DeepSeek开源周收官,V3/R1推理系统概览于知乎独家发布
2025/03/03 16:22AI云资讯13600
3月1日,DeepSeek于知乎开设官方账号,独家发布《DeepSeek-V3/R1推理系统概览》技术文章,首次公布模型推理系统优化细节,并披露成本利润率关键信息,标志着全球关注的“DeepSeek开源周”正式收官。不久前,月之暗面、微软研究院、清华大学、阶跃星辰等开源项目参与者,均在知乎分享研究成果和经历。知乎一直是AI从业者和创业者密度最高的社区,此次DeepSeek选择知乎作为开源发布的最后一站,进一步引领了全网最重要的AI趋势发布。

作为“DeepSeek开源周”的收官之作,DeepSeeK知乎官方账号正式亮相,并发布文章详述V3/R1推理系统。文章写道:“DeepSeek-V3 / R1 推理系统的优化目标是:更大的吞吐,更低的延迟。”为实现这两个目标,DeepSeek的方案是使用大规模跨节点专家并行(EP),但该方案也增加了系统复杂性。文章的主要内容就是关于如何使用EP增长批量大小(batch size)、隐藏传输耗时以及进行负载均衡。
值得一提的是,文章还率先披露了DeepSeek的成本和利润率等关键信息。“假定GPU租赁成本为2美金/小时,总成本为$87,072/天。……如果所有 tokens全部按照DeepSeek R1的定价计算,理论上一天的总收入为$562,027,成本利润率545%。”

据了解,“DeepSeek开源周”自2月24日至2月28日,陆续开源最新技术进展。其中包括,FlashMLA、DeepEP、DeepGEMM和3FS四个开源项目,以及DualPipe、EPLB等代码库。每一项开源发布,都在知乎引发了业内人士的热烈讨论和赞叹。
“话不多说,DeepSeek和OpenAI一样重要。”知乎大模型话题优秀答主、算法工程师“刘聪NPL”如此评价。业内人士甚至认为,“DeepSeek开源周”的重要性已经超过了不久前OpenAI的发布会。DeepSeek用“量大管饱”的开源有力回击了欧美关于DeepSeek故意说低训练成本的说法,并且证明了在训练链路上存在极大的优化空间。“刘聪NPL”在开源周最后一天就感叹:“真没想到,最后一天DeepSeek对存储下手啊!”而知乎编程话题优秀答主“平凡”在第三天就做出判断:“这些工作几乎不可能在国外的AI公司里面完成。”
此次收官文章再次点燃了知乎对AI的讨论热情,相关问题下从业者云集。事实上,“发完论文,上知乎亲自答”,已成为人工智能研究者的风潮。2月20日,月之暗面开源MoBA框架研发人员鹿恩哲、苏剑林分别在知乎讲述了研发思路,引发了业界对“稀疏注意力”框架的讨论。与此同时,微软研究院、清华大学团队以及阶跃星辰开源模型参与者,均发文分享研究了各自成果与历程。这被业界称为继模型开源、论文开源之后的一次“思维链开源”。
知乎囊括了最广泛的互联网、AI、机器人等科技领域的从业者,是从业者最青睐的交流场所和思想碰撞的前沿阵地。此次,全球瞩目的DeepSeek将知乎作为了开源周的最后一站,更印证了知乎作为AI讨论第一阵地的独特平台价值。
相关文章
- 做表格AI又升级了!数以轻舟Agent V3.2:当Deepseek V4 Pro遇上百万
- 时的科技黄雍威:载人eVTOL已成为新势力,进入下一个DeepSeek时刻
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 追觅硅谷发布的高光时刻:中国智造Deepseek时刻已经来临 商业范式面临巨大变革
- 国产算力×国产模型,联想开天工作站全面适配 DeepSeek V4!
- 金融智能新跨越:中国银联依托昇腾算力率先完成DeepSeek-V4私有化部署
- 探索“数算模用“一体化发展,超算互联网加速DeepSeek V4赋能千行百业
- 显示龙头卡莱特完成DeepSeek V4在昇腾平台验证,国产大模型工程化落地提速
- 超算互联网推出限时免费DeepSeek-V4对话服务 零门槛解锁百万Token体验
- DeepSeek-V4 上线国家超算互联网:以普惠算力与开发者共逐AI新浪潮
- 每日互动个知·智能工作站率先接入DeepSeek-V4
- 元戎启行冲刺百万级交付,前DeepSeek核心成员阮翀将亮相北京车展
- “马”上有Token,联通云“万亿”免费送!——联通云×OpenClaw+DeepSeek,零成本解锁灵活办公新方式
- 开箱即用、安全无忧!麒麟信安全国产化智算一体机发布,高效赋能DeepSeek大模型应用实践
- DeepSeek最火Engram怎么跑?英特尔至强+AMX实测:性能提升达1.67倍!
- “工业版DeepSeek”,安世亚太精智 iGPT 工业大模型平台荣获国家工业大模型最高评级
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









