OpenAI首次采用Cerebras的AI芯片运行Codex模型,成功实现了每秒1000次事务处理量
2026/02/14 09:17AI云资讯22222

(AI云资讯消息)Cerebras的AI芯片首次获得主流采用,而采用者正是OpenAI。OpenAI透露,他们最新的Codex模型除了使用英伟达的算力外,还增加了另一家算力供应商。
在最新的Codex版本发布中,OpenAI透露,GPT-5.3-Codex-Spark模型正是由Cerebras的AI芯片提供动力,使用该硬件相比其他方案的优势在于推理任务中的低延迟。在此次算力选择中,OpenAI间接宣告了在推理领域出现了一个可以抗衡英伟达的对手。
主流Codex模型与这里的Spark变体之间的区别在于,OpenAI称设计目的在于即刻完成工作。通过优化流程管道,借助Cerebras的硬件,GPT-5.3-Codex-Spark在模型延迟方面取得了重大改进。OpenAI声称,此版本将首字生成时间即从输入到输出第一个字的时间缩短了50%,这无疑是一个惊人的数据。Codex-Spark运行在Cerebras的晶圆级引擎3(Wafer Scale Engine 3)上。晶圆级引擎3采用台积电5nm制程节点,AI优化的可编程处理核心架构,约有4万亿晶体管数量,90万个AI优化核心,内存带宽达21PB/s,属于完整的300mm晶圆级芯片。
至于OpenAI为何选择Cerebras作为此次的算力供应商,原因有多方面。但其中最重要的一点是,借助晶圆级引擎3,OpenAI获得了惊人的内存带宽,这对于编码这类内存密集型任务至关重要。这也是为什么Codex-Spark能够实现每秒1000次事务处理,据称其响应速度可以媲美人类结对编程伙伴的原因。考虑到Blackwell架构更侧重于批量处理而非低延迟,若在英伟达的基础设施上训练Spark模型,在经济上并不划算,而这正是Cerebras在此场景下更具优势的原因。
当然在大规模推理方面,英伟达在Token经济中还是占据主导地位。英伟达Blackwell架构已将Token成本降低多达10倍。OpenAI的萨钦·卡蒂(SachinKatti)表示,与Cerebras的合作是为了增加互补能力,但在OpenAI的算力竞赛中,其核心忠诚度仍然完全倾向于英伟达。不过,通过Codex-Spark可以清晰地看到,当前的瓶颈在于延迟。而在硬件层面,英伟达的技术栈并未准备好主导这一领域。
鉴于Cerebras只是该领域内一个强大的竞争对手,此外还有来自ASIC制造商以及像AMD这样的竞争者所提供的新兴解决方案,看看推理市场未来将如何定位英伟达,只能拭目以待了。相关文章
- OpenAI推出自研智能体Dots,对标Meta热度高涨的Muse AI
- OpenAI 智能体尝试暴力破解联合国网站
- 安全研究员利用 Claude 入侵 OpenAI
- 英伟达黄仁勋称:OpenAI 耗资近 10 亿美元的 GPT‑6 Astra 宣告 AGI 时代到来
- OpenAI GPT‑6 Astra 催生海量本地 CPU 智能体,为英特尔与 AMD 带来需求红利
- 受 Hugging Face 遭黑客攻击事件影响,OpenAI 推迟新模型研发
- 英伟达百亿押注OpenAI算力基地,潜在回报或达两千亿美元
- OpenAI的Bel模型参数突破10万亿,或成全球首个AGI门槛级基座
- OpenAI公布安全升级方案,避免安全事故重演
- IPO前夕,OpenAI解散安全预备团队
- OpenAI一周内连失两位核心高管:首席营收官继首席运营官离职后也提出请辞
- OpenAI总裁:将为 AI 聊天机器人打造全系硬件产品矩阵
- 英伟达与微软牵头成立开放AI安全联盟,OpenAI、谷歌及Anthropic均未加入
- OpenAI推出ChatGPT Health,AI将重塑医疗
- 微软拟在Copilot中用月之暗面Kimi K3替换OpenAI和Anthropic的模型,有望节省6亿美元
- OpenAI推出专为Codex打造的配套硬件产品
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 阶跃这次够狠:AA 全球开源前二,价格打到 Claude 的 1/8
- 科大讯飞发布Spark-Audio-1.0-Preview,全国产语音基座大模型实现从“听清”到“听懂”
- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练









