英伟达Blackwell平台为AI推理工作负载带来全新水平的Token优化
2026/02/13 08:40AI云资讯19574

(AI云资讯消息)在英伟达竞相构建AI领域新基础设施的过程中,公司最大的关注点始终是提升所部署硬件的效率。随着经Blackwell训练的前沿AI模型陆续面世,英伟达在Token输出与成本控制方面的取得重大进步。在最新发布的博文中,英伟达公司透露正携手企业客户共同扩展Blackwell性能,并展示了相较Hopper架构高达十倍的显著提升。
在探讨Blackwell的Token经济时,英伟达特别提及了贝斯腾(Baseten)、Sully.ai以及专注游戏领域的DeepInfra和Latitude等企业。对于每家公司而言,Blackwell架构都使其得以实现更低延迟、最优推理成本及稳定可靠的响应,这正是该技术栈成为当今主流AI公司首选方案的原因。即便在多智能体工作流与部署专用AI代理的场景中,SentientLabs公司也实现了相较Hopper架构25%至50%的成本效益提升。
英伟达Blackwell AI架构的突破源于其极限协同设计策略,这一方法论与当今的MoE架构高度契合。通过GB200 NVL72,英伟达采用72芯片配置搭配30TB高速共享内存,将专家并行技术推至全新高度,确保Token批次在GPU间持续拆分分发,并使通信量呈非线性增长。这正是Token经济将在Blackwell平台达到巅峰效率的关键原因。
展望Vera Rubin,英伟达计划通过架构革新、针对预填充的CPX等专用机制,将基础设施效能提升至全新维度。AI世界正以势不可挡的速度进化,这警示我们:硬件优化与硬件创新同等重要。相关文章
- 英伟达上季度营收破960亿,数据中心成绝对主力
- SpaceX AI加码英伟达Vera平台,借力Vera CPU与Vera Rubin服务器加速自主AI
- 告别交流电!英伟达800伏直流电方案攻克供电瓶颈,算力迎爆发式增长
- 英伟达Kyber机架配备340.4TB内存,HBM4E单价19.76美元/GB,单机架售价高达4160万美元
- 英伟达与微软牵头成立开放AI安全联盟,OpenAI、谷歌及Anthropic均未加入
- 英伟达缩减Vera Rubin芯片内存配置,因HBM4成本高涨将占单机架总成本29%
- 英伟达图形研究亮相SIGGRAPH 2026:21项突破性技术加速仿真与物理AI
- SpaceX向富士康下了520亿美元的巨额订单,采购搭载英伟达GB300芯片的AI服务器机架
- 英伟达Rubin全液冷时代,川润股份“算力液冷+绿色能源”全链条闭环服务卡位千亿赛道
- AMD EPYC Venice处理器到2027年将以675万颗的出货量超越英伟达Vera CPU
- 英伟达称其AI数据中心采用高温运行设计,可大幅减少用水量
- 英伟达抢建物理AI算力工厂,微美全息(WIMI.US)锚定芯片赛道掀起GPU热潮!
- 云工场科技加快多元智算布局,构建 AMD、沐曦、英伟达协同算力体系
- 数据中心耗电远超电网负荷,迫使英伟达与谷歌在2026年第三季度前启动800V直流电架构改造
- 苹果在新版Siri上作出妥协:依靠英伟达B200 GPU加密技术,防止谷歌窃取用户数据
- 英伟达发布RTX Spark芯片,高调杀入PC市场
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









