英伟达Rubin芯片落地谷歌A5X实例,多站点集群规模扩展至近百万颗GPU
2026/04/28 05:58AI云资讯19572

(AI云资讯消息)谷歌与英伟达联手,为用户提供高达100万颗英伟达GPU的接入能力,为全新推出的A5X实例提供算力支持。此次发布是双方最新合作,旨在降低推理成本并提升token吞吐量。谷歌A5X系统依托英伟达的网络加速器,能够构建支持AI工作负载的单集群及多集群计算基础设施。
A5X实例是谷歌专为运行智能体类人工智能工作负载而设计的最新产品,属于谷歌AIHypercomputer产品组合的一部分,该组合也为谷歌的Gemini平台及其面向消费者和企业的AI产品提供算力支持。在最新发布的一系列公告中,谷歌宣布对Hypercomputer进行多项升级,包括由定制化Arm架构CPU驱动的新型虚拟机、第八代张量处理器、对PyTorch的原生TPU支持,以及A5X实例。
这些新功能专为智能体类AI工作负载而设计,此类负载依赖一组AI智能体,以分步协作的方式解决某个问题或完成任务。A5X实例是谷歌首批基于英伟达最新Vera Rubin AI GPU设计的产品。

根据披露的细节,A5X将采用英伟达ConnectX-9智能网卡,该网卡专为在以太网运行的云基础设施中加速AI工作负载而设计。这些网卡配合谷歌的Virgo平台,将使用户能够在单个集群中接入多达8万颗Rubin GPU,在多站点集群中接入多达96万颗GPU。
谷歌的Virgo平台能够将同一数据中心内的多颗AI芯片互联互通。该平台不仅兼容英伟达的RubinGPU,还支持谷歌自家的张量处理器(TPU)。Virgo可在单个数据中心内连接多达13.4万颗TPU,跨多个站点则可连接超过100万颗芯片。据英伟达称,与上一代产品相比,A5X实例能够将每token的推理成本降低10倍,并将每兆瓦的吞吐量提升10倍。
英伟达还简要提及了物理AI与工业AI领域,透露Cadence和Siemens等公司的产品由其基础设施提供支持,并已在Google Cloud上线。该公司补充说,谷歌的Gemini平台还能在网络安全等行业部署智能体模型和工作流。相关文章
- 英伟达图形研究亮相SIGGRAPH 2026:21项突破性技术加速仿真与物理AI
- SpaceX向富士康下了520亿美元的巨额订单,采购搭载英伟达GB300芯片的AI服务器机架
- 英伟达Rubin全液冷时代,川润股份“算力液冷+绿色能源”全链条闭环服务卡位千亿赛道
- AMD EPYC Venice处理器到2027年将以675万颗的出货量超越英伟达Vera CPU
- 英伟达称其AI数据中心采用高温运行设计,可大幅减少用水量
- 英伟达抢建物理AI算力工厂,微美全息(WIMI.US)锚定芯片赛道掀起GPU热潮!
- 云工场科技加快多元智算布局,构建 AMD、沐曦、英伟达协同算力体系
- 数据中心耗电远超电网负荷,迫使英伟达与谷歌在2026年第三季度前启动800V直流电架构改造
- 苹果在新版Siri上作出妥协:依靠英伟达B200 GPU加密技术,防止谷歌窃取用户数据
- 英伟达发布RTX Spark芯片,高调杀入PC市场
- 维谛(Vertiv)将在COMPUTEX展示首个面向英伟达NVIDIA Omniverse DSX Blueprint的全融合物理基础设施数字孪生能力
- AI驱动量子计算风口已至!英伟达/微美全息抢占高地锁定量子生态席位!
- 英伟达首席财务官调侃竞争对手因存储芯片短缺措手不及
- SpaceXAI宣布将向Anthropic开放搭载22万张英伟达GPU的巨像一号超级计算机
- OpenAI宣布与AMD、英伟达、英特尔、微软及博通达成超级合作,合力加速AI发展
- Anthropic看中英国初创公司融合技术,以仅英伟达Groq十分之一的成本,实现百倍速度的AI推理
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









