英伟达发布开源AI模型Neomotron 3 Nano Omni,性能提升高达9倍
2026/04/29 05:59AI云资讯14804

(AI云资讯消息)4月28日,英伟达发布的Nemotron 3 Nano Omni是一款开源多模态模型,将这些能力整合于单一系统之中,使智能体能够跨视频、音频、图像和文本进行高级推理,提供更快、更智能的响应。这一顶尖模型为企业与开发者打造了一条生产路径,能够构建更高效、更精准的多模态AI智能体,同时具备充分的部署灵活性和掌控力。
Nemotron 3 Nano Omni为开源多模态模型树立了全新的效率标杆,凭借领先的准确率与低成本,在复杂文档智能、视频及音频理解等六项权威榜单中拔得头筹。
已采用Nemotron 3 Nano Omni的人工智能及软件公司包括Aible、应用科学智能(ASI)、Eka Care、富士康、H Company、Palantir和Pyler,此外,戴尔科技、DocuSign、Infosys、K-Dense、Lila、甲骨文和Zefr也正在对该模型进行评估。
Nemotron 3 Nano Omni 在其 30B-A3B 混合专家架构中融合了视觉与音频编码器,无需再使用独立的感知模型,从而大幅提升大规模推理效率。在保持高效率的同时,该模型还具备出色的多模态感知精度,使 AI 系统能够在同等的交互水平下,实现比其他开源全模态模型高出 9 倍的吞吐量。这意味着在不牺牲响应速度或质量的前提下,降低成本、提升可扩展性。
在智能体系统中,Nemotron 3 Nano Omni 可与专有云端模型、英伟达其他Nemotron 开源模型(如用于高频执行的 Nemotron 3 Super 或用于复杂规划的 Nemotron 3 Ultra)以及其他供应商的专有模型协同工作,为计算机操作、文档智能和音视频推理等智能体工作流中的子智能体提供支持。
计算机操作智能体——Nemotron 3 Nano Omni 为导航图形用户界面的智能体提供感知循环支持,能够对屏幕内容进行推理,并随时间推移理解用户界面的状态变化。H Company 最新的计算机操作智能体由 Nemotron 3 Nano Omni 驱动,采用 1920×1080 像素的原生输入分辨率,实现高保真视觉推理。在 OSWorld 基准测试的初步评估中,这一集成方案在导航复杂图形界面方面实现了显著飞跃,并充分发挥了 Nemotron 3 Nano Omni 处理超高分辨率图像的能力。
文档智能——能够解读文档、图表、表格、截图及混合媒体输入,使智能体能够连贯地跨视觉结构和文本内容进行推理。这对于企业分析和合规工作流至关重要。
音频与视频理解——在客户服务、研究和监控工作流中,Nemotron 3 Nano Omni 能够保持音视频上下文,将所说的内容、所显示的内容和所记录的内容整合为统一的推理流,而非割裂的摘要。
相关文章
- 英伟达与微软牵头成立开放AI安全联盟,OpenAI、谷歌及Anthropic均未加入
- 英伟达缩减Vera Rubin芯片内存配置,因HBM4成本高涨将占单机架总成本29%
- 英伟达图形研究亮相SIGGRAPH 2026:21项突破性技术加速仿真与物理AI
- SpaceX向富士康下了520亿美元的巨额订单,采购搭载英伟达GB300芯片的AI服务器机架
- 英伟达Rubin全液冷时代,川润股份“算力液冷+绿色能源”全链条闭环服务卡位千亿赛道
- AMD EPYC Venice处理器到2027年将以675万颗的出货量超越英伟达Vera CPU
- 英伟达称其AI数据中心采用高温运行设计,可大幅减少用水量
- 英伟达抢建物理AI算力工厂,微美全息(WIMI.US)锚定芯片赛道掀起GPU热潮!
- 云工场科技加快多元智算布局,构建 AMD、沐曦、英伟达协同算力体系
- 数据中心耗电远超电网负荷,迫使英伟达与谷歌在2026年第三季度前启动800V直流电架构改造
- 苹果在新版Siri上作出妥协:依靠英伟达B200 GPU加密技术,防止谷歌窃取用户数据
- 英伟达发布RTX Spark芯片,高调杀入PC市场
- 维谛(Vertiv)将在COMPUTEX展示首个面向英伟达NVIDIA Omniverse DSX Blueprint的全融合物理基础设施数字孪生能力
- AI驱动量子计算风口已至!英伟达/微美全息抢占高地锁定量子生态席位!
- 英伟达首席财务官调侃竞争对手因存储芯片短缺措手不及
- SpaceXAI宣布将向Anthropic开放搭载22万张英伟达GPU的巨像一号超级计算机
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









