谷歌DeepMind的新型AI模型可通过网络搜索帮助机器人完成任务
2025/09/26 05:59AI云资讯14308

(AI云资讯消息)谷歌DeepMind表示,其升级后的人工智能模型使机器人能够完成更复杂的任务,甚至能借助互联网寻求帮助。谷歌DeepMind机器人技术负责人卡罗莱娜·帕拉达(Carolina Parada)表示,该公司的新AI模型可协同工作,让机器人在物理世界采取行动前能够提前规划多个步骤。
该系统由新发布的Gemini Robotics 1.5及具身推理模型Gemini Robotics-ER 1.5驱动,这些是谷歌DeepMind 3月份推出的AI模型的升级版本。如今机器人不仅能完成折纸或拉开包链的单一任务,还能实现按深浅色分类洗衣、根据伦敦实时天气整理行李箱、甚至通过针对当地规定的网络搜索来协助人们分类垃圾、堆肥物和可回收物等复杂操作。
帕拉达表示:"此前发布的模型能够以非常通用的方式,每次精准执行单一指令。而通过此次升级,我们正从单一指令执行迈向对实体任务的真正理解与问题解决。"
首先,机器人利用升级后的Gemini Robotics-ER 1.5模型感知周围环境,并通过谷歌搜索等数字工具获取更多信息。随后,Gemini Robotics-ER 1.5会将检索结果转化为自然语言指令传递给Gemini Robotics 1.5模型,使机器人能够借助该模型的视觉与语言理解能力逐步执行任务。

此外,谷歌DeepMind宣布,Gemini Robotics 1.5能帮助不同配置的机器人实现相互学习。研究发现,面向ALOHA2双机械臂机器人训练的任务,可直接应用于双臂Franka机器人及Apptronik的人形机器人Apollo。谷歌DeepMind软件工程师卡尼什卡·拉奥(Kanishka Rao)在发布会上表示:"我们实现了两大突破:一是能用单一模型控制包括人形机器人在内的多种机器人;二是某台机器人习得的技能现在可以迁移至其他机器人。"
谷歌DeepMind已通过Google AI Studio中的Gemini API向开发者开放Gemini Robotics-ER 1.5模型,而Gemini Robotics 1.5目前仅限特定合作伙伴访问。
相关文章
- 谷歌 AI 核心管理层迎来重大调整,负责人戴密斯·哈萨比斯卸任
- 谷歌 DeepMind 推出新一代 AI 模型,能够操控机器人的全身躯体
- 英伟达与微软牵头成立开放AI安全联盟,OpenAI、谷歌及Anthropic均未加入
- 谷歌携手联发科打造下一代TPUv9芯片,将CPU与计算晶粒合封于一体,助力AI智能体发展
- 谷歌投资A24,共同开发人工智能电影制作工具
- 数据中心耗电远超电网负荷,迫使英伟达与谷歌在2026年第三季度前启动800V直流电架构改造
- 苹果和谷歌新增对Thread 1.4的支持
- 宜选科技出席2026谷歌合作伙伴峰会
- 苹果在新版Siri上作出妥协:依靠英伟达B200 GPU加密技术,防止谷歌窃取用户数据
- 谷歌Beam抢滩多人会议全息赛道,微美全息以AI+5G解锁虚实融合视觉新想象
- Google I/O 2026亮点回顾:晶晨股份携手谷歌共拓端侧AI新生态
- 谷歌搜索的人工智能进化包含更多广告
- 谷歌的未来是一个无所不能的搜索框
- Google I/O 2026:Gemini 将成为谷歌年度开发者大会的主角
- 2026智能眼镜“百镜争鸣”,谷歌/阿里/微美全息引领AR/XR产业全面升级
- 谷歌发布 Chromebook 后继产品——Googlebook
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









