DeepMind人工智能学会将平面图像转换为3D场景
2018/07/01 21:19AI云资讯10880
据外媒报道,谷歌母公司Alphabet旗下DeepMind最近开发了一种人工智能技术,它可以在观察2D平面图像之后以3D渲染整个场景。目前一些人工智能研究人员正在试图教机器学习像人类一样。我们不是以像素为单位看世界,而是环顾我们的环境并对其中的一切进行假设。

DeepMind团队则训练了一个人工智能如何从其未见的角度猜测事物的样子。 DeepMind的科学家提出了一个生成查询网络(Generative Query Network,GQN),这是一个神经网络,旨在教人工智能如何从不同的角度想象物体的场景会是什么样子。基本上,人工智能观察场景的2D平面图像,然后尝试重新创建它。在这种情况下,重要的是DeepMind的人工智能不使用任何人为标记的输入等。它只观察三幅图像,并开始预测场景的3D版本是什么样子。
研究人员正在努力实现“完全无监督的场景理解”。目前人工智能尚未接受真实世界的图像训练,因此下一步将从照片中渲染逼真的场景。未来,DeepMind基于GQN的人工智能可能只使用照片就可以生成与现实世界几乎完全相同的按需3D场景。
相关文章
- DeepMind开发AI程序员,称可达人类中等水平
- DeepMind最新论文:强化学习“足以”达到通用人工智能
- DeepMind进军多伦多,以寻找优秀的人工智能研究人员
- DeepMind巨亏42亿,AI公司为何难有“好下场”?
- 首届剑桥国际青年学术论坛开幕 第四范式携手DeepMind、华为共话AI技术革新
- DeepMind首次在所有57款雅达利游戏上超越人类玩家
- DeepMind研究人员研发出了一种解决机器人控制问题的混合方案
- 谷歌的DeepMind在医学上采用了人工智能的混合路径
- DeepMind联合创始人离职加入谷歌 曾负责健康团队
- Waymo合作DeepMind AI算法开发速度提升1至2倍
- Google和DeepMind正在使用人工智能来预测风电场的能源输出
- 谷歌人工智能DeepMind,高中数学考了个不及格
- 谷歌和DeepMind最新成果:使用人工智能软件预测并提高风能“价值”
- DeepMind一直想做的事,彩云科技做到了!
- 谷歌人工智能公司 DeepMind 介绍阿尔法狗升级版 AlphaZero
- 和 DeepMind 一起考虑如何在 AI 中重现人类的价值观
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 阶跃这次够狠:AA 全球开源前二,价格打到 Claude 的 1/8
- 科大讯飞发布Spark-Audio-1.0-Preview,全国产语音基座大模型实现从“听清”到“听懂”
- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练









