谷歌开发强化学习框架以培训人工智能模型
2018-08-29 17:07:51AI云资讯1930
谷歌正在开发一个用于项目的强化学习框架来培训人工智能模型。
强化学习已经被应用于迄今为止最令人印象深刻的人工智能演示,包括那些在Alpha Go和Dota 2中击败了人类职业玩家的演示。谷歌子公司DeepMind将其用于其Deep Q-Network(DQN)。
建立一个强化学习框架需要时间和大量的资源。为了使人工智能充分发挥其潜力,它需要变得更容易获取。
从今天开始,谷歌正在开发一个基于TensorFlow的开源强化框架——它的机器学习库——可以在GitHub上找到。
谷歌大脑研究人员Pablo Samuel Castro和Marc G. Bellemare在一篇博客文章中写道:
“灵感来自于大脑中奖赏激励行为的一个主要组成部分,反映了神经科学与强化学习研究之间的强烈历史联系,这个平台的目的是为了促成一种能够推动重大发现的投机性研究。”
“这个版本还会说明如何使用我们的框架。”
谷歌的框架设计有三个重点:灵活性、稳定性和再现性。
该公司为学习环境提供了15个代码示例——一个使用视频游戏来评估人工智能技术性能的平台——以及四个不同的机器学习模型:C51、前面提到的DQN、隐式量子网络和彩虹代理。

强化学习是最有效的训练方法之一。如果你在训练一只狗,把它作为对你想要的行为的奖励,这是在实践中积极强化的一个关键例子。
培训一台机器是一个类似的概念,奖励被保留为1和0,而不是商品或薪水。
“我们希望,我们的框架的灵活性和易用性将使研究人员能够尝试新的想法,无论是渐进的还是激进的,”Bellemare和Castro写道。“我们已经在积极地将它用于我们的研究,并发现它给了我们快速迭代许多想法的灵活性。”相关文章
- 谷歌搜索的人工智能进化包含更多广告
- 谷歌的未来是一个无所不能的搜索框
- Google I/O 2026:Gemini 将成为谷歌年度开发者大会的主角
- 2026智能眼镜“百镜争鸣”,谷歌/阿里/微美全息引领AR/XR产业全面升级
- 谷歌发布 Chromebook 后继产品——Googlebook
- 谷歌称其首次发现并阻止了一个利用AI开发的零日漏洞
- 谷歌首款AI眼镜即将呼之欲出,微美全息(WIMI.US)扎实推进AI+AR生态落地
- 谷歌母公司发布2026年一季度财报,搜索查询量创下历史新高
- 英伟达Rubin芯片落地谷歌A5X实例,多站点集群规模扩展至近百万颗GPU
- Siri悄然接入Gemini大模型,苹果反成谷歌云2026 Next大会主角
- 联合谷歌共建:戴盟发布数百万小时触觉具身数据集
- 谷歌将Marvell纳入双芯片TPU计划,ASIC AI推理格局或将重塑
- 谷歌推出Mac版Gemini人工智能应用
- Meta闭源模型Muse Spark登场,谷歌/微美全息加码投入开源AI“严阵以待”
- 谷歌正式接管母公司Alphabet旗下机器人软件企业Intrinsic
- 谷歌云客户业务负责人重返微软,出任安全主管
人工智能企业
更多>>人工智能硬件
更多>>人工智能产业
更多>>人工智能技术
更多>>- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠
- Seedance 2.0面向企业公测,豆包大模型日均Token使用量突破120万亿
- 端到端OCR模型第一!百度千帆Qianfan-OCR正式发布
- 云知声Unisound U1-OCR大模型发布!首个工业级文档智能基础大模型,开启OCR 3.0时代
- 基石智算上线 MiniMax M2.5,超强编程与智能体工具调用能力
- 昇腾原生支持,科学多模态大模型Intern-S1-Pro正式发布并开源









