AI虚拟主播亮相世界互联网大会
2018-11-07 16:23:51AI云资讯2191
11月7日,第五届世界互联网大会在浙江乌镇拉开帷幕,在开幕当天,搜狗公司CEO王小川、新华社副社长刘思扬等嘉宾和著名主持人邱浩联合带来了一场跨界产品发布会:搜狗与新华社合作开发、全球第一个全仿真智能虚拟主持人——“AI虚拟主播”正式亮相。而随着“AI虚拟主播”的发布,搜狗未来人工智能的核心技术“搜狗分身”也终于浮出水面,成为大会开幕日的最大亮点之一。

图片由搜狗公司提供
“AI虚拟主播”到底是什么?主播长什么样?在发布会现场的体验中,观众只要输入一句既有的新闻文本,屏幕上就会出现一位虚拟的新华社新闻主播,他不仅会用和真人一样的声音进行播报,连唇形、面部表情也能完全吻合。这样的视频效果,无论看上去还是听起来,都与现实中的新华社主播的本人播报没有太大差别。
据了解,在虚拟主播的开发过程中,搜狗公司的相关技术人员同新华社的新闻主播一同进行了各种探索尝试,在“搜狗分身”技术的支持下,通过人脸关键点检测、人脸特征提取、人脸重构、唇语识别、情感迁移等多项前沿技术,并结合语音、图像等多模态信息进行联合建模训练后,“AI虚拟主播”正式诞生。
随着“AI虚拟主播”系统的成功上线,支撑其正常运转的核心“搜狗分身”也引起了大家的广泛关注。那么什么是“搜狗分身”技术?
据搜狗公司智能语音事业部总经理王砚峰介绍,“搜狗分身”技术是搜狗人工智能的核心技术之一,诞生于搜狗“自然交互+知识计算”这一人工智能理念之下。该技术能够利用搜狗的AI能力,从图像表情,声音语言习惯,逻辑思维等层面对AI进行拟人化训练,然后克隆制造人类的AI分身,进而帮助人类提高信息表达和传递的效率。
以“AI虚拟主播”为例,该产品就创造性的使用新华社中、英文主播的真人形象,配合“搜狗分身”的语音、合成等技术模拟真人播报画面,使大众享受到逼真度极高的图像效果。这种播报形式,突破了以往语音图像合成领域中,只能单纯创造虚拟形象,并配合语音输出唇部效果的约束,极大地提高了观众信息获取的真实度。同时,利用“搜狗分身”技术,“AI虚拟主播”还能实时高效地输出音视频合成效果。在“搜狗分身”技术的支持下,使用者通过文字键入、语音输入、机器翻译等多种方式输入文本后,将获得实时的播报视频。这种操作方式将极大减少新闻媒体在后期制作的各项成本,让新闻视频的制作效率有了极大的提高。
在与新华社等媒体的合作中,搜狗依托“搜狗分身”技术,通过“AI虚拟主播”这一创新的信息传播形式,帮助媒体在融媒体转型、新闻时效性和跨语种传播能力等方面再上台阶。
“搜狗分身”技术实现了在不同场景下更为自然的人机交互,除了在媒体融合领域的应用外,未来还将在娱乐、医疗健康、教育、法律等多个领域提供个性化的内容。
相关文章
- 阳台储能开创者疆海科技完成数亿元 B 轮融资,押注 AI 时代的家庭能源中心
- 开源!鲸智百应升级,浩鲸科技重新定义企业AI原生
- 万兆AI惠商 联通美好未来 ——中国联通东莞市分公司5・17 电信日暨联通客户日活动圆满举行
- 中国联通在北京地区携手华为发布3000M宽带新产品,全光臻宽带矩阵为“双万兆AI提质行动”添砖加瓦
- 超显商城整合核心GLED显示技术,开启显示设备AI定制新模式
- 博大数据荣膺“全球AI生态基石大奖”,夯实融合算力基础设施服务商领先地位
- 全国人工智能发展大会 AI HANGZHOU 2026中国(杭州)国际人工智能展览会
- 酷开发布企业AI操作系统 开启硅基管理新时代
- 酷开AIOS:定义“企业AI操作系统”的野心与挑战
- 华为超千兆新品亮相山西!三频Wi-Fi 7+AI 焕新智慧家庭新生活
- 辽宁与华为联合发布超千兆三频Wi-Fi 7+AI 新品,共筑辽沈智慧家庭新生活
- 亿达科创亮相国际人工智能展再获AI大奖
- 花旗银行报告称,台积电在AI领域的主导地位不会受到英特尔威胁
- 华为云创想者大会主题论坛议程公布:释放Agentic AI新布局
- 与AI同行 3000M助力 共创智家新生活——中国联通品牌与产品辽宁宣传推广会 全面启动联通社区惠民行系列行动
- 以创新设计重塑 AI 路由未来,MOVA LINCO X1 Pro 荣膺红点奖
人工智能企业
更多>>人工智能硬件
更多>>人工智能产业
更多>>人工智能技术
更多>>- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠
- Seedance 2.0面向企业公测,豆包大模型日均Token使用量突破120万亿
- 端到端OCR模型第一!百度千帆Qianfan-OCR正式发布
- 云知声Unisound U1-OCR大模型发布!首个工业级文档智能基础大模型,开启OCR 3.0时代
- 基石智算上线 MiniMax M2.5,超强编程与智能体工具调用能力
- 昇腾原生支持,科学多模态大模型Intern-S1-Pro正式发布并开源









