科大讯飞AI播报员:中关村论坛年会上的“声音”担当
2024-05-02 06:48:00AI云资讯1161
在刚刚落幕的2024年中关村论坛年会上,来自全球100多个国家和地区、150余家外国政府部门和国际组织机构的上百位顶尖专家、上千名演讲嘉宾齐聚一堂,世界的目光聚焦中国,共同见证一场科技创新的盛宴。
全球首个通用人工智能系统原型“通通”、驾驭激光的利器“转角菱方氮化硼”材料、拓展“心有灵犀”边界的“北脑二号”智能脑机系统……在2024中关村论坛年会重大成果发布环节,10项具有创新性、前瞻性、颠覆性的重大科技成果亮相,涉及基础研究、前沿技术、科技基础设施等各方面。
“就像是真人在说话一样。”科大讯飞运用先进的语音合成技术,为成果亮相视频环节进行AI配音,为传统会议模式带来了创新突破。
借助深度学习技术,科大讯飞将文本转化成拟人化的语音,赋予机器像人一样自然流畅说话的能力,成为语音交互、语音翻译的关键接口能力。

作为人工智能领域的龙头企业,科大讯飞在智能语音技术领域的深耕已有25年之久。自上世纪90年代开始探索语音领域以来,科大讯飞始终坚持源头技术创新,连续14年蝉联国际语音合成大赛冠军,并在语音识别、机器翻译等领域多次在国际大赛上夺冠。
如今,科大讯飞不仅将中文语音技术做到了最好,还将多语种语音技术做到了最好。2020年,科大讯飞60个语种的语音识别、翻译和37个语种的语音合成技术已达到国际领先水平,超越了谷歌、微软等国际巨头,达到国际领先水平。2021年,科大讯飞在美国国家标准与技术研究院NIST发起的国际低资源多语种语音识别竞赛OpenASR中,获得全部受限赛道的15个语种冠军及7个语种非受限赛道冠军。目前,科大讯飞的多语种技术已经可以满足60余种语言的智能语音技术需求。
今年1月份,科大讯飞结合语音属性解耦、多语种共享建模等技术创新发布讯飞星火语音大模型,在多语种语音识别方面首批37个主流语种效果超过OpenAI Whisper V3。星火语音大模型首批覆盖语种中,24个主要语种识别率达到了90%,13个重点语种识别率更是超过了94%。在多语种语音合成能力方面,27个主要语种MOS评分达到了4.4,13个重点语种MOS评分高达4.6。
4月26日,讯飞星火大模型V3.5春季上新,科大讯飞发布业界首个支持长文本、长图文以及长语音的大模型产品。在此次升级中,面对广泛的音视频信息高效获取需求,科大讯飞推出长语音功能,将语音识别和翻译技术结合起来,可以实现会议录音、学习视频等的一键研读,实现音视频场景的高效知识获取。
科大讯飞进一步升级星火语音大模型,首发多情感超拟人合成,情绪表达的可感知度达到 85% 以上,对高兴、抱歉、安慰、撒娇、困惑等语气表达更加生动,可以满足用户在各种场景下的自我减压、释放情绪等需求,并推出一句话声音复刻功能。
在2024中关村论坛年会上,科大讯飞智能语音技术的出色表现,展示了中国科技企业在人工智能领域的技术实力和创新能力。在科大讯飞等中国企业的努力下,智能语音技术将为人类带来更多便捷和智慧,引领科技创新的未来。
相关文章
- 科大讯飞发布玲珑Agent OS,让AI真正走进企业核心业务流
- 2026中国翻译协会年会召开,科大讯飞携多语言AI翻译产品矩阵亮相并获评5A级企业认证
- 科大讯飞佛山人工智能产业基地正式启用,助力南海构建AI产业生态
- 科大讯飞重磅布局智能穿戴,讯飞AI眼镜开启跨语言沟通新时代
- 科大讯飞AstronClaw升级,引领AI Agent从对话走向执行
- 科大讯飞亮相2026联合国中文日,让语言无界,让文化共鸣
- 打造办公新模式,科大讯飞三大核心“AI+办公”大模型在成都发布
- 科大讯飞AIPC华东制造基地正式投产,软硬智造一体出场即“数字员工”
- 科大讯飞与苏移集成签署战略合作协议,共推具身智能产业升级
- 从硬件集成到软核共研,科大讯飞与北京人形机器人创新中心深化合作
- 科大讯飞与金光集团签约战略合作,携手推动印尼人工智能转型
- MWC 2026 | 科大讯飞全球首发AI眼镜,多款AI产品全新升级
- 科大讯飞AI学习机T90系列重磅发布,开启个性化学习新时代
- 科大讯飞携手天津河西区:探路“人民城市”数字底座,为基层减负增效
- 科大讯飞ANYPIN获2026德国iF设计奖,以隐形科技重塑AI录音新体验
- 科大讯飞将亮相MWC2026,推动安全、可部署AI走向全球行业
人工智能企业
更多>>人工智能硬件
更多>>人工智能产业
更多>>人工智能技术
更多>>- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠
- Seedance 2.0面向企业公测,豆包大模型日均Token使用量突破120万亿
- 端到端OCR模型第一!百度千帆Qianfan-OCR正式发布
- 云知声Unisound U1-OCR大模型发布!首个工业级文档智能基础大模型,开启OCR 3.0时代
- 基石智算上线 MiniMax M2.5,超强编程与智能体工具调用能力
- 昇腾原生支持,科学多模态大模型Intern-S1-Pro正式发布并开源
- 百度千帆深度研究Agent登顶权威评测榜单DeepResearch Bench









