思必驰:语音交互迈入“拟人化”阶段
2023/06/29 09:49AI云资讯11626
消费者在交互过程中并非孤立地依据声音、表情及动作中的单项进行沟通与交流,而是综合视觉、听觉、触觉甚至嗅觉来进行有效的沟通。同理,要使机器做到更加逼真的“拟人化”,就需要通过语音、视觉、文本等信息结合的方式来推动人机交互的优化与升级。

例如,在复杂声学环境尤其是多人同时说话的时候,语音识别性能会显著下降,此时若引入视觉信息对讲话者进行唇语识别,综合语音和视频信息则可以大幅提升说话人跟踪和语音识别准确率;又例如,在人机交互过程中,机器通过采集用户的表情、说话语气,甚至脚步的频率和急缓程度,可以分析用户的情绪状态,以采用不同的方式推进交互,提高人机交互的交互效率与质量。
不难看出,应对人机交互场景化应用不断拓展的市场需求,多模态、智能化的完整解决方案可以更好地应对不同场景的复杂变化,多模态交互成为行业发展的必然趋势。
深耕行业多年,思必驰早年便对多模态交互领域进行布局,已经成功自主研发出多模态对话交互技术。
具体来看,思必驰多模态对话交互技术联合语音、语言、视觉等多个模态的信息,能够在高噪声环境(比如地铁、家居、车载环境),大幅提升语音识别率和对话交互成功率。此外,思必驰研发打造出多模态对话交互软硬件一体的解决方案,包括高噪声环境下的多模态唤醒、说话人跟踪、语音活动检测等技术,增加了语音交互对噪声的鲁棒性,显著提升了用户体验。
目前,思必驰上述方案已应用政务民生场景中的轨道交通、智能自助设备等需要近场语音交互且环境嘈杂的场景和产品。
随着技术的不断进步,多模态交互的应用场景将会越来越广泛。可以预见的是,AI语音的发展在思必驰等技术领先企业的持续推动下,将会为人们带来更加自然、智能的交互体验。
相关文章
- 思必驰自主品牌亮相第七届辽洽会,以AI硬实力赋能智能制造
- 思必驰亮相 2026 江苏产学研大会,加速 AI 科技成果落地转化
- 思必驰×一汽悦意08:超级天琴加持,解锁智享轿跑新交互
- 思必驰获信通院首批可信Token云服务检验证书,“模芯云用”能力获权威认可
- 多元业务并进、亏损大幅收窄:思必驰的“盈利前夜”
- 端侧AI快车道上,思必驰十九年的“慢生意”
- 聚焦自然交互与主动服务 东软联合思必驰实现技术升级
- 思必驰2025技术进展报告:践行“0-1-N-0”创新范式
- 思必驰自研AI算法突破拾音“禁区”,惊艳世界顶尖学府
- 「思必驰AI办公本·4G畅写版」3月28日发布,高效办公与学习的新选择
- 吸顶麦MC10用实力说话,思必驰助力香港大学经济与管理学院提升教学质量
- 思必驰与上海财经大学达成合作,吸顶麦MC10扩声效果获满分
- 思必驰AI办公本先行接入DeepSeek-R1大模型,简直太强了!
- 删繁就简,思必驰AI办公本数字办公专业之选
- 敏芯股份×思必驰:从Siri史诗级进化,看人工智能的无限应用场景
- 思必驰完成新一轮首期两亿元融资:2023年主营业务收入同比增长50%
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 阶跃这次够狠:AA 全球开源前二,价格打到 Claude 的 1/8
- 科大讯飞发布Spark-Audio-1.0-Preview,全国产语音基座大模型实现从“听清”到“听懂”
- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练









