百度夺魁INTERSPEECH2020竞赛 AI助力阿尔茨海默症早期诊断
2020-10-31 12:36:48AI云资讯1270

(全球语音研究领域顶级会议INTERSPEECH2020)
近日,全球语音研究领域顶级会议INTERSPEECH2020召开,值得一提的是,其中利用口语自动识别阿尔茨海默症的竞赛吸引了包括MIT、首尔大学、德国人工智能研究中心等全球34支队伍参赛;百度研究院89.6%的准确率超越MIT等世界顶级对手,以第一名的成绩摘得桂冠。据了解,百度研究院在竞赛中基于百度知识增强语义理解技术与平台ERNIE做出创新,其模型效果比谷歌BERT更好。百度研究院此次夺冠,不仅为阿尔茨海默症这一广泛存在的顽疾提供了早期诊断的更多可能性,同时也证明了语言模型乃至人工智能在医疗领域的重要价值,为行业实现“AI+医疗”提供了全新的范例和思路。

(INTERSPEECH2020百度研究院夺魁阿尔茨海默症的竞赛)
阿尔茨海默症即所谓的“老年痴呆”,这是一种起病隐匿的进行性发展的神经系统退行性疾病,患者会出现记忆障碍、失语、失用、失认、执行功能障碍以及人格和行为改变等全面性痴呆症状。随着老龄化社会到来,愈多的家庭深受阿尔茨海默症困扰,严重降低老年人的生活质量。医学界认为,阿尔茨海默症的早期诊断非常重要,及时的干预和治疗可以延缓疾病的发展甚至治愈。
INTERSPEECH是由国际语音通信协会ISCA组织的语音研究领域的顶级会议之一,此次大会正聚焦于阿尔茨海默症举办识别竞赛,探索用AI在早期来识别和诊断阿尔茨海默病情的可能性。其中,百度研究院提出的方法是利用语言中的停顿信息,用包含停顿编码的语音转写对Transformer语言模型进行微调,并对多次微调结果做多数表决。
经研究,停顿是阿尔茨海默症的一个重要特征。停顿信息不仅包括停顿的时长和频率,同时还包括停顿出现的位置,比如哪两个词之间或者哪种句法结构中出现停顿。基于此,百度研究院的研究表明在转写中加入停顿编码,利用Transformer语言模型中的注意力机制学习数据中的停顿信息,可有效识别阿尔茨海默症。

(图1:停顿编码的流程)
在竞赛过程中,百度研究院首先是对语音和转写做强制对齐,根据强制对齐得到的停顿时长对停顿进行编码。在尝试了两种编码,分别包括三种停顿(3p: <0.5s, 0.5-2s, >2s)和六种停顿(6p: <0.5s, 0.5-1s, 1-2s, 2-3s, 3-4s, >4s)之后,百度研究院再在转写中加入这些编码,如上图所示。

(图2:微调的流程)
第二步,百度研究院将识别阿尔茨海默症作为语言模型的一个下游任务,用包含停顿编码的转写对预训练的语言模型BERT和ERNIE进行微调,其流程见上图;最后发现,通过微调预训练模型得到的分类结果有较大的不稳定性。为克服这一问题,百度研究院又采用了多次微调并对结果做多数表决,有效提高了算法的稳定性和准确率。
此次对阿尔茨海默症停顿特征的研究工作中,百度ERNIE做出了巨大贡献;基于ERNIE,百度研究院算法的识别准确率得到了有效提升。结果(下表)显示结合停顿编码和百度ERNIE语言模型得到的准确率最高,优于只使用转写(0p,不包含停顿),也优于BERT语言模型。

(表1:在测试集上的结果)
百度文心(ERNIE)是依托百度深度学习平台飞桨打造的语义理解技术与平台,集先进的预训练模型、全面的NLP算法集、端到端开发套件和平台化服务于一体,为企业和开发者提供一整套NLP定制与应用能力;其中ERNIE预训练模型开创性地将大数据预训练与多源丰富知识相结合,通过持续学习技术,不断吸收海量文本数据中词汇、结构、语义等方面的新知识,实现模型效果不断进化,如同人类持续学习一样。并且百度还将此项世界领先的NLP技术成果开放给业界,降低了NLP技术的准入门槛,让各大产业都能快速拥有构建和应用文本智能的能力,为产业智能化提供了全新的加速度。

如今,文心(ERNIE)已广泛应用于搜索引擎、信息流、智能音箱等互联网产品中,同时也在金融、电商、媒体、教育等行业中落地,成为推动产业智能化转型的利器。在2020世界人工智能大会上,百度文心(ERNIE)还荣获了最高奖项SAIL奖(Super AI Leader,卓越人工智能引领者)。百度人工智能技术在阿尔茨海默症早期识别和诊断上的应用,既体现了“科技为更好”的核心理念,助力人们享受幸福生活,也证明了人工智能技术向不同领域延伸的巨大价值。
相关文章
- 让国宝“在线重生”:百度百科3D复原圆明园十二生肖喷水铜兽,沉浸式呈现历史细节
- 2025年百度AI原生营销服务收入同比增长301%
- 百度商家智能体对话近450万次,数字人线索直播助力商家转化率涨三成
- 500万用户追捧!百度地图岳云鹏文心AI副驾对话破亿,春节互动数据亮眼
- 白龙马变身文心AI副驾?岳云鹏携手百度地图上天津春晚,送出2亿红包!
- MongoDB与百度智能云达成战略合作,打造全球领先的AI原生数据库生态
- 百度百科推出国际版BaiduWiki,正式迈入全球化知识服务阶段
- Omdia报告:百度智能云领跑中国具身智能AI云市场
- 《运输策略蓝图》发布 百度杨楠:香港是孵化自动驾驶业务的宝地
- 百度千帆启动开发者大使计划 携手行业先行者共建Agent繁荣生态
- 诺科达智驾亮相百度 Apollo 生态大会,荣获 2025 年度杰出应用奖
- 百度千帆深度研究Agent登顶权威评测榜单DeepResearch Bench
- 手机也能用OpenClaw了!百度智能云发布移动端接入方案
- 以“高效现场 AI”回应产业升级需求 DEEPX 在百度 Moment 2026 展示 Physical AI 产业化实践成果
- 百度YY启动“熊力·聚星计划”携手刘天池选拔短剧新星
- 百度地图刘增刚:百度地图致力于成为AI时代的入口与基建
人工智能企业
更多>>人工智能硬件
更多>>人工智能产业
更多>>人工智能技术
更多>>- 云知声Unisound U1-OCR大模型发布!首个工业级文档智能基础大模型,开启OCR 3.0时代
- 基石智算上线 MiniMax M2.5,超强编程与智能体工具调用能力
- 昇腾原生支持,科学多模态大模型Intern-S1-Pro正式发布并开源
- 百度千帆深度研究Agent登顶权威评测榜单DeepResearch Bench
- 在MoltBot/ClawdBot,火山方舟模型服务助力开发者畅享模型自由
- 教程 | OpenCode调用基石智算大模型,AI 编程效率翻倍
- 全国首个!上海上线规划资源AI大模型,商汤大装置让城市治理“更聪明”
- 昇思人工智能框架峰会 | 昇思MindSpore MoE模型性能优化方案,提升训练性能15%+









