百度夺魁INTERSPEECH2020竞赛 AI助力阿尔茨海默症早期诊断
2020-10-31 12:36:48AI云资讯1322

(全球语音研究领域顶级会议INTERSPEECH2020)
近日,全球语音研究领域顶级会议INTERSPEECH2020召开,值得一提的是,其中利用口语自动识别阿尔茨海默症的竞赛吸引了包括MIT、首尔大学、德国人工智能研究中心等全球34支队伍参赛;百度研究院89.6%的准确率超越MIT等世界顶级对手,以第一名的成绩摘得桂冠。据了解,百度研究院在竞赛中基于百度知识增强语义理解技术与平台ERNIE做出创新,其模型效果比谷歌BERT更好。百度研究院此次夺冠,不仅为阿尔茨海默症这一广泛存在的顽疾提供了早期诊断的更多可能性,同时也证明了语言模型乃至人工智能在医疗领域的重要价值,为行业实现“AI+医疗”提供了全新的范例和思路。

(INTERSPEECH2020百度研究院夺魁阿尔茨海默症的竞赛)
阿尔茨海默症即所谓的“老年痴呆”,这是一种起病隐匿的进行性发展的神经系统退行性疾病,患者会出现记忆障碍、失语、失用、失认、执行功能障碍以及人格和行为改变等全面性痴呆症状。随着老龄化社会到来,愈多的家庭深受阿尔茨海默症困扰,严重降低老年人的生活质量。医学界认为,阿尔茨海默症的早期诊断非常重要,及时的干预和治疗可以延缓疾病的发展甚至治愈。
INTERSPEECH是由国际语音通信协会ISCA组织的语音研究领域的顶级会议之一,此次大会正聚焦于阿尔茨海默症举办识别竞赛,探索用AI在早期来识别和诊断阿尔茨海默病情的可能性。其中,百度研究院提出的方法是利用语言中的停顿信息,用包含停顿编码的语音转写对Transformer语言模型进行微调,并对多次微调结果做多数表决。
经研究,停顿是阿尔茨海默症的一个重要特征。停顿信息不仅包括停顿的时长和频率,同时还包括停顿出现的位置,比如哪两个词之间或者哪种句法结构中出现停顿。基于此,百度研究院的研究表明在转写中加入停顿编码,利用Transformer语言模型中的注意力机制学习数据中的停顿信息,可有效识别阿尔茨海默症。

(图1:停顿编码的流程)
在竞赛过程中,百度研究院首先是对语音和转写做强制对齐,根据强制对齐得到的停顿时长对停顿进行编码。在尝试了两种编码,分别包括三种停顿(3p: <0.5s, 0.5-2s, >2s)和六种停顿(6p: <0.5s, 0.5-1s, 1-2s, 2-3s, 3-4s, >4s)之后,百度研究院再在转写中加入这些编码,如上图所示。

(图2:微调的流程)
第二步,百度研究院将识别阿尔茨海默症作为语言模型的一个下游任务,用包含停顿编码的转写对预训练的语言模型BERT和ERNIE进行微调,其流程见上图;最后发现,通过微调预训练模型得到的分类结果有较大的不稳定性。为克服这一问题,百度研究院又采用了多次微调并对结果做多数表决,有效提高了算法的稳定性和准确率。
此次对阿尔茨海默症停顿特征的研究工作中,百度ERNIE做出了巨大贡献;基于ERNIE,百度研究院算法的识别准确率得到了有效提升。结果(下表)显示结合停顿编码和百度ERNIE语言模型得到的准确率最高,优于只使用转写(0p,不包含停顿),也优于BERT语言模型。

(表1:在测试集上的结果)
百度文心(ERNIE)是依托百度深度学习平台飞桨打造的语义理解技术与平台,集先进的预训练模型、全面的NLP算法集、端到端开发套件和平台化服务于一体,为企业和开发者提供一整套NLP定制与应用能力;其中ERNIE预训练模型开创性地将大数据预训练与多源丰富知识相结合,通过持续学习技术,不断吸收海量文本数据中词汇、结构、语义等方面的新知识,实现模型效果不断进化,如同人类持续学习一样。并且百度还将此项世界领先的NLP技术成果开放给业界,降低了NLP技术的准入门槛,让各大产业都能快速拥有构建和应用文本智能的能力,为产业智能化提供了全新的加速度。

如今,文心(ERNIE)已广泛应用于搜索引擎、信息流、智能音箱等互联网产品中,同时也在金融、电商、媒体、教育等行业中落地,成为推动产业智能化转型的利器。在2020世界人工智能大会上,百度文心(ERNIE)还荣获了最高奖项SAIL奖(Super AI Leader,卓越人工智能引领者)。百度人工智能技术在阿尔茨海默症早期识别和诊断上的应用,既体现了“科技为更好”的核心理念,助力人们享受幸福生活,也证明了人工智能技术向不同领域延伸的巨大价值。
相关文章
- 百度智能云与帕西尼达成战略合作 共同推动具身智能产业规模化落地
- 百度智能云:加大三方面投入 解决具身智能产业硬问题
- 百度沈抖:自我进化,开启超级个体黄金时代
- 百度一镜升级,数字人进入“全场景+全球化”时代
- 百度智能云升级百度一见视觉智能体平台:内置1000+专业视觉Skills,可自主进化
- 百度智能云发起智慧养老产业联盟,8家企业首批加入
- 百度Create2026:AI Agent走进家庭,小度给出落地样本
- L4级自动驾驶车辆驶入中国农业大学 百度Apollo星火计划再落一子
- 百度百科20周年沙龙致敬百万UGC用户:让3000万+词条成为时代的知识方舟
- AI生万象,灵感疯长——百度百家号AI创作者漫谈大会圆满落幕
- 2026百度创作者大会:AI引擎赋能创作 共生共筑新生态
- 领跑中国乘用车NOA辅助驾驶地图市场份额 百度地图实力亮相2026北京车展
- 百度百科“繁星计划”再加码,投入2000万基金激励权威内容建设
- 行业首发!鸿蒙版雅迪智行App深度集成百度地图SDK,上线投屏导航,实现“抬头骑行,眼不离路”
- 百度APP用户数据再攀升:主动日活用户同比增长1.6倍、创作者规模同比增长近3成
- 行业首家!百度地图×雅迪首发支持鸿蒙投屏导航,两轮车智慧出行迈入“鸿蒙时代”
人工智能企业
更多>>人工智能硬件
更多>>人工智能产业
更多>>人工智能技术
更多>>- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠
- Seedance 2.0面向企业公测,豆包大模型日均Token使用量突破120万亿
- 端到端OCR模型第一!百度千帆Qianfan-OCR正式发布
- 云知声Unisound U1-OCR大模型发布!首个工业级文档智能基础大模型,开启OCR 3.0时代
- 基石智算上线 MiniMax M2.5,超强编程与智能体工具调用能力
- 昇腾原生支持,科学多模态大模型Intern-S1-Pro正式发布并开源
- 百度千帆深度研究Agent登顶权威评测榜单DeepResearch Bench









