中国移动发布《审计行业大模型评测白皮书》及配套测试集,为审计大模型建立“度量衡”
2025-10-12 21:58:53AI云资讯1747
10月11日,在2025中国移动全球合作伙伴大会上,中国移动正式发布《审计行业大模型评测体系白皮书》(以下简称《白皮书》)及配套测试集。作为国内首个面向审计行业的系统性大模型评测标准框架,该体系为审计大模型的科学评估、选型与应用筑牢了“标准底座”,有效填补了通用大模型评测体系在审计行业适配性与应用价值评估上的空白。

《白皮书》指出,审计行业大模型作为融合前沿技术的创新产物,正在逐渐重塑审计业务的流程与模式,其在提升审计效率、增强风险识别、助力精准决策等方面展现出巨大潜力。然而,随着审计领域各类大模型的不断涌现,其质量与性能参差不齐,如何科学、客观且全面地评测审计行业大模型就显得尤为重要。现有通用大模型评测侧重于文本流畅性与开放任务泛化能力,难以量化审计场景特定需求,在数据、方法和落地上面临三重鸿沟。
为深度洞察不同审计行业大模型的专业适配性与实际效能,精准辨析各模型的优势与短板,推动审计行业大模型技术健康发展,中国移动依据国家标准 GB/T45288.2-2025《人工智能大模型第 2 部分:评测指标与方法》,并结合中国移动联合发布的《通用大模型评测标准》,编制完成《审计行业大模型评测体系白皮书》,创新性地提出面向审计行业的大模型评测体系,以“2+4+6”层级架构为核心:聚焦基础能力层与审计应用层“两大”核心场景,并将审计应用评测按审计流程细分为不同场景下的30余项具体应用任务。针对每项审计应用任务,白皮书清晰指明适用的评测方式、指标、数据与工具“四项”关键评测要素,同时细化反映功能性、准确性、可靠性等“六大”审计评测维度的具体指标,为评测工作提供了切实可行的落地级指南,有效弥补了通用评测在审计行业适配性与应用价值评估上的不足。
此外,中国移动还同步发布了与《白皮书》配套的标准化的专业测试集,包含国家权威审计类考试题目2万余条,及覆盖企业审计业务六大场景的真实数据5千余条,为模型能力评估提供了真实、全面的数据支撑。
《白皮书》及测试集的发布推动审计行业大模型的发展迈入了更加标准化、规范化的新阶段。未来,中国移动将持续推动大模型安全、透明、高效地赋能审计现代化,铸就“科技强审”新范式,铸牢审计之盾。
相关文章
- 中国移动5G-A超级上行:以网络能力跃升驱动产业智能化升级
- 中国移动副总经理陈怀达:把握数智时代新机遇 开创信息通信新格局
- 灵犀智屏,全新启航:中国移动重磅发布灵犀Inside-灵犀智屏系列产品,全面升级家庭AI超级入口
- 从横州茉莉花海到北部湾浪花 中国移动书写数智广西新篇章
- 深耕算网融合, 华为全面助力中国移动构筑 Token 运营核心竞争力
- 深耕算网融合, 华为全面助力中国移动构筑Token运营核心竞争力
- 共建数亿目标用户 中国移动携手京东发布AI-eSIM“1+3+9”多生态智能服务体系
- 中国移动联合产业发布《5G-A超级上行技术演进及规划白皮书》
- “智绘”领跑设计生产速度,“AI电商·星璨”亮相中国移动云大会
- 中国移动研究院提出“DORA”可重构光互连架构,助力智算向光而行
- 中国移动研究院推出商用智算卡间互联全向智感(OISA)IP,构建开放智算互联新生态
- 中国移动研究院发布“芯合”2.5暨开放智算产业合作计划
- 中国移动研究院段晓东:从“AI Native”到“Token Native”,算力网络迈向发展新阶段
- 中国移动研究院发布全球首个集成物理层安全功能的400G光模块核心组件
- 中国移动发布全国一体化算力网技术创新体系
- 中国移动发布AI-eSIM多生态智能服务体系 锚定Token经济新入口
人工智能企业
更多>>人工智能硬件
更多>>人工智能产业
更多>>人工智能技术
更多>>- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠
- Seedance 2.0面向企业公测,豆包大模型日均Token使用量突破120万亿
- 端到端OCR模型第一!百度千帆Qianfan-OCR正式发布
- 云知声Unisound U1-OCR大模型发布!首个工业级文档智能基础大模型,开启OCR 3.0时代
- 基石智算上线 MiniMax M2.5,超强编程与智能体工具调用能力
- 昇腾原生支持,科学多模态大模型Intern-S1-Pro正式发布并开源









