中国移动发布《审计行业大模型评测白皮书》及配套测试集,为审计大模型建立“度量衡”
2025-10-12 21:58:53AI云资讯1584
10月11日,在2025中国移动全球合作伙伴大会上,中国移动正式发布《审计行业大模型评测体系白皮书》(以下简称《白皮书》)及配套测试集。作为国内首个面向审计行业的系统性大模型评测标准框架,该体系为审计大模型的科学评估、选型与应用筑牢了“标准底座”,有效填补了通用大模型评测体系在审计行业适配性与应用价值评估上的空白。

《白皮书》指出,审计行业大模型作为融合前沿技术的创新产物,正在逐渐重塑审计业务的流程与模式,其在提升审计效率、增强风险识别、助力精准决策等方面展现出巨大潜力。然而,随着审计领域各类大模型的不断涌现,其质量与性能参差不齐,如何科学、客观且全面地评测审计行业大模型就显得尤为重要。现有通用大模型评测侧重于文本流畅性与开放任务泛化能力,难以量化审计场景特定需求,在数据、方法和落地上面临三重鸿沟。
为深度洞察不同审计行业大模型的专业适配性与实际效能,精准辨析各模型的优势与短板,推动审计行业大模型技术健康发展,中国移动依据国家标准 GB/T45288.2-2025《人工智能大模型第 2 部分:评测指标与方法》,并结合中国移动联合发布的《通用大模型评测标准》,编制完成《审计行业大模型评测体系白皮书》,创新性地提出面向审计行业的大模型评测体系,以“2+4+6”层级架构为核心:聚焦基础能力层与审计应用层“两大”核心场景,并将审计应用评测按审计流程细分为不同场景下的30余项具体应用任务。针对每项审计应用任务,白皮书清晰指明适用的评测方式、指标、数据与工具“四项”关键评测要素,同时细化反映功能性、准确性、可靠性等“六大”审计评测维度的具体指标,为评测工作提供了切实可行的落地级指南,有效弥补了通用评测在审计行业适配性与应用价值评估上的不足。
此外,中国移动还同步发布了与《白皮书》配套的标准化的专业测试集,包含国家权威审计类考试题目2万余条,及覆盖企业审计业务六大场景的真实数据5千余条,为模型能力评估提供了真实、全面的数据支撑。
《白皮书》及测试集的发布推动审计行业大模型的发展迈入了更加标准化、规范化的新阶段。未来,中国移动将持续推动大模型安全、透明、高效地赋能审计现代化,铸就“科技强审”新范式,铸牢审计之盾。
相关文章
- 中国移动供应链管理中心总经理朱国弟一行赴海康存储考察调研
- 极客邦科技中标中国移动集采项目,“知识+社区+生态”模式获央企客户认可
- 合作再升级:旷视与中国移动签署战略合作框架协议
- 科技当燃!中国移动“九天”闪耀中国科技创新盛典
- 3亿用户的共同选择!中国移动APP以数智赋能让生活更美好
- 中国移动首发智算推理集群“运营黄金标准”
- 中国移动长三角(苏州)汾湖智算中心5号机房楼主体结构封顶,助力长三角算力布局
- 中国移动举办“赋能建功”2025年网络安全技能竞赛
- 中国移动呼和浩特分公司联合华为以“5G-A+VIP资源保障+游戏加速包”硬核护航工大王者荣耀电竞比赛
- 中国移动在杭州建成全国首个5G-A×AI大上行示范区,网络上行体验大幅跃升
- 中国移动与北京中关村学院、上海创智学院、 深圳河套学院签署合作共建协议
- 中国移动研究院发布“泛在实时通信网络原型1.0”
- 中兴通讯助力中国移动完成烟草行业蜂窝无源物联网试点验证
- 中国移动多项自智网络创新成果登顶TM Forum全球评测榜单
- 质量铸就,行业唯一!亨通光电蝉联中国移动光缆A级供应商
- 中国移动贵港分公司多措并举 筑牢安全生产防线









