北大杨仝团队发布FairyR1模型:5%参数量数学和代码能力超越满血DeepSeek
2025/05/26 10:56AI云资讯11891
北京大学杨仝教授团队近期发布了其在高效大型语言模型研究方向的一项新成果——FairyR1-32B模型。该模型基于DeepSeek-R1-Distill-Qwen-32B基座,通过结合微调与模型合并技术构建。研究探索了在参数量大幅减少的情况下,模型在特定任务上实现与更大模型相当甚至更优性能的可能性。该研究得到了国家自然科学基金委项目(624B2005,62372009)的资助。FairyR1-32B模型已在huggingface开源:https://huggingface.co/PKU-DS-LAB/FairyR1-32B。
FairyR1-32B模型是在团队前期TinyR1工作基础上进行的进一步探索,沿用了“分合蒸馏”的研究思路,提出了多种改进方法,包括自我合并、多教师交叉蒸馏、轻蒸馏等方法,并在数据处理进行了优化,模型精度有了显著提升。
本次工作重点改进了蒸馏数据的构建流程,对来源于AI-MO/NuminaMath-1.5(数学)和open-thoughts/OpenThoughts-114k(代码)等数据集的原始数据,通过多个“教师模型”生成答案,随后对问答数据进行精心筛选、结构调整与思维链优化,并进行多阶段筛选。筛选过程包括基于答案的正确性验证(针对数学数据),以及基于长度的筛选(数学数据保留2k-8k tokens范围,代码数据保留4k-8k tokens范围),最终构建了更具针对性的约6.6k条数学数据和约3.8k条代码数据用于训练。
在模型结构方面,研究团队尝试训练两个领域(数学和代码)的专业模型进行合并,旨在进一步优化流程和资源消耗。这两个专业模型在一致的训练参数下(例如相同的学习率和批次大小)独立训练约5个周期后,利用AcreeFusion工具进行了合并。在多个公开基准测试中,FairyR1展现出了在低参数量下的竞争力表现。以下为FairyR1与DeepSeek-R1-671B及DeepSeek-R1-Distill-Qwen-32B在部分基准上的得分对比:

从测试结果可以看出,FairyR1-32B在AIME 2025和LiveCodeBench基准上得分略高于DeepSeek-R1-671B,在AIME 2024上表现接近。在GPQA-Diamond科学基准上,FairyR1的得分低于DeepSeek-R1-671B。这些结果表明,FairyR1在采用DeepSeek-R1-Distill-Qwen-32B基座并经过特定技术处理后,能够在约5%参数量的情况下,在数理和编程等领域实现与大型模型相当或略优的性能水平,但在科学等其他领域可能存在差距。这项工作探索了通过优化的数据处理和模型融合技术,在保证特定任务性能的前提下,大幅降低模型规模和潜在推理成本的可能性。
北京大学杨仝教授团队表示:“FairyR1-32B模型是我们探索高效大型语言模型技术路线的阶段性成果。通过对蒸馏和合并方法的改进,我们初步验证了在有限资源下实现高性能模型的可行性。”
团队成员:李旺、周俊廷、刘文睿、姚一伦、王融乐、杨仝

相关文章
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 数字化项目成功率提升300%的秘密:不写代码
- 每日互动发布零代码Agent搭建平台 2小时极速开启Agent智能营销
- 多模态、无代码、全流程 东软多模态医学人工智能平台 让医生轻松用AI
- 40亿低代码市场背后的真相:无代码才是企业长期主义
- 逐代码星河 战算力之巅!2026第十三届并行应用挑战赛正式启航
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- 炎黄盈动发布AWS AI IDE,让低代码开发迈向AI Engineering时代
- 为什么Excel转系统的需求,低代码不靠谱?要用无代码
- 2026海洋计算挑战赛正式启动 以代码逐浪,用科技护深蓝
- 发微信就能编程:DFRobot 行空板 K10 接入 ESP-Claw,实现零代码本地 AI
- BesTV上海博物馆又一新馆上线!“考古上海”带你读懂这座城市的“源代码”
- 黑湖科技周宇翔:扎根工厂一线写代码,十年磨一剑打造工业AI独角兽
- 阿里云推出企业级Agent构建平台JVS Crew:零代码“建龙虾工厂”
- 当“星星的孩子”遇见AI:编程猫第8届蓝灯行动 用代码链接世界
- 勤哲Excel服务器:无代码搭建数字化系统,驱动紧固件企业一体化管控
AI企业
更多>>AI硬件
更多>>- 机器漫步在世界机器人大会发布桌面服务机器人V2.0,单臂突破180杯/小时,全行业最快!
- 技嘉DDR5主板全面适配长鑫存储内存,国产颗粒解锁高频新体验
- 深度解读新一代三星Galaxy Z系列和Galaxy Watch的设计之道
- 灵御智能TA2二开版本正式发布,冠军同款本体向全行业开放
- 中坚智氪亮相WRC 2026 :以模组全栈自研、量产,定义机器人动力之巅
- iQOO Z11S正式发布:搭载10000mAh超薄蓝海电池 首销优惠价1799元起
- 微星主板调校加持,Lexar携国产长鑫颗粒达成 6000 CL28 低时序新高度
- 上海智位机器人出席哈萨克斯坦 TAMYZ FORUM 2026:以实践创新推动 AI 教育,共建全球开发者生态
AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









