全球最强开源模型!阿里通义千问登顶国内第一:超越一众开闭源
2024/07/10 17:38AI云资讯15960
7月10日消息,根据SuperCLUE发布的中文大模型基准测评最新报告,阿里通义千问开源模型Qwen2-72B-Instruct以卓越的表现位居国内通用能力第一,更在全球范围内成为最强开源模型。
SuperCLUE报告详细披露了对国内外33个大模型的综合测评结果,Qwen2-72B在一级总分上以77分的高分与Claude-3.5-Sonnet并列第二,仅次于OpenAI的GPT-4o。
这一得分超越了百度文心一言4.0、讯飞星火V4.0、Llama-3-70B等开闭源大模型。

具体来看,在理科、文科和Hard三个维度的具体测评中,Qwen2-72B展现了全面而均衡的能力。
特别是在理科任务上,Qwen2-72B与GPT-4o的分差仅为5分,显示出其在计算、逻辑推理和代码测评方面的强劲实力。

在文科任务和Hard任务上,Qwen2-72B同样表现不俗,得分均达到了76分,与GPT-4o的得分相差无几。
特别值得一提的是,在端侧小模型测评中,Qwen2-7B以70亿参数的模型规模,超越了上一代320亿参数的Qwen1.5-32B和130亿参数的Llama-3-8B-Instruct,夺得了排名第一的宝座。

这一成绩不仅证明了Qwen2-7B在小尺寸模型中的极致性能,也极大提升了端侧小模型落地的可行性。
数据显示,截至目前Qwen系列模型的下载量已突破2000万次,其应用场景覆盖了工业、金融、医疗、汽车等多个垂直领域。
相关文章
- 2026《财富》世界500强中国全栈AI企业盘点:联想集团、阿里巴巴、腾讯
- 阿里系20余款应用在鸿蒙端落地50+创新体验:让每一个生活场景更智能、更轻松
- 以太之心牵手华为、阿里、三大运营商等 WAIC上共发智能体倡议
- 魔法原子签约阿里速卖通,WAIC 2026开幕首日宣布独家战略合作
- 苹果智能在国内获批,将集成阿里通义千问AI生态
- 从ALink到SNPO:阿里云定义行业首款ScaleUp铜光兼容NPO模块
- 阿里云发布AgentTeams与AgentLoop:破解企业智能体规模化落地两大难题
- 阿里云百炼推出Agentic RAG服务,让AI的知识检索和回答更精准
- 中国企业创新盘点——同时入选《财富》中国科技50强的联想集团与华为、腾讯、阿里
- 天猫618收官,阿里妈妈AI万相响应超30亿次投放决策,百万商家智赢增长
- 阿里MuleRun上线Pages数据库模式,零门槛交付可管理真实数据的完整网页
- 牧原携手阿里云共建养猪大模型 AI赋能传统产业升级
- 阿里MuleRun上线多任务模式,打造永久留存、独立交互的Agent团队
- 阿里云发布AI视频创作平台“万镜一刻”,打通短漫剧和营销视频生成全流程
- 2026智能眼镜“百镜争鸣”,谷歌/阿里/微美全息引领AR/XR产业全面升级
- 阿里云发布Token-Watt八大前沿课题,推动共建算电协同新业态
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









