RTX 5090 移动版碾压 M5 Max:生成速度最高快 1.3 倍,但大模型面前光环褪色
2026/08/21 06:58AI云资讯14006

(AI云资讯消息)英伟达移动版 RTX 5090 拥有充足的显存容量,足以在最具硬件杀手级水准的 3A 大作中拉满所有画质选项。然而,当面对 AI 工作负载时,这块 GPU 的 24GB 帧缓冲内存则进入了完全不同的竞争维度。一系列测试表明,RTX 5090 在面对苹果 M5 Max 时仍能站稳脚跟,在多项大语言模型任务中全面领先。不过,这一优势仅限于常规负载,一旦基准测试切换到更重的 AI 模型并同步增大上下文长度,局面便会随之逆转。
在 Alex Ziskind 的最新对比测试中,新款雷蛇灵刃 18 与苹果 16 英寸 MacBook Pro(M5 Max)展开全面较量,项目涵盖各类 AI 任务。首轮测试运行 4-bit 量化的 Qwen3 4B 模型,上下文长度高达 262,144。结果显示,RTX 5090 空有图形算力却难以施展——24GB 显存几乎被耗尽,生成速度仅为 25.28 token/秒。

作为参照,M5 Max 在同测试中取得了 181.40 token/秒的成绩。但当上下文长度降至 68,014 后,RTX 5090 得以释放大量被占用的显存,生成速度跃升至 160.36 token/秒。不过即便如此,它依然未能超越 M5 Max,原因很可能在于软件层面的差异:Windows 端使用的是 LM Studio,而苹果 Silicon 端则调用了 MLX 框架。
好在 RTX 5090 并未就此认输。YouTuber 随后测试了 Gemma 4 12B、Qwen3.5 27B 和 Qwen3.6 35B A3B 等多款模型(基于 llama.cpp),在提示处理和token生成两方面,RTX 5090 均反超 M5 Max。不过必须指出的是,英伟达这款移动旗舰 GPU 之所以能称霸,前提始终是那 24GB 显存尚未触顶。

但很遗憾,一旦面对像 Qwen3.5 122B 这样的超大规模稠密模型,RTX 5090 几乎没有任何胜算。反观 M5 Max,凭借 128GB 统一内存,即便在消耗 94GB 内存的情况下,仍能维持 139 token/秒的提示处理速度和 47.4 token/秒的生成速度。
相关文章
- 即刻升级 RTX 50 系笔记本 ROG魔霸新锐 酷睿版 2026开启全能模式
- 英伟达发布RTX Spark芯片,高调杀入PC市场
- Neousys宸曜发布强固紧凑型边缘AI计算机,支持RTX GPU
- 技嘉RTX 50系显卡超频表现亮眼 3DMark多项测试获高分
- NVIDIA 通过 RTX PRO 服务器实现游戏开发虚拟化
- Teclab绕过英伟达RTX 50显存时钟限制,将RTX 5070 Ti超频至超过36Gbps
- 英伟达将推出新款GeForce RTX 5050显卡,搭载9GB GDDR7显存
- 英伟达GeForce RTX 60系列将采用Rubin GR20x GPU架构,预计2027年发布
- 技嘉AORUS RTX 5060 Ti AI BOX正式发售
- 四通集团携手云酷智能全球首发RTX5090浸没式智算解决方案,开启绿色算力浸时代
- FLUX.2 图像生成模型发布,针对 NVIDIA RTX GPU 优化
- 高颜暴击出手即高手,RTX 5070游戏本华硕天选6 Pro锐龙版
- 硬核性能 游戏利器,RTX™ 5060游戏本ROG魔霸新锐2025畅玩3A
- 英伟达GeForce Now云游戏服务将于9月10日至升级至RTX 5080显卡架构
- 英伟达将为我国人工智能市场推出RTX 6000D显卡,计划年底前出货两百万张
- 影驰GeForce RTX 5090 D显卡以3650MHz GPU超频频率和36Gbps GDDR7显存速度创下世界纪录
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









