海光DCU完成与GLM-5.2极速适配,长程任务国产底座就绪
2026/06/17 19:24AI云资讯15210
智谱新一代开源大模型GLM-5.2发布之际,海光DCU同步完成全流程适配与性能验证,实现“发布即支持”。
此次适配的核心在于对GLM-5.2 Solid 1M无损上下文的深度优化。长上下文模型在实际部署中普遍面临算力带宽与显存管理的瓶颈,导致性能随序列长度增加而衰减。海光DCU通过内存调度机制优化与IndexShare架构适配,将1M上下文下单位Token的运算消耗显著降低,使模型在处理88万tokens级别的长程任务时保持稳定输出。
双方后续将持续推进深度适配,围绕长程任务与代码能力展开更多场景化验证,进一步降低大模型在国产算力平台上的部署门槛。
此次适配的核心在于对GLM-5.2 Solid 1M无损上下文的深度优化。长上下文模型在实际部署中普遍面临算力带宽与显存管理的瓶颈,导致性能随序列长度增加而衰减。海光DCU通过内存调度机制优化与IndexShare架构适配,将1M上下文下单位Token的运算消耗显著降低,使模型在处理88万tokens级别的长程任务时保持稳定输出。
双方后续将持续推进深度适配,围绕长程任务与代码能力展开更多场景化验证,进一步降低大模型在国产算力平台上的部署门槛。
相关文章
- 全栈算力底座赋能Agentic AI,海光信息亮相云栖大会
- VARA2026|海光如何守住AI时代的漏洞治理
- 国产算力筑基“AI+”,海光全场景算力方案亮相东博会
- 海光信息全场景金融算力方案亮相东博会
- 2026年国家网络安全宣传周丨海光亮相中国网络安全年会,提出AI安全新思路
- 海光信息首发“词元经营双芯加速方案”,助力通信产业价值释放
- 海光信息亮相武汉内河展,首次展出水运港口数智化全栈方案
- 海光重磅发布Token经营“双芯”加速解决方案
- 从“能对话”到“办业务”,海光信息支撑AI Agent加速落地
- 深入证券关键场景,海光携手华锐发布五款高性能信创一体机
- 杭州四海光纤G657A2少量供货,全球需求高景气下供不应求
- “海光+麒麟”跑通全栈:23份认证背后的工业仿真软件选择逻辑
- 海光信息荣获第二十六届中国专利金奖
- 让Agent从实验走向生产,海光双芯平衡架构释放极致Token效能
- 海光“Agent to Token开放计算架构”数博会首发,重塑词元生产力
- 海光“Agent to Token开放计算架构”数博会首发,重塑词元生产力
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 阶跃这次够狠:AA 全球开源前二,价格打到 Claude 的 1/8
- 科大讯飞发布Spark-Audio-1.0-Preview,全国产语音基座大模型实现从“听清”到“听懂”
- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练









