忆联与英特尔携高性能KV Cache G3.5方案亮相2026英特尔技术创新与产业生态大会
2026/09/27 10:17AI云资讯13965
9月22日至23日,以"同芯•智远"为主题的2026英特尔技术创新与产业生态大会在苏州国际博览中心举行。作为英特尔数据中心事业部(DCG)中国区首家国产SSD战略合作伙伴,忆联深度参与本次大会。会议期间,忆联与英特尔联合发布面向Agentic AI时代的高性能KV Cache G3.5方案,并发表主题演讲、展示企业级亮点产品,全面呈现AI时代企业级存储的创新成果。

联合发布G3.5方案应对Agentic AI时代存储挑战
随着上下文窗口、并发会话和智能体运行时长持续增长,KV Cache 已从GPU的内部实现细节,演变为决定首 Token 时延(TTFT)、系统吞吐、GPU利用率和部署成本的关键基础设施资源。基于此,忆联携手英特尔发布高性能KV Cache G3.5方案。
英特尔数据中心集团副总裁、中国区总经理陈葆立,忆联总经理寇朋韬共同出席发布仪式。该方案以英特尔® 至强® 6 处理器为核心,基于忆联高性能UH812a企业级SSD,构建分层KV Cache架构,充分释放双方在算力与存储领域的协同创新。

寇朋韬表示:"海量KV Cache正在成为系统核心瓶颈——GPU昂贵的HBM带宽被持续消耗,推理延迟难以控制。正是基于这一挑战,G3.5方案应运而生,让企业级SSD从单纯的存储介质,进化为承载KV Cache的大容量溢出层,为智能体的持续推理与上下文保留提供坚实支撑。这一方案凝聚了英特尔坚实的算力底座、忆联领先的企业级存力引擎。只有当算力与存力真正高效协同,智能体才能跑得更久、更稳、更经济。"

G3.5:重构LLM存储层级加速AI推理落地
大会期间,忆联副总裁杨锦平发表题为《G3.5:重构LLM存储层级,加速AI推理落地》的主题演讲,重点阐释G3.5在新一代AI推理架构中的定位与价值。
杨锦平指出,LLM推理为数据引入了新的"热度维度":KV Cache的访问频率与复用窗口不再单一,既承载 LLM 推理时活跃参数的状态,又需要在推理会话期间持续保留,供后续token生成复用,部分数据还需跨会话长期留存。这种频率与时效的双重维度,使KV Cache需要在HBM、DRAM、SSD之间分层流动。
在此背景下,G3.5 作为GPU内存/主机DRAM与后端共享存储之间的独立层级,通过大容量、高性能企业级SSD承接长期上下文与KV Cache数据,在容量、性能与成本之间形成更优平衡。相较传统层级,G3.5可将KV Cache的扩展容量从单卡HBM的几十GB提升至系统级,为多轮智能体、大型上下文及稳定并发等生产环境提供持续支撑。
多款创新产品亮相, 助推AI产业发展
围绕大模型训练、推理、Agent应用及海量数据管理等核心场景,忆联集中展示了UH713a、UH812c/UH832c、UM301a等企业级SSD及E1.S形态产品,形成覆盖高性能、低功耗与更优TCO的完整产品布局,全面满足AI时代多样化存储需求。

针对不同AI工作负载,忆联展出三款企业级SSD:
UH713a作为国内首款8通道数据中心级SSD,依托自研主控与固件深度调优,为AI训练等高负载场景提供性能与能效兼顾的存储支撑;
UH812c/UH832c搭载新一代NAND,相较上一代顺序写入性能提升14%,随机写入提升20%,4K随机读取延迟低至52µs,为AI训推及企业核心业务提供高吞吐、低时延支持;
UM301a采用DRAM-less设计,全面支持掉电保护及带外管理等企业级特性,为服务器提供低功耗、高可靠的启动支撑。
此外,现场展出的E1.S形态产品进一步丰富了忆联企业级SSD的产品形态。E1.S凭借紧凑尺寸、高密度部署、热插拔及更灵活的散热设计,可更好适配1U服务器等高密度计算平台。结合M.2、U.2、E3.S等形态,忆联进一步展现了面向不同服务器架构与业务负载的灵活适配能力。

从成为英特尔DCG中国区首家国产SSD战略合作伙伴,三度参与 Connection大会、到联合发布G3.5方案,并斩获最佳合作伙伴奖,忆联与英特尔的合作正不断向系统架构与产业生态纵深延伸,持续以技术协同推动 AI 存储创新。

未来,忆联将继续携手英特尔及产业生态伙伴,推进下一代AI存储的技术创新,从技术创新到应用场景落地,为Agentic AI规模化落地构建高效、可靠且更具成本优势的数据底座。
相关文章
- 以CPU为核心,英特尔为智能体AI打造全新智算中心
- 连接计算创新与行业生态,加速智能体落地产业场景,2026英特尔技术创新与产业生态大会开幕
- 以算力为基,华硕破晓携手英特尔驱动AI办公体验革新
- 英特尔CEO陈立武重申量产节点,将于2027年第一季度启动风险试产
- 英特尔14A工艺产能预计到2027年底达每月6000片晶圆,或打入英伟达生态体系
- 堆GPU已过时?英特尔将在苏州开讲智能体时代AI工厂,速速来报名
- 英特尔10月或将上调CPU价格,涨幅达10%
- OpenAI GPT‑6 Astra 催生海量本地 CPU 智能体,为英特尔与 AMD 带来需求红利
- 英特尔代工扩展生态合作,Intel 18A-P与Intel 14A获多家EDA伙伴工具与流程支持
- 英特尔筹资150亿美元,迹象表明14A制程已拿下客户订单
- 英特尔押注高端芯片,战略见效:Q2服务器芯片价格飙升48%
- 扩产、提质、稳交付,英特尔代工为AI算力供给“加码”
- 英特尔推出航天系统级芯片Starfire:搭载8核心、18A制程技术,可耐受125℃高温
- 英特尔拟推出14A2节点,采用双面供电技术,提供更成熟的制程工艺
- 轻盈随行,性能越级!英特尔酷睿 Ultra 5 325+4Xe 激活轻薄本新潜力
- 马斯克的TeraFab招揽英特尔18年资深老将出任代工经理,主导550亿美元芯片制造项目
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 阶跃这次够狠:AA 全球开源前二,价格打到 Claude 的 1/8
- 科大讯飞发布Spark-Audio-1.0-Preview,全国产语音基座大模型实现从“听清”到“听懂”
- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练









