引入DSpark!DeepSeek-V4-Flash正式版上线中国联通北京市分公司京元平台
2026/08/04 10:47AI云资讯15467
日前,DeepSeek-V4-Flash正式版开源发布。中国联通北京市分公司依托京元Token服务平台快速完成该模型服务上线,用户可通过统一API接口调用最新版模型能力。
本次部署基于国产算力服务器,中国联通北京市分公司围绕模型加载、缓存管理和服务稳定性开展专项优化,并引入DSpark新一代推测解码加速框架,进一步提升信创化环境下模型的生成速度与推理效率。
正式版聚焦Agent与代码场景,实现能力跃迁
DeepSeek-V4-Flash正式版延续2840亿参数、130亿激活参数和100万Token上下文能力,通过新一轮后训练,进一步增强代码生成、工具调用、复杂任务处理和Agent能力。
此外,模型原生支持Responses API,能够更加便捷地衔接代码助手、工具调用和智能体应用,降低既有应用向新版本迁移和升级的门槛,为企业研发、智能编程及复杂自动化任务提供更加高效的模型选择。
引入DSpark框架,实测TPS达到60以上
传统MTP多Token预测技术能够同时预测多个后续Token,提升模型生成速度。DSpark在此基础上进一步优化候选Token生成和验证机制,可根据预测置信度、系统负载和推理状态动态调整验证策略,减少无效计算,在生成速度与系统吞吐之间实现更优平衡。
基于DSpark框架,中国联通北京市分公司将模型推理性能提升到原MTP方案的2倍,TPS达到60以上,可有效缩短内容生成等待时间,进一步提升代码开发、长文本处理和Agent连续执行等场景的使用体验。
深耕信创化环境,持续提升模型服务质量
中国联通北京市分公司京元Token平台正持续提升信创化环境下的模型运行效率,推动模型能力更快转化为稳定、可调用的AI服务。
目前,平台已形成覆盖模型部署、性能调优、统一API接入、Token用量统计和运行保障的一体化服务能力。下一步,中国联通北京市分公司将持续跟进前沿模型技术演进,在信创化环境下让前沿模型跑得更快、用得更稳,推动人工智能技术的规模化应用落地。同时,聚焦北京地区客户特点,构建本地算力集群组网、模型部署调优、行业数据标注、智能体开发端到端服务体系。
用户办理方式
中国联通APP“臻选生活”专区已上架49元、79元和99元三档权益产品,为客户提供DeepSeek-V4-Flash模型Token包月服务,路径为“中国联通APP-服务-权益-臻选生活”,用户可根据实际需求自主选购。
相关文章
- 引入DSpark!DeepSeek-V4-Flash正式版上线中国联通北京市分公司京元平台
- 中国联通北京市分公司京元平台上新!全球参数最大开源模型Kimi K3即刻调用
- 中国联通相关团队到访十方融海,围绕AI能力场景化落地展开交流
- 中国联通助力陕历博大唐壁画海外首展
- 中国联通AI+eSIM产业发展计划亮相WAIC 联合京东加速推动100万台终端落地
- 中国联通携手中兴通讯打造Mobile AI时代的5G-A百兆大上行网络
- 中国联通携华为发布全球最大规模5G-A百兆大上行网络
- 风雨逆行千里路,联通守护万家通——中国联通星夜兼程,为温州筑牢通信屏障
- 数智合力启新程 中国联通闪耀2026中国互联网大会
- 聚智向善 赋能未来:中国联通数智创新成果亮相2026人工智能向善全球峰会
- 中国联通北京市分公司“北京市预约挂号统一平台”案例荣膺2026全球数字经济灯塔案例
- AI铸就未来,智绘社区更新 中国联通全域智慧社区方案闪耀物博会
- 六年深耕迭代|中国联通智慧社区平台4.0重磅发布,AI能力全面升级
- AI赋能超千兆!中国联通绘就三晋数字家庭新生活
- 中国联通创新成果精彩亮相2026上海世界移动通信大会
- 中国联通大连市分公司携手中兴通讯圆满完成大连周边海域信号覆盖工程
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









