引入DSpark!DeepSeek-V4-Flash正式版上线中国联通北京市分公司京元平台

日前,DeepSeek-V4-Flash正式版开源发布。中国联通北京市分公司依托京元Token服务平台快速完成该模型服务上线,用户可通过统一API接口调用最新版模型能力。

本次部署基于国产算力服务器,中国联通北京市分公司围绕模型加载、缓存管理和服务稳定性开展专项优化,并引入DSpark新一代推测解码加速框架,进一步提升信创化环境下模型的生成速度与推理效率。

正式版聚焦Agent与代码场景,实现能力跃迁

DeepSeek-V4-Flash正式版延续2840亿参数、130亿激活参数和100万Token上下文能力,通过新一轮后训练,进一步增强代码生成、工具调用、复杂任务处理和Agent能力。

此外,模型原生支持Responses API,能够更加便捷地衔接代码助手、工具调用和智能体应用,降低既有应用向新版本迁移和升级的门槛,为企业研发、智能编程及复杂自动化任务提供更加高效的模型选择。

引入DSpark框架,实测TPS达到60以上

传统MTP多Token预测技术能够同时预测多个后续Token,提升模型生成速度。DSpark在此基础上进一步优化候选Token生成和验证机制,可根据预测置信度、系统负载和推理状态动态调整验证策略,减少无效计算,在生成速度与系统吞吐之间实现更优平衡。

基于DSpark框架,中国联通北京市分公司将模型推理性能提升到原MTP方案的2倍,TPS达到60以上,可有效缩短内容生成等待时间,进一步提升代码开发、长文本处理和Agent连续执行等场景的使用体验。

深耕信创化环境,持续提升模型服务质量

中国联通北京市分公司京元Token平台正持续提升信创化环境下的模型运行效率,推动模型能力更快转化为稳定、可调用的AI服务。

目前,平台已形成覆盖模型部署、性能调优、统一API接入、Token用量统计和运行保障的一体化服务能力。下一步,中国联通北京市分公司将持续跟进前沿模型技术演进,在信创化环境下让前沿模型跑得更快、用得更稳,推动人工智能技术的规模化应用落地。同时,聚焦北京地区客户特点,构建本地算力集群组网、模型部署调优、行业数据标注、智能体开发端到端服务体系。

【免责声明】该文章系本网转载,旨在为读者提供更多信息资讯。所涉内容不构成任何投资、消费建议,仅供读者参考。如造成侵权请联系本网处理。

安姆科全链路创新方案助力宠物食品行业破解货架期难题
上一篇 2026年8月4日 10:28
全国最大岚图旗舰店落地武汉,创新“前店后厂”模式赋能产业升级
下一篇 2026年8月4日 10:30

相关推荐