华体会体育官网 - 信息处理架构与数据分析平台

您好,欢迎访问企业软硬件技术支持平台官网!

底层技术积累

47项著作权与专利

极速系统响应

延迟控制在80毫秒内

高并发承载

日均300万次调用

全国业务专线

010-67666283

内部通告
您的位置: 首页 > 研发动态 > 内部通告

研发动态

联系我们

地址:北京市丰台区顺三条21号

咨询热线:

010-67666283

13699652230

网宿科技与趋境科技达成战略合作共推高品质AIToken规模化生产

发布时间:2026-08-14 01:14:34人气:

  

网宿科技与趋境科技达成战略合作共推高品质AIToken规模化生产(图1)

  与趋境科技近日宣布达成深度战略合作。双方将面向企业级AI推理市场,整合技术与资源优势,共同打造高性价比、高品质、高可靠的AI Token生产体系,助力

  根据合作规划,双方将围绕企业级AI推理核心环节展开联合攻关:依托网宿庞大的全球分布式边缘资源底座、智能调度、网络优化、边缘推理及安全技术,结合趋境科技在KTransformers、Mooncake等开源项目以及KV Cache、PD分离等推理优化方向的技术积累,通过“算力底座—网络承载—推理优化—智能调度”全链路优化,共同打磨标准化服务方案,提升AI Token的生产效率与交付稳定性。

  当前,大模型正全面进入企业生产系统、业务流程和智能体应用,Token调用量呈爆发式增长。中国信息通信研究院数据显示,2026年6月中国日均Token调用量接近175万亿,较2024年初增长超千倍。IDC预测,全球年度Token消耗量将从2025年的0.0005 Peta Token增至2030年的15万Peta Token,年复合增长率高达3418%;到2031年,全球活跃智能体数量将达3.5亿个,单智能体Token消耗量可达传统对话应用的百倍乃至千倍级。

  Token需求井喷正在重塑AI基础设施的核心逻辑。过去行业更多以算力规模为核心指标,但随着推理需求爆发和场景复杂度提升,企业更关注Token服务质量、单位算力产出效率和长期使用成本。与此同时,集中式推理模式难以满足高并发、低延时的AI业务需求,边缘推理成为产业共识——通过将算力下沉至用户侧,有效缩短数据传输链路,既满足极致低延时要求,又通过分布式架构实现数据本地化闭环与安全合规。

  此次合作将在边缘推理领域的深厚积累与趋境科技在模型推理优化、算力优化方面的领先技术深度结合,从算力资源到网络、推理及调度进行全链路优化,旨在提升算力向有效Token的转化效率,提升企业级AI推理服务品质。

  作为领先的AI基础设施服务提供商,已构建起覆盖全球的3000+分布式边缘节点与低延时网络,具备高性能算力、网络及存储资源底座,并打造了领先的智能调度与推理平台,可支撑全球范围内毫秒级推理响应,为企业级AI用户在高并发、复杂调用与跨区域服务场景下提供稳定可靠的基础设施保障。

  趋境科技源自清华大学计算机系高性能计算研究所,是全球领先的高效能AI Token生产服务商,专注企业级全场景专属推理解决方案。公司核心团队长期深耕大模型推理开源生态,牵头发起KTransformers,并参与Mooncake的发起与共建。依托全系统异构协同、以存换算等核心技术,公司持续完善模型推理与高品质AI Token生产能力,推动底层资源更高效地转化为满足业务要求的AI Token,兼顾生产效率、服务稳定与成本可控。

  此次战略合作将充分释放算力硬件潜能,提升Token生产效率、服务质量与系统华体会可靠性,降低企业部署和使用大模型的门槛与成本。双方将围绕技术协同、市场拓展与场景验证开展合作,助力更多行业客户以更高效率、更低成本、更强稳定性拥抱AI,推动高品质AI Token生产体系与开源模型在医疗、教育、金融、智能制造等行业场景中的适配,探索企业规模化落地路径。

推荐资讯