全球「AI学术顶会」精华汇聚地
您正在使用IE低版浏览器,为了您的雷峰网账号安全和更好的产品体验,强烈建议使用更快更安全的浏览器
此为临时链接,仅用于文章预览,将在时失效
业界 正文
发私信给徐咪
发送

0

阿里云真武超节点Day0适配Kimi K3大模型,双方展开国产算力合作

本文作者: 徐咪   2026-07-28 09:25
导语:7月28日,阿里云真武M890超节点实例已Day0适配Kimi K3,这是国内首个跑通近3万亿参数模型的超节点。双方将进一步展开国产算力合作,千问AI平台和阿里

7月28日,阿里云真武M890超节点实例已Day0适配Kimi K3,这是国内首个跑通近3万亿参数模型的超节点。双方将进一步展开国产算力合作,千问AI平台和阿里云百炼也将提供Kimi K3 的模型API。

 

Kimi K3是目前业界参数规模最大的模型之一,跑通这一规模的模型需要将参数分散到几十张甚至上百张高速互联的GPU卡,让万亿参数“跑得又稳又快”。然而,普通AI集群因通信带宽的局限,无法满足高吞吐、低延迟、高并发的需求。

 

阿里云真武超节点Day0适配Kimi K3大模型,双方展开国产算力合作

 

阿里云真武超节点实例通过ICN Switch高速互联芯片,让64张平头哥真武M890实现800GB/s的全互联,其显存规模达到 9TB,可突破万亿参数模型运行的算力、显存和网络带宽的瓶颈,单实例即可支撑大规模万亿级参数MoE模型的专家并行需求。

 

为提升Kimi K3的运行效率,阿里云、平头哥与Kimi团队从软件栈、算子等层面进行了深度联合适配。例如,真武M890对Kimi K3模型架构的核心算子进行优化,显著提升推理的算力和带宽利用率,可稳定支持最1M长上下文,从容应对长文档理解、复杂推理等场景。测试显示,适配后模型的首Token时延降低约35%,单卡解码吞吐提升1.8倍。

 

目前,国内外主流模型已进入超2万亿参数规模的时代,阿里云真武超节点不仅跑通Kimi K3,还实现了模型的高效运行,意味着国产算力已具备支撑超大参数模型大规模应用的能力。


分享:
相关文章
最新文章
请填写申请人资料
姓名
电话
邮箱
微信号
作品链接
个人简介
为了您的账户安全,请验证邮箱
您的邮箱还未验证,完成可获20积分哟!
请验证您的邮箱
立即验证
完善账号信息
您的账号已经绑定,现在您可以设置密码以方便用邮箱登录
立即设置 以后再说