返回列表 发布新帖
查看: 4|回复: 0

[互联网] 阿里云真武超节点Day0适配Kimi K3:单卡吞吐提升1.8倍

发表于 1 小时前 | 查看全部 |阅读模式

这里或许是互联网从业者的最后一片净土,随客社区期待您的加入!

您需要 登录 才可以下载或查看,没有账号?立即注册

×
7月28日消息,阿里云宣布,真武M890超节点实例已Day0成功适配Kimi K3,成为国内首个跑通近3万亿参数模型的超节点。

跑通Kimi K3这样2.8万亿参数的模型,需要将参数分散到几十甚至上百张高速互联的GPU卡上。普通AI集群因通信带宽局限,无法满足高吞吐、低延迟、高并发的需求。

真武超节点的设计正是为了解决这一瓶颈。其核心芯片真武M890采用自研并行计算架构,内置144GB显存。磐久AL128超节点服务器基于自研AI芯片和互联芯片打造,单机柜128卡紧密耦合互联,P2P时延低于150纳秒。

真武超节点通过ICN Switch 1.0互联芯片,让64张真武M890实现800GB/s高速互联,显存规模达9TB。单实例即可支撑大规模万亿级参数MoE模型部署。

为提升Kimi K3运行效率,阿里云、平头哥与Kimi团队从软件栈、算子等层面进行了深度联合适配。真武M890针对Kimi K3模型架构的核心算子进行了专项优化,显著提升了推理的算力和带宽利用率。

实测数据显示,适配后模型首Token时延降低约35%,单卡解码吞吐提升1.8倍,可稳定支持百万级长上下文场景。

阿里云表示,千问AI平台和阿里云百炼也将同步提供Kimi K3的模型API服务,实现深度协同。

国内外主流模型已迈入超2万亿参数时代,阿里云真武超节点不仅跑通了Kimi K3,更实现了模型的高效运行,意味着国产算力已具备支撑超大参数模型大规模应用的能力。

Sf00b9d9e-b35b-49ca-b37d-fe6d5a52fe63.png

来源:快科技
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Copyright © 2001-2026 Suike Tech All Rights Reserved. 随客交流社区 (备案号:津ICP备19010126号) |Processed in 0.105430 second(s), 8 queries , Gzip On, MemCached On.
关灯 在本版发帖返回顶部
快速回复 返回顶部 返回列表