7月27日深夜,月之暗面正式发布Kimi K3模型完整权重、47页技术报告,并同步开源支撑其训练的三大核心基础设施技术,成为全球首个实现完全开源的3万亿参数级别大模型。
发布仅半小时,该模型便登顶Hugging Face全球趋势榜,创下开源社区最快增长纪录,国内外多家云厂商、AI应用企业同步宣布完成Day0适配,产业链热度快速升温。
作为月之暗面迄今能力最强的基座模型,Kimi K3采用2.8万亿参数的混合专家(MoE)架构,单token激活16个专家、有效参数约1042亿,在保持高算力效率的同时实现能力跃升。
相比上一代产品,其单位算力的智能输出效率提升2.5倍,原生支持100万token上下文窗口,并搭载自研MoonViT-V2视觉编码器,实现原生图文多模态能力。从实测表现来看,该模型在代码开发、智能体工具调用、长文档理解等核心场景性能逼近全球头部闭源模型,部分代码专项评测实现反超,且推理成本仅为头部闭源模型的二分之一到三分之一,商用性价比突出。
不同于多数开源模型仅开放权重的做法,月之暗面此次同时公开了支撑大模型训练的完整基建技术栈:面向超大MoE的高性能通信库MoonEP、长上下文高性能注意力算子FlashKDA,以及大规模智能体训练沙箱AgentEnv。这套技术方案的公开,大幅降低了3T级大模型的研发与部署门槛。根据行业内测算,搭建一套可用的Kimi K3推理集群成本约2000万元,显著低于市场此前预期。
生态落地速度成为本次发布的另一大亮点。国内方面,华为昇腾宣布完成Kimi K3在Atlas A3超节点上的推理适配,896专家的大规模并行部署可充分发挥昇腾超节点架构优势;阿里云真武M890超节点实例同步实现Day0适配,并将在千问、百炼平台开放模型API服务。海外Nebius、Baseten等六家主流AI基础设施厂商也同步上线支持。应用端,AI编程工具Cursor、智能开发者平台Devin已率先接入Kimi K3,验证了其在代码场景的成熟度与可用性。
在业内看来,Kimi K3开源标志着全球开源大模型正式迈入3T参数时代,将整体抬升行业能力基线。国盛证券指出,前沿开源模型能力逼近闭源水平,将大幅降低下游应用的技术门槛与算力成本,推动AI Agent、行业解决方案加速落地,具备场景与数据壁垒的应用厂商将率先受益。国金证券则认为,3T级大模型将推动行业部署架构向超节点集群升级,带动国产AI芯片、高速互联、推理软件栈的全链条需求,具备完整超节点产品与生态适配能力的国产算力厂商将迎来发展机遇。
值得注意的是,此次开源也印证了“开源与闭源协同发展”的行业共识,此前英伟达CEO黄仁勋曾联合多家科技企业公开表态,支持前沿开源模型与闭源模型并行发展。
对于月之暗面而言,开源在扩大生态影响力的同时,也将反哺其商业化进程,数据显示K3发布后企业年度经常性收入已实现数倍增长。随着3T级开源模型的普及,AI产业将进入技术迭代更快、应用落地更广的新阶段,国产大模型的全球产业竞争力也将进一步凸显。
文章来源:国信家办
* 本文部分图片来源于网络、部分内容源于公开信息整理,如无意中侵犯某家媒体、公司企业或个人等的知识产权,请告知,将在24小时内给予删除相关处理。
风险提示:文章所提及的投资方向,不代表未来长期必然投资的方向。本文内容不构成任何投资建议或邀约,不构成任何产品宣传、推介,不构成亦不应被理解为任何形式的保证或承诺。市场有风险,投资需谨慎。