月之暗面 Kimi K3 全量开源:2.8 万亿参数模型权重免费开放

2026 年 7 月 16 日,月之暗面在北京 WAIC 期间正式发布旗舰基座模型 Kimi K3;11 天后的 7 月 27 日凌晨(北京时间约 8 点),公司按承诺将 K3 的完整模型权重上传至 HuggingFace,意味着这款总参数达 2.8 万亿的模型正式进入"开放权重(open weight)"阶段。需要明确的是,本次开放的是模型权重而非训练数据与完整训练代码,采用 Modified MIT 许可证,允许商用、微调和私有化部署,但对训练数据/训练代码保持私有,这对绝大多数开发者、企业而言,已经能够满足下载、自托管与合规采购的核心诉求。

Kimi K3 由月之暗面团队基于自研的 Kimi Delta Attention(KDA)混合线性注意力机制与 Attention Residuals(AttnRes)注意力残差技术构建,配合 Stable LatentMoE 框架,在 896 个专家模块中每次仅激活 16 个,整体扩展效率较上一代 K2 提升约 2.5 倍;模型原生支持视觉理解,上下文窗口达 100 万 token。权重文件经 MXFP4 量化后约 594GB,加载需约 1.4TB 显存,官方推荐 64 卡以上加速器组成的超节点集群——这意味着能第一时间自托管跑起来的主要是云厂商和中大型企业,个人开发者更现实的路径仍是通过 Kimi.com、Kimi API 调用。

在能力表现上,K3 在 Artificial Analysis 智能指数评测中获得 57 分,位列全球第三,仅次于 Anthropic 的 Claude Fable 5(60 分)与 OpenAI 的 GPT-5.6 Sol(59 分);在前端编程 Arena 盲测中以 1679 分登顶,超过 Fable 5(1631)与 GPT-5.6 Sol(1618);在 SWE Marathon 软件工程测试中同样取得 42.0 分的全球第一。特斯拉 CEO 马斯克在发布后公开留言"Impressive"表达认可。不过月之暗面也坦诚,K3 在整体用户体验上与 Claude Fable 5、GPT-5.6 Sol 仍存在一定差距。

这一事件的影响是多层次的。对国内 AI 生态而言,继 DeepSeek-R1 之后,中国开源模型再次形成"全球最强开源"的共识,2.8 万亿级参数底座的开源使得中小企业无需自研千亿级基座即可开发行业专用 AI,覆盖智能制造、医疗、教育、芯片设计等赛道。对全球市场而言,K3 发布后 72 小时内美股大型科技股普跌,费城半导体指数进入技术性熊市,全球 EDA 巨头新思科技、铿腾电子股价一度大跌超 12%——市场担忧中国高性能开源模型的大规模采用会影响美国 AI 企业资本开支预期及高端芯片需求。API 定价方面,K3 输入 2 元/百万 token(缓存命中)、20 元/百万 token(未命中),输出 100 元/百万 token,按第三方测算单任务成本约 0.94 美元,约为 Claude Opus 4.8 的一半,价格优势显著。与此同时,K3 的开放也引发了美国监管层的强烈反应,白宫科技政策办公室主任公开指控月之暗面对 Fable 模型进行"工业级蒸馏",OpenAI 与 Anthropic 也在游说限制中国开源权重模型,但英伟达黄仁勋、马斯克及近 200 家硅谷创业公司联名反对,围绕"是否封禁中国开源模型"的博弈正在展开。

总结

Kimi K3 的完整权重开放,标志着开源大模型首次迈入 3 万亿参数时代,其意义远超"免费可用"本身——它同时挑战了闭源 API 的定价权、企业数据主权的叙事方式,以及全球 AI 监管的地缘杠杆。虽然在自托管硬件门槛、事实性幻觉率(独立测得约 51%)等方面仍有现实约束,但 K3 已经用实际行动证明:国产开源模型不仅在成本效率上逼近美国前沿水平,更在编程、长文本等核心赛道实现反超。当一段 2.8 万亿参数的权重可以被任意组织复制进自己的机房,"开源 vs 闭源"的商业模式之争,正被重新推向台前。

posted @ 2026-07-27 15:37  胡萝卜薅代码  阅读(432)  评论(0)    收藏  举报