Loading

Kimi K3 来了,2.8万亿参数、1M上下文 - 月之暗面对自己的定位,变了!

7月16日晚上,Kimi K3 悄悄上线了。

官方确认的,都在这了

目前最权威的信息源不是新闻稿,是 Kimi 开放平台的文档页。能确认的有这些:

项目 内容
参数量 2.8 万亿
架构 Kimi Delta Attention(混合线性注意力)+ Attention Residuals
上下文 100 万 token
多模态 原生视觉理解
思考模式 始终开启,力度只有 max 一档
新能力 tool_choice 工具约束、动态加载工具

两个点值得展开。

2.8 万亿参数,放在国产模型里是目前最大的一个。之前传闻是 2.5 万亿,官方文档把数字坐实了。

模型介绍

Kimi Delta Attention 混合线性注意力加注意力残差,这套组合走的是高效注意力的路线,主要解决长上下文烧算力的问题。1M token 的窗口还能维持这个定价,靠的就是它。

价格:这次不便宜了

先看官方定价(每百万 token):

模型 输入(缓存命中) 输入(未命中) 输出
kimi-k3 ¥2 ¥20 ¥100
kimi-k2.7-code ¥1.30 ¥6.50 ¥27

Kimi K3价格

K3 的输入价格是 K2.7 Code 的 3 倍,输出贵了 3.7 倍。

换算成美元,K3 输入约 2.8 美元、输出约 14 美元,几乎贴着 GPT-5.6 Terra(2.5/15 美元)定价。比 GPT-5.6 Sol(5/30 美元)便宜一半,是 Claude Fable 5(10/50 美元)的三分之一上下。

过去国产模型挑战美国旗舰,打法很统一:性能打八折,价格打一折。K3 是第一次有国产模型在公开 API 定价上,直接站进美国旗舰的价位带。

月之暗面对自己的定位,变了。

C 端会员同步改了档位,五档全用音乐速度术语命名:Adagio 免费,Andante 每月 49 元,Moderato 99 元,Allegretto 199 元,Allegro 699 元。Kimi Code 额度分别是 1 倍、4 倍、20 倍、60 倍,档位越高,K3 可用的上下文越长,最高 1M。

发布当天还有限时充值活动,最高返券 30%。新用户注册送 15 元代金券,可以直接体验 K3。

性能到底什么水平

先说结论:官方一个跑分都还没放。API 文档里只有一句"综合智能达到领先水平",正式通稿和 benchmark 都要等。

现在能看到的全是内测用户的说法,我汇总一下,来源标清楚,信不信由你。

X 上有参与内测的用户爆料,K3 跑分超过 Claude Opus 4.7、GPT-5.5 和 GPT-5.6 Terra,接近 Opus 4.8 的水平,部分测试能摸到 Fable 5。

但这位爆料者自己也留了个心眼:官方之后发 benchmark 的时候,留意它用的是 Terminal-Bench 2 还是 2.1。在更严格的 2.1 上,GPT-5.6 Sol 和 Fable 5 目前仍然领先。

游戏和 3D 是 K3 主打的差异方向。内测案例里有马里奥赛车碰撞物理模拟、3D 盆景生成这类任务,有评价说运动流畅度超过 GPT-5.6 Sol。官方定位里也写了"尤其擅长编程、游戏/3D 与知识类任务"。

另外,发布前 Arena 平台上出现一个代号 Kivine 的匿名模型,圈内普遍认为是 K3 的马甲。而 LMArena、Artificial Analysis 这些独立榜单还没收录 K3,按惯例要等发布后三到六周。现在所有"超谁平谁"的说法,都别全信。

顺便拆一个流传很广的说法:"响应速度提升 37%"。我翻了一圈没找到任何出处,官方文档里也没有,建议别转。

先泼点冷水

没开源。K2 系列全部开放权重,所以不少海外测评想当然把 K3 写成 open-weight。发布当天没有任何开源公告,目前只走 API 和 Kimi Code。之后会不会开源,官方一个字都没提。

网页版不是满血。有媒体当晚实测,复杂生成任务跑了将近 20 分钟,效果和内测版有差距。想体验完整能力,优先 Kimi Code 或 API。

怎么用上

网页版/客户端:进入网页版 https://www.kimi.com/ 可以直接使用,模型选择 K3,这是最直接的方法(但是现在网页端慢的像蜗牛)

API:platform.kimi.com 申请 key,模型名 kimi-k3,兼容 OpenAI SDK 协议。官方文档里有接入 Claude Code、Codex、Cline 的指南,老工具链不用换。

Kimi Code 里按会员档位给额度,已经在用的人切过去没有成本。(K3模型要 Moderato 及以上会员才能用,我订阅的Andante会员,直接不让用😭)

Kimi Code 提示升级会员

有一点要留意:K3 思考模式常开,reasoning_effort 只有 max 一档,没有省电模式。响应快不了,跑长任务的时候多点耐心。

值不值得冲

我的判断分场景。

已经在 Kimi Code 生态里的,直接切,没有试错成本。重度长上下文场景的,缓存命中价每百万 token 2 元很香,1M 窗口加自动缓存,跑大仓库代码分析这类任务性价比不错。

但如果你想拿它替换 Claude 或 GPT 的主力编程位,我建议再等两周。等独立榜单,等官方 benchmark,也等模型状态稳定。它按旗舰收费,大家自然会拿旗舰的标准挑毛病,这怨不得别人。

你会第一时间换 K3 吗,还是先观望?留言区聊聊。

posted @ 2026-07-17 00:33  拓荒者IT  阅读(175)  评论(0)    收藏  举报