这是Kimi K3出来之前,中美大模型的价格表,综合价格。仔细研究这个表,美国大模型会被吓死

  大模型的标价分三种,输出价最贵,最贵的百万token输出高达50美元,是最终给到用户看的。输入价便宜多了,但是输入的token非常多,因为中间要做非常多次大模型API调用,上下文非常长,都要全部当作输入发给基座大模型。这里输入价又分为“缓存命中”与“不命中”两种,价格差异很大。这是说,基座大模型收到的输入,其实大部分是前面已经计算过的(告诉它前面干了啥,前因后果),这些输入是“缓存命中”;有一些输入就是新的(又来了新请求、新信息),这些是“缓存不命中”,就要多计算很多。多次调用基座大模型的任务,大部分是缓存命中,甚至可能高达98%。

  最贵的Claude Fable 5,百万token输出50美元,输入缓存不命中10美元、缓存命中1美元。最便宜的是DeepSeek V4-Flash,百万token输出0.28美元,输入缓存不命中0.14美元、缓存命中0.00028美元。这差了有100倍。

  这图中直接给出一个“综合价格”,如Claude Fable 5是2.75美元每百万token。这是Artificial Intelligence这个机构设计的指标“Intelligence Index task”,是说完成一个标准任务,它需要用多少输入,输入里面多少是缓存命中的、不命中的,输出多少token。最后折算下来,百刀token要花2.75美元,比50美元低得多,接近缓存命中的1美元,说明大多数token是缓存命中花的。DeepSeek V4-Flash的综合价格0.02美元,百分之一。即使是性能强得多的DeepSeek V4-Pro,也只要0.04美元。

  在Kimi K3之前,国产大模型里综合价格最贵的是Qwen3.7 Max 1.06美元。性能最强的GLM5.2是0.37美元,一些任务水平和Claude Opus 4.8相近,那个要1.8美元。

  Kimi K3价格是输出15美元,输入缓存不命中3美元,命中0.3美元。这基本是Claude Fable 5的三分之一。按这个比例,综合价格会是0.9美元,而一些任务水平是超过Opus 4.8的,这就厉害了。

  但感觉更可怕的会是DeepSeek V4正式版,如果还是0.04美元综合价格,水平接近Opus 4.8,那美国大模型价格体系真的要崩了。