Token导航 LogoToken导航TokenDH.com

中国最贵大模型来了,但Kimi K3真正值钱的可能不只是模型

更新时间 2026-07-18来源 前哨王煜全正文 2349字阅读约 8分钟4 张图片

7月17日,月之暗面发布新一代模型Kimi K3。上一代Kimi K2.6每百万Token的输入、输出价格约为0.95美元和4美元,K3却涨到了3美元和15美元,几乎翻了三到四倍。

不少海外开发者的第一反应不是称赞性能,反而是感叹:便宜的中国模型,好像涨价了

过去一年,中国模型在海外靠低价打开市场,这次K3为什么把价格提到美国中高端模型的区间?

这背后是从国产芯片算力,到AI应用生态格局,一个完整产业链的变迁过程。

周四直播中,王煜全提前和大家预言了中国模型出海追赶编程,拓展赛道的必然,没想到几个小时后就在Kimi这里得到验证。

今天,我们一起看看Kimi K3这次更新最大的价值所在,共同看懂这轮中国AI的新趋势。

图片
前哨直播PPT报告,加入立即获取完整版
海外走红后,K3开始试探另一条路

中国模型在海外扩张已经是不争的事实。

OpenRouter官方数据显示,DeepSeek在该平台的Token份额从2026年初的约9%升至6月初的近20%,5月中旬以来一度成为平台使用量最高的模型厂商。

2026年2月以来,中国模型在美国企业Token使用中的周度占比一直高于30%,最高达到46%。

OpenRouter的数据分析人员估计,中国开放模型的使用成本通常比OpenAI和Anthropic的领先产品低60%至90%。

图片
前哨直播PPT报告,加入立即获取完整版

企业的选择很现实。很多任务并不需要调用最强的模型,只要结果够好、运行稳定、价格便宜,就值得把流量切过去。

AI应用公司Lindy的负责人告诉CNBC,迁移部分任务后,公司预计几个月内就能节省数百万美元。

低价帮助中国模型跨过了海外市场的第一道门槛,也留下一个麻烦:使用量未必会完整变成模型公司的收入

开放权重的开源模型可以由海外云平台自行部署,开发者也可以通过OpenRouter等平台在不同模型之间切换。

调用量上升,收入可能被云服务商、托管平台和路由平台共同分走。

Kimi K3的出现最关键的不只是能力的提升,更重要的是它没有继续把价格压到DeepSeek或GLM的水平,直接冲进了美国中高端模型的价格区间。

显然,月之暗面想证明的事情已经改变:中国模型除了提供便宜Token,也可以依靠复杂任务能力获得更高价格

这条路能不能走通,单看排行榜还不够。

每个Token更贵,完成任务可能更便宜

K3这次采用混合专家架构,共有896个专家,每次激活16个,原生支持图像理解,上下文窗口达100万Token,完整权重计划7月27日前发布。

月之暗面在官方文档中承认,K3整体表现仍落后于Claude Fable 5和GPT-5.6 Sol。

但第三方评测不这么认为,Artificial Analysis给K3的综合智能评分为57,接近Claude Opus 4.8和GPT-5.5,前端编程盲测中它一度排到Arena平台第一,超过了Fable 5。

图片
Kimi K3与其他主流模型的编程能力评测对比

但它平均每秒仅输出约62个Token,低于同档水平,完成整套评测生成了约1.3亿个Token,是可比模型中位数(约6300万)的两倍多。

Artificial Analysis按统一方法估算,K3完成单项评测任务的平均成本约0.94美元,接近GPT-5.6 Sol,低于Claude Opus 4.8,明显高于GLM-5.2和DeepSeek V4 Pro。

那为什么说Kimi K3可能还更便宜?这就要提到大模型背后的一项技术改进KV Cache

具体技术原理和产业影响,王煜全在上周的存储专题、本周的国产芯片专题都有解读,简单说KV Cache把模型算过的上下文保存下来,下一轮遇到相同内容直接复用,省去重复计算。

月之暗面称其官方API在编程任务中的缓存命中率超过90%。

这在Agent场景里尤为关键:Agent会读文件、搜网页、调用工具、改代码,前一轮输出成为下一轮输入,任务越长上下文越长,同样的100万Token,反复重算还是大量复用,成本可能天差地别。

为支撑这套系统,K3用上了Kimi Delta Attention、Attention Residuals和Mooncake分离式推理架构,官方还建议把它部署在64张以上加速卡组成的超节点上。

这一次开源AI正式来到了工业级别,已经是普通开发者难以部署的规模,它也意味着更大、更智能的模型未来还是会掌握在有算力的人手中。

Kimi K3背后,三条暗线开始合流

如果说K3把中国模型的性能追赶、模型的成本结构摆到了台面上,那么几乎同时开幕的世界人工智能大会,展示的是支撑这套成本的整条产业链。

图片
2026世界人工智能大会现场

今年的上海世界人工智能大会有1100余家企业参展,集中展示3000余项产品,其中超过300款计划全球首发。

大会公开信息里,智能体、产业应用和算力成为高频词。华为Atlas 950超节点真机也在现场亮相。

把WAIC与K3放在一起看,一条线索逐渐清晰:模型、应用和算力正在形成新的循环

这条循环再往下就落到芯片上,训练和推理正在分成两个不同的市场,王煜全在本周的国产芯片专题里从华为的集群路线一直讲到国产推理芯片的窗口期。

简单说,训练拼的是万卡集群的通讯协同,推理则已经变成一个竞争白热化的独立市场,中国AI生态下一轮的变迁已经肉眼可见

如果只想知道K3有多少参数,公开新闻已经足够。

想看懂模型变贵以后谁会赚钱、Agent会把算力需求推向哪里、万卡集群里哪些数字真正重要,本周四的直播提供了一张更完整的产业地图。

本周四的【国产芯片产业链扫描】直播中,王煜全从国产模型崛起讲到Token价格和KV Cache,再进一步拆解训练与推理的分化、华为集群路线、国产芯片梯队及AI应用的商业化机会。

模型的排行榜每天都会变化,只有提前把握产业节奏才能看懂下一轮竞争的结果。

文章标签Kimi月之暗面大模型AI产品
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多