本文围绕Kimi K3发布引发的行业波动,展现AI模型迭代极快、领先优势保质期极短的行业现状。 ## 1. Kimi K3发布引发全球行业震动 Kimi K3是月之暗面发布的新大模型,被海外多家机构称为“第二次DeepSeek冲击”,发布后引发费城半导体指数单周重挫10%进入技术性熊市,72小时内美股AI板块合计蒸发4700亿美元。 Kimi K3公开承认总体性能仍落后于Claude Fable 5与GPT-5.6 Sol,但在Arena.ai的前端代码竞技场测评中以1679分获得榜首,超越Claude Fable 5,是2025年DeepSeek-R1后中国模型再次逼近全球领先位置。 受Kimi K3冲击,处于上市关键节点的OpenAI与Anthropic遭遇用户质疑性价比,此前已经承压的半导体行业将下跌归因于此次发布。 ## 2. 国内市场格局因Kimi K3快速生变 Kimi K3的输入输出价格较上代K2.6上涨超3倍,显著高于GLM-5.2及DeepSeek V4 Pro,是目前最贵的国产模型,但发布次日月之暗面ARR创下历史最大单日增幅,随后因算力紧缺暂停C端新用户订阅,拆分会员权益销售。 K3完成整套测试输出1.3亿个Token,接近同类模型平均水平的两倍,更高的Token消耗推高了推理成本,进一步加重了算力压力,也有用户吐槽其Token消耗过快。 此前被市场看好、上市半年股价翻24倍、总市值一度突破1.3万亿港元的智谱,两个交易日因K3发布股价累计下跌超4成,市值跌破5000亿港元。 ## 3. AI模型优势保质期仅一个版本 AI模型迭代速度远超传统行业,性能提升以周甚至天计算,没有永远的领先:阿里巴巴已发布Qwen3.8 Max预览版,马斯克称2万亿参数量的Grok新模型即将完成训练,OpenAI称即将推出性能惊喜的新模型,DeepSeek也即将推出性能逼近GPT-5.6的V4正式版。 传统互联网时代先发优势可随规模放大持续保持,但AI时代优势仅绑定模型性能,**任何领先的保质期往往只有下一个模型发布前**,行业竞争始终在快速推进。
在下一个模型发布之前
2026-07-21 14:55

在下一个模型发布之前

本文来自微信公众号: 山上 ,作者:山上团队


脆弱的模型时代。


作者I薛星星


编辑I蒋浇


封面I Kimi


像所有AI行业人士一样,月之暗面创始人杨植麟喜欢用“AI一天,人间一年”的说法形容AI的迅速迭代。对于刚刚发布的Kimi K3而言,似乎没有什么形容比这句话更为贴切。月之暗面成立至今已有三年,但过去三年的所有积累可能都抵不上这三天的轰动。


自ChatGPT发布以来,中国AI行业有许多次震惊世界的时刻。一部分来自于真正的技术突破,一部分则是媒体与厂商们的自嗨,Kimi K3的发布似乎是唯一能与“DeepSeek时刻”相媲美的。


和去年年初DeepSeek-R1发布后美国芯片产业普跌类似,上周包括英伟达、博通以及美光在内的费城半导体指数重挫10%,创下自2025年4月以来最大单周跌幅,进入技术性熊市区间。媒体统计称,72小时内美股AI板块合计蒸发4700亿美元,约超3万亿人民币。


不止一家海外媒体及研究机构用诸如“DeepSeek 2.0”来形容Kimi K3。《财富》杂志称这是“第二次DeepSeek冲击”,《华尔街日报》强调Kimi加剧了华尔街芯片股抛售,彭博社则表示“Kimi颠覆了美国领先中国的传统认知”。


恐慌的情绪不断蔓延,甚至令OpenAI及Anthropic都备受质疑,因为一家中国开源模型的性能似乎已接近顶级闭源模型。二者本就处在上市前的关键节点,模型性能领先是他们获得高估值以及高定价的关键。部分美国开发者已经在质疑为何还要为Calude和GPT付出这么多的价格。


过去几日,Anthropic宣布为所有Max及Team Premium用户开放Claude Fable 5,但限额50%,此前他们曾因算力问题而计划完全从订阅方案中移除这一模型。OpenAI则在上周多次重置Codex限额,甚至一度取消了5小时的用量限制。


很难说这些事件都是Kimi K3的冲击所致。在此之前,半导体产业已经连续承压数周,华尔街分析师们迫切需要为这轮下跌寻找一个足够醒目、也容易理解的借口——境外势力自然是万能法宝。更不用说OpenAI及Anthropic本就处在激烈竞争之中,已经演变到大打价格战的地步。


但这似乎并不影响美国科技行业对于Kimi K3的惊讶。即便Kimi承认自身总体性能仍落后于Claude Fable 5于GPT-5.6 Sol,诸多海外评测机构仍在测评对K3不吝赞美,排名往往位列前茅。


Arena.ai称Kimi K3以1679分的成绩获得前端代码竞技场榜首,超越Claude Fable 5。这家机构表示,上次中国模型如此接近领先,还是2025年的DeepSeek-R1。


Arena统计中美AI对比


高昂的市场热情下,连杨植麟都成为美国科技圈热议的新偶像人物。大洋彼岸的人民群众疑问为何他当年没有留在美国,而是回到了中国。杨植麟的博士生导师不得不专门发文解释,澄清杨回国并不是由于签证或移民问题,而是他自己坚定要回去创业。


大模型行业仍然遵循着最简单明了的优胜劣汰法则,只要性能足够领先,价格就不是问题。即便K3模型的输入及输出价格均较上代K2.6模型均上涨超3倍有余,也显著高于GLM-5.2及DeepSeek V4 Pro,已经是目前市面上最贵的国产模型,但Kimi依然遭遇了算力紧缺问题。


7月19日晚,Kimi宣布由于算力紧缺,自即日起暂停C端新用户订阅。他们同时调整了会员权益,将原本覆盖Kimi网页版、App以及Kimi Work的通用会员与Kimi Code会员拆分销售。Kimi总裁张予彤称,K3发布次日公司ARR创下历史最大单日增幅。


Kimi官方推文


算力紧缺一定程度上或许也与K3模型自身的Token效率相关。在Artificial Analysis的评测中,K3完成整套测试输出了1.3亿个Token,接近同类模型平均水平的两倍。更长的输出通常意味着更高的推理成本,这可能进一步加重Kimi的算力压力。


社交媒体上,也有不少开发者吐槽Kimi K3是Token消耗大户,有人称跑了15分钟就已经耗尽了5小时的限额。


K3的出圈似乎再一次证明了AI时代模型的脆弱性。仅仅两周之前,中国大模型市场最被人看好的还是已经上市的智谱。上半年智谱发布的GLM-5.2模型被誉为国产开源模型的骄傲,几次大幅上调价格依然紧俏。上市半年来,智谱股价翻了24倍有余,总市值一度突破1.3万亿港元。


但从上周开始,智谱的神话似乎就已松动。上周五,智谱股价下跌28.49%,本周一再跌19.56%,两个交易日股价累计下跌超4成,市值跌破5000亿港元。


Kimi K3的领先可能也维持不了多久。7月19日,阿里巴巴发布Qwen3.8 Max预览版,参数规模达2.4万亿,宣称综合能力在全球范围内仅次于Claude Fable 5。马斯克对外称,拥有2万亿参数量的Grok新模型即将完成初步训练,它可能在保持较高运行效率的同时超越Kimi。


K3发布当天,萨姆·奥尔特曼对外表示,他知道他们过去12个月并非最佳,这主要归咎于他,但他们即将迎来迄今为止最好的12个月。“团队正在做非常出色的工作,我相信你会对他们为你准备的惊喜感到非常满意。”



芯片行业多年来一直奉行着摩尔定律,在成本大致不变的情况下芯片性能大约每18至24个月翻一倍。但就像AI行业人士常常挂在嘴边的“AI一天,人间一年”的说法,AI时代的模型性能提升可能以周甚至天来计算。


去年谷歌的Gemini模型一度令萨姆·奥尔特曼在公司内拉响红色警报,但现在Gemini更流行的称谓是“北美豆包”。彭博社称Gemini 3.5 Pro的发布时间已经推迟数月,因为模型在编程及代码生成能力上未达预期。


刚刚完成首轮融资的DeepSeek被曝即将推出DeepSeek-V4模型的正式版,外界称性能将逼近GPT-5.6,且继续保持极高性价比的优势。


过去的时代总在反复证明时间的重要。无论是PC互联网还是移动互联网,一家公司只要起步足够早、跑得足够快,就有机会赶在窗口关闭前建立先发优势。而随着用户和市场规模不断扩大,领先非但不会被稀释,反而会持续放大,令后来者越来越难以追赶。


但在AI时代,优势并不总是站在时间这一边。所有的领先都建立在模型性能的迭代上,总有后来者不断推出更新的模型,缩短与前者的差距。如果说互联网时代最难追赶的是规模,那么AI最醒目的优势就是模型。只是这种优势的保质期,往往只有一个版本。


两个交易日内股价连跌4成的智谱,今日盘中涨幅一度超35%。市场消息称,智谱已落地1GW级国产AI算力数据中心建设。


竞争仍在继续。

AI创投日报频道: 前沿科技
本内容由作者授权发布,观点仅代表作者本人,不代表虎嗅立场。
如对本稿件有异议或投诉,请联系 tougao@huxiu.com。
正在改变与想要改变世界的人,都在 虎嗅APP