本文来自微信公众号: 山上 ,作者:山上团队

脆弱的模型时代。

作者I薛星星

编辑I蒋浇

封面I Kimi

像所有AI行业人士一样,月之暗面创始人杨植麟喜欢用“AI一天,人间一年”的说法形容AI的迅速迭代。对于刚刚发布的Kimi K3而言,似乎没有什么形容比这句话更为贴切。月之暗面成立至今已有三年,但过去三年的所有积累可能都抵不上这三天的轰动。

自ChatGPT发布以来,中国AI行业有许多次震惊世界的时刻。一部分来自于真正的技术突破,一部分则是媒体与厂商们的自嗨,Kimi K3的发布似乎是唯一能与“DeepSeek时刻”相媲美的。

和去年年初DeepSeek-R1发布后美国芯片产业普跌类似,上周包括英伟达、博通以及美光在内的费城半导体指数重挫10%,创下自2025年4月以来最大单周跌幅,进入技术性熊市区间。媒体统计称,72小时内美股AI板块合计蒸发4700亿美元,约超3万亿人民币。

不止一家海外媒体及研究机构用诸如“DeepSeek 2.0”来形容Kimi K3。《财富》杂志称这是“第二次DeepSeek冲击”,《华尔街日报》强调Kimi加剧了华尔街芯片股抛售,彭博社则表示“Kimi颠覆了美国领先中国的传统认知”。

恐慌的情绪不断蔓延,甚至令OpenAI及Anthropic都备受质疑,因为一家中国开源模型的性能似乎已接近顶级闭源模型。二者本就处在上市前的关键节点,模型性能领先是他们获得高估值以及高定价的关键。部分美国开发者已经在质疑为何还要为Calude和GPT付出这么多的价格。

过去几日,Anthropic宣布为所有Max及Team Premium用户开放Claude Fable 5,但限额50%,此前他们曾因算力问题而计划完全从订阅方案中移除这一模型。OpenAI则在上周多次重置Codex限额,甚至一度取消了5小时的用量限制。

很难说这些事件都是Kimi K3的冲击所致。在此之前,半导体产业已经连续承压数周,华尔街分析师们迫切需要为这轮下跌寻找一个足够醒目、也容易理解的借口——境外势力自然是万能法宝。更不用说OpenAI及Anthropic本就处在激烈竞争之中,已经演变到大打价格战的地步。

但这似乎并不影响美国科技行业对于Kimi K3的惊讶。即便Kimi承认自身总体性能仍落后于Claude Fable 5于GPT-5.6 Sol,诸多海外评测机构仍在测评对K3不吝赞美,排名往往位列前茅。

Arena.ai称Kimi K3以1679分的成绩获得前端代码竞技场榜首,超越Claude Fable 5。这家机构表示,上次中国模型如此接近领先,还是2025年的DeepSeek-R1。


Arena统计中美AI对比

高昂的市场热情下,连杨植麟都成为美国科技圈热议的新偶像人物。大洋彼岸的人民群众疑问为何他当年没有留在美国,而是回到了中国。杨植麟的博士生导师不得不专门发文解释,澄清杨回国并不是由于签证或移民问题,而是他自己坚定要回去创业。

大模型行业仍然遵循着最简单明了的优胜劣汰法则,只要性能足够领先,价格就不是问题。即便K3模型的输入及输出价格均较上代K2.6模型均上涨超3倍有余,也显著高于GLM-5.2及DeepSeek V4 Pro,已经是目前市面上最贵的国产模型,但Kimi依然遭遇了算力紧缺问题。

7月19日晚,Kimi宣布由于算力紧缺,自即日起暂停C端新用户订阅。他们同时调整了会员权益,将原本覆盖Kimi网页版、App以及Kimi Work的通用会员与Kimi Code会员拆分销售。Kimi总裁张予彤称,K3发布次日公司ARR创下历史最大单日增幅。


Kimi官方推文

算力紧缺一定程度上或许也与K3模型自身的Token效率相关。在Artificial Analysis的评测中,K3完成整套测试输出了1.3亿个Token,接近同类模型平均水平的两倍。更长的输出通常意味着更高的推理成本,这可能进一步加重Kimi的算力压力。

社交媒体上,也有不少开发者吐槽Kimi K3是Token消耗大户,有人称跑了15分钟就已经耗尽了5小时的限额。

K3的出圈似乎再一次证明了AI时代模型的脆弱性。仅仅两周之前,中国大模型市场最被人看好的还是已经上市的智谱。上半年智谱发布的GLM-5.2模型被誉为国产开源模型的骄傲,几次大幅上调价格依然紧俏。上市半年来,智谱股价翻了24倍有余,总市值一度突破1.3万亿港元。

但从上周开始,智谱的神话似乎就已松动。上周五,智谱股价下跌28.49%,本周一再跌19.56%,两个交易日股价累计下跌超4成,市值跌破5000亿港元。

Kimi K3的领先可能也维持不了多久。7月19日,阿里巴巴发布Qwen3.8 Max预览版,参数规模达2.4万亿,宣称综合能力在全球范围内仅次于Claude Fable 5。马斯克对外称,拥有2万亿参数量的Grok新模型即将完成初步训练,它可能在保持较高运行效率的同时超越Kimi。

K3发布当天,萨姆·奥尔特曼对外表示,他知道他们过去12个月并非最佳,这主要归咎于他,但他们即将迎来迄今为止最好的12个月。“团队正在做非常出色的工作,我相信你会对他们为你准备的惊喜感到非常满意。”


芯片行业多年来一直奉行着摩尔定律,在成本大致不变的情况下芯片性能大约每18至24个月翻一倍。但就像AI行业人士常常挂在嘴边的“AI一天,人间一年”的说法,AI时代的模型性能提升可能以周甚至天来计算。

去年谷歌的Gemini模型一度令萨姆·奥尔特曼在公司内拉响红色警报,但现在Gemini更流行的称谓是“北美豆包”。彭博社称Gemini 3.5 Pro的发布时间已经推迟数月,因为模型在编程及代码生成能力上未达预期。

刚刚完成首轮融资的DeepSeek被曝即将推出DeepSeek-V4模型的正式版,外界称性能将逼近GPT-5.6,且继续保持极高性价比的优势。

过去的时代总在反复证明时间的重要。无论是PC互联网还是移动互联网,一家公司只要起步足够早、跑得足够快,就有机会赶在窗口关闭前建立先发优势。而随着用户和市场规模不断扩大,领先非但不会被稀释,反而会持续放大,令后来者越来越难以追赶。

但在AI时代,优势并不总是站在时间这一边。所有的领先都建立在模型性能的迭代上,总有后来者不断推出更新的模型,缩短与前者的差距。如果说互联网时代最难追赶的是规模,那么AI最醒目的优势就是模型。只是这种优势的保质期,往往只有一个版本。

两个交易日内股价连跌4成的智谱,今日盘中涨幅一度超35%。市场消息称,智谱已落地1GW级国产AI算力数据中心建设。

竞争仍在继续。

本内容由作者授权发布,观点仅代表作者本人,不代表虎嗅立场。如对本稿件有异议或投诉,请联系 tougao@huxiu.com。

本文来自虎嗅,原文链接:https://www.huxiu.com/article/4877026.html?f=wyxwapp