在下一个模型发布之前
像所有 AI 行业人士一样,月之暗面创始人杨植麟喜欢用“AI 一天,人间一年”的说法形容 AI 的迅速迭代。对于刚刚发布的
自 ChatGPT 发布以来,中国 AI 行业有许多次震惊世界的时刻。一部分来自于真正的技术突破,一部分则是媒体与厂商们的自嗨,
和去年年初
不止一家海外媒体及研究机构用诸如“
恐慌的情绪不断蔓延,甚至令 OpenAI 及 Anthropic 都备受质疑,因为一家中国开源模型的性能似乎已接近顶级闭源模型。二者本就处在上市前的关键节点,模型性能领先是他们获得高估值以及高定价的关键。部分美国开发者已经在质疑为何还要为 Calude 和 GPT 付出这么多的价格。
过去几日,Anthropic 宣布为所有 Max 及 Team Premium 用户开放 Claude Fable 5,但限额 50%,此前他们曾因算力问题而计划完全从订阅方案中移除这一模型。OpenAI 则在上周多次重置 Codex 限额,甚至一度取消了 5 小时的用量限制。
很难说这些事件都是
但这似乎并不影响美国科技行业对于
Arena.ai 称
Arena 统计中美 AI 对比
高昂的市场热情下,连杨植麟都成为美国科技圈热议的新偶像人物。大洋彼岸的人民群众疑问为何他当年没有留在美国,而是回到了中国。杨植麟的博士生导师不得不专门发文解释,澄清杨回国并不是由于签证或移民问题,而是他自己坚定要回去创业。
大模型行业仍然遵循着最简单明了的优胜劣汰法则,只要性能足够领先,价格就不是问题。即便 K3 模型的输入及输出价格均较上代 K2.6 模型均上涨超 3 倍有余,也显著高于 GLM-5.2 及
7 月 19 日晚,
算力紧缺一定程度上或许也与 K3 模型自身的 Token 效率相关。在 Artificial Analysis 的评测中,K3 完成整套测试输出了 1.3 亿个 Token,接近同类模型平均水平的两倍。更长的输出通常意味着更高的推理成本,这可能进一步加重
社交媒体上,也有不少开发者吐槽
K3 的出圈似乎再一次证明了 AI 时代模型的脆弱性。仅仅两周之前,中国大模型市场最被人看好的还是已经上市的智谱。上半年智谱发布的 GLM-5.2 模型被誉为国产开源模型的骄傲,几次大幅上调价格依然紧俏。上市半年来,智谱股价翻了 24 倍有余,总市值一度突破 1.3 万亿港元。
但从上周开始,智谱的神话似乎就已松动。上周五,智谱股价下跌 28.49%,本周一再跌 19.56%,两个交易日股价累计下跌超 4 成,市值跌破 5000 亿港元。
K3 发布当天,萨姆·奥尔特曼对外表示,他知道他们过去 12 个月并非最佳,这主要归咎于他,但他们即将迎来迄今为止最好的 12 个月。“团队正在做非常出色的工作,我相信你会对他们为你准备的惊喜感到非常满意。”
芯片行业多年来一直奉行着摩尔定律,在成本大致不变的情况下芯片性能大约每 18 至 24 个月翻一倍。但就像 AI 行业人士常常挂在嘴边的“AI 一天,人间一年”的说法,AI 时代的模型性能提升可能以周甚至天来计算。
去年谷歌的 Gemini 模型一度令萨姆·奥尔特曼在公司内拉响红色警报,但现在 Gemini 更流行的称谓是“北美
两个交易日的重挫后,市场消息称智谱可能跳过 GLM-5.3,直接推出 GLM-5.5,预计最快将于 8 月发布,据称将具备万亿以上的参数规模。智谱的员工们已经开始在推特上放出小道消息,称现在可能是订阅 GLM Coding Plan 的最佳时机。
刚刚完成首轮融资的
过去的时代总在反复证明时间的重要。无论是 PC 互联网还是移动互联网,一家公司只要起步足够早、跑得足够快,就有机会赶在窗口关闭前建立先发优势。而随着用户和市场规模不断扩大,领先非但不会被稀释,反而会持续放大,令后来者越来越难以追赶。
但在 AI 时代,优势并不总是站在时间这一边。所有的领先都建立在模型性能的迭代上,总有后来者不断推出更新的模型,缩短与前者的差距。如果说互联网时代最难追赶的是规模,那么 AI 最醒目的优势就是模型。只是这种优势的保质期,往往只有一个版本。
两个交易日内股价连跌 4 成的智谱,今日盘中涨幅一度超 35%。市场消息称,智谱已落地 1GW 级国产 AI 算力数据中心建设。
竞争仍在继续。
本文来自微信公众号“山上”,作者:薛星星,36氪经授权发布。















