Kimi也要“入关”了?
最近一个月,月之暗面同时坐上了美国的两张“桌子”。
一张是美国政府讨论限制它的政策桌。
7月22日,美国财政部长Scott Bessent公开表示,正考虑把月之暗面加入贸易黑名单。同一天,特朗普政府科技官员Michael Kratsios指控月之暗面通过蒸馏Anthropic的Fable开发
月之暗面否认了相关指控,称K3的能力提升来自原创的架构改进。
另一张,是美国科技巨头的商业谈判桌。
当地时间8月26日,路透社独家披露,月之暗面正在同时与微软、亚马逊和谷歌谈判,希望让
如果最终谈成,这可能成为中国AI公司与美国大型云厂商之间第一笔重要的收入分成协议。
在此之前,国产模型其实早已陆续“入关”。
去年2月,IBM将两款基于
但这也带来了一个新的问题:
一个已经开放权重的模型,凭什么还能从微软、亚马逊和谷歌手里拿走最高30%的收入?
01
这笔钱现在还悬在谈判桌上。
按照路透社8月26日的报道,月之暗面正在分别与Azure、AWS和Google Cloud讨论
谈判仍处于早期阶段,收入怎么算,数据能开放到什么程度,K3实际消耗了多少Token,都是当前尚未解决的问题。尤其是最后一项,直接关系到未来怎么分钱——云平台每天处理海量模型请求,K3究竟贡献了多少调用量,需要有一套双方都认可的审计办法。
把时间往前拨十几天,这个数字其实并不是第一次出现。
8月7日,路透社已经披露,月之暗面正在为K3的大型商业用户设计收入分成机制,最高比例同样是30%。
再往前看,K3的许可证也为这套安排留下了入口。
这套规则已经落到了真实的商业合作里。
据路透社援引知情人士消息,月之暗面此前已经与一些规模较小的云平台签署过类似的收入分成协议,但具体合作对象和分成条款尚未披露。
目前公开可确认的一例发生在7月20日。中软国际在港交所公告称,已与月之暗面签署Token收入分成及联合创新合作协议。双方将共同面向能源、电力、金融等行业开发企业级Agent;合作中由
分工上,中软国际负责行业场景与企业交付,月之暗面提供
到了8月26日,坐到谈判桌另一边的名字变成了微软、亚马逊和谷歌,事情的分量也随之改变。
Azure、AWS和Google Cloud掌握着全球最重要的一批企业AI客户,而K3的体量又让大型云平台变得格外重要。
它拥有2.8万亿参数,虽然开放权重,但要想把它稳定地跑起来,需要相当庞大的算力基础设施。
64张加速卡,已经远远超过普通企业随手可以搭起来的推理环境。路透社援引分析人士称,由于计算成本巨大,很少有客户会选择完全依靠自己的基础设施运行K3。
于是出现了一个很有意思的局面:权重可以自由下载,大规模的Token消费却不断流向云端。
月之暗面现在希望从这部分收入里分走最高30%。
如果最终谈成,路透认为,这可能成为中国AI公司与美国大型云厂商之间第一笔重要的收入分成协议。
02
中国模型能够进入美国市场,首先靠的是一笔现实的账。
去年2月,
如今,国产模型正越来越多地出现在美国开发者平台、云服务和企业级模型目录中。
这些模型能够在美国市场获得采用,原因并不复杂:性能已经可以站上牌桌,成本又足够有竞争力。
对于每天消耗数十亿甚至更多Token的企业来说,同样一个任务,每百万Token便宜几美元,最后都可能变成一笔很大的账。
与此同时,国产开放权重模型与美国头部模型之间的能力差距也在缩小。在8月26日关于
如果模型能力相差很远,低价只是一种妥协。但当能力进入同一个竞争区间,价格就会变成真正的采购理由。
我们在之前的文章《字节留住微软中国》里写过一个很有意思的镜像:
一方面,中国科技公司需要美国的先进模型、全球云基础设施和合规能力。字节、SHEIN等公司的海外业务,已经成为微软继续留在中国的重要商业理由。路透社披露,到2020年代中期,帮助中国公司走向全球已经成为微软最大的中国相关业务。
另一方面,美国云厂商也需要足够多、足够便宜的模型供给。
7月2日,路透社已经观察到,西方初创企业和开发者对中国开放权重模型的兴趣正在上升——最直接的原因之一,就是性能越来越接近美国头部模型,而价格明显更低。
对于Azure、AWS和Google Cloud来说,模型本身也是云服务的一部分。模型选择越丰富,价格越有竞争力,就越有机会吸引开发者和企业把Token消耗留在自己的平台上。
中国公司需要美国的云平台,美国的云厂商也开始需要中国模型。
到了
既然中国模型已经可以出现在美国企业的模型菜单里,月之暗面现在想知道:这份需求能不能继续变成收入分配上的筹码?
三大云不缺模型,也不缺算力,月之暗面想拿到最高30%的分成,最终还是要看K3能不能给这些平台带来足够多的调用量和客户。
如果客户确实愿意选择
而如果这套分成机制最终能够谈成,意味着月之暗面,以及更多的中国模型厂商,可以将模型需求转化为实实在在的商业议价权。
不过,现在下这个结论还早。三大云尚未与月之暗面达成协议,30%也只是知情人士透露的最高分成要求。最终能谈到多少,甚至能不能谈成,目前都没有答案。
值得注意的是,这场谈判恰好发生在月之暗面准备上市的关键节点。
对于一家最新一轮融资估值已经达到350亿美元、并正在以最高500亿美元估值推进IPO的公司来说,月之暗面现在需要证明的不只是模型能力和用户需求,还有一套能持续挣钱的商业模式。
而如果能让Azure、AWS和Google Cloud接受收入分成,
03
如何在开放权重之后继续赚钱,并不是只有月之暗面需要回答的问题。
8月7日,路透社同时披露,阿里也准备在下一版Qwen上采用类似的收入分成机制。按照知情人士的说法,下一版Qwen仍将开放模型权重,但大型商业用户如果依靠模型获得收入,阿里计划从中分走一部分,具体比例仍在讨论。
和月之暗面不同,阿里自己就是云厂商。Qwen放在阿里云上调用时,阿里本来就可以直接从Token使用中收费;但一旦开放权重被下载到客户自己的服务器,模型后续的商业使用就可能绕开阿里云的计费体系。
现在,阿里准备把收费的边界继续往外推:模型依然开放,大型商业用户即使把Qwen部署在自己的基础设施上,只要围绕它做成了一门足够大的生意,也可能需要重新和阿里分钱。
要想知道为什么
过去一年,开放权重几乎成了国产模型走向全球最快的一条路。
从
低价和开放一起,把分发速度推到了过去很难想象的程度;但模型越往外走,钱也开始沿着越来越多的路径分散出去。
一家云厂商拿到权重,可以自己搭建推理服务,按Token向客户收费;推理平台可以通过提高GPU利用率、优化Token处理效率赚钱;应用公司再把模型包装成Coding、搜索或者Agent产品,继续向下一层用户收费。
虽然模型的使用量涨了起来,钱却未必会沿着原路回到训练模型的公司手里。
面对这种情况,国产模型公司开始走向不同的方向。
简单来说,
智谱的做法又不太一样,虽然它也开放过GLM模型权重,但在收费方式上,智谱反而更接近Anthropic:尽可能把模型能力包装成自己的服务,再一层层卖出去。
开发者可以按Token调用BigModel API,也可以购买GLM Coding Plan订阅;企业客户还可以购买专属实例,把模型部署在独立的计算资源上。API、订阅、企业部署,都能成为收入来源。
和
月之暗面和阿里则又往前走了一步:它们希望把收费范围延伸到自己控制之外。
模型权重仍然可以被下载和部署,但当第三方围绕模型形成足够大的商业收入后,模型公司也希望参与分钱。
在这条路上,月之暗面目前走得更快。
它已经把规则写进K3许可证,也已经出现中软国际这样的收入分成案例,现在又开始和Azure、AWS、Google Cloud讨论最高30%的收入分成。
问题在于,这套收费逻辑在中国或者中小平台上成立是一回事,微软、亚马逊和谷歌愿不愿意接受,又是另一回事。
但如果三大云厂商最终愿意接受收入分成——哪怕不是30%的比例。国产模型“入关”的第二幕,也算真正进入了分钱阶段。
本文来自微信公众号“字母榜”,作者:袁心玥,36氪经授权发布。















