98出海

2.8 万亿参数、按调用量分成:中国大模型第一次用这种方式出海

2.8 万亿参数、按调用量分成:中国大模型第一次用这种方式出海

 

中国大模型出海,过去两年一直是"上架"逻辑。

 

这次不一样——计价方式变了。

 

这不是又一次"上架",是计价方式变了

 

过去,国产大模型出海有两条主路径。一是 API 直连,模型公司自己获客、自己结算、自己运维;二是项目定制,针对特定客户做私有化或联合开发。前者需要强大的海外销售、支付、税务与法务体系;后者难以标准化复制,规模天花板明显。按调用量分成,把费用结构彻底改了:推理与算力成本由云厂商承担,模型厂商只分享收益。

 

对全球企业开发者来说,变化同样直接。通过 Bedrock 调用 Kimi K3,不需要单独与模型公司签约、单独结算、单独做安全评估——一个云账号、一套权限体系、一张账单就能完成。高盛此前分析指出,与海外云服务商合作的一大好处,是模型厂商在获得分成的同时无需自行承担推理与计算成本,从而带来毛利率提升。

 

2.8 万亿参数,意味着自建部署几乎不现实

 

Kimi K3 是 2.8 万亿参数的混合专家模型,原生支持视觉能力,上下文窗口达 100 万 token,2026 年 7 月 16 日发布,扩展效率较上一代 Kimi K2 提升约 2.5 倍。开发者可通过 us.moonshotai.kimi-k3 与 global.moonshotai.kimi-k3 调用,Bedrock 标准定价为输入每百万 token 3 美元、输出 15 美元,缓存输入 0.30 美元。

 

开放权重意味着可以下载、可以修改,但这样的体量让自行部署门槛极高,对绝大多数企业客户而言并不现实,大型云服务商因此仍是模型进入企业市场的主要通道。K3 在 Bedrock 上还是首个支持显式提示词缓存的开放权重模型,通过复用上下文降低延迟与输入成本;亚马逊同时表示,它在 Bedrock 上运行时与闭源专有模型处于相同的安全边界内,数据在 AWS 边界内处理,不共享给模型提供商,也不用于训练底层模型。

 

许可条款早已为分成留了口子

 

K3 的开源许可并非无条件开放。协议规定,如果被许可方或其关联方运营模型即服务业务,且在任意连续 12 个月内的总营收合计超过 2000 万美元,则在使用 K3 进行商业化之前,必须与月之暗面另行签订单独协议。这一条几乎是为云厂商的分成合作量身设计的:小规模使用不受约束,规模化的商业分发则回到谈判桌上。

 

这说明中国厂商对开放权重的理解已经分层——权重可以开放,但规模化变现的路径要握在自己手里。截至 6 月中旬,月之暗面年化经常性收入突破 3 亿美元,API 收入占比超七成,海外付费用户与 API 收入均增长 400%,覆盖 200 多个国家和地区。

 

同业跟进与三个待验证的问题

 

这条路径不是孤例。智谱管理层在 9 月 16 日的电话沟通会中披露,公司已与海内外头部云服务商签署收入分成协议,相关收入将从 10 月起确认,GLM 系列开源模型以托管接口形式在海外云平台提供服务。摩根士丹利在同期报告中写道,这反映出管理层认为开源模型的分发与商业化并不互斥。

 

值得跟踪三件事:首份披露分成收入的财报口径;另外两家全球云厂商会不会跟进同类协议;以及 K3 在 Bedrock 上的实际调用占比。开源解决的是能不能被用起来,分成解决的是用起来之后这笔钱归谁。 对中国大模型出海来说,分水岭在于目标的切换——从"被使用"变成"被计价"。(98出海综合报道)