2026-09-01 11:26

国产大模型出海“元年”,谁在海外市场淘金?

author_path 财联社AI daily©

本文来自微信公众号: 财联社AI daily ,作者:王耐,原文标题:《国产大模型出海“元年”,谁在海外市场淘金?|深度》


2026年,被行业视为大模型出海元年。


OpenRouter数据显示,中国AI大模型周调用量(8月17日至8月23日)为40.48万亿Token,环比增长9.88%,周调用量连续十七周超过美国,居全球首位。


调用量持续走高的同时,最近,一款“隐身模型”的登场让海外开发者社区炸了锅。8月20日深夜,一款名为Ox Alpha的模型以“隐身模型‌”身份上架OpenRouter。上线后,迅速冲至平台调用量榜首,六天后,被智谱正式认领:Ox Alpha是GLM系列新一代模型。


两件事放在一起看,都展示了国产模型在全球AI圈的权重和声量。


“数据释放出的核心信号,是国产模型已经从‘技术榜单上的可用’,进一步走向‘国际开发者工作流中的高频使用’,特别是在编程、Agent、长上下文等高Token消耗场景中形成了规模优势。”国金证券计算机首席分析师刘高畅表示。


但刘高畅也提醒,OpenRouter的数据可以证明中国模型在这一国际模型聚合平台上的流量很强,却不能直接等同于全球市场份额、海外用户数量,更不能直接等同于国产模型厂商取得了同等规模的海外收入。


调用量第一的模型是收入第一的模型吗?


在OpenRouter,模型排名实时更新,排名指标包括周使用量、模型在平台上的消费金额、编程智能体单次会话的使用成本、市场份额、基准测试、工具调用占比等等。


模型周Token调用量排名指标关注度很高。截至8月24日,总Token规模达到113T。智谱GLM5.3 Flash(Ox Alpha)、DeepSeek V4 Flash 0731、小米MiMo‑V2.5、GPT‑5.6 Luna、腾讯Hy3,位居Token量前列,国产多个模型Token量级达到10T级别。


值得注意的是,“Others”其他模型周Token调用量合计40.8T,占比很高,大量新模型仍然不断涌入市场。


图片来源:OpenRouter(Weekly usage of models across OpenRouter)


不过,Token调用量不等于付费收入,不等于实际花销。


哪些任务用户付费意愿更高?OpenRouter数据中,按头部模型的任务花费占比(share of spend),分了四大类。除了通用任务32.4%、代码任务30.3%之外,智能体Agent任务排名第三,占比28.7%,数据处理排第四,占比8.7%。


记者发现,打开不同任务的模型排行榜单,不同任务的最优模型差异较大,不存在一款模型通吃全部的付费场景。


比如最近关注度颇高的工作任务执行(Workflow Execution),占平台全部消费的18.7%,是OpenRouter上付费价值最高的细分任务之一。


图片来源:OpenRouter(Each task’s leading models,ranked by share of spend on OpenRouter)


按付费占比排名,榜单第一名是Anthropic的Claude Opus5,消费占比13.2%,说明在复杂工作流任务里,高端Claude依然是付费客户的首选。国产模型Kimi K3(月之暗面)高居第2位,占比9.5%,智谱GLM5.2排第4、DeepSeek V4 Pro 0423排第6,前十里面国产模型占据3席。


这也说明,作为大模型的兵家必争之地,高端复杂Agent工作流并没有被单一模型垄断。Anthropic的高端模型保有优势,但国产的Kimi、GLM、DeepSeek在付费维度已经可以和OpenAI同台竞争。


国金证券计算机首席分析师刘高畅认为,国产模型连续多周保持较高Token规模,说明它们不再只是新模型发布后被集中测试,而是越来越多地进入真实应用链路。尤其是编程助手和Agent,一项任务可能包含多轮规划、代码生成、工具调用、错误修复和上下文回传,单次任务消耗的Token远高于普通聊天。国产模型凭借较好的性价比在这类场景中获得流量,是有实际产业意义的。


图片来源:OpenRouter(Each task’s leading models,ranked by share of tokens on OpenRouter)


不过,如果以Workflow Execution为评估尺度,把Token量占比(share of tokens)和付费占比(share of spend)两个表格放在一起看,国产模型确实存在高Token调用量,但由于单次单价低,付费金额占比不匹配的现实矛盾。


不过,专家也提醒,在模型的商业化落地中,各项排名和指标只是参考项,而且商业化价值的全面体现,更应关注实际业务层面的落地和ROI,而非纸面数据。刘高畅指出,“榜单中的Token调用量不等于请求次数、用户数量或者收入。一个模型Token更多,可能是用户更多,也可能是上下文更长、输出更冗长,或者少数高强度应用贡献了大量流量。Token首先是工作负载指标,不是财务指标。”


出海的国产模型正在撕掉“低价标签”?


近期,一向被称为“价格屠夫”的DeepSeek也上调了价格。比如DeepSeek-V4-Pro相比于此前每百万Tokens输入(缓存命中)0.025元、输入(缓存未命中)3元、输出6元的价格,高峰时段涨幅最高达1100%。


刘高畅认为,DeepSeek此次价格调整部分项目相对旧价涨幅很大,说明DeepSeek正在从统一低价获客,转向按模型能力、时延和峰值容量做收益管理,也说明厂商认为模型质量、用户黏性和生产可用性已经具备一定定价权。


专家也提醒,涨价只是扩大了毛利空间,不等于已经盈利,也不意味着价格战结束。是否盈利仍取决于输入与输出结构、缓存命中率、硬件利用率、企业折扣、坏账和研发摊销。价格提高后,如果用户迅速迁移到第三方托管版本或其他模型,原厂未必能获得预期收益;如果峰值需求迫使厂商大量预留算力,实际成本也可能继续偏高。


“未来竞争不会只是‘谁最便宜’,而是比单位任务成功成本,也就是完成一项真实工作需要多少Token、多少重试、多少人工纠错,以及能否提供稳定SLA、区域部署、数据保护和企业支持。”


刘高畅进一步补充道,判断海外闭环是否真正打通,“我更关注付费Token占比、原厂端点占比、90天留存、企业合同、输出Token结构、缓存命中率和单位Token毛利,而不是单周调用量。未来最有可能率先跑通的,不一定是单纯卖最便宜Token的公司,而是同时掌握高效推理、差异化模型、海外渠道、本地合规和企业服务能力的厂商。”


与此同时,行业也经常将“模型出海”和“Token出海”混为一谈。中国信通院人工智能研究所国际发展部主任许珊曾在采访中表示,“Token出海”在物理意义上还未实现,其本质依然是“模型出海”。OpenRouter上显示的中国大模型服务提供方,其数据中心实体多部署在海外,海外开发者实际使用的是部署在海外云平台上的大模型服务。


中国电信研究院行业与企业战略研究所所长、高级工程师饶少阳也表示,对于Token出海的长远发展,中国AI将经历规模红利期、生态扎根期、价值主导期三阶段渐进式升级。


目前国内大厂的海外营收情况如何?


近期,国内AI厂商的半年报也相继发布,不少大厂的海外营收都非常亮眼。



比如MiniMax上半年海外市场收入达到7083万美元,占总收入的60.8%。这一比例较2025年全年73%在下降,但绝对值仍在增长。


月之暗面方面,截至6月中旬,ARR(年度经常性收入)突破3亿美元。Kimi B端负责人黄震昕透露,Kimi海外付费用户增长400%,API收入增长400%。


根据Ramp 2026年6月5万余家美企账单支付数据,DeepSeek登顶当月软件趋势榜,Coinbase、Lindy等美国企业直接付费采购,并非仅采用开源权重本地部署。


字节“先圈地,后盖楼“的扩张策略和打发同样在海外上演。凭借免费模式、低门槛订阅和本地化策略,AI豆包海外版Dola在东南亚、拉美等市场快速崛起。2026年第一季度,Dola单季下载量超过7200万次,环比增长47%,累计下载量在本季度正式突破2亿次。2026年Q1,Dola超越ChatGPT成为东南亚下载量最高的AI应用,并在拉美市场仅次于ChatGPT。


AI内容制作方面,昆仑万维2026年上半年实现营收53.59亿元,海外收入52.03亿元,同比增长51.21%。


快手可灵第二季度AI营业收入超过8.5亿元,同比增长超200%。一季度数据显示,可灵收入约75%来自海外市场,付费形式中API与订阅收入之比为6:4。今年前五个月为可灵贡献最多API收入的十大客户中,有八家来自海外。

本内容来源于网络 原文链接,观点仅代表作者本人,不代表虎嗅立场。
如涉及版权问题请联系 hezuo@huxiu.com,我们将及时核实并处理。