2026年,被行业视为大模型出海元年。
OpenRouter数据显示,中国AI大模型周调用量(8月17日至8月23日)为40.48万亿Token,环比增长9.88%,周调用量连续十七周超过美国,居全球首位。
调用量持续走高的同时,最近,一款“隐身模型”的登场让海外开发者社区炸了锅。8月20日深夜,一款名为Ox Alpha的模型以“隐身模型”身份上架OpenRouter。上线后,迅速冲至平台调用量榜首,六天后,被智谱正式认领:Ox Alpha是GLM系列新一代模型。
两件事放在一起看,都展示了国产模型在全球AI圈的权重和声量。
“数据释放出的核心信号,是国产模型已经从‘技术榜单上的可用’,进一步走向‘国际开发者工作流中的高频使用’,特别是在编程、Agent、长上下文等高Token消耗场景中形成了规模优势。”国金证券计算机首席分析师刘高畅表示。
但刘高畅也提醒,OpenRouter的数据可以证明中国模型在这一国际模型聚合平台上的流量很强,却不能直接等同于全球市场份额、海外用户数量,更不能直接等同于国产模型厂商取得了同等规模的海外收入。
调用量第一的模型是收入第一的模型吗?
在OpenRouter,模型排名实时更新,排名指标包括周使用量、模型在平台上的消费金额、编程智能体单次会话的使用成本、市场份额、基准测试、工具调用占比等等。
模型周 Token 调用量排名指标关注度很高。截至8月24日,总 Token 规模达到 113T。智谱 GLM5.3 Flash(Ox Alpha)、DeepSeek V4 Flash 0731、小米 MiMo-V2.5、GPT-5.6 Luna、腾讯 Hy3,位居 Token 量前列,国产多个模型 Token 量级达到 10T 级别。
值得注意的是,“Others” 其他模型周 Token 调用量合计 40.8T,占比很高,大量新模型仍然不断涌入市场。

图片来源:OpenRouter(Weekly usage of models across OpenRouter)
不过,Token调用量不等于付费收入,不等于实际花销。
哪些任务用户付费意愿更高?OpenRouter数据中,按头部模型的任务花费占比(share of spend),分了四大类。除了通用任务 32.4%、代码任务 30.3%之外,智能体 Agent 任务排名第三,占比 28.7%,数据处理排第四,占比8.7%。
记者发现,打开不同任务的模型排行榜单,不同任务的最优模型差异较大,不存在一款模型通吃全部的付费场景。
比如最近关注度颇高的工作任务执行(Workflow Execution),占平台全部消费的 18.7%,是 OpenRouter 上付费价值最高的细分任务之一。

图片来源:OpenRouter(Each tasks leading models, ranked by share of spend on OpenRouter)
按付费占比排名,榜单第一名是 Anthropic 的 Claude Opus5,消费占比 13.2%,说明在复杂工作流任务里,高端 Claude 依然是付费客户的首选。国产模型Kimi K3(月之暗面)高居第 2 位,占比 9.5%,智谱 GLM5.2 排第 4、DeepSeek V4 Pro 0423 排第 6,前十里面国产模型占据 3 席。
这也说明,作为大模型的兵家必争之地,高端复杂 Agent 工作流并没有被单一模型垄断。Anthropic 的高端模型保有优势,但国产的 Kimi、GLM、DeepSeek 在付费维度已经可以和 OpenAI 同台竞争。
国金证券计算机首席分析师刘高畅认为,国产模型连续多周保持较高Token规模,说明它们不再只是新模型发布后被集中测试,而是越来越多地进入真实应用链路。尤其是编程助手和Agent,一项任务可能包含多轮规划、代码生成、工具调用、错误修复和上下文回传,单次任务消耗的Token远高于普通聊天。国产模型凭借较好的性价比在这类场景中获得流量,是有实际产业意义的。

图片来源:OpenRouter(Each tasks leading models, ranked by share of tokens on OpenRouter)

不过,如果以Workflow Execution为评估尺度,把Token量占比(share of tokens)和付费占比(share of spend)两个表格放在一起看,国产模型确实存在高Token调用量,但由于单次单价低,付费金额占比不匹配的现实矛盾。
不过,专家也提醒,在模型的商业化落地中,各项排名和指标只是参考项,而且商业化价值的全面体现,更应关注实际业务层面的落地和ROI,而非纸面数据。刘高畅指出,“榜单中的Token调用量不等于请求次数、用户数量或者收入。一个模型Token更多,可能是用户更多,也可能是上下文更长、输出更冗长,或者少数高强度应用贡献了大量流量。Token首先是工作负载指标,不是财务指标。”
出海的国产模型正在撕掉“低价标签”?
近期,一向被称为“价格屠夫”的DeepSeek也上调了价格。比如DeepSeek-V4-Pro相比于此前每百万Tokens输入(缓存命中)0.025元、输入(缓存未命中)3元、输出6元的价格,高峰时段涨幅最高达1100%。
刘高畅认为,DeepSeek此次价格调整部分项目相对旧价涨幅很大,说明DeepSeek正在从统一低价获客,转向按模型能力、时延和峰值容量做收益管理,也说明厂商认为模型质量、用户黏性和生产可用性已经具备一定定价权。
专家也提醒,涨价只是扩大了毛利空间,不等于已经盈利,也不意味着价格战结束。是否盈利仍取决于输入与输出结构、缓存命中率、硬件利用率、企业折扣、坏账和研发摊销。价格提高后,如果用户迅速迁移到第三方托管版本或其他模型,原厂未必能获得预期收益;如果峰值需求迫使厂商大量预留算力,实际成本也可能继续偏高。
“未来竞争不会只是‘谁最便宜’,而是比单位任务成功成本,也就是完成一项真实工作需要多少Token、多少重试、多少人工纠错,以及能否提供稳定SLA、区域部署、数据保护和企业支持。”
刘高畅进一步补充道,判断海外闭环是否真正打通,“我更关注付费Token占比、原厂端点占比、90天留存、企业合同、输出Token结构、缓存命中率和单位Token毛利,而不是单周调用量。未来最有可能率先跑通的,不一定是单纯卖最便宜Token的公司,而是同时掌握高效推理、差异化模型、海外渠道、本地合规和企业服务能力的厂商。”
与此同时,行业也经常将“模型出海” 和 “Token 出海” 混为一谈。中国信通院人工智能研究所国际发展部主任许珊曾在采访中表示,“Token出海”在物理意义上还未实现,其本质依然是“模型出海”。OpenRouter上显示的中国大模型服务提供方,其数据中心实体多部署在海外,海外开发者实际使用的是部署在海外云平台上的大模型服务。
中国电信研究院行业与企业战略研究所所长、高级工程师饶少阳也表示,对于Token出海的长远发展,中国AI将经历规模红利期、生态扎根期、价值主导期三阶段渐进式升级。
目前国内大厂的海外营收情况如何?
近期,国内AI厂商的半年报也相继发布,不少大厂的海外营收都非常亮眼。

比如MiniMax上半年海外市场收入达到 7083 万美元,占总收入的 60.8%。这一比例较2025年全年73%在下降,但绝对值仍在增长。
月之暗面方面,截至6月中旬,ARR(年度经常性收入)突破3亿美元。Kimi B端负责人黄震昕透露,Kimi海外付费用户增长400%,API收入增长400%。
根据Ramp 2026 年6 月5万余家美企账单支付数据,DeepSeek 登顶当月软件趋势榜,Coinbase、Lindy 等美国企业直接付费采购,并非仅采用开源权重本地部署。
字节“先圈地,后盖楼”的扩张策略和打法同样在海外上演。凭借免费模式、低门槛订阅和本地化策略,AI豆包海外版Dola在东南亚、拉美等市场快速崛起。2026年第一季度,Dola单季下载量超过7200万次,环比增长47%,累计下载量在本季度正式突破2亿次。2026年Q1,Dola超越ChatGPT成为东南亚下载量最高的AI应用,并在拉美市场仅次于ChatGPT。
AI内容制作方面,昆仑万维2026年上半年实现营收53.59亿元,海外收入52.03亿元,同比增长51.21%。
快手可灵第二季度AI营业收入超过8.5亿元,同比增长超200%。一季度数据显示,可灵收入约75%来自海外市场,付费形式中API与订阅收入之比为6:4。今年前五个月为可灵贡献最多API收入的十大客户中,有八家来自海外。
(文章来源:科创板日报)