国产大模型出海“元年”谁在海外市场淘金?

博主:fm5i0dxdb2j0考研资深辅导 2026年09月03日 00:45:53

《科创板日报》9 月 1 日讯(记者 王耐)2026 年,被行业视为大模型出海元年。

OpenRouter 数据显示,中国 AI 大模型周调用量(8 月 17 日至 8 月 23 日)为 40.48 万亿 Token,环比增长 9.88%,周调用量连续十七周超过美国,居全球首位。

调用量持续走高的同时,最近,一款 " 隐身模型 " 的登场让海外开发者社区炸了锅。8 月 20 日深夜,一款名为 Ox Alpha 的模型以 " 隐身模型‌ " 身份上架 OpenRouter。上线后,迅速冲至平台调用量榜首,六天后,被智谱正式认领:Ox Alpha 是 GLM 系列新一代模型。

两件事放在一起看,都展示了国产模型在全球 AI 圈的权重和声量。

" 数据释放出的核心信号,是国产模型已经从‘技术榜单上的可用’,进一步走向‘国际开发者工作流中的高频使用’,特别是在编程、Agent、长上下文等高 Token 消耗场景中形成了规模优势。" 国金证券计算机首席分析师刘高畅表示。

但刘高畅也提醒,OpenRouter 的数据可以证明中国模型在这一国际模型聚合平台上的流量很强,却不能直接等同于全球市场份额、海外用户数量,更不能直接等同于国产模型厂商取得了同等规模的海外收入。

调用量第一的模型 是收入第一的模型吗?

在 OpenRouter,模型排名实时更新,排名指标包括周使用量、模型在平台上的消费金额、编程智能体单次会话的使用成本、市场份额、基准测试、工具调用占比等等。

模型周 Token 调用量排名指标关注度很高。截至 8 月 24 日,总 Token 规模达到 113T。智谱 GLM5.3 Flash(Ox Alpha)、DeepSeek V4 Flash 0731、小米 MiMo ‑ V2.5、GPT ‑ 5.6 Luna、腾讯 Hy3,位居 Token 量前列,国产多个模型 Token 量级达到 10T 级别。

值得注意的是,"Others" 其他模型周 Token 调用量合计 40.8T,占比很高,大量新模型仍然不断涌入市场。

图片来源:OpenRouter(Weekly usage of models across OpenRouter)

不过,Token 调用量不等于付费收入,不等于实际花销。

哪些任务用户付费意愿更高?OpenRouter 数据中,按头部模型的任务花费占比(share of spend),分了四大类。除了通用任务 32.4%、代码任务 30.3% 之外,智能体 Agent 任务排名第三,占比 28.7%,数据处理排第四,占比 8.7%。

记者发现,打开不同任务的模型排行榜单,不同任务的最优模型差异较大,不存在一款模型通吃全部的付费场景。

比如最近关注度颇高的工作任务执行(Workflow Execution),占平台全部消费的 18.7%,是 OpenRouter 上付费价值最高的细分任务之一。

图片来源:OpenRouter(Each task ’ s leading models, ranked by share of spend on OpenRouter)

按付费占比排名,榜单第一名是 Anthropic 的 Claude Opus5,消费占比 13.2%,说明在复杂工作流任务里,高端 Claude 依然是付费客户的首选。国产模型 Kimi K3(月之暗面)高居第 2 位,占比 9.5%,智谱 GLM5.2 排第 4、DeepSeek V4 Pro 0423 排第 6,前十里面国产模型占据 3 席。

这也说明,作为大模型的兵家必争之地,高端复杂 Agent 工作流并没有被单一模型垄断。Anthropic 的高端模型保有优势,但国产的 Kimi、GLM、DeepSeek 在付费维度已经可以和 OpenAI 同台竞争。

国金证券计算机首席分析师刘高畅认为,国产模型连续多周保持较高 Token 规模,说明它们不再只是新模型发布后被集中测试,而是越来越多地进入真实应用链路。尤其是编程助手和 Agent,一项任务可能包含多轮规划、代码生成、工具调用、错误修复和上下文回传,单次任务消耗的 Token 远高于普通聊天。国产模型凭借较好的性价比在这类场景中获得流量,是有实际产业意义的。

图片来源:OpenRouter(Each task ’ s leading models, ranked by share of tokens on OpenRouter)

不过,如果以 Workflow Execution 为评估尺度,把 Token 量占比(share of tokens)和付费占比(share of spend)两个表格放在一起看,国产模型确实存在高 Token 调用量,但由于单次单价低,付费金额占比不匹配的现实矛盾。

不过,专家也提醒,在模型的商业化落地中,各项排名和指标只是参考项,而且商业化价值的全面体现,更应关注实际业务层面的落地和 ROI,而非纸面数据。刘高畅指出," 榜单中的 Token 调用量不等于请求次数、用户数量或者收入。一个模型 Token 更多,可能是用户更多,也可能是上下文更长、输出更冗长,或者少数高强度应用贡献了大量流量。Token 首先是工作负载指标,不是财务指标。"

出海的国产模型 正在撕掉 " 低价标签 "?

近期,一向被称为 " 价格屠夫 " 的 DeepSeek 也上调了价格。比如 DeepSeek-V4-Pro 相比于此前每百万 Tokens 输入(缓存命中)0.025 元、输入(缓存未命中)3 元、输出 6 元的价格,高峰时段涨幅最高达 1100%。

刘高畅认为,DeepSeek 此次价格调整部分项目相对旧价涨幅很大,说明 DeepSeek 正在从统一低价获客,转向按模型能力、时延和峰值容量做收益管理,也说明厂商认为模型质量、用户黏性和生产可用性已经具备一定定价权。

专家也提醒,涨价只是扩大了毛利空间,不等于已经盈利,也不意味着价格战结束。是否盈利仍取决于输入与输出结构、缓存命中率、硬件利用率、企业折扣、坏账和研发摊销。价格提高后,如果用户迅速迁移到第三方托管版本或其他模型,原厂未必能获得预期收益;如果峰值需求迫使厂商大量预留算力,实际成本也可能继续偏高。

" 未来竞争不会只是‘谁最便宜’,而是比单位任务成功成本,也就是完成一项真实工作需要多少 Token、多少重试、多少人工纠错,以及能否提供稳定 SLA、区域部署、数据保护和企业支持。"

刘高畅进一步补充道,判断海外闭环是否真正打通," 我更关注付费 Token 占比、原厂端点占比、90 天留存、企业合同、输出 Token 结构、缓存命中率和单位 Token 毛利,而不是单周调用量。未来最有可能率先跑通的,不一定是单纯卖最便宜 Token 的公司,而是同时掌握高效推理、差异化模型、海外渠道、本地合规和企业服务能力的厂商。"

与此同时,行业也经常将 " 模型出海 " 和 "Token 出海 " 混为一谈。中国信通院人工智能研究所国际发展部主任许珊曾在采访中表示,"Token 出海 " 在物理意义上还未实现,其本质依然是 " 模型出海 "。OpenRouter 上显示的中国大模型服务提供方,其数据中心实体多部署在海外,海外开发者实际使用的是部署在海外云平台上的大模型服务。

中国电信研究院行业与企业战略研究所所长、高级工程师饶少阳也表示,对于 Token 出海的长远发展,中国 AI 将经历规模红利期、生态扎根期、价值主导期三阶段渐进式升级。

目前国内大厂的海外营收情况如何?

近期,国内 AI 厂商的半年报也相继发布,不少大厂的海外营收都非常亮眼。

比如 MiniMax 上半年海外市场收入达到 7083 万美元,占总收入的 60.8%。这一比例较 2025 年全年 73% 在下降,但绝对值仍在增长。

月之暗面方面,截至 6 月中旬,ARR(年度经常性收入)突破 3 亿美元。Kimi B 端负责人黄震昕透露,Kimi 海外付费用户增长 400%,API 收入增长 400%。

根据 Ramp 2026 年 6 月 5 万余家美企账单支付数据,DeepSeek 登顶当月软件趋势榜,Coinbase、Lindy 等美国企业直接付费采购,并非仅采用开源权重本地部署。

字节 " 先圈地,后盖楼 " 的扩张策略和打发同样在海外上演。凭借免费模式、低门槛订阅和本地化策略,AI 豆包海外版 Dola 在东南亚、拉美等市场快速崛起。2026 年第一季度,Dola 单季下载量超过 7200 万次,环比增长 47%,累计下载量在本季度正式突破 2 亿次。2026 年 Q1,Dola 超越 ChatGPT 成为东南亚下载量最高的 AI 应用,并在拉美市场仅次于 ChatGPT。

AI 内容制作方面,昆仑万维 2026 年上半年实现营收 53.59 亿元,海外收入 52.03 亿元,同比增长 51.21%。

快手可灵第二季度 AI 营业收入超过 8.5 亿元,同比增长超 200%。一季度数据显示,可灵收入约 75% 来自海外市场,付费形式中 API 与订阅收入之比为 6:4。今年前五个月为可灵贡献最多 API 收入的十大客户中,有八家来自海外。

The End