海通国际:AI模型价格战升级价值加速向云和基础设施迁移

博主:fm5i0dxdb2j0考研资深辅导 2026年08月06日 00:55:29

智通财经获悉,海通国际发布研报称,DeepSeek V4-Flash 进一步压低了前沿模型的使用成本,其 API 价格仅为每百万 Token 输入 0.14 美元、输出 0.28 美元,在保持较强综合能力的同时,将单位任务成本压至行业低位。投资上继续看好云和推理基础设施。模型层建议保持谨慎,价格战将进一步削弱单一 API 的稀缺性和定价权 ; 云平台将受益于模型调用量增长及多模型部署需求 ; 基础设施端关注推理芯片、服务器、网络及数据中心产业链。

海通国际主要观点如下:

模型竞争正从参数规模转向后训练与系统工程

V4-Flash 未通过扩大参数实现能力跃升,而是依靠后训练和 Harness 框架强化任务规划、工具调用及错误恢复。未来模型实际效果将越来越取决于模型 +Harness+ 工具 + 数据的整体组合,单纯依靠基础模型能力建立壁垒的难度继续上升。

模型层的定价权仍将承压

当中等强度模型能够以极低价格完成大部分标准化任务,企业将更频繁地在不同模型之间切换,高端闭源模型仅能在复杂推理、高可靠代码及关键任务中维持溢价。模型厂商或进入投入继续增加、Token 价格持续下降的阶段。

低成本模型将加快 Agent 和 AI 应用渗透

Agent 通常需要多轮推理、工具调用和失败重试,模型降价将显著改善 AI 编程、营销等中后台自动化的单位经济模型。应用公司的竞争重点也将回到客户入口、行业数据和工作流闭环,能够对最终任务结果负责的产品更具定价权。

DeepSeek V4 与 Kimi K3 正在推动海外模型市场进入新一轮价格竞争

海外对开放权重生态的支持持续升温,中国模型凭借接近前沿的能力、开放部署和显著成本优势,正加快进入海外开发者和企业的模型选型范围。Kimi K3 将开放模型能力进一步推近海外闭源旗舰,DeepSeek V4-Flash 则将单位任务成本压至行业低位 ; 叠加 OpenAI 近期主动下调 GPT-5.6 Terra 和 Luna 价格,海外模型厂商或从单纯比拼能力转向能力、价格与生态并重,模型 API 价格和毛利率仍将承压。

模型降价将通过杰文斯悖论推动云端使用量增长

高效率模型虽然降低了单次任务的算力消耗,但更低价格也将扩大用户数量、调用频率和可经济部署的场景,带动 Token 消耗和推理需求加速增长。随着企业同时接入更多开源和闭源模型,云平台将成为统一获取算力、部署模型和管理调用的核心入口,模型越便宜、应用越普及,云收入的受益反而可能越明显。

风险提示:1 ) AI 需求不及预期 ;2 ) 地缘政治环境干扰供应链 ;3 ) AI 数据中心建造放缓

本文源自:智通财经网

The End