周一(8月4日)高盛发布的这份研报数据很直接:中国大陆AI模型市场的年底ARR预测,从原来的100亿美元一口气抬到130亿美元,一次性上调30%。高盛给出的具体拆分是——港股上市的智谱AI(Zhipu)年底ARR预计25亿美元,MiniMax预计10亿美元。
驱动这次上调的三条硬指标:aggressive price cuts(激进降价)、technical breakthroughs(技术突破)、accelerating corporate adoption(企业采用加速)。研报原话:"我们预计中国AI模型之间对最佳性能价格比的竞争将进一步加剧。"
上周五那一天,三家中国厂商同时出招
南华早报梳理的时间线:上周五(8月1日)MiniMax发布了开放权重(open-weight)的H3多模态大模型,能同时处理文本、图像、视频、音频和音乐。定价只有市场同级模型的30%到50%。
同一天,DeepSeek正式为V4 Flash模型开放API访问,前端编码能力对标智谱旗舰GLM-5.2。据Arena AI最新排行榜,GLM-5.2全球前端编码第7,DeepSeek V4 Flash紧随其后第8。
还是同一周,阿里巴巴集团正式推出Qwen3.8 Max,参数规模达2.4万亿。在Arena AI前端编码榜上,Qwen3.8 Max排到第4名,压过了OpenAI旗舰GPT-5.6 Sol(排第6)。Qwen3.8 Max的API定价是每百万输入token 2美元、每百万输出token 6美元;OpenAI的GPT-5.6 Sol则是输入5美元、输出30美元——阿里几乎是OpenAI价格的三分之一到五分之一。
OpenAI被逼直接降价80%
面对这一波中国厂商的价格攻势,OpenAI上周五宣布轻量级模型GPT-5.6 Luna的API价格直接砍80%,降到每百万输入token仅0.20美元;中端GPT-5.6 Terra同步降价20%。这在OpenAI历史上算是相当罕见的一次大幅调价。
另一个信号可能更值得注意:据高盛跟踪,中国开放权重模型目前已经占据OpenRouter等开发者平台上全球token消耗量的近70%。也就是说,全球开发者社群实际用来跑生产环境的模型里,中国货已经是绝对主力。
桌面AI代理战场:腾讯WorkBuddy领跑
竞争已经从大模型本身扩展到"AI工作代理"(agentic tools)领域。腾讯WorkBuddy在6月中国桌面AI代理排名中登顶,按月度访问量拿下34%市场份额;字节跳动的TRAE以21%位居第二。这个赛道,是2026年下半年AI产业新一轮增长的核心之一。
两个警示信号,高盛也点了
报告没有一味唱多。高盛指出,下半年整个API定价和毛利率都可能持续承压——因为几家融资充裕的模型厂商还会用募集资金去补贴激进定价,这场价格战短期内不会停。
另一个是政策风险:报告提到中国监管部门正在考虑限制模型权重的境外下载和训练数据的海外转移。如果政策落地,"中国开源模型主宰全球开发者社区"的故事就可能出现变数。
对本地读者的意义
这份高盛研报值得温哥华华人读者关心的原因有两个:第一,做跨境科技投资的家庭——尤其手里有港股智谱、阿里、腾讯,或者持有美股OpenAI相关ETF的朋友——最近这一周就是关键节点,价格战、市占率、政策风险都在同时演化。第二,做软件外包、SaaS、独立开发者的读者,API价格砍80%意味着未来做基于大模型的产品,成本可能比一年前又降一档,商业模式也会跟着变。
具体的模型能力对比、企业采用比例、后续政策公告,请以高盛研报原文和相关公司官方渠道为准。南早为本次报道的主要来源。