开源模型免费冲击下:云厂商 API 价格战会打穿谁的毛利
企业用路由把成本砍到约95%;开源消灭的是闭源默认溢价。模型层与托管API最先承压,云综合毛利未必同比例被打穿——打穿的是把token当金矿卖的那一页。
模型权重可以免费下载,不等于推理免费。开源把「能力锚」和「价格锚」同时砸向市场:开发者能自建,也能去更便宜的第三方 API;闭源旗舰还想收溢价,就必须证明自己比开源「好出一个代差」。华尔街日报经由智东西等转述的画面很具体:企业把常规任务切到 DeepSeek、智谱 GLM 等更便宜模型,特定场景成本可降约 95%;Vercel 上 DeepSeek 使用份额曾在一个月内从不足 1% 跳到约 17%;OpenRouter 高消费客户里,开源 token 增速约是闭源的 4 倍,逾 500 家机构发生过从专有模型到开源的切换。
价格战已经开打。真正的问题是:毛利会先从谁的报表里被打穿——模型公司、云厂商,还是应用层?
价格锚被拉开之后
闭源旗舰与 DeepSeek 档在 token 单价上可以拉开数十倍差距(报道称部分对比超过 50 倍);简单任务上,便宜模型成本可落到闭源的几个百分点。能力上,顶级闭源仍常被描述为领先开源约 4~6 个月——但企业不等追平才迁移,而是用路由:难题留给贵模型,批量留给便宜模型。系统会「精打细算」,只在必要时升级。
对 DeepSeek「第三条路」的梳理点破商业结构:权重开源换信任与生态,官方 API 仍按量收费;国内通义、文心、豆包等 API 在过去约 12 个月里普遍出现过大幅降价(常见叙事写到超过 50% 的集体下探),锚点被认为是开源把市场价格预期拉下来。开源不是消灭 API,而是消灭「闭源默认溢价」。
谁的毛利更脆
模型层(OpenAI / Anthropic 等)
训练与推理资本开支巨大,靠高单价与调用量覆盖。被迫降价或被分流到开源后,收入端先受伤;若仍要砸算力保代差,亏损扩大、盈利时点后移——这与潜在 IPO 叙事直接打架。成本被称作「huge issue」,是情绪,也是结构警报。贡献利润承压最直接。
开源官方 API 与推理云(DeepSeek、硅基流动、云厂商模型服务)
开源引流带来量,量带来服务器与 GPU 账单。单价打太低,会吸引低频、低意愿流量挤占高峰;官方 API 还要面对「别人用你的开源权重做更便宜推理」的分流。毛利战变成工程战:推理优化栈、调度、投机解码——开源权重通常不含这层。谁能把单位 token 成本压到售价之下,谁留下;留下的也未必厚,只是比亏得慢的人厚。
传统云厂商 IaaS / 大模型平台
更拧巴:一边模型 API 在降价抢开发者,一边智算与 GPU 云可能因供给约束与需求爆炸而涨价或调结构——「token 变便宜、任务变贵」可以并存。云的综合毛利不一定被 API 价格战同比例打穿——可能是产品结构切换:高毛利的托管模型被压价,裸金属/智算反而更好卖;也可能是被客户用开源自建从 PaaS 抽走。打穿的是「托管模型默认高毛利」假设,不一定是整家云公司的综合毛利率。
应用层
反而常是受益方:推理成本下降扩大可做产品集。除非应用自己绑定单一贵模型且不会路由,否则毛利压力小于上游。
价格战打不穿的东西
打不穿的是:复杂任务上的代差、合规与数据驻留、企业采购对稳定性的溢价、以及把模型嵌进办公套件与云账户的切换成本。企业越来越按「每任务总价」而非单 token 评估——闭源若能用更少 token 做完,贵单价未必更贵。云厂商若把模型调用与存储、安全、观测性捆成平台,毛利可以藏在捆绑里,而不是标在 token 价签上。
对创业者:默认架构应是路由与可替换,而不是单供应商信仰。对投资者:看模型公司别只看调用量,要看单价与单位算力成本;看云别只看 AI 收入增速,要看 AI 收入里有多少是在亏钱抢份额。对采购:开源免费是诱饵,账单在推理与工程人天。
开源模型免费冲击,打穿的首先是溢价叙事,其次是扛不住单位经济的 API 卖方。云厂商若只靠「我也有个大模型 API」跟价,毛利会薄;若把战场挪回算力、网络与企业工作负载,价格战未必能从根上打穿整本账。被打穿的,往往是还把 token 当金矿卖的那一页。
数据来源
评论0
暂无评论





