开源模型权重免费,但推理成本飙升;闭源API价格暴跌,竞争激烈。开源与闭源在价格带上相撞,模型能力不再值钱,利润流向交付层。企业CIO预算转向,混合部署成主流,地缘政治介入,开源定义漂移。 科技新闻。
说到底,这中间差出来的钱,挣的就不是模型能力了,挣的是「省心」。
所以,闭源只要守住交付,它就永远有饭吃。真正该害怕的,是那些只有模型、没有交付的人。
闭源背景与起因
CMU 有项研究算过一笔账,一个小规模部署,30B 参数以下的,三个月就能回本。
中国模型在证明一件事,当开源权重能做到闭源 99% 的事,成本还便宜 60% 以上,定价权,就从闭源手里滑到开源手里了。
不过,这还不是最关键的,最要命的是那个杰文斯悖论。
闭源事件经过
上层是模型层,比参数、跑分、paper。下层是交付层,比稳定、安全、替我扛雷。上层的利润在蒸发,下层的利润在膨胀。
前沿模型中位价现在是 4.50美元每百万 token。中端呢?1.93美元。低预算级别直接压到了0.50美元。
这事在华尔街的数据里更刺眼,a16z 今年 1 月发了一份 CIO 调查,100 家全球 2000 强企业,开源模型的支出占比从上一年的 19% 掉到了 11%。同一批企业,闭源占到 89%。
闭源各方回应
剩下的 96% 去哪了?
我们假设两边都是泾渭分明的,可实际上双方都在从两端往中间靠。
闭源在降价、开放 API、给免费额度,开源在收窄定义、在把训练数据藏起来、在靠云服务收钱。两边都不纯了。
闭源影响分析
好,两条线正在往一起走。然后呢?
今天的 AI,正在同样的剧本上狂奔。
就在这两天,美国参议员 Tom Cotton 发了一封公开信,要求禁止美国政府承包商使用中国的开源模型。
…….
同一张牌桌,玩家在打完全不同的游戏。开源厂商在用模型能力抢 token 份额。闭源厂商,在用交付能力抢预算份额。
第三股,地缘政治在介入,模型选型不再只是一个技术或者商业决策,它开始变成一道合规选择题。
第一股,定义在漂移。你嘴上说的「开源」,跟对方理解的「开源」,可能完全是两件事。
苹果做高端,闭源 iOS,一部 iPhone 六七千,安卓厂商做性价比,开源系统,一两千就能到手,然,后剧本开始反转了。
那到底谁在亏?
IP 免责。SLA 保障。数据不出境。合规审计。企业级权限管理。你发现没有,这些东西,没有一个跟模型能力本身有关。它们全是「交付」层面的事。
安卓厂商被用户「凭什么你只值两千块」的标签锁得死死的,拼命往高端冲;三星做 Galaxy S,华为推 P 系列,价格一路往上跑。
我查了一下,阿里今年 AI 相关收入接近 90 亿人民币,年化 358 亿。它的 AI MaaS,就是模型即服务,年度经常性收入 6 月破了 100 亿,管理层说年底奔着 300 亿去。
本文核心数据来源:
这个逻辑一旦成立,整个 AI 产业链就裂成了两层。
然后呢?真正把这事推到极致的,是月之暗面的 Kimi K3。
最近AI圈最反常的一个趋势,闭源在变便宜,开源越来越贵。真的,没搞反。
…….
整体指数在1.29美元每百万 token 左右,听起来还好,没太离谱。你把它拆开看看,两条线,在往截然相反的方向走。
我们今天聊的「开源」,它更像一种新的闭源。核心资产,训练数据、清洗流程、配比方案,攥在自己手里,只把推理用的权重文件扔出来,说是开源,其实开了一半。
中国模型在 OpenRouter 上的周 token 占比已经超过了 30%,这不是监管部门假装看不见就能消失的数字。
你看到议题在哪了吗?
这不是孤例,中国这批厂商,DeepSeek、阿里、字节、腾讯、智谱、月之暗面,现在清一色打一个策略,内部叫「战略级开源」。
a16z 的调查里,78% 的企业在生产环境跑着 OpenAI,81% 的企业同时用三家以上的模型家族。企业的平均大模型预算,两年内从 450 万美金涨到了 700 万。
可数据不撒谎。BenchLM 有一条指数,专门盯着 AI 推理的市场价格。
所以,我查了这么多数据,得出的结论:终端成本降得越狠,总盘子涨得越大,这就是利润池搬家的逻辑,模型层收不到溢价了,钱顺着管道往两边流。
[1].Mozilla《开源AI状态报告》v1.0、a16z 全球企业 CIO 调查、BenchLM Token Price Index、彭博/Silicon Data LLM Token Expenditure Index、摩根士丹利研报、MIT/HuggingFace 开源定义研究
这是现在,这个差距,正在以肉眼可见的速度收窄。
K3 发布后,OpenAI 加 Anthropic 的合计估值预期被砍了大概 3140 亿美金,而月之暗面自己的估值涨到了 3300 亿人民币。
如果故事到这里就结束了,那 Anthropic 这家公司就不应该存在。可它不仅活着,还活得特别好。
Anthropic 的年化收入从 90 亿美金一路冲到了 600 亿以上。
基座开源,高端闭源,基础能力免费,增值服务付费,免费给你尝,吃饱了得留下来。
你用脚趾头想都知道,这么便宜,谁会只跑一次?
再讲一个细节:
所以,闭源完了,对吧?
我们的直觉是,开源权重免费下载,想跑就跑,能贵到哪去;闭源模型 API 按 token 计费,企业掏的是垄断溢价。你说它在变便宜?鬼才信。
而企业之所以心甘情愿掏这笔钱,因为那 51% 和 79% 之间那 28 个百分点的落差,每个百分点掉下去,烧的是工程师的头发。
就三年,从「用一次心疼一次」到「随便用吧反正也不贵了」。
MIT 和 HuggingFace 去年底联合做了一项研究,追踪了 2022 到 2025 年间所有自称「开源」的大模型,然后按一个硬标准过了一遍筛子,训练数据是否公开。
企业 CIO 不傻,开源权重下载下来只是第一步,后面那摊事,部署、运维、合规、SLA,闭源厂商帮你全包了。多收你几倍的钱,他们还觉得自己省了事。
讲了这么多,有一个前提一直没碰。我们现在说的开源到底什么意思?
然后最吓人的事情就来了。当开源和闭源挤进同一个价格带,模型本身,就不再值钱了。「模型能力」作为一种可以单独卖钱的商品,正在被抽空。
本文由人人都是产品经理作者【王智远】,微信公众号:【王智远】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。
模型强,但企业不敢用,你拿了个世界冠军,没人找你打联赛。
到那一天,「开源更便宜」和「闭源更好」这两个故事,谁都讲不下去了。
所以你看,「开源 vs 闭源」这个框架,正在被三股力量同时撕扯。
Anthropic 收的是「你放心,出了事我兜着」的钱。
同一份 a16z 调查里,它的企业渗透率一年内涨了 25 个百分点,44% 的全球 2000 强企业在用它。不是什么「模型更好」的故事。
省下来的 250 亿不会躺在账户里吃灰,会被重新投到更多的 AI 应用里,跑出更多的 token,烧掉更多的算力。
前面说了,性能差距只剩 3%,编码类任务已经持平,它赢在别的地方。
你也没法假装安全情况不存在,之前有研究用五分钟就摘掉了某些开源模型的安全护栏。
你再看阿里是怎么卖 AI 的?千问全栈开源,权重免费拿;但是呢?推理你得走阿里云。开源是饵,云是鱼钩。
结果非常离谱,2022 年,79% 的开源模型是真正开源,训练数据、权重、代码,全套公开;到了 2025 年,这个数字掉到了 39%。
Anthropic 把自己的推理毛利率从负 94% 拉到了 60% 以上。负 94%什么概念?就是每收一块钱,亏九毛四;现在收一块钱,赚六毛。
MIT 有一项研究算了一笔更狠的账,企业转向开源模型,推理成本能砍掉 70%,全美一年能省大概 250 亿美金。
原因很简单。免费的是权重文件,不是跑起来的成本。
你用开源模型跑推理,需要 GPU,需要工程师调参、压量化、修显存溢出、改 prompt 模板,甚至凌晨两点企业群炸了爬起来定位 bug,这些事,每一分每一秒都在往账本上记。
一边在禁,一边在豁免,企业夹在中间不知道该看谁的脸色。
去了云厂商、系统集成商、那些帮企业把模型「跑起来」的人手里。模型是免费的,落地,是要钱的。
现在手机市场行情,你很难说「安卓更便宜」或者「苹果就是贵」,iPhone 的价格带上探到万元,也在下探到三千。安卓旗舰也敢叫价七千八千。
预算在涨,但涨的是「把 AI 跑通」的钱。
这个辩论本身,正在变成一个比它试图回答的问题更复杂的东西。
AI 正在复刻这个剧本,Mozilla 报告里有一条数据,GPT级别的推理成本,36 个月降了 50 倍,从 20 美元,降到了 0.40 美元每百万 token。
…….
2.8 万亿参数,MIT 协议完全开源,编程能力直接把 GPT-5.6 干翻了。定价呢?100 块人民币每百万 token。发布 48 小时,算力被打爆,新用户直接暂停注册。
听起来,整个趋势就是单向的嘛,变便宜。开源肯定更便宜,板上钉钉的事。
摩根士丹利的报告画了三种终局,闭源赢、开源赢、混合共存。
品牌溢价消失了,替代逻辑成了主流,贵一块钱都要给个理由。
高盛在报告里用了三个字评价这件事:定价权。
这件事已经有一些信号了。
赢在哪呢?
一头流到云厂商的推理账单里,一头流到企业内部的部署维护上。
OpenRouter 的数据,DeepSeek 从今年年初 10% 的 token 份额翻倍到了 18%;中国开源模型整体,从 2025 年初不到 2%,飙到了 2026 年 6 月的 46%。快一半了。
而就在同一年,开放权重,就是只公开模型权重但不给训练数据的那种,首次超过了真正开源的数量。
但一旦上到 200B 到 1T 参数的大规模部署,回本周期是六年。这六年里每一分每一秒,烧的都是交付成本。
钱没消失,却搬家了。
所以,闭源的价格被竞争活活压下来了。
彭博跟 Silicon Data 合推了一条 LLM Token Expenditure Index,就是干这个的,结果很有意思。
第二股,商业模式在融合,定价权在不停换手。
因为便宜的不一定真便宜了,贵的不一定真比别人好了,这盘棋,就从比「谁的模型能力强」,变成了比「谁能把东西安稳地送到客户手里」。
卡在中间的人。手里确实有很强的模型,但没有交付能力;没有企业级支持,也没有稳定供应的算力。
两条线,在中间撞上了。
Mozilla 今年 7 月发了一份开源 AI 状态报告,里面有个数字我看完楞了一下。
然后,白宫却在豁免中国开源权重模型的安全测试要求,200 多家硅谷创业公司联名反对禁令,DoorDash 因为被曝部署了中国开源模型,正在接受调查。
苹果被安卓的市况份额压得难受,开始做 iPhone SE、做中端机型,把均价往下拽。
开源模型支撑了全球大概 33% 的活跃 AI 应用,但它拿走的收入,只有 4%。33% 的活儿你干的,4% 的钱是你的。
闭源这边呢?在往另一边走。
OpenAI、Google Gemini、Claude,三家在同一个价格带上打得头破血流;你的 API 敢比别人贵一倍,企业 CIO 第二天就发邮件:为什么?
更麻烦的是,这事还被政治盯上了。
听起来是不是反了?
它没明说,但数据指向第三种,混合。企业会把最核心、最怕出事的工作负载交给闭源,把高频、低敏感的长尾任务交给开源。两边都活,只是在产业链上挪了位置。
注意啊,这说同一批企业,在开源上花的钱相对变少了,钱,都涌向了闭源的交付方案。
这让整个「开源 vs 闭源」的辩论变得有点荒诞。
别急。这里有个关键概念,叫支出加权价格,它比的是用户实际愿意掏多少钱。
下次有人跟你说「开源模型是免费的」,你可以回他一句:对,权重免费。跑起来,账单在云上等你。
从 2023 年 3 月到现在,整个前沿模型的真实成交价降了 88%。注意,是市场价,就是大家真金白银掏出去的那个数。
是的你没看错。开源,在涨价,这件事的诡异之处在于,开源模型的权重文件确实是免费下载的,凭什么说它在涨?
19 世纪的英国经济学家杰文斯发现,蒸汽机效率越高、烧煤越省;结果呢?英国的煤炭消耗量不降反升。因为烧煤变便宜了,所有人都在用蒸汽机,总用量爆炸了。
更重要的是规模,用开源的人越来越多了。
闭源在往下探,开源在往上挤,它们会在某个价格带上相遇;大概率就是 BenchLM 框出的那块1.9美元到4.5美元的区间。
然后你再看一遍那个表:
以前跑一次心疼半天,现在一个 prompt 不过瘾,跑十次二十次,跑完再让 Agent 自己迭代。
怎么做到的?规模效应,推理优化,硬件成本在降。但最关键的推手,是竞争。
当所有人都在跑开源模型,当 token 量从 34% 冲到 65%,总账单只会往上跳,这是物理定律,和商业模式没有什么大的关系。
闭源,从3.07美元一路往下,开源权重,从0.66美元一路上升。
插一条旁证;DeepSeek V4 Flash,定价0.09美元输入;输出就更便宜了,0.18美元输出百万Token,你再看看闭源前沿模型中的价位,4.5美元;差距大概是25倍。
两条曲线,各自朝对方的地盘走,闭源3.07美元在往下滑,开源0.66美元在往上爬。
我每次想到这个趋势,都会想起 2012 到 2015 年的手机行业,那会儿的格局,跟今天 AI 一模一样。
题图来自Unsplash,基于 CC0 协议。