本文来自微信公众号: 夕小瑶科技说 ,作者:丸美小沐
这几天,我给AI们续费的时候,顺手把账单拢了一遍。
Claude、Codex两家的套餐,再算上各种国产模型、API,加起来每个月就小五千块。

肉疼归肉疼,我倒没怎么犹豫。

因为这钱花得确实值,一方面帮大家测评模型;另一方面现在Agent是真干活,以前自己得熬一晚上的事儿,现在它一会儿就弄完了。
我出钱,AI干活儿,算是子孝父安。
但交着交着,我突然发现,自己这两年在AI上花的钱真是越来越多了。
从一开始的20刀订阅,到后面批量买API、Max套餐,会员越买越多,越买越贵。但这些钱,到底被谁、以什么姿势赚走了啊。
我决定抽个时间,好好查下账。
◈你每花100元,Anthropic就赚80元
要查账,就先从所谓的行业龙头查起吧。
我找到研究机构SemiAnalysis新发的,对Anthropic营收的测算报告。
报告估算,A社的API业务毛利率,超过80%,综合毛利率65%上下。

而2024年,这个数字还是-94%。
两年,负94到正80。
毛利率的计算,就是收入减去直接成本,再除以收入。
就是说,现在在Claude API上花100块,GPU、云租赁、电力、网络、机房运维、渠道分成加起来一共20块,剩下的80块就是A社的毛利。
但有一样东西,不在这20块的成本里——训练。
训练下一代模型的天价算力,会计上记在研发费用下,不进毛利这本账。
再看两年前的-94%,就好理解了,每收100块,光跑推理的直接成本就要烧掉194块。
当年圈内流传着一句话,「推理即亏损」,卖token属于给英伟达打工,顺便普度众生。
也就是说,两年前我充100块,它得倒贴94块伺候我。现在,它能留下80块。
这数据也挺离谱的。但我扒完这两年的财报,发现这中间还真没什么玄学,就是两特牛逼的事儿凑到了一起。
第一,机器真的多了。
今年五月,Anthropic官宣了跟SpaceX的算力合作,300多兆瓦、22万张GPU的新增容量,一个月内到位。转头,Claude Code的五小时限额直接翻倍。
第二,每张卡能干的活,也变多了。
模型推理团队这两年,本质上一直在干一件事:
挤GPU里的水分。Prompt缓存、批处理、推测解码、量化、MoE路由……
名词一大堆,思路其实就一条:
让同一批机器,在同样的时间里,处理更多请求,吐出更多有效Token。
效果是实打实的。Epoch AI统计过,同等能力的推理价格,中位数一年能降50倍上下。
我一开始还以为看错了,确认了一下,还真不是降50%,是50倍。
机器更多了,每张机器干的活也更多了。
这两件事叠一块,省出来的算力就有了两个去处:一小部分,变成你我限额里的额度;大头,变成财报里的毛利。
至于比例怎么分,全看厂商当时的心情。顺着这个数往下想,我更纳闷了。
好家伙,你的成本年年降,我的成本可是一直在上升啊!

省下来的钱,咋不降价还给我一点?
这两年真金白银地交下来,怎么算我也是A社、OpenAI的天使投资人了。
降个价,哪怕意思一下?
这事儿要是就A社一家这么抠,那还只能怪它自己黑心。可我把整个行业这两年的账都翻了一遍——
好家伙,谁都没打算把这笔钱吐出来。
我把去年的价目表和今年一对比,2026年这一轮,AI价目表上没几家是真心降价的。

Fable 5、Opus 5、GPT-5.6、Qwen3.8-Max,都在强调和上代同定位产品价格持平。
听起来还挺良心。
推理成本每年降低50倍啊,价格纹丝不动。。
甚至有些厂商已经不装了,直接开始涨价。
Kimi K3一口气把价格锚点抬高了五六倍。当然,人家的模型结构和调用成本也确实大幅上涨,这笔账我勉强能理解。
智谱的GLM Coding Plan官宣回归,但最受欢迎的Pro档,连续包月价格从149元直接跳到了538元。
这已经是它一年里的第三轮提价。
A社当然也没忍住。4月,它悄悄把Claude Enterprise从每人每月200美元封顶,改成了按实际算力消耗收费。
对于重度用户来说,账单可能直接翻倍,甚至翻三倍。
就连全行业的价格地板DeepSeek,也开始做峰谷定价。
反正省下来的成本,目前好像没有很多人打算还给我。。
我后来算是琢磨明白了。以前它定价,看的是它跑这一次要花多少钱。现在它定价,看的是这活儿我自己干,得花多少钱。
我越离不开,它就越敢贵。
价是这么定的,那到底赚成什么样了?
我又把各家的毛利率挨个翻了一遍。
◈连最便宜的DeepSeek,毛利也能到70%+
先说DeepSeek。
它卖着全行业的地板价,连涨价都只敢挑高峰时段涨,我本来都准备好心疼一下国产了——
却又被The Information的报道糊了一脸:
DeepSeek的年化收入已逼近5亿美元,V4旗舰API的毛利率,70%到80%。
它卖的是全行业的地板价啊!!
7月31日,DeepSeek V4-Flash正式版API上线公测:输出价2块钱一百万token,多项基准反超自家V4-Pro预览版,整体超GLM-5.2、直追Opus 4.8。
便宜到这个份上,还能赚70%的毛利。
相比之下,A社把最贵的模型卖出80%毛利,赢在定价权;而DeepSeek:把最便宜的模型卖出70%毛利,赢在工程效率。
一个卖爱马仕,一个卖蜜雪冰城,都赚钱,都牛啊。
看完这两家,我有点上头,干脆把手头能找到的几家毛利率口径全扒了出来。

智谱3月底发布的年报显示,2025年收入7.24亿元,同比增长132%,综合毛利率达到41%,API这一块,目前毛利率只有18.9%。
单看18.9%,跟Anthropic和DeepSeek确实没法比。
但往前翻一年,智谱的API毛利率还不到4%。等于一年时间,直接提了将近五倍。
它的MaaS ARR,也就是按照当前收入水平折算出来的年化经常性收入,十二个月里涨了60倍,达到17亿元。
从不断补贴用户,到一年三次提高Coding Plan价格,方向已经很明显了。
智谱正在往变现走。
MiniMax也差不多。
它的毛利率从12.2%爬到25.4%,七成收入来自海外。
虽然离Anthropic还很远,但曲线是往上走的。
要知道,Anthropic从巨额负毛利爬到现在,也就花了两年。
国产几家公司走的,基本是同一条路。
先靠资本和低价把规模跑起来,再一点点把毛利修回来。
一圈翻下来,真正让我看懵的,反而是名气最大的那个——OpenAI。
据多家美媒披露的内部口径,OpenAI一季度收入大幅增长57亿美元、同比翻三倍。
但经营层面依旧巨亏,一季度亏损有93亿美元,non-GAAP利润率-122%。
看得出来,奥特曼好像确实挺良心的,它现在走的还是规模路线。

按照相关测算,OpenAI有将近10亿免费用户,其中每人每月要吃掉约0.7美元的算力。一年下来,就是75亿美元,直接拖累毛利率20-30个百分点。
我对着这笔账愣了一下,合着我交的订阅费,有一部分是在替10亿免费用户买单。
行吧。
这一圈看完,各家的姿势其实完全不一样。
Anthropic靠高价和定价权;DeepSeek靠工程效率。
智谱靠规模增长和提价;MiniMax靠海外收入。
OpenAI则还在拿毛利和融资补贴免费用户。
但不管走哪条路,所有厂商最后争的,都是足够多的毛利。
◈下一代模型训练是最大的花销
账查到这儿,被谁留下的,我已经弄明白了。
但我还想知道最后一层,这些被留下毛利,最后的最后又去了哪?
前面说了,毛利这本账,不算训练费。
但这一代模型赚下来的毛利,恰恰就是下一代模型训练费最大的来源。
我对到这儿突然反应过来,我那天使投资人,还真不是白当的。我这一代交的钱,养着下一代模型的训练。
一家公司的毛利越高,它就越有能力继续买GPU、抢人才、修数据中心、补贴用户。
毛利率低的公司,则必须持续融资。
这也是为什么,今年这么多模型公司开始争着进入资本市场。
SemiAnalysis算过:到2027年,A社扣掉成本能拿出约1600亿美元再投资,OpenAI是920亿。
美国巨头在攒下一代的弹药,国产公司也没闲着。
前两年,国产模型的关键词是:烧钱换规模。
到了今年,大家齐刷刷换成了三个词:涨价、出海、修毛利。
烧钱换规模的剧本翻篇了。接下来,是它们理直气壮赚钱的阶段。
至于我?下个月的钱照交。毕竟活是真好用,账是真算不过它。
参考文献
[1]https://newsletter.semianalysis.com/p/anthropic-3q26-profit-over-1b-the
[2]https://epoch.ai/data-insights/llm-inference-price-trends
[3]https://www.anthropic.com/news/higher-limits-spacex
[4]DeepSeek的毛利率:https://www.theinformation.com/articles/deepseeks-annualized-revenue-nears-500-million-boosting-fundraise-ipo-plans
[5]Anthropic毛利、算力和推理价格:https://newsletter.semianalysis.com/p/anthropic-3q26-profit-over-1b-the
