当前主流AI大模型厂商的API业务毛利率普遍较高,成本降低后并未向用户让利,赚得的毛利主要用于下一代模型训练。 ## **1. Anthropic API毛利率超80%** Anthropic仅用两年就从负94%的毛利率攀升至API业务超80%的毛利率,靠的是算力容量扩充和推理工程优化,同等能力推理价格一年中位数降50倍,省出的算力大多转化为毛利。 ## **2. 成本下降并未惠及用户** 推理成本每年降低50倍,但多数厂商未真心降价,部分厂商直接提价,重度用户账单可能翻倍甚至三倍,目前成本节省的红利大多未流向用户。 ## **3. 不同厂商均维持较高毛利** 卖全行业地板价的DeepSeek,V4旗舰API毛利率也达70%-80%;国产厂商智谱API毛利率一年从不到4%升至18.9%,正在逐步修复毛利往变现推进。 ## **4. 赚得的毛利多用于下一代模型训练** AI厂商当前赚得的毛利,基本都会用作下一代模型的训练投入,毛利越高的厂商越有能力扩充算力、储备资源,毛利率不足的厂商则需要持续融资。
我每月花5000元养AI,Anthropic拿走了80%毛利
2026-08-04 10:01

我每月花5000元养AI,Anthropic拿走了80%毛利

本文来自微信公众号: 夕小瑶科技说 ,作者:丸美小沐


这几天,我给AI们续费的时候,顺手把账单拢了一遍。


Claude、Codex两家的套餐,再算上各种国产模型、API,加起来每个月就小五千块。



肉疼归肉疼,我倒没怎么犹豫。



因为这钱花得确实值,一方面帮大家测评模型;另一方面现在Agent是真干活,以前自己得熬一晚上的事儿,现在它一会儿就弄完了。


我出钱,AI干活儿,算是子孝父安。


但交着交着,我突然发现,自己这两年在AI上花的钱真是越来越多了。


从一开始的20刀订阅,到后面批量买API、Max套餐,会员越买越多,越买越贵。但这些钱,到底被谁、以什么姿势赚走了啊。


我决定抽个时间,好好查下账。


◈你每花100元,Anthropic就赚80元


要查账,就先从所谓的行业龙头查起吧。


我找到研究机构SemiAnalysis新发的,对Anthropic营收的测算报告。


报告估算,A社的API业务毛利率,超过80%,综合毛利率65%上下。



而2024年,这个数字还是-94%。


两年,负94到正80。


毛利率的计算,就是收入减去直接成本,再除以收入。


就是说,现在在Claude API上花100块,GPU、云租赁、电力、网络、机房运维、渠道分成加起来一共20块,剩下的80块就是A社的毛利。


但有一样东西,不在这20块的成本里——训练。


训练下一代模型的天价算力,会计上记在研发费用下,不进毛利这本账。


再看两年前的-94%,就好理解了,每收100块,光跑推理的直接成本就要烧掉194块。


当年圈内流传着一句话,「推理即亏损」,卖token属于给英伟达打工,顺便普度众生。


也就是说,两年前我充100块,它得倒贴94块伺候我。现在,它能留下80块。


这数据也挺离谱的。但我扒完这两年的财报,发现这中间还真没什么玄学,就是两特牛逼的事儿凑到了一起。


第一,机器真的多了。


今年五月,Anthropic官宣了跟SpaceX的算力合作,300多兆瓦、22万张GPU的新增容量,一个月内到位。转头,Claude Code的五小时限额直接翻倍。


第二,每张卡能干的活,也变多了。


模型推理团队这两年,本质上一直在干一件事:


挤GPU里的水分。Prompt缓存、批处理、推测解码、量化、MoE路由……


名词一大堆,思路其实就一条:


让同一批机器,在同样的时间里,处理更多请求,吐出更多有效Token。


效果是实打实的。Epoch AI统计过,同等能力的推理价格,中位数一年能降50倍上下。


我一开始还以为看错了,确认了一下,还真不是降50%,是50倍。


机器更多了,每张机器干的活也更多了。


这两件事叠一块,省出来的算力就有了两个去处:一小部分,变成你我限额里的额度;大头,变成财报里的毛利。


至于比例怎么分,全看厂商当时的心情。顺着这个数往下想,我更纳闷了。


好家伙,你的成本年年降,我的成本可是一直在上升啊!



省下来的钱,咋不降价还给我一点?


这两年真金白银地交下来,怎么算我也是A社、OpenAI的天使投资人了。


降个价,哪怕意思一下?


这事儿要是就A社一家这么抠,那还只能怪它自己黑心。可我把整个行业这两年的账都翻了一遍——


好家伙,谁都没打算把这笔钱吐出来。


我把去年的价目表和今年一对比,2026年这一轮,AI价目表上没几家是真心降价的。



Fable 5、Opus 5、GPT-5.6、Qwen3.8-Max,都在强调和上代同定位产品价格持平。


听起来还挺良心。


推理成本每年降低50倍啊,价格纹丝不动。。


甚至有些厂商已经不装了,直接开始涨价。


Kimi K3一口气把价格锚点抬高了五六倍。当然,人家的模型结构和调用成本也确实大幅上涨,这笔账我勉强能理解。


智谱的GLM Coding Plan官宣回归,但最受欢迎的Pro档,连续包月价格从149元直接跳到了538元。


这已经是它一年里的第三轮提价。


A社当然也没忍住。4月,它悄悄把Claude Enterprise从每人每月200美元封顶,改成了按实际算力消耗收费。


对于重度用户来说,账单可能直接翻倍,甚至翻三倍。


就连全行业的价格地板DeepSeek,也开始做峰谷定价。


反正省下来的成本,目前好像没有很多人打算还给我。。


我后来算是琢磨明白了。以前它定价,看的是它跑这一次要花多少钱。现在它定价,看的是这活儿我自己干,得花多少钱。


我越离不开,它就越敢贵。


价是这么定的,那到底赚成什么样了?


我又把各家的毛利率挨个翻了一遍。


◈连最便宜的DeepSeek,毛利也能到70%+


先说DeepSeek。


它卖着全行业的地板价,连涨价都只敢挑高峰时段涨,我本来都准备好心疼一下国产了——


却又被The Information的报道糊了一脸:


DeepSeek的年化收入已逼近5亿美元,V4旗舰API的毛利率,70%到80%。


它卖的是全行业的地板价啊!!


7月31日,DeepSeek V4-Flash正式版API上线公测:输出价2块钱一百万token,多项基准反超自家V4-Pro预览版,整体超GLM-5.2、直追Opus 4.8。


便宜到这个份上,还能赚70%的毛利。


相比之下,A社把最贵的模型卖出80%毛利,赢在定价权;而DeepSeek:把最便宜的模型卖出70%毛利,赢在工程效率。


一个卖爱马仕,一个卖蜜雪冰城,都赚钱,都牛啊。


看完这两家,我有点上头,干脆把手头能找到的几家毛利率口径全扒了出来。



智谱3月底发布的年报显示,2025年收入7.24亿元,同比增长132%,综合毛利率达到41%,API这一块,目前毛利率只有18.9%。


单看18.9%,跟Anthropic和DeepSeek确实没法比。


但往前翻一年,智谱的API毛利率还不到4%。等于一年时间,直接提了将近五倍。


它的MaaS ARR,也就是按照当前收入水平折算出来的年化经常性收入,十二个月里涨了60倍,达到17亿元。


从不断补贴用户,到一年三次提高Coding Plan价格,方向已经很明显了。


智谱正在往变现走。


MiniMax也差不多。


它的毛利率从12.2%爬到25.4%,七成收入来自海外。


虽然离Anthropic还很远,但曲线是往上走的。


要知道,Anthropic从巨额负毛利爬到现在,也就花了两年。


国产几家公司走的,基本是同一条路。


先靠资本和低价把规模跑起来,再一点点把毛利修回来。


一圈翻下来,真正让我看懵的,反而是名气最大的那个——OpenAI。


据多家美媒披露的内部口径,OpenAI一季度收入大幅增长57亿美元、同比翻三倍。


但经营层面依旧巨亏,一季度亏损有93亿美元,non-GAAP利润率-122%。


看得出来,奥特曼好像确实挺良心的,它现在走的还是规模路线。



按照相关测算,OpenAI有将近10亿免费用户,其中每人每月要吃掉约0.7美元的算力。一年下来,就是75亿美元,直接拖累毛利率20-30个百分点。


我对着这笔账愣了一下,合着我交的订阅费,有一部分是在替10亿免费用户买单。


行吧。


这一圈看完,各家的姿势其实完全不一样。


Anthropic靠高价和定价权;DeepSeek靠工程效率。


智谱靠规模增长和提价;MiniMax靠海外收入。


OpenAI则还在拿毛利和融资补贴免费用户。


但不管走哪条路,所有厂商最后争的,都是足够多的毛利。


◈下一代模型训练是最大的花销


账查到这儿,被谁留下的,我已经弄明白了。


但我还想知道最后一层,这些被留下毛利,最后的最后又去了哪?


前面说了,毛利这本账,不算训练费。


但这一代模型赚下来的毛利,恰恰就是下一代模型训练费最大的来源。


我对到这儿突然反应过来,我那天使投资人,还真不是白当的。我这一代交的钱,养着下一代模型的训练。


一家公司的毛利越高,它就越有能力继续买GPU、抢人才、修数据中心、补贴用户。


毛利率低的公司,则必须持续融资。


这也是为什么,今年这么多模型公司开始争着进入资本市场。


SemiAnalysis算过:到2027年,A社扣掉成本能拿出约1600亿美元再投资,OpenAI是920亿。


美国巨头在攒下一代的弹药,国产公司也没闲着。


前两年,国产模型的关键词是:烧钱换规模。


到了今年,大家齐刷刷换成了三个词:涨价、出海、修毛利。


烧钱换规模的剧本翻篇了。接下来,是它们理直气壮赚钱的阶段。


至于我?下个月的钱照交。毕竟活是真好用,账是真算不过它。


参考文献


[1]https://newsletter.semianalysis.com/p/anthropic-3q26-profit-over-1b-the


[2]https://epoch.ai/data-insights/llm-inference-price-trends


[3]https://www.anthropic.com/news/higher-limits-spacex


[4]DeepSeek的毛利率:https://www.theinformation.com/articles/deepseeks-annualized-revenue-nears-500-million-boosting-fundraise-ipo-plans


[5]Anthropic毛利、算力和推理价格:https://newsletter.semianalysis.com/p/anthropic-3q26-profit-over-1b-the

AI创投日报频道: 前沿科技
本内容来源于网络 原文链接,观点仅代表作者本人,不代表虎嗅立场。
如涉及版权问题请联系 hezuo@huxiu.com,我们将及时核实并处理。
正在改变与想要改变世界的人,都在 虎嗅APP