本文来自微信公众号: 未来图灵 ,作者:张凤静
7月27日晚,月之暗面把Kimi K3的完整模型权重挂上了Hugging Face。

2.8万亿参数,1040亿激活参数,100万Token上下文,原生多模态。同步公开的还有技术报告,以及三项支撑K3训练的关键基础设施技术——MoonEP、FlashKDA和AgentEnv。用月之暗面官方的表述,这是“Kimi K3开放日”。
Hugging Face CEO Clem Delangue发帖说,K3在30分钟内拿下4000多个赞,是平台迄今增长最快的一次发布。Vercel创始人称它是“目前全球最强的开放权重模型”。

vLLM、Fireworks、Together AI、Nebius、Baseten、DigitalOcean,六家海外推理平台Day 0适配(指在大模型正式发布当天,算力侧已完成全链路兼容验证、性能调优与稳定性测试,开发者开箱即用,无需等待适配窗口)。华为昇腾也宣布完成Day 0原生支持。

看起来,这是一场属于开源模型的集体狂欢。
但如果把镜头拉远,AI行业正在分裂成三个截然不同的世界。
第一层分裂:133家站队开源,只有Anthropic说不
K3开源的同一天,硅谷关于“开放权重”的争吵烧到了最旺。
当地时间7月24日,英伟达、微软、Meta等25家机构联名发布《开放权重与美国AI领导力》公开信,呼吁华盛顿不要过早限制可下载、修改和部署的开放权重模型。此后OpenAI、Google、SpaceX陆续加入。

截至7月28日,据微软官网最新文字名单逐项统计签署机构达到133家。芯片厂商、云厂商、安全公司、开源社区——几乎囊括了整个AI产业链。
只有一家没签:Anthropic。
不仅是联名信没签。7月27日,英伟达又牵头成立“开放安全AI联盟”,微软、IBM、Hugging Face、Cisco、Palantir等37家机构加入。Anthropic仍然不在。

OpenAI和Google虽然没加联盟,但至少补签了公开信。Anthropic两头都不在。
更尴尬的是,一位Anthropic员工在X上怼黄仁勋:“你这么爱开源,怎么不把CUDA开源?”被网友群嘲。Hermes Agent负责人回他“Anthropic一如既往发表了最糟糕的观点”,吴恩达也下场评论:你可以不开源,但别阻止别人开源。
7月27日,Anthropic CEO Dario Amodei亲自发声明“灭火”。开头就是:“Anthropic从未主张禁止开放权重模型。”但整篇声明剩下的篇幅,全在讲开放权重模型有多危险——可能被用于生物攻击、网络攻击,可能被恶意行为者利用,权重一旦放出去就收不回来。他提出的三条“解决方案”也一如既往:封锁芯片出口、打击工业级蒸馏、强制安全测试。

图注:Anthropic CEO达里奥·阿莫代伊(Dario Amodei)发文《我们对开源权重模型的立场》正面回应开源争议。
有网友直接翻译了他的潜台词:“立法者们,请帮我禁掉我的竞争对手。”
133家vs1家。这个站位本身,比任何技术评测都更能说明问题——当闭源公司开始用政策游说来应对开源竞争,说明技术上的护城河已经不够用了。
第二层分裂:开源了,但你能跑吗?
K3开源后,月之暗面的官宣文章里有一句话:“现在,每个人都可以下载并部署Kimi K3模型——无论是用于内部研发,还是嵌入到面向终端用户的产品中,均可自由使用。”

图注:“月之暗面”公号截图
“每个人都可以”——这句话很动人。但真相是,大多数人连跑都跑不起来。
K3的完整权重约1.56TB。目前公开验证的最低部署配置,是8张AMD MI355X加速卡。这种卡单张市场估值约2.5万美元,一台8卡服务器成本在25万到35万美元之间,折合人民币170万到240万。
而且这只是“能把模型加载起来”的门槛。知乎上一位答主“平凡”做了详细测算:8张MI355X虽然能放下K3的权重,但生成速度、并发能力和长上下文性能都远达不到生产级。Kimi官方技术文档的建议是64张以上加速卡,这意味着8台八卡服务器,硬件投入约1360万到1900万元。如果全年持续运行,仅电费就可能接近百万元,还不算机房、散热、网络、运维和冗余设备。

图注:知乎答主“平凡”文章截图
“200万只是K3入场券,千万级才接近商业化服务的起点。”
这不是“开源模型”,这是“对云厂商和巨头开源的模型”。
K3采用的MXFP4低精度格式虽然大幅压缩了权重体积,但2.8万亿参数的总规模、896个专家、每次激活16个专家的MoE架构,决定了它对显存、带宽、互联速度的要求是硬性的。单机8卡能加载,但跨卡通信、专家调度、KV缓存管理,每一项都是瓶颈。
所以K3开源之后,第一批真正用上它的是谁?Vercel、Fireworks、Together AI、Modal——全是推理服务商和云平台。它们可以把K3部署在自己的数据中心里,再通过API卖给企业和开发者。
对个人开发者来说,K3开源意味着你可以下载一个1.56TB的文件。然后呢?你需要的不是K3,是8张MI355X。
“开源”这个词,在大模型时代正在被重新定义。传统软件开源,下载就能用。大模型开源,下载只是第一步,后面还有一座算力大山等着你翻。当模型大到个人电脑根本装不下、个人预算根本跑不动的时候,“开放权重”本质上是一种对B端的开放,而不是对C端的开放。
第三层分裂:真正赢麻了的人,是卖算力的人
所以,K3开源这场盛宴里,谁是真正的赢家?
不是被133家孤立的Anthropic。它的闭源商业模式正在被开源浪潮挤压,API定价权在松动——K3在BrowseComp上拿到91.2分,单任务成本2.03美元,是GPT-5.6 Sol的一半,跟Claude Fable 5比不到四成。企业客户会算账:能力差不到10分,价格差几倍甚至几十倍,为什么还要锁死在闭源API上?
也不是跑不动K3的个人开发者。他们下载了1.56TB的文件,然后看着自己的消费级显卡叹了口气。
真正的赢家是卖算力的。
黄仁勋在K3开源前就公开表态:“优秀的中国开放模型应该被使用,美国公司绝对应该获准使用中国模型。”他还发了人生第一条X推文,为那封联名信站台。第二条推文直接官宣“开放安全AI联盟”。

图注:黄仁勋在X的第一个帖子就是发布联署信支持开源AI大模型
为什么他这么积极?英伟达2027财年Q1营收816亿美元,数据中心业务占752亿,超过九成。无论跑的是K3、GLM还是Claude,只要企业买GPU、租算力,英伟达就能收钱。K3的权重1.56TB,最低8张卡、商业级64张卡。模型免费,不代表推理免费。越大的开源模型,越需要更多GPU;越多人部署,越多人买卡。这是一个完美闭环。
对云厂商也一样。微软Azure、Together AI、Fireworks把K3接到自己平台上,提供推理服务、微调服务、托管服务。模型本身不收费,但算力、存储、网络、运维全都收费。开源模型越强,云厂商的服务越好卖。
这就是K3开源背后的产业逻辑:模型层的稀缺性在下降,价值正在从“模型本身”转移到“跑模型的基础设施”上。Anthropic和OpenAI靠模型能力赚钱,英伟达靠跑模型需要的算力赚钱。前者害怕开源,因为开源会稀释模型层的利润;后者欢迎开源,因为开源会扩大算力市场的基数。
结语
K3开放权重,是中国大模型在全球开源生态中的又一个里程碑。2.8万亿参数、896个专家、KDA混合注意力。每一项都在证明,开放模型已进入前沿竞技场。
但这场开放运动也暴露了几个真相。
133家站队、1家被孤立,说明技术路线之争的背后是商业利益。闭源公司不全是为安全担忧,开源阵营也不全是为开发者谋福利——每个人都在捍卫自己的生意。
开放了但用不起,说明大模型的“开放”正在分层:对云厂商开放,对巨头开放,对推理服务商开放,但对普通人来说,它只是Hugging Face上的一个下载按钮。
而最后算总账时会发现:卖铲子的人永远稳赚不赔。
K3的权重已经可以下载了。如果你有8张MI355X,祝你部署顺利。如果没有,技术报告里那些架构设计和工程实践,本身也值得一读。
只是别忘了,在这场“三个世界”的分裂中,每个人都要清楚自己站在哪里——是挥舞联名信的人,是被孤立的人,是跑不动模型的人,还是卖铲子的人。
