本文来自微信公众号: AI超维度 ,作者:AI MetaView
这两天,DeepSeek创始人梁文锋近期广泛流传的一段讲话在全网刷屏了。
在这份文稿里,梁罕见地点了智谱的名:
"智谱也开源,但是智谱的开源跟我们的开源不一样。智谱的开源有一种被迫的感觉,他们觉得这不是本意,但是对我们来讲,这就是我们的本意。"
梁文锋在一场投资者交流会上说了这番话。投资圈不大,这些话传到智谱那边不需要太久。
7月11日,智谱创始人唐杰发了一封内部信《巨浪已来》,里面专门用一个章节解释智谱的开放路线:
"前沿智能不应只属于少数人,也不应被少数规则随时收回。"
智谱要"一只手向上摸高,一只手向下铺路",最强模型采用MIT协议,任何主体都可以下载、部署和商用。在信里,唐杰宣布智谱启动为期两年的Touch High(摸高)计划——四大研究方向、百亿级投入,暂不追求短期商业变现。"不登顶,就是失败。"
国内互联网分别称他们为"唐圣"和"梁圣"。两个人说了很多相似的话——AGI、理想主义、开源、普惠。但仔细把两份文本对着读下去,真正的分歧藏在共识走到尽头的地方。
唐杰认为通往AGI的道路已经逐渐铺开,接下来需要组织资源向上攀登。梁则认为行业只看到了下一道难题,跨过去的方法仍未出现。
一个在"摸高",一个还在"摸奖"。

基础模型还值钱吗
过去一年,行业里流行一种判断:基础模型正在快速商品化,各家效果差距不大,下一轮竞争只剩Agent、产品和流量。
唐、梁都否定了这个判断。
唐杰在《巨浪已来》中宣布,智谱上市后将"全面回归基础模型研究",未来两年暂时降低短期应用变现的优先级。他的判断很直接:下一次模型升级会重写当前所有的产品和商业模式,真正的机会在"智能上界"的跃迁。
梁的判断更加极端。他把DeepSeek的C端用户、B端API收入都称为通往AGI过程中的阶段性产出。视频生成是好生意,世界模型也很热门,但只要与当前智能上限关系不大,DeepSeek就暂时不做。
智谱今年1月在港交所上市,市值超万亿港元,是国内第一家上市的大模型公司。一家万亿市值的上市公司宣布两年不以变现为优先,一家没有上市也不打算短期上市的公司把所有商业收入叫做"副产品",两个完全不同的出发点,得出了同一个结论。
但两个人都没有说的一件事是:当前大家最关注的AI写代码能力,领先很难持续。因为代码能不能跑通,一测就知道,训练方法一旦成熟就很容易被同行复制。AI超维度从多位业内人士处了解到,今年下半年,很可能同时出现4~5个接近海外顶级水平的国产Coding模型。写代码这一层,大家很快就会拉不开差距了。
真正能拉开差距的,是下一层的能力——持续学习、自我训练、长期记忆。这些能力目前全世界没有任何一家公司做通。唐、梁二人同时把话题推向AGI,不仅是因为他们相信那里有更大的机会,也因为当前这层领先正在保不住了。
模型的第一个用户是自己
“唐圣”和“梁圣”对“下一代模型应该首先做什么”给出了非常一致的回答:帮自己。
唐的"摸高计划"中最核心的方向之一是完全自我训练——模型自己写代码、自己生成训练数据、自己判断质量好不好,然后用这些数据训练下一版的自己,逐步缩短下一代模型的研发周期。“梁圣”表达了几乎相同的目标:DeepSeek下一版模型的第一目标,是让DeepSeek自己用得更好,模型先帮助内部研究员开发下一版模型。
公众通常用排行榜、用户量和API收入判断一家模型公司。而唐、梁二人更关心的是一个外界很难直接观测的内部闭环:一个模型能不能帮助模型公司更快地生产下一个模型。这个闭环一旦转起来,领先者的优势会非线性扩大。
但要实现这个闭环,模型必须具备一种当前还不存在的能力。
当前Coding Agent可以完成单次编码任务,距离真正进入模型研发还有很长的距离。它需要读懂长期代码库,理解数月甚至数年的实验历史,记住哪些路线已经失败,设计新的对照实验,判断结果是否真的有价值。即使是像Anthropic家的Claude Code这样,已经拥有大量用户编码行为轨迹数据的模型,也仍需要大量人工构造真正有用的数据,甚至需要招募SaaS公司的技术负责人参与任务设计。因为用户数量不会自动形成数据飞轮。
缺少的那种能力叫做持续学习——让模型像新入职的员工一样,在工作中不断积累经验、适应环境,而不是每次都从零开始。唐、梁二人对这个判断完全一致。
但对于持续学习怎么做,他们的回答正好相反。
摸高与摸奖
唐杰在《巨浪已来》中写了一句非常大胆的话:
记忆、持续学习、自我评判——三个过去被认为需要范式变革才能解决的难题,正在逐步消解。
他的依据是:模型能处理的上下文越来越长,再加上从外部数据库检索信息的能力,已经开始逼近"记忆"的雏形。模型每隔几个月迭代一次,本身就在逼近持续学习的效果。前沿模型已经表现出初步判断自身输出质量的能力。
如果这三个问题正在沿着现有路线逐步解决,接下来的路线图就可以画出来:继续扩大长程任务,让模型工作数周甚至数月;组织大量Agent协作;建设合成数据工厂让AI训练AI。每一步都有团队、有项目、有算力投入,可以设置两年的阶段目标。这就是"摸高"——一条连续的工程路线。
但“梁圣”不同意"正在逐步消解"这个判断。
他在交流会上举了一个例子:一个新员工进公司,花两个月熟悉同事、流程和隐性规则,之后老板说一句"叫小王过来",他就知道小王是谁、在哪里、怎么联系。当前模型做不到这件事。你可以把资料塞进上下文窗口,可以从数据库里检索信息,但模型本身没有在工作中成长。每次开始新任务,你还得重新告诉它一切。
被问到什么时候能突破,他的回答很坦率:
"全世界都还没有找到好的方法,大家都在摸索。"
他给这类研究起了个名字,叫"摸奖"。门槛很低,谁都可以去摸,不需要预先集中大量算力和人员,让很多研究员长期想同一个问题,等待少数想法做通。
两个人立场的“区别”关键在这里:模型每隔两个月发布一个新版本,和同一个模型在工作两个月后变得更懂这家公司,是两件不同的事情。“唐圣”把前者算作持续学习的一部分,“梁圣”则认为这中间隔着一道还没有人跨过去的科学断层。

唐画了四条登山路线,并打算投入百亿支持登顶。而梁说这座山上可能还有一段路根本不存在——你得先把路发明出来。
唐给出四个明确方向,两年期限,直言"不登顶就是失败"。但他列出的长程Agent、多智能体、自我训练和机械可解释性,恰好是全球模型公司当前最热门的方向。智谱真正反直觉的地方可能不在技术选题——一家万亿市值的上市公司选择暂时降低变现优先级,继续在高不确定性的基础研究上投入重金,这件事本身才是反直觉的。"摸高计划"同时也是在向公开市场解释,为什么智谱还需要继续采购下一代算力。智谱当前的下一代集群尚未完全就绪,3万亿参数级别的训练基础设施还在补齐中。
“梁圣”则说,在他的公司没有传统KPI,正式项目最多占研究员一半时间,剩余时间留给自主研究,公司不加班。他的逻辑是先做持续学习和自我迭代,后面的具身智能就可以让模型自己来做,不用人力硬推。
这套逻辑听起来很优雅,但背后也有DeepSeek的现实考量。DeepSeek目前只有几百人的研究团队,做不了所有方向。梁选择把视频生成、世界模型和具身智能都放到后面,一部分原因是他觉得这些不在智能主线上,另一部分是因为DeepSeek只能集中力量做一件事。
但他的风险在于,持续学习最终可能需要模型在真实环境中长期工作——跟用户打交道,在企业工作流里犯错和纠正,接触图像、声音和物理世界的反馈。而这些,恰好是他降低优先级的方向。
"摸高"路线下,两年内一定有阶段性交付物,每一步都能展示可量化的改善。"摸奖"逻辑下,如果持续学习没做通,两年内可能什么范式级的突破都看不到。但一旦做通,就是一次跳跃,和DeepSeek R1横空出世的那个冬天一样。
谁的开源是真的
2024年智谱发布GLM-4的时候,最强的版本只能通过API用,要付费。智谱同时开源了一个9B的小版本给社区。这在当时是很正常的做法——最好的东西留着卖钱,放一个小的出去让大家试用。
DeepSeek做了一件不寻常的事。2024年底DeepSeek发布V3,2025年初发布R1,这两个模型都是DeepSeek当时最强的,但它把最强的直接放出去了,任何人都可以下载,任何人都可以拿去部署。今年6月,智谱用MIT协议开源了自己的旗舰模型GLM-5.2。梁前面提到智谱开源的“被迫”,大意指的就是这个吧。
那为什么DeepSeek敢在一开始就把最强模型全部开源?按照正常的商业逻辑,你把最好的东西免费放出去,别人拿去部署一个一模一样的服务,你的客户就被抢走了。
“梁圣”在交流会上解释了为什么这件事不会发生。DeepSeek在模型推理上做了大量的效率优化,这些优化是跟着代码和工程能力走的,不是跟着模型权重走的。别人下载了权重,自己搭一套服务跑起来,因为没有DeepSeek的推理优化,跑同样模型的成本反而比直接调DeepSeek的API更高,所以他坚信,客户不会被抢走。
但这有一个前提:定价必须够低。梁在交流会上说,DeepSeek只赚一个"合理的利润"——买一批服务器回来,十个月把设备成本赚回来就够了。在这个价格下,第三方部署完全没有利润空间。
克制利润空间是开源成立的前提条件。你越贪,开源对你的威胁越大;你越克制,开源反而成为你的护城河——因为没有人能在你的利润空间里再挤出利润来。
交流会上梁还说到一个细节。有一次DeepSeek发布一款新模型时,担⼼需求太多,于是⼀开始把价格定得⽐较⾼,团队成员不是很⾼兴。后来他们把价格降到了四分之⼀,公司群里有很多人欢呼。他说:这才是我们做这件事的目的——"不是赚最多的钱,而是在拿到合理利润的情况下,让这个东西能够非常便宜、效果非常好,能够让大家充分地用起。我们就觉得这很开心。"
唐杰在内部信的最后写到:巨浪已来,趋势不可逆转。不登顶,就是失败。他说,智谱要做那个迎着浪头、向上摸高的人。
唐杰相信,登得足够高,就能把山修成路;梁文锋相信,舍得放弃山下的利益,才有可能走到山顶。
同一座山,他们对于“如何抵达”,给出两种答案。
