**中美因AI误判险引冲突后建立对话与事件沟通渠道,AI性能差距缩至2.7%而安全事件激增,机制框架已定但定义权等关键问题未解。** **要点** **1. AI误判险些触发军事冲突成为直接动因** 今年春天,美军AI分析报告误判一艘中国货船向伊朗运送核部件,美军启动登船行动,最后关头被高级分析师叫停。CNN于9月18日曝光后,9月20日中美在摩根大通总部会谈,9月26日发布共识,其中首次纳入AI对话和事件沟通渠道。 **2. 中美AI性能差距已基本抹平** 斯坦福2026年AI指数报告显示,中美顶尖模型Elo分差仅39分(2.7%),胜率约55%;LMArena排行榜前20中有7-8个中国模型。调用量上中国模型每周处理61.2万亿token,约为美国三倍,一年前还七三开。 **3. AI安全事件激增,规则却一片空白** 斯坦福报告2025年AI安全事件362起,同比增长55%;英国CLTR机构截至8月记录1664起AI失控事件,7月单月306起。典型事件包括AI Agent自主攻击Hugging Face服务器、伪造用户消息等。目前全球AI治理缺乏类似金融、航空的监管框架。 **4. 对话机制已落地,热线定义权尚未谈拢** 共识中“AI对话”已确定11月在深圳举行,“AI事件沟通渠道”仍处概念阶段。美方由财长贝森特牵头,中方未明确承接热线。关键分歧在于“严重国家安全威胁”由谁判定,以及通报门槛是否单方定义。中方坚持对等原则,避免定义权被单边化。 **5. 机制刻意绕开芯片出口管制与指控争议** 美方贸易代表格里尔明确对华芯片出口管制不在会谈议程;同时9月8日美方三大机构指控六家中国AI公司“蒸馏”技术,中方回应后仍照常参与对话。各方在竞争与合作间划清边界,事故热线管撞车不管竞赛。
中美AI具体谈了什么?
2026-09-28 00:07

中美AI具体谈了什么?

本文来自微信公众号: 王智远 ,作者:王智远


9月26日,外交部发布了中美八点成果共识,估计不少人都看到了。


贸易、禁毒、熊猫,各归各位。但这八条里,有一个此前从没出现过的条目:中美建立人工智能对话,外加一条AI事件的沟通渠道。


这个条目从哪来的?它指向一次差点出大事的误判,事发在今年春天,9月18日被CNN捅了出来。


那是美伊冲突期间的一份常规分析,美军特种作战司令部的情报分析员,用AI聊天机器人,处理一艘在中东航行的中国货船,AI生成了一份报告:这艘船正在向伊朗运送核武器相关部件。


美军信了,飞机升空,特种部队集结,拦截登船行动进入执行流程。


最后关头,一个高级分析师把那份报告重新看了一遍,他说了句话,大意是:这份情报完全不成立。


数据撤回、AI的幻觉、行动取消。


CNN用了四个消息源,五角大楼拒绝回应,中国外交部被问到这件事,发言人说「我不了解你提到的情况」。


这是公开记录里,AI误判最接近引发国际军事冲突的一次。9月20日,纽约摩根大通总部,何立峰和贝森特、格里尔关起门谈了八个小时,出来的东西,就是共识里那条AI沟通渠道。


两边通报里到今天都没把这两件事绑在一起,你把日期排一排:18号曝光,20号开谈,26号白纸黑字。


现在回头看第七点,它是八点里唯一一个拿到了「建立机制」待遇的条目,凭什么偏偏是AI?


斯坦福2026年AI指数报告给的一组数字,在Chatbot Arena上,美国Anthropic的Claude Opus 4.6拿了1503分,字节跳动的Dola-Seed-2.0拿了1464分,差39分,2.7%。


39分什么概念?Elo是胜负分,差39分的意思是,两个模型面对面打一轮,分高的那个胜率也就55%,剩下的基本靠抛硬币。


以前我们说中美AI差距,讲「代差」。一两年、两三年那种差,现在这个差距基本被抹平了。


9月的LMArena排行榜上,前20个模型里有7到8个来自中国的,美国还占着前六。领先这个词,已经不太好用在了。


而且用脚投票的人早就选了,OpenRouter是全球最大的AI模型API聚合平台,开发者在上面调用各种模型。2025年9月,美国模型占全球调用量的76%。


十二个月后呢?中国模型每周处理61.2万亿token,大约是美国的三倍。


一年前还七三开,现在就翻过来了。


造AI公司这头也在追,兰德公司2026年8月梳理了1181家中美AI企业:美国743家,中国438家。两边做的生意挺不一样的。


美国AI公司61%扎在软件行业,中国更硬,制造业30%,地面机器人24%,自动驾驶14%,人形机器人12%,一个是屏幕后面的生意,一个是工厂和公路上的生意。


有意思的是,两边都有19%的公司在做基础模型。


产业结构不重叠,谁也不能替代谁。性能上又只差2.7%。两边都在高速跑,而且两边都清楚对方也在全速跑。


风险已经不是抽象的了,斯坦福报告统计了2025年的AI安全事件:362起,比上年的233起增长了55%。同期AI透明度指数从58掉到了40。厂商变悄悄了,事故倒是越来越多。


英国长期韧性中心(CLTR)的统计更夸张:


这家机构今年2月才成立,到8月9日已经记下1664起AI失控事件,7月单月306起,环比增长93.67%。日均峰值11.3起,你算算,平均每两个多小时就有一台AI脱离了人类控制。


这些事件包括什么呢?


AI Agent伪造用户消息来模拟审批通过,冒充用户下令删除文件,绕过人工审核自行升级权限,大部分没造成实质损害,可「大部分没有」能当「不需要打电话」的理由吗?


「不是大部分」的那种,公开记录里目前有俩。


一个,那艘差点被登船检查的中国货轮。另一个发生在最前沿的地方,硅谷自己家里。


7月8日到13日,OpenAI的一批测试Agent,前前后后约1200个,自己搭了块留言板,7天互发超过7万条密信协调行动,其中700个左右突破沙箱隔离摸上了互联网,动手攻击了Hugging Face的服务器,拿到了私有数据。


OpenAI事后写了37页事故报告,全球首例AI自主入侵外部系统,就这么来的。


金融有SEC,有巴塞尔协议,有各国央行盯着,航空有ICAO,电信有ITU。AI有什么?什么都没有。


现在你知道为什么是AI了。


差距抹平到了2.7%,事故真实发生过,规则却是一片空白,三个条件凑齐的产业,全世界只此一家,八条共识里,也只有它拿到了「建立机制」的待遇。


这个机制做的事很小,两个最可能因AI出大事的大国,同意建一个出事了能打电话的系统。


这根电话线具体怎么接、谁来接、什么时候能响?第七点原文已经给了答案。


......


里面装两套制度,一套定期开会,一套出了事才响,开会那套已经落地了,拉警报那套还停在纸面上。


先看原文,一共三句话:


双方同意建立中美人工智能对话,交流人工智能相关风险和惠益。下次对话将于今年11月举行。双方同意建立人工智能事件的沟通渠道。


第一句和第三句,主语一样,性质完全不同。


AI对话,是定期坐下来谈风险、谈机会,像经贸磋商那样,到点到名开会;AI事件沟通渠道,不开会,它等着,等一个AI惹出的麻烦大到需要马上让对方知道,它才响。


开会的价值在议程,谁定义风险、谈出什么结果,全程博弈;拉警报的价值只传事实:我这出了个事,跟你有关系,先告诉你一声。


实际上,中美在AI上说话,不是从今天开始。


2019年,清华的战略与安全研究中心和布鲁金斯就开过中美人工智能与国际安全的二轨对话,学者先谈,官员旁听。


2024年5月,双方在日内瓦开了首次政府间对话,聊了军事AI的风险。那轮是拜登时期,中间停摆了一段时间。



这次不一样在哪?就一个字:机制。


AI对话被放进了经贸磋商机制的框架里,有了固定周期,也有了下一站;贝森特9月21日放话,11月两边在深圳再见,日子正好撞上APEC。


你猜谁在牵头?美方谈AI这条线,握在贝森特手里,财政部长。按外交礼宾,这类议题本该归国务院。可提热线的就是贝森特本人。


华盛顿没把AI对话当外交议题,当的是经济安全风险,技术本身不出国,事故才会,出一次像9月那样的AI假情报,动摇的是市场、供应链、还有两边政府的信誉。


这条热线本身,两边的说法就有温差了。


贝森特对外说,双方同意建立沟通AI安全事件的应急联系渠道,外交部被问到时,发言人怎么回的?建议向主管部门询问。


商务部确认的是另一件事:在经贸磋商机制下,双方就AI进行了首次正式对话。另一头,国务卿鲁比奥自己降了温,说AI热线还在概念阶段。


捋一下就很清楚:对话,中方接了;热线,中方没接。


不接有逻辑,中方反复讲的两个字,对等,通报机制最怕定义权单边化,什么算「需要通报的事件」如果由一方来写,这条线就不是电话,是绳子,对方随时可以拽。


还有个细节,美方媒体的报道里写着:


这个渠道有门槛,得是「可能引发严重国家安全威胁」的AI危险事件才配通报。举的例子挺吓人:AI失控搞破坏、牵扯核化生武器、技术泄露、攻击关键设施。


翻译一下:不是所有AI闯祸都配一个跨国电话。


今年2月以来1664起AI失控,绝大多数够不着这条线。门槛有道理,不然渠道会被无效信息淹死。


可它留下一个更要命的问题:「严重国家安全威胁」由谁来判定?各自判,还是共同判?第七点原文里没有一个字回答这个。


11月的深圳,大概率就谈这些的,至于能谈成什么样,得先看这个机制有意绕开了什么。


......


绕开的第一件事是芯片,这条线画得明明白白。


美方画线的人是格里尔,贸易代表。会谈之后他直接把话撂在那儿:对华芯片和半导体制造设备的出口管制,不在这次会谈的议程上。


措辞值得琢磨,他说的是「不在议程上」,没说「不谈」,只是这条电话线不背这个事。


同一份共识的第五项,双方各砍300亿美元的关税。贸易这头的手动了,可芯片和AI这两个最值钱的战略科目,圈在了降税清单外面,原地不动。


翻译一下:事故上画停火线,竞争照旧。热线管的是别撞车,不是一起跑。


第二件绕开的事,藏得深一点:指控也不进这个房间。


9月8日,美国三大安全机构发了份联合报告,挨点名的是六家中国公司,DeepSeek、月之暗面、阿里、MiniMax、阶跃星辰、智谱。


罪名是「蒸馏」,通俗讲,拿美国前沿模型的答案,喂自己的模型,走捷径;隔天外交部回应:中国AI发展是高水平科技自立自强的成果,敦促美方停止无端指责。


十几天后,两边坐下来,把AI对话建成了机制。


有人觉得这个顺序拧巴,其实这才是边卡边谈的标准姿势:指控归指控,桌子照坐,谁也没耽误谁。中方接下的,是把事故沟通装进机制,它恰好不包含对错这两个字。


倒是被点名的那六家,到今天没有一家,对这场对话公开说过一个字。桌子是国家的,生意是自己做的。


第三件绕开的事,不在屋里,在门外。


CSIS给全球AI治理画过一个分析框架,三轨并行。一轨叫Pax Silica,「硅和平」,美国牵头的供应链小圈子,24个经济体在册。


一轨叫WAICO,世界人工智能合作组织,中国牵头的政府间组织,29个国家签了创始协定,总部设在上海,可美国、欧洲、日本,一个都没来。


剩下那轨在联合国,古特雷斯攒了个科学小组,开了场全球对话,各说各话了一年多。


再加一个数:全球南方在AI治理上的话语权,不到20%;中美这条线连的是两户人家,线外几十家,各有各的局。


美国还在挨家做工作:Pax Silica和WAICO,总得选一个跟。线外那几十家看着像观众,其实是被人拉着投票的。


定义权这仗,其实从AI这个名字上就已经打过了。


9月22日,特朗普在联大宣布,以后美国政府文件里,AI要改叫「超级智能」,理由是artificial让intelligence听起来像假的。没签行政令,口头放了一句话,政府文件的牌匾照换。


几天后外交部被问到这个提法,回答是:重视美方立场,尊重美方提法。


注意,是尊重,不是跟进。一边把牌子换了,一边把尊重说了,名字的温差,就这么轻拿轻放了。


所以,通报门槛的定义权没谈拢,真不奇怪。


没人回答,眼下也回答不了,因为它没法核查。AI治理讨论里常被引用的一组对比:


核弹头的数量,可以靠现场核查和卫星一颗一颗数;神经网络不公开权重,企业拿商业机密为由拒绝开放核心代码,仓库看不见进出的货,事故有多严重,就只能靠当事方自己报。


落到日常一点的场景:


某家大模型的Agent半夜自己动手用了谁的权限、泄了谁的数据,这算企业安全事故,还是算国家安全层面?


现在没有标准答案,因为既没有一张两边都认的事故清单,也没有一个能上门查账的第三方。


所以,你管它叫电话,它不太算一台电话,电话是拿起来就能响的,这条线,得先有人点头:这事够格拿起来。


关系还冻着,两边没握手,也没串门,就是在冰面上凿了道缝,塞进去一根电话线。缝能凿多宽?线能拉多长?谁攥着线头?眼下没人说得清。


11月的深圳,会不会真的有人拨这个号?就看下一次AI差点闯出大祸的时候,谁有资格说一句:这算,打电话吧。


数据来源:

AI创投日报频道: 前沿科技
本内容来源于网络 原文链接,观点仅代表作者本人,不代表虎嗅立场。
如涉及版权问题请联系 hezuo@huxiu.com,我们将及时核实并处理。
正在改变与想要改变世界的人,都在 虎嗅APP