**苹果新任CEO特努斯明确AI路线不卷模型,而是回归硬件,利用统一内存架构推出企业级AI推理服务器,补齐从iPhone到Mac再到机房的硬件链,让用户无需操心AI运行位置。** **要点** **1. 苹果AI策略转向硬件而非模型** 苹果不自研大模型,而依靠统一内存架构的硬件(如Mac Studio最高512GB内存)提供端侧和企业级AI推理能力,新CEO特努斯出身硬件体系,支持重返服务器市场销售开箱即用的本地推理整机。 **2. Mac mini带动个人本地AI需求,但用户自行部署风险高** “龙虾热”使Mac mini成为个人AI热门设备,高内存版本缺货涨价。用户自行部署Ollama等工具导致约17.5万个配置错误的服务暴露在公网,显示个人本地AI需求真实但用户动手门槛与安全风险并存。 **3. 苹果计划重返企业AI推理服务器市场** 苹果正研发基于M8 Ultra芯片的企业服务器(最早2029年),用于运行已训练好的AI模型(推理而非训练),目标客户是出于合规不愿上公有云的企业,提供软硬件一体方案,类似Xserve回归但用途换成AI推理。 **4. 新CEO硬件背景推动“替用户决定”的产品逻辑** 特努斯作为30年来首位硬件出身CEO,在iPhone等产品中直接提升芯片和散热能力来支持端侧推理。苹果正构建一条硬件链:能本地完成的推理留在iPhone,装不下的交给Mac,企业数据用自研服务器,仅剩余任务上云。
2026-09-28 11:25

苹果真正的AI杀手锏,根本不是Siri

本文来自微信公众号: APPSO ,作者:发现明日产品的,原文标题:《苹果真正的AI杀手锏,根本不是 Siri》


苹果在AI时代落后了吗?


这个问题现在抛给了接棒库克的特努斯,这两年AI Siri的跳票让很多人对这个问题的答案并不乐观,可于此同时Mac mini也成为了AI PC的代名词一机难求。


最近资深科技分析师Ben Thompson在播客中提出一个暴论:苹果压根不需要自己做AI。


他认为掌握庞大用户入口的苹果,只需要采购AI能力,做自己更擅长的事就可以了。最大的风险在于,如果未来的AI不再以手机为中心,苹果可能会被颠覆。


这个月的苹果发布会,特努斯把iPhone重新定义为智能个人中枢(Intelligent Personal Hub),就是为了连接即将到来一系列AI硬件,抵御的这个AI去中心化的风险。


苹果并不是不需要做AI,但它的路线大概率不是卷模型,很可能还是回到硬件本身。


前段时间苹果被曝重返企业服务器市场就是一个信号,苹果离开服务器市场十五年,又因为AI要归来了。



这台最早可能在2029年出现的设备,将塞入两枚或四枚M8 Ultra芯片,甚至借用英伟达的NVLink Fusion,把多枚芯片连接成更大的系统。


跟坊间流传的、用于做自研模型恰恰相反,苹果要做的是面向企业运行已经训练好的AI模型。项目仍在讨论的雏形阶段,但已经得到新任CEO John Ternus的直接支持。


苹果上一次出售专用服务器,还是2011年停产的Xserve。十五年后,它为什么偏偏在AI时代重新走进机房?


看上去,答案跟服务器生意的热闹有关,可事关苹果,显然不是那么简单。


本地AI,仍然是一种极客行为


今年以来,拜年初的「龙虾热」所赐,Mac mini意外成了个人AI玩家的热门设备。OpenClaw上线后获得超过10万个GitHub Star,单周吸引200万访客,看得出,用户确实想拥有一个持续运行、保留记忆的私人Agent。


有人购买高内存版本,在家运行开源模型;有人把它设成全天在线的Agent,让聊天记录、文件和长期记忆留在自己的机器里。据《华尔街日报》测算,Mac mini此前只占苹果美国Mac销量约3%,但OpenClaw等常驻Agent带来的需求,已经让部分高内存版本出现明显缺货,还出现了涨价。



一时间,Mac mini奇货可居,买不到的人就得另寻出路,比如租用VPS,把Agent和记忆放进远程服务器。VPS的主要顾客本来是开发者与企业,租服务器、连接远程终端、部署软件、管理端口和密钥,这套动作比较复杂,落到个人用户身上,需要很大的学习成本。


但AI推动着一群「小白」用户冒着极大的安全风险进入这个沼泽地。2026年初,安全研究人员在公开网络上发现约17.5万个配置错误的Ollama服务,不少来自家庭网络、VPS和云主机;它们原本应当只在本地响应,却因为用户设置失误而直接暴露在互联网上。TechRadar



可以说,VPS是相当极客的玩法,并不适合消费级AI的默认入口,这也是为什么,云端AI始终是市场主流。人们不需要判断模型应该装在哪里,也不需要考虑内存、带宽和电费,打开ChatGPT、Claude或豆包就能开始对话。模型越大、任务越复杂,云端的优势越明显。


但是,个人本地AI已经形成一股真实需求,人们确实开始需要一个「握在掌心」的AI。只是从Mac mini缺货,到十七万台裸奔在公网上的Ollama,这股需求交给用户自己动手的结果,是热情与风险并存。


这道题并不只属于个人用户,企业早就遇到过它的放大版,只是企业有预算硬扛。


企业想要的AI,苹果来解决


出于合规和数据安全,很多企业对于把推理任务交给公有云很谨慎;可要留在自己机房,就得自己挑芯片、自己搭软件栈、自己维护推理环境。眼下几乎只有围绕英伟达生态从零攒起这一条路,没有人卖一台开箱即用的本地推理整机。


所以苹果实际上要卖的正是这个,报道里的机器面向企业运行已经训练好的模型——注意,是推理,不是训练。


两者的区别不只在算力,更在数据的去向。训练必须把语料汇集到超大规模集群,在这方面苹果没有任何优势,但它在推理却有着现成的好底子:从M1开始坚持的统一内存架构。这让CPU与GPU共用同一片内存,一台Mac Studio就能装下原本需要多张专业显卡才能载入的模型权重。


以最新的Mac Studio为例,M5 Ultra版最高可配512GB统一内存,内存带宽1.2TB/s,还支持多台通过雷雳5组成集群。作为对照,即便是顶级专业显卡,单卡显存通常也还在几十GB的量级,要装下同样规模的模型,就得先拆成多卡再想办法拼回来。苹果自己的官方说法,也直接把新Mac Studio形容为面向端侧AI的终极台式机。


统一内存本是为桌面创作设计的选择,到了跑大模型的时代显示出新的价值。所以苹果不是要去和AWS抢云生意,它卖的是机器本身,不是算力。机器进的是企业自己的机房,跑的是企业自己的数据。从这个角度看,它更像是Xserve的回归,只是用途换成了AI推理。


对于个人用户来说,你不必为了AI本地化自己学会部署模型;企业用户亦然,不必自己攒一套AI基础设施——苹果都可以提供软硬件一体解决方案。


新CEO,决定了


苹果要回到服务器市场,这个动作是明确得到新任CEO支持的。


今年,John Ternus接替Tim Cook,执掌苹果。他是机械工程师出身,长期负责iPhone、iPad、Mac、Apple Watch和AirPods等硬件,这是三十年来首位从硬件体系走上CEO位置的苹果掌舵人。


刚刚过去的秋季发布会是他第一次亮相,带来了iPhone Duo、iPhone 18 Pro与Pro Max、Apple Watch Series 12与Ultra 4、AirPods 5一次性摆上台面。


这一系列的产品,都体现出很强的「替用户决定」的色彩。以A20 Pro芯片为例,有很多用户看不到的取舍:内存带宽提升50%,NPU做到32核、性能是A18 Pro的两倍,新一代均热板的面积直接做到上一代的三倍。这些硬件层面的提升,都潜在地让更多模型能在这部手机上跑起来。


苹果没有问用户愿不愿意为端侧推理付钱,它直接把自己心里的答案焊在了芯片里。


「替用户决定」很适合用来概括今年的产品风格,区别于Tim Cook,反而让人想起了一位故人:乔布斯。


初代iMac直接拿掉了软驱,当时几乎所有文件都靠它搬运;初代iPhone取消了实体键盘和触控笔,而那正是当时商务手机最引以为傲的东西;MacBook Air拿掉光驱,iPad和iPhone始终拒绝Flash……


这是苹果许久没有展现出的一种气质:不以市场的主流偏好为依据,而是先判断什么是他们认为好的使用方式,然后直接呈现到用户面前。


不过,John Ternus敢这么硬气,是苹果给他的底气,也是他和公司之间的彼此需要。今年春天Ternus上任时,苹果AI正处在一段尴尬时期:新Siri一再跳票,无论是自研还是联合模型,都屡屡传出不顺。年初才与谷歌签下约每年十亿美元的协议,用Gemini来驱动Siri,谁料到下半年Gemini就变成大号豆包了……


直到WWDC 2026新Siri AI亮相,局面才勉强稳住。当然了,彭博社Mark Gurman给出的评价也只是「将将够用」。



也就是说,在模型层面,苹果已经承认自己需要借力。它还能完全掌控的,是硬件,以及由硬件所决定的计算究竟发生在哪里。对一位硬件出身的CEO来说,把赌注下在这一层,是合理也可能唯一的选择。


这是一条只有苹果能够完整下注的路线。OpenAI卖模型,英伟达卖芯片和算力,它们各自在自己的赛道上称雄。可也只有苹果,同时控制移动设备、桌面与操作系统,走进机房不仅合理,而且相当有竞争力。


目前看来,苹果的AI路线依然不甚清晰,Private Cloud Compute仍是云,Siri也会借用外部模型。未来变化的可能是任务的默认顺序:能在iPhone上完成的,不必离开手机;手机装不下的,可以交给Mac;企业不愿上传的数据,则进入自己的M8 Ultra服务器。只有这些硬件处理不了的任务,才继续向云端溢出,服务器要补的,正是这一端。


网友爆料的Apple M5服务器,爆料者表示这将用于Private Cloud Compute(PCC)


从iPhone、Mac,到企业机房里的M8 Ultra,苹果似乎正在补齐一条硬件链。它想回答的,是一个眼下没人替普通人回答的问题:智能到底应该住在哪里。


用户自己不必为了回答这个问题,自己学着部署模型,也不必先理解什么是本地推理。从个人设备到企业服务器,苹果自会替用户判断,每一次智能究竟应该住在哪里。

AI创投日报频道: 前沿科技
本内容来源于网络 原文链接,观点仅代表作者本人,不代表虎嗅立场。
如涉及版权问题请联系 hezuo@huxiu.com,我们将及时核实并处理。
正在改变与想要改变世界的人,都在 虎嗅APP