苹果拟推出AI推理服务器:自研M8 Ultra芯片+英伟达NVLink

据外媒The Information当地时间9月16日报道,苹果正在开发一款搭载自研M8 Ultra芯片的企业级AI推理服务器,计划面向AI开发者、企业和政府客户销售,并已与英伟达洽谈采用其NVLink Fusion互联技术。

需要指出的是,这将是苹果时隔15年以来,首次认真评估重返企业服务器市场。苹果在2002年时曾对外推出过专用服务器Xserve系列,采用PowerPC和Intel Xeon芯片,面向企业、教育机构和数据中心。但由于苹果对企业市场重视不足、客户支持薄弱,Xserve始终未能打开局面,最终于2011年1月31日停止销售,此后苹果业务重心全面转向消费电子设备。

将集成两颗或四颗M8 Ultra,瞄准AI推理

据知情人士透露,苹果正在开发的企业级AI服务器将搭载其计划中性能最强大的处理器M8 Ultra,预计将提供两种版本:较小版本集成两颗M8 Ultra芯片,较大版本搭载四颗M8 Ultra芯片,通过高速互联组成计算系统。该服务器并非面向训练,而是聚焦AI推理市场。

苹果瞄准的是企业客户在私有化基础设施上运行本地AI推理的需求,尤其是对数据隐私要求较高的政府和大型企业。

“苹果的优势在于它已同时拥有芯片、操作系统与开发者生态,”半导体供应链分析师Rachel Kim评论道。“问题在于,企业是否愿意向一家从未卖过机架给他们的公司采购推论算力。”

或将采用NVLink Fusion技术

报道指出,为连接服务器内的多颗M8 Ultra芯片,苹果已与英伟达讨论采用NVLink Fusion技术。该技术于2025年由英伟达推出,将原本仅用于自家GPU的NVLink互联架构开放给第三方芯片厂商,使其定制芯片既能彼此高速互联,也能与英伟达GPU协同工作。

参与该项目的部分苹果员工认为,英伟达目前可能拥有更合适的芯片互联技术。报道援引一名AI硬件领域投资者表示,网络互联技术一直是苹果发展大型AI服务器业务需要补足的环节,引入英伟达方案可能成为苹果过渡到自研互联技术成熟之前的一种选择。

但这一合作远未确定。 报道明确指出,该服务器最快要到2029年才可能问世,计划仍有被取消的可能,最终产品也不一定采用英伟达技术。

值得注意的是,苹果本身是UALink联盟的董事会成员。该联盟由AMD、英特尔、谷歌、微软等于2024年组建,旨在制定开放的AI芯片互联标准,被视为英伟达NVLink专有技术的主要竞争对手。若苹果最终选择NVLink Fusion,意味着其可能在开放标准与英伟达方案之间转向后者。

AI驱动的Mac需求是催化剂

据报道,苹果新任首席执行官John Ternus是自研AI推理服务器项目的重要推动者。项目约一年前启动时,Ternus仍负责苹果硬件工程部门,已开始关注AI算力市场的增长机会。

推动这一战略转向的直接催化剂,是AI开发者对Mac产品的意外强劲需求。最新季度,苹果Mac业务销售额同比增长近29%至104亿美元,成为公司增长最快的硬件产品线。据报道,OpenAI等大型AI实验室已采购数万台Mac mini和Mac Studio用于AI开发,部分企业甚至基于苹果硬件搭建云计算服务。旺盛需求一度导致相关机型严重缺货。

然而,Mac的消费级定位限制了其进一步进入企业市场——现有产品缺乏远程管理、大规模部署和企业级运维功能。苹果的Private Cloud Compute服务器虽已自用,但从未对外销售,此前已有合作伙伴希望接入但遭拒绝。

推理赛道竞争加剧

如果最新的重返服务器市场的计划如期推进,有望在2029年正式推向市场,这将是苹果时隔约18年再次推出面向外部客户的企业服务器。与Xserve时代不同,这一次苹果瞄准的是AI推理这一高速增长的市场。

高盛预计,全球AI服务器市场规模到2030年将达到1.24万亿美元。虽然市场规模巨大,但是这个市场的竞争正越来越激烈。比如,在AI推理领域,Alphabet自建TPU并通过Google Cloud销售算力;亚马逊的Trainium产品线以宣称优于英伟达元件的成本优势驱动AWS推理;AMD的Instinct MI300系列则在加速器性能上直接竞争。就连英伟达也专门推出了基于Gorq芯片的推理服务器。

因此,多家机构对苹果的服务器计划持审慎态度,2029年的发布窗口意味着该项目对苹果近期盈利几乎没有实质贡献,更宜视为一份“战略看涨期权”。

编辑:芯智讯-浪客剑

友情链接 集成电路有限公司 - 芯片模拟器网站入口