Technology · · 3 min read
苹果考虑推出采用 Ultra 芯片的企业级 AI 服务器
据报道,苹果正在探索面向外部客户的 AI 服务器,但可能于 2029 年推出的产品,将意味着它艰难回归这个多年前放弃的市场。
据 eu.36kr.com 援引的报道,苹果正在考虑重返企业服务器业务,推出专为人工智能工作负载设计的机器。据称,相关系统可能采用两颗或四颗 M8 Ultra 芯片,并可能集成英伟达的 NVLink 技术以连接这些芯片。
据报道,该项目已经开发了近一年。约翰·特努斯在项目早期批准了它,当时他负责苹果的硬件工程部门;如今,他已成为公司的首席执行官。不过,产品商业化仍遥遥无期。这些机器预计要到 2029 年才会推出,而且项目仍可能被放弃。
如果苹果继续推进,这将是自 Xserve 产品线于 2011 年停产以来,该公司进军企业服务器领域最重要的一步。
Mac 在 AI 领域找到了意想不到的用途
随着实验室、云服务商和软件开发者寻找大量 Mac 来支持 AI 开发,苹果的兴趣也开始显现。Mac mini 和 Mac Studio 原本是为桌面使用设计的电脑,如今却越来越多地被安装在机架中,作为托管的 macOS 机器使用。
这些系统可以运行智能体软件、收集行为数据,并提供那些与图形桌面交互的应用所需的真实 Mac 环境。据报道,OpenAI 已购买数万台苹果电脑,而 Anthropic 据称通过亚马逊云服务租用了大量 Mac 算力。专业托管公司也建立了用于大规模部署 Mac 的机架。
这种需求增长的原因之一,是后训练和智能体能力在 AI 开发中的重要性日益提高。能够操作计算机并完成实际任务的系统,往往需要访问真实的 macOS 桌面及其应用。苹果的许可规则要求 macOS 运行在苹果硬件上,因此,传统服务器无法通过普通虚拟机或非官方安装,简单地替代 Mac。
对于某些工作负载而言,直接购买或租用 Mac mini,可能比试图在其他设备上复现相同环境更经济。这一需求也已扩展到实验室之外。随着 OpenClaw 和其他智能体产品兴起,据报道 Mac mini 的供应变得紧张,一些客户需要等待一个月甚至更久。Mac 部门的季度营收同比增长 29%,不过更高的内存成本也促使产品价格发生变化。
苹果的内存设计适合推理
苹果的硬件架构还可能让它在 AI 推理方面具备另一项优势。从 M1 一代开始,Apple Silicon 就采用统一内存,让处理器和图形处理器共享同一内存池,而不是分别依赖系统内存和显存。
大模型推理不仅取决于内存容量和数据传输速度,也取决于原始处理能力。在传统计算机和服务器中,在不同内存池之间移动信息可能增加通信延迟,尤其是在需要大量数据移动的工作负载中。
搭载 M5 Ultra 芯片的最新 Mac Studio 据称支持最高 512GB 的统一内存,以及每秒 1.2TB 的带宽。这一容量足以容纳模型权重,而这些权重在其他情况下可能需要分布到多颗专业 GPU 上。因此,对于并发量相对较低的大模型运行任务而言,高内存容量的苹果系统可能提供一种实用的替代方案。
专用服务器将使苹果能够把现有的这种兴趣转化为专门为机架部署和企业使用设计的硬件。苹果并非要从零开始:尽管当前的消费级机器并不是为数据中心打造的,但它们已经吸引了机构客户。
Xserve 的经历仍是一个警示
苹果能否回归这一市场远未确定,因为企业计算需要的不只是吸引人的硬件和强大的性能。服务器客户期待有竞争力的价格、定制能力、与既有管理工具的兼容性、长期维护以及全面的技术支持。销售、安装、运营和合同服务义务,都是这项业务的核心。
这种模式与苹果一贯专注于消费产品的方向相冲突。在消费产品领域,设计、简洁性和用户体验是主要卖点。企业采购则由采购团队、IT 管理员和数据中心运营商共同参与,而他们各自的优先事项并不相同。批准服务器的人可能永远不会看到它,而负责维护的人可能更在意功耗、机架密度和可维修性,而非工业设计。
苹果早期的 Xserve 体现了其中的难度。它于 2002 年推出,采用了格外精致的铝制机箱,前面板硬件的布局也经过精心设计。然而,它的高昂定价以及 Mac OS X Server 的封闭性限制了其吸引力。它并未成为广泛采用的企业平台,随着苹果的战略转向其他方向,公司最终终止了这一产品。
当前的 AI 市场为苹果重新考虑服务器业务提供了比过去更强的商业理由。基于 Mac 的基础设施已经存在需求,而统一内存可能使 Apple Silicon 适用于特定的推理工作负载。不过,苹果仍需建立消费业务无需具备的销售、部署和支持体系。目前来看,据报道的 2029 年目标只是一个可能性,而非承诺。