Technology · · 2 min read
OpenAI让Jalapeño ASIC搭配AMD Turin主机处理器运行
OpenAI正在采用基于AMD EPYC Turin处理器构建的系统测试Jalapeño推理芯片,而非使用英伟达的Vera平台。
据AI Weekly援引Tom’s Hardware的报道,OpenAI正在让其Jalapeño推理ASIC与AMD处理器协同运行。这些系统采用AMD EPYC“Turin”CPU作为主机芯片,将OpenAI定制的加速器置于一种不依赖英伟达处理器的服务器配置中。
据报道,每套主机系统包含两颗Turin系列CPU和1.5TB DRAM。这一配置为Jalapeño提供了外围计算平台;Jalapeño是OpenAI为推理工作负载打造的定制芯片。这些信息让外界得以一窥该公司如何组建运行自有芯片所需的基础设施,以及它正在考虑采用哪些替代方案来配套周边组件。
双部分服务器设计
推理ASIC是为AI系统生成答案或预测时所需的计算而打造的。主机处理器是系统中的独立部件,负责支持加速器并提供更广泛的服务器平台。在OpenAI部署Jalapeño的方案中,AMD的EPYC Turin CPU承担了主机处理器的角色。
据报道,每台主机配备两颗Turin处理器和1.5TB内存。这些规格是目前公开披露的、有关承载该ASIC的机器的最明确细节。它们还表明,加速器的选择并不会决定服务器中的其他所有组件:OpenAI自研的推理芯片正与AMD提供的主机平台搭配使用。
这一点很重要,因为有关AI硬件的讨论往往只关注加速器本身。但实际上,一个系统还依赖处理器、内存和服务器设计,才能让加速器运行起来。OpenAI据报道采用的配置明确体现了这两方面:Jalapeño是定制推理组件,而Turin则提供主机CPU。
为什么采用AMD
据报道,OpenAI副总裁兼硬件负责人Richard Ho将采用Turin的决定描述为一项旨在降低风险的务实举措。这一解释表明,选择该处理器是一项实际的工程决策,而不是宣告某一家供应商已经在OpenAI的整个基础设施中取代了另一家供应商。
现有报道并未称AMD正在供应Jalapeño ASIC本身。相反,在部署OpenAI芯片的系统中,AMD的EPYC处理器充当主机芯片。区分这两个角色很重要:报道涉及的是围绕Jalapeño的CPU平台,而不是OpenAI定制加速器的制造。
据报道采用AMD硬件还表明,OpenAI的定制芯片正在一个由多家供应商参与的环境中接受测试。Jalapeño来自OpenAI自身的硬件项目,而主机处理器来自AMD。最终形成的服务器设计由来源和功能各不相同的组件构成。
英伟达仍是比较对象
Ho的评论中提到的替代方案是英伟达的Vera独立平台。据Tom’s Hardware和AI Weekly报道,他认为Vera在成熟度方面“稍微落后一些”。这一评价有助于解释OpenAI为何为报道所述的Jalapeño系统选择Turin作为主机处理器。
这番评论的范围小于对英伟达硬件作出笼统判断。它具体涉及Vera作为这一部署备选方案时的成熟度。报道并未称英伟达硬件不存在于OpenAI的所有系统中,也没有表明AMD将成为该公司永久的主机CPU供应商。
报道真正显示的是OpenAI硬件战略所处的一个特定阶段。该公司拥有一款定制推理ASIC,这款芯片正运行在每台主机配备两颗AMD EPYC Turin处理器和1.5TB DRAM的系统中。其硬件负责人还将英伟达Vera独立方案的成熟度与当前设计的实际需求进行了比较。
目前,已披露的细节有限,但它们确立了基本架构:OpenAI的Jalapeño芯片正与AMD Turin CPU搭配部署,而英伟达Vera则被视为在这一主机角色上成熟度较低的替代方案。这一选择反映的是让定制推理系统投入运行的即时需求,而不是对OpenAI可能采用的所有平台作出更广泛的声明。