Technology · · 3 min read
OpenAI opera ASICs Jalapeño com CPUs hospedeiras AMD Turin
A OpenAI está testando seu chip de inferência Jalapeño em sistemas baseados em processadores AMD EPYC Turin, em vez da plataforma Vera da Nvidia.
A OpenAI está operando seu ASIC de inferência Jalapeño junto a processadores AMD, segundo informações do Tom’s Hardware citadas pela AI Weekly. Os sistemas usam CPUs AMD EPYC “Turin” como processadores hospedeiros, colocando o acelerador personalizado da OpenAI em uma configuração de servidor que não depende dos processadores da Nvidia.
Cada sistema hospedeiro teria dois processadores da classe Turin e 1.5 terabytes de DRAM. Essa configuração fornece a plataforma computacional que envolve o Jalapeño, chip personalizado da OpenAI para cargas de trabalho de inferência. As informações oferecem um vislumbre de como a empresa está montando a infraestrutura necessária para operar seu próprio silício, além das alternativas que está considerando para os componentes ao redor dele.
Um design de servidor em duas partes
Um ASIC de inferência é construído para realizar os cálculos necessários quando um sistema de IA produz uma resposta ou previsão. O processador hospedeiro é uma parte separada do sistema, responsável por dar suporte ao acelerador e fornecer a plataforma mais ampla do servidor. Na implementação do Jalapeño pela OpenAI, as CPUs AMD EPYC Turin desempenham esse papel de hospedeiras.
A configuração divulgada tem dois processadores Turin em cada hospedeiro e 1.5TB de memória. Essas especificações são os detalhes mais claros divulgados sobre as máquinas que transportam o ASIC. Elas também mostram que a escolha do acelerador não determina todos os outros componentes do servidor: o silício de inferência próprio da OpenAI está sendo combinado com uma plataforma hospedeira fornecida pela AMD.
Essa distinção é importante porque as discussões sobre hardware de IA costumam se concentrar apenas no acelerador. Na prática, um sistema também depende dos processadores, da memória e do design do servidor que permitem o funcionamento do acelerador. A configuração divulgada da OpenAI identifica os dois lados desse arranjo: o Jalapeño é o componente personalizado de inferência, enquanto o Turin fornece as CPUs hospedeiras.
Por que a AMD está sendo usada
Richard Ho, vice-presidente e responsável pela área de hardware da OpenAI, descreveu a decisão de usar o Turin como um esforço pragmático para reduzir riscos, segundo as informações divulgadas. Essa explicação apresenta a seleção do processador como uma escolha prática de engenharia, e não como uma declaração de que um fornecedor substituiu outro em toda a infraestrutura da OpenAI.
As informações disponíveis não dizem que a AMD esteja fornecendo o próprio ASIC Jalapeño. Em vez disso, os processadores EPYC da AMD funcionam como o silício hospedeiro nos sistemas em que o chip da OpenAI é implementado. Manter essas funções separadas é importante: a reportagem trata da plataforma de CPUs ao redor do Jalapeño, não da fabricação do acelerador personalizado da OpenAI.
O uso divulgado de hardware da AMD também indica que o chip personalizado da OpenAI está sendo testado em um ambiente com fornecedores diferentes. O Jalapeño vem do próprio esforço de hardware da OpenAI, enquanto os processadores hospedeiros vêm da AMD. O resultado é um design de servidor montado com componentes de origens e funções distintas.
A Nvidia continua fazendo parte da comparação
A plataforma independente Vera da Nvidia foi a alternativa discutida nos comentários de Ho. Ele avaliou que ela estava “um pouco atrás” em termos de maturidade, conforme relatado pelo Tom’s Hardware e pela AI Weekly. Essa avaliação ajuda a explicar por que a OpenAI selecionou o Turin para os hospedeiros dos sistemas Jalapeño descritos pela reportagem.
O comentário é mais restrito do que um veredito geral sobre o hardware da Nvidia. Ele se relaciona especificamente à maturidade do Vera como alternativa considerada para essa implementação. A reportagem não diz que o hardware da Nvidia esteja ausente de todos os sistemas da OpenAI, nem estabelece que a AMD será a fornecedora permanente de CPUs hospedeiras da empresa.
O que a informação mostra é uma etapa específica da estratégia de hardware da OpenAI. A empresa tem um ASIC de inferência personalizado operando em sistemas com dois processadores AMD EPYC Turin e 1.5TB de DRAM por hospedeiro. A liderança de hardware da empresa também comparou a maturidade da opção independente Vera, da Nvidia, com as necessidades práticas do design atual.
Por enquanto, os detalhes divulgados são limitados, mas estabelecem a arquitetura básica: o chip Jalapeño da OpenAI está sendo implementado com CPUs AMD Turin ao seu redor, enquanto o Nvidia Vera é considerado uma alternativa menos madura para essa função de hospedeiro. A escolha reflete as necessidades imediatas de colocar um sistema de inferência personalizado em operação, e não um anúncio mais amplo sobre todas as plataformas que a OpenAI poderá usar.