Technology · · 3 min read

OpenAI exploite ses ASIC Jalapeño avec des processeurs hôtes AMD Turin

OpenAI teste sa puce d’inférence Jalapeño dans des systèmes articulés autour de processeurs AMD EPYC Turin plutôt que de la plateforme Vera de Nvidia.

OpenAI fait fonctionner son ASIC d’inférence Jalapeño avec des processeurs AMD, selon des informations de Tom’s Hardware citées par AI Weekly. Les systèmes utilisent des processeurs AMD EPYC « Turin » comme silicium hôte, plaçant l’accélérateur personnalisé d’OpenAI dans une configuration serveur qui ne dépend pas des processeurs de Nvidia.

Chaque système hôte contiendrait, selon les informations disponibles, deux processeurs de la famille Turin et 1.5 téraoctet de DRAM. Cette configuration fournit la plateforme informatique qui entoure Jalapeño, la puce personnalisée d’OpenAI destinée aux charges de travail d’inférence. Ces informations donnent un aperçu de la manière dont l’entreprise assemble l’infrastructure nécessaire pour exploiter ses propres composants, ainsi que des solutions alternatives qu’elle envisage pour les éléments qui les entourent.

Une conception de serveur en deux parties

Un ASIC d’inférence est conçu pour effectuer les calculs nécessaires lorsqu’un système d’IA produit une réponse ou une prédiction. Le processeur hôte constitue une partie distincte du système, chargée d’accompagner l’accélérateur et de fournir la plateforme serveur globale. Dans le déploiement de Jalapeño par OpenAI, les processeurs AMD EPYC Turin remplissent ce rôle d’hôte.

La configuration rapportée comporte deux processeurs Turin dans chaque hôte et 1.5TB de mémoire. Ces spécifications sont les détails les plus précis communiqués sur les machines qui embarquent l’ASIC. Elles montrent également que le choix de l’accélérateur ne détermine pas tous les autres composants du serveur : le silicium d’inférence développé par OpenAI est associé à une plateforme hôte fournie par AMD.

Cette distinction est importante, car les discussions sur le matériel d’IA se concentrent souvent sur l’accélérateur seul. En pratique, un système dépend aussi des processeurs, de la mémoire et de la conception du serveur qui permettent à l’accélérateur de fonctionner. La configuration d’OpenAI telle qu’elle a été rapportée identifie les deux faces de cet ensemble : Jalapeño est le composant d’inférence personnalisé, tandis que Turin fournit les processeurs hôtes.

Pourquoi AMD est utilisé

Richard Ho, vice-président d’OpenAI et responsable du matériel, a décrit la décision d’utiliser Turin comme une démarche pragmatique visant à réduire les risques, selon les informations rapportées. Cette explication présente le choix du processeur comme une décision d’ingénierie pratique plutôt que comme l’annonce du remplacement d’un fournisseur par un autre dans l’ensemble de l’infrastructure d’OpenAI.

Les informations disponibles n’indiquent pas qu’AMD fournisse l’ASIC Jalapeño lui-même. Les processeurs EPYC d’AMD servent plutôt de silicium hôte dans les systèmes où la puce d’OpenAI est déployée. Il est important de distinguer ces rôles : le rapport concerne la plateforme CPU qui entoure Jalapeño, et non la fabrication de l’accélérateur personnalisé d’OpenAI.

L’utilisation rapportée de matériel AMD indique également que la puce personnalisée d’OpenAI est testée dans un environnement faisant intervenir plusieurs fournisseurs. Jalapeño provient des propres efforts d’OpenAI dans le domaine du matériel, tandis que les processeurs hôtes viennent d’AMD. Il en résulte une conception serveur composée de composants aux origines et aux fonctions différentes.

Nvidia reste présent dans la comparaison

La plateforme autonome Vera de Nvidia était l’alternative évoquée dans les commentaires de Ho. Il l’a jugée « un peu en retard » en matière de maturité, selon Tom’s Hardware et AI Weekly. Cette évaluation contribue à expliquer pourquoi OpenAI a choisi Turin pour les hôtes des systèmes Jalapeño décrits dans le rapport.

Ce commentaire est plus limité qu’un jugement général sur le matériel de Nvidia. Il concerne précisément la maturité de Vera en tant qu’alternative envisagée pour ce déploiement. Le rapport n’affirme pas que le matériel de Nvidia est absent de tous les systèmes d’OpenAI, pas plus qu’il n’établit qu’AMD sera le fournisseur permanent des processeurs hôtes de l’entreprise.

Ce qu’il montre, en revanche, c’est une étape particulière de la stratégie matérielle d’OpenAI. L’entreprise dispose d’un ASIC d’inférence personnalisé qui fonctionne dans des systèmes équipés de deux processeurs AMD EPYC Turin et de 1.5TB de DRAM par hôte. Les responsables du matériel ont également comparé la maturité de l’option autonome Vera de Nvidia aux besoins pratiques de la conception actuelle.

Pour l’instant, les détails communiqués restent limités, mais ils établissent l’architecture de base : la puce Jalapeño d’OpenAI est déployée avec des processeurs AMD Turin autour d’elle, tandis que Vera de Nvidia est considérée comme une alternative moins mature pour ce rôle d’hôte. Ce choix répond aux exigences immédiates de la mise en service d’un système d’inférence personnalisé, plutôt qu’à une annonce plus large sur toutes les plateformes qu’OpenAI pourrait utiliser.

openaiai hardwareinference chipsamdnvidiaepyc turinjalapeño

Continue reading

Read this in another language