OpenAI et Broadcom dévoilent la puce Jalapeño pour l'inférence de grands modèles de langage

OpenAI and Broadcom team up on custom AI silicon
OpenAI et Broadcom ont annoncé une nouvelle puce conçue spécifiquement pour l'inférence de grands modèles de langage dans les centres de données, marquant un nouvel indice que l'industrie de l'IA s'enfonce davantage dans le matériel personnalisé.
La puce, appelée Jalapeño, est présentée comme la première génération d'une collaboration à plus long terme entre les deux entreprises. Broadcom a déclaré que l'ASIC a été conçu de A à Z pour l'inférence de grands modèles de langage, en s'appuyant sur des « insights détaillés » tirés des discussions avec les chercheurs d'OpenAI et la feuille de route de la société pour les modèles et produits futurs. Broadcom a indiqué que la puce a été conçue et fabriquée en neuf mois.
OpenAI a précisé que les premiers tests suggèrent que Jalapeño offrira une « performance par watt sensiblement meilleure que l'état de l'art actuel », tout en ajoutant que les tests sont toujours en cours et qu'un rapport technique plus détaillé suivra dans les mois à venir.
Cet effort reflète l'ambition plus large d'OpenAI de contrôler davantage l'infrastructure derrière ses modèles et produits, réduisant la dépendance à des fournisseurs externes tels que Nvidia. Il intervient également alors que les entreprises d'IA cherchent à mieux répartir des ressources de calcul limitées dans un contexte de tension mondiale sur les centres de données.
Broadcom, déjà un fournisseur majeur de puces pour les constructeurs d'infrastructures, a étendu son activité de silicium personnalisé alors que les hyperscalers et les développeurs de modèles de pointe recherchent des puces spécialisées adaptées à leurs propres charges de travail.
Les deux entreprises ont déclaré que des puces Jalapeño devraient être déployées dans les centres de données d'ici la fin de cette année.
Sources:
Lisez plus de nouvelles tech sur le Doppler VPN Blog.