
En résumé
- OpenAI a présenté Jalapeño, sa première puce d'IA conçue avec Broadcom spécifiquement pour l'inférence de modèles de langage.
- La puce est déjà testée dans les laboratoires OpenAI avec GPT-5.3-Codex-Spark et promet une plus grande efficacité énergétique que les puces actuelles.
- Jalapeño fait partie d'une plateforme multigénérationnelle qui sera déployée dans les centres de données d'ici fin 2026.
OpenAI a dévoilé mercredi Jalapeño, sa première puce d'IA personnalisée, donnant un nom épicé à un projet qui pourrait transformer la façon dont l'entreprise alimente ChatGPT et les futurs produits d'IA.
Développée avec Broadcom, la puce a été conçue spécifiquement pour l'inférence de grands modèles de langage (LLM), le processus qui génère des réponses aux invites des utilisateurs, et représente l'avancée la plus importante d'OpenAI à ce jour vers un contrôle accru de l'infrastructure matérielle derrière ses modèles d'IA.
« Jalapeño fait partie de notre stratégie d'infrastructure globale à long terme visant à rendre la capacité informatique plus abondante, ce qui aboutira à une IA plus rapide, plus fiable et accessible aux particuliers et aux entreprises, et qui peut être utilisée pour résoudre des problèmes plus importants », a déclaré le président d'OpenAI, Greg Brockman, dans un communiqué. « En concevant nous-mêmes davantage de composants, nous pouvons fournir plus d'intelligence plus efficacement et continuer à pousser l'IA avancée vers un accès plus large. »
Contrairement à de nombreuses puces d'IA conçues pour gérer un large éventail de tâches informatiques, Jalapeño a été spécialement conçu pour exécuter des chatbots et d'autres systèmes d'IA alimentés par de grands modèles linguistiques. OpenAI a déclaré que les premières versions de la puce sont déjà testées dans ses laboratoires, notamment avec GPT-5.3-Codex-Spark. La société affirme que Jalapeño peut fournir plus de puissance de calcul tout en utilisant moins d’énergie que les principales puces d’IA actuelles, bien qu’elle n’ait pas encore publié de résultats de référence.
L'annonce confirme les informations selon lesquelles OpenAI développait un programme de puce personnalisé. Au début de cette année, Reuters a rapporté que la société prévoyait de lancer sa première puce d'IA développée en interne dans le but de réduire sa dépendance à l'égard du matériel Nvidia. Les ambitions d'OpenAI en matière de puces ont encore pris de l'ampleur en avril, avec des informations selon lesquelles la société développait une puce conçue pour les smartphones.
La puce est le premier produit de ce qu'OpenAI décrit comme une plate-forme informatique multigénérationnelle qui devrait commencer à être déployée dans les centres de données plus tard cette année, les générations futures prenant en charge une infrastructure d'IA à l'échelle du gigawatt aux côtés de Microsoft et d'autres partenaires.
« Notre collaboration avec OpenAI représente un engagement crucial pour faire évoluer l'infrastructure physique nécessaire à la prochaine décennie de l'IA », a ajouté le président-directeur général de Broadcom, Hock Tan, dans un communiqué. « En co-développant notre silicium de pointe directement avec OpenAI, nous permettons le déploiement de centres de données à l'échelle du gigawatt avec Microsoft et d'autres partenaires à partir de 2026. »
Débriefing quotidien Bulletin
Commencez chaque journée avec les principales actualités du moment, ainsi que des fonctionnalités originales, un podcast, des vidéos et bien plus encore.
Voir l’article original en espagnol
