
Nvidia a annoncé une nouvelle génération de puces et de logiciels d’IA pour travailler avec de grands modèles de langage. La présentation a eu lieu lors de la conférence GTC 2024.
Selon le PDG de l’entreprise, Jensen Huang, Nvidia met à jour son architecture tous les deux ans GPU afin d’améliorer la productivité. De nombreux modèles d’IA précédemment publiés sont formés sur l’architecture Hopper. Il est utilisé dans des puces comme la H100, annoncée en 2022.
« Hopper est fantastique, mais nous avons besoin de GPU plus puissants », a déclaré le PDG de l’entreprise.
La nouvelle génération de processeurs graphiques d’IA s’appelle Blackwell. Le premier modèle GB200 sortira plus tard cette année.
Nvidia affirme que les nouveaux processeurs offrent une amélioration significative des performances aux entreprises travaillant avec des réseaux de neurones : 20 pétaflops pour les nouvelles puces au lieu de 4 pétaflops pour le H100. La puissance de calcul supplémentaire leur permettra de former des modèles plus grands et plus complexes, a déclaré Huang.
Par exemple, la formation de GPT-4 en 90 jours a nécessité 8 000 anciennes puces et 15 MW de puissance. Pour vous entraîner sur une nouvelle carte vidéo, vous n’aurez besoin que de 2 000 processeurs et 4 MW.
On a également appris que le GB200 disposerait de 192 Go de mémoire avec une bande passante de 8 To/s.
« Blackwell n’est pas seulement une puce, c’est une plateforme entière », a déclaré Huang.
Le GPU combine deux puces fabriquées séparément en une seule puce fabriquée par TSMC. Ensemble, ils contiennent 208 milliards de transistors.
Le modèle sera disponible sous la forme d’un serveur appelé GB200 NVLink 2, composé de 72 GPU Blackwell. Sa capacité totale de RAM sera de 30 To.
La société vendra l’accès au GB200 via des services cloud. Nvidia a déclaré qu’Amazon Web Services construirait un cluster de serveurs composé de 20 000 de ces modèles.
Huang a également annoncé l’ajout d’un nouveau produit appelé Nvidia Inference Microservice (NIM) à ses abonnements aux logiciels d’entreprise. Cela facilite l’utilisation d’anciens GPU pour l’informatique.
Rappelons qu’en janvier 2024, Mark Zuckerberg avait promis d’acheter des puces Nvidia pour Meta, car la « future feuille de route » dans le domaine de l’intelligence artificielle nécessite « une énorme infrastructure informatique ».
Vous avez trouvé une erreur dans le texte ? Sélectionnez-le et appuyez sur CTRL+ENTRÉE
Newsletters ForkLog : restez à l’écoute de l’industrie Bitcoin !