
La startup d'IA OpenAI a dévoilé un nouveau modèle de langage à grande échelle, o1, formé à l'aide de l'apprentissage par renforcement pour effectuer un raisonnement complexe.
Nous publions un aperçu d'OpenAI o1, une nouvelle série de modèles d'IA conçus pour passer plus de temps à réfléchir avant de répondre.
Ces modèles peuvent raisonner sur des tâches complexes et résoudre des problèmes plus difficiles que les modèles précédents en sciences, en codage et en mathématiques. https://t.co/peKzzKX1bu
— OpenAI (@OpenAI) 12 septembre 2024
Le réseau neuronal peut réfléchir : il est capable de créer une longue chaîne interne de pensées lors de l'analyse d'une question, affirme l'entreprise.
o1 évite certains « Les pièges du raisonnement« , car il peut se vérifier efficacement, en consacrant plus de temps à l'analyse des parties de la question. Le modèle est capable d'aborder l'analyse du problème de manière holistique, en planifiant et en exécutant une série d'actions sur une longue période de temps.
Le nouvel outil d'OpenAI est adapté aux tâches impliquant plusieurs sous-tâches, telles que la détection d'e-mails privilégiés ou le brainstorming d'une stratégie marketing.
@OpenAIL'IA o1 pense en quelques secondes, mais nous souhaitons que les versions futures pensent en quelques heures, quelques jours, voire quelques semaines. Les coûts d'inférence seront plus élevés, mais quel prix paieriez-vous pour un nouveau médicament contre le cancer ? Pour des batteries révolutionnaires ? Pour une preuve de l'hypothèse de Riemann ? L'IA peut être bien plus que des chatbots pic.twitter.com/AtqjRTzNMN
— Noam Brown (@polynoamial) 12 septembre 2024
« Le processus de raisonnement d’O1 prend quelques secondes, mais nous espérons que les versions futures pourront réfléchir pendant des heures, des jours, voire des semaines. Le coût du raisonnement sera plus élevé, mais quel prix paieriez-vous pour un nouveau médicament contre le cancer ? Pour des batteries révolutionnaires ? Pour prouver l’hypothèse de Riemann ? L’IA peut être bien plus que des chatbots », a déclaré Noam Brown, chercheur à OpenAI.
Selon OpenAI, o1 a résolu 83 % des problèmes de l'examen de sélection de l'Olympiade internationale de mathématiques, tandis que GPT-4o en a résolu 13 %. En programmation compétitive sur la plateforme Codeforces, il obtient de meilleurs résultats que 89 % des participants.
Le réseau neuronal combine une famille de modèles. Une première version d'o1-preview a été publiée le 12 septembre et d'autres sont prévues pour l'avenir.
Les capacités du nouveau modèle de langage sont encore limitées : il ne peut pas analyser les pages Web, les fichiers et les images.
Le nouvel outil d'OpenAI est plus cher que son prédécesseur : l'API o1-preview coûte 15 $ pour 1 million de jetons d'entrée (trois fois le prix de GPT-4o) et 60 $ pour 1 million de jetons de sortie (quatre fois le prix de GPT-4o). Il est disponible dans ChatGPT pour les utilisateurs d'entreprise Plus ou Team.
Le nouveau modèle portait auparavant le nom de code Strawberry. Avant cela, le projet s’appelait Q* et était considéré comme une avancée majeure dans la création d’une intelligence artificielle générale qui « pourrait menacer l’humanité ».
Il a été annoncé plus tôt qu'OpenAI était en pourparlers pour lever 6,5 milliards de dollars pour une valorisation de 150 milliards de dollars.
Rappelons que le PDG de la startup, Sam Altman, prévoit de mettre en œuvre un projet à grande échelle visant à créer des équipements et des systèmes d'intelligence artificielle d'une valeur de plusieurs dizaines de milliards de dollars.
Vous avez trouvé une erreur dans le texte ? Sélectionnez-la et appuyez sur CTRL+ENTRÉE
Newsletters ForkLog : restez au courant de l'actualité du secteur du bitcoin !