OpenAI lance un nouveau modèle « 01 » qui surpasse ChatGPT-4o

OpenAI lance un nouveau modèle « 01 » qui surpasse ChatGPT-4o

En résumé

  • OpenAI a présenté une nouvelle famille de modèles, OpenAI o1, disponible dans ChatGPT Plus, affirmant qu'elle offre des améliorations significatives en termes de performances et de capacités de raisonnement.
  • Les nouveaux modèles utilisent le raisonnement par « chaîne de pensée » pour être plus efficaces dans les tâches complexes, surpassant le GPT-40 dans plusieurs domaines clés.
  • OpenAI a décrit ces modèles comme une avancée majeure, soulignant leur capacité à effectuer un raisonnement complexe et délibératif, même s’ils sont encore confrontés à des défis dans les tâches créatives.

OpenAI a dévoilé une nouvelle famille de modèles et les a mis à disposition du public jeudi dans son abonnement payant ChatGPT Plus, affirmant qu'ils offrent des améliorations significatives en termes de performances et de capacités de raisonnement.

« Nous présentons OpenAI o1, un nouveau modèle de langage étendu (LLM) formé avec l'apprentissage par renforcement pour effectuer un raisonnement complexe », a déclaré OpenAI dans un article de blog officiel, « o1 réfléchit avant de répondre. » Les observateurs du secteur de l'IA s'attendent depuis des semaines à ce que le principal développeur d'IA déploie un nouveau modèle « fraise », bien que les distinctions entre les différents modèles en cours de développement ne soient pas rendues publiques.

OpenAI décrit cette nouvelle famille de modèles comme une avancée majeure, à tel point qu'ils ont modifié leur schéma de dénomination habituel, rompant ainsi avec les séries ChatGPT-3, ChatGPT-3.5 et ChatGPT-4o.

« Pour les tâches de raisonnement complexes, il s’agit d’une avancée significative et représente un nouveau niveau de capacité de l’IA », a déclaré OpenAI. « Compte tenu de cela, nous remettons le compteur à 1 et nommons cette série OpenAI o1. »

La clé du fonctionnement de ces nouveaux modèles est qu’ils « prennent leur temps » pour réfléchir avant d’agir, a déclaré l’entreprise, et utilisent le raisonnement par « chaîne de pensée » pour les rendre extrêmement efficaces dans les tâches complexes.

Notamment, même le plus petit modèle de cette nouvelle gamme surpasse le GPT-4o haut de gamme dans plusieurs domaines clés, selon les tests d'IA partagés par Open AI, en particulier les benchmarks d'OpenAI sur les défis considérés comme étant de niveau doctorat en termes de complexité.

Les nouveaux modèles mis en ligne mettent l’accent sur ce qu’OpenAI appelle le « raisonnement délibératif », où le système prend plus de temps pour travailler en interne sur ses réponses. Ce processus vise à produire des réponses plus réfléchies et plus cohérentes, en particulier dans les tâches qui nécessitent du raisonnement.

OpenAI a également publié des résultats de tests internes montrant des améliorations par rapport à GPT-4o dans des tâches telles que le codage, le calcul et l'analyse de données. Cependant, la société a révélé qu'OpenAI 01 a montré une amélioration moins spectaculaire dans les tâches créatives comme l'écriture créative. (Nos propres tests subjectifs ont placé les offres d'OpenAI derrière Claude AI dans ces domaines.) Néanmoins, les résultats de son nouveau modèle ont été généralement bien considérés par les évaluateurs humains.

Le nouveau modèle met en œuvre le processus d'IA de la chaîne de pensée lors de l'inférence. Cela signifie que le modèle utilise une approche segmentée pour raisonner sur un problème étape par étape avant de fournir un résultat final, qui est ce que les utilisateurs voient en fin de compte.

« La série de modèles o1 est entraînée à l'aide d'un apprentissage par renforcement à grande échelle pour raisonner à l'aide d'une chaîne de pensée », indique OpenAI sur la fiche système de la famille o1. « Entraîner des modèles à intégrer une chaîne de pensée avant de réagir a le potentiel de générer des avantages substantiels, tout en augmentant les risques potentiels associés à une intelligence supérieure. »

Cette déclaration générale laisse place au débat sur la véritable nouveauté de l’architecture du modèle parmi les observateurs techniques. OpenAI n’a pas précisé en quoi le processus diffère de la génération basée sur des jetons : s’agit-il d’une véritable allocation de ressources pour le raisonnement, d’une chaîne de commande cachée – ou peut-être d’un mélange des deux techniques ?

Un modèle d’IA open source antérieur appelé Reflection avait expérimenté une approche similaire basée sur le raisonnement, mais avait été critiqué pour son manque de transparence. Ce modèle utilisait des étiquettes pour séparer les étapes de son raisonnement, ce qui, selon ses développeurs, constituait une amélioration par rapport aux résultats des modèles conventionnels.

L’intégration de davantage de lignes directrices dans la chaîne de processus de réflexion rend non seulement le modèle plus précis, mais également moins sujet aux techniques de jailbreaking, car il dispose de plus de temps et d’étapes pour détecter lorsqu’un résultat potentiellement dangereux se produit.

La communauté du jailbreaking semble être plus efficace que jamais pour trouver des moyens de contourner les contrôles de sécurité de l'IA, avec les premiers jailbreaks réussis d'OpenAI 01 signalés quelques minutes après sa sortie.

Il n'est pas certain que cette approche de raisonnement délibératif puisse être adaptée aux applications en temps réel nécessitant des temps de réponse rapides. OpenAI a annoncé son intention d'étendre les capacités des modèles entre-temps, notamment en ajoutant des fonctionnalités de recherche sur le Web et en améliorant les interactions multimodales.

De plus, le modèle sera affiné au fil du temps pour répondre aux normes minimales d'OpenAI en matière de sécurité, de prévention du jailbreak et d'autonomie.

Le modèle devrait être entièrement lancé jeudi, mais il pourrait être commercialisé par étapes, car certains utilisateurs ont signalé que le modèle n'était pas encore disponible pour être testé.

La version plus petite sera finalement disponible gratuitement, et l'accès à l'API sera 80 % moins cher que celui d'OpenAI o1-preview, selon l'annonce d'OpenAI. Mais ne vous enthousiasmez pas trop : il existe actuellement un tarif hebdomadaire de seulement 30 invites par semaine pour tester ce nouveau modèle pour o1-preview et 50 pour o1-mini, alors choisissez judicieusement vos invites.

Généralement intelligent Bulletin

Un voyage hebdomadaire de l'IA raconté par Gen, un modèle d'IA génératif.



Voir l’article original en espagnol