
OpenAI a introduit GPT-Live, une nouvelle génération de modèles vocaux. La technologie est déjà intégrée au mode « Conversation » du chatbot ChatGPT.
La principale caractéristique de GPT-Live est son architecture full-duplex. Désormais, le réseau neuronal peut écouter et parler en même temps, sans attendre le silence. Le modèle comprend les interjections, sait faire une pause et n'interrompt pas l'utilisateur s'il est simplement perdu dans ses pensées.
Les développeurs ont séparé le processus de communication et l'exécution des tâches. Pendant que GPT-Live maintient la conversation, un autre modèle (au lancement il s'agit de GPT-5.5) recherche des informations sur Internet ou effectue des calculs complexes en arrière-plan. Cela permet à l’IA de traduire la parole en temps réel et de résoudre les requêtes sans interrompre la conversation.

Les résultats des tests ont montré que GPT-Live surpasse les solutions précédentes en matière de raisonnement scientifique et de récupération de données. L'interface ChatGPT comprend également des cartes visuelles avec la météo, les cours des actions et les résultats sportifs.
OpenAI a publié deux versions : la puissante GPT-Live-1 et la version simplifiée GPT-Live-1 mini. Disponibilité:
- les utilisateurs des tarifs payants Plus et Pro ont eu accès au modèle principal ;
- une version mini est disponible dans la version gratuite de ChatGPT ;
- l'entreprise ouvrira bientôt API pour les développeurs.
Les programmeurs ont ajouté de nouveaux filtres de sécurité au système. Ils bloquent les tentatives d'imitation de la voix d'autrui et limitent les contenus liés à la violence ou à l'automutilation. Un contrôle parental est prévu pour les adolescents.
Pour rappel, OpenAI a ouvert en juin un accès limité à GPT-5.6 Sol, Terra et Luna via API et Codex à un petit groupe de partenaires de confiance. La société a lancé l'avant-première à la demande des autorités américaines.
Vous avez trouvé une erreur dans le texte ? Sélectionnez-le et appuyez sur CTRL+ENTRÉE