
Les chercheurs d’Apple ont développé un nouveau système d’IA capable de comprendre le contexte.
Selon des documents publiés, la fonctionnalité permet d’interagir plus naturellement avec les assistants vocaux.
Le système s’appelle Reference Resolution As Language Modeling (ReALM) – « résolution en tant que modélisation du langage ». Elle utilise LLM pour résoudre le problème de reconnaissance de lien. Cela permet à ReALM d’obtenir des gains de performances significatifs par rapport aux méthodes existantes.
« La capacité à comprendre le contexte, y compris les références, est très importante pour un assistant conversationnel. L’étape la plus importante pour rendre les assistants vocaux véritablement mains libres est la possibilité de poser des questions sur ce qui est à l’écran », a déclaré l’équipe de recherche d’Apple.
Pour travailler avec des références à l’écran, ReALM utilise la reconstruction d’affichage en analysant les objets qui s’y trouvent et leurs emplacements pour créer une représentation textuelle qui transmet le schéma visuel.
Le modèle d’IA est spécifiquement conçu pour améliorer les capacités de Siri en prenant en compte les données affichées et les tâches en cours. Il classe les informations en trois entités : écran, conversationnelle et arrière-plan.
Selon les travaux de recherche d’Apple, le système d’IA n’est pas inférieur en capacités à GPT-4. Le plus petit modèle ReALM d’Apple fonctionne de manière comparable au chatbot d’OpenAI, tandis que les plus grands le surpassent considérablement.
Rappelons qu’en février, le PDG d’Apple, Tim Cook, a révélé les projets de l’entreprise d’utiliser l’IA générative.
Vous avez trouvé une erreur dans le texte ? Sélectionnez-le et appuyez sur CTRL+ENTRÉE
Newsletters ForkLog : restez à l’écoute de l’industrie Bitcoin !
Voir l’article original en russe
