OpenRouter lance Fusion, une API qui promet d'égaler Claude Fable 5 à moitié prix

OpenRouter lance Fusion, une API qui promet d'égaler Claude Fable 5 à moitié prix

En résumé

  • OpenRouter a lancé Fusion, une API qui fusionne les réponses de plusieurs modèles bon marché pour rivaliser avec Claude Fable 5.
  • Gemini 3 Flash, Kimi K2.6 et DeepSeek V4 Pro combinés ont obtenu 64,7 % sur DRACO contre 65,3 % pour Fable.
  • Les chercheurs ont salué cette approche, mais les sceptiques ont souligné des défauts de programmation et un manque de transparence.

OpenRouter a lancé une API basée sur un pari simple : qu'un panel de modèles d'IA bon marché, combinés de la bonne manière, puisse égaler un seul modèle coûteux. Et par « cher », ils entendent Claude Fable 5.

Le produit s'appelle Fusion. Envoyez une invite à plusieurs modèles en parallèle, puis utilisez un juge de modèle et un synthétiseur pour fusionner les résultats en une réponse unique et éclairée.

Le moment est opportun. Peu de temps après le lancement de Fable 5 et Mythos 5 la semaine dernière, une directive américaine sur le contrôle des exportations a forcé Anthropic à suspendre ces modèles pour tous les ressortissants étrangers dans le monde, citant une conclusion controversée en matière de jailbreak. Le lendemain, OpenRouter a publié la nouvelle sur

Comment obtenir une Fable pas chère

Lorsque vous envoyez une invite à Fusion, OpenRouter l'envoie à un panneau de modèles parallèles. Chacun a accès aux outils bash et de recherche Web.

Ensuite, un modèle de juge extrait les points de consensus, les contradictions et les angles morts de chaque réponse. Une fois cette phase terminée, un synthétiseur – Claude Opus 4.8 par défaut – écrit la réponse finale basée sur cette analyse.

Tout se passe côté serveur. Vous pouvez modifier la chaîne de modèle en « openrouter/fusion » pour un panneau par défaut, ajouter un outil de fusion pour votre propre modèle à utiliser de manière sélective ou créer un panneau personnalisé dans la salle de discussion Fusion sans code.

OpenRouter a testé cela sur DRACO, le benchmark de Perplexity construit à partir de véritables demandes de recherche approfondies d'utilisateurs. Fable 5 combiné avec GPT-5.5 d'OpenAI et synthétisé par Opus est en tête du classement avec 69 %. Fable à lui seul a obtenu un score de 65,3 %, bien que sept de ses 100 tâches n'aient jamais été exécutées parce que leurs propres filtres de contenu les bloquaient.

La combinaison la moins chère est celle qu'OpenRouter veut que vous reteniez : Gemini 3 Flash, le modèle économique, combiné aux modèles chinois open source Kimi K2.6 et DeepSeek V4 Pro, fusionnés et synthétisés par Opus, a obtenu un score de 64,7 %, battant GPT-5,5 seul (60 %) et Opus 4.8 seul (58,8 %), et se situant à un point de Fable pour environ la moitié du prix.

Même en combinant Opus 4.8 avec une instance distincte de lui-même, il a obtenu un score de 65,5 %, soit un bond de 6,7 points par rapport à Opus seul ; Selon OpenRouter, environ les trois quarts de cette amélioration proviennent de l’étape de synthèse elle-même, et le reste d’une véritable diversité entre les modèles.

Un détail : donner au panel un accès Web en direct permet aux modèles de trouver la propre rubrique de notation de DRACO dans les résultats de recherche, un risque de contamination qu'OpenRouter qualifie de fortuit et non délibéré. Le correctif nécessitait une seule ligne de configuration pour exclure les domaines d'hébergement du benchmark des outils de recherche, et tous les chiffres publiés reflètent cette exécution raffinée.

Est-ce que ça vaut la peine d'essayer ?

OpenRouter reconnaît ouvertement que Fusion ne remplace pas complètement Fable. DRACO omet les travaux à long terme, où Fable serait toujours en tête, et pour la programmation, Fusion fonctionne comme un outil qu'un modèle de programmation utilise de manière sélective, et non comme un remplacement complet – une mise en garde qui correspond à ce que *Decrypt* a trouvé lors du test de DeepClaude, un backend moins cher qui maintient la boucle d'agent de Claude Code intacte mais reste toujours derrière Opus sur les tâches de raisonnement les plus difficiles.

Le modèle régulier continue de gérer les tâches quotidiennes. La fusion est là pour les questions où un seul modèle peut manquer quelque chose, et le fait que plusieurs perspectives se vérifient mutuellement fait vraiment la différence.

Pour une enquête approfondie, une planification complexe ou tout autre cas où les contradictions sont importantes, le panel semble aider.

Les graphiques montrent clairement l'essentiel : dans ce type de travail, le modèle coûteux n'est plus le seul moyen d'obtenir une synthèse solide. Un groupe de modèles encore faciles à obtenir, fusionnés, peuvent être positionnés les uns à côté des autres dans les résultats tout en générant une facture bien moindre.

Le fil de discussion était partagé environ deux contre un sur le sentiment positif. Le chercheur en IA Andrew Trask l'a qualifié de « beaucoup plus important qu'il n'y paraît », affirmant que les laboratoires frontaliers ne seront plus jamais les seuls propriétaires de la frontière. Cependant, les sceptiques ont remis en question cette approche, citant de mauvais résultats de programmation, une mauvaise utilisation des outils et un manque de transparence puisque Fable 5 n'est plus disponible pour comparer les résultats.

Fusion fonctionne entièrement sur des modèles acheminés via la propre infrastructure d'OpenRouter, il ne résout donc pas le problème du contrôle des exportations à la source. Quiconque n'a pas accès à Fable 5 a désormais des options : un panneau Fusion, un échange backend comme DeepClaude ou des alternatives open source comme GLM-5.2 qui ne sont peut-être pas meilleures, mais sont assez bonnes pour le prix.

Débriefing quotidien Bulletin

Commencez chaque journée avec les principales actualités du moment, ainsi que des fonctionnalités originales, un podcast, des vidéos et bien plus encore.



Voir l’article original en espagnol