Les développeurs font parler Claude comme un homme des cavernes pour réduire les coûts – et ça marche

Les développeurs font parler Claude comme un homme des cavernes pour réduire les coûts – et ça marche

En résumé

  • Un développeur sur Reddit est devenu viral grâce à une technique qui réduit les jetons de sortie de Claude jusqu'à 75 %, l'obligeant à répondre sans courtoisie ni explication.
  • La compétence a été regroupée sur GitHub avec une réduction moyenne vérifiée de 61 % des tâches de recherche, du code et des FAQ.
  • Les experts ont averti que restreindre le langage du modèle pourrait affecter leur raisonnement et que les économies réelles sont d'environ 25 % en incluant les jetons d'entrée.

Entre ingénierie rapide et art de la performance, un développeur a publié sur Reddit une découverte qui a fait rire la communauté de l'IA avant qu'elle n'y prête attention : apprenez à Claude à communiquer comme un humain préhistorique et voyez votre facture de jetons baisser jusqu'à 75 %.

Le message est arrivé sur ClaudeAI la semaine dernière et a depuis accumulé plus de 400 commentaires et 10 000 votes – une combinaison rare d'une véritable perspicacité technique et d'une comédie absurde qu'Internet récompense souvent.

Le mécanisme est simple. Au lieu de laisser Claude s'échauffer avec des plaisanteries, raconter chaque pas qu'il fait et conclure en offrant plus d'aide, le développeur limite le modèle à des phrases courtes et épurées. L'outil d'abord, le résultat d'abord, sans explications. Une tâche de recherche Web normale qui représenterait environ 180 jetons de sortie est tombée à environ 45. L'auteur original revendique des réductions allant jusqu'à 75 % des jetons de sortie, obtenues en donnant l'impression que le modèle vient de découvrir le feu.

En termes d'homme des cavernes, comme l'a dit un utilisateur de Reddit : « Pourquoi perdre du temps à dire beaucoup de mots alors que quelques mots suffisent ? »

Ce que cette technique ne touche pas, c'est le contexte d'entrée : l'intégralité de l'historique de la conversation, les pièces jointes et les instructions système que le modèle relit à chaque tour. Cette entrée est généralement beaucoup plus importante que la sortie, en particulier lors de longues sessions de programmation. Les sessions réelles qui incluent toutes ces entrées enregistrent des économies d'environ 25 %, et non de 75 %. C’est quand même significatif, mais ce n’est tout simplement pas le chiffre qui fait la une des journaux.

C'est également une bonne idée de nourrir le modèle avec des instructions normales. Ne lui donnez pas le langage « homme des cavernes », car vous pourriez vous retrouver dans une situation de « déchets à l'intérieur, déchets à l'extérieur ».

Se pose également la question de la dégradation du renseignement. Un groupe de chercheurs participant au fil de discussion a fait valoir que forcer une IA à adopter une personnalité moins sophistiquée pourrait nuire activement à sa qualité de raisonnement et que les contraintes verbales pourraient se répercuter sur les contraintes cognitives. Le problème n’est pas définitivement résolu, mais mérite d’être pris en compte lors de l’évaluation des résultats.

Bonne compétence, devenez une compétence virale

Cependant, malgré les avertissements, la technique a trouvé presque immédiatement une seconde vie sur GitHub.

Le développeur Shawnchee a regroupé les règles dans une compétence d'homme des cavernes autonome, prenant en charge Claude Code, Cursor, Windsurf, Copilot et plus de 40 agents supplémentaires. La compétence distille l'approche en 10 règles : pas de phrases de remplissage, exécuter avant d'expliquer, pas de méta-commentaires, pas de préambules, pas de post-scriptum, pas de publicités d'outils, expliquer uniquement lorsque cela est nécessaire, laisser le code parler de lui-même et traiter les bogues comme quelque chose que vous corrigez et non racontez.

Les benchmarks du référentiel, vérifiés avec tiktoken, montrent des réductions de jetons de sortie de 68 % dans les tâches de recherche sur le Web, de 50 % dans les modifications de code et de 72 % dans les échanges de questions-réponses, pour une réduction moyenne de 61 % des jetons de sortie dans quatre tâches standard.

Un référentiel parallèle du développeur Julius Brussee a adopté une approche légèrement différente, posant la même idée qu'un fichier SKILL.md avec 562 étoiles sur GitHub. La spécification : réagir comme un homme des cavernes intelligent, éliminer les articles, les remplissages et les plaisanteries, conserver toute la substance technique. Les blocs de code restent intacts. Les messages d'erreur sont cités textuellement. Les termes techniques restent les mêmes. L’homme des cavernes ne parle que l’anglais qui entoure les faits.

Celui-ci est même livré avec différents modes pour contrôler la quantité que vous souhaitez recadrer, en alternant entre Normal, Lite et Ultra. Les modèles font exactement le même travail, mais offrent un temps de réponse beaucoup plus court, ce qui entraîne d'énormes économies au fil du temps.

Le contexte plus large des coûts donne à la plaisanterie un aspect plus pointu. Anthropic fait partie des modèles les plus chers en termes de prix par token. Pour les développeurs exécutant des workflows agents avec des dizaines de tours par session, la verbosité des jetons de sortie n'est pas un reproche stylistique. C'est un poste budgétaire. Si un grognement d'homme des cavernes peut remplacer un résumé en cinq phrases de ce que le modèle vient de faire, ces jetons enregistrés s'accumulent sur des milliers d'appels d'API.

La compétence Caveman peut être installée avec une seule commande via skills.sh et fonctionne globalement sur tous les projets. Même si cela rend Claude légèrement moins articulé, cela a déjà rendu de nombreux développeurs beaucoup moins frustrés.

Débriefing quotidien Bulletin

Commencez chaque journée avec les principales actualités du moment, ainsi que des fonctionnalités originales, un podcast, des vidéos et bien plus encore.

Voir l’article original en espagnol

Prime Video sur Amazon.fr
Découvrez un monde infini de divertissement avec Prime Video d’Amazon. Inscrivez-vous dès maintenant pour profiter d’un essai gratuit de 30 jours et plongez dans vos séries et films préférés, où que vous soyez !