7 règles pour utiliser Claude Fable 5.1 mieux que 90 % des gens

AAI LABS
Computing/Software

Transcript

00:00:00Fable 5.1 est la toute dernière version d'Anthropic, et c'est l'un des meilleurs modèles que vous puissiez utiliser
00:00:05en ce moment. Mais il ne se comporte pas de la même manière que les modèles précédents, et il y a quelques petits
00:00:09détails à changer dans votre façon de travailler avec lui. Car si vous l'utilisez comme vous utilisiez
00:00:13les versions précédentes, vous n'en tirerez pas tout le potentiel, et vous obtiendrez peut-être même de moins bons
00:00:18résultats. Par exemple, Anthropic affirme que ce modèle est idéal pour les tâches de longue durée, mais il n'excelle
00:00:23vraiment que si vous le sollicitez d'une certaine façon. Et il y a un paramètre qu'Anthropic conseille de laisser
00:00:28au maximum, mais qui dégrade en réalité les résultats. Si vous nous découvrez, nous sommes une entreprise
00:00:32logicielle, et ceci est notre chaîne AI Labs. Dans cette vidéo, nous allons aborder 7 conseils pour tirer
00:00:37le meilleur parti de Fable 5.1. Mais avant d'entrer dans le vif du sujet, nous devons dire
00:00:42quelques mots sur ce nouveau modèle. Lors de sa sortie, Anthropic a affirmé qu'il était bien
00:00:48plus performant pour mener à bien les tâches. Mais Fable 5.1 ne fait pas un travail de meilleure qualité ; il accomplit
00:00:54davantage de travail pour un coût moindre. Nous l'avons constaté sur les projets de nos propres clients. Nous avons confié
00:01:00les mêmes tâches à Fable 5 et Fable 5.1 en effectuant plusieurs essais pour chaque modèle. Sans pouvoir
00:01:05révéler les détails des projets, Fable 5 a fourni un meilleur travail sur la plupart des tâches, et Fable 5.1 n'a
00:01:10été supérieur que sur une seule d'entre elles. C'était la plus difficile du lot : Fable 5.1 y a excellé,
00:01:16terminant environ 40 % plus rapidement pour un coût inférieur à la moitié. Fable 5.1 montre donc sa force
00:01:22quand la difficulté augmente. Et même lorsque son travail n'était pas supérieur, il allait jusqu'au bout. Fable 5
00:01:27s'interrompait avant la fin de certains essais, tandis que Fable 5.1 les a tous menés à terme. De plus, il coûte moins cher
00:01:33sur toutes les tâches. Vous savez peut-être déjà que Claude Code dispose d'une commande d'utilisation qui estime
00:01:38grosso modo ce qu'une session vous aurait coûté en payant à l'acte plutôt qu'avec un abonnement. Selon cette estimation,
00:01:45Fable 5.1 était environ 47 % moins cher que Fable 5. Mais ce n'est pas parce que le modèle consomme soudainement
00:01:50moins de jetons, c'est parce que la grille tarifaire d'Anthropic a changé. Avant d'aborder cette baisse de prix,
00:01:55plus la tâche dure longtemps, plus la conversation s'allonge. Et pour cette raison, le modèle doit lire davantage
00:02:00avant de répondre à une nouvelle invite. Les modèles ne se souviennent pas de la conversation d'un message à l'autre.
00:02:05souviennent pas d'un message à l'autre de manière spontanée. Ainsi, chaque fois que le modèle doit formuler une nouvelle
00:02:10réponse, l'intégralité de la conversation doit lui être renvoyée. Mais au lieu de retraiter la même conversation
00:02:16de zéro à chaque fois, Claude conserve une copie enregistrée des parties déjà traitées et réutilise cette copie
00:02:21lors de votre prochaine sollicitation. C'est ce qu'on appelle une lecture en cache. Ces lectures en cache ont également
00:02:27un coût, mais leur prix est réduit par rapport aux entrées et sorties classiques. Avec Fable 5.1, Anthropic a réduit
00:02:33ce tarif de 75 %. Par conséquent, la conversation renvoyée avant chaque réponse coûte désormais beaucoup moins cher. Cette
00:02:39économie peut sembler minime sur une seule instruction car il y a peu de texte à renvoyer, mais sur une tâche longue,
00:02:44cette même conversation qui ne cesse de grandir est transmise sans cesse, de sorte que l'économie s'accroît à chaque
00:02:50réponse du modèle. Cela ne concerne toutefois que ce que lit le modèle. Ce qu'il écrit est facturé séparément,
00:02:55et ce prix n'a pas bougé. Artificial Analysis, qui teste les modèles et les évalue de manière indépendante,
00:03:01a constaté que Fable 5.1 écrivait beaucoup plus que Fable 5. La facture a donc augmenté malgré des lectures moins
00:03:07chères. Lors de leurs tests, il a généré environ 1,7 fois plus de texte qu'Fable 5 pour un coût supérieur d'environ 20 % par tâche.
00:03:14Les modèles Fable d'Anthropic intègrent des garde-fous de sécurité, c'est-à-dire des règles qui les empêchent d'exécuter
00:03:19certains types de tâches. Avec Fable 5.1, Anthropic affirme que ces garde-fous interrompent les sessions de Claude Code
00:03:25environ 60 % moins souvent. Mais lorsqu'il déclenche l'un de ces garde-fous, Claude Code bascule vers un modèle plus faible
00:03:31sans vous prévenir et poursuit son travail. Ce modèle moins puissant gère le reste de la session, même si votre requête
00:03:36suivante n'a aucun rapport avec ce qui a provoqué ce changement. Ainsi, au lieu d'un refus net, vous obtenez un travail
00:03:41de moindre qualité tout en pensant qu'il provient de Fable 5.1. C'est déjà arrivé à quelqu'un qui concevait un jeu
00:03:46comportant un fichier de blagues contenant le mot biologique. Le projet n'avait aucun lien avec la biologie,
00:03:51mais ce seul mot a suffi pour changer le modèle en charge du travail. Et si votre projet traite réellement
00:03:55de l'un des sujets couverts par ces garde-fous, comme la sécurité ou la biologie, aucun paramètre ni aucune formulation
00:04:00ne permet d'éviter cela. C'est simplement une contrainte inhérente à Fable 5.1. D'après les tests d'Artificial Analysis,
00:04:06Fable 5.1 obtient de meilleurs scores que Fable 5 en matière de précision, mais il hallucine aussi davantage, c'est-à-dire
00:04:13qu'ignorant la réponse, il en invente une et la présente comme véridique. Lorsque Fable 5.1 ignorait
00:04:18une réponse, il a halluciné dans 72,6 % des cas, contre 63,6 % pour Fable 5. Qu'un modèle admette qu'il ne sait pas
00:04:26vaut pourtant mieux qu'un modèle qui prétend tout savoir, car cela vous permet d'aller vérifier les choses par
00:04:31vous-même. Mais s'il invente quelque chose et que vous lui faites confiance parce qu'il l'affirme d'un ton assuré,
00:04:35cette fausse information s'glisse directement dans votre travail. C'est d'autant plus problématique pour la recherche
00:04:40pour de la recherche ou de la rédaction, car tout vérifier devient ensuite une tâche ardue. Mais avant de passer
00:04:45aux conseils, ce serait formidable de vous abonner à la chaîne et de cliquer sur le bouton j'aime. Ce petit
00:04:50signifie beaucoup pour nous. Après avoir entendu tout cela, vous vous direz sans doute que l'ancien modèle reste
00:04:56clairement supérieur sur certains points. C'est vrai, mais il va également devenir le modèle par défaut dans
00:05:01les applications que vous utilisez. C'est pourquoi vous devez suivre les conseils que nous allons vous présenter,
00:05:06sous peine de passer à côté de son véritable potentiel. Le premier moyen d'exploiter réellement mieux
00:05:11Fable 5.1 consiste à réduire le niveau d'effort. Pour ceux qui l'ignorent, l'effort est le paramètre qui détermine
00:05:16le volume de travail fourni par le modèle avant de vous répondre, ce qui influence à la fois la qualité
00:05:21du travail et son coût. Code Rabbit, créateur d'un outil de révision de code, a testé Fable 5.1 sur ses propres
00:05:26revues et a découvert qu'il détectait 61 % des problèmes avec un effort faible, contre 57,1 % avec un effort élevé,
00:05:33tout en terminant environ 3 minutes plus vite. Nous avons fait le même constat en utilisant Fable 5.1 pour ajouter
00:05:39une fonctionnalité à notre site communautaire : en mode d'effort élevé, il s'est attardé longuement sur une partie
00:05:44spécifique, tandis qu'en mode faible, il a bouclé l'ensemble en nous offrant un meilleur résultat. Nous avions déjà
00:05:49recommandé l'effort faible dans notre précédente vidéo sur Fable, et après l'avoir testé sur Fable 5.1, c'est toujours
00:05:54notre recommandation. Commencez donc par un effort faible et n'augmentez ce niveau que si le résultat le justifie,
00:06:00sinon vous gaspillerez du temps et des jetons pour un bénéfice minime. La deuxième étape consiste à supprimer
00:06:05les instructions rédigées pour les anciens modèles. Celles-ci persistent dans votre configuration lorsque vous
00:06:10passez à Fable 5.1, alors même que les comportements qu'elles cherchaient à corriger ont disparu. Fable 5.1
00:06:15se retrouve donc encombré par une liste de correctifs pour des problèmes qu'il ne rencontre plus. Elles ne font
00:06:21que gaspiller votre quota, et certaines génèrent même de nouveaux problèmes. Nous l'avions déjà souligné dans notre
00:06:25vidéo précédente. Vous vous demandez peut-être comment identifier les consignes importantes de celles qui ne le sont plus ?
00:06:30Vous pouvez tester en retirant une instruction de votre fichier Claude.md et en soumettant un travail similaire à Claude.
00:06:36Si le résultat reste identique, cette instruction est superflue. Mais vous n'avez pas à tout faire vous-même :
00:06:41Claude Code dispose d'une commande nommée Claude API Prompt Audit qui repère ces instructions pour vous. Il suffit
00:06:46d'exécuter cette commande dans le terminal pour qu'elle analyse tout ce que vous avez enregistré pour Claude.
00:06:51Elle vous indique ensuite quelles instructions ont été écrites pour d'anciens modèles et suggère des modifications précises.
00:06:56Elle ne modifie rien d'elle-même, ce qui vous permet de consulter la liste au préalable et d'approuver uniquement
00:07:01les changements qui vous conviennent. Avant de passer au conseil suivant, un mot de notre sponsor, Porkbun.
00:07:06Vous venez enfin de lancer votre application, mais elle se retrouve coincée sur une URL par défaut quelconque, alors qu'elle
00:07:12mériterait un véritable nom de domaine personnalisé. C'est là que Porkbun intervient, avec des extensions .app et .dev
00:07:18conçues spécialement pour les projets technologiques. Un domaine .app est idéal pour votre application ou votre page de vente SaaS,
00:07:23tandis que le .dev s'adresse à votre portfolio de code ou à votre documentation, si bien qu'au premier coup d'œil,
00:07:28vos visiteurs savent qu'il s'agit d'un projet sérieux. Et ce ne sont pas seulement de jolis noms : chaque domaine .app et .dev
00:07:33figure sur la liste de préchargement HSTS, ce qui garantit le HTTPS automatique sur toutes les connexions sans configuration,
00:07:39avec un certificat SSL gratuit inclus pour sécuriser votre site immédiatement. Mieux encore,
00:07:45vous pouvez acquérir votre première année pour seulement 5,99 dollars, avec la confidentialité WHOIS offerte et zéro frais cachés.
00:07:52Après la première année, les renouvellements restent au prix coûtant pour assurer la pérennité de votre budget. Obtenez votre domaine
00:07:58pour 5,99 dollars sur [porkbun.com/ailabs26](https://www.google.com/search?q=https%3A%2F%2Fporkbun.com%2Failabs26). Le lien se trouve dans la description ci-dessous.
00:08:03Anthropic présente Fable 5.1 comme idéal pour des tâches longues que l'on peut laisser tourner sans surveillance constante,
00:08:09mais il s'interrompt tout de même pour demander l'autorisation avant d'exécuter une étape déjà couverte par votre demande initiale.
00:08:14Il pose une question et attend, et en l'absence de réponse, attendre revient à s'arrêter. Ce comportement
00:08:19par défaut suppose que vous travaillez à ses côtés. C'est pourquoi le guide de prompt d'Anthropic pour Fable 5.1
00:08:24recommande d'indiquer explicitement dans votre instruction que personne ne surveille, et qu'il doit poursuivre
00:08:29toute action couverte par votre requête dès lors qu'elle peut être annulée. Cela donne au modèle l'autorisation
00:08:34de mener à bien une tâche longue sans s'arrêter pour poser des questions superflues. Fable 5.1 a également
00:08:39 tendance à faire plus de travail que ce que vous lui avez demandé.
00:08:43Par exemple, si vous lui demandez d'ajouter une fonctionnalité, il remarquera peut-être un autre problème à proximité et le corrigera,
00:08:48ou étendra la fonctionnalité au-delà de vos descriptions. Nous l'avons observé sur l'un de nos projets clients,
00:08:53où nous lui avions demandé une fonction et où il a également modifié des fichiers de test que personne ne lui avait demandé de toucher.
00:08:58Le problème, c'est que ces modifications superflues risquent de modifier des aspects de votre produit que vous souhaitiez
00:09:03laisser intacts. Par conséquent, lorsque vous confiez une tâche à Fable 5.1, précisez-lui également ce qu'il doit ne pas toucher,
00:09:08ce qui signifie qu'il ne modifie que le strict nécessaire. Et s'il remarque un autre problème,
00:09:13il le signale à la fin. Et lorsque nous avons fait cela sur notre projet en lui indiquant expressément de ne pas modifier
00:09:18les fichiers de test, il n'a travaillé que sur la fonctionnalité demandée. Fable 5.1 a une autre habitude qui se manifeste
00:09:24chaque fois qu'il modifie des fichiers. Lorsqu'il travaille sur une tâche et ne doit modifier qu'une petite partie d'un fichier,
00:09:29il réécrit tout le fichier à la place, alors même que le reste ne change pas d'un iota.
00:09:33Cela peut sembler anodin puisque vous obtenez le bon résultat, mais chacune de ces
00:09:38lignes coûte des jetons de sortie et, s'il gère de nombreux fichiers, il épuise votre limite beaucoup plus vite.
00:09:43Nous l'avons constaté sur notre propre “second brain”, où chaque petit changement coûtait plus cher que prévu,
00:09:48car il n'arrêtait pas de réécrire des fichiers qu'il aurait pu simplement éditer. Pour remédier à cela,
00:09:52vous devez dire à Fable 5.1 que lorsqu'une modification mineure suffit à obtenir le même résultat,
00:09:56il ne doit modifier que cette partie. Le problème suivant ne concerne pas la quantité de texte produite par Fable 5.1,
00:10:01mais son style d'écriture. Nous l'avions déjà remarqué avec Opus 5, qui abusait de ce qu'Anthropic appelle
00:10:06la “prose maniérée”. Pour ceux qui l'ignorent, la “prose maniérée” désigne l'utilisation par le modèle de tournures
00:10:11et de métaphores alambiquées au lieu d'aller droit au but. Par exemple, au lieu de dire qu'un paramètre gagne
00:10:16à être modifié, le modèle parlera d'un cadran qui mérite d'être tourné. Et dans le cadre d'une recherche approfondie,
00:10:20ce type de langage nuit grandement à la clarté du message que le modèle essaie de faire passer.
00:10:24Certes, Fable 5.1 y a moins recours qu'Opus 5 et Fable 5, et il emploie également moins de tournures toutes faites et de jargon
00:10:31non expliqué. Mais le problème persiste dans son écriture et, comparé à Fable 5,
00:10:36ses phrases s'allongent avec moins de sauts de paragraphe, ce qui le rend encore plus difficile à suivre.
00:10:41Il vous suffit donc de lui demander de supprimer toute prose maniérée, ce qui résout les deux problèmes. C'est ce que nous avons fait
00:10:46lorsque nous l'avons testé sur l'une de nos tâches de recherche, où nous l'utilisions pour rédiger plutôt que pour concevoir.
00:10:51Le dernier point concerne la nature des tâches que vous confiez à Fable 5.1. Tout ce que nous avons vu jusqu'à présent visait à en tirer
00:10:56le meilleur parti, mais le type de mission a tout autant d'importance, car Fable 5.1 donne sa pleine mesure sur les projets d'envergure.
00:11:01Lors de nos tests sur nos projets, Fable 5 s'en sortait mieux sur la tâche la plus simple,
00:11:07mais sur la plus complexe, Fable 5.1 a surpassé son prédécesseur en terminant environ 40 % plus vite pour un coût inférieur de 58 %.
00:11:14C'est donc sur les grands projets que Fable 5.1 s'impose, car c'est là qu'il est crucial de mener à bien l'ensemble de la tâche
00:11:19sans interruption. C'est pourquoi vous ne devriez pas découper une fonctionnalité en une multitude de petites instructions
00:11:23pour avancer étape par étape. Vous devez lui confier toute la fonctionnalité en décrivant clairement le résultat attendu,
00:11:28et vous le verrez achever l'ensemble du projet de manière autonome. Si vous souhaitez accéder à toutes les compétences
00:11:33et aux flux de travail présentés dans nos vidéos, vous pouvez les retrouver sur AI Labs Pro, notre communauté.
00:11:38Alors, si notre travail vous a apporté de la valeur et que vous souhaitez soutenir la chaîne, c'est la meilleure façon de le faire.
00:11:43Le lien se trouve dans la description. Ceci conclut cette vidéo. Si vous souhaitez soutenir la
00:11:48chaîne et nous aider à continuer à produire ce genre de contenu, vous pouvez le faire via le bouton Super Thanks ci-dessous.
00:11:53Comme toujours, merci d'avoir regardé et à bientôt pour une prochaine vidéo.

Key Takeaway

L'utilisation optimale de Fable 5.1 repose sur l'abaissement du niveau d'effort, la suppression des anciennes instructions et la délégation de tâches d'envergure globale plutôt que fragmentées.

Highlights

  • Fable 5.1 réalise 40 % de travail en plus plus rapidement pour un coût inférieur de 58 % sur les tâches complexes.

  • Fable 5.1 consomme des jetons de sortie excédentaires en réécrivant les fichiers entiers au lieu de n'appliquer que des modifications mineures.

  • La réduction du niveau d'effort permet à Fable 5.1 de détecter 61 % des problèmes de code tout en s'exécutant 3 minutes plus vite.

  • Fable 5.1 déclenche des hallucinations dans 72,6 % des cas lorsqu'il ignore une réponse.

  • Fable 5.1 réduit les interruptions de sécurité de Claude Code de 60 % par rapport aux versions précédentes.

Timeline

Performances et coûts de Fable 5.1

  • Fable 5.1 surpasse ses prédécesseurs principalement lorsque la difficulté augmente.
  • La grille tarifaire d'Anthropic réduit le coût de la lecture en cache de 75 %.
  • Fable 5.1 génère environ 1,7 fois plus de texte que Fable 5.
  • Les garde-fous de sécurité basculent vers un modèle plus faible sans avertissement.

Fable 5.1 accomplit davantage de travail pour un coût global inférieur malgré une production textuelle accrue. Les lectures en cache bénéficient d'une baisse tarifaire significative, mais la génération de texte supplémentaire élève la facture finale d'environ 20 %. Par ailleurs, le déclenchement de la sécurité bascule silencieusement la session vers un modèle de moindre qualité.

Règles d'optimisation et niveau d'effort

  • Le mode d'effort faible détecte 61 % des problèmes contre 57,1 % en effort élevé.
  • Les instructions obsolètes des versions précédentes encombrent inutilement le modèle.
  • La commande Claude API Prompt Audit identifie automatiquement les consignes superflues.

L'abaissement du niveau d'effort améliore l'efficacité opérationnelle et accélère l'exécution des tâches de revue de code. Le maintien d'anciennes instructions spécifiques aux versions antérieures gaspille les quotas et perturbe le comportement du modèle. L'utilisation d'outils d'audit automatisés permet de nettoyer ces configurations sans intervention manuelle fastidieuse.

Gestion des tâches et des réécritures

  • Fable 5.1 réécrit les fichiers en entier même pour des modifications mineures.
  • L'indication explicite des limites évite les modifications non sollicitées de code.
  • Fable 5.1 donne sa pleine mesure sur les projets d'envergure globale.

L'optimisation des requêtes exige de préciser explicitement les fichiers à ne pas modifier afin d'éviter la réécriture superflue de documents entiers qui épuise rapidement les limites de jetons. Confirmer des blocs de projets globaux plutôt que des micro-instructions permet à Fable 5.1 de déployer son plein potentiel de manière autonome.

Community Posts

No posts yet. Be the first to write about this video!

Write about this video