스크립트
00:00:00Fable 5.1 est la toute dernière version d'Anthropic, et c'est l'un des meilleurs modèles que vous puissiez utiliser
00:00:05en ce moment. Mais il ne se comporte pas de la même manière que les modèles précédents, et il y a quelques petits
00:00:09détails à changer dans votre façon de travailler avec lui. Car si vous l'utilisez comme vous utilisiez
00:00:13les versions précédentes, vous n'en tirerez pas tout le potentiel, et vous obtiendrez peut-être même de moins bons
00:00:18résultats. Par exemple, Anthropic affirme que ce modèle est idéal pour les tâches de longue durée, mais il n'excelle
00:00:23vraiment que si vous le sollicitez d'une certaine façon. Et il y a un paramètre qu'Anthropic conseille de laisser
00:00:28au maximum, mais qui dégrade en réalité les résultats. Si vous nous découvrez, nous sommes une entreprise
00:00:32logicielle, et ceci est notre chaîne AI Labs. Dans cette vidéo, nous allons aborder 7 conseils pour tirer
00:00:37le meilleur parti de Fable 5.1. Mais avant d'entrer dans le vif du sujet, nous devons dire
00:00:42quelques mots sur ce nouveau modèle. Lors de sa sortie, Anthropic a affirmé qu'il était bien
00:00:48plus performant pour mener à bien les tâches. Mais Fable 5.1 ne fait pas un travail de meilleure qualité ; il accomplit
00:00:54davantage de travail pour un coût moindre. Nous l'avons constaté sur les projets de nos propres clients. Nous avons confié
00:01:00les mêmes tâches à Fable 5 et Fable 5.1 en effectuant plusieurs essais pour chaque modèle. Sans pouvoir
00:01:05révéler les détails des projets, Fable 5 a fourni un meilleur travail sur la plupart des tâches, et Fable 5.1 n'a
00:01:10été supérieur que sur une seule d'entre elles. C'était la plus difficile du lot : Fable 5.1 y a excellé,
00:01:16terminant environ 40 % plus rapidement pour un coût inférieur à la moitié. Fable 5.1 montre donc sa force
00:01:22quand la difficulté augmente. Et même lorsque son travail n'était pas supérieur, il allait jusqu'au bout. Fable 5
00:01:27s'interrompait avant la fin de certains essais, tandis que Fable 5.1 les a tous menés à terme. De plus, il coûte moins cher
00:01:33sur toutes les tâches. Vous savez peut-être déjà que Claude Code dispose d'une commande d'utilisation qui estime
00:01:38grosso modo ce qu'une session vous aurait coûté en payant à l'acte plutôt qu'avec un abonnement. Selon cette estimation,
00:01:45Fable 5.1 était environ 47 % moins cher que Fable 5. Mais ce n'est pas parce que le modèle consomme soudainement
00:01:50moins de jetons, c'est parce que la grille tarifaire d'Anthropic a changé. Avant d'aborder cette baisse de prix,
00:01:55plus la tâche dure longtemps, plus la conversation s'allonge. Et pour cette raison, le modèle doit lire davantage
00:02:00avant de répondre à une nouvelle invite. Les modèles ne se souviennent pas de la conversation d'un message à l'autre.
00:02:05souviennent pas d'un message à l'autre de manière spontanée. Ainsi, chaque fois que le modèle doit formuler une nouvelle
00:02:10réponse, l'intégralité de la conversation doit lui être renvoyée. Mais au lieu de retraiter la même conversation
00:02:16de zéro à chaque fois, Claude conserve une copie enregistrée des parties déjà traitées et réutilise cette copie
00:02:21lors de votre prochaine sollicitation. C'est ce qu'on appelle une lecture en cache. Ces lectures en cache ont également
00:02:27un coût, mais leur prix est réduit par rapport aux entrées et sorties classiques. Avec Fable 5.1, Anthropic a réduit
00:02:33ce tarif de 75 %. Par conséquent, la conversation renvoyée avant chaque réponse coûte désormais beaucoup moins cher. Cette
00:02:39économie peut sembler minime sur une seule instruction car il y a peu de texte à renvoyer, mais sur une tâche longue,
00:02:44cette même conversation qui ne cesse de grandir est transmise sans cesse, de sorte que l'économie s'accroît à chaque
00:02:50réponse du modèle. Cela ne concerne toutefois que ce que lit le modèle. Ce qu'il écrit est facturé séparément,
00:02:55et ce prix n'a pas bougé. Artificial Analysis, qui teste les modèles et les évalue de manière indépendante,
00:03:01a constaté que Fable 5.1 écrivait beaucoup plus que Fable 5. La facture a donc augmenté malgré des lectures moins
00:03:07chères. Lors de leurs tests, il a généré environ 1,7 fois plus de texte qu'Fable 5 pour un coût supérieur d'environ 20 % par tâche.
00:03:14Les modèles Fable d'Anthropic intègrent des garde-fous de sécurité, c'est-à-dire des règles qui les empêchent d'exécuter
00:03:19certains types de tâches. Avec Fable 5.1, Anthropic affirme que ces garde-fous interrompent les sessions de Claude Code
00:03:25environ 60 % moins souvent. Mais lorsqu'il déclenche l'un de ces garde-fous, Claude Code bascule vers un modèle plus faible
00:03:31sans vous prévenir et poursuit son travail. Ce modèle moins puissant gère le reste de la session, même si votre requête
00:03:36suivante n'a aucun rapport avec ce qui a provoqué ce changement. Ainsi, au lieu d'un refus net, vous obtenez un travail
00:03:41de moindre qualité tout en pensant qu'il provient de Fable 5.1. C'est déjà arrivé à quelqu'un qui concevait un jeu
00:03:46comportant un fichier de blagues contenant le mot biologique. Le projet n'avait aucun lien avec la biologie,
00:03:51mais ce seul mot a suffi pour changer le modèle en charge du travail. Et si votre projet traite réellement
00:03:55de l'un des sujets couverts par ces garde-fous, comme la sécurité ou la biologie, aucun paramètre ni aucune formulation
00:04:00ne permet d'éviter cela. C'est simplement une contrainte inhérente à Fable 5.1. D'après les tests d'Artificial Analysis,
00:04:06Fable 5.1 obtient de meilleurs scores que Fable 5 en matière de précision, mais il hallucine aussi davantage, c'est-à-dire
00:04:13qu'ignorant la réponse, il en invente une et la présente comme véridique. Lorsque Fable 5.1 ignorait
00:04:18une réponse, il a halluciné dans 72,6 % des cas, contre 63,6 % pour Fable 5. Qu'un modèle admette qu'il ne sait pas
00:04:26vaut pourtant mieux qu'un modèle qui prétend tout savoir, car cela vous permet d'aller vérifier les choses par
00:04:31vous-même. Mais s'il invente quelque chose et que vous lui faites confiance parce qu'il l'affirme d'un ton assuré,
00:04:35cette fausse information s'glisse directement dans votre travail. C'est d'autant plus problématique pour la recherche
00:04:40pour de la recherche ou de la rédaction, car tout vérifier devient ensuite une tâche ardue. Mais avant de passer
00:04:45aux conseils, ce serait formidable de vous abonner à la chaîne et de cliquer sur le bouton j'aime. Ce petit
00:04:50signifie beaucoup pour nous. Après avoir entendu tout cela, vous vous direz sans doute que l'ancien modèle reste
00:04:56clairement supérieur sur certains points. C'est vrai, mais il va également devenir le modèle par défaut dans
00:05:01les applications que vous utilisez. C'est pourquoi vous devez suivre les conseils que nous allons vous présenter,
00:05:06sous peine de passer à côté de son véritable potentiel. Le premier moyen d'exploiter réellement mieux
00:05:11Fable 5.1 consiste à réduire le niveau d'effort. Pour ceux qui l'ignorent, l'effort est le paramètre qui détermine
00:05:16le volume de travail fourni par le modèle avant de vous répondre, ce qui influence à la fois la qualité
00:05:21du travail et son coût. Code Rabbit, créateur d'un outil de révision de code, a testé Fable 5.1 sur ses propres
00:05:26revues et a découvert qu'il détectait 61 % des problèmes avec un effort faible, contre 57,1 % avec un effort élevé,
00:05:33tout en terminant environ 3 minutes plus vite. Nous avons fait le même constat en utilisant Fable 5.1 pour ajouter
00:05:39une fonctionnalité à notre site communautaire : en mode d'effort élevé, il s'est attardé longuement sur une partie
00:05:44spécifique, tandis qu'en mode faible, il a bouclé l'ensemble en nous offrant un meilleur résultat. Nous avions déjà
00:05:49recommandé l'effort faible dans notre précédente vidéo sur Fable, et après l'avoir testé sur Fable 5.1, c'est toujours
00:05:54notre recommandation. Commencez donc par un effort faible et n'augmentez ce niveau que si le résultat le justifie,
00:06:00sinon vous gaspillerez du temps et des jetons pour un bénéfice minime. La deuxième étape consiste à supprimer
00:06:05les instructions rédigées pour les anciens modèles. Celles-ci persistent dans votre configuration lorsque vous
00:06:10passez à Fable 5.1, alors même que les comportements qu'elles cherchaient à corriger ont disparu. Fable 5.1
00:06:15se retrouve donc encombré par une liste de correctifs pour des problèmes qu'il ne rencontre plus. Elles ne font
00:06:21que gaspiller votre quota, et certaines génèrent même de nouveaux problèmes. Nous l'avions déjà souligné dans notre
00:06:25vidéo précédente. Vous vous demandez peut-être comment identifier les consignes importantes de celles qui ne le sont plus ?
00:06:30Vous pouvez tester en retirant une instruction de votre fichier Claude.md et en soumettant un travail similaire à Claude.
00:06:36Si le résultat reste identique, cette instruction est superflue. Mais vous n'avez pas à tout faire vous-même :
00:06:41Claude Code dispose d'une commande nommée Claude API Prompt Audit qui repère ces instructions pour vous. Il suffit
00:06:46d'exécuter cette commande dans le terminal pour qu'elle analyse tout ce que vous avez enregistré pour Claude.
00:06:51Elle vous indique ensuite quelles instructions ont été écrites pour d'anciens modèles et suggère des modifications précises.
00:06:56Elle ne modifie rien d'elle-même, ce qui vous permet de consulter la liste au préalable et d'approuver uniquement
00:07:01les changements qui vous conviennent. Avant de passer au conseil suivant, un mot de notre sponsor, Porkbun.
00:07:06Vous venez enfin de lancer votre application, mais elle se retrouve coincée sur une URL par défaut quelconque, alors qu'elle
00:07:12mériterait un véritable nom de domaine personnalisé. C'est là que Porkbun intervient, avec des extensions .app et .dev
00:07:18conçues spécialement pour les projets technologiques. Un domaine .app est idéal pour votre application ou votre page de vente SaaS,
00:07:23tandis que le .dev s'adresse à votre portfolio de code ou à votre documentation, si bien qu'au premier coup d'œil,
00:07:28vos visiteurs savent qu'il s'agit d'un projet sérieux. Et ce ne sont pas seulement de jolis noms : chaque domaine .app et .dev
00:07:33figure sur la liste de préchargement HSTS, ce qui garantit le HTTPS automatique sur toutes les connexions sans configuration,
00:07:39avec un certificat SSL gratuit inclus pour sécuriser votre site immédiatement. Mieux encore,
00:07:45vous pouvez acquérir votre première année pour seulement 5,99 dollars, avec la confidentialité WHOIS offerte et zéro frais cachés.
00:07:52Après la première année, les renouvellements restent au prix coûtant pour assurer la pérennité de votre budget. Obtenez votre domaine
00:07:58pour 5,99 dollars sur [porkbun.com/ailabs26](https://www.google.com/search?q=https%3A%2F%2Fporkbun.com%2Failabs26). Le lien se trouve dans la description ci-dessous.
00:08:03Anthropic présente Fable 5.1 comme idéal pour des tâches longues que l'on peut laisser tourner sans surveillance constante,
00:08:09mais il s'interrompt tout de même pour demander l'autorisation avant d'exécuter une étape déjà couverte par votre demande initiale.
00:08:14Il pose une question et attend, et en l'absence de réponse, attendre revient à s'arrêter. Ce comportement
00:08:19par défaut suppose que vous travaillez à ses côtés. C'est pourquoi le guide de prompt d'Anthropic pour Fable 5.1
00:08:24recommande d'indiquer explicitement dans votre instruction que personne ne surveille, et qu'il doit poursuivre
00:08:29toute action couverte par votre requête dès lors qu'elle peut être annulée. Cela donne au modèle l'autorisation
00:08:34de mener à bien une tâche longue sans s'arrêter pour poser des questions superflues. Fable 5.1 a également
00:08:39 tendance à faire plus de travail que ce que vous lui avez demandé.
00:08:43Par exemple, si vous lui demandez d'ajouter une fonctionnalité, il remarquera peut-être un autre problème à proximité et le corrigera,
00:08:48ou étendra la fonctionnalité au-delà de vos descriptions. Nous l'avons observé sur l'un de nos projets clients,
00:08:53où nous lui avions demandé une fonction et où il a également modifié des fichiers de test que personne ne lui avait demandé de toucher.
00:08:58Le problème, c'est que ces modifications superflues risquent de modifier des aspects de votre produit que vous souhaitiez
00:09:03laisser intacts. Par conséquent, lorsque vous confiez une tâche à Fable 5.1, précisez-lui également ce qu'il doit ne pas toucher,
00:09:08ce qui signifie qu'il ne modifie que le strict nécessaire. Et s'il remarque un autre problème,
00:09:13il le signale à la fin. Et lorsque nous avons fait cela sur notre projet en lui indiquant expressément de ne pas modifier
00:09:18les fichiers de test, il n'a travaillé que sur la fonctionnalité demandée. Fable 5.1 a une autre habitude qui se manifeste
00:09:24chaque fois qu'il modifie des fichiers. Lorsqu'il travaille sur une tâche et ne doit modifier qu'une petite partie d'un fichier,
00:09:29il réécrit tout le fichier à la place, alors même que le reste ne change pas d'un iota.
00:09:33Cela peut sembler anodin puisque vous obtenez le bon résultat, mais chacune de ces
00:09:38lignes coûte des jetons de sortie et, s'il gère de nombreux fichiers, il épuise votre limite beaucoup plus vite.
00:09:43Nous l'avons constaté sur notre propre “second brain”, où chaque petit changement coûtait plus cher que prévu,
00:09:48car il n'arrêtait pas de réécrire des fichiers qu'il aurait pu simplement éditer. Pour remédier à cela,
00:09:52vous devez dire à Fable 5.1 que lorsqu'une modification mineure suffit à obtenir le même résultat,
00:09:56il ne doit modifier que cette partie. Le problème suivant ne concerne pas la quantité de texte produite par Fable 5.1,
00:10:01mais son style d'écriture. Nous l'avions déjà remarqué avec Opus 5, qui abusait de ce qu'Anthropic appelle
00:10:06la “prose maniérée”. Pour ceux qui l'ignorent, la “prose maniérée” désigne l'utilisation par le modèle de tournures
00:10:11et de métaphores alambiquées au lieu d'aller droit au but. Par exemple, au lieu de dire qu'un paramètre gagne
00:10:16à être modifié, le modèle parlera d'un cadran qui mérite d'être tourné. Et dans le cadre d'une recherche approfondie,
00:10:20ce type de langage nuit grandement à la clarté du message que le modèle essaie de faire passer.
00:10:24Certes, Fable 5.1 y a moins recours qu'Opus 5 et Fable 5, et il emploie également moins de tournures toutes faites et de jargon
00:10:31non expliqué. Mais le problème persiste dans son écriture et, comparé à Fable 5,
00:10:36ses phrases s'allongent avec moins de sauts de paragraphe, ce qui le rend encore plus difficile à suivre.
00:10:41Il vous suffit donc de lui demander de supprimer toute prose maniérée, ce qui résout les deux problèmes. C'est ce que nous avons fait
00:10:46lorsque nous l'avons testé sur l'une de nos tâches de recherche, où nous l'utilisions pour rédiger plutôt que pour concevoir.
00:10:51Le dernier point concerne la nature des tâches que vous confiez à Fable 5.1. Tout ce que nous avons vu jusqu'à présent visait à en tirer
00:10:56le meilleur parti, mais le type de mission a tout autant d'importance, car Fable 5.1 donne sa pleine mesure sur les projets d'envergure.
00:11:01Lors de nos tests sur nos projets, Fable 5 s'en sortait mieux sur la tâche la plus simple,
00:11:07mais sur la plus complexe, Fable 5.1 a surpassé son prédécesseur en terminant environ 40 % plus vite pour un coût inférieur de 58 %.
00:11:14C'est donc sur les grands projets que Fable 5.1 s'impose, car c'est là qu'il est crucial de mener à bien l'ensemble de la tâche
00:11:19sans interruption. C'est pourquoi vous ne devriez pas découper une fonctionnalité en une multitude de petites instructions
00:11:23pour avancer étape par étape. Vous devez lui confier toute la fonctionnalité en décrivant clairement le résultat attendu,
00:11:28et vous le verrez achever l'ensemble du projet de manière autonome. Si vous souhaitez accéder à toutes les compétences
00:11:33et aux flux de travail présentés dans nos vidéos, vous pouvez les retrouver sur AI Labs Pro, notre communauté.
00:11:38Alors, si notre travail vous a apporté de la valeur et que vous souhaitez soutenir la chaîne, c'est la meilleure façon de le faire.
00:11:43Le lien se trouve dans la description. Ceci conclut cette vidéo. Si vous souhaitez soutenir la
00:11:48chaîne et nous aider à continuer à produire ce genre de contenu, vous pouvez le faire via le bouton Super Thanks ci-dessous.
00:11:53Comme toujours, merci d'avoir regardé et à bientôt pour une prochaine vidéo.
커뮤니티 글
아직 글이 없습니다. 이 영상에 대한 첫 번째 글을 작성해 보세요!
이 영상에 대해 글쓰기