Você está usando o Claude Fable 5.1 do jeito errado... Faça isto em vez disso
AAI LABS
Computing/Software
Transcript
00:00:00O Fable 5.1 é o lançamento mais recente da Anthropic e é um dos melhores modelos que você pode usar agora
00:00:05mesmo. Mas ele não se comporta da mesma forma que os modelos anteriores, e há algumas pequenas
00:00:09coisas que você precisa mudar na forma como trabalha com ele. Porque se você o usar do jeito que usava os
00:00:13modelos anteriores, não estará aproveitando todo o seu potencial e poderá até obter piores resultados
00:00:18dele. Por exemplo, a Anthropic diz que este modelo é melhor para tarefas de longa duração, mas ele só faz
00:00:23isso bem se você der instruções de uma maneira específica. E há uma configuração que a Anthropic diz para manter
00:00:28alta, mas que na verdade está piorando os resultados. Se esta é a sua primeira vez aqui, nós somos uma empresa de software
00:00:32e este é o nosso canal AI Labs. E neste vídeo, vamos apresentar 7 dicas para aproveitar
00:00:37ao máximo o Fable 5.1. Mas antes de entrarmos nessas dicas, há algumas coisas que precisamos dizer
00:00:42sobre este novo modelo primeiro. Com o lançamento do Fable 5.1, a Anthropic afirmou que este modelo é muito
00:00:48melhor em concluir tarefas. Mas o Fable 5.1 não está fazendo um trabalho melhor. Ele está realizando mais trabalho
00:00:54por menos dinheiro. Vimos isso nos projetos dos nossos próprios clientes. Demos ao Fable 5 e ao Fable 5.1 as mesmas
00:01:00tarefas e executamos cada uma várias vezes. Não podemos revelar os detalhes dos projetos, mas o Fable 5 fez
00:01:05um trabalho melhor na maioria das tarefas, e o Fable 5.1 só foi melhor em uma delas. Essa foi a
00:01:10tarefa mais difícil de todas, e nela o Fable 5.1 fez um trabalho melhor, terminou cerca de 40% mais rápido e custou bem
00:01:16menos da metade. Portanto, o Fable 5.1 é mais forte quando o trabalho fica mais difícil. E mesmo nas tarefas em que o seu
00:01:22trabalho não foi melhor, ele continuou. O Fable 5 parou antes do fim em algumas das suas tentativas, enquanto o Fable
00:01:275.1 terminou todas elas. Ele também custa menos em cada tarefa. Agora, você talvez já saiba que o Claude
00:01:33Code tem um comando de uso que basicamente estima quanto uma sessão teria custado se você estivesse pagando
00:01:38por uso em vez de uma assinatura. E por essa estimativa, o Fable 5.1 foi cerca de 47% mais barato que
00:01:45o Fable 5. Mas ele não é mais barato porque o modelo de repente usa menos tokens. É porque o preço
00:01:50da Anthropic mudou. Mas antes de chegarmos a essa mudança de preço, você precisa saber de uma coisa. Quanto mais
00:01:55tempo a tarefa dura, mais longa a conversa se torna. E por causa disso, o modelo tem que ler mais
00:02:00antes de responder a um novo comando. Os modelos não se lembram da conversa de uma mensagem para a
00:02:05seguinte. Então, toda vez que um modelo precisa dar outra resposta, toda a conversa precisa
00:02:10ser enviada a ele novamente. Mas em vez de processar a mesma conversa do zero a cada vez,
00:02:16o Claude mantém uma cópia salva das partes que já processou e reutiliza essa cópia da próxima vez que você
00:02:21o orientar. Isso é basicamente chamado de leitura em cache. Essas leituras em cache também custam, mas são mais baixas em
00:02:27preço em comparação com a entrada e saída habituais. E com o Fable 5.1, a Anthropic reduziu o preço disso
00:02:33em 75%. Portanto, a conversa que é enviada novamente antes de cada resposta agora custa muito menos. Essa economia
00:02:39pode parecer pequena em um único comando porque não há muita conversa para enviar novamente. Mas em uma tarefa
00:02:44longa, a mesma conversa em crescimento é enviada repetidamente, então a economia cresce toda vez que o modelo
00:02:50responde. Agora, isso cobre apenas o que o modelo lê. O que o modelo escreve é cobrado separadamente e esse
00:02:55preço não mudou. A Artificial Analysis, que testa modelos e os pontua independentemente, descobriu que
00:03:01o Fable 5.1 escreveu muito mais do que o Fable 5. Então a conta aumentou mesmo com as leituras mais baratas. Nos
00:03:07testes deles, ele gerou cerca de 1,7 vez mais saída do que o Fable 5 e custou cerca de 20% a mais por tarefa.
00:03:14Os modelos Fable da Anthropic têm salvaguardas de segurança, que são regras que os impedem de fazer certos tipos
00:03:19de tarefas. E com o Fable 5.1, a Anthropic diz que essas salvaguardas interrompem as sessões do Claude Code
00:03:25cerca de 60% menos vezes. Mas quando ele esbarra em uma dessas salvaguardas agora, o Claude Code muda para um
00:03:31modelo mais fraco sem avisar e continua. E esse modelo mais fraco lida com o resto da sessão
00:03:36mesmo quando o seu próximo pedido não tem nada a ver com o que o acionou. Então, em vez de uma recusa, você recebe
00:03:41um trabalho mais fraco e acha que foi o Fable 5.1 que produziu. E isso já aconteceu com alguém construindo um jogo
00:03:46que tinha um arquivo de piadas com a palavra biológico nele. O projeto não tinha nada a ver com biologia,
00:03:51mas aquela única palavra foi suficiente para trocar o modelo que lidava com o trabalho. E se o seu projeto for realmente
00:03:55sobre um dos assuntos que essas salvaguardas cobrem, como segurança ou biologia, não há configuração e nem
00:04:00forma de redigir que evite isso. É apenas algo que o Fable 5.1 impõe a você. Agora, nos testes da Artificial Analysis,
00:04:06o Fable 5.1 pontua mais alto que o Fable 5 em precisão, mas ele também alucina mais, que é quando um
00:04:13modelo não sabe a resposta. Então ele inventa uma e a apresenta como verdadeira. Quando o Fable 5.1 não sabia
00:04:18uma resposta, ele alucinou 72,6% das vezes. O Fable 5 fez isso 63,6% das vezes. E um modelo dizer que
00:04:26não sabe é na verdade melhor do que um modelo fingindo saber tudo, porque aí você
00:04:31pode ir e verificar as coisas você mesmo. Mas quando ele inventa algo e você confia nisso porque o modelo disse
00:04:35assim, essa resposta inventada vai direto para o seu trabalho. E isso importa ainda mais quando você o está usando
00:04:40para pesquisa ou escrita, porque verificar isso se torna uma tarefa inteira mais tarde. Mas antes de passarmos
00:04:45para as dicas, seria ótimo se você se inscrevesse no canal e curtisse o vídeo. Esse pequeno
00:04:50gesto de apoio ajuda muito a gente. Agora, depois de ouvir essas coisas, você vai dizer que o
00:04:56modelo mais antigo é claramente melhor em alguns aspectos. Isso é verdade, mas ao mesmo tempo ele vai se tornar
00:05:01o modelo padrão nos aplicativos que você usa. É por isso que você precisa seguir as dicas sobre as quais vamos
00:05:06falar. Caso contrário, você não vai aproveitar todo o potencial dele. Agora, a primeira maneira de usar de fato
00:05:11o Fable 5.1 melhor é diminuir o esforço. Para quem não sabe, o esforço é a configuração que
00:05:16decide quanto trabalho o modelo faz antes de lhe dar uma resposta. E essa única configuração afeta
00:05:21tanto a qualidade do trabalho quanto o custo. A Code Rabbit, que faz uma ferramenta que revisa código,
00:05:26testou o Fable 5.1 em seu trabalho real de revisão e descobriu que ele pegou 61% dos problemas com esforço baixo
00:05:33em comparação com 57,1% no alto, e terminou cerca de 3 minutos mais rápido também. E nós vimos a mesma coisa
00:05:39quando usamos o Fable 5.1 para adicionar um recurso ao nosso site da comunidade. No esforço alto, ele passou muito
00:05:44tempo indo e voltando em uma parte do recurso, enquanto no esforço baixo, ele terminou tudo e
00:05:49nos deu um resultado melhor. Nós recomendamos esforço baixo em nosso vídeo anterior do Fable também, e depois de usar
00:05:54o Fable 5.1, é isso que ainda recomendamos. Portanto, você deve começar com esforço baixo e só aumentá-lo se o
00:06:00resultado lhe der um motivo para isso. Caso contrário, você estará gastando tempo e tokens por muito pouco em troca.
00:06:05A próxima coisa que você precisa fazer é remover as instruções que escreveu para modelos mais antigos. Essas
00:06:10instruções permanecem na sua configuração quando você muda para o Fable 5.1, mesmo que o comportamento que elas estavam
00:06:15corrigindo já não exista. Então o Fable 5.1 ainda tem que seguir uma lista crescente de correções para problemas que ele não tem.
00:06:21Elas estão apenas desperdiçando o seu limite, e algumas delas agora causam novos problemas. Nós mencionamos isso no nosso
00:06:25vídeo anterior também. Agora você pode pensar: como vai saber qual instrução é importante e
00:06:30qual não é? Você pode testar tirando uma instrução do seu Claude.md e dando ao Claude o mesmo
00:06:36tipo de trabalho novamente. Se o resultado for o mesmo sem ela, essa instrução não precisa estar lá. Mas você
00:06:41não precisa fazer tudo sozinho. O Claude Code tem um comando chamado Claude API Prompt Audit que encontra
00:06:46essas instruções para você. Você precisa executar esse comando no terminal, e ele verificará tudo o que você
00:06:51salvou para o Claude. Em seguida, ele mostra quais instruções foram escritas para modelos mais antigos e dá a você as exatas
00:06:56mudanças que ele recomenda. Ele não muda nada sozinho, então você pode revisar a lista primeiro e apenas
00:07:01aprovar as alterações com as quais concorda. Mas antes de passarmos para a próxima dica, vamos ouvir uma palavra do nosso
00:07:06patrocinador, a Porkbun. Então você finalmente lança seu aplicativo, mas ele fica preso em alguma URL padrão aleatória, e o que ele
00:07:12realmente precisa é de um domínio próprio adequado. É aí que entra a Porkbun, com domínios .app e .dev criados
00:07:18especificamente para projetos de tecnologia. Um domínio .app é perfeito para o seu aplicativo ou página de destino de SaaS,
00:07:23e o .dev é feito para o seu portfólio de programação ou sua documentação, para que no segundo em que alguém veja,
00:07:28saiba que é um projeto real. E estes não são apenas nomes bonitos. Cada domínio .app e .dev fica
00:07:33na lista de pré-carregamento HSTS, o que significa que o HTTPS é automático em todas as conexões com zero configuração,
00:07:39e um certificado SSL gratuito está incluído, para que seu site seja seguro logo de cara. A melhor parte,
00:07:45você pode garantir seu primeiro ano por apenas US$ 5,99 com privacidade WHOIS gratuita e sem ofertas extras ou taxas ocultas.
00:07:52E após o primeiro ano, as renovações continuam com preço de custo, mantendo-se baratas a longo prazo. Obtenha seu domínio por US$ 5,99
00:07:58em [porkbun.com/ailabs26](https://www.google.com/search?q=https%3A%2F%2Fporkbun.com%2Failabs26). O link está na descrição abaixo.
00:08:03Agora, a Anthropic vende o Fable 5.1 para tarefas longas que você pode deixar rodando sem precisar vigiar muito, mas ele ainda
00:08:09pausa para pedir permissão antes de fazer uma etapa que já havia sido coberta pelo seu pedido original.
00:08:14Ele apenas faz uma pergunta e espera, e quando não há ninguém lá para responder, esperar é o mesmo que parar.
00:08:19Isso acontece porque seu comportamento habitual assume que você está trabalhando junto com ele. Então o guia
00:08:24de prompts da Anthropic para o Fable 5.1 diz que você precisa avisar no prompt que ninguém está vigiando,
00:08:29e que ele deve continuar com qualquer coisa já coberta pelo seu pedido, desde que possa ser desfeita.
00:08:34Isso dá ao modelo permissão para concluir um trabalho longo sem parar para perguntas desnecessárias.
00:08:39O Fable 5.1 também tem o hábito de fazer mais trabalho do que você pediu.
00:08:43Por exemplo, se você pedir para ele adicionar um recurso, ele poderá notar outro problema por perto e corrigi-lo também,
00:08:48ou estender o recurso além do que você descreveu. Vimos isso em um dos projetos dos nossos clientes,
00:08:53onde pedimos um recurso e ele também editou os arquivos de teste que ninguém havia pedido para ele tocar.
00:08:58O problema é que essas edições extras podem alterar partes do seu produto que você queria que ficassem exatamente
00:09:03como estavam. Portanto, quando você der uma tarefa ao Fable 5.1, também deve dizer a ele o que deixar em paz,
00:09:08o que significa que ele altera apenas o necessário. E se notar outro problema,
00:09:13ele o menciona no final. E quando fizemos isso no nosso projeto e pedimos especificamente para não mexer
00:09:18nos arquivos de teste, ele trabalhou apenas na funcionalidade que pedimos. O Fable 5.1 tem outro hábito que acontece
00:09:24sempre que ele altera arquivos. Quando está trabalhando em uma tarefa e só precisa editar uma pequena parte de um arquivo,
00:09:29ele reescreve o arquivo inteiro, mesmo que o resto não mude absolutamente nada.
00:09:33Isso pode parecer bom para você, já que ainda obtém o resultado certo, mas cada uma dessas
00:09:38linhas consome tokens de saída e, se estiver lidando com muitos arquivos, esgota seu limite muito mais rápido.
00:09:43Vimos isso no nosso próprio segundo cérebro, onde cada pequena alteração custava mais do que deveria,
00:09:48porque ele continuava reescrevendo arquivos que poderia ter apenas editado. Para evitar isso,
00:09:52você precisa dizer ao Fable 5.1 que, quando uma pequena alteração trouxer o mesmo resultado,
00:09:56ele deve editar apenas aquela parte. O próximo problema não é quanto o Fable 5.1 escreve,
00:10:01mas como ele escreve. Já vimos isso com o Opus 5, que usava muito do que a Anthropic chama
00:10:06de “prosa maneirista”. Para quem não sabe, “prosa maneirista” é quando o modelo usa frases
00:10:11e metáforas rebuscadas em vez de dizer o que realmente quer dizer. Por exemplo, em vez de dizer que uma configuração
00:10:16vale a pena ser alterada, o modelo a chama de um botão que vale a pena girar. E em uma tarefa longa de pesquisa,
00:10:20esse tipo de linguagem dificulta até mesmo entender o ponto que o modelo está tentando defender.
00:10:24Agora, o Fable 5.1 usa isso menos do que o Opus 5 e o Fable 5, e também usa menos frases feitas e menos
00:10:31jargões sem explicação. Mas o problema ainda persiste em sua escrita e, comparado ao Fable 5,
00:10:36suas frases são mais longas com menos quebras de parágrafo, o que torna a leitura ainda mais difícil.
00:10:41Portanto, basta dizer a ele para remover toda prosa maneirista, e isso resolve ambos. Foi o que fizemos quando
00:10:46o executamos em uma de nossas tarefas de pesquisa, onde o usávamos para escrever em vez de programar.
00:10:51O último ponto é o tipo de trabalho que você delega ao Fable 5.1. Tudo o que cobrimos até agora é sobre como extrair
00:10:56mais dele, mas o tipo de tarefa importa igualmente, pois o Fable 5.1 brilha de verdade nas tarefas grandes.
00:11:01Quando executamos as tarefas em nossos projetos, o Fable 5 se saiu melhor na tarefa mais simples,
00:11:07mas na mais difícil, o Fable 5.1 teve um desempenho superior, terminando cerca de 40% mais rápido e custando 58% menos.
00:11:14Portanto, os grandes projetos são onde o Fable 5.1 vence, porque é aí que concluir tudo sem
00:11:19parar realmente faz a diferença. É por isso que você não deve dividir uma funcionalidade em vários prompts pequenos e dar
00:11:23um passo de cada vez. Você deve fornecer a funcionalidade inteira e descrever o resultado desejado com clareza,
00:11:28e então verá ele concluir a funcionalidade inteira sozinho. Agora, se você quiser ter acesso a todas as habilidades
00:11:33e fluxos de trabalho que mostramos em nossos vídeos, pode encontrá-los no AI Labs Pro, que é a nossa comunidade.
00:11:38Portanto, se você valoriza o que fazemos e quer apoiar o canal, esta é a melhor maneira de fazer isso.
00:11:43O link está na descrição. E isso nos traz ao final deste vídeo. Se você quiser apoiar o
00:11:48canal e nos ajudar a continuar fazendo vídeos como este, pode fazê-lo usando o botão de valeu demais abaixo.
00:11:53Como sempre, muito obrigado por assistir e vejo você no próximo.
Community Posts
No posts yet. Be the first to write about this video!
Write about this video