7 reglas para usar Claude Fable 5.1 mejor que el 90% de las personas

AAI LABS
Computing/Software

Transcript

00:00:00Fable 5.1 es el lanzamiento más reciente de Anthropic, y es uno de los mejores modelos que puedes usar ahora
00:00:05mismo. Pero no se comporta de la misma manera que los modelos anteriores, y hay algunos pequeños
00:00:09detalles que debes cambiar en tu forma de trabajar con él. Porque si lo usas de la forma en que usabas los
00:00:13modelos anteriores, no le estarás sacando todo el provecho, e incluso podrías obtener peores resultados
00:00:18de él. Por ejemplo, Anthropic dice que este modelo es ideal para tareas de larga duración, pero solo hace
00:00:23eso bien si le das instrucciones de una manera específica. Y hay una configuración que Anthropic recomienda subir,
00:00:28pero que en realidad empeora los resultados. Si es tu primera vez por aquí, somos una empresa de software
00:00:32y este es nuestro canal AI Labs. En este video, vamos a ver 7 consejos para aprovechar al
00:00:37máximo Fable 5.1. Pero antes de pasar a esos consejos, hay algunas cosas que debemos decir
00:00:42sobre este nuevo modelo primero. Con el lanzamiento de Fable 5.1, Anthropic afirmó que este modelo es mucho
00:00:48mejor para terminar tareas. Pero Fable 5.1 no está haciendo un mejor trabajo, sino sacando adelante más trabajo
00:00:54por menos dinero. Lo vimos en nuestros propios proyectos con clientes. Dimos a Fable 5 y Fable 5.1 las mismas
00:01:00tareas y ejecutamos cada una varias veces. No podemos revelar los detalles de los proyectos, pero Fable 5 hizo
00:01:05un mejor trabajo en la mayoría de las tareas, y Fable 5.1 solo fue mejor en una de ellas. Esa fue la
00:01:10tarea más difícil de todas, y en ella Fable 5.1 hizo un mejor trabajo, terminó alrededor de un 40% más rápido y costó
00:01:16menos de la mitad. Así que Fable 5.1 es más fuerte cuando el trabajo se pone difícil. e incluso en las tareas donde su
00:01:22trabajo no fue mejor, siguió adelante. Fable 5 se detenía antes de terminar algunos de sus intentos, mientras que Fable
00:01:275.1 los terminó todos. Además, cuesta menos en cada tarea. Ahora bien, es posible que ya sepas que Claude
00:01:33Code tiene un comando de uso que básicamente calcula lo que te habría costado una sesión si pagaras
00:01:38por uso en lugar de una suscripción. Y según ese cálculo, Fable 5.1 fue aproximadamente un 47% más barato que
00:01:45Fable 5. Pero no es más barato porque el modelo de repente use menos tokens, sino porque el precio
00:01:50de Anthropic cambió. Pero antes de llegar a ese cambio de precio, necesitas saber una cosa. Cuanto más
00:01:55tiempo dura la tarea, más crece la conversación. Y debido a eso, el modelo tiene que leer más
00:02:00antes de responder a una nueva instrucción. Los modelos no recuerdan la conversación de un mensaje al
00:02:05siguiente. Así que cada vez que un modelo necesita darte otra respuesta, hay que enviarle
00:02:10toda la conversación de nuevo. Pero en lugar de procesar la misma conversación desde cero cada vez,
00:02:16Claude guarda una copia de las partes que ya ha procesado y la reutiliza la próxima vez que le
00:02:21das instrucciones. Básicamente, a esto se le llama lectura en caché. Estas lecturas en caché también cuestan, pero su precio
00:02:27es menor en comparación con la entrada y salida habituales. Y con Fable 5.1, Anthropic redujo ese precio
00:02:33en un 75%. Así que la conversación que se vuelve a enviar antes de cada respuesta ahora cuesta mucho menos. Ese ahorro
00:02:39puede parecer pequeño en una sola instrucción porque no hay mucha conversación que reenviar. Pero en una tarea
00:02:44larga, esa misma conversación que va creciendo se envía una y otra vez, por lo que el ahorro aumenta cada vez que el modelo
00:02:50responde. Ahora bien, eso solo cubre lo que lee el modelo. Lo que el modelo escribe se cobra por separado y ese
00:02:55precio no cambió. Artificial Analysis, que prueba modelos y los califica de forma independiente, descubrió que
00:03:01Fable 5.1 escribía mucho más que Fable 5. Así que la factura aumentó a pesar de las lecturas más económicas. En sus
00:03:07pruebas, generó alrededor de 1.7 veces más resultados que Fable 5 y costó cerca de un 20% más por tarea.
00:03:14Los modelos Fable de Anthropic tienen medidas de seguridad, que son reglas que les impiden realizar ciertos tipos
00:03:19de tareas. Y con Fable 5.1, Anthropic afirma que esas medidas interrumpen las sesiones de Claude Code
00:03:25un 60% menos de las veces. Pero cuando llega a activar una de esas medidas, Claude Code cambia a un
00:03:31modelo más débil sin avisarte y continúa. Y ese modelo más débil se encarga del resto de la sesión
00:03:36incluso cuando tu siguiente solicitud no tiene nada que ver con lo que la provocó. Así que en lugar de una negativa, obtienes
00:03:41un trabajo de menor calidad y crees que lo produjo Fable 5.1. Y esto ya le ha sucedido a alguien que creaba un juego
00:03:46que tenía un archivo de broma con la palabra biológico. El proyecto no tenía nada que ver con la biología,
00:03:51pero esa sola palabra fue suficiente para cambiar el modelo que manejaba el trabajo. Y si tu proyecto trata
00:03:55realmente sobre uno de los temas que cubren esas medidas de seguridad, como la seguridad o la biología, no hay configuración ni
00:04:00forma de redactarlo que evite esto. Es simplemente algo que cuesta con Fable 5.1. Ahora bien, en las pruebas de Artificial Analysis,
00:04:06Fable 5.1 obtiene puntuaciones más altas que Fable 5 en precisión, pero también alucina más, que es cuando un
00:04:13modelo no sabe la respuesta, así que se inventa una y la presenta como si fuera cierta. Cuando Fable 5.1 no sabía
00:04:18una respuesta, alucinó el 72.6% de las veces. Fable 5 lo hizo el 63.6% de las veces. Y que un modelo diga
00:04:26que no sabe es en realidad mejor que un modelo que finge saberlo todo, porque entonces
00:04:31puedes ir a comprobar las cosas tú mismo. Pero cuando se inventa algo y confías en ello porque el modelo lo dijo,
00:04:35esa respuesta inventada va directa a tu trabajo. Y eso importa aún más cuando lo usas
00:04:40para investigar o escribir, porque verificar eso se convierte en toda una tarea después. Pero antes de pasar
00:04:45a los consejos, sería genial que te suscribieras al canal y le dieras al botón de me gusta. Este pequeño
00:04:50gesto de apoyo significa mucho para nosotros. Ahora, después de escuchar estas cosas, vas a decir que el
00:04:56modelo antiguo es claramente mejor en algunos aspectos. Eso es verdad, pero al mismo tiempo se va a convertir
00:05:01en el modelo predeterminado en las aplicaciones que usas. Por esto necesitas seguir los consejos de los que vamos a
00:05:06hablar. De lo contrario, no vas a aprovecharlo al máximo. Ahora, la primera forma de usar realmente
00:05:11mejor Fable 5.1 es bajar el nivel de esfuerzo. Para quienes no lo sepan, el esfuerzo es la configuración que
00:05:16determina cuánto trabajo hace el modelo antes de darte una respuesta. Y esa única configuración afecta
00:05:21tanto a la calidad del trabajo como a su costo. Code Rabbit, creadores de una herramienta que revisa código,
00:05:26probaron Fable 5.1 en su trabajo de revisión real y descubrieron que detectaba el 61% de los problemas con un esfuerzo bajo
00:05:33en comparación con el 57.1% con esfuerzo alto, y además terminaba unos 3 minutos más rápido. Y nosotros vimos lo mismo
00:05:39cuando usamos Fable 5.1 para añadir una función a nuestro sitio web comunitario. Con un esfuerzo alto, pasó mucho
00:05:44tiempo yendo y viniendo en una parte de la función, mientras que con un esfuerzo bajo, terminó todo y
00:05:49nos dio un mejor resultado. Recomendamos el esfuerzo bajo en nuestro video anterior de Fable también, y después de usar
00:05:54Fable 5.1, sigue siendo lo que recomendamos. Así que debes empezar con un esfuerzo bajo y solo subirlo si el
00:06:00resultado te da una razón para hacerlo. De lo contrario, estás gastando tiempo y tokens para obtener muy poco a cambio.
00:06:05Lo siguiente que debes hacer es eliminar las instrucciones que escribiste para los modelos anteriores. Esas
00:06:10instrucciones se quedan en tu configuración cuando cambias a Fable 5.1, a pesar de que el comportamiento que
00:06:15estaban corrigiendo ya no existe. Así que Fable 5.1 todavía tiene que seguir una lista cada vez mayor de correcciones para problemas que no tiene.
00:06:21Solo están desperdiciando tu límite, y algunas de ellas ahora provocan nuevos problemas. Mencionamos esto en nuestro
00:06:25video anterior también. Ahora podrías pensar, ¿cómo vas a saber qué instrucción es importante y
00:06:30cuál no? Puedes probarlo quitando una instrucción de tu archivo Claude.md y dándole a Claude el mismo
00:06:36tipo de trabajo de nuevo. Si el resultado es el mismo sin ella, esa instrucción no necesita estar ahí. Pero no
00:06:41tienes que hacerlo todo tú mismo. Claude Code tiene un comando llamado Claude API Prompt Audit que encuentra
00:06:46esas instrucciones por ti. Debes ejecutar ese comando en la terminal, y comprobará todo lo que hayas
00:06:51guardado para Claude. Luego te muestra qué instrucciones fueron escritas para modelos antiguos y te da los cambios
00:06:56exactos que recomienda. No cambia nada por sí solo, por lo que puedes revisar la lista primero y aprobar solo
00:07:01los cambios con los que estés de acuerdo. Pero antes de pasar al siguiente consejo, escuchemos unas palabras de nuestro
00:07:06patrocinador, Porkbun. Así que por fin lanzas tu aplicación, pero se queda atascada en una URL predeterminada cualquiera, y lo que
00:07:12realmente necesita es un dominio propio adecuado. Ahí es donde entra Porkbun, con dominios .app y .dev creados
00:07:18específicamente para proyectos tecnológicos. Un dominio .app es perfecto para tu aplicación o tu página de aterrizaje de SaaS,
00:07:23y .dev está hecho para tu portafolio de programación o tus documentos, para que en cuanto alguien lo vea,
00:07:28sepa que es un proyecto real. Y estos no son solo nombres bonitos. Cada dominio .app y .dev se encuentra
00:07:33en la lista de precarga HSTS, lo que significa que HTTPS es automático en cada conexión sin necesidad de configuración,
00:07:39e incluye un certificado SSL gratuito, por lo que tu sitio es seguro desde el primer momento. Lo mejor de todo,
00:07:45puedes conseguir tu primer año por solo $5.99 con privacidad WHOIS gratuita y sin ventas agresivas ni tarifas ocultas.
00:07:52Y después del primer año, las renovaciones se mantienen al precio de costo, por lo que sigue siendo barato a largo plazo. Consigue tu dominio por $5.99
00:07:58en [porkbun.com/ailabs26](https://www.google.com/search?q=https%3A%2F%2Fporkbun.com%2Failabs26). El enlace está en la descripción de abajo.
00:08:03Ahora bien, Anthropic vende Fable 5.1 para trabajos largos que puedes dejar corriendo sin supervisarlos mucho, pero aun así
00:08:09hace pausas para pedir permiso antes de realizar un paso que ya estaba cubierto por tu solicitud original.
00:08:14Simplemente hace una pregunta y espera, y cuando no hay nadie para responder, esperar es lo mismo que detenerse.
00:08:19Esto ocurre porque su comportamiento habitual asume que estás trabajando junto a él. Así que la guía de
00:08:24instrucciones de Anthropic para Fable 5.1 dice que debes indicarle en la orden que nadie está vigilando,
00:08:29y que debe continuar con cualquier cosa que ya esté cubierta por tu solicitud siempre que se pueda deshacer.
00:08:34Eso le da permiso al modelo para terminar un trabajo largo sin detenerse a hacer preguntas innecesarias.
00:08:39Fable 5.1 también tiene la costumbre de hacer más trabajo del que le pediste.
00:08:43Por ejemplo, si le pides que añada una función, puede notar otro problema cercano y solucionarlo también,
00:08:48o ampliar la función más allá de lo que describiste. Vimos esto en uno de nuestros proyectos con clientes,
00:08:53donde le pedimos una función y también editó los archivos de prueba sin que nadie le hubiera pedido que los tocara.
00:08:58El problema es que esas ediciones adicionales pueden cambiar partes de tu producto que querías dejar exactamente
00:09:03como estaban. Así que cuando le des una tarea a Fable 5.1, también debes decirle qué debe dejar en paz,
00:09:08lo que significa que solo cambia lo necesario para la solicitud. Y si nota otro problema,
00:09:13lo menciona al final. Y cuando hicimos eso en nuestro proyecto y le dijimos específicamente que no editara
00:09:18los archivos de prueba, solo trabajó en la función que pedimos. Fable 5.1 tiene otro hábito y ocurre
00:09:24cada vez que cambia archivos. Cuando trabaja en una tarea y solo necesita editar una pequeña parte de un archivo,
00:09:29reescribe todo el archivo en su lugar, aunque el resto no cambie en absoluto.
00:09:33Esto puede parecerte bien porque sigues obteniendo el resultado correcto, pero cada una de esas
00:09:38líneas consume tokens de salida y, si trabaja con muchos archivos, agota tu límite mucho más rápido.
00:09:43Lo vimos en nuestro propio segundo cerebro, donde cada pequeño cambio costaba más de lo debido,
00:09:48porque seguía reescribiendo archivos que podría haber editado. Para evitarlo,
00:09:52debes decirle a Fable 5.1 que cuando un pequeño cambio dé el mismo resultado,
00:09:56debe editar solo esa parte. El siguiente problema no es cuánto escribe Fable 5.1,
00:10:01sino cómo escribe. Ya lo vimos con Opus 5, que usaba mucho de lo que Anthropic llama
00:10:06“prosa amanerada”. Para quienes no lo sepan, la “prosa amanerada” es cuando el modelo usa frases
00:10:11y metáforas sofisticadas en lugar de decir lo que significa. Por ejemplo, en vez de decir que una configuración
00:10:16vale la pena cambiarla, el modelo la llama un dial que vale la pena girar. Y en una tarea de investigación larga,
00:10:20ese tipo de lenguaje dificulta incluso ver el punto que el modelo intenta transmitir.
00:10:24Ahora bien, Fable 5.1 usa menos esto que Opus 5 y Fable 5, y también usa menos frases hechas y menos
00:10:31jerga sin explicar. Pero el problema sigue presente en su escritura, y en comparación con Fable 5,
00:10:36sus oraciones son más largas con menos saltos de párrafo, lo que hace que sea aún más difícil de seguir.
00:10:41Así que solo tienes que pedirle que elimine toda prosa amanerada, y eso soluciona ambas cosas. Eso hicimos cuando
00:10:46lo ejecutamos en una de nuestras propias tareas de investigación, donde lo usábamos para escribir en vez de construir.
00:10:51Lo último es qué tipo de trabajo le das a Fable 5.1. Todo lo que hemos cubierto hasta ahora trata sobre cómo obtener
00:10:56más provecho de él, pero el tipo de tarea importa tanto como eso, porque Fable 5.1 brilla en las grandes
00:11:01tareas. Cuando ejecutamos las tareas en nuestros proyectos, Fable 5 en realidad hizo un mejor trabajo en la más simple,
00:11:07pero en la más difícil, Fable 5.1 hizo un mejor trabajo, terminó alrededor de un 40% más rápido y costó un 58% menos.
00:11:14Así que los grandes trabajos son donde Fable 5.1 gana, porque ahí es donde terminar todo sin
00:11:19detenerse realmente importa. Por eso no debes dividir una función en muchos pequeños mensajes y darle
00:11:23un paso a la vez. Debes darle la función completa y describir el resultado que deseas claramente,
00:11:28y entonces verás cómo termina toda la función por sí solo. Ahora, si quieres acceso a todas las habilidades
00:11:33y flujos de trabajo que te mostramos en nuestros videos, puedes conseguirlos en AI Labs Pro, que es nuestra comunidad.
00:11:38Así que si encontraste valor en lo que hacemos y quieres apoyar al canal, esta es la mejor forma de hacerlo.
00:11:43El enlace está en la descripción. Esto nos lleva al final de este video. Si te gustaría apoyar el
00:11:48canal y ayudarnos a seguir haciendo videos como este, puedes hacerlo usando el botón de supergracias de abajo.
00:11:53Como siempre, gracias por ver y nos vemos en el próximo.

Key Takeaway

Fable 5.1 supera a las versiones anteriores en tareas difíciles y reduce costos con un 75% menos en lecturas en caché, pero requiere bajar el nivel de esfuerzo y eliminar instrucciones obsoletas para evitar gastos innecesarios de tokens.

Highlights

  • Fable 5.1 completa tareas difíciles un 40% más rápido y cuesta menos de la mitad en comparación con la versión anterior en pruebas complejas.

  • Las lecturas en caché de Fable 5.1 reducen su precio en un 75%, pero el volumen de resultados escritos aumentó un 70%.

  • Bajar el nivel de esfuerzo detecta el 61% de los problemas frente al 57.1% con esfuerzo alto, además de terminar 3 minutos más rápido.

  • El comando Claude API Prompt Audit detecta y elimina instrucciones obsoletas escritas para modelos antiguos que desperdician límites de tokens.

  • Fable 5.1 sobresale en trabajos grandes y complejos, por lo que entregar la función completa genera mejores resultados que dividirla en pasos.

Timeline

Rendimiento y costos de Fable 5.1

  • Fable 5.1 procesa más trabajo por menos dinero en proyectos complejos.
  • Las lecturas en caché cuestan un 75% menos que en versiones anteriores.
  • El volumen de resultados escritos aumenta un 70% y eleva el costo total por tarea en un 20%.

Anthropic lanza Fable 5.1 como un modelo optimizado para tareas de larga duración. Las pruebas demuestran que en las tareas más difíciles completa el trabajo un 40% más rápido y reduce los costos de lectura a la mitad gracias a la reducción en el precio de las lecturas en caché. Sin embargo, el modelo genera más texto de salida, lo que incrementa ligeramente el costo general por tarea a pesar de los ahorros en tokens repetidos. Además, las medidas de seguridad del sistema pueden cambiar el modelo a una versión más débil de forma automática sin previo aviso si detectan ciertas palabras en los archivos.

Estrategias para optimizar el uso de Fable 5.1

  • Configurar el nivel de esfuerzo en bajo mejora la precisión y reduce el tiempo de ejecución.
  • Eliminar instrucciones antiguas de los archivos de configuración libera límites de tokens.
  • Asignar tareas completas en lugar de pasos pequeños maximiza la efectividad del modelo.

Para aprovechar al máximo Fable 5.1, es necesario cambiar ciertos hábitos heredados de modelos anteriores. Bajar la configuración de esfuerzo evita que el modelo divague y acelera la resolución de problemas en las revisiones de código. Asimismo, ejecutar auditorías de instrucciones elimina comandos obsoletos que consumen tokens innecesariamente. Al asignar proyectos, se debe indicar explícitamente al modelo que nadie supervisa el proceso, limitar las modificaciones a los archivos estrictamente necesarios y evitar dividir las funciones en fragmentos pequeños para permitir que el modelo resuelva la tarea global de forma autónoma.

Community Posts

No posts yet. Be the first to write about this video!

Write about this video