Claude Fable 5.1을 상위 10%처럼 사용하는 7가지 규칙

AAI LABS
컴퓨터/소프트웨어

스크립트

00:00:00Fable 5.1은 앤트로픽이 선보인 최신 모델로, 현재 사용할 수 있는 최고의 모델 중 하나입니다.
00:00:05하지만 이전 모델들과는 다르게 작동하므로 작업 방식을 약간 수정해야 할 부분이 있습니다.
00:00:09기존 모델들을 사용하던 방식 그대로 쓴다면 잠재력을 온전히 끌어내지 못할 뿐더러
00:00:13오히려 더 못한 결과를 얻을 수도 있기 때문입니다.
00:00:18예를 들어, 앤트로픽은 이 모델이 장기 작업에 가장 적합하다고 하지만, 특정 방식으로 프롬프트를
00:00:23입력해야만 그 성능을 제대로 발휘합니다. 또한 앤트로픽 측에서 높게 유지하라고 권장하는 설정 중
00:00:28오히려 결과의 질을 떨어뜨리는 설정도 하나 있습니다. 저희는 소프트웨어 개발 회사인 AI Labs입니다.
00:00:32이번 영상에서는 Fable 5.1을 100% 활용하는 7가지 팁을 살펴보겠습니다.
00:00:37본격적인 팁으로 넘어가기 전에, 이 새로운 모델에 대해 먼저 짚고 넘어가야 할 점들이 있습니다.
00:00:42Fable 5.1이 출시되면서 앤트로픽은 이 모델이 작업을 완료하는 능력이 훨씬 뛰어날 것이라고 주장했습니다.
00:00:48하지만 Fable 5.1이 더 뛰어난 결과물을 만든다기보다는, 더 적은 비용으로 더 많은 작업을
00:00:54적은 비용으로 더 많은 작업을 처리합니다. 저희 자체 클라이언트 프로젝트에서도 이를 확인했습니다.
00:01:00Fable 5와 Fable 5.1에 동일한 작업을 맡기고 각각 여러 번 테스트해 보았습니다.
00:01:05프로젝트의 세부 사항은 밝힐 수 없지만, 대부분의 작업에서는 Fable 5가 더 나은 결과물을 냈고
00:01:10Fable 5.1이 우세했던 것은 단 하나뿐이었습니다. 그것은 가장 난이도가 높은 작업이었는데,
00:01:16여기서 Fable 5.1은 더 우수한 결과물을 내면서도 속도는 약 40% 빨랐고 비용은 절반 이하로 들었습니다.
00:01:22즉, 작업이 어려워질수록 Fable 5.1의 진가가 발휘됩니다. 그리고 결과물의 퀄리티 차이가 크지 않던
00:01:27작업에서도 차이가 있었습니다. Fable 5는 중간에 멈춘 반면 Fable 5.1은 끝까지 완수해 냈습니다.
00:01:33Claude Code에는 세션 비용을 구독제가 아닌 종량제로 환산해 보여주는 usage 명령어가 있습니다.
00:01:38이 추정치에 따르면 Fable 5.1은 Fable 5보다 약 47% 저렴했습니다.
00:01:45하지만 모델 자체가 토큰을 적게 써서 저렴해진 것이 아니라, 앤트로픽의 가격 정책이 바뀌었기 때문입니다.
00:01:50이 가격 변동을 살펴보기 전에 반드시 알아야 할 한 가지가 있습니다. 작업이 길어질수록
00:01:55대화 내역도 길어집니다. 이 때문에 모델은 새로운 프롬프트에 답변하기 전에
00:02:00더 많은 내용을 읽어야 합니다. AI 모델은 메시지와 메시지 사이의 대화를 스스로 기억하지 못합니다.
00:02:05따라서 모델이 응답을 내놓아야 할 때마다 전체 대화 내역이 다시 전송되어야 합니다.
00:02:10하지만 매번 똑같은 대화를 처음부터 다시 처리하는 대신, Claude는 이미 처리한 부분의
00:02:16저장된 사본을 보관해 두었다가 다음 프롬프트 때 그 사본을 재사용합니다.
00:02:21이를 흔히 캐시된 읽기(cached read)라고 부릅니다. 이 캐시된 읽기에도 비용이 발생하지만,
00:02:27일반적인 입력 및 출력에 비해서는 가격이 훨씬 저렴합니다. Fable 5.1에 와서 앤트로픽은 이 비용을 75%나 낮췄습니다.
00:02:33따라서 응답 전마다 다시 전송되는 대화 비용이 대폭 줄어들었습니다. 단건 프롬프트에서는
00:02:39보낼 대화가 별로 없어 이 절감 효과가 미미해 보일 수 있습니다. 하지만 긴 작업에서는
00:02:44계속 늘어나는 대화가 반복해서 전송되므로, 모델이 응답할 때마다 절감액이 불어납니다.
00:02:50하지만 이는 모델이 읽는 부분에만 해당됩니다. 모델이 작성하는 출력은 별도로 가격이 책정되며,
00:02:55그 가격은 변하지 않았습니다. 모델을 독립적으로 테스트하고 평가하는 Artificial Analysis에 따르면,
00:03:01Fable 5.1은 Fable 5보다 훨씬 더 많은 양을 작성했습니다. 읽기 비용이 저렴해졌음에도
00:03:07청구 금액이 늘어난 이유입니다. 테스트 결과 Fable 5보다 약 1.7배 더 많은 출력을 생성했고 작업당 비용은 약 20% 더 들었습니다.
00:03:14앤트로픽의 Fable 모델에는 특정 유형의 작업을 수행하지 못하도록 막는 안전 가이드라인이 있습니다.
00:03:19앤트로픽에 따르면 Fable 5.1에서는 이러한 가이드라인으로 인해 Claude Code 세션이
00:03:25중단되는 빈도가 약 60% 줄어들었다고 합니다. 하지만 막상 가이드라인에 걸리게 될 경우,
00:03:31Claude Code는 사용자에게 알리지도 않은 채 더 약한 모델로 전환하여 작업을 이어갑니다.
00:03:36게다가 다음 요청이 전환을 유발한 원인과 전혀 상관없는 내용일지라도 남은 세션은 계속 그 약한 모델이 처리합니다.
00:03:41즉, 거절 메시지를 받는 대신 성능이 떨어진 결과물을 받아보게 되고, 사용자는 이를 Fable 5.1이 낸 결과로 착각하게 됩니다.
00:03:46실제로 생물학 관련 단어가 포함된 농담 파일이 있는 게임을 만들던 개발자에게 이런 일이 있었습니다.
00:03:51프로젝트는 생물학과 전혀 무관했지만, 그 단어 하나 때문에 작업을 처리하던 모델이 바뀌어 버렸습니다.
00:03:55만약 프로젝트 자체가 보안이나 생물학처럼 가이드라인이 다루는 주제라면, 어떤 설정이나
00:04:00어떤 문구를 쓰더라도 이를 피할 방법이 없습니다. Fable 5.1을 쓰면서 감수해야 할 부분인 셈입니다.
00:04:06Artificial Analysis의 테스트에서 Fable 5.1은 정확도 면에서 Fable 5보다 높은 점수를 받았지만,
00:04:13환각 현상도 더 심해졌습니다. 환각이란 모델이 답을 모를 때 엉뚱한 답을 지어내어 사실인 것처럼 말하는 현상을 말합니다.
00:04:18Fable 5.1은 정답을 모를 때 72.6%의 확률로 환각을 일으켰습니다. Fable 5는 그 확률이 63.6%였습니다.
00:04:26모른다고 솔직하게 말하는 모델이 다 아는 척 거짓말을 하는 모델보다 훨씬 낫습니다. 모른다고 해야
00:04:31사용자가 직접 사실관계를 확인할 수 있으니까요. 하지만 모델이 그럴듯하게 지어낸 거짓말을
00:04:35모델의 말을 믿고 그대로 받아들이면, 그 지어낸 답변이 작업물에 고스란히 반영되어 버립니다.
00:04:40연구나 글쓰기에 이 모델을 사용할 때는 내용을 검증하는 것 자체가 또 하나의 큰 일거리가 되므로 이는 더욱 중요합니다.
00:04:45본격적인 팁으로 넘어가기 전에, 채널 구독과 좋아요 버튼을 눌러주시면 정말 큰 힘이 됩니다.
00:04:50이러한 작은 지원이 저희에게는 큰 격려가 됩니다. 자, 이런 특징들을 들으면 구형 모델이
00:04:56certain 면에서는 확실히 더 낫다는 생각이 드실 겁니다. 그 말도 맞지만, 동시에 이 모델이
00:05:01여러분이 사용하는 앱들의 기본 모델로 자리 잡게 될 것입니다. 그렇기 때문에 지금부터 말씀드릴 팁들을
00:05:06꼭 따라 하셔야 합니다. 그렇지 않으면 모델의 잠재력을 제대로 활용하지 못하게 됩니다.
00:05:11Fable 5.1을 실제로 더 잘 쓰는 첫 번째 방법은 'effort(노력도)' 설정을 낮추는 것입니다.
00:05:16잘 모르시는 분들을 위해 설명하자면, effort는 모델이 답변을 내놓기 전에 얼마나 깊게 고민하고
00:05:21작업할지를 결정하는 설정입니다. 이 단 하나의 설정이 작업의 품질과 비용 모두에 영향을 미칩니다.
00:05:26코드 리뷰 도구를 만드는 Code Rabbit이 실제 코드 리뷰 업무에 Fable 5.1을 테스트해 본 결과,
00:05:33low effort일 때 61%의 문제를 잡아내어 high effort(57.1%)보다 우수했으며 완료 시간도 약 3분 더 빨랐습니다.
00:05:39저희가 커뮤니티 웹사이트에 새로운 기능을 추가하기 위해 Fable 5.1을 사용했을 때도 똑같은 현상을 겪었습니다.
00:05:44high effort에서는 기능의 한 부분을 두고 한참을 헤맸지만, low effort에서는 전체 작업을
00:05:49깔끔하게 끝마치고 더 나은 결과물을 주었습니다. 이전 Fable 영상에서도 low effort를 추천해 드렸는데,
00:05:54Fable 5.1을 써본 지금도 여전히 low effort를 추천합니다. 따라서 평소에는 low effort로 시작하고,
00:06:00결과물이 부족한 이유가 명확할 때만 높이시길 바랍니다. 그렇지 않으면 토큰과 시간만 낭비하게 됩니다.
00:06:05다음으로 해야 할 일은 이전 모델들을 위해 작성해 두었던 지시사항들을 제거하는 것입니다.
00:06:10Fable 5.1로 전환해도 그 지시사항들은 세팅에 그대로 남아 있게 되는데, 막상 그 지시사항이
00:06:15해결하려던 문제들은 이미 사라진 뒤입니다. 결과적으로 Fable 5.1은 이제 존재하지도 않는
00:06:21문제들을 해결하기 위한 방대한 잔소리 같은 지시들을 계속 읽어야 합니다. 토큰 한도만 낭비될 뿐더러
00:06:25그중 일부는 오히려 새로운 문제를 유발하기도 합니다. 이 역시 지난 영상에서 언급한 적이 있습니다.
00:06:30그렇다면 어떤 지시사항이 중요하고 어떤 것이 불필요한지 어떻게 알 수 있을까요? Claude.md에서
00:06:36특정 지시를 지우고 Claude에게 비슷한 작업을 다시 시켜보면 테스트해 볼 수 있습니다. 없어도
00:06:41결과가 같다면 그 지시는 더 이상 필요 없는 것입니다. 하지만 모든 걸 직접 할 필요는 없습니다. Claude Code에는
00:06:46Claude API Prompt Audit이라는 명령어가 있어 이러한 지시사항들을 알아서 찾아줍니다.
00:06:51터미널에서 이 명령어를 실행하면 Claude를 위해 저장해 둔 모든 설정을 검사한 뒤,
00:06:56구형 모델용으로 작성된 지시가 무엇인지 보여주고 정확한 수정 권장안을 제시해 줍니다.
00:07:01자동으로 변경되는 것은 아니므로 목록을 먼저 검토한 후 동의하는 내용만 승인하면 됩니다.
00:07:06다음 팁으로 넘어가기 전에, 스폰서인 Porkbun의 메시지를 들어보겠습니다. 드디어 앱을 배포했는데
00:07:12이상한 기본 URL에 묶여 있다면, 진짜 필요한 것은 제대로 된 고유 도메인일 것입니다.
00:07:18이럴 때 기술 프로젝트에 특화된 .app 및 .dev 도메인을 제공하는 Porkbun이 제격입니다.
00:07:23.app 도메인은 앱이나 SaaS 랜딩 페이지에 안성맞춤이며, .dev는 코딩 포트폴리오나
00:07:28문서 페이지용으로 만들어져 누구나 보는 순간 진짜 개발 프로젝트임을 알 수 있습니다.
00:07:33게다가 모든 .app 및 .dev 도메인은 HSTS 프리로드 리스트에 등록되어 있어 별도 설정 없이도
00:07:39모든 연결에서 HTTPS가 자동으로 적용되며 무료 SSL 인증서까지 포함되어 처음부터 안전한 사이트를 만들 수 있습니다.
00:07:45가장 좋은 점은 무료 WHOIS 프라이버시 보호와 부가 서비스 비용이나 숨겨진 수수료 없이 첫해를 단 5.99달러에 이용할 수 있다는 것입니다.
00:07:521년 차 이후에도 갱신 비용이 원가 수준으로 유지되기 때문에 장기적으로도 매우 저렴합니다.
00:07:58[porkbun.com/ailabs26에서](https://www.google.com/search?q=https%3A%2F%2Fporkbun.com%2Failabs26%EC%97%90%EC%84%9C) 5.99달러에 도메인을 만나보세요. 링크는 아래 설명란에 있습니다.
00:08:03자, 앤트로픽은 Fable 5.1이 일일이 지켜보지 않고 내버려 두어도 되는 장기 작업에 적합하다고 하지만,
00:08:09원래 요청에 이미 포함되어 있던 단계에 대해서도 실행 전 허락을 구하기 위해 여전히 중간에 멈춰 섭니다.
00:08:14질문을 던지고 답변을 기다리는데, 답해줄 사람이 없으면 기다리는 것은 곧 작업 중단이나 다름없습니다.
00:08:19이는 사용자가 옆에서 같이 작업하고 있다는 전제하에 만들어진 기본 동작 때문입니다.
00:08:24따라서 Fable 5.1용 앤트로픽 프롬프트 가이드에서는 현재 지켜보는 사람이 없으며,
00:08:29되돌릴 수만 있다면 요청에 이미 포함된 내용과 관련된 작업은 알아서 계속 진행하라고 프롬프트에 명시해야 한다고 조언합니다.
00:08:34이렇게 해야 모델이 불필요한 질문으로 멈춰 서지 않고 긴 작업을 끝마칠 수 있는 권한을 갖게 됩니다.
00:08:39또한 Fable 5.1에는 요청한 것보다 더 많은 작업을 하려는 성향이 있습니다.
00:08:43예를 들어 하나의 기능만 추가해 달라고 요청하면 근처의 다른 문제를 발견하고 그것까지 고쳐버리거나,
00:08:48설명한 범위를 넘어서 기능을 확장해 버리기도 합니다. 저희 클라이언트 프로젝트 중 하나에서
00:08:53특정 기능을 요청했더니 아무도 건드려 달라고 한 적 없는 테스트 파일까지 수정해 놓은 경우가 있었습니다.
00:08:58문제는 이러한 불필요한 수정으로 인해 원래 그대로 유지하고 싶었던 제품의 다른 부분까지 바뀔 수 있다는 점입니다.
00:09:03따라서 Fable 5.1에 작업을 맡길 때는 무엇을 건드리지 말아야 하는지도 함께 지시해 주어야 합니다.
00:09:08즉 요청된 부분만 수정하도록 하는 것입니다. 그리고 다른 문제를 발견하면,
00:09:13마지막에 그 내용을 언급합니다. 우리 프로젝트에서 이 방식으로 테스트 파일을
00:09:18수정하지 말라고 구체적으로 지시했더니, 요청한 기능만 작업했습니다. Fable 5.1에는 또 다른 버릇이 있는데,
00:09:24파일을 수정할 때마다 나타납니다. 작업 중 파일의 일부분만 수정하면 되는 경우에도,
00:09:29나머지 부분은 전혀 바뀌지 않는데도 파일 전체를 다시 작성합니다.
00:09:33올바른 결과물이 나오기 때문에 보기에는 문제없어 보일 수 있지만, 그 모든
00:09:38줄마다 출력 토큰이 소모되며, 많은 파일로 작업할 경우 사용 한도가 훨씬 빨리 소모됩니다.
00:09:43우리의 세컨드 브레인 프로젝트에서도 이를 목격했는데, 작은 수정 하나마다 불필요하게 비용이 많이 들었습니다.
00:09:48그냥 수정할 수도 있었던 파일들을 계속해서 다시 작성했기 때문입니다. 이를 막으려면,
00:09:52Fable 5.1에게 작은 수정만으로도 같은 결과가 나온다면
00:09:56해당 부분만 수정하라고 지시해야 합니다. 다음 문제는 Fable 5.1이 얼마나 많이 쓰느냐가 아니라,
00:10:01어떻게 쓰느냐입니다. 우리는 이미 앤스로픽이 일명 “기교 부린 산문”이라고 부르는 방식을
00:10:06많이 사용했던 Opus 5를 통해 이를 목격했습니다. 모르시는 분들을 위해 설명하자면, “기교 부린 산문”이란 모델이
00:10:11하고 싶은 말을 그냥 하는 대신 화려한 표현과 은유를 사용하는 것을 말합니다. 예를 들어, 설정을
00:10:16변경할 가치가 있다고 말하는 대신, 모델은 이를 돌려볼 가치가 있는 다이얼이라고 표현합니다. 그리고 긴 연구 작업에서는
00:10:20그런 언어 때문에 모델이 전달하려는 요점조차 파악하기 어려워집니다.
00:10:24이제 Fable 5.1은 Opus 5나 Fable 5에 비해 그런 표현을 덜 사용하며, 상투적인구구나 불필요한 전문 용어도 적게 씁니다.
00:10:31하지만 여전히 글에서 그런 문제가 나타나며, Fable 5와 비교했을 때
00:10:36문장이 더 길어지고 문단 나눔은 줄어들어 내용을 따라가기가 더욱 어려워집니다.
00:10:41따라서 모든 기교 부린 산문을 제거하라고 지시하기만 하면 두 문제 모두 해결됩니다. 이는 우리가
00:10:46구축 대신 글쓰기 용도로 활용했던 자체 연구 작업 중 하나에 적용했을 때 취했던 방식입니다.
00:10:51마지막은 Fable 5.1에 어떤 종류의 작업을 맡기느냐에 관한 것입니다. 지금까지 다룬 내용은 모두 성능을
00:10:56최대화하는 방법에 관한 것이지만, 작업의 종류 역시 그만큼 중요합니다. Fable 5.1은 규모가 큰 작업에서 진가를 발휘하기 때문입니다.
00:11:01우리 프로젝트에서 작업을 실행했을 때, 가장 단순한 작업에서는 Fable 5가 실제로 더 나은 결과를 냈지만,
00:11:07가장 어려운 작업에서는 Fable 5.1이 더 뛰어난 성능을 보였으며, 약 40% 더 빠르게 완료하고 비용은 58% 절감했습니다.
00:11:14따라서 멈추지 않고 전체 작업을 완수하는 것이 실제로 중요한 대규모 작업야말로 Fable 5.1이 승리하는 영역입니다.
00:11:19그렇기 때문에 기능을 수많은 작은 프롬프트로 쪼개어 한 번에 한 단계씩 입력해서는 안 됩니다.
00:11:23기능 전체를 건네고 원하는 결과물을 명확하게 설명해야 하며,
00:11:28그러면 스스로 전체 기능을 완성하는 모습을 보게 될 것입니다. 자, 저희 영상에서 보여드리는 모든 기술과
00:11:33워크플로를 이용하고 싶다면 저희 커뮤니티인 AI Labs Pro에서 확인하실 수 있습니다.
00:11:38그러니 저희 활동에서 유익함을 얻었고 채널을 지원하고 싶다면, 이것이 가장 좋은 방법입니다.
00:11:43링크는 더보기란에 있습니다. 이것으로 이번 영상도 끝에 다다랐습니다. 채널을 지원하고
00:11:48이와 같은 영상을 계속 만드는 데 도움을 주고 싶으시다면, 아래의 슈퍼 댄스 버튼을 이용해 동참해 주세요.
00:11:53언제나 그렇듯 시청해 주셔서 감사드리며 다음 영상에서 뵙겠습니다.

핵심 요약

Fable 5.1은 low effort 설정으로 사용하고 대규모 작업 단위로 통째로 맡겨야 성능을 극대화할 수 있다.

하이라이트

  • Fable 5.1은 복잡한 대규모 작업에서 Fable 5보다 속도가 약 40% 빠르고 비용은 절반 이하로 소요된다.

  • Fable 5.1의 low effort 설정은 코드 리뷰 작업에서 high effort 설정보다 61%의 문제를 더 많이 잡아낸다.

  • Fable 5.1은 정답을 모를 때 72.6%의 확률로 환각 현상을 일으킨다.

  • Fable 5.1은 캐시된 읽기 비용이 이전 모델 대비 75% 낮아졌다.

  • Fable 5.1은 작은 수정만 필요한 경우에도 파일 전체를 다시 작성하여 출력 토큰을 소모한다.

타임라인

Fable 5.1의 성능 특징과 비용 구조

  • Fable 5.1은 단순한 작업보다 난이도가 높은 대규모 작업에서 뛰어난 성능을 발휘한다.
  • 가장 난이도가 높은 작업에서 Fable 5.1은 속도가 약 40% 빠르고 비용은 절반 이하로 줄어든다.
  • 캐시된 읽기 비용이 이전 모델보다 75% 저렴해져 긴 작업에서의 대화 전송 비용이 대폭 감소한다.

앤트로픽의 최신 모델인 Fable 5.1은 단순 작업에서는 이전 모델과 큰 차이가 없거나 밀리기도 하지만, 가장 난이도가 높은 작업에서는 우수한 결과물을 내놓습니다. AI Labs의 클라이언트 프로젝트 테스트 결과, Fable 5.1은 Fable 5보다 속도가 약 40% 빨랐고 비용은 50% 이하로 들었습니다. 또한, 대화 내역이 길어질 때 재사용되는 캐시된 읽기 비용이 75% 낮아져 긴 작업을 수행할 때 유리합니다.

Fable 5.1의 한계점과 주의사항

  • 안전 가이드라인에 걸리면 사용자에게 알리지 않고 약한 모델로 자동 전환된다.
  • Fable 5.1은 정답을 모를 때 72.6%의 확률로 환각 현상을 일으킨다.
  • 출력 생성량이 많아져 읽기 비용 절감에도 불구하고 작업당 전체 청구 금액은 늘어날 수 있다.

Fable 5.1은 안전 가이드라인에 저촉될 경우 경고 없이 성능이 낮은 모델로 전환되어 남은 세션을 처리합니다. 이로 인해 사용자는 성능이 떨어진 결과물을 Fable 5.1의 결과로 오인하게 됩니다. 또한 Artificial Analysis의 테스트에 따르면 Fable 5.1은 환각 현상 발생 확률이 72.6%로 Fable 5의 63.6%보다 높으며, 더 많은 양의 텍스트를 출력하여 작업당 비용이 약 20% 증가합니다.

Fable 5.1 성능을 100% 끌어내는 7가지 규칙

  • effort 설정을 low로 낮추면 코드 리뷰와 개발 작업에서 더 우수한 결과와 속도를 얻을 수 있다.
  • 구형 모델을 위해 작성된 불필요한 지시사항들을 제거하여 토큰 낭비를 막아야 한다.
  • 기능을 작은 프롬프트로 쪼개지 말고 전체 기능을 한 번에 전달해야 한다.

Fable 5.1의 잠재력을 온전히 활용하려면 effort 설정을 low로 낮춰 깊은 고민 대신 효율적인 결과물을 유도해야 합니다. 구형 모델용 지시사항을 정리하고, 모델이 불필요한 질문으로 멈춰 서지 않도록 허가 조건을 명시해야 합니다. 또한 파일 수정 시 전체를 다시 작성하는 성향을 제어하고, 기교 부린 산문을 쓰지 않도록 지시해야 합니다.

커뮤니티 글

아직 글이 없습니다. 이 영상에 대한 첫 번째 글을 작성해 보세요!

이 영상에 대해 글쓰기