클로드 페이블5 토큰 90% 아끼는 궁극의 세팅법 — 성공지식백과
한 줄 요약
Fable 5 의 사고 강도를 Max 대신 High 로 낮추고, Fable 5 는 계획·판단만 맡긴 뒤 실제 구현은 Opus·탐색은 Haiku 서브에이전트에 위임하는 오케스트레이션 세팅으로 토큰 비용을 크게 줄이는 방법. 훅으로 이 위임 규칙을 강제하고 fable on/off 로 전체 모드를 켜고 끈다.
영상 메타
- URL: https://www.youtube.com/watch?v=I-JuFhY5W54
- 채널: 성공지식백과
- 길이: 10분 3초
- 업로드: 2026-07-05
- 조회수: 19,518 / 좋아요 663
- 시청일: 2026-07-11 KST (🍎 가 자막 추출 후 요약)
픽업
- 코딩 에이전트 벤치마크(영상에서 “deep benchmark” 로 지칭) 기준 Fable 5 의 Max 와 X-High 는 성능 차이가 거의 없는데 동일 과제 비용은 $22 대 $13 이다. 따라서 굳이 Max 를 쓸 이유가 없고 Max 는 탈락이다.
- X-High 와 High 는 성능 차이가 1% 인데 비용은 $13 에서 $9 로 40% 이상 떨어진다. 발화자 본인은 아직 X-High 를 쓰지만, 비용 트레이드오프를 중시한다면 High 가 맞다고 권한다.
- 함께 나온 Sonnet 5 는 효율이 나쁘다. 성능은 더 낮은데 가격은 더 비싸며, Opus Max 가 $13 인 데 비해 Sonnet 5 는 $26 이다. 2026-07-01 기준으로는 Sonnet 5 를 워커로 쓰기 어렵다고 본다.
- Fable 5 는 가장 똑똑하고 가장 비싼 모델이므로 잡무까지 시키면 비싼 토큰이 쓸모없는 일에 낭비된다. 계획 수립·작업 분배·중요한 판단만 Fable 5 에 맡기고, 실제 구현은 하위 모델에 맡기는 회사 조직식 분업이 핵심이다.
- 3단 구성: Fable 5 가 전체 계획, 코드 작성은 Opus 4.8, 중간에 파일이나 정보를 찾는 탐색성 잡무는 Haiku 서브에이전트가 맡는다. 발화자의 실제 프로젝트에서도 상위 계획은 Fable 5, 디자인 구현은 서브모델 Opus 로 배선돼 있다.
- 한 달치 Claude Code 사용을 API 비용으로 환산하면 약 $20,000 이 나왔는데, 그중 Fable 5 사용 비중은 25% 이고 나머지는 대부분 Opus 였다. 반대로 Fable 5 만 쓴 새 계정은 토큰을 많이 쓰지 않았는데도 비용이 크게 뛰었다.
- CLAUDE.md 에 지시만 적으면 먹을 때도 있고 안 먹을 때도 있어서 훅(hook)으로 강제하고, 상위가 내린 지시를 하위 서브에이전트가 다시 재위임하지 못하도록 차단하는 설정도 함께 넣는다. 이 시스템으로 프롬프트 하나를 10시간 돌렸는데 5시간 한도는 25%, 주간 한도는 7%만 소모했다.
용어
- Fable 5 [모델 · 구독]: 영상 시점 기준 가장 똑똑하고 가장 비싼 최상위 모델. 곧 무료 사용 창이 닫힌다고 언급된다.
- 사고 강도 단계 (Max / X-High / High) [모델 · 구독]: 모델이 얼마나 깊게 추론할지 정하는 설정 단계. 단계가 높을수록 비용이 오른다.
- 오케스트레이션 [하니스 · 패턴]: 비싼 상위 모델에 계획·판단만 맡기고 실제 작업은 저렴한 하위 모델에 나눠 시키는 지휘 구조.
- 서브에이전트 [하니스 · 패턴]: 상위 모델의 지시를 받아 개별 작업을 수행하는 하위 에이전트. 여기서는 구현용 Opus, 탐색용 Haiku 로 나뉜다.
- 훅 (hook) [하니스 · 패턴]: 지시가 지켜지지 않는 것을 막기 위해 하네스 차원에서 규칙을 강제 실행시키는 장치.
- CLAUDE.md [지식 · 컨텍스트 자산]: 에이전트에게 상시 적용할 지침을 적어두는 파일. 지시가 항상 지켜지지는 않는다는 한계가 지적된다.
- 5시간 한도 / 주간 한도 [빌링 · 운영]: 구독 플랜에서 사용량을 제한하는 두 축. 위임 구조를 쓰면 같은 작업량에도 한도 소모가 줄어든다.
- API 환산 비용 [빌링 · 운영]: 구독으로 쓴 사용량을 종량제 API 가격으로 환산해 본 금액. 모델 구성에 따라 크게 갈린다.