본문으로 건너뛰기

Claude Fable 5.1 API 전환 가이드: 캐시 가격과 effort부터 검증하기

4 분 소요API 가이드

기본 입력·출력 요금은 그대로입니다. 반복 prefix의 비용이 언제 줄어드는지 계산하고, 모델 ID를 바꾸기 전에 실패할 설정을 찾습니다.

Claude Fable 5.1 전환을 위한 가격, 캐시 회수 시점, effort, 호환성, Mythos 승인 조건 요약

Claude Fable 5.1의 가격 변화는 전체 API 호출에 동일하게 적용되지 않습니다. 일반 입력은 100만 token당 $10, 출력은 $50으로 Fable 5와 같습니다. 달라진 항목은 캐시 읽기이며, $1에서 $0.25로 내려갔습니다.

따라서 큰 system prompt, tools 정의, 긴 대화 prefix를 계속 재사용하는 에이전트가 직접적인 수혜 대상입니다. 매번 입력이 달라지는 작업은 버전만 바꿔도 75% 저렴해지지 않습니다. 게다가 강제 도구 호출과 thinking blocks 처리에는 깨지는 변경이 있으므로 비용과 호환성을 함께 검증해야 합니다.

아래 내용은 2026년 9월 3일 Claude Platform 공식 문서를 기준으로 확인했습니다. 실제 배포일에는 가격, 보존 정책, 계정별 제공 여부를 다시 확인해야 합니다.

먼저 token 종류별 원장을 만든다

Claude API 가격 문서는 Fable 5.1과 Mythos 5.1에 같은 단가를 표시합니다.

구분100만 token당 USD
일반 입력$10
5분 캐시 쓰기$12.50
1시간 캐시 쓰기$20
캐시 적중 또는 갱신$0.25
출력$50

Batch 입력과 출력은 각각 $5, $25입니다. 미국 내 추론을 지정하는 inference_geo: "us"에는 모든 token 종류에 1.1배가 붙습니다. 클라우드 사업자나 중개 서비스의 요금은 별도이므로 위 숫자를 최종 청구액으로 단정하면 안 됩니다.

75% 인하는 Fable 5의 캐시 읽기 $1과 비교한 값입니다. 일반 입력 $10과 비교하면 $0.25는 2.5%이며 97.5% 저렴합니다. 두 수치는 모두 맞지만 비교 대상이 다릅니다. “Fable 5.1 전체가 75% 싸졌다”는 표현은 입력 첫 처리, 캐시 쓰기, 출력 비용을 지워 버립니다.

재사용 횟수로 TTL을 선택한다

고정 prefix가 100만 token이고 변경되는 뒷부분과 출력은 없다고 가정해 보겠습니다.

5분 캐시는 첫 쓰기 $12.50과 첫 읽기 $0.25를 합쳐 $12.75입니다. 일반 입력을 두 번 처리하면 $20이므로 TTL 안에서 두 번째 요청이 적중하는 순간 더 저렴합니다.

1시간 캐시는 쓰기 후 한 번 읽으면 $20.25로 일반 입력 두 번의 $20보다 약간 비쌉니다. 한 번 더 읽으면 총 $20.50이고 일반 입력 세 번은 $30입니다. 이 단순 사례에서는 세 번째 사용부터 1시간 캐시가 이깁니다.

운영 원장에서는 일반 입력, cache creation, cache read, 출력을 따로 보관해야 합니다. 평균 할인율 하나만 기록하면 TTL 만료, system prompt 변경, tools 배열 변경 때문에 발생한 miss를 찾기 어렵습니다. Claude Code 세션 비용 급증을 추적하는 경우에는 캐시 미스 진단 가이드가 더 맞습니다.

Fable 5.1 캐시 가격, TTL별 회수 횟수, effort 기본값을 정리한 전환 가이드

effort를 생략하면 high와 같다

공식 Effort 문서에 따르면 API에서 output_config.effort를 생략한 동작은 high를 넣은 것과 정확히 같습니다. Fable 5.1은 low, medium, high, xhigh, max를 지원하며 적응형 사고는 항상 켜져 있습니다.

typescript
const response = await client.messages.create({ model: "claude-fable-5-1", max_tokens: 16000, output_config: { effort: "high" }, messages: [{ role: "user", content: "이 전환 계획을 검토해 주세요." }], });

명시적인 high로 첫 기준선을 만들면 이후 튜닝 결과를 설명하기 쉽습니다. 짧은 분류와 변환은 medium 또는 low를 비교하고, 장시간 코딩과 조사처럼 품질 민감도가 높은 작업만 xhighmax까지 확장합니다. effort는 엄격한 token 예산이 아니므로, 자체 eval에서 품질, 출력 token, 지연, 도구 호출 수를 같이 봐야 합니다.

Fable 5.1은 beta per-message effort도 지원합니다. 대화 중 system message로 수준을 바꾸면 기존 prompt cache를 유지할 수 있습니다. 다음 요청의 top-level effort를 바꾸는 방식은 캐시를 다시 시작합니다. 동적 effort를 쓴다면 현재 beta header와 cache counter를 함께 검증하세요.

모델 ID 변경 전 실패 조건을 제거한다

Anthropic 마이그레이션 문서가 강조하는 첫 문제는 forced tool use입니다. tool_choiceany이거나 특정 이름의 tool이면 400 invalid_request_error가 납니다. auto 또는 none을 사용합니다. 스키마 적합성이 목적이라면 autostrict: true를 결합하거나 structured outputs로 옮깁니다.

두 번째는 thinking blocks의 방향성입니다. Fable 5.1은 이전 Claude 모델이 만든 blocks를 읽지만, 이전 모델은 5.1 blocks를 읽지 못합니다. 대화 중 구형 모델로 fallback하는 라우터는 해당 상태가 그대로 유지된다고 가정할 수 없습니다.

세 번째는 과거 대화를 수정하는 클라이언트입니다. 이전 message, top-level system, tools 배열을 다시 만들면 이후 Fable 5.1 thinking blocks가 무효가 될 수 있습니다. 자체 messages 배열은 추가 전용으로 유지하고, 컨텍스트를 줄일 때는 서버 측 context editing이나 compaction을 우선합니다. 기존 계정에는 단계적 적용 차이가 있으므로 canary에서 400과 input_transformations를 직접 확인합니다.

thinking: {type: "disabled"}나 수동 budget_tokens로 이 문제를 우회할 수는 없습니다. Fable 5.1은 적응형 사고를 항상 사용합니다.

모델 ID 변경 전 호환성 검사와 품질·비용 canary의 확대 또는 중단 기준

Mythos 5.1은 공개 프리미엄 요금제가 아니다

Fable 5.1 변경 사항은 Fable 5.1과 Mythos 5.1이 기능, 사양, 가격을 공유한다고 설명합니다. 실행 가능한 차이는 접근 권한입니다.

  • claude-fable-5-1은 Claude API 고객과 공식 파트너 플랫폼에서 사용할 수 있습니다.
  • claude-mythos-5-1은 Project Glasswing 승인 고객에게만 제공됩니다.
  • 두 모델은 Anthropic의 명시적 예외가 없으면 30일 데이터 보존을 요구합니다.
  • 현재 두 모델 모두 Priority Tier를 지원하지 않습니다.

클라우드 카탈로그에 모델 ID가 보이는 것만으로 entitlement가 생기지 않습니다. 조직 수준 승인 문서가 없다면 Fable 5.1을 선택해야 합니다. Mythos 권한 증거가 실제로 무엇인지 확인하려면 Mythos API 접근 가이드를 별도로 참고하세요.

canary는 품질과 비용을 동시에 통과해야 한다

Fable 5에서 사용한 대표 요청을 비민감 데이터로 복제하고 claude-fable-5-1을 적용합니다. 강제 tool_choice를 제거하고 effort를 명시합니다. 일반 입력, 캐시 생성, 캐시 읽기, 출력, 지연, 도구 round, refusal, 400을 같은 형식으로 수집합니다.

기존 task eval이 통과하고, 관측된 cache hit 비율이 예상 절감액을 뒷받침하며, 클라이언트가 stop_reason: "refusal"을 네트워크 오류와 구분할 때만 트래픽을 늘립니다. 하나라도 실패하면 이전 ID로 되돌리고 요청 계약부터 수정합니다. effort를 올리는 것은 잘못된 도구 설정의 해결책이 아닙니다.

결론은 세 갈래입니다. 안정적인 prefix를 반복 사용하고 호환성 검사를 통과하면 Fable 5.1을 단계적으로 도입합니다. 입력 대부분이 고유하면 75% 숫자 대신 능력 eval을 우선합니다. Glasswing 승인이 없으면 Mythos는 실행 가능한 후보가 아닙니다.

#Claude Fable 5.1#Claude Mythos 5.1#프롬프트 캐시#Effort#Claude API
Share: