Claude Fable 5.1 공개, 입출력 단가는 그대로고 캐시 읽기만 4분의 1
Anthropic이 9월 1일 Claude Fable 5.1과 Mythos 5.1을 공개했습니다. 입력 100만 토큰 10달러와 출력 50달러는 Fable 5와 같고, 캐시 읽기만 1달러에서 0.25달러로 내렸습니다. 도구 강제 호출을 포함해 세 가지가 끊깁니다.
- Claude Fable 5.1의 입력·출력 단가는
Fable 5와 똑같습니다. - 내려간 건 캐시 읽기 하나로, 100만 토큰 1달러에서 0.25달러입니다.
- 도구 강제 호출은 이제 400 에러라, 옮기기 전 코드를 봐야 합니다.
Anthropic이 2026년 9월 1일 Claude Fable 5.1과 Claude Mythos 5.1을 공개했습니다. Fable 5.1은 Claude API를 쓰는 모든 고객에게 모델 ID claude-fable-5-1로 열렸고, Mythos 5.1은 미국 조직 대상 프로그램인 Project Glasswing 참가자만 씁니다. Hacker News 발표 스레드에는 648점과 댓글 604개가 달렸습니다.
여러 매체가 "최대 45% 저렴"을 헤드라인으로 뽑았습니다. 그런데 플랫폼 문서의 가격 표를 열어 보면 기본 입력 100만 토큰 10달러, 출력 50달러로 6월에 공개된 Fable 5와 숫자가 하나도 다르지 않습니다. 내려간 항목은 캐시 읽기 하나뿐입니다.
싸진 건 캐시 읽기 하나입니다
캐시 읽기가 무엇인지부터 짚습니다. 긴 대화나 에이전트 세션은 요청할 때마다 앞부분을 통째로 다시 보냅니다. 시스템 프롬프트, 도구 정의, 지금까지 오간 기록입니다. 프롬프트 캐시는 그 앞부분을 서버에 저장해 두고 다음 요청에서 다시 씁니다. 다시 쓴 토큰에 매기는 값이 캐시 읽기 단가입니다.
다른 Claude 모델의 캐시 읽기는 기본 입력 단가의 0.1배입니다. Fable 5.1과 Mythos 5.1은 0.025배입니다. 기본 입력이 10달러이므로 100만 토큰에 1달러 하던 것이 0.25달러가 됩니다.
발표문은 절감폭을 두 갈래로 적었습니다. 일반적인 작업은 Fable 5보다 약 25%, 복잡한 코딩과 에이전트 작업은 최대 약 45%입니다. 두 숫자의 차이가 어디서 오는지는 계산해 보면 바로 나옵니다. 절감폭은 전체 입력 토큰 가운데 캐시에서 읽힌 비중에 정비례합니다. 같은 앞부분을 수십 번 다시 읽는 긴 에이전트 세션이 45%에 가까워집니다. 매번 새 프롬프트를 보내는 일회성 호출은 절감이 0입니다.
캐시 쓰기 단가는 그대로입니다. 5분 캐시 쓰기가 100만 토큰에 12.50달러, 1시간 캐시 쓰기가 20달러입니다. 캐시에 올릴 수 있는 최소 프롬프트 길이도 512토큰으로 같습니다. 캐시를 아직 안 쓰는 코드라면 쓰기 비용을 먼저 내야 읽기 할인이 시작된다는 뜻입니다.
| 100만 토큰당 | Fable 5.1 · Mythos 5.1 | 다른 Claude 모델의 계산식 |
|---|---|---|
| 기본 입력 | $10 | 기준값 |
| 캐시 읽기 | $0.25 (입력의 0.025배) | 입력의 0.1배 |
| 캐시 쓰기 (5분 / 1시간) | $12.50 / $20 | 변동 없음 |
| 출력 | $50 | 기준값 |
| 배치 처리 (입력 / 출력) | $5 / $25 | 변동 없음 |
옮기기 전에 끊기는 세 가지
모델 ID만 바꾸면 되는 업데이트가 아닙니다. 문서는 Fable 5에서 넘어올 때 깨지는 동작을 세 가지로 명시했습니다.
첫째, 도구를 강제로 부르게 하는 설정이 막혔습니다. tool_choice를 {"type":"any"}나 {"type":"tool","name":"..."}로 보내면 400 오류가 돌아옵니다.
tool_choice: type "tool" and "any" are not supported for this model.
토큰 카운팅 엔드포인트에도 같은 검증이 걸립니다. 기본값인 {"type":"auto"}와 {"type":"none"}은 그대로 동작합니다. 막은 이유는 문서에 적혀 있습니다. 이 모델은 사고 과정이 항상 켜져 있는데 도구 호출을 강제하면 사고를 건너뛰고 그 내용을 도구 인자 안에 써 넣게 되어 인자 품질이 떨어집니다. 문서가 제시한 대안은 둘입니다. JSON 스키마를 지키게 하려던 용도였다면 strict: true를 쓰는 strict tool use나 structured outputs로 옮깁니다. 도구를 반드시 부르게 하려던 용도였다면 어떤 상황에서 그 도구를 쓰라고 프롬프트에 적습니다.
둘째, 이전 모델은 Fable 5.1이 만든 사고 블록을 읽지 못합니다. 보존은 한 방향입니다. Claude Opus 5나 Fable 5로 시작한 대화를 Fable 5.1로 옮기면 그동안의 사고가 그대로 이어지지만, 반대로 Fable 5.1에서 다른 모델로 내려가면 그 턴의 사고는 사라집니다. 라우터나 폴백이 대화 중간에 모델을 바꾸는 구조라면 API가 읽을 수 없는 블록을 조용히 버립니다. 버려진 블록은 input_tokens에 안 잡히고 과금도 안 되지만, thinking-binding-controls-2026-08-01 베타 헤더를 붙이지 않으면 버려졌다는 사실 자체가 응답에 안 나옵니다.
셋째, 이전 턴을 고치면 그 뒤의 사고 블록이 전부 무효가 됩니다. 시스템 프롬프트, tools 배열, 이전 메시지 중 무엇이든 바꾸면 다음 요청이 400으로 거절되고 메시지에 The block is bound to a different conversation이 붙습니다.
이 검사에는 계정별 유예가 걸려 있습니다. 2026년 8월 31일 이후에 만든 신규 계정에만 강제되고, 그 이전 계정은 불일치를 기록만 하며 thinking.block_binding.prefix_mismatch_behavior를 직접 설정해야 동작합니다. Mythos 5.1은 이 검사를 아예 하지 않습니다.
| 사고 블록이 무효가 되는 패턴 | 유효하게 남는 패턴 |
|---|---|
| 이전 턴을 고치거나 순서를 바꾸거나 지우기 | 맨 앞부터 순서대로 사고 블록 걷어내기 |
| 요청마다 이전 턴에 넣었다 다음 요청에서 빼는 리마인더 | 서버측 context editing과 compaction으로 기록 줄이기 |
같은 대화 안에서 시스템 프롬프트나 tools 재구성 | cache_control 마커 위치 옮기기 |
| 같은 URL이 요청마다 다른 바이트를 주는 이미지·문서 | 요청 사이 effort 값 바꾸기 |
직접 messages 배열을 만드는 코드만 이 셋에 해당합니다. Claude Code, claude.ai, Claude Managed Agents, Claude Agent SDK는 앞부분을 알아서 그대로 유지합니다. 공식 도구만 쓰는 독자는 손댈 것이 없고, API를 직접 호출하는 개발자만 해당합니다.

세 가지를 정리한 마이그레이션 절차는 공식 마이그레이션 가이드에 단계별로 있습니다. 자기 코드가 대화 기록을 고치고 있는지 확인하려면 prefix_mismatch_behavior를 "drop_block"으로 두고 한 세션을 돌린 뒤 input_transformations를 찍어 보라는 것이 문서의 방법입니다.
코드를 안 고쳐도 달라지는 동작
한 줄도 안 고쳐도 결과물이 달라지는 항목이 따로 있습니다. 문서가 「Changed from Claude Fable 5」로 묶은 일곱 가지 가운데 비용과 직결되는 것이 둘입니다.
- 병렬 도구 호출이 줄었습니다. Fable 5가 독립적인 읽기 작업을 여러 개 묶어 한 번에 부르던 자리에서, Fable 5.1은 턴당 하나씩만 부르는 경우가 있습니다. 답변 품질은 안 떨어지지만 왕복 횟수와 토큰, 걸리는 시간이 늘어납니다. 직접 만든 코딩 에이전트나 명령줄과 편집기를 오가는 구조에서 두드러진다고 적혀 있습니다.
- 작은 수정에도 파일 전체를 다시 씁니다. 텍스트 파일을 고칠 때 해당 부분만 바꾸는 대신 전체를 새로 쓰는 경향이 늘었습니다. 결과는 대체로 같지만 출력 토큰이 더 나가고, 출력은 100만 토큰에 50달러입니다.
나머지 다섯은 결과물 자체의 성격이 달라진 항목입니다. 긴 도구 실행 중에 사용자에게 보이는 중간 보고가 줄었습니다. low effort에서는 검색 도구를 덜 부르고 기억에 의존해 답하는 빈도가 늘었습니다. 산문은 문장이 길어지고 문단 나눔이 줄어 더 조밀해졌습니다. 채팅에서는 볼드와 헤더, 목록을 이전 모델보다 덜 씁니다. 문서를 요약할 때 원문 구절을 인용 표시 없이 그대로 옮기는 경향도 늘었다고 적혀 있습니다. 마지막 항목은 요약본을 그대로 외부에 내보내는 파이프라인이라면 인용 표시를 따로 확인해야 한다는 뜻입니다.
성능은 발표문 기준으로 에이전트 코딩 벤치마크 Terminal-Bench 4.0에서 Fable 5.1이 55.8%, 안전장치를 걷어낸 Mythos 5.1이 60.9%입니다. 컴퓨터 사용 벤치마크 OSWorld 2.0은 부분 점수 77.9%, 엄격 점수 41.7%이고, CursorBench 3.2.0은 73.4%입니다. Claude Code에서는 사이버보안 관련 오탐이 약 60% 줄었다고 밝혔습니다.
지금 쓸 수 있나
Fable 5.1은 한국에서도 쓸 수 있습니다. Claude API와 claude.ai, AWS, Google Cloud, Microsoft Foundry 어디에도 지역 제한이 적혀 있지 않습니다. Mythos 5.1은 미국 조직만 참여하는 Project Glasswing 프로그램 안에서만 열려 한국에서는 쓸 수 없습니다.
| 쓰는 곳 | Fable 5.1 조건 |
|---|---|
| Claude API | 전 고객. 표준 API 요금 |
| claude.ai Free | 쓸 수 없음 |
| claude.ai Pro, Team 표준 좌석 | 요금제 사용량에 포함되지 않음. 사용 크레딧을 따로 결제해야 함 |
| claude.ai Max, Team·Enterprise 프리미엄 좌석 | 요금제에 포함. 주간 사용 한도의 최대 50%까지 추가 비용 없음 |
| Mythos 5.1 | Project Glasswing 참가 미국 조직만. 담당팀 문의 필요 |
지난 7월 19일 끝난 Fable 5 프로모션 크레딧은 Fable 5.1에 적용되지 않습니다. 지원 문서는 "Fable 5.1은 애초에 그 대상이 아니었다"고 명시했습니다.
데이터 보존 조건도 확인해야 합니다. 두 모델 모두 데이터를 30일 보관하고, Anthropic이 별도로 승인하지 않는 한 데이터를 남기지 않는 zero data retention 설정으로는 쓸 수 없습니다. 사내 규정상 무보존이 조건인 팀이라면 이 항목이 도입 여부를 먼저 가릅니다.
출력물에는 8월 2일 이후 출시 모델에 적용된 통계적 텍스트 워터마크가 그대로 들어갑니다. Files API로 받는 이미지와 영상에는 C2PA Content Credentials 서명이 붙습니다. 그 워터마크를 읽는 탐지 API는 이번 발표에서 비공개 프리뷰로 열렸는데, 대상이 규제기관·법 집행기관·언론·팩트체커·독립 연구자·교육기관·EU 시민사회 단체로 한정돼 일반 개발자는 아직 자기 출력물의 워터마크를 직접 확인할 수 없습니다.
한 가지 더, 문서는 Fable 5.1을 기본 선택지로 권하지 않습니다. "대부분의 워크로드는 Claude Opus 5에서 시작한다"고 적고, Opus 5를 xhigh나 max effort로 돌려도 자체 평가가 모자랄 때 Fable 5.1로 올리라고 안내합니다.
Claude API로 긴 에이전트 세션을 돌리는 팀이라면, 지난달 청구서에서 캐시 읽기 토큰이 전체 입력 토큰의 몇 퍼센트였는지부터 뽑아 보면 됩니다. 그 비율이 곧 이번 인하로 줄어드는 금액이고, 25%와 45% 중 어느 쪽에 가까운지도 그 숫자가 답합니다. 비율이 낮게 나왔다면 모델을 바꾸기 전에 프롬프트 캐시부터 켜는 편이 절감폭이 큽니다. 옮기기로 정했다면 코드베이스에서 tool_choice를 검색해 any와 tool을 먼저 걷어내야 첫 요청이 400으로 돌아오지 않습니다.