Claude Fable 5.1 출시: 캐시 읽기 75% 인하, 개발자가 꼭 확인할 3가지

Anthropic 공식 발표문·개발자 문서·Artificial Analysis 리더보드·주요 외신 보도를 직접 확인하고 정리한 실무 중심 가이드입니다.

어제(9월 1일), Anthropic이 Claude Fable 5.1Claude Mythos 5.1을 동시에 공개했습니다. 발표 하루 만에 독립 벤치마크 Artificial Analysis 인텔리전스 지수 66점으로 전체 1위에 올랐고, 전작이 24.7%였던 과학 연구 벤치마크 점수는 52.6%로 두 배 이상 뛰었습니다.

그런데 숫자보다 더 눈여겨볼 변화가 있습니다. 캐시 읽기 가격이 75% 인하되면서 실제 에이전트 워크로드 비용이 최대 45%까지 줄어들고, 그동안 개발자들을 괴롭히던 “30일 데이터 보관” 문제도 사실상 해결 수순에 들어갔습니다. 반면 기존 Fable 5를 호출하던 코드라면 반드시 확인해야 할 깨짐 변경 3가지도 생겼습니다.

Claude Fable 5.1 출시 기념 대표 이미지

이 글에서 무엇이 달라졌고, 내가 쓰는 코드와 요금제에는 어떤 영향이 있는지 한 번에 정리합니다.

Anthropic 공식 발표문 바로가기

Fable 5.1과 Mythos 5.1, 뭐가 다른가요?

결론부터 말하면 같은 모델, 다른 안전장치입니다. Fable 5.1은 모든 고객이 바로 쓸 수 있는 일반 공개 버전이고, Mythos 5.1은 사이버 보안·생명과학 분야 검증된 조직만 접근할 수 있는 제한 버전입니다. 성능과 스펙, 가격은 동일합니다.

항목 Claude Fable 5.1 Claude Fable 5 Claude Opus 5
컨텍스트 윈도우 1M 토큰 1M 토큰 1M 토큰
최대 출력 128K 토큰 128K 토큰 128K 토큰
입력/출력 가격 $10 / $50 (MTok) $10 / $50 (MTok) $5 / $25 (MTok)
캐시 읽기 $0.25 (MTok) $1 (MTok) $0.50 (MTok)
사고(thinking) Adaptive 항상 켜짐 Adaptive 항상 켜짐 Adaptive
기본 effort high high high
지식 기준 시점 2026년 6월 2026년 5월
API 모델 ID claude-fable-5-1 claude-fable-5 claude-opus-5

Anthropic 공식 문서가 권하는 선택 기준은 명확합니다. 대부분의 워크로드는 Opus 5로 시작하고, 고난도 추론이나 장시간 에이전트 작업에서 Opus 5의 높은 effort로도 평가 점수가 부족할 때 Fable 5.1로 올리라는 것입니다. 즉 “무조건 최강 모델”이 아니라 비용 대비 필요한 지능의 문제입니다.

비용: 캐시 읽기 75% 인하가 체감 비용을 바꿉니다

이번 5.1에서 가격이 바뀐 곳은 딱 한 군데, 캐시 읽기입니다. 기존 $1/MTok에서 $0.25/MTok으로 내려갔습니다. 기본 입력가의 0.025배로, 다른 Claude 모델들(0.1배)보다 4배 저렴합니다.

구분 Claude Fable 5.1
기본 입력 $10 / MTok
5분 캐시 쓰기 $12.50 / MTok
1시간 캐시 쓰기 $20 / MTok
캐시 읽기(히트) $0.25 / MTok
출력 $50 / MTok
Batch API $5 입력 / $25 출력 (50% 할인)

왜 캐시 읽기일까요? 긴 에이전트 세션은 매 턴마다 거대한 컨텍스트(시스템 프롬프트 + 도구 정의 + 이전 대화)를 다시 읽는데, 이때 대부분이 캐시 읽기로 처리됩니다. Anthropic이 8월 실제 사용량을 기준으로 측정한 결과, 일반 워크로드는 약 25%, 컨텍스트·도구 호출이 많은 고에이전트 워크로드는 최대 약 45%까지 총비용이 줄었습니다.

여기서 하나 짚고 갈 점이 있습니다. 독립 벤치마크 Artificial Analysis 기준으로 5.1(max effort, 폴백 포함)의 과제당 비용은 약 $3.69로, 여전히 비싼 축입니다. 즉 “절대 요금이 내려갔다”기보다 “같은 작업을 더 적은 캐시 비용으로”라는 표현이 정확합니다. 비용이 민감한 배치 작업이라면 50% 할인되는 Batch API부터 검토하세요.

Claude API 요금표 확인하기

성능: 과학 벤치마크 두 배, 리더보드 1위

Anthropic이 공개한 벤치마크에서 가장 눈에 띄는 것은 Terminal-Bench-Science 0.1입니다. 과학 연구용 에이전트 코딩 능력을 재는 이 테스트에서 Fable 5.1은 52.6%를 기록했습니다. 전작 Fable 5(24.7%)의 두 배가 넘고, Opus 5(29.0%)와 GPT-5.6 Sol(22.4%)도 크게 앞섭니다.

벤치마크 Fable 5.1 Fable 5 Opus 5 GPT-5.6 Sol
Terminal-Bench-Science 0.1 (과학 연구) 52.6% 24.7% 29.0% 22.4%
Terminal-Bench 4.0 (에이전트 코딩) 55.8% 42.0% 52.3% 37.3%
GDPval-AA v2 (지식 업무) 1853 1723 1824 1711
OSWorld 2.0 partial (컴퓨터 사용) 77.9% 72.9% 75.4%
Humanity’s Last Exam (도구 포함) 65.0% 63.8% 63.6%
AutomationBench (비즈니스 워크플로) 31.4% 17.1% 26.9% 19.6%
CursorBench 3.2.0 (에이전트 코딩) 73.4% 70.5% 70.0% 67.2%
Claude Fable 5.1 Artificial Analysis 인텔리전스 지수 1위

독립 지표도 같은 방향입니다. Artificial Analysis 인텔리전스 지수에서 Fable 5.1은 66점으로 1위(max effort, 폴백 포함)를 차지했습니다. Opus 5(63점)보다 3점, 전작 Fable 5(62점)보다 4점 높습니다. 하루 만에 주요 외신이 “리더보드 정상 등극”을 보도한 이유입니다.

실제 사용자 증언도 벤치마크와 결이 같습니다. 투자사 Millennium은 “수년간 엔지니어 누구도, 어떤 모델도 원인을 찾지 못했던 희귀 크래시의 원인을 Fable 5.1이 찾아냈다”고 밝혔고, Jane Street는 “긴 다단계 작업에서도 출력이 읽기 쉬운 상태를 유지한다”고 평가했습니다.

Artificial Analysis 리더보드 보기

과학 연구: 단백질 설계 성공률 50%, 금성 지도까지

Anthropic은 이번 발표에서 과학 연구 사례를 전면에 내세웠습니다. 단순 데모가 아니라 외부 기관이 실험으로 검증한 결과들입니다.

  • 단백질 결합체 설계: Mythos 5.1이 설계한 결합체는 3개 타깃에서 기존 단백질 설계 대회 최고 기록보다 10배 높은 친화도를 보였고, 12개 타깃 전체 히트율은 약 50%에 달했습니다. 통상 10~15%인 업계 평균을 크게 웃도는 수치입니다.
  • 금성 지형도: 30년 전 NASA 마젤란 탐사선의 레이더 데이터를 바탕으로 금성 표면 3분의 1의 고해상도 고도 지도를 새로 만들었습니다. 해상도가 기존 10~20km에서 2~3km로 높아졌고, 이 지도는 향후 NASA·ESA 임무를 위해 크리에이티브 커먼즈로 공개됐습니다.
  • GPU 커널 최적화: 오픈소스 딥러닝 모델 7개를 최대 2.5배 가속했고(출력 동일), 이 최적화로 해당 분석의 GPU 비용을 30~60% 줄일 수 있다고 밝혔습니다.

데이터·안전: 30일 보관 논란, EFS로 풀다

Fable 계열의 가장 큰 걸림돌은 데이터였습니다. Covered Models 정책상 프롬프트와 출력이 안전 목적을 위해 30일간 보관됐기 때문에, 민감 데이터를 다루는 기업 도입이 어려웠습니다. 이번 발표의 핵심은 이를 뒤집는 Enterprise Frontier Safeguards(EFS)입니다.

EFS는 데이터를 Anthropic이 아닌 고객이 완전히 통제하는 클라우드 인프라에 저장합니다. 사람이 검토해야 할 때도 원칙적으로 Anthropic이 아닌 고객사가 직접 합니다. 사실상 제로 데이터 보존과 동등한 프라이버시를 유지하면서 악용 방지 기능은 그대로 두는 구조입니다. 금융·의료·제조 등 100곳 넘는 고객사와 AWS·구글 클라우드·애저와 함께 개발했고, 올해 가을부터 단계적으로 제공됩니다. EFS가 준비되기 전까지 자격이 되는 고객은 Fable 5.1을 제로 데이터 보존 조건으로 쓸 수 있습니다.

안전장치 정밀도도 높아졌습니다.

  • 사이버 보안: 오탐(false positive) 차단이 이전보다 60% 줄었습니다. 이제 Fable 5.1로 소프트웨어 취약점 발견 작업이 허용됩니다. 다만 익스플로잇 개발, 침투 테스트, 바이너리 취약점 스캔 같은 이중 용도 작업은 여전히 Opus 모델로 리디렉션됩니다.
  • 생명과학: 기초 생물학·의료 관련 정상 질문의 오탐이 85% 감소했습니다. 연구개발 수준의 질의는 계속 Opus로 안내되며, 전문 연구용 접근은 미국 정부와 함께 만든 Mythos 5.1 접근 프로그램으로 열립니다.
  • 증류 방지: 새 API 계정은 이전 대화 맥락을 수동 편집하면서 사고 기록을 보존하는 방식이 차단됩니다. 공개적으로 알려졌던 증류 공격 기법을 원천 봉쇄한 것입니다.
  • EU AI Act: 8월 2일 이후 출시 모델은 출력에 눈에 보이지 않는 워터마크가 포함되며, 감지 API는 규제기관·언론 등을 대상으로 비공개 프리뷰로 열렸습니다.

개발자 필독: 깨짐 변경 3가지

이미 Fable 5를 API로 호출 중이라면 마이그레이션 전에 아래 3가지를 반드시 점검하세요. 전부 요청이 실패하거나 동작이 바뀌는 변경입니다.

  1. 강제 도구 호출 미지원: tool_choice{"type": "any"}나 특정 도구 지정을 넣으면 400 에러가 반환됩니다. 사고가 항상 켜져 있어 강제 호출이 이를 건너뛰기 때문입니다. 대안은 auto + strict 도구 사용, 또는 구조화 출력입니다.
  2. 사고 블록 호환 방향: Fable 5.1은 이전 모델의 사고 블록을 읽을 수 있지만, 이전 모델은 Fable 5.1의 사고 블록을 읽지 못합니다. Fable 5.1에서 다른 모델로 전환하는 폴백 라우터를 쓰면 해당 턴의 추론이 사라집니다.
  3. 이전 턴 편집 시 사고 블록 무효화: thinking 블록 앞의 시스템 프롬프트·도구·메시지를 수정하면 다음 요청에서 에러가 나거나 블록이 삭제됩니다. 2026년 8월 31일 이후 생성 계정은 강제 적용입니다. 직접 messages 배열을 만드는 코드라면 마이그레이션 전에 꼭 점검하세요.

코드 변경 없이 체감되는 동작 변화도 있습니다. 병렬 도구 호출이 더 변동적이어서(한 턴에 하나씩 호출하는 경우가 늘어남) 긴 에이전트 루프에서는 토큰과 시간이 더 들 수 있습니다. 독립적 호출을 한꺼번에 하라는 한 줄 지시를 프롬프트에 추가하면 해결됩니다. 또한 low effort에서는 검색 도구를 덜 쓰고 기억으로 답하는 경향이 있어, 최신 정보가 필요한 턴은 effort를 높이는 편이 안전합니다.

추가된 기능도 있습니다. 대화 중간 effort 변경(베타), 턴 단위 시스템 메시지(베타), 도구 호출 사이에 사람이 읽을 수 있는 진행 상황 표시(display: "updates", 베타), 콘텐츠 출처 정보입니다.

What’s New 공식 문서 보기

플랜별 사용법: 내 요금제에서는 어떻게 쓰나

Fable 5.1은 모든 유료 플랜(Pro·Max·Team·Enterprise)에서 쓸 수 있으며, 무료 플랜에서는 사용할 수 없습니다. 과금 방식은 플랜에 따라 다릅니다.

  • Max, Team 프리미엄 시트: 플랜에 포함. 주 사용 한도의 최대 50%까지 Fable 모델에 추가 비용 없이 사용 가능. 한도를 넘기면 사용 크레딧으로 계속 쓰거나 다른 모델로 전환.
  • Pro, Team 표준 시트: 플랜 한도에 포함되지 않고 처음부터 사용 크레딧(종량제)으로 동작. 참고로 7월 Fable 5 전환 때의 일회성 크레딧은 5.1에는 없습니다.
  • API·종량제 Enterprise: 표준 API 요율로 과금(입력 $10/출력 $50).

Claude Code에서 쓰려면 2.1.250 이상 버전이 필요하고, Cowork는 최신 Claude Desktop 버전이 필요합니다. 웹·모바일·데스크톱에서는 모델 선택기에서 “Fable 5.1″을 고르면 됩니다. Claude Security 제품에는 Mythos 5.1이 이미 적용됐습니다.

플랜별 Fable 모델 안내 보기

실무 적용 체크리스트

  • ☐ 내 워크로드가 캐시 읽기 비중이 높은 긴 에이전트 세션인지 확인 (맞다면 5.1 전환만으로 비용 절감)
  • ☐ Fable 5 호출 코드에서 강제 도구 호출(tool_choice: any/tool) 사용 여부 점검
  • ☐ 폴백 라우터가 5.1 → 이전 모델 방향으로 전환하지 않는지 확인
  • ☐ messages 배열을 수동 조립하는 코드에서 이전 턴 편집 패턴 점검
  • ☐ 민감 데이터 처리 시 제로 데이터 보존 자격 또는 가을 출시 예정인 EFS 신청 검토
  • ☐ 사이버 보안 용도로 쓴다면 취약점 ‘발견’은 허용, 익스플로잇 계열은 리디렉션된다는 점 숙지
  • ☐ Claude Code 버전 2.1.250 이상 업데이트
  • ☐ 비용 민감 배치 작업은 Batch API(50% 할인) 적용 검토

자주 묻는 질문 (FAQ)

Q1. Fable 5에서 5.1로 무조건 갈아타야 하나요?

코드만 놓고 보면 성능은 오르고 가격은 내려갔으니 전환이 유리합니다. 다만 깨짐 변경 3가지 때문에 호출 코드를 점검 없이 모델 ID만 바꾸면 400 에러가 날 수 있습니다. 위 체크리스트를 먼저 확인하세요. 단순 작업이라면 반값인 Opus 5로도 충분한 경우가 많습니다.

Q2. 거부 응답 처리 방식이 바뀌었나요?

Fable 5와 동일합니다. 거부된 요청은 에러가 아니라 HTTP 200에 stop_reason: "refusal"로 옵니다. 서버 사이드 폴백이나 SDK 미들웨어로 다른 모델에 재시도할 수 있고, 5.1은 폴백 시 캐시 쓰기 비용을 크레딧으로 돌려줍니다. 허용된 폴백 대상은 Opus 4.8과 Opus 5입니다.

Q3. Mythos 5.1은 어떻게 쓸 수 있나요?

일반적으로는 쓸 수 없습니다. 사이버 보안 검증 프로그램(CVP)과 생명과학 검증 프로그램(LSVP) 등 신뢰 접근 프로그램을 통해서만 제공되며, 현재는 미국 일부 조직 중심입니다. 국내 보안팀이라면 CVP 신청 페이지를 주시할 만합니다.

Q4. 지식 기준 시점이 언제인가요?

2026년 6월입니다. Fable 5보다 최신 정보를 갖고 있지만, 그 이후 사건은 웹 검색이나 문서 주입으로 보완해야 합니다.

결론: “성능 1위”보다 중요한 두 가지

Claude Fable 5.1은 리더보드 1위, 과학 벤치마크 두 배라는 화려한 숫자로 나왔습니다. 하지만 실무에서 진짜 의미 있는 변화는 캐시 읽기 75% 인하로 에이전트 비용 구조를 바꾼 것, 그리고 EFS로 기업 데이터 걱정 없이 쓸 수 있는 길을 연 것입니다. Fable 5 도입을 막았던 두 장벽이 동시에 낮아진 셈입니다.

지금 해야 할 일은 명확합니다. 기존 Fable 5 사용자라면 깨짐 변경 3가지를 점검한 뒤 모델 ID를 claude-fable-5-1로 전환하고, 아직 Claude를 안 쓰고 있다면 내 작업이 Opus 5로 충분한지부터 평가해보세요. 최강 모델은 필요할 때만 쓰는 것이 가장 싸게 쓰는 법입니다.

함께 읽으면 좋은 글