Claude Fable 5.1: 캐시 읽기 75% 인하가 에이전트 비용 구조를 어떻게 바꾸나
2026년 9월 1일 나온 Claude Fable 5.1은 헤드라인 가격을 유지한 채 캐시 읽기 단가를 100만 토큰당 1달러에서 0.25달러로 내렸습니다. Anthropic은 에이전트형 워크로드에서 실효 비용이 최대 45%가량 준다고 말합니다. 같은 모델의 두 이름(Fable/Mythos), 1M 컨텍스트, 안전장치 변화를 AX 관점에서 정리했습니다.

Anthropic은 2026년 9월 1일 Claude Fable 5.1과 Claude Mythos 5.1을 공개했습니다. 둘은 같은 모델입니다. Fable이 안전장치를 갖춘 일반 공개판이고, Mythos는 검증된 사이버보안·생명과학 기관에 제한 공개되는 판입니다. 6월의 Fable 5/Mythos 5 구조를 잇습니다. 스펙은 컨텍스트 100만 토큰, 출력 최대 128K, 항상 켜진 적응형 사고, 지식 기준 2026년 6월이고, Claude API와 AWS·Google Cloud·Azure에서 `claude-fable-5-1`로 부릅니다.
가격표에서 중요한 한 줄
입력 100만 토큰당 10달러, 출력 50달러라는 헤드라인은 그대로입니다. 바뀐 것은 캐시 읽기 단가가 1달러에서 0.25달러로 75% 내린 점입니다. Anthropic은 이 때문에 일반 워크로드에서 약 25%, 에이전트형 워크로드에서 최대 약 45% 실효 비용이 준다고 설명합니다. 에이전트는 같은 시스템 프롬프트·도구 정의·브랜드 사실을 매 턴 다시 읽기 때문에 캐시 비중이 큽니다. 즉 이 인하는 '캐시를 잘 설계한 팀'에게만 돌아갑니다. 프롬프트 앞부분을 안정적으로 고정하고, 자주 바뀌는 내용을 뒤로 보내는 컨텍스트 엔지니어링이 곧 비용 절감입니다.
안전장치와 오탐
Fable 5에서는 사이버보안·생물/화학·모델 증류 관련 요청을 분류기가 잡으면 덜 강한 모델이 대신 답했습니다. 5.1은 안전장치를 개선해 Claude Code 사용자의 사이버보안 오탐이 약 60% 줄었다고 하며, 취약점 발견은 가능하되 익스플로잇 개발은 막습니다. 기업 입장에서 오탐 감소는 체감이 큽니다. 보안 점검 자동화처럼 정당한 작업이 막히는 빈도가 줄기 때문입니다. 벤치마크 수치(GDPval-AA v2 1,853, AutomationBench 31.4% 등)는 공급자 보고이므로 독립 검증으로 읽지 않습니다.
노벤티스가 적용하는 방식
- 캐시 친화 하네스: 브랜드 사실·업무 규칙·도구 정의를 앞에 고정하고 해시로 버전을 관리합니다. 바뀌면 캐시가 깨지므로 변경 자체를 기록합니다.
- 판정 구간에만 상위 모델: 분류·검수처럼 판단이 필요한 구간에 Fable 5.1을, 나머지는 더 싼 모델이나 규칙으로 처리합니다.
- 회귀 세트로 교체 검증: 자사 제품의 답 유출·형식 위반 시나리오를 같은 세트로 다시 돌린 뒤 교체합니다.
이 글은 Claude Fable 5.1을 실제로 써서 초안 검토에 참여한 작업 흐름에서 나왔습니다. 모델 하나에 묶이지 않는다는 원칙은 그대로입니다.