모델2분 읽기Noventis

Claude Fable 5.1: 캐시 읽기 75% 인하가 에이전트 비용 구조를 어떻게 바꾸나

2026년 9월 1일 나온 Claude Fable 5.1은 헤드라인 가격을 유지한 채 캐시 읽기 단가를 100만 토큰당 1달러에서 0.25달러로 내렸습니다. Anthropic은 에이전트형 워크로드에서 실효 비용이 최대 45%가량 준다고 말합니다. 같은 모델의 두 이름(Fable/Mythos), 1M 컨텍스트, 안전장치 변화를 AX 관점에서 정리했습니다.

앞부분이 잠긴 채 반복 읽기되는 프롬프트 캐시 테이프와 4분의 1을 가리키는 비용 계기. Fable 5.1 캐시 읽기 75% 인하의 구조.
앞부분이 잠긴 채 반복 읽기되는 프롬프트 캐시 테이프와 4분의 1을 가리키는 비용 계기. Fable 5.1 캐시 읽기 75% 인하의 구조.

Anthropic은 2026년 9월 1일 Claude Fable 5.1과 Claude Mythos 5.1을 공개했습니다. 둘은 같은 모델입니다. Fable이 안전장치를 갖춘 일반 공개판이고, Mythos는 검증된 사이버보안·생명과학 기관에 제한 공개되는 판입니다. 6월의 Fable 5/Mythos 5 구조를 잇습니다. 스펙은 컨텍스트 100만 토큰, 출력 최대 128K, 항상 켜진 적응형 사고, 지식 기준 2026년 6월이고, Claude API와 AWS·Google Cloud·Azure에서 `claude-fable-5-1`로 부릅니다.

가격표에서 중요한 한 줄

입력 100만 토큰당 10달러, 출력 50달러라는 헤드라인은 그대로입니다. 바뀐 것은 캐시 읽기 단가가 1달러에서 0.25달러로 75% 내린 점입니다. Anthropic은 이 때문에 일반 워크로드에서 약 25%, 에이전트형 워크로드에서 최대 약 45% 실효 비용이 준다고 설명합니다. 에이전트는 같은 시스템 프롬프트·도구 정의·브랜드 사실을 매 턴 다시 읽기 때문에 캐시 비중이 큽니다. 즉 이 인하는 '캐시를 잘 설계한 팀'에게만 돌아갑니다. 프롬프트 앞부분을 안정적으로 고정하고, 자주 바뀌는 내용을 뒤로 보내는 컨텍스트 엔지니어링이 곧 비용 절감입니다.

안전장치와 오탐

Fable 5에서는 사이버보안·생물/화학·모델 증류 관련 요청을 분류기가 잡으면 덜 강한 모델이 대신 답했습니다. 5.1은 안전장치를 개선해 Claude Code 사용자의 사이버보안 오탐이 약 60% 줄었다고 하며, 취약점 발견은 가능하되 익스플로잇 개발은 막습니다. 기업 입장에서 오탐 감소는 체감이 큽니다. 보안 점검 자동화처럼 정당한 작업이 막히는 빈도가 줄기 때문입니다. 벤치마크 수치(GDPval-AA v2 1,853, AutomationBench 31.4% 등)는 공급자 보고이므로 독립 검증으로 읽지 않습니다.

노벤티스가 적용하는 방식

  • 캐시 친화 하네스: 브랜드 사실·업무 규칙·도구 정의를 앞에 고정하고 해시로 버전을 관리합니다. 바뀌면 캐시가 깨지므로 변경 자체를 기록합니다.
  • 판정 구간에만 상위 모델: 분류·검수처럼 판단이 필요한 구간에 Fable 5.1을, 나머지는 더 싼 모델이나 규칙으로 처리합니다.
  • 회귀 세트로 교체 검증: 자사 제품의 답 유출·형식 위반 시나리오를 같은 세트로 다시 돌린 뒤 교체합니다.

이 글은 Claude Fable 5.1을 실제로 써서 초안 검토에 참여한 작업 흐름에서 나왔습니다. 모델 하나에 묶이지 않는다는 원칙은 그대로입니다.

이제, 다음 단계로나아가세요.

어떤 일이 반복되는지 알려주세요.
사람이 더 중요한 일에 집중할 방법을 함께 찾겠습니다.

프로젝트 문의하기