본문 바로가기
AI 트렌드&뉴스

Claude Fable 5.1 — 캐시 읽기가 4분의 1로 내렸다

by 재아군 2026. 9. 27.
반응형

Claude Fable 5.1 — 캐시 읽기가 4분의 1로 내렸다

 

Claude Fable 5.1이 9월 1일에 나왔다.

입력 100만 토큰당 $10, 출력 $50으로 Fable 5와 값이 같다.

 

바뀐 건 한 줄이다.

캐시 읽기가 $1에서 $0.25로 내려갔다.

 

이게 왜 중요하냐면, 긴 에이전트 작업은 같은 프롬프트를 계속 다시 읽기 때문이다.

공식 안내 기준으로 일반 작업 약 25%, 복잡한 코딩·에이전트 작업은 최대 45% 실질 비용이 줄어든다.

 

빠른 판단

 
  • 모델 ID는 claude-fable-5-1이다. Fable 5에서 한 줄만 바꾸면 된다.
  • 입력 $10, 출력 $50은 그대로. 캐시 읽기만 $0.25/MTok로 내려갔다.
  • 컨텍스트 100만 토큰, 최대 출력 12.8만 토큰이다.
  • 강제 도구 호출이 막혔다. tool_choice를 any나 tool로 쓰면 400 오류다.
  • 생성 텍스트에 통계적 워터마크가 들어간다. 토큰이 늘거나 내용이 바뀌지는 않는다.
 

가격에서 뭐가 달라졌나

 

표로 보면 한 칸만 움직였다.

 
항목 가격
입력 $10 / MTok
5분 캐시 쓰기 $12.50 / MTok
1시간 캐시 쓰기 $20 / MTok
캐시 읽기 $0.25 / MTok
출력 $50 / MTok
 

다른 Claude 모델은 캐시 읽기가 기본 입력가의 0.1배인데, Fable 5.1은 0.025배다.

 

그래서 이득이 생기는 구간이 정해져 있다.

같은 프리픽스를 반복해서 읽는 작업이다.

긴 코드베이스를 물고 몇 시간씩 도는 에이전트, 문서 더미를 계속 참조하는 리서치가 여기 해당한다.

 

반대로 한 번 묻고 끝나는 짧은 작업은 차이가 거의 없다.

캐시 자체가 최소 512토큰부터 걸리기 때문이다.

 

배치 처리는 별도다.

입력 $5, 출력 $25로 절반이다.

 

무엇이 좋아졌나

 

Claude Fable 5.1 전환 4단계

 

공식 문서가 여섯 영역을 꼽는다.

 
  • 긴 세션의 에이전트 코딩 — 여러 파일 수정, 대규모 리팩토링, 몇 시간짜리 디버깅
  • 문서·스프레드시트·슬라이드 작업 — 빈 화면에서 완성물까지
  • 리서치와 검색 — 찾은 것을 이어서 파고드는 다단계 조사
  • 비전 — PDF 안의 빽빽한 차트·표 읽기
  • 긴 컨텍스트 — 100만 토큰 전체를 연결해 추론
  • 컴퓨터 사용 — 브라우저·데스크톱 조작과 실패 복구
 

차이는 effort를 높일수록 벌어진다고 안내된다.

낮은 설정으로 쓰면 이전 모델과 체감 차이가 작다는 뜻이다.

 

코드를 고쳐야 할까요

 

모델 ID만 바꾸면 되는 경우가 많지만, 깨지는 변경이 셋 있다.

 

강제 도구 호출이 안 된다.

tool_choice: {"type": "any"}나 {"type": "tool", ...}은 400 오류를 낸다.

사고 과정이 항상 켜져 있는 모델이라 강제 호출이 그 단계를 건너뛰기 때문이다.

스키마를 고정하고 싶으면 auto를 유지한 채 strict tool use나 structured outputs로 옮긴다.

 

사고 블록이 모델에 묶인다.

Fable 5.1이 만든 사고 블록은 이전 모델이 읽지 못한다.

대화를 5.1로 옮기는 건 되지만, 5.1에서 이전 모델로 되돌리면 그 구간의 추론이 사라진다.

 

과거 대화를 수정하면 사고 블록이 무효가 된다.

시스템 프롬프트나 도구 배열을 중간에 다시 만들거나, 지난 메시지에 텍스트를 끼워 넣었다 빼는 방식이 여기 걸린다.

대화를 덧붙이기만 하는 구조로 두는 게 원칙이다.

 

Claude Code나 claude.ai를 쓰는 경우는 해당하지 않는다.

직접 messages 배열을 만드는 코드에서만 확인이 필요하다.

 

새로 생긴 기능

 

셋 다 베타 헤더가 필요하다.

 

대화 중 effort 변경이 가능해졌다.

어려운 단계에서 올리고 단순한 단계에서 내리는데, 프롬프트 캐시가 깨지지 않는다.

한 세션 내내 같은 수준을 유지할 이유가 없어졌다.

 

턴 한정 시스템 메시지가 생겼다.

clear_at: "next_user_message"를 걸면 그 턴에만 시스템 권위로 적용되고 다음 사용자 메시지부터는 렌더링되지 않는다.

"이번에는 받은 편지함부터 확인해라" 같은 일회성 지시를 히스토리에 끼워 넣었다 지우는 방식 대신 쓸 수 있다.

 

도구 호출 사이 진행 상황을 텍스트로 받을 수 있다.

기본값에서는 사고 블록이 비어 있어 긴 작업이 조용해 보이는데, display: "updates"로 상태 줄만 받아 사용자에게 보여줄 수 있다.

 

워터마크가 들어간다

 

이번 모델부터 생성된 텍스트에 통계적 워터마크가 붙는다.

제공되는 모든 플랫폼에서 적용된다.

 

읽는 사람 입장에서 달라지는 건 없다.

의미·품질·가독성이 바뀌지 않고, 토큰이 늘거나 숨은 문자가 들어가지도 않는다.

사용자나 조직 정보도 담기지 않는다.

 

이미지·영상·음성 파일에는 C2PA 콘텐츠 자격증명이 서명돼 붙는다.

AI 생성물 표시가 제도화되는 흐름에서 모델 쪽이 먼저 움직인 셈이다.

 

쓰기 전에 알아둘 차이

 

코드 변경 없이도 동작이 달라지는 지점이 공식 문서에 여럿 적혀 있다.

 

병렬 도구 호출이 줄었다.

Fable 5가 여러 개를 묶어 부르던 자리에서 한 번에 하나씩 부르는 경우가 생긴다.

답 품질이 떨어지는 건 아니지만 턴이 늘어 토큰과 시간이 더 든다.

프롬프트에 독립 작업은 묶어서 호출하라는 한 줄을 넣는 게 해법으로 안내된다.

 

낮은 effort에서 검색을 덜 한다.

기억에 의존해 답하는 경향이 있어, 최신 정보가 필요한 턴은 effort를 올려야 한다.

 

문장이 더 촘촘하고 서식을 덜 쓴다.

굵게·헤더·목록 사용이 줄어서, 예전 모델용으로 써둔 "서식 쓰지 마라" 규칙이 필요한 구조까지 눌러버릴 수 있다.

 

작은 수정에도 파일을 통째로 다시 쓰는 경향이 있다.

결과는 같지만 출력 토큰이 더 들므로, 부분 수정을 명시하는 편이 낫다.

 

자주 묻는 질문 (FAQ)

 

Fable 5보다 비싼가요?

입력·출력 단가는 같다.

캐시 읽기가 4분의 1이라 실질 비용은 내려간다.

 

모델 ID가 뭔가요?

claude-fable-5-1이다.

 

Mythos 5.1은 뭐가 다른가요?

성능은 같고 안전장치 수준이 다르다.

승인된 참가자에게만 제공된다.

 

코드를 많이 고쳐야 하나요?

강제 도구 호출을 쓰고 있거나 대화 히스토리를 직접 편집한다면 손봐야 한다.

아니면 모델 ID만 바꾸면 된다.

 

워터마크 때문에 결과가 달라지나요?

의미·품질·토큰 수에 영향이 없다.

 

오늘 바로 할 것

 
  1. 캐시 읽기 비중을 확인한다. 반복 프리픽스가 크면 이득이 크다.
  2. tool_choice에 any나 tool이 있는지 찾는다. 있으면 오류가 난다.
  3. 히스토리를 직접 편집하는 코드가 있는지 본다. 덧붙이기 구조로 바꾼다.
  4. effort 기본값을 다시 조정한다. 대화 중 변경도 검토한다.
  5. 에이전트 루프라면 도구 묶어 호출 지시를 프롬프트에 추가한다.
 

API 비용 구조를 먼저 잡는 중이라면 Claude API 요금과 캐싱에서 계산법을 정리해뒀고, Fable 계열이 처음이라면 Claude Fable 공개와 개발자 영향 쪽을 먼저 보면 된다.

 

 

출처

반응형

댓글