클로드 페이블 5.1이 나왔는데 오퍼스 5와 뭘 골라야 할까 — 캐시 읽기 75% 인하의 뜻

Anthropic이 2026년 9월 1일 클로드 페이블 5.1을 내놓았습니다. 정가는 페이블 5와 같은 100만 토큰당 입력 10달러·출력 50달러인데, 캐시 읽기 단가만 1달러에서 0.25달러로 75% 내렸습니다. 7월에 나온 오퍼스 5는 절반 값(5달러·25달러)이고 Anthropic 스스로 “대부분의 작업은 오퍼스 5부터”라고 안내합니다. 그러면 언제 페이블 5.1을 써야 할까요. 이 글은 두 모델의 사양을 공식 문서 기준으로 나란히 놓고, 캐시 인하가 실제 청구액을 어떻게 바꾸는지 계산해 봅니다. 수치는 2026년 9월 6일 기준입니다.

사양 비교

구분클로드 페이블 5.1클로드 오퍼스 5클로드 소네트 5
출시2026-09-012026-07-24—
입력 / 출력$10 / $50$5 / $25$2 / $10
캐시 읽기$0.25 (입력의 2.5%)$0.50 (입력의 10%)$0.20
캐시 쓰기$12.50$6.25$2.50
컨텍스트 / 최대 출력100만 / 12.8만100만 / 12.8만100만 / 12.8만
지식 컷오프(신뢰)2026년 6월2026년 5월2026년 1월
속도느림보통빠름
사고(thinking)적응형, 항상 켜짐적응형적응형
은퇴 약속2027-09-01 이전 없음2027-07-24 이전 없음2027-06-30 이전 없음

컨텍스트와 출력 한도는 셋이 같습니다. 다른 것은 정가, 캐시 비율, 컷오프, 속도입니다. 페이블 5.1은 “사고”를 끌 수 없는 유일한 모델이라 짧은 질문에도 생각하는 시간이 붙습니다. 그래서 문서가 “느림”으로 표시합니다.

캐시 읽기 75% 인하가 뜻하는 것

캐시 읽기는 같은 앞부분(시스템 프롬프트, 파일, 앞선 대화)을 다시 보낼 때 적용되는 단가입니다. 에이전트 작업은 매 턴 같은 문맥을 다시 읽으므로 토큰의 대부분이 캐시 읽기입니다. Anthropic은 이 인하로 “일반 작업은 약 25%, 고도로 에이전트적인 작업은 최대 약 45%” 비용이 준다고 밝혔습니다.

숫자로 보면 이렇습니다. 문맥 20만 토큰을 캐시에 올려 두고 50턴을 돌리는 작업을 가정합니다. 캐시 읽기 총량은 약 1,000만 토큰입니다.

모델캐시 읽기 1,000만 토큰비고
페이블 5$10.00인하 전
페이블 5.1$2.50인하 후
오퍼스 5$5.00정가는 절반이지만 캐시는 10%

즉 캐시 읽기만 보면 페이블 5.1이 오퍼스 5보다 싸집니다. 물론 출력(50달러 대 25달러)과 첫 캐시 쓰기(12.50달러 대 6.25달러)는 여전히 두 배라, 문맥 반복이 많고 출력이 짧은 작업일수록 페이블 5.1 쪽으로 기웁니다. 반대로 짧은 문맥에 긴 답을 받는 작업은 오퍼스 5가 절반입니다. 컨텍스트가 차면 무슨 일이 생기는지는 컨텍스트 윈도우 글에서 다뤘습니다.

Anthropic이 권하는 선택 기준

공식 모델 문서는 이렇게 적습니다. “어떤 모델을 쓸지 모르겠다면 대부분의 작업은 오퍼스 5로 시작하라. 까다로운 추론과 장시간 에이전트 작업, 또는 오퍼스 5의 추론 강도를 올려도 평가 결과가 부족할 때 페이블 5.1을 써라.” 순서가 중요합니다. 처음부터 페이블이 아니라, 오퍼스에서 강도를 올려 보고 그래도 안 될 때 올라가라는 뜻입니다. 추론 강도(effort)가 무엇인지는 추론 수준 설정 글에서 설명했습니다.

  • 페이블 5.1이 맞는 경우: 수백 파일을 문맥에 두고 수십 턴을 이어 가는 리팩터링, 며칠짜리 연구 과제, 오퍼스에서 실패한 평가 세트.
  • 오퍼스 5가 맞는 경우: 대부분의 코딩·문서 작업, 출력이 긴 작업, 지연이 신경 쓰이는 대화형 서비스.
  • 소네트 5가 맞는 경우: 속도와 값이 우선인 대량 작업. 컷오프가 1월이라 최근 사건을 묻는 용도에는 약합니다.

페이블 5와 미소스 5.1은 어떻게 되나

페이블 5는 “여전히 쓸 수 있는 이전 모델”로 내려갔고 캐시 읽기는 1달러 그대로입니다. 같은 값이면 5.1로 옮기지 않을 이유가 없습니다. 미소스 5.1은 페이블 5.1과 같은 모델에 사이버보안·생물학 안전장치를 느슨하게 둔 판으로, 검증된 기관에만 열립니다. 6월의 페이블 5와 미소스 5의 관계가 그대로 이어진 구조입니다. 페이블 5.1은 claude.ai의 Pro·Max·Team·Enterprise 요금제와 API, AWS·Google Cloud·Microsoft Foundry에서 쓸 수 있습니다.

API가 아니라 앱에서 쓴다면

claude.ai에서는 모델을 고르는 것보다 요금제가 먼저입니다. 가격 페이지 기준으로 무료 요금제는 페이블 5.1 대상이 아니고, Pro는 월 20달러(연간 결제 시 월 17달러, 200달러 선결제), Max는 월 100달러부터입니다. 페이블 5.1은 Pro·Max·Team·Enterprise에서 열리며, 요금제 안의 사용량 한도를 페이블에 쓰면 오퍼스보다 빨리 소진됩니다. 같은 한도로 더 많은 턴을 쓰고 싶다면 앱에서도 오퍼스 5를 기본으로 두는 편이 낫습니다.

표의 “은퇴 약속”은 Anthropic이 자사 API에서 그 모델을 내리지 않겠다고 약속한 최소 기한입니다. 페이블 5.1은 2027년 9월 1일, 오퍼스 5는 2027년 7월 24일 이전에는 은퇴하지 않습니다. 장기 파이프라인을 짤 때 이 날짜가 모델 교체 계획의 기준이 됩니다. 아마존 베드록과 구글 클라우드는 자체 일정을 따르므로 그쪽에서 쓴다면 별도로 확인해야 합니다.

자주 묻는 질문

클로드 코드에서는 어느 모델을 기본으로 두나요?

요금제와 설정에 따라 다릅니다. 문서의 권고대로라면 오퍼스 5를 기본으로 두고, 큰 작업에서만 페이블 5.1로 바꾸는 운영이 비용 대비 효율적입니다. 요금제별 한도는 클로드 코드 요금 정리를 참고하십시오.

캐시는 자동으로 적용되나요?

API에서는 프롬프트 캐싱을 명시해야 하고, claude.ai와 클로드 코드는 내부에서 알아서 씁니다. 클로드 코드는 9월 업데이트에서 캐시가 빗나간 이유를 /cost에 표시하기 시작했습니다.

페이블 5.1이 항상 더 정확한가요?

Anthropic이 공개한 벤치마크에서는 페이블 5.1이 오퍼스 5를 앞서지만, 작업마다 차이가 다릅니다. 문서가 “오퍼스에서 평가해 보고 부족할 때”라고 조건을 단 이유입니다.

정리

페이블 5.1은 값을 내린 것이 아니라 반복 문맥의 값을 내린 것입니다. 그래서 짧게 묻고 길게 받는 일에는 오퍼스 5가 여전히 절반이고, 같은 문맥을 오래 붙잡는 일에서는 페이블 5.1이 오퍼스보다 싸질 수 있습니다. 시작은 오퍼스, 부족할 때 페이블. 이 순서만 지키면 됩니다. 9월 첫 주에 나온 아스트라·3.8 플래시와의 비교는 세 모델 비교 글에 있습니다.

공식 출처: Anthropic 모델 문서 · 클로드 가격 페이지 · 클로드 페이블 소개 (2026년 9월 6일 확인)

이 갈래에서 이어 읽기