Claude Opus 5.5 가격 20% 인하, Claude Code 비용도 20% 줄까?
답부터 말하면 토큰 사용량이 그대로인 API 작업은 단가 인하분(입력·출력 20%, 캐시 읽기 60%)만큼 저렴해지지만, 내 청구액이 반드시 20% 줄지는 않는다.
Opus 5.5는 기본 effort가 medium이라 출력 토큰이 줄 수도 있지만, 끌 수 없는 adaptive thinking이 출력 토큰으로 과금되므로 thinking을 끄고 쓰던 작업은 출력이 늘 수도 있기 때문이다.
구독으로 Claude Code를 쓰는 사람은 더 조심해서 읽어야 한다.
Pro·Max의 포함 사용량은 토큰 단가로 직접 청구되지 않으므로, 단가 인하율 대신 5시간 한도 도달 시점과 추가 사용 크레딧을 같은 기간에 기록해야 한다.
가격·사양 확인일은 2026년 9월 28일 KST다.
금액은 100만 토큰당 USD이며 세금·환율·카드 수수료와 별도 도구 비용은 포함하지 않는다.
가격표는 정확히 무엇이 20% 내렸나?
Anthropic은 2026년 9월 22일 Claude Opus 5.5를 공개했다.
공식 발표와 모델 문서 기준으로 컨텍스트는 100만 토큰, 최대 출력은 12만8000토큰이며 adaptive thinking은 항상 켜지고 기본 effort는 medium이다.
Opus 5.5의 표준 API 단가는 입력 $4, 출력 $20, 5분 캐시 쓰기 $5, 1시간 캐시 쓰기 $8, 캐시 읽기 $0.20다.
Opus 5의 $5·$25·$6.25·$10·$0.50과 비교하면 입력·출력·캐시 쓰기는 20%, 캐시 읽기는 60% 낮다.
Anthropic은 기본 설정의 일반 작업에서는 작업당 토큰도 줄어 Opus 5보다 40% 저렴하다고 자체 시험 결과를 밝혔지만, 이 글은 그 수치를 검증하지 않았다.
| 모델 | 입력 | 출력 | 캐시 읽기 | 컨텍스트 / 최대 출력 | 기본 effort |
|---|---|---|---|---|---|
| Claude Opus 5.5 | $4 | $20 | $0.20 | 1M / 128K | medium |
| Claude Opus 5 | $5 | $25 | $0.50 | 1M / 128K | high |
| Claude Fable 5.1 | $10 | $50 | $0.25 | 1M / 128K | high |
| GPT-6 Sol | $2 | $10 | $0.20 | 1.05M / 128K | medium |
| GPT-6 Luna | $0.10 | $0.50 | $0.01 | 1.05M / 128K | medium |
OpenAI의 GPT-6 Sol 모델 문서와 GPT-6 Luna 모델 문서도 같은 조회일에 확인했다.
이 표는 가격·사양 비교일 뿐이며, 서로 다른 모델이 같은 작업에서 같은 토큰과 품질을 낸다는 뜻은 아니다.
Fable 5.1보다 어디서 앞서고, 어디서 남겨 둬야 하나?
Anthropic 공개 평가에서 Opus 5.5는 Terminal-Bench 4.0 66.4%, Fable 5.1은 55.8%였다.
GDPval-AA v2.1도 Opus 5.5가 1846 Elo, Fable 5.1이 1735 Elo였으며, 전자는 Opus 5.5 xhigh 결과이고, 후자는 별도 표기가 없는 Opus 5.5 결과가 max effort라는 발표 조건에 해당한다.
이 두 숫자는 Opus 5.5의 기본 medium 성능을 뜻하지 않는다.
Anthropic도 고성능 구간의 벤치마크 차이가 실제 차이를 덜 정확히 보여줄 수 있고, 내부 사용에서 두 모델의 격차는 표보다 좁았다고 적었다.
확인한 Anthropic 비교표에는 Fable 5.1이 Opus 5.5를 이긴 항목이 없다.
Fable 5.1 모델 문서의 선택 지침은 demanding reasoning·장시간 agentic 작업, 또는 Opus 5를 높은 effort로 돌린 자체 평가가 부족할 때 Fable 5.1을 쓰라고 적었고, 확인일 기준 이 문구는 Opus 5.5로 갱신되지 않았다.
이 글은 그 기준을 Opus 5.5에 옮겨, 높은 effort의 Opus 5.5 자체 평가가 부족할 때만 Fable 5.1을 남기는 것으로 읽는다.
가격에서는 Opus 5.5가 Fable 5.1보다 입력·출력이 60% 낮고 캐시 읽기는 20% 낮다.
다만 Fable 5.1을 유지할지는 공개 벤치마크 한 줄이 아니라 내 저장소의 완료율, 회귀 오류, 사람 수정 시간을 같은 조건에서 비교해 결정해야 한다.
왜 effort가 가격표보다 청구액을 더 흔드나?
Anthropic effort 문서는 effort가 보이는 답변뿐 아니라 thinking, 도구 호출, 함수 인자 등 모든 출력 토큰에 영향을 준다고 설명한다.
낮은 effort는 대체로 도구 호출도 더 적고 짧게 만들지만, effort는 엄격한 토큰 상한이 아니라 행동 신호다.
Opus 5.5는 effort를 생략하면 medium, Opus 5와 Fable 5.1은 high로 실행된다.
모델만 바꾸고 effort를 생략하면 단가와 추론 깊이가 동시에 바뀌므로, “같은 작업의 모델 가격 비교”가 되지 않는다.
반대로 Opus 5에서 thinking을 끄고 돌리던 작업은 Opus 5.5에서 thinking을 끌 수 없고 thinking 토큰이 출력으로 과금되므로, 요청당 출력 토큰이 늘 수 있다고 Opus 5.5 마이그레이션 문서가 적었다.
API 사용자는 먼저 medium에서 자체 평가를 돌리고 품질이 부족한 작업만 high·xhigh·max로 올리는 편이 낫다.
비교 실험에서는 effort를 명시하고 일반 입력, 캐시 쓰기, 캐시 읽기, 전체 출력 토큰을 각각 저장해야 한다.
가상 계산에서 실제 절감률은 얼마인가?
아래 수치는 실제 사용 기록이 아닌 재현 가능한 가정이다.
같은 작업 묶음이 일반 입력 10만, 캐시 읽기 40만, 출력 2만 토큰을 쓰고 캐시 쓰기·도구 비용·할증·할인은 없다고 둔다.
Opus 5 비용은 0.1×$5 + 0.4×$0.50 + 0.02×$25 = $1.20다.
같은 토큰량의 Opus 5.5는 0.1×$4 + 0.4×$0.20 + 0.02×$20 = $0.88이므로 $0.32, 약 26.7% 줄어든다.
절감률이 20%보다 큰 이유는 캐시 읽기 단가가 60% 내렸기 때문이다.
반대로 Opus 5.5의 출력이 3만 토큰으로 50% 늘면 비용은 $1.08이 되어 절감률이 10%로 줄어든다.
같은 가정에서 Opus 5.5 출력이 3만6000토큰, 즉 80% 늘면 비용은 $1.20으로 Opus 5와 같아진다.
이것이 “가격표 20% 인하”를 “청구액 20% 인하”로 바로 바꾸면 안 되는 이유다.
구독 Claude Code에서는 무엇을 재야 하나?
Anthropic 발표는 Pro·Max·Team·좌석형 Enterprise의 5시간 사용 한도를 늘리고 구독자에게 저장해 둘 수 있는 한 번의 rate-limit reset을 제공한다고 밝혔다.
그러나 확인한 공식 발표에는 증가율과 reset 사용 기한이 적혀 있지 않으므로, 다른 글에 도는 “한도 20% 증가”나 “10월 22일 만료” 같은 수치는 이 글에서 쓰지 않는다.
구독자는 한 주 동안 모델, effort, 시작·종료 시각, 5시간 한도 도달 시점, 추가 사용 크레딧을 기록한다.
API 사용자는 Console의 청구 토큰을 기록하고, 구독자는 화면의 포함 한도와 별도 과금을 섞지 않는다.
청구 경로를 나누는 방법은 Claude Code 요금제와 실제 비용에 정리했다.
구독 안에서 작업이 끝나고 추가 사용료가 없다면 API 단가 인하는 월 구독료를 낮추지 않는다.
반대로 한도를 넘겨 추가 사용 크레딧을 자주 쓰는 경우에는 Opus 5.5의 단가와 토큰 효율이 총액에 직접 반영될 수 있다.
처음 설정은 무엇으로 두면 되나?
- 일상 코딩: Opus 5.5 medium에서 시작하고, 같은 완료 조건으로 실패율과 출력 토큰을 기록한다.
- 어려운 회귀·장시간 에이전트: medium이 실패한 작업만 high 이상으로 올린다.
높은 effort에서도 자체 평가가 부족하면 Fable 5.1을 유지한다. - 반복 컨텍스트: 캐시 적중 토큰을 따로 본다.
Opus 5.5 캐시 읽기 $0.20은 절감률을 크게 만들 수 있다. - fast mode: 입력 $8·출력 $40으로 표준의 2배다.
최대 2.5배 속도가 배포 장애, 대화형 디버깅, 마감 시간의 추가 비용보다 가치 있을 때만 쓴다. - 비교 기록: effort, 입력·캐시·출력 토큰, 완료 여부, 재시도, 사람 수정 시간을 한 줄에 남긴다.
어떤 조건에서 결론이 뒤집히나?
출력이 비용 대부분인 작업에서 Opus 5.5의 출력·도구 호출량이 25% 늘면 출력 단가의 20% 인하 효과는 사라진다.
캐시 비중이 크면 반대로 60% 낮은 캐시 읽기 가격 덕분에 총 절감률이 20%를 넘을 수 있다.
Fable 5.1이 내 장시간 작업의 실패와 재작업을 충분히 줄이면 더 높은 토큰 단가가 최종 비용을 낮출 수 있다.
Fast mode도 사람 대기시간이나 장애 시간이 토큰 할증보다 비싼 상황에서는 합리적이다.
결론은 단순하다.
API는 Opus 5.5 medium을 기준선으로 삼아 같은 완료 조건의 총 청구액을 비교하고, 구독은 월 요금이 아니라 한도 도달과 추가 사용료를 비교해야 한다.
공식 출처와 확인 범위
Anthropic, Claude Opus 5.5 발표(2026-09-22)와 Claude Platform 가격 문서, Opus 5.5·Fable 5.1 모델 문서를 2026-09-28 KST에 확인했다.
effort·extended thinking·Opus 5.5 마이그레이션 문서도 같은 날 확인했다.
OpenAI, GPT-6 Sol·GPT-6 Luna 모델 문서를 2026-09-28 KST에 확인했다.
실제 계정의 청구서·구독 한도·작업 성능은 측정하지 않았고 사용자 후기는 근거로 쓰지 않았다.


댓글
댓글 쓰기