핵심 요약
Anthropic이 Claude Opus 5를 2026년 7월 24일 출시했습니다. 복잡한 에이전트 코딩과 기업 업무를 겨냥한 모델로, 이전 모델인 Opus 4.8과 같은 비용에서 성능이 크게 향상됐습니다. 모델 ID는 claude-opus-5이고 가격은 $5/$25 per MTok입니다. Claude Max의 새 기본 모델이자 Claude Pro에서 쓸 수 있는 가장 강력한 모델입니다.
주요 기능
-
자기 검증과 반복 개선
긴 에이전트 작업에서는 모델이 결과를 스스로 점검하지 않아 사용자가 검증 절차를 프롬프트에 직접 넣어야 했습니다. Opus 5는 자신의 작업을 검증하고 성공할 때까지 신중하게 반복하는 능력이 크게 강해졌습니다. 공식 마이그레이션 문서는 오히려 기존의 자체 점검 지시를 제거하라고 권합니다. 그대로 두면 과도한 검증이 발생하기 때문입니다.
-
적응형 사고 기본 활성화
Opus 4.8에서는
thinking필드 없이 보낸 요청이 사고 없이 실행됐습니다. Opus 5에서는 같은 요청이 적응형 사고가 켜진 상태로 실행됩니다. 사고 토큰도max_tokens한도에 포함되므로 기존 값을 다시 검토해야 하며, 이전 동작을 유지하려면thinking: {"type": "disabled"}를 명시해야 합니다. -
effort 전체 범위 지원
Opus 5는
low,medium,high,xhigh,max전체 effort 범위를 지원합니다. 지능을 최대로 끌어올릴지, 토큰을 아껴 더 빠르고 저렴한 결과를 받을지 선택할 수 있습니다. 기본값은 Claude API와 Claude Code에서high이며, 능력이 중요한 작업에서는max를 시험해 볼 수 있습니다. -
대화 중간 도구 변경 (베타)
기존에는 대화 도중 사용 가능한 도구 목록을 바꾸면 프롬프트 캐시가 무효화돼 비용과 지연이 늘었습니다. Claude Platform에서
mid-conversation-tool-changes-2026-07-01베타 헤더를 붙이면 캐시 적중을 유지한 채 턴 사이에 도구를 추가하거나 제거할 수 있습니다. -
자동 폴백 (베타)
안전 분류기에 걸린 요청은 지금까지 애플리케이션이 직접 처리해야 했습니다.
server-side-fallback-2026-07-01베타 헤더와fallbacks: "default"를 쓰면 Opus 5(또는 Fable 5)에서 플래그된 요청이 거부 유형에 맞는 다른 모델로 자동 라우팅됩니다. Claude.ai, Claude Code, Claude Cowork에서는 플래그된 요청이 기본적으로 Opus 4.8로 폴백합니다. -
프롬프트 캐시 최소 길이 인하
캐시 가능한 최소 프롬프트 길이가 512토큰으로 내려갔습니다. Opus 4.8의 1,024토큰 기준에서는 너무 짧아 캐시되지 않던 프롬프트도 코드 변경 없이 캐시 항목을 만들 수 있습니다.
벤치마크 성능
| 벤치마크 | 결과 |
|---|---|
| Frontier-Bench v0.1 | 모든 모델을 능가, 더 낮은 비용으로 Opus 4.8의 2배 이상 성능 |
| CursorBench 3.2 | Fable 5 최고 점수와 0.5% 이내, 작업당 비용은 Fable 5의 절반 |
| ARC-AGI 3 | 차순위 모델 대비 3배 점수 |
| Zapier AutomationBench | 기존 Claude 모델과 같은 비용에서 약 1.5배 통과율 |
| OSWorld 2.0 | Fable 5를 능가, 비용은 Fable 5의 3분의 1 |
가격 및 사용처
| 항목 | 내용 |
|---|---|
| 입력 / 출력 | $5 / $25 per MTok (Opus 4.8과 동일) |
| Fast mode | 기본 속도의 약 2.5배, Claude Platform에서 기본 가격의 2배, Claude Code에서는 사용 크레딧 |
| 모델 ID | claude-opus-5 (Amazon Bedrock anthropic.claude-opus-5, Google Cloud claude-opus-5) |
| 컨텍스트 | 1M 토큰 |
| 최대 출력 | 128k 토큰 (Message Batches API에서 output-300k-2026-03-24 베타 헤더로 300k) |
| 학습 데이터 컷오프 | 2026년 5월 |
| 플랜 | Claude Max 기본 모델, Claude Pro에서 가장 강력한 모델 |
| 플랫폼 | Claude.ai, Claude Code, Claude Cowork, Claude API, Amazon Bedrock, Google Cloud |
알아두면 좋은 점
- 기존 Opus 4.8 코드는 그대로 동작하지 않음 —
thinking필드가 없던 요청이 적응형 사고로 실행되고,thinking: {"type": "disabled"}를xhigh또는maxeffort와 함께 쓰면 400 오류가 납니다. 사고를 끈 채로 쓰려면 effort를high이하로 낮춰야 합니다. - 응답 길이와 지시 해석이 달라짐 — Opus 5는 작업 복잡도에 맞춰 응답 길이를 조절해 기본 응답이 더 길어질 수 있고, 지시를 더 문자 그대로 따릅니다. 간결함이 필요하면 프롬프트에 명시하세요.
- 서브에이전트를 더 적극적으로 생성 — Opus 4.8보다 하위 에이전트에 작업을 더 자주 위임하므로, 필요하면 명시적 지침을 주거나 개수를 제한하세요.
- 에이전트 진행 상황 보고 내장 — 중간 상태 메시지를 강제하던 스캐폴딩은 제거해도 됩니다.
- 보안 관련 안전장치 — 소스코드에서 취약점을 찾는 작업은 허용하되 바이너리 기반 취약점 스캐닝은 차단합니다. 안전장치에 막히는 보안 업무는 Cyber Verification Program을 통해 진행할 수 있습니다. 사이버 공격 실행과 자율 생물학 연구 영역에서는 Mythos 5보다 능력이 낮습니다.
- Opus 4.1 은퇴 예정 —
claude-opus-4-1-20250805는 2026년 8월 5일 은퇴하며, 그 전에 Claude Opus 5로 옮기도록 권장합니다.