
Claude Opus 5.5 vs Claude Opus 5: 업그레이드할 가치가 있나
400을 반환하고, 기본 effort는 high에서 medium으로 내려가며, 같은 effort 수준에서 모델은 턴당 더 많이 사고합니다.한눈에 보는 결정
| 상황 | 할 일 | 이유 |
|---|---|---|
| 새 워크로드, Opus 기준선 없음 | Opus 5.5에서 시작 | Anthropic 권장 기본값, 낮은 정가, 같은 한도 |
Opus 5 프로덕션 운영 중, thinking 켜짐, tool_choice: auto | 카나리 뒤에서 5.5 시범 도입 | effort를 명시하면 코드는 대개 그대로 넘어가지만, 아래 다섯 가지 리스크(thinking 설정, 도구 선택, 진행 텍스트, thinking 블록 폴백, computer use 버전)는 반드시 점검 |
Opus 5 프로덕션 운영 중, thinking: disabled 또는 강제 도구 선택 사용 | 요청부터 고치고 그다음 시범 도입 | 두 패턴 모두 5.5에서 400 |
| 큰 안정 프리픽스를 가진 캐시 중심 에이전트 | 시범 도입 우선 | 5.5의 캐시 읽기가 60% 저렴 |
| 대화 중간에 Opus에서 Sonnet이나 Haiku로 떨어지는 폴백 체인 | 폴백 경로 재테스트 | Opus 5.5 thinking 블록은 Fable 5.1과 Mythos 5.1만 읽음 |
| 도구 호출 사이의 텍스트를 보여주는 스트리밍 UI | 배포 전에 thinking.display 처리 추가 | 그 텍스트는 이제 thinking 블록으로 오고 기본값은 비어 있음 |
| 지연에 민감해 속도 때문에 thinking을 꺼 두었음 | 5.5의 low effort를 thinking 끈 Opus 5와 비교 | thinking은 끌 수 없고 effort가 유일한 레버 |
이 표에는 무조건적인 승자가 없습니다. 워크로드가 Anthropic이 최적화한 종류이고 요청 형태가 이미 호환될 때 업그레이드가 이득이며, 그렇지 않으면 먼저 엔지니어링 시간이 듭니다.
Anthropic이 바꾼 것
| 항목 | Claude Opus 5 | Claude Opus 5.5 | 출처 |
|---|---|---|---|
| 출시 | 2026년 7월 24일 | 2026년 9월 22일 | 릴리스 노트 |
| 모델 ID | claude-opus-5 | claude-opus-5-5 | 모델 개요 |
| 입력 / 출력 | $5 / $25 per MTok | $4 / $20 per MTok | 가격 |
| 캐시 쓰기 5분 / 1시간 | $6.25 / $10 | $5 / $8 | 가격 |
| 캐시 읽기 | $0.50(입력의 10%) | $0.20(입력의 5%) | 가격 |
| Batch | $2.50 / $12.50 | $2 / $10 | 가격 |
| Fast mode(Claude API 전용) | $10 / $50 | $8 / $40 | 가격 |
| 컨텍스트 / 최대 출력 | 1M / 128K | 1M / 128K | 모델 개요 |
| Thinking | 기본 켜짐. effort high 이하에서 disabled 허용 | 항상 켜짐. disabled와 budget_tokens는 400 | What's new |
| 기본 effort | high | medium | 모델 개요 |
강제 도구 선택(any, tool) | 지원 | 400 반환 | What's new |
| 도구 호출 사이 텍스트 | text 블록 | 진행 상황 thinking 블록, 기본 표시에서는 비어 있음 | What's new |
| Thinking 블록 이식성 | Opus 5.5, Fable 5.1, Mythos 5.1이 읽음 | Fable 5.1과 Mythos 5.1만 읽음 | What's new |
| Claude API / Google Cloud의 computer use | 툴셋 또는 computer_20251124 | 툴셋만 | What's new |
| 세이프가드 범주 | cyber | cyber, bio, reasoning_extraction | What's new |
| 지식 기준일 | 더 이전 | 2026년 6월 | 모델 개요 |
| 퇴역 하한 | 2027년 7월 24일 이전 없음 | 2027년 9월 22일 이전 없음 | 모델 개요 |
이 표의 모든 항목은 검증 가능한, 문서화된 계약 변경입니다. Anthropic의 성능 주장은 별개의 범주입니다. FrontierCode 선두 결과, "on most work"에서 Claude Fable 5.1과 동등, 30% 이상 빠른 출력, Opus 5보다 40% 낮은 운영 비용을 보고하지만, 이는 Anthropic 자체 작업 구성에 대한 주장입니다. 여러분의 평가가 검증할 가설로 다루세요.
같은 기준의 비용: 20%, 60%, 아니면 40%?
세 가지 숫자가 돌고 있고, 각각 다른 것을 측정합니다.
- **20%**는 입력과 출력의 정가 차이입니다. 동작 차이를 따지기 전, 모든 토큰에 적용됩니다.
- **60%**는 캐시 읽기의 정가 차이입니다. 입력 중 캐시에서 제공되는 부분에만 적용됩니다.
- **40%**는 Anthropic 자체 워크로드에서의 총 운영 비용 추정치입니다. 단가 인하와 작업 완료당 토큰 감소를 묶은 숫자라서, 여러분의 작업이 새 모델에서 어떻게 동작하는지에 달려 있습니다.
아래 표는 세 가지 고정 토큰 구성에 정가를 적용한 것으로, 1,000개 작업당 금액입니다. 가격 계산이며 품질을 반영한 비용은 아닙니다.
| 워크로드(작업당) | Opus 5 | Opus 5.5 | 변화 |
|---|---|---|---|
| A. 단일 호출, 캐시 없음: 입력 20K, 출력 4K | $200.00 | $160.00 | -20% |
| B. 캐시 중심 에이전트: 캐시 읽기 60K, 신규 입력 10K, 캐시 쓰기 5K, 출력 6K | $261.25 | $197.00 | -25% |
| C. A와 같지만 5.5가 같은 effort에서 출력 토큰을 25% 더 냄 | $200.00 | $180.00 | -10% |
xhigh와 max에서 그렇다고 말하며, 사고는 출력으로 과금됩니다. 구성 A에서 Opus 5.5는 출력 토큰을 최대 50% 더 내도 작업당 가격이 Opus 5와 같아질 뿐입니다. 실제로 그렇게 되는지는 선택한 effort 수준과, 모델이 더 적은 턴으로 승인 가능한 결과에 도달하는지에 달려 있습니다. 후자가 Anthropic의 40% 숫자가 나온 곳입니다.호환성 리스크, 문제가 터지는 순서대로
1. 이제 실패하는 요청
400 오류는 Anthropic API의 동작입니다. EvoLink에서는 게이트웨이가 구형 thinking: disabled와 budget_tokens 설정을 거부하는 대신 adaptive thinking으로 변환하며, 강제 도구 선택은 Chat Completions와 Messages 두 엔드포인트 모두에서 거부됩니다. 게이트웨이 동작은 Claude Opus 5.5 모델 페이지에 문서화되어 있습니다.thinking: {"type": "disabled"}와 thinking: {"type": "enabled", "budget_tokens": N}는 모두 400 invalid_request_error를 반환합니다. tool_choice: {"type": "any"}와 {"type": "tool", "name": ...}는 토큰 카운팅 엔드포인트를 포함해 400을 반환합니다. Claude API와 Google Cloud에서는 computer_20251124 도구 항목이 400을 반환하므로 대신 computer_toolset_20260801을 선언하세요.thinking 필드를 제거하거나 동등한 thinking: {"type": "adaptive"}를 보내고, output_config.effort를 명시적으로 설정합니다. tool_choice: auto를 유지하고, 스키마에 맞는 인자를 내야 하는 도구에는 strict: true를 설정하거나 스키마를 structured outputs로 옮기고, 도구를 언제 써야 하는지 프롬프트에 적으세요. 그런 다음 루프에서 실제로 도구 호출이 일어났는지 확인하세요. auto는 호출을 보장하지 않습니다.2. 조용히 움직이는 기본값
effort를 생략한 요청은 Opus 5에서는 high로, Opus 5.5에서는 medium으로 실행됩니다. 프로덕션 요청에서 effort를 한 번도 설정하지 않았다면, 첫 Opus 5.5 리플레이는 동일 조건 비교가 아닙니다. 결과를 읽기 전에 두 모델 모두에 수준을 명시하고, 그다음 5.5에서 low, medium, high를 스윕하세요.3. 사라지는 진행 상황 텍스트
text 블록으로 반환했습니다. Opus 5.5는 이를 진행 상황 thinking 블록으로 반환하며, 각 도구 호출 전에 최대 하나, 기본값 display: "omitted"에서는 thinking 필드가 비어 있습니다. 오류는 없고 스트리밍 UI가 조용해질 뿐입니다. thinking.display를 "updates"(베타 헤더 thinking-display-updates-2026-08-18) 또는 "summarized"로 설정하고, 비어 있지 않은 thinking 블록을 그것이 앞서는 도구 호출 앞에 렌더링하며, 블록은 변경 없이 되돌려 보내세요.4. 추론을 잃는 폴백 체인
400을 받습니다. 이력은 추가만 하고, system prompt나 도구를 편집하는 대신 대화 중간 system 메시지를 사용하세요.5. 새로운 거부 범주
stop_reason: "refusal"과 함께 stop_details.category가 bio 또는 reasoning_extraction으로 반환됩니다. 서버 측 폴백은 reasoning_extraction을 재시도하지 않습니다. Opus 5 통합에서 stop_reason을 한 번도 확인하지 않았다면 시범 도입 전에 그 확인을 추가하세요.여섯 가지 시나리오와 각각이 증명해야 할 것
| 시나리오 | 입력에서 출력 | "더 낫다"의 의미 | Opus 5.5에서 볼 것 |
|---|---|---|---|
| 다중 파일 코드 변경 | 저장소 컨텍스트에서 패치 | 테스트 통과. 리뷰어가 더 적은 수정으로 승인 | 선택한 effort에서의 출력 토큰. 그린까지의 단계 수 |
| 다중 턴 도구 에이전트 | 작업과 도구 스키마에서 일련의 도구 호출 | 작업 완료. 실패 후 루프 복구 가능 | auto가 여전히 도구를 호출하는지. 진행 블록 렌더링. thinking 블록 반환 |
| 긴 문서 분석 | 문서와 이미지에서 출처가 있는 결론 | 주장이 증거 집합과 일치. 누락 없음 | 인용 검사. Anthropic은 근거 없는 수치가 줄었다고 보고, 검증 필요 |
| 구조화 추출 | 반구조화 텍스트에서 고정 JSON | 스키마 유효율. 필드 정확도 | strict: true가 강제 도구 선택을 대체 |
| 캐시 중심 워크플로 | 고정 프리픽스와 새 작업에서 결과 | 승인율 유지. 청구서가 실제로 감소 | 캐시 히트 비율. 5분과 1시간 쓰기 선택 |
| 다중 모델 폴백 | 실패 또는 타임아웃된 턴에서 대체 라우트 | 대화 지속. 비용 한정 | 어떤 모델이 5.5 thinking 블록을 읽을 수 있는지. 거부 범주 |
이것들은 결과가 아닙니다. 트래픽을 옮기기 전에 채워야 할 승인 기록이며, 작업 클래스당 하나씩, 두 모델에서 같은 프롬프트, 도구, 타임아웃, effort 수준, 재시도 규칙, 리뷰어로 작성합니다.
Opus 5를 유지해야 할 때
thinking: disabled나 강제 도구 선택을 보내고 수정이 배포되지 않은 곳에서도 유지하세요. 모든 5.5 카나리에 대해, 실제 부하에서 p95 지연과 거부 동작을 볼 수 있을 만큼 충분히 돌기 전까지 롤백 라우트로 두세요. 그리고 폴백 체인이 하류 모델이 대화의 thinking 블록을 읽는 데 의존하는 곳에서는, 그 체인을 재테스트하기 전까지 유지하세요.기준선을 모으는 동안의 기다림은 수동적이지 않습니다. Anthropic은 Opus 5를 Active로 등재하고 자사 운영 플랫폼에서의 퇴역 하한을 2027년 7월 24일로 두고 있으니, 출시일이 아니라 증거에 따라 옮길 시간이 있습니다.
안전한 마이그레이션 계획
1. Opus 5 기준선 고정
위 각 클래스에서 대표 작업을 고릅니다. 정확한 요청 형태, effort 수준, 도구 세트, 승인 기준을 기록하고 Opus 5에서 한 번 더 돌려 기준선이 기억이 아닌 최신 상태가 되게 하세요.
2. 요청 형태 수정
thinking: disabled와 budget_tokens를 제거하고, effort를 명시적으로 설정하고, 강제 도구 선택을 auto와 strict로 바꾸고, computer use를 툴셋으로 옮기고, stop_reason 처리를 추가합니다. 이를 먼저 Opus 5에 배포하세요. 모든 변경이 거기서도 유효하므로 요청 수정과 모델 변경을 분리할 수 있습니다.3. effort 스윕 실행
low, medium, high로 리플레이합니다. 각 수준에서 승인 작업률, 출력 토큰, 소요 시간, 승인 작업당 비용을 기록합니다. 작업 클래스별로 승인 기준을 충족하는 가장 저렴한 수준을 고르세요. 습관적으로 Opus 5의 high를 가져오지 마세요.4. 작업 클래스별 카나리
stop_reason, 과금 항목을 기록합니다. 승인 작업당 비용과 품질이 하루의 좋은 결과가 아니라 실제 트래픽의 한 사이클 전체에서 게이트를 통과하면 그 클래스를 승격하세요.5. 되돌아갈 길 정의
claude-opus-5로 되돌리세요. Opus 5는 Opus 5.5의 thinking 블록을 읽을 수 없으므로 대화 중간의 롤백은 이전 추론 없이 이어집니다. 가능하면 새 대화 경계를 시작하세요. 카나리를 시작하기 전에 누가 롤백을 촉발할 수 있고 어떤 신호가 촉발하는지 기록하세요.EvoLink에서는 모델 선택이 요청 안의 문자열이므로 4, 5단계에 코드 배포가 필요하지 않습니다.
Claude Opus 5.5 라우트와 현재 요금 확인 Claude Opus 5 라우트를 롤백으로 유지자주 묻는 질문
Claude Opus 5.5는 Claude Opus 5보다 저렴한가요?
토큰당으로는 그렇습니다. Anthropic은 입력과 출력을 20%, 캐시 읽기를 60% 낮게 책정했습니다. 작업당으로는 여러분의 effort 수준에서 모델이 얼마나 많은 토큰을 쓰는지에 달려 있습니다. Anthropic의 40%는 자사 워크로드에 대한 자사 추정치입니다.
Opus 5.5는 Opus 5를 그대로 대체할 수 있나요?
400을 반환합니다. 기본 effort도 high에서 medium으로 내려가고, 도구 호출 사이의 텍스트는 thinking 블록으로 옮겨갑니다.내 워크로드에서 Opus 5.5가 Opus 5보다 비쌀 수 있는 이유는?
high를 그대로 가져오는 대신 스윕으로 effort를 고르세요.지연 때문에 Opus 5.5에서 thinking을 끌 수 있나요?
effort: low를 쓰고 thinking을 끈 Opus 5 기준선과 지연과 승인율을 비교하세요. thinking을 끈 전제로 작성된 프롬프트에 대한 Anthropic 가이드도 "추론하지 마"류의 지시를 제거하라고 제안합니다.Opus 5.5에서 Opus 5로 폴백하면 thinking 블록은 어떻게 되나요?
Opus 5는 이를 읽을 수 없어 API가 모델이 요청을 보기 전에 버립니다. 요청은 성공하고 버려진 블록은 과금되지 않지만, 남은 턴은 이전 추론 없이 실행됩니다. Opus 5에서 Opus 5.5로 갈 때는 유지됩니다.
강제 도구 선택의 대체 수단이 있나요?
tool_choice: auto를 유지하고, 도구에 strict: true를 설정해 모든 호출이 스키마에 맞게 하고, 도구를 언제 써야 하는지 프롬프트에 적으세요. 순수 JSON 출력이 목적이면 도구 대신 structured outputs를 쓰세요.Opus 5를 폴백으로 남겨 두어야 하나요?
claude-opus-5를 Active로 등재하고 자사 운영 플랫폼에서의 퇴역 하한을 2027년 7월 24일로 두고 있습니다. 위에서 설명한 thinking 블록 동작을 포함해, 폴백하려는 구체적인 라우트를 테스트하세요.어떤 워크로드를 먼저 옮겨야 하나요?
장시간 에이전트 코딩, 대용량 문서 분석, 안정 프리픽스를 가진 캐시 중심 에이전트 순으로 기대 효과가 큽니다. 일상 코딩과 대량·지연 민감 트래픽은 보통 두 Opus가 아니라 Sonnet 5에 속합니다.
출처
- Anthropic: What's new in Claude Opus 5.5
- Anthropic: Migrating to Claude Opus 5.5
- Anthropic: Models overview
- Anthropic: Pricing
- Anthropic: Effort parameter
- Anthropic: Preserved thinking
- Anthropic: Refusals and fallback
- Anthropic: Introducing Claude Opus 5.5


