GPT Image 2.5 Flare & Sunburst가 EvoLink에 출시되었습니다GPT Image 2.5 체험하기
테라코타와 차콜 경로가 이어진 Claude Opus 5.5 vs 5 비교 커버
비교

Claude Opus 5.5 vs Claude Opus 5: 업그레이드할 가치가 있나

EvoLink Team
EvoLink Team
제품 팀
2026년 9월 22일
25분 소요
짧게 답하면, 장시간 에이전트 코딩, 대용량 문서 분석, 차트가 많은 시각 작업에서 Claude Opus 5.5를 시범 도입하고, 짝지은 리플레이가 다른 결론을 내기 전까지는 Claude Opus 5를 롤백 라우트로 유지하세요. Anthropic 정가 기준으로 Opus 5.5는 토큰당 20%, 캐시 읽기는 60% 저렴하고, Anthropic은 더 적은 토큰으로 작업을 끝낸다고 말합니다. 하지만 그대로 갈아 끼울 수 있는 것은 아닙니다. Opus 5에서 동작하는 네 가지 요청 패턴이 Opus 5.5에서 400을 반환하고, 기본 effort는 high에서 medium으로 내려가며, 같은 effort 수준에서 모델은 턴당 더 많이 사고합니다.
이 가이드는 이미 프로덕션에서 Opus 5를 운영하는 팀을 위한 것입니다. 출시 사실과 "Opus 5.2" 소문의 결말은 Claude Opus 5.5 출시에, EvoLink의 실시간 요금, 모델 ID, 통합 설정은 Claude Opus 5.5 모델 페이지와 Claude Opus 5 모델 페이지에 있습니다. 아래 가격은 Anthropic이 공표한 정가이며, 두 모델을 같은 기준으로 비교하기 위해서만 사용합니다.

한눈에 보는 결정

상황할 일이유
새 워크로드, Opus 기준선 없음Opus 5.5에서 시작Anthropic 권장 기본값, 낮은 정가, 같은 한도
Opus 5 프로덕션 운영 중, thinking 켜짐, tool_choice: auto카나리 뒤에서 5.5 시범 도입effort를 명시하면 코드는 대개 그대로 넘어가지만, 아래 다섯 가지 리스크(thinking 설정, 도구 선택, 진행 텍스트, thinking 블록 폴백, computer use 버전)는 반드시 점검
Opus 5 프로덕션 운영 중, thinking: disabled 또는 강제 도구 선택 사용요청부터 고치고 그다음 시범 도입두 패턴 모두 5.5에서 400
큰 안정 프리픽스를 가진 캐시 중심 에이전트시범 도입 우선5.5의 캐시 읽기가 60% 저렴
대화 중간에 Opus에서 Sonnet이나 Haiku로 떨어지는 폴백 체인폴백 경로 재테스트Opus 5.5 thinking 블록은 Fable 5.1과 Mythos 5.1만 읽음
도구 호출 사이의 텍스트를 보여주는 스트리밍 UI배포 전에 thinking.display 처리 추가그 텍스트는 이제 thinking 블록으로 오고 기본값은 비어 있음
지연에 민감해 속도 때문에 thinking을 꺼 두었음5.5의 low effort를 thinking 끈 Opus 5와 비교thinking은 끌 수 없고 effort가 유일한 레버

이 표에는 무조건적인 승자가 없습니다. 워크로드가 Anthropic이 최적화한 종류이고 요청 형태가 이미 호환될 때 업그레이드가 이득이며, 그렇지 않으면 먼저 엔지니어링 시간이 듭니다.

Anthropic이 바꾼 것

항목Claude Opus 5Claude Opus 5.5출처
출시2026년 7월 24일2026년 9월 22일릴리스 노트
모델 IDclaude-opus-5claude-opus-5-5모델 개요
입력 / 출력$5 / $25 per MTok$4 / $20 per MTok가격
캐시 쓰기 5분 / 1시간$6.25 / $10$5 / $8가격
캐시 읽기$0.50(입력의 10%)$0.20(입력의 5%)가격
Batch$2.50 / $12.50$2 / $10가격
Fast mode(Claude API 전용)$10 / $50$8 / $40가격
컨텍스트 / 최대 출력1M / 128K1M / 128K모델 개요
Thinking기본 켜짐. effort high 이하에서 disabled 허용항상 켜짐. disabled와 budget_tokens는 400What's new
기본 efforthighmedium모델 개요
강제 도구 선택(any, tool)지원400 반환What's new
도구 호출 사이 텍스트text 블록진행 상황 thinking 블록, 기본 표시에서는 비어 있음What's new
Thinking 블록 이식성Opus 5.5, Fable 5.1, Mythos 5.1이 읽음Fable 5.1과 Mythos 5.1만 읽음What's new
Claude API / Google Cloud의 computer use툴셋 또는 computer_20251124툴셋만What's new
세이프가드 범주cybercyber, bio, reasoning_extractionWhat's new
지식 기준일더 이전2026년 6월모델 개요
퇴역 하한2027년 7월 24일 이전 없음2027년 9월 22일 이전 없음모델 개요

이 표의 모든 항목은 검증 가능한, 문서화된 계약 변경입니다. Anthropic의 성능 주장은 별개의 범주입니다. FrontierCode 선두 결과, "on most work"에서 Claude Fable 5.1과 동등, 30% 이상 빠른 출력, Opus 5보다 40% 낮은 운영 비용을 보고하지만, 이는 Anthropic 자체 작업 구성에 대한 주장입니다. 여러분의 평가가 검증할 가설로 다루세요.

같은 기준의 비용: 20%, 60%, 아니면 40%?

세 가지 숫자가 돌고 있고, 각각 다른 것을 측정합니다.

  • **20%**는 입력과 출력의 정가 차이입니다. 동작 차이를 따지기 전, 모든 토큰에 적용됩니다.
  • **60%**는 캐시 읽기의 정가 차이입니다. 입력 중 캐시에서 제공되는 부분에만 적용됩니다.
  • **40%**는 Anthropic 자체 워크로드에서의 총 운영 비용 추정치입니다. 단가 인하와 작업 완료당 토큰 감소를 묶은 숫자라서, 여러분의 작업이 새 모델에서 어떻게 동작하는지에 달려 있습니다.

아래 표는 세 가지 고정 토큰 구성에 정가를 적용한 것으로, 1,000개 작업당 금액입니다. 가격 계산이며 품질을 반영한 비용은 아닙니다.

워크로드(작업당)Opus 5Opus 5.5변화
A. 단일 호출, 캐시 없음: 입력 20K, 출력 4K$200.00$160.00-20%
B. 캐시 중심 에이전트: 캐시 읽기 60K, 신규 입력 10K, 캐시 쓰기 5K, 출력 6K$261.25$197.00-25%
C. A와 같지만 5.5가 같은 effort에서 출력 토큰을 25% 더 냄$200.00$180.00-10%
지켜봐야 할 것은 워크로드 C입니다. Anthropic 문서는 같은 effort 수준에서 Opus 5.5가 Opus 5보다 턴당 더 많이 사고하는 경향이 있고, 특히 xhigh와 max에서 그렇다고 말하며, 사고는 출력으로 과금됩니다. 구성 A에서 Opus 5.5는 출력 토큰을 최대 50% 더 내도 작업당 가격이 Opus 5와 같아질 뿐입니다. 실제로 그렇게 되는지는 선택한 effort 수준과, 모델이 더 적은 턴으로 승인 가능한 결과에 도달하는지에 달려 있습니다. 후자가 Anthropic의 40% 숫자가 나온 곳입니다.
업그레이드를 결정짓는 유일한 비교는 승인된 작업당 비용입니다. 실패, 재시도, 도구 요금을 포함한 평가 그룹의 총 지출을 승인을 통과한 작업 수로 나누고, 사람이 고친 시간은 따로 보고합니다. 다음 절의 effort 스윕 뒤에 하세요. 그 전에는 하지 마세요.

호환성 리스크, 문제가 터지는 순서대로

1. 이제 실패하는 요청

적용 범위: 아래의 400 오류는 Anthropic API의 동작입니다. EvoLink에서는 게이트웨이가 구형 thinking: disabled와 budget_tokens 설정을 거부하는 대신 adaptive thinking으로 변환하며, 강제 도구 선택은 Chat Completions와 Messages 두 엔드포인트 모두에서 거부됩니다. 게이트웨이 동작은 Claude Opus 5.5 모델 페이지에 문서화되어 있습니다.
요청 빌더에서 세 가지 패턴을 찾으세요. thinking: {"type": "disabled"}와 thinking: {"type": "enabled", "budget_tokens": N}는 모두 400 invalid_request_error를 반환합니다. tool_choice: {"type": "any"}와 {"type": "tool", "name": ...}는 토큰 카운팅 엔드포인트를 포함해 400을 반환합니다. Claude API와 Google Cloud에서는 computer_20251124 도구 항목이 400을 반환하므로 대신 computer_toolset_20260801을 선언하세요.
교체는 기계적입니다. thinking 필드를 제거하거나 동등한 thinking: {"type": "adaptive"}를 보내고, output_config.effort를 명시적으로 설정합니다. tool_choice: auto를 유지하고, 스키마에 맞는 인자를 내야 하는 도구에는 strict: true를 설정하거나 스키마를 structured outputs로 옮기고, 도구를 언제 써야 하는지 프롬프트에 적으세요. 그런 다음 루프에서 실제로 도구 호출이 일어났는지 확인하세요. auto는 호출을 보장하지 않습니다.

2. 조용히 움직이는 기본값

effort를 생략한 요청은 Opus 5에서는 high로, Opus 5.5에서는 medium으로 실행됩니다. 프로덕션 요청에서 effort를 한 번도 설정하지 않았다면, 첫 Opus 5.5 리플레이는 동일 조건 비교가 아닙니다. 결과를 읽기 전에 두 모델 모두에 수준을 명시하고, 그다음 5.5에서 low, medium, high를 스윕하세요.

3. 사라지는 진행 상황 텍스트

도구 호출 사이에 Opus 5는 짧은 설명을 text 블록으로 반환했습니다. Opus 5.5는 이를 진행 상황 thinking 블록으로 반환하며, 각 도구 호출 전에 최대 하나, 기본값 display: "omitted"에서는 thinking 필드가 비어 있습니다. 오류는 없고 스트리밍 UI가 조용해질 뿐입니다. thinking.display를 "updates"(베타 헤더 thinking-display-updates-2026-08-18) 또는 "summarized"로 설정하고, 비어 있지 않은 thinking 블록을 그것이 앞서는 도구 호출 앞에 렌더링하며, 블록은 변경 없이 되돌려 보내세요.

4. 추론을 잃는 폴백 체인

Thinking 블록에는 이를 생성한 모델이 기록됩니다. Opus 5.5는 Opus 5와 그 이전 Opus·Sonnet·Haiku 모델의 블록을 읽으므로, Opus 5에서 시작해 5.5로 옮기는 대화는 추론을 유지합니다. 반대 방향에서는 Claude Fable 5.1과 Mythos 5.1만 Opus 5.5 블록을 읽습니다. Opus 5.5에서 Opus 5, Sonnet 5, Haiku 4.5로 폴백하는 라우터는 남은 턴을 이전 추론 없이 실행합니다. 요청은 성공하고 버려진 블록은 과금되지 않지만 동작은 바뀝니다. API는 또한 5.5 thinking 블록 이전의 내용이 편집되지 않았는지 확인하며, 2026년 8월 31일 이후 생성된 계정은 그런 편집 뒤에 블록을 다시 보내면 기본적으로 400을 받습니다. 이력은 추가만 하고, system prompt나 도구를 편집하는 대신 대화 중간 system 메시지를 사용하세요.

5. 새로운 거부 범주

Opus 5.5는 사이버보안 분류기 외에 생물학 분류기를 함께 실행하며, 내부 추론을 재현하도록 몰아가는 요청을 거부할 수 있습니다. 이때 stop_reason: "refusal"과 함께 stop_details.category가 bio 또는 reasoning_extraction으로 반환됩니다. 서버 측 폴백은 reasoning_extraction을 재시도하지 않습니다. Opus 5 통합에서 stop_reason을 한 번도 확인하지 않았다면 시범 도입 전에 그 확인을 추가하세요.

여섯 가지 시나리오와 각각이 증명해야 할 것

시나리오입력에서 출력"더 낫다"의 의미Opus 5.5에서 볼 것
다중 파일 코드 변경저장소 컨텍스트에서 패치테스트 통과. 리뷰어가 더 적은 수정으로 승인선택한 effort에서의 출력 토큰. 그린까지의 단계 수
다중 턴 도구 에이전트작업과 도구 스키마에서 일련의 도구 호출작업 완료. 실패 후 루프 복구 가능auto가 여전히 도구를 호출하는지. 진행 블록 렌더링. thinking 블록 반환
긴 문서 분석문서와 이미지에서 출처가 있는 결론주장이 증거 집합과 일치. 누락 없음인용 검사. Anthropic은 근거 없는 수치가 줄었다고 보고, 검증 필요
구조화 추출반구조화 텍스트에서 고정 JSON스키마 유효율. 필드 정확도strict: true가 강제 도구 선택을 대체
캐시 중심 워크플로고정 프리픽스와 새 작업에서 결과승인율 유지. 청구서가 실제로 감소캐시 히트 비율. 5분과 1시간 쓰기 선택
다중 모델 폴백실패 또는 타임아웃된 턴에서 대체 라우트대화 지속. 비용 한정어떤 모델이 5.5 thinking 블록을 읽을 수 있는지. 거부 범주

이것들은 결과가 아닙니다. 트래픽을 옮기기 전에 채워야 할 승인 기록이며, 작업 클래스당 하나씩, 두 모델에서 같은 프롬프트, 도구, 타임아웃, effort 수준, 재시도 규칙, 리뷰어로 작성합니다.

Opus 5를 유지해야 할 때

Opus 5가 이미 통과율, 지연, 비용 목표를 충족하고 리플레이에서 측정 가능한 이득이 보이지 않는 곳에서는 Opus 5를 유지하세요. 요청 빌더가 아직 thinking: disabled나 강제 도구 선택을 보내고 수정이 배포되지 않은 곳에서도 유지하세요. 모든 5.5 카나리에 대해, 실제 부하에서 p95 지연과 거부 동작을 볼 수 있을 만큼 충분히 돌기 전까지 롤백 라우트로 두세요. 그리고 폴백 체인이 하류 모델이 대화의 thinking 블록을 읽는 데 의존하는 곳에서는, 그 체인을 재테스트하기 전까지 유지하세요.

기준선을 모으는 동안의 기다림은 수동적이지 않습니다. Anthropic은 Opus 5를 Active로 등재하고 자사 운영 플랫폼에서의 퇴역 하한을 2027년 7월 24일로 두고 있으니, 출시일이 아니라 증거에 따라 옮길 시간이 있습니다.

안전한 마이그레이션 계획

1. Opus 5 기준선 고정

위 각 클래스에서 대표 작업을 고릅니다. 정확한 요청 형태, effort 수준, 도구 세트, 승인 기준을 기록하고 Opus 5에서 한 번 더 돌려 기준선이 기억이 아닌 최신 상태가 되게 하세요.

2. 요청 형태 수정

thinking: disabled와 budget_tokens를 제거하고, effort를 명시적으로 설정하고, 강제 도구 선택을 auto와 strict로 바꾸고, computer use를 툴셋으로 옮기고, stop_reason 처리를 추가합니다. 이를 먼저 Opus 5에 배포하세요. 모든 변경이 거기서도 유효하므로 요청 수정과 모델 변경을 분리할 수 있습니다.

3. effort 스윕 실행

기준선을 Opus 5.5에서 low, medium, high로 리플레이합니다. 각 수준에서 승인 작업률, 출력 토큰, 소요 시간, 승인 작업당 비용을 기록합니다. 작업 클래스별로 승인 기준을 충족하는 가장 저렴한 수준을 고르세요. 습관적으로 Opus 5의 high를 가져오지 마세요.

4. 작업 클래스별 카나리

한 작업 클래스의 작은 비율을 Opus 5.5로 라우팅하고 Opus 5를 설정된 폴백으로 두며, 모든 호출에서 요청 모델, 반환 모델, effort, stop_reason, 과금 항목을 기록합니다. 승인 작업당 비용과 품질이 하루의 좋은 결과가 아니라 실제 트래픽의 한 사이클 전체에서 게이트를 통과하면 그 클래스를 승격하세요.

5. 되돌아갈 길 정의

롤백은 설정 변경입니다. 해당 클래스를 claude-opus-5로 되돌리세요. Opus 5는 Opus 5.5의 thinking 블록을 읽을 수 없으므로 대화 중간의 롤백은 이전 추론 없이 이어집니다. 가능하면 새 대화 경계를 시작하세요. 카나리를 시작하기 전에 누가 롤백을 촉발할 수 있고 어떤 신호가 촉발하는지 기록하세요.

EvoLink에서는 모델 선택이 요청 안의 문자열이므로 4, 5단계에 코드 배포가 필요하지 않습니다.

Claude Opus 5.5 라우트와 현재 요금 확인 Claude Opus 5 라우트를 롤백으로 유지

자주 묻는 질문

Claude Opus 5.5는 Claude Opus 5보다 저렴한가요?

토큰당으로는 그렇습니다. Anthropic은 입력과 출력을 20%, 캐시 읽기를 60% 낮게 책정했습니다. 작업당으로는 여러분의 effort 수준에서 모델이 얼마나 많은 토큰을 쓰는지에 달려 있습니다. Anthropic의 40%는 자사 워크로드에 대한 자사 추정치입니다.

Opus 5.5는 Opus 5를 그대로 대체할 수 있나요?

아닙니다. thinking을 끄거나, thinking 예산을 설정하거나, 도구 선택을 강제하거나, 이전 computer use 도구를 선언하는 요청은 400을 반환합니다. 기본 effort도 high에서 medium으로 내려가고, 도구 호출 사이의 텍스트는 thinking 블록으로 옮겨갑니다.

내 워크로드에서 Opus 5.5가 Opus 5보다 비쌀 수 있는 이유는?

같은 effort 수준에서 턴당 더 많이 사고하는 경향이 있고 사고는 출력으로 과금되기 때문입니다. 입력 20K, 출력 4K 작업에서 출력이 50% 늘어야 Opus 5 가격과 같아지므로, high를 그대로 가져오는 대신 스윕으로 effort를 고르세요.

지연 때문에 Opus 5.5에서 thinking을 끌 수 있나요?

없습니다. effort: low를 쓰고 thinking을 끈 Opus 5 기준선과 지연과 승인율을 비교하세요. thinking을 끈 전제로 작성된 프롬프트에 대한 Anthropic 가이드도 "추론하지 마"류의 지시를 제거하라고 제안합니다.

Opus 5.5에서 Opus 5로 폴백하면 thinking 블록은 어떻게 되나요?

Opus 5는 이를 읽을 수 없어 API가 모델이 요청을 보기 전에 버립니다. 요청은 성공하고 버려진 블록은 과금되지 않지만, 남은 턴은 이전 추론 없이 실행됩니다. Opus 5에서 Opus 5.5로 갈 때는 유지됩니다.

강제 도구 선택의 대체 수단이 있나요?

tool_choice: auto를 유지하고, 도구에 strict: true를 설정해 모든 호출이 스키마에 맞게 하고, 도구를 언제 써야 하는지 프롬프트에 적으세요. 순수 JSON 출력이 목적이면 도구 대신 structured outputs를 쓰세요.

Opus 5를 폴백으로 남겨 두어야 하나요?

네, 적어도 카나리 기간에는요. Anthropic은 claude-opus-5를 Active로 등재하고 자사 운영 플랫폼에서의 퇴역 하한을 2027년 7월 24일로 두고 있습니다. 위에서 설명한 thinking 블록 동작을 포함해, 폴백하려는 구체적인 라우트를 테스트하세요.

어떤 워크로드를 먼저 옮겨야 하나요?

장시간 에이전트 코딩, 대용량 문서 분석, 안정 프리픽스를 가진 캐시 중심 에이전트 순으로 기대 효과가 큽니다. 일상 코딩과 대량·지연 민감 트래픽은 보통 두 Opus가 아니라 Sonnet 5에 속합니다.

출처

사실 최종 확인일: 2026년 9월 22일. 비용 예시는 Anthropic 정가와 고정 토큰 구성을 사용한 가격 산술이며 측정 결과가 아닙니다.

AI 비용을 89% 절감할 준비가 되셨나요?

오늘 EvoLink를 시작하고 지능형 API 라우팅의 힘을 경험해보세요.