
Claude Fable 5 vs Fable 5.1: 차이와 업그레이드 가치
빠른 결정
| Workload | 권장 | 이유 |
|---|---|---|
| 장기 Agent | 5.1 Canary | Cache read 75% 저렴 |
| 대규모 Coding | 5.1 평가 | 자체 trace로 확인 |
| 강제 Tool | Fable 5 유지 | any/tool 오류 |
| 편집 History | 설계 변경 | thinking blocks 비호환 |
| 짧은 비캐시 요청 | Opus 5도 비교 | 기본 가격 동일 |
확인된 차이
| 항목 | Fable 5 | Fable 5.1 |
|---|---|---|
| 수명 주기 | 운영 중인 이전 세대 | 운영 중인 최신 버전 |
| 컨텍스트 / 최대 출력 | 1M / 128K | 1M / 128K |
| 입력 / 출력 가격 | $10 / $50 | $10 / $50 |
| 5분 / 1시간 캐시 쓰기 | $12.50 / $20 | $12.50 / $20 |
| 캐시 읽기 | $1 | $0.25 |
| 사고 모드 | 적응형 | 적응형, 항상 활성화 |
| 지식 기준일 | 2026년 1월 | 2026년 6월 |
input + cache + output + tools + retries + fallback + review로 측정합니다.3가지 호환성 위험
1. 강제 Tool
tool_choice의 any와 tool이 실패합니다.2. 모델 전환
이전 모델은 5.1 thinking blocks를 읽지 못합니다.
3. History 편집
이전 turn 수정은 thinking blocks를 무효화합니다.
되돌릴 수 있는 전환

기준 저장 → 동일 조건 Replay → Shadow → 제한 Canary → Fallback 유지 순서로 진행합니다.
승격 기준
- 수락된 작업 품질: 같은 rubric에서 회귀 없음.
- 장기 신뢰성: 완주, 복구와 loop.
- 비용: 성공 비용과 cache hit.
- 지연 시간: p50/p95.
- 운영 동작: 반환 모델, tool, usage, fallback.
- 데이터와 안전: retention, region, safeguards.
Fable 5가 여전히 올바른 경로인 경우
현재 통합이 제품 기준을 충족하고 강제 Tool에 의존하거나 append-only Thinking History를 아직 지원하지 않는다면 Fable 5는 안정적인 Baseline입니다. 알려진 Latency, 이해한 거부 동작, 검증된 fallback은 새 버전이 나와도 가치가 있습니다.
마이그레이션 중 유지하는 것은 정지가 아니라 Control Group 확보입니다. Prompt, Tool, effort, Evaluator, Retry, 관찰 기간을 고정해 모델 향상과 Traffic 변화, 평가 Drift를 구분하세요.
같은 조건에서 전체 호환성 테스트
| 검증 영역 | Fable 5 기준 | Fable 5.1 테스트 |
|---|---|---|
| Tool 선택 | auto, none, any, 지정 Tool 기록 | 강제 Mode 제거, strict Schema 확인 |
| Thinking History | 반환 Block 보존 | 단방향 Compatibility와 append-only 확인 |
| Prompt 변경 | system, tools, 이전 Message 저장 | Prefix 변경 감지 |
| Agent Loop | Batch, Retry, Recovery 기록 | 완료, 반복, 진행 업데이트 비교 |
| Effort | 운영 설정 고정 | 작업 유형별 Sweep |
| Safeguard | 거부 Category와 최종 Model 기록 | 실제 완료 Model 확인 |
| Cost | Token과 Tool 전체 계량 | Cache Hit와 수동 수정 포함 |
| Context/Output | 둘 다 1M / 128K | 용량 향상 주장 금지 |
| Cache read | $1 대 $0.25/MTok | 실제 Hit로만 절감 측정 |
| Output Risk | 둘 다 $50/MTok | 긴 응답 제한 |
| Latency | 작업 전체 p50/p95 | Demo를 분포로 해석하지 않음 |
| Knowledge | 2026년 1월 대 6월 | 문서 Baseline이지 보장 아님 |
| Channel | Account, Region, Billing | 앱 표시와 API Access 구분 |
단일 답변이 아니라 전체 Trace를 비교하세요. 여러 Tool과 Review를 소비한 뒤 거절되는 그럴듯한 부분 결과가 가장 비싼 실패일 수 있습니다.
자주 발생하는 업그레이드 오류
- Model ID만 바꾸고 Tool·Thinking History 비호환을 놓친다.
- Cache 인하를 모든 작업의 25% 절감으로 표현한다.
- 새 Prompt와 이전 운영 Trace를 비교한다.
- Benchmark나 한 번의 Demo로 전체 승격한다.
- Canary 기간 전에 fallback을 제거한다.
- 실제 응답한 fallback Model을 기록하지 않는다.
- Token 가격만 최적화하고 Retry, Tool, Latency, 수정을 뺀다.
가격 외 변화
Fable 5.1은 Message별 effort, Turn 단위 System Message, 진행 업데이트, Content Provenance를 추가합니다. Beta와 Channel 지원이 다르므로 각각 검증하고 공급자 Benchmark를 실제 Traffic 승리로 간주하지 마세요.
합격 작업당 비용
Input + Cache Writes + Cache Reads + Output + Tool + Retry + fallback + Review로 계산합니다. Cache 중심 Agent는 크게 절감될 수 있지만 짧은 Input과 긴 Output은 효과가 작으므로 Cache Hit Token과 합격 결과를 같은 Report에 기록하세요.업그레이드하지 않을 조건
강제 Tool이 남아 있거나 History를 재작성하거나 Thinking Block을 이전 Model에 전달하거나 Policy Review가 끝나지 않았거나 5.1의 측정 가능한 가치가 없다면 Fable 5를 유지하세요.
FAQ
그대로 교체할 수 있나요?
현재 후속 버전이지만 위험 없이 그대로 교체할 수는 없습니다. 문서화된 세 가지 호환성 변경을 테스트해야 합니다.
저렴해졌나요?
기본 입출력 가격은 같습니다. 캐시 읽기만 75% 저렴하므로 총절감률은 워크로드가 실제로 재사용하는 캐시 양에 달려 있습니다.
둘 다 1M context인가요?
네. 두 모델 모두 100만 토큰 컨텍스트와 128,000토큰 최대 출력을 공개합니다.
캐시 Agent는 옮겨야 하나요?
카나리 평가의 유력한 후보입니다. 캐시 읽기는 4분의 1 가격이지만 합격 작업 품질, 지연 시간과 운영 동작도 기준을 통과할 때만 승격하세요.
대화 중 모델 전환이 가능한가요?
무조건 전환할 수는 없습니다. 이전 Claude 모델은 Fable 5.1 Thinking Block을 읽지 못하므로 모델 간 폴백에서 대화 기록을 명시적으로 관리해야 합니다.
모든 트래픽에 적합한가요?
아니요. 작업 가치와 측정 결과에 따라 라우팅하세요. 일반 트래픽은 Opus 5나 다른 저비용 경로가 더 적합할 수 있습니다.
출시 정보는?
도구 호출은 무엇이 달라졌나요?
tool_choice의 any와 tool 강제 값을 거부합니다. 도구 의존 트래픽을 옮기기 전에 지원되는 자동 선택과 애플리케이션 제어를 검증하세요.

