tracks
에이전트가 사용할 Anthropic 모델을 선택해야 한다면, 이제 성능은 비슷하지만 가격은 크게 다른 두 가지 플래그십급 옵션이 있습니다. Claude Opus 5는 2026년 7월 24일에 출시되었으며 입력 토큰 100만 개당 $5입니다. Claude Fable 5는 2026년 6월 9일에 출시되었고 정확히 그 두 배 가격입니다. 자연스러운 질문은, 더 비싼 Fable 5가 Opus 5가 이미 제공하는 것 이상의 가치를 주느냐는 것입니다.
Anthropic에 따르면 Opus 5는 Frontier-Bench와 GDPval-AA 같은 코딩 및 지식 작업 평가에서 새로운 최첨단 성능을 보이며, 일부 벤치마크에서는 Fable 5를 아예 앞지릅니다. 이는 비싼 모델이 항상 이긴다는 통념을 뒤집습니다.
이 글에서는 코딩, 에이전트 작업, 추론, 안전장치, 가격 측면에서 Opus 5와 Fable 5를 비교해 워크플로에 맞는 모델을 고를 수 있도록 돕겠습니다. 각 모델에 대한 자세한 내용은 Claude Opus 5 가이드와 Claude Fable 5 가이드를 참고하세요.
요약
- Opus 5는 절반의 가격에(입출력 각각 $5/$25 vs $10/$50) Fable 5에 준하는 지능을 제공하므로 거의 모든 사용자에게 기본 선택지입니다.
- Opus 5는 Frontier-Bench v0.1(43.3% vs 33.7%)와 SWE-bench Verified(96.0% vs 95.0%)에서 Fable 5를 앞서며, Fable 5는 SWE-bench Pro(80.3% vs 79.2%)에서 근소하게 앞섭니다.
- Fable 5의 GDPval-AA v2 Elo 1,747은 Opus 5의 1,861에 뒤지므로 지식 작업 평가에서도 Opus 5가 우세합니다.
- Fable 5는 플래그된 요청을 Opus 4.8로 라우팅하는 더 강한 사이버·생물학 안전장치를 탑재했으며, Opus 5의 분류기는 개입 빈도가 약 85% 낮습니다.
- 안전장치 기반 포지셔닝이나 Mythos급 라우팅이 꼭 필요한 경우에만 Fable 5를 선택하고, 일반적인 코딩·에이전트·지식 작업에는 Opus 5를 선택하세요.
Claude Opus 5란?
Claude Opus 5는 Anthropic의 최신 Opus 티어 모델로, 2026년 7월 24일에 출시되었으며 전작 Opus 4.8과 동일한 가격으로 책정되었습니다.
Anthropic은 이를 일상 사용을 위해 설계된 사려 깊고 능동적인 모델로 설명하며, 현재 Claude Max의 기본 모델이자 Claude Pro에서 가장 강력한 모델입니다. 대표적인 특징은 에이전트형 지속성으로, 그럴듯한 답에서 멈추지 않고 실제로 작업이 성공할 때까지 스스로 결과를 검증하고 반복합니다.
실제 동작을 확인하려면, 다섯 가지 추론 노력 레벨 전반에서 버그 수정 코딩 에이전트를 구축하고 벤치마크하는 Claude Opus 5 API 튜토리얼을 살펴보세요. 에이전트형 워크플로 내에서 Opus 5를 실행할 계획이라면 Claude Code 템플릿 가이드도 유용합니다.
Claude Fable 5란?
Claude Fable 5는 Anthropic이 일반 사용에 적합하도록 안전성을 강화한 Mythos급 모델로, 2026년 6월 9일에 출시되었으며 입력 토큰 100만 개당 $10, 출력 토큰 100만 개당 $50입니다. 2026년 6월 12일 미국 수출 통제 명령 준수를 위해 잠시 철회되었다가, 2026년 7월 1일 해당 명령 해제와 함께 다시 제공이 재개되었습니다.
Anthropic은 순수 성능 측면에서 Opus 티어 위에 위치시켰고, 출시 당시 거의 모든 테스트된 벤치마크에서 최첨단 성능을 보였으며, 작업이 길고 복잡할수록 격차가 벌어진다고 설명합니다. 특징적인 요소는 사이버보안, 생물학, 디스틸레이션으로 플래그된 요청을 직접 응답하지 않고 Opus 4.8로 라우팅하는 분류기 세트입니다.
Claude Opus 5 vs Claude Fable 5: 정면 비교
세부 항목으로 들어가기 전 요약부터 보겠습니다. 한마디로, 대부분의 벤치마크에서 Opus 5와 Fable 5는 사실상 비슷하게 나오지만, Opus 5는 그 절반 가격으로 이를 달성합니다.
| 항목 | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| 출시일 | July 24, 2026 | June 9, 2026 |
| 입력 가격(100만 토큰당) | $5 | $10 |
| 출력 가격(100만 토큰당) | $25 | $50 |
| SWE-bench Verified | 96.0% * | 95.0% |
| SWE-bench Pro | 79.2% | 80.3% * |
| Frontier-Bench v0.1 | 43.3% * | 33.7% |
| ARC-AGI 3 | 30.2% * | not published |
| GDPval-AA v2 (Elo) | 1,861 * | 1,747 |
| 안전장치 성향 | 가벼운 사이버 분류기 | 광범위한 사이버/생물/디스틸레이션 분류기 |
| 제공 범위 | 모든 플랫폼 및 티어 | 모든 플랫폼, 소비자 단계적 롤아웃 |
* 해당 벤치마크 현 시점 종합 1위
코딩 및 에이전트형 워크플로
대부분의 사용자가 실제로 이 모델들을 배치하는 영역이 코딩이며, 가격 차이가 가장 정당화되지 않아 보이는 부분이기도 합니다. SWE-bench Verified에서 Opus 5는 96.0%, Fable 5는 95.0%로, 더 저렴한 모델이 1점 앞섭니다. 터미널 코딩 평가인 Frontier-Bench v0.1에서는 Opus 5가 43.3%로 33.7%의 Fable 5를 더 크게 앞지릅니다.
Fable 5는 SWE-bench Pro에서 80.3%로 79.2%의 Opus 5를 간신히 앞서며 한 점 차를 만회합니다. 이는 저장소 수준 엔지니어링에서는 두 모델이 사실상 비등하다는 의미입니다. Cognition 팀은 FrontierCode 1.1 평가에서 Opus 5가 절반 비용으로 Fable에 근접한 성능을 보였다고 보고했는데, 공개 수치와도 일치합니다.
| 벤치마크 | Opus 5 | Fable 5 | 비고 |
|---|---|---|---|
| SWE-bench Verified | 96.0% | 95.0% | 벤더 보고 |
| SWE-bench Pro | 79.2% | 80.3% | 여기서만 Fable 5가 코딩 우위 |
| Frontier-Bench v0.1 | 43.3% | 33.7% | 터미널 코딩; Opus 5 +9.6%p |
| Terminal-Bench 2.1 | Not published | 88.0% | Opus 5 점수 미공개 |
요점은 SWE-bench Pro 하나를 제외하면, 공개된 코딩 벤치마크에서 Opus 5가 Fable 5와 같거나 앞선다는 것입니다. Anthropic은 Opus 5가 더 낮은 작업당 비용으로 Opus 4.8의 Frontier-Bench 점수를 두 배 이상 끌어올렸다고 설명하며, Fable 5도 거기서 이깁니다. 코딩에서는 더 비싼 모델이 추가 가치를 주지 못합니다.

에이전트 및 컴퓨터 사용 작업
두 모델 모두 장기 지평 에이전트 작업을 위해 설계되었으므로, 원샷 프롬프트가 아닌 자율 파이프라인을 운영한다면 이 측면이 중요합니다. 여기서 Opus 5의 능동적 검증 행동이 부분적으로 벤치마크에 포착되는 차별점입니다.
새로운 문제를 풀어야 하는 ARC-AGI 3에서 Opus 5는 Opus 4.8의 1.5%에서 30.2%로 뛰었고, 이는 다음으로 높은 모델(GPT-5.6 Sol 7.8%)의 거의 네 배입니다. 안타깝게도 Anthropic은 Fable 5의 점수를 공개하지 않아 두 모델을 직접 비교할 수는 없습니다.
컴퓨터 사용 벤치마크 OSWorld 2.0에서는 Opus 5(70.6%)가 Fable 5(66.1%)를 제치고 전체 1위 모델이 되었으며, Zapier의 AutomationBench에서는 이전 모델들이 전혀 완료하지 못했던 이탈 방지 시퀀스에서 100% 통과율을 기록했습니다.
에이전트 작업에서는 Opus 5가 달러 대비 성능에서 큰 차이로 앞섭니다.
추론 및 지식 작업
지식 작업은 Fable 5의 마케팅 홈그라운드라 우위를 예상했지만, 결과는 그렇지 않았습니다. 지식 작업 Elo 벤치마크인 GDPval-AA v2에서 Opus 5는 1,861, Fable 5는 1,747을 기록합니다. 더 저렴한 모델이 114 Elo 포인트 앞선 셈입니다.
가장 어렵고 긴 과학적 추론에서는 여전히 Fable 5가 실제 우위를 지니며, 장기 자율 생물학 연구에서는 Mythos급 역량이 더 강하다고 Anthropic은 명시합니다. 하지만 대부분 팀이 수행하는 분석 및 지식 작업에서는 Opus 5의 더 높은 GDPval-AA 점수에 비추어 Fable 5에 두 배 지불하는 것이 오히려 성능 저하로 이어질 수 있습니다.
안전장치와 거부 행동
이 영역은 두 모델이 실질적으로 갈라지는 부분이며, Fable 5가 별도 제품으로 존재하는 진짜 이유이기도 합니다. 동시에 가장 오해받기 쉬운 부분인데, 여기서 말하는 "안전"에는 서로 반대 지점을 측정하는 두 가지가 있기 때문입니다.
첫째는 오용 저항성입니다. 모델 앞단에 놓인 외부 분류기 시스템으로, 위험한 요청을 모델에 도달하기 전에 우회시킵니다. 둘째는 정렬입니다. 모델 자체의 행동으로, 기만 여부, 무모하고 되돌릴 수 없는 행동 수행 여부, 오용으로 유도될 가능성 등을 포함합니다.
한 모델이 한쪽에서는 좋은 점수를 받아도 다른 쪽에서는 강한 보조가 필요할 수 있는데, 분류기는 모델의 일탈을 막는 장치가 아니기 때문입니다. 사용자가 유해한 결과를 끌어내는 것을 막는 장치입니다.
Fable 5는 두 모델 중 더 무거운 분류기 시스템을 갖춘 Mythos급 모델입니다. 분류기는 세 영역을 다루며, 작동 시 요청은 Opus 4.8로 폴백됩니다.
- 사이버보안: 취약점 악용과 보다 광범위한 공격적 사이버 작업이 모두 차단되며, 분류기가 활성화되면 사이버 평가에서 Fable 5의 성능은 0%로 수렴합니다.
- 생물학 및 화학: 대부분의 생물학·화학 요청은 기본적으로 Opus 4.8로 폴백됩니다.
- 디스틸레이션: Fable 5의 역량을 추출하려는 시도로 플래그된 요청은 라우팅됩니다.
Anthropic은 이를 보수적으로 튜닝했으며, 초기 데이터에 따르면 Fable 5 세션의 95% 이상은 폴백이 전혀 발생하지 않습니다.
Opus 5는 같은 시스템의 더 가벼운 버전을 탑재합니다. 사이버 분류기는 소스 코드 취약점 찾기는 허용하지만 바이너리 기반 스캐닝, 침투 테스트, 익스플로잇 생성은 차단하며, 작동 빈도는 Fable 5 대비 약 85% 낮을 것으로 예상합니다.
자동화된 행동 감사에서 Opus 5는 오정렬 행동 점수 2.3을 기록했으며, 이는 Opus 4.8, Sonnet 5, Fable 5보다 앞선 Anthropic의 현재까지 가장 잘 정렬된 모델이라고 합니다.
따라서 이것은 순위표가 아니라 분기점입니다. 일반 코딩, 지식 작업, 컴퓨터 사용에서는 Opus 5가 방해를 덜 주는 잘 정렬된 모델입니다. 공격적 보안 연구나 장기 생물학 같은 보호가 필요한 최전선 영역에서는 Fable 5(또는 Cyber Verification Program을 통한 Mythos 5)가 더 강력한 도구이며, 더 무거운 거부 행동은 그 대가입니다.
가격: 실제 지출
Fable 5는 입력과 출력 모두에서 Opus 5의 정확히 두 배입니다. Opus 5의 Fast 모드는 기본 속도의 약 2.5배로 동작하며 입력 $10, 출력 $50으로, Fable 5의 표준 요율과 정확히 일치합니다.
| 요율 | Opus 5 | Fable 5 |
|---|---|---|
| 입력, 100만 토큰당 | $5.00 | $10.00 |
| 출력, 100만 토큰당 | $25.00 | $50.00 |
| Fast 모드 입력, 100만 토큰당 | $10.00 | 해당 없음 |
| Fast 모드 출력, 100만 토큰당 | $50.00 | 해당 없음 |
실제 워크로드 비용
두 모델은 Opus 4.7 세대부터 도입된 새 토크나이저를 공유하므로 동일한 텍스트는 동일한 입력 토큰 수를 사용합니다. 동일 작업에서의 통제된 토큰 수 비교는 어느 쪽도 공개하지 않았습니다.
| 월간 볼륨 | Opus 5 | Fable 5 | 차이 |
|---|---|---|---|
| 라이트: 입력 100만 / 출력 25만 | $11.25 | $22.50 | Opus 5가 $11.25 절감(50%) |
| 헤비: 입력 1억 / 출력 2,500만 | $1,125 | $2,250 | Opus 5가 $1,125 절감(50%) |
헤비 수준에서는 프로덕션 기능이나 상시 실행 에이전트 기준으로 월 $1,125 차이이며, 코딩이나 지식 작업에서 손해 보는 것도 없습니다.
다만 이는 정밀 예측이라기보다 요율 비교로 보세요. Opus 5는 기본적으로 사고(thinking) 토큰을 더 많이 내보내는 경향이 있어 실제로는 Opus 4.8보다 비용이 늘 수 있습니다. 그래도 대부분 경우 두 모델 중 Opus 5가 훨씬 저렴하다는 큰 그림은 변하지 않습니다.
Claude Opus 5와 Claude Fable 5 중 언제 무엇을 선택할까
대부분의 독자에게 선택은 간단합니다. Opus 5가 기본, Fable 5는 예외입니다. 아래 표는 이 판단이 뒤집히는 상황을 다룹니다.
| 사용 사례 | 권장 모델 | 이유 |
|---|---|---|
| 저장소 수준 코딩 에이전트 | Opus 5 | SWE-bench에서 Fable 5와 같거나 앞서고, Frontier-Bench에서도 절반 비용으로 선도합니다. |
| 일상 지식 작업 및 분석 | Opus 5 | GDPval-AA v2 Elo가 더 높음(1,861 vs 1,747)에도 가격은 절반. |
| 대량 프로덕션 워크로드 | Opus 5 | 50% 절감이 헤비 티어에서 월 $1,000 이상으로 누적됩니다. |
| 신규 문제 및 추상 추론 | Opus 5 | ARC-AGI 3 점수 30.2%로 차점 모델의 세 배. |
| 장기 자율 생물학 연구 | Fable 5 | 이 특정 작업에서는 Mythos급 역량이 여전히 강함. |
| 광범위한 안전장치 커버리지가 필요한 워크플로 | Fable 5 | 사이버·생물·디스틸레이션 전반을 더 넓게 커버하는 분류기. |
다음에 해당하면 Opus 5를 선택하세요…
- 코딩 또는 에이전트형 도구를 구축하며, Frontier-Bench에서 앞서고 SWE-bench에서 비등한 달러 대비 성능을 원하시는 경우.
- 대량 워크로드를 운영하여 50% 요율 인하가 실제 예산 절감으로 이어지고, 벤치마크가 품질 손실이 없음을 확인해 주는 경우.
- 오정렬 행동 감사 점수 2.3이라는 Anthropic 최고 정렬 모델을 원하시는 경우.
- 정당한 보안 연구를 위해 더 가벼운 거부 행동이 필요하며, Fable 5 대비 분류기 작동 빈도가 약 85% 낮은 모델이 필요한 경우.
다음에 해당하면 Fable 5를 선택하세요…
- 장기 자율 생물학 연구처럼 Anthropic이 Mythos급 역량이 여전히 앞선다고 밝힌 작업을 수행하는 경우.
- Fable 5의 안전장치 시스템이 제공하는 사이버·생물·디스틸레이션 전반의 더 넓은 분류기 커버리지가 꼭 필요한 경우.

Claude Opus 5와 Claude Fable 5 시작하기
두 모델 모두 Claude 앱, API, 주요 클라우드 플랫폼, Anthropic의 코딩 에이전트 전반에서 폭넓게 제공됩니다. 실질적 차이는 좁으며 주로 소비자 요금제 수준에서 나타납니다.
| 채널 | Opus 5 | Fable 5 |
|---|---|---|
| 소비자 앱 | Claude 앱(Pro, Max, Team, Enterprise 포함; Max 기본, Pro 최강) | Claude 앱(Max & Team Premium: 포함, 주간 한도 50%; Pro & Team Standard: 사용 크레딧만) |
| 1st-party API | Anthropic API | Anthropic API |
| 클라우드 플랫폼 | Amazon Bedrock, Vertex AI, Microsoft Foundry | Amazon Bedrock, Vertex AI, Microsoft Foundry |
| 코딩 에이전트 | Claude Code, Claude Cowork | Claude Code, Claude Cowork |
| API 모델 ID | claude-opus-5 |
claude-fable-5 |
API에서는 각각 claude-opus-5와 claude-fable-5로 문자열만 바꾸면 됩니다.
가장 분명한 차이: Pro와 Team Standard에서는 Fable 5가 포함되지 않습니다. API 요율의 종량제 사용 크레딧으로만 이용할 수 있으며, Opus 5는 해당 요금제에 포함됩니다.
코딩 에이전트에서 Opus 5와 Fable 5 사용하기
두 모델 모두 Claude Code에서 선택 가능하며, 요청이나 에이전트 구성에서 모델 문자열만 바꾸면 전환됩니다. 동일 SDK를 사용하므로, 동작 중인 에이전트를 한쪽에서 다른 쪽으로 옮기는 일은 한 줄 변경이면 충분합니다.
from anthropic import Anthropic
client = Anthropic()
response = client.messages.create(
model="claude-opus-5", # swap for "claude-fable-5"
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor this function..."}],
)
print(response.content.text)
실전 테스트에서의 구현 팁 한 가지: Opus 5는 기본적으로 사고 블록을 반환하므로, 첫 블록이 사고 블록일 때 response.content.text에 바로 접근하면 AttributeError가 발생할 수 있습니다. 전체 설정, 노력 레벨 튜닝, 프롬프트 캐싱 동작은 Claude Opus 5 API 튜토리얼에서 다룹니다.
마무리
특별한 이유가 없다면 Opus 5를 권장합니다. 코딩에서 Fable 5에 비기거나 앞서고, 지식 작업 Elo 벤치마크에서 이기며, 새로운 추론 영역에서는 세 배의 격차를 보입니다. 이 모든 것을 절반 가격으로, Anthropic 최고 정렬 점수까지 기록하며 달성합니다.
Fable 5가 나쁜 모델이라는 뜻은 아닙니다. 다만 대부분 팀이 실제로 하는 작업에 맞춰 설계된 모델은 아닙니다. 더 무거운 안전장치를 탑재했고 생물학 연구 같은 장기 자율 작업의 최전선에서는 실질적 우위를 지니지만, 그 좁은 영역을 벗어나면 Fable 5에 두 배를 지불하는 것은 코딩과 분석에 중요한 벤치마크에서 약간 낮은 점수를 위해 두 배를 지불하는 셈이 됩니다.
흥미로운 점은 이 비교가 일반적인 모델 티어 논리를 뒤집는다는 것입니다. 보통은 더 새롭고 저렴한 모델이 접근성을 위해 성능을 일부 포기합니다. 그러나 이번에는 거의 모든 주류 작업에서 더 뛰어난 선택지가 되면서도 더 저렴한 모델을 Anthropic이 제공했습니다. 이는 Fable 5의 가격이 원시 성능보다 안전장치 성향과 Mythos 계보에 더 지불하는 것임을 시사합니다.
자주 묻는 질문
Claude Opus 5가 Claude Fable 5보다 더 좋은가요?
대부분의 작업에서는 그렇습니다. Opus 5는 코딩에서 Fable 5와 같거나 앞서며(SWE-bench Verified 96.0% vs 95.0%, Frontier-Bench v0.1 43.3% vs 33.7%), 지식 작업 벤치마크 GDPval-AA v2에서도 우위(1,861 vs 1,747 Elo)를 보입니다. 게다가 가격은 절반입니다. Fable 5가 유리한 영역은 장기 자율 생물학 연구 같은 좁은 최전선 작업뿐입니다.
왜 Claude Fable 5가 Claude Opus 5보다 비싼가요?
Fable 5는 입력/출력 100만 토큰당 $10/$50로, Opus 5의 $5/$25보다 비쌉니다. 그러나 이 프리미엄은 주로 안전장치 성향과 최전선 포지셔닝에 대한 것이지, 일상 성능 향상 때문은 아닙니다. 주류 코딩 및 지식 작업 벤치마크에서는 Opus 5가 같거나 더 높게 나오므로, 해당 워크로드에서는 더 비싼 비용으로 약간 낮은 성능을 선택하는 셈입니다.
Opus 5 대신 Fable 5를 선택해야 하는 경우는 언제인가요?
장기 자율 생물학 연구에서는 Anthropic이 여전히 Fable 5의 역량이 앞선다고 밝히므로 Fable 5를 선택하세요. 혹은 사이버보안·생물학·디스틸레이션 전반에 걸친 더 넓은 분류기 커버리지가 반드시 필요한 경우에도 Fable 5가 적합합니다. 일반적인 코딩, 에이전트 파이프라인, 분석, 대량 프로덕션 작업에는 Opus 5가 더 나은 기본값입니다.
API에서 Opus 5와 Fable 5를 전환하려면 어떻게 하나요?
두 모델은 동일한 SDK를 사용하므로, 모델 문자열(claude-opus-5 또는 claude-fable-5) 한 줄만 바꾸면 전환됩니다. 유의할 점 하나: Opus 5는 기본적으로 사고 블록을 반환하므로, response.content[0].text를 바로 읽으면 첫 블록이 텍스트가 아닌 사고 블록일 때 AttributeError가 발생할 수 있습니다.
실사용에서 Opus 5가 정말 Fable 5의 절반 비용인가요?
토큰당 요율로 보면 그렇습니다. Opus 5는 입력과 출력 모두 Fable 5의 정확히 절반 요율입니다. 실제 청구액은 토큰 사용량에 따라 달라지며, Opus 5는 기본적으로 Opus 4.8보다 사고 토큰을 더 많이 내보내는 경향이 있으므로 50%는 요율 비교로 이해하세요. 그래도 대부분의 시나리오에서 Opus 5가 다른 모델보다 유의미하게 저렴한 것은 변하지 않습니다.