Claude Fable 5의 등장 배경과 기술적 위치
Anthropic은 자사 모델 라인업을 Mythos 클래스라는 최상위 계층으로 구분하고 있다. Claude Fable 5는 이 Mythos 클래스의 첫 번째 범용 공개 버전이다. 같은 기반 모델에서 파생된 Claude Mythos 5는 일부 안전 제한이 해제된 버전으로, 현재 미국 정부와의 협력 프로젝트인 ‘Project Glasswing’을 통해 제한적으로 운용되고 있다. 두 버전은 동일한 모델 가중치를 공유하지만, 접근 가능한 기능의 범위가 다르다.
Anthropic의 공식 발표 자료에 따르면, Fable 5는 소프트웨어 엔지니어링, 지식 업무, 비전 처리, 생명과학 연구 등 거의 모든 평가 항목에서 기존 Claude 모델을 뛰어넘는다. 특히 “작업이 길고 복잡할수록 다른 모델과의 격차가 커진다”는 점을 Anthropic이 직접 강조했다. 재미있는 사실은 이 모델이 훈련 완료 후 공개까지 2개월 이상이 소요됐다는 점이다. 그 기간 동안 안전성 검토와 세이프가드 설계가 이루어졌다고 볼 수 있다.
Nathan Lambert의 분석(Interconnects AI)에 따르면, 이 모델에는 사용자에게 명시적으로 공개된 세이프가드 외에 조용히 작동하는 분류기(classifier)도 처음에는 포함되어 있었다. 이 부분은 이후 Anthropic이 수정하여 모든 안전 도메인에 동일한 방식의 분류기를 적용했다고 밝혔다.
Claude Fable 5 스펙 및 경쟁 모델 비교
이 모델을 실제로 활용할 때 가장 먼저 눈에 들어오는 것은 가격 구조다. Anthropic 공식 발표 기준으로, Fable 5와 Mythos 5의 API 가격은 다음과 같다.
| 항목 | Claude Fable 5 / Mythos 5 | Claude Mythos Preview (이전) |
|---|---|---|
| 입력 토큰 단가 | $10 / 1M 토큰 | 약 $25 / 1M 토큰 수준 |
| 출력 토큰 단가 | $50 / 1M 토큰 | 약 $125 / 1M 토큰 수준 |
| 성능 등급 | Mythos 클래스 (최상위) | Mythos 클래스 (이전 세대) |
Anthropic은 이번 가격이 Claude Mythos Preview 대비 절반 이하라는 점을 명시했다. Nathan Lambert의 분석에 따르면, 이는 현재 GPT-5.5 Pro 계열보다도 낮은 가격대이며, Claude Opus 모델 대비 약 2배 수준이다. 상위 클래스 모델이 가격을 대폭 낮추면서 범용 공개된 것은 이 분야에서 의미 있는 전환점이다.
성능 측면에서는 소프트웨어 엔지니어링 벤치마크, 장기 자율 작업, 과학 연구 보조 등에서 기존 최고 수준의 결과를 보인다. 다만 Endor Labs가 실제 취약점 수정 작업 200건을 대상으로 진행한 독립 벤치마크에서는 FuncPass(기능 유지율) 59.8%, SecPass(보안 코드 생성율) 19.0%로 중간권 성능에 머물렀다. Anthropic의 공식 사이버 평가 지표가 주로 공격적 취약점 재현 능력을 측정하는 반면, Endor Labs의 테스트는 실제 운영 코드에서 취약점을 수정하면서 기능을 보존하는 능력을 평가한다는 점에서 측정 기준 자체가 다르다.
- Fable 5는 200개 인스턴스 중 38건에서 학습 데이터 기반 암기(memorization) 방식의 치팅이 확인됨
- 동시에 이전 어떤 모델도 풀지 못했던 4개의 취약점 수정 문제를 최초로 해결함
- 타임아웃 발생 건수는 테스트 이력상 최다 기록 — 확장 사고(extended thinking) 기능이 원인으로 지목됨
실제 사용 시 제한 사항과 현실적 조언
Fable 5를 쓸 때 가장 주의해야 할 점은 세이프가드로 인한 응답 전환이다. Anthropic은 사이버보안 등 특정 민감 영역의 쿼리에 대해 Fable 5 대신 Claude Opus 4.8이 응답하도록 설계했다. 이 전환은 평균적으로 전체 세션의 5% 미만에서 발생하도록 조정되어 있지만, 보수적으로 튜닝된 탓에 무해한 요청도 걸릴 수 있다는 점은 Anthropic도 공식적으로 인정했다.
반면 Endor Labs의 실제 테스트에서는 200건의 보안 관련 코딩 작업 전체에서 단 한 건의 콘텐츠 정책 차단도 발생하지 않았다. 이는 세이프가드가 “코딩 작업” 맥락에서는 거의 개입하지 않는다는 것을 보여준다. 세이프가드가 작동하는 영역과 작동하지 않는 영역 사이의 경계는 아직 명확히 문서화되어 있지 않다.
아래는 현재 확인된 제약 및 활용 특성을 정리한 것이다.
- 세이프가드 적용 영역: 사이버보안, 민감 정보 관련 직접 쿼리 — Claude Opus 4.8으로 자동 전환
- 세이프가드 미적용 영역: 보안 코딩 작업, 취약점 수정 등 — Endor Labs 테스트 기준 차단 없음
- 확장 사고 기능: 복잡한 작업에서 추론 능력을 높이지만, 타임아웃 발생 빈도가 높아 장기 실행 환경에서 안정성 검토 필요
- Mythos 5 접근: 일반 사용자는 불가. 현재 Project Glasswing(미국 정부 협력) 및 제한된 신뢰 접근 프로그램(trusted access program) 참여자만 이용 가능
- 학습 데이터 암기 문제: 공개된 취약점 수정 패턴이 학습 데이터에 포함되어 있을 경우 벤치마크 성능이 과대평가될 수 있음
이런 점이 궁금하실 거예요
Claude Fable 5는 어디서 사용할 수 있나요?
현재 Claude Fable 5는 Anthropic API를 통한 기업·개발자 접근과 Claude.ai 웹 서비스를 통한 일반 사용자 접근이 가능합니다. 같은 기반 모델에서 파생된 Mythos 5는 미국 정부 협력 프로젝트인 Project Glasswing과 Anthropic의 신뢰 접근 프로그램(trusted access program) 참여자에게만 제공되며, 일반 사용자는 접근할 수 없습니다. API 사용 시 세이프가드로 인해 일부 쿼리는 Claude Opus 4.8이 대신 응답할 수 있다는 점을 미리 알아두는 게 좋습니다.
Claude Fable 5 가격은 얼마이고, 기존 모델과 비교하면 어떻게 다른가요?
Anthropic 공식 발표 기준으로 입력 토큰 $10/1M, 출력 토큰 $50/1M입니다. 이전 최상위 모델이었던 Claude Mythos Preview보다 절반 이하 수준이며, Nathan Lambert의 분석에 따르면 GPT-5.5 Pro 계열과 비교해도 낮은 편입니다. Claude Opus 모델 대비로는 약 2배 수준입니다. 상위 클래스 성능을 가격을 낮춰 제공한다는 점은 실제 비용을 계산하는 기업이나 개발자 입장에서 분명히 의미 있는 변화입니다.
Claude Fable 5의 실제 성능과 사용 시 주의할 제한 사항은 무엇인가요?
Anthropic의 공식 벤치마크에서는 소프트웨어 엔지니어링과 장기 복잡 작업에서 두드러진 결과를 보입니다. 단, Endor Labs가 실제 취약점 수정 200건을 대상으로 진행한 독립 테스트에서는 FuncPass 59.8%, SecPass 19.0%로 중간권 성적을 기록했습니다. 확장 사고 기능이 활성화될 경우 타임아웃이 발생할 수 있으며, 세이프가드로 인해 민감 영역 쿼리는 다른 모델로 자동 전환될 수 있습니다. 전체 세션의 5% 미만에서 발생하도록 설계되어 있지만, 무해한 요청도 걸릴 수 있다는 점은 Anthropic이 직접 인정했습니다.
2프로의 생각
이번 Claude Fable 5 출시에서 가장 주목할 부분은 성능 수치 자체가 아니라, “가장 강력한 모델을 의도적으로 제한해서 내놓는다”는 전례를 Anthropic이 직접 만들었다는 점이다. 세이프가드의 기준이 아직 충분히 투명하지 않다는 점, 그리고 독립 기관의 테스트와 공식 벤치마크 사이에 의미 있는 간극이 존재한다는 사실은 실사용 전에 반드시 짚어야 할 대목이다. 가격 인하는 분명 반가운 변화지만, 내가 보내는 쿼리가 Fable 5에 닿는지 Opus 4.8에 닿는지 사용자가 직접 확인하기 어렵다는 구조적 불투명성은 지금 당장 해결되어야 할 숙제다.
참고 자료
- Claude Fable 5 and Claude Mythos 5 – Anthropic
- Claude Fable 5 and new safety fables – by Nathan Lambert – Interconnects AI
- Claude Fable 5: Mythos-grade hype, record cheating, and a few hall-of-fame entries – Endor Labs
본 글에 언급된 제품 스펙 및 수치는 작성 시점 기준이며 이후 변동될 수 있습니다.