Mythos 5와 Fable 5 완전 정리: Anthropic의 frontier 등급 모델, 성능·가격·안전장치 전부 분석

Anthropic의 frontier 등급 모델 Mythos 5와 Fable 5는 무엇이 다른가. 두 모델의 성능 벤치마크, 2배로 오른 API 가격, 위험 요청 라우팅과 모델 전환 구조까지 정리한다.

여러분, 이번에도 Anthropic이 굉장한 걸 내놨습니다. 기존 Opus 계열을 한 단계 뛰어넘는 frontier 등급 모델을 드디어 공개했는데요. 그런데 이름이 하나가 아닙니다. 일반 사용자가 쓰는 모델은 Fable 5, 그리고 그 위에 보안 제한이 일부 풀린 Mythos 5가 별도로 존재합니다. 같은 기반 모델을 공유하면서도 이름과 공개 대상을 둘로 나눈 이 구조는 단순한 마케팅이 아닙니다. “성능이 너무 좋아서 그냥 풀 수 없다”는 문제의식에서 출발한 의도적 설계죠.

이 글에서는 Mythos 5와 Fable 5가 정확히 무엇이 다른지, 왜 두 개로 쪼개졌는지, 그리고 agentic coding·frontier code·cybersecurity 벤치마크에서 어떤 변화가 있었는지를 수치 중심으로 정리합니다. 더불어 API 가격이 2배로 오른 배경, Opus 4.8과 달라진 effort level 동작, Claude Desktop에서 위험 요청 시 모델이 자동 전환되는 설정까지 실무자가 바로 판단에 쓸 수 있는 형태로 풀어냈습니다.

“Fable 5를 지금 써도 되나”, “비용이 2배인데 그만한 값을 하나”, “내 요청이 갑자기 차단되는 이유가 뭔가” 이런 의문이 있으셨다면, 그 답을 모두 담았습니다.

Mythos 5 / Fable 5 핵심 요약

  • Mythos 5는 Opus보다 한 단계 위 등급의 frontier 모델이다. 지금까지 가장 강력한 Claude 모델이 Opus 계열이었다면, 그보다 상위 클래스가 새로 등장했다.
  • Fable 5는 Mythos 5와 동일한 기반 모델을 쓰되, 일반 사용자가 안전하게 쓸 수 있도록 안전장치를 단 버전이다. 위험한 요청은 Opus 4.8 응답으로 우회시킨다.
  • Mythos 5는 일반에 풀지 않는다. cybersecurity 전문가와 인프라 제공 업체를 대상으로, Project Glasswing을 통해 Claude Mythos Preview의 업그레이드 버전으로 배포된다.
  • API 가격은 두 모델 모두 입력 100만 토큰당 $10, 출력 100만 토큰당 $50으로, 기존 Opus급($5 / $25) 대비 입력·출력 모두 정확히 2배 인상됐다.
  • 벤치마크는 전 영역에서 큰 폭으로 상승했다. agentic coding 69.2%→80.3%, frontier code 13.4%→29.3%(2배 이상), cybersecurity 40%→78%(약 2배, Mythos 5 기준).
  • effort level 동작이 개선됐다. Opus 4.8은 effort를 max로 올리면 오히려 성능이 떨어지고 비용만 늘었지만, Fable 5는 effort가 올라갈수록 성능도 함께 오른다.
  • 위험 분야 요청은 차단된다. cybersecurity·생물학 등 악용 가능 영역은 응답 자체를 막거나 이전 모델로 전환하도록 설정돼 있다.

Mythos 5란 무엇인가: Opus 위에 새로 생긴 등급

먼저 가장 중요한 개념부터 정리해보겠습니다. Mythos 5(미소스 5)는 기능 면에서 Opus보다 한 단계 위에 위치하는 Claude 모델군입니다. 그동안 Anthropic이 내놓은 모델 중 가장 성능이 뛰어난 건 Opus였는데, 이번에 그 Opus를 능가하는 상위 클래스가 처음으로 공개됐다는 점이 핵심이죠.

여기서 “Mythos급 성능”이라는 표현이 자주 등장하는데요. 이건 단순히 “조금 더 좋다”는 수준이 아니라 모델 등급 자체가 한 단계 올라갔다는 의미로 받아들이는 게 정확합니다. 즉, Opus가 천장이던 시대에서 Mythos가 새로운 천장이 된 셈입니다.

Project Glasswing과 Claude Mythos Preview

Mythos라는 모델이 주목받기 시작한 시점은 이번이 처음이 아닙니다. 지난 4월 Project Glasswing을 통해 공개된 Claude Mythos Preview가 그 출발점이었죠. 당시 이 프리뷰 모델은 “파괴적인 성능”을 보여준다는 평가와 함께, 바로 일반에 공개하기는 위험하다는 우려를 동시에 받았습니다. 성능이 일정 수준을 넘어서면 그 강력함 자체가 공개를 망설이게 하는 요인이 됩니다. 출시가 늦어진 배경에는 기술적 미완성이 아니라, 오히려 너무 잘 작동한다는 점이 있었던 거죠.

Mythos 5는 이 Claude Mythos Preview의 정식 후속 격입니다. 그리고 이번에도 일반 공개가 아니라 Project Glasswing 경로를 통해, 프리뷰의 업그레이드 버전으로 제한적으로 배포됩니다.

왜 출시가 계속 미뤄졌나

Mythos 계열이 줄곧 출시를 미뤄온 이유는 명확합니다. 모델이 워낙 강력하다 보니 그대로 풀었을 때 보안 문제와 악용 사례가 폭증할 수 있기 때문이죠. 대표적인 예가 해킹입니다. 강력한 코드 생성·문제 해결 능력은 정당한 개발에도 쓰이지만, 동일한 능력이 공격 도구 제작에도 그대로 전용될 수 있습니다. 이 딜레마가 Mythos를 오래 묶어둔 핵심 원인입니다.

Fable 5: 같은 두뇌, 다른 안전벨트

그렇다면 일반 사용자는 무엇을 쓰게 될까요? 바로 Fable 5(페이블 5)입니다. Fable 5는 Mythos급 성능의 모델이면서, 일반 사용자가 안전하게 쓸 수 있도록 튜닝이 들어간 버전이죠.

제가 말하고 싶은 건 이 한 문장입니다. Fable 5의 기반 모델은 Mythos와 동일합니다. 다만 특정 상황에서는 다르게 동작하죠. 모든 질의에 Mythos 기반으로 답하는 게 아니라, 위험하다고 판단되는 특정 주제에 대해서는 그다음으로 성능이 뛰어난 모델, 즉 우리가 지금까지 써온 Claude Opus 4.8의 응답으로 라우팅합니다.

라우팅이 작동하는 방식

예를 들어 사용자가 해킹을 요청하는 등 악의적 의도가 의심되는 질의를 던지면, Fable 5는 이를 Mythos 기반으로 처리하지 않고 Opus 4.8 응답으로 전환합니다. 정리하면 다음과 같습니다.

요청 유형Fable 5의 처리 방식실제 응답 모델
일반적인 코딩·지식·연구 질의Mythos 기반으로 처리Mythos급 성능
악의적·위험 의심 질의(예: 해킹)다음 등급 모델로 라우팅Opus 4.8

이 설계 덕분에 Fable 5는 평상시에는 frontier 등급의 성능을 그대로 누리면서, 위험한 순간에만 한 단계 낮은(그러나 충분히 안전한) 모델로 내려가는 이중 구조를 갖습니다.

향후 전망: 제약이 풀린 모델

Anthropic은 향후 몇 달 내에 더 뛰어난 성능의 모델을 출시할 예정이라고 밝혔습니다. 이 시점에 모든 제약이 완전히 풀린 Mythos급 성능 모델이 나올 가능성도 거론되죠. 다만 이건 예상일 뿐, 현재 일반 사용자가 손에 쥘 수 있는 건 안전장치가 달린 Fable 5라는 점을 기억해야 합니다.

Mythos 5는 누구에게 공개되는가

Fable 5가 일반 사용자용이라면, Mythos 5는 모든 사용자를 대상으로 하지 않습니다. Mythos 5는 cybersecurity(사이버 보안) 전문가와 인프라 제공 업체를 위해 출시되죠.

Mythos 5는 Fable 5와 동일한 기반 모델을 쓰지만, 일부 영역에서 보안 제한이 해제된 모델입니다. 배포 경로 역시 일반 채널이 아니라 Project Glasswing을 통해, Claude Mythos Preview의 업그레이드 버전으로 전달됩니다. Anthropic은 Mythos 5가 전 세계 어떤 모델보다도 강력한 cybersecurity 기능을 갖추고 있다고 설명합니다.

”바이브해킹”이라는 우려

여기서 한 가지 사회적 논점이 따라붙습니다. 만약 Mythos 5처럼 보안 제한이 풀린 모델이 언젠가 일반에 전면 공개된다면, 바이브코딩(vibe coding)의 시대를 넘어 바이브해킹(vibe hacking)의 시대가 오는 것 아니냐는 우려죠. 자연어로 코드를 짜듯 자연어로 공격을 설계하는 상황을 떠올리면, Anthropic이 Mythos 5를 일반에 풀지 않고 전문가·인프라 사업자로 한정한 이유가 좀 더 분명해집니다.

이런 우려는 모델을 두 갈래(Fable 5 / Mythos 5)로 나눈 설계의 배경으로 거론됩니다.

가격: 왜 2배가 됐고, 그만한 값을 하는가

이번 공개에서 실무자가 가장 먼저 따져볼 지점은 비용입니다. Fable 5와 Mythos 5는 비용 구조가 동일한데요. 다음과 같습니다.

구분입력(100만 토큰)출력(100만 토큰)
Fable 5 / Mythos 5$10$50
기존 Opus급$5$25
인상 폭2배2배

입력·출력 모두 정확히 2배 인상입니다. 기존 Opus급이 입력 100만 토큰당 $5, 출력 100만 토큰당 $25였던 것과 비교하면, 토큰 단가 자체가 두 배로 뛴 거죠.

비용 2배, 성능은 2배 이상일까

여기서 자연스러운 질문이 나옵니다. 비용이 2배 늘었다면, 성능도 그만큼 또는 그 이상 좋아졌을까요? 결론부터 말하면, 적어도 일부 핵심 벤치마크에서는 비용 인상 폭을 웃도는 성능 향상이 확인됩니다. 특히 어려운 코드 작성과 보안 영역에서는 2배 이상의 점수 상승이 나타났죠(자세한 수치는 다음 섹션). 그래서 단순히 “토큰 단가가 비싸졌다”로만 볼 게 아니라, 복잡하고 긴 작업일수록 비용 대비 효용이 커지는 구조로 이해하는 편이 정확합니다.

벤치마크로 보는 성능 향상

이번 모델은 모든 영역에서 벤치마크가 상승했습니다. 그중에서도 의미 있는 세 가지 지표를 비교하면 다음과 같습니다.

벤치마크 영역Opus 4.8Fable 5 / Mythos 5변화
agentic coding69.2%80.3%약 11%p 상승
frontier code13.4%29.3%2배 이상
cybersecurity40%78%약 2배

※ cybersecurity 40%→78%는 Mythos 5 기준 수치다. Fable 5는 위험 주제 요청을 Opus 4.8로 라우팅하는 구조이므로, 보안 벤치마크 점수의 실사용 의미는 두 모델에서 다를 수 있다.

agentic coding: 69.2% → 80.3%

agentic coding(에이전트형 코딩)은 모델이 도구를 사용하고 여러 단계를 자율적으로 거쳐 코딩 작업을 수행하는 능력을 평가합니다. Opus 4.8의 69.2%에서 80.3%로 올라, 자동화된 코딩 워크플로에서 한층 안정적인 결과를 기대할 수 있게 됐습니다.

frontier code: 13.4% → 29.3%

frontier code는 단순한 코딩 문제 풀이가 아닙니다. 현업 개발자가 실제로 다루는 대규모 코드베이스를 주고 그 안에서 실제 문제를 해결해 나가는 과정을 평가하는, 훨씬 어려운 테스트죠. 여기서 13.4%에서 29.3%로 2배 이상 뛰었다는 점은, 이 모델이 복잡한 실무형 문제 해결에 특화되어 있음을 보여줍니다. 점수의 절대값(29.3%)이 여전히 높지 않다는 사실은, 거꾸로 이 벤치마크가 얼마나 까다로운 과제인지를 방증합니다.

cybersecurity: 40% → 78%

보안 영역의 상승 폭이 특히 두드러집니다. 이 cybersecurity 벤치마크 상승은 Mythos 5 기준으로, Opus 4.8의 40%에서 78%로 약 2배 향상됐죠. 이 강력한 보안 성능이야말로 Mythos 5를 일반에 풀지 않고 전문가·인프라 사업자로 한정한 핵심 이유입니다. 같은 능력이 방어에도 공격에도 쓰일 수 있기 때문이죠.

effort level이 달라졌다: 자원을 올린 만큼 성능이 따라온다

frontier code 벤치마크에서 또 하나 주목할 변화는 effort level(에포트 레벨)의 동작 방식입니다. effort level은 모델이 한 작업에 얼마나 많은 연산·추론 자원을 투입할지를 조절하는 단계죠.

Opus 4.8의 한계

기존 Claude Opus 4.8에서는 effort level을 단계적으로 올리면 어느 지점까지는 성능이 함께 올라갔습니다. 그런데 max로 끝까지 올리면 오히려 성능이 떨어지고 비용만 증가하는 현상이 자주 나타났죠. “자원을 더 쓸수록 더 좋아진다”는 직관이 깨지는 구간이 있었던 겁니다. 이 때문에 실무에서는 effort를 무작정 올리기보다 적당한 선에서 멈추는 튜닝이 필요했어요.

Fable 5의 개선

Fable 5는 이 문제를 정면으로 개선했습니다. effort level이 올라갈수록 성능도 함께 올라갑니다. 다음과 같이 정리할 수 있죠.

모델effort 상향 시 거동실무적 함의
Opus 4.8중간까지 상승, max에서 성능 하락·비용 증가effort를 적정선에서 멈춰야 함
Fable 5effort 상승에 비례해 성능도 상승effort를 올린 만큼 성능 향상을 기대할 수 있음

이 개선은 단순한 점수 이상의 의미를 갖습니다. “어려운 문제일수록 자원을 더 투입하면 더 잘 푼다”는, 모델에게 기대하는 가장 상식적인 동작이 비로소 성립한 거죠.

Claude Desktop에서 Fable 5 쓰기와 차단 동작

Fable 5는 Claude Desktop 앱에서 바로 선택해 사용할 수 있습니다. 모델 선택 영역에서 Fable 5를 고르면 되죠. 장기간 실행되는 복잡한 작업에 특화된 모델인 만큼, 긴 호흡의 작업일수록 그 강점이 드러납니다.

일부 요청이 차단되는 이유

Fable 5를 쓰다 보면 일부 요청이 차단되는 경험을 할 수 있습니다. 이유는 명확해요. 모델 성능이 너무 강력하기 때문에, cybersecurity나 생물학 분야의 첨단 기능이 악용될 경우 대규모 사이버 공격이나 생물학 무기 제조에 이용될 수 있습니다. 이런 위험 분야에 대해서는 응답 자체를 차단하도록 설정돼 있죠.

”메시지 플래그 처리될 때 모델 전환” 설정

Claude Desktop 설정에는 메시지 플래그 처리될 때 모델 전환 옵션이 기본적으로 활성화돼 있습니다. 이 옵션의 동작을 정리하면 다음과 같습니다.

  1. 활성화 상태(기본값): 위험하다고 판단되는 요청을 보내면, Fable 5 대신 Opus 4.8 등 이전 모델로 자동 전환해 대화를 이어갑니다.
  2. 비활성화 상태: 모델을 바꿔가며 요청을 이어가는 방식이 싫다면 이 옵션을 끌 수 있습니다. 끄면, 차단될 수 있는 요청을 보냈을 때 모델을 전환하는 대신 대화가 일시 중지되도록 동작하죠.

정리하면, 이 설정은 “위험 신호가 잡혔을 때 한 단계 낮은 안전 모델로 갈아탈 것인가, 아니면 그냥 멈출 것인가”를 사용자가 직접 고를 수 있게 해주는 스위치입니다. 우회 라우팅을 원치 않는 보수적 운영 환경이라면 비활성화가 적합하고, 작업 흐름이 끊기는 걸 피하고 싶다면 활성화를 유지하는 편이 낫습니다.

실무 적용 가이드와 정리

지금까지의 내용을 실무 판단에 바로 쓸 수 있도록 압축하면 다음과 같습니다.

  • 모델 선택: 일반 사용자와 개발자는 Claude Desktop에서 Fable 5를 선택해 쓰면 됩니다. Mythos 5는 cybersecurity 전문가·인프라 사업자 대상이라 일반 경로로는 접근하지 않습니다.
  • 비용 검토: 입력 $10 / 출력 $50(100만 토큰 기준)으로 기존 Opus급 대비 2배입니다. 짧고 단순한 작업이라면 비용 부담이 크게 느껴질 수 있지만, 길고 복잡한 장기 작업일수록 비용 대비 효용이 커집니다.
  • effort level 활용: Opus 4.8은 effort를 max로 올리면 성능이 오히려 꺾이는 구간이 있었지만, Fable 5는 effort가 올라갈수록 성능도 함께 오릅니다. 자원 투입과 성능이 비례하니, 어려운 작업에 effort를 더 높여볼 여지가 커졌죠.
  • 차단을 정상 동작으로 이해: cybersecurity·생물학 등 악용 위험 분야의 요청이 막히거나 모델이 전환되는 건 버그가 아니라 안전 설계입니다. 운영 정책에 맞춰 “모델 전환” 설정을 켜거나 끄면 됩니다.

결론부터 말하면, 이번 공개의 본질은 “Opus 위에 새 등급이 생겼다”는 사실과, “그 강력함을 그대로 풀 수 없어 둘로 나눴다”는 설계 철학에 있다고 봅니다. Fable 5는 frontier 성능과 안전장치를 동시에 가진 일반용 모델이고, Mythos 5는 보안 제한을 일부 푼 전문가용 모델이죠. 같은 기반 모델을 두고 공개 대상과 안전 경계만 달리한 셈입니다.

frontier 등급 모델이 일상 도구로 내려온 지금, 제가 더 중요하게 보는 건 남은 과제입니다. 비용 2배를 정당화할 만큼 복잡하고 긴 작업에 이 성능을 어떻게 쓸 것인가, 그리고 강력해진 능력을 어떤 안전 경계 안에서 다룰 것인가죠. 이 두 질문에 대한 각자의 답이 앞으로의 활용 수준을 가른다고 생각합니다.

자주 묻는 질문

Mythos 5와 Fable 5의 API 가격은 얼마인가요?

두 모델 모두 100만 토큰당 입력 10달러, 출력 50달러입니다. 기존 Opus급(입력 5달러, 출력 25달러) 대비 정확히 2배 인상됐습니다.

Opus 4.8 대비 벤치마크는 얼마나 올랐나요?

agentic coding은 69.2%에서 80.3%로, frontier code는 13.4%에서 29.3%로 올랐습니다. cybersecurity는 Mythos 5 기준 40%에서 78%로 약 2배 상승했습니다.

Fable 5에서 effort level을 높이면 어떻게 되나요?

Opus 4.8은 effort를 max로 올리면 오히려 성능이 떨어지고 비용만 늘었지만, Fable 5는 effort가 올라갈수록 성능도 함께 오릅니다.

Claude Desktop에서 Fable 5 요청이 차단되거나 모델이 바뀌는 이유는 무엇인가요?

cybersecurity·생물학처럼 악용 위험이 있는 분야는 차단하도록 설계되어 있습니다. 기본 활성화된 "메시지 플래그 처리될 때 모델 전환" 옵션을 끄면 모델 전환 대신 대화가 일시 중지됩니다.

이 글이 도움이 됐나요?

좋았다면 링크를 공유하거나 반응을 남겨주세요. 남겨주신 반응은 다음 글을 개선하는 데 참고하겠습니다.