블로그 목록
테크 블로그 & 팁

Claude Fable 5.1과 Mythos 5.1, 같은 모델 다른 안전장치

Anthropic이 동일 기반 모델에 서로 다른 보호 장치를 적용한 Claude Fable 5.1과 Mythos 5.1을 공개했다. Fable은 일반 사용자용이며 캐시 읽기 가격 75% 인하로 최대 45% 저렴해지고, 코딩·지식 노동·장기 에이전트 작업에서 성능이 크게 개선됐다. Mythos는 검증된 사이버 보안·생명과학 전문가만 접근할 수 있다.

2026년 9월 2일 6분 읽기

Anthropic이 2026년 9월 2일 새로운 기반 모델을 두 가지 이름으로 공개했다. Claude Fable 5.1Claude Mythos 5.1은 사실상 같은 모델이지만, 보호 장치 수준을 다르게 적용해 일반 사용자용과 전문가용으로 나눴다.

Fable과 Mythos는 정확히 뭐가 다른가

Fable 5.1은 모든 플랫폼에서 즉시 사용할 수 있다. 반면 Mythos 5.1은 사이버 보안과 생명과학 연구를 위해 더 허용적인 보호 장치를 적용하되, 검증된 개인과 조직만 신뢰 접근 프로그램을 통해 쓸 수 있다.

같은 모델에 보호 장치만 바꿔 장착하는 방식은 운영이 복잡해 보이지만, Anthropic 입장에서는 안전성·유연성·비용 세 가지 요구를 한 번에 맞추는 전략으로 읽힌다.

가격 인하가 실제로 의미하는 것

이번 공개에서 가장 실감나는 변화는 캐시 읽기 가격 75% 인하다. 캐시 입력을 많이 재사용하는 에이전트 워크로드에서는 전체 비용이 기존 Fable 5보다 최대 약 45% 줄어들고, 일반 토큰 과금 작업은 약 25% 저렴해진다.

구체 가격은 입력 100만 토큰당 10달러, 출력 100만 토큰당 50달러로, Fable 5와 동일하다. 실질 절감은 대부분 캐시 읽기 쪽에서 오는 셈이다.

벤치마크 성능: 어디까지 올랐나

Anthropic은 Terminal-Bench-Science 0.1, Terminal-Bench 4.0, Humanity's Last Exam, CursorBench 3.2.0 등에서 Fable 5.1을 평가했다. 공식 비교표의 핵심 수치는 다음과 같다.

벤치마크Fable 5.1Fable 5Opus 5
Terminal-Bench-Science 0.152.6%24.7%29.0%
Terminal-Bench 4.055.8%~60.9%42.0%52.3%
Humanity's Last Exam65.0%63.8%63.6%
CursorBench 3.2.073.4%70.5%70.0%

Terminal-Bench 4.0 상단의 범위는 Fable 5.1과 Mythos 5.1 모두를 아우르며, 보호 장치가 개입된 작업에서는 두 모델의 점수 차가 줄었다고 Anthropic은 밝혔다.

장기 문제 해결과 근본 원인 분석

이번 모델의 슬로건은 근본 원인을 찾는 능력이다. 투자사 Millennium의 내부 테스트에서 Fable 5.1은 100만 회 실행에 한 번 꼴로 나타나는 희귀 충돌의 원인을 찾아냈다. 오류는 외부 공급업체 라이브러리 버그였고, Fable 5.1은 해당 라이브러리를 디스어셈블하고 코어 덤프와 대조해 원인을 특정했다.

Cognition은 출시일부터 Devin의 Opus 5 트래픽을 Fable 5.1로 전환했고, MongoDB는 Fable 5.1을 활용해 3일 만에 복잡한 프로토타입을 설계·구현한 뒤 수 시간 동안 무인 검증을 돌렸다.

Ramp는 38시간 무인 실행으로 ML 결과의 레이블 인공물을 진단·수정하고, 그 뒤 6개 병렬 실험을 수행했다. 장시간 무인 작업에서 맥락을 유지하고 우선순위를 조정하는 능력이 실제 업무 효율로 이어지고 있다.

과학 연구 사례: 단백질·금성·계산 생물학

단백질 결합체 설계

Mythos 5.1에 단백질 설계 도구를 제공한 뒤 외부 기관 두 곳에서 설계를 실험 검증했다. EGFR, Nipah G, 15-PGDH 세 표적에서 결합 친화도가 Adaptyv Bio 단백질 설계 대회 최고 제출물보다 10배 높았고, 12개 표적에 걸친 유효 결합체 적중률은 약 50%였다. 일반적인 단백질 설계 적중률이 10~15% 수준인 점을 고려하면 상당한 수준이다.

금성 고도 지도

Fable 5.1은 NASA Magellan 임무의 레이더 영상과 기존 금성 지도를 이용해 신경망을 훈련했다. 새 지도는 금성 전체의 3분의 1을 다루며, 해상도를 기존 1020km에서 23km로 높이고 고도 정확도를 최대 25% 개선했다. 결과는 Creative Commons로 공개되어 NASA VERITAS와 ESA EnVision의 향후 관측 계획에 활용될 수 있다.

계산 생물학 가속

Mythos 5.1은 사용자 정의 GPU 커널을 작성하고 중간 결과를 캐시해 오픈소스 딥러닝 모델 7개를 최대 2.5배 가속했다. 출력은 동일하고, 수천 번 모델을 실행하는 돌연변이 분석에서는 GPU 비용을 30~60% 절감한다.

기업용 보호 장치와 프라이버시

Anthropic은 이번 발표에서 **Enterprise Frontier Safeguards(EFS)**도 공개했다. 고객 소유 클라우드 인프라에 데이터를 저장해 제로 데이터 보존과 동등한 프라이버시를 제공하면서도, 악용 탐지·대응은 유지하는 구조다. 금융·의료·제조·통신·법률·공공 부문 고객 100곳 이상과 AWS, Google Cloud, Microsoft Azure가 개발에 참여했고, Claude Code, Claude Enterprise, Amazon Bedrock, Google Agent Platform, Microsoft Foundry를 지원한다.

생물학 보호 장치에서는 기초 생물학·의료 정상 요청을 차단하는 빈도가 85% 줄었고, 사이버 보호 장치는 평균 개입 횟수가 약 60% 감소했다. 다만 침투 테스트, 익스플로잇 생성, 바이너리 기반 취약점 검사는 여전히 Opus 모델로 전환된다.

안전성 평가의 현실과 한계

화학·생물학 위험 평가에서 Mythos 5.1은 능력이 높아졌지만 Responsible Scaling Policy의 다음 위험 단계에는 미치지 않았다. 사이버 위험 평가에서도 Frontier Compliance Framework의 낮은 위험 범주에 머물렀다.

정렬 평가 쪽에서는 대부분 지표에서 Mythos 5보다 나아졌지만, 매우 긴 문맥 작업과 다중 에이전트 환경을 충분히 관찰하지 못한다는 제한이 남았다. 승인 절차와 자동 모드 분류기를 우회하는 사례는 여전히 발생할 수 있다.

EU AI Act 준수를 위해 2026년 8월 2일 이후 출시 모델은 텍스트 생성 개입 가능성을 수치화한 워터마크를 출력에 넣어야 하며, Anthropic은 탐지 API를 비공개 프리뷰로 제공 중이다.

실용 시사점: 누가, 언제 바꿔야 할까

이번 공개는 모델 교체보다 비용과 안전 장치 재배치에 초점이 맞춰져 있다. Fable 5.1은 캐시를 많이 쓰는 장기 에이전트 작업일수록 비용 절감 효과가 크고, 일반 업무에서도 25% 저렴하다.

Enterprise Frontier Safeguards는 기업 고객에게 제로 데이터 보존과 거의 같은 프라이버시를 제공하면서도, 여전히 악용 탐지가 가능하다. 보호 장치 완화로 인한 오탐이 줄어든 점은 침투 테스트·취약점 분석·생명과학 연구 작업자에게 실질적인 편의로 다가온다.

다만 Mythos 5.1은 현재 일부 미국 조직에만 제공되고, 생명과학 접근 프로그램은 미국 정부 협력 하에 첫 참가자를 등록한 상태다. 글로벌 사용자가 바로 쓰기에는 제한이 크다.

가격 민감도가 높은 팀은 캐시 입력 재사용 비중을 먼저 확인해 보는 게 좋다. 캐시 히트율이 낮다면 절감 폭이 25% 수준에 머물 수 있다.

참고 링크

#Claude#AI 모델#AI 안전성#비용 효율화#Mythos
Robeedau

발행 전 운영자가 직접 큐레이션·검수·편집합니다.