Fable 5와 Mythos 5: AI 모델 접근권도 제품 신뢰의 일부가 되었습니다
Anthropic의 Fable 5 접근 중단과 복구 사례는 안전한 AI 모델에도 명확한 보호장치, 원본 기록, 설명 가능한 사용자 제어가 필요하다는 점을 보여줍니다.
Anthropic의 Fable 5 사례는 AI 제품을 만들거나 사용하는 사람들에게 중요한 신호를 줍니다. 이제 프런티어 모델은 벤치마크 점수만의 문제가 아닙니다. 접근 권한, 보호장치, 정부 검토, 사용자 신뢰가 모두 제품 경험의 일부가 되고 있습니다.
Anthropic에 따르면 Claude Fable 5와 Claude Mythos 5는 2026년 6월 9일 공개됐습니다. 두 모델은 같은 기반 모델을 공유하지만, 공개 대상과 보호장치가 달랐습니다. Fable 5는 더 강한 보호장치를 적용한 일반 사용자용 안전 버전으로 설명됐고, Mythos 5는 보호장치가 더 적은 버전으로 방어적 사이버보안 작업을 하는 일부 Project Glasswing 파트너에게만 제공됐습니다.
이후 접근 정책은 빠르게 바뀌었습니다. Anthropic은 미국 정부가 6월 12일 두 모델에 export controls를 적용했고, 외국 국적자 접근 제한이 필요해졌다고 설명했습니다. Anthropic은 실시간으로 국적을 신뢰성 있게 검증할 방법이 없었기 때문에 두 모델의 접근을 모든 사용자에게 일시 중단했습니다. 6월 30일에는 통제가 해제됐고, Fable 5는 7월 1일부터 전 세계 사용자에게 다시 제공됐습니다. Mythos 5는 승인된 일부 미국 조직부터 더 제한적으로 복구됐습니다.

이미지: Telli.sh용 AI 생성 에디토리얼 이미지. 프롬프트: 현대 데이터센터, 추상적인 정부 감독, AI 거버넌스, 로고와 읽을 수 있는 텍스트 없음.
핵심은 "모델이 돌아왔다"가 전부가 아닙니다
간단한 헤드라인은 Fable 5가 중단됐다가 복구됐다는 것입니다. 하지만 더 중요한 메시지는 "안전 버전"이라고 해서 거버넌스가 필요 없어지는 것은 아니라는 점입니다.
Anthropic은 Fable 5에 자사 기준 가장 강한 보호장치를 적용했다고 설명했습니다. 그럼에도 Amazon 연구진이 사이버보안 맥락에서 일부 보호장치를 우회하는 방법을 보고했고, Anthropic은 자체 테스트 결과 이것이 Mythos 수준의 고유한 사이버 능력을 노출한 것은 아니라고 설명했습니다. 하지만 Anthropic은 해당 동작을 막는 개선된 safety classifier를 훈련했고, 정부 및 파트너와 조율한 뒤 접근을 복구했습니다.
이것이 현대 AI 안전의 실제 모습에 가깝습니다. 한 번 켜고 끝나는 스위치가 아니라, 배포, 레드팀, classifier 업데이트, 접근 결정, 위험 분류가 계속 순환하는 구조입니다.
사용자에게 설명해야 할 것
보안 전문가가 아닌 사용자에게는 이 사례를 이렇게 설명할 수 있습니다.
- Fable 5는 매우 강력한 모델 계열의 더 강하게 보호된 버전입니다.
- Mythos 5는 방어적 사이버보안 파트너에게 제한적으로 제공된, 보호장치가 더 적은 버전입니다.
- 보고된 jailbreak가 미국 정부의 개입을 부를 정도로 중요한 이슈가 됐습니다.
- Anthropic은 누가 접근할 수 있는지 즉시 검증하기 어려워 전체 접근을 일시 중단했습니다.
- 추가 보호장치와 정부·파트너 조율 이후 접근이 복구됐습니다.
이 사례가 중요한 이유는 AI 제품의 신뢰가 이제 "변경을 얼마나 잘 설명하는가"와 연결되기 때문입니다. 모델이 어떤 요청을 거절하거나, 접근을 제한하거나, 더 안전한 모델로 우회시킨다면 사용자는 제품이 고장 난 것인지, 안전상 차단된 것인지, 의도된 동작 변경인지 이해할 수 있어야 합니다.
AI 제품이 얻어야 할 교훈
Fable 5 이야기는 사실 한 모델의 다운타임에 관한 것이 아닙니다. 그것은 AI 제품에 대한 신뢰가, 시스템이 요청에 무엇을 했는지를 얼마나 투명하게 보여주는가에 점점 더 좌우된다는 신호입니다. 제품이 콘텐츠를 차단하거나 요약하거나 번역하거나 다른 형태로 바꿀 때는, 사용자가 결과를 그대로 믿는 대신 검증할 수 있도록 충분한 원본을 남겨 두어야 합니다.
이 원칙은 Telli.sh 같은 일상적인 도구에도 그대로 적용됩니다. 노트, 전사, 요약은 그 아래에 원본이 검토 가능한 상태로 남아 있을 때에만 신뢰할 수 있습니다. 번역이 우연한 부작용이 아니라 명시적인 선택일 때, 그리고 요약이 언제나 실제로 말한 내용까지 거슬러 확인될 수 있을 때 말입니다.