Claude Fable 5가 다시 열려요 — AI 모델 통제와 안전장치, 무슨 일이었나요?
Claude Fable 5가 7월 1일 전 세계에 재제공돼요. 6월 수출 통제부터 통제 해제, 안전장치 우회 제보와 새 분류기 대응, 업계 공동 프레임워크까지 이번 소식의 전말을 개발사 관점으로 차근차근 정리했어요.

“우리가 쓰던 AI 모델이 어느 날 갑자기 막히면 어떻게 될까요?” 최근 실제로 그런 일이 있었어요. 글로벌 AI 모델이 정책 변수로 며칠간 멈췄다가 다시 열린 사례예요.
Anthropic이 자사 최신 모델 Claude Fable 5를 7월 1일부터 전 세계에 다시 제공한다고 밝혔어요. 6월의 수출 통제부터 통제 해제, 그리고 그 사이에 있었던 안전장치 이슈까지, 이번 소식이 어떤 흐름이었는지 개발사 관점으로 정리해 볼게요.

1. 한눈에 보는 이번 소식

먼저 전체 흐름을 세 줄로 요약하면 이래요.
- 6월 12일: 미국 정부가 최신 모델 Claude Fable 5와 Mythos 5에 수출 통제를 적용하면서 두 모델의 접근이 중단됐어요.
- 6월 30일: 수출 통제가 해제됐어요.
- 7월 1일: Fable 5가 전 세계 사용자에게 다시 제공돼요.
중간에 왜 이런 조치가 있었는지, 그리고 그 과정에서 안전장치가 어떻게 바뀌었는지가 이번 소식의 핵심이에요.
2. 6월, 두 모델의 접근이 멈춘 이유
6월 12일, 미국 정부는 Anthropic의 최신 모델인 Claude Fable 5와 Claude Mythos 5에 수출 통제를 적용했어요. 이 조치는 외국 국적자의 접근을 제한하도록 요구하는 것이었어요.
문제는 이 지시가 즉시 발효됐다는 점이었어요. 미국 안팎을 막론하고 사용자의 국적을 실시간으로 확인할 방법이 마땅치 않았거든요. 그래서 Anthropic은 특정 국가 사용자만 걸러내는 대신, 모든 사용자에게 두 모델의 접근을 일시 중단하는 방식으로 대응할 수밖에 없었어요.

3. 7월 1일, 다시 열리는 Fable 5
6월 30일 자로 Fable 5와 Mythos 5에 대한 수출 통제가 해제됐어요. 이에 따라 Fable 5는 7월 1일(수)부터 전 세계 사용자에게 다시 제공돼요.
이용할 수 있는 경로는 Claude Platform, Claude.ai, Claude Code, Claude Cowork이에요. 요금제별로는 Pro·Max·Team과 일부 Enterprise 플랜에서 7월 7일까지 주간 사용량 한도의 50%까지 Fable 5를 포함하고, 이후에는 사용량 크레딧으로 제공된다고 해요. AWS·Google Cloud·Microsoft Foundry 같은 클라우드 경로도 순차적으로 다시 열릴 예정이에요.
한편 더 적은 안전장치로 소수의 신뢰 파트너에게만 제공되던 Mythos 5는, 6월 26일 정부 승인 이후 일부 미국 조직에 한해 접근이 복원됐어요.
4. 발단이 된 안전장치 우회 제보
그렇다면 애초에 왜 통제가 걸린 걸까요? 발단은 Amazon 연구진의 제보였어요. 연구진은 Fable 5의 안전장치를 우회해 모델이 여러 소프트웨어 취약점을 식별하도록 유도하는 방법을 찾아냈고, 한 사례에서는 취약점을 악용하는 방식을 보여주는 시연 코드까지 나왔다고 해요.

다만 Anthropic은 이 보고를 검토한 결과 몇 가지를 함께 밝혔어요. 같은 취약점은 Claude Opus 4.8, GPT-5.5, Kimi K2.7 등 상대적으로 덜 강력한 모델들도 동일하게 식별할 수 있었고, 시연 역시 테스트한 다른 모델들도 재현할 수 있었다는 거예요. 즉 이 사례가 Mythos 급의 고유한 공격 역량을 드러낸 건 아니었고, 안전장치가 신중하게 차단하던 경계선상의 사례에 해당했다고 설명했어요.
5. Anthropic의 대응 — 새 안전 분류기
Anthropic은 경계 사례라고 판단하면서도 빠르게 조치했어요. 정부와 협력해 문제된 동작을 겨냥하는 개선된 안전 분류기(classifier, 위험한 요청을 자동으로 걸러내는 장치)를 새로 학습시킨 거예요.

이 분류기 덕분에 Amazon 보고서에서 설명한 기법은 이제 99% 이상 차단돼요. 요청이 막히면 사용자에게 알림이 가고, 해당 요청은 Opus 4.8로 대신 전달돼요. 미국 상무부 산하 CAISI(AI 표준·혁신 센터)도 이전과 새 안전장치를 시험한 뒤 매우 강력하다고 평가했다고 해요. 다만 새 분류기는 정상적인 코딩·디버깅 요청까지 더 자주 걸러내는 부작용이 있어서, Anthropic은 오탐(false positive)을 줄이는 방향으로 계속 다듬겠다고 밝혔어요.
6. 업계 공동 프레임워크와 정부 협력
이번 일을 계기로 Anthropic은 한 걸음 더 나갔어요. Amazon·Microsoft·Google 등 파트너들과 함께 ‘탈옥(jailbreak, 모델의 안전장치를 우회하는 기법)‘의 심각도를 판단하는 공통 프레임워크를 만들기 시작한 거예요.
새로운 우회 기법이 발견됐을 때 그 위험도를 일관된 기준으로 분류할 수 있으면, 개발사들이 문제를 빠르게 선별하고, 더 안전하게 모델을 출시하며, 정부·업계와 위험 수준을 같은 언어로 소통할 수 있어요. 여기에 더해 미국 정부와의 사전 출시 테스트, 정보 공유, 연구 협력도 강화한다고 해요.
7. 이 소식이 시사하는 점
이번 사례는 두 가지를 잘 보여줘요. 하나는 AI 모델의 가용성이 기술 문제만이 아니라 정책·규제 같은 외부 변수에도 영향을 받는다는 점이에요. 또 하나는 모델의 안전장치가 실제 사건을 거치며 어떻게 조정되는지예요.
AI를 업무에 도입하는 입장에서 보면, 특정 모델 하나에 서비스를 깊게 묶어두기보다 상황에 따라 유연하게 대응할 수 있는 구조가 왜 중요한지 다시 생각하게 하는 소식이기도 해요. 저희처럼 서비스를 직접 만들고 운영해온 곳에서는, 외부 변수에 흔들려도 버틸 수 있게 설계해두는 일이 늘 중요한 과제였거든요.
8. 자주 묻는 질문 (FAQ)
Fable 5는 지금 바로 쓸 수 있나요?
7월 1일(수)부터 Claude Platform·Claude.ai·Claude Code·Claude Cowork에서 전 세계 사용자에게 제공돼요. 클라우드 경로(AWS·Google Cloud·Microsoft Foundry)는 순차적으로 다시 열려요.
안전장치가 강화되면 일반 사용에도 영향이 있나요?
새 분류기는 위험한 요청을 더 강하게 차단하는 대신, 정상적인 코딩·디버깅 요청까지 더 자주 걸러낼 수 있어요. Anthropic은 이 오탐을 줄이는 방향으로 계속 개선하겠다고 밝혔어요.
Mythos 5도 다시 열렸나요?
Mythos 5는 6월 26일 정부 승인 이후 일부 미국 조직에 한해 접근이 복원됐어요. 더 넓은 파트너로의 확대는 계속 협의 중이에요.
9. 마무리
정리하면, Claude Fable 5는 6월의 수출 통제와 안전장치 이슈를 거쳐 7월 1일 다시 전 세계에 제공돼요. AI 모델의 가용성과 안전장치가 실제로 어떻게 관리되는지 한눈에 보여준 사례라, 흐름을 알아두면 도움이 될 거예요.
이 글이 도움이 됐다면 저장해두고, 비슷한 고민을 하는 동료와 함께 보세요.
관련해서 함께 보면 좋은 글이에요.