AI

Claude Fable 5가 다시 열려요 — AI 모델 통제와 안전장치, 무슨 일이었나요?

Claude Fable 5가 7월 1일 전 세계에 재제공돼요. 6월 수출 통제부터 통제 해제, 안전장치 우회 제보와 새 분류기 대응, 업계 공동 프레임워크까지 이번 소식의 전말을 개발사 관점으로 차근차근 정리했어요.

크리에이티브소프트
크리에이티브소프트
2026년 7월 1일 ·

“우리가 쓰던 AI 모델이 어느 날 갑자기 막히면 어떻게 될까요?” 최근 실제로 그런 일이 있었어요. 글로벌 AI 모델이 정책 변수로 며칠간 멈췄다가 다시 열린 사례예요.

Anthropic이 자사 최신 모델 Claude Fable 5를 7월 1일부터 전 세계에 다시 제공한다고 밝혔어요. 6월의 수출 통제부터 통제 해제, 그리고 그 사이에 있었던 안전장치 이슈까지, 이번 소식이 어떤 흐름이었는지 개발사 관점으로 정리해 볼게요.

AI 모델의 접근 제한과 재개를 상징하는 이미지

1. 한눈에 보는 이번 소식

한눈에 보는 이번 소식 관련 이미지

먼저 전체 흐름을 세 줄로 요약하면 이래요.

  • 6월 12일: 미국 정부가 최신 모델 Claude Fable 5와 Mythos 5에 수출 통제를 적용하면서 두 모델의 접근이 중단됐어요.
  • 6월 30일: 수출 통제가 해제됐어요.
  • 7월 1일: Fable 5가 전 세계 사용자에게 다시 제공돼요.

중간에 왜 이런 조치가 있었는지, 그리고 그 과정에서 안전장치가 어떻게 바뀌었는지가 이번 소식의 핵심이에요.

2. 6월, 두 모델의 접근이 멈춘 이유

6월 12일, 미국 정부는 Anthropic의 최신 모델인 Claude Fable 5와 Claude Mythos 5에 수출 통제를 적용했어요. 이 조치는 외국 국적자의 접근을 제한하도록 요구하는 것이었어요.

문제는 이 지시가 즉시 발효됐다는 점이었어요. 미국 안팎을 막론하고 사용자의 국적을 실시간으로 확인할 방법이 마땅치 않았거든요. 그래서 Anthropic은 특정 국가 사용자만 걸러내는 대신, 모든 사용자에게 두 모델의 접근을 일시 중단하는 방식으로 대응할 수밖에 없었어요.

정책과 규제가 기술 서비스에 영향을 주는 상황을 나타낸 이미지

3. 7월 1일, 다시 열리는 Fable 5

6월 30일 자로 Fable 5와 Mythos 5에 대한 수출 통제가 해제됐어요. 이에 따라 Fable 5는 7월 1일(수)부터 전 세계 사용자에게 다시 제공돼요.

이용할 수 있는 경로는 Claude Platform, Claude.ai, Claude Code, Claude Cowork이에요. 요금제별로는 Pro·Max·Team과 일부 Enterprise 플랜에서 7월 7일까지 주간 사용량 한도의 50%까지 Fable 5를 포함하고, 이후에는 사용량 크레딧으로 제공된다고 해요. AWS·Google Cloud·Microsoft Foundry 같은 클라우드 경로도 순차적으로 다시 열릴 예정이에요.

한편 더 적은 안전장치로 소수의 신뢰 파트너에게만 제공되던 Mythos 5는, 6월 26일 정부 승인 이후 일부 미국 조직에 한해 접근이 복원됐어요.

4. 발단이 된 안전장치 우회 제보

그렇다면 애초에 왜 통제가 걸린 걸까요? 발단은 Amazon 연구진의 제보였어요. 연구진은 Fable 5의 안전장치를 우회해 모델이 여러 소프트웨어 취약점을 식별하도록 유도하는 방법을 찾아냈고, 한 사례에서는 취약점을 악용하는 방식을 보여주는 시연 코드까지 나왔다고 해요.

소프트웨어 보안 취약점 점검을 상징하는 이미지

다만 Anthropic은 이 보고를 검토한 결과 몇 가지를 함께 밝혔어요. 같은 취약점은 Claude Opus 4.8, GPT-5.5, Kimi K2.7 등 상대적으로 덜 강력한 모델들도 동일하게 식별할 수 있었고, 시연 역시 테스트한 다른 모델들도 재현할 수 있었다는 거예요. 즉 이 사례가 Mythos 급의 고유한 공격 역량을 드러낸 건 아니었고, 안전장치가 신중하게 차단하던 경계선상의 사례에 해당했다고 설명했어요.

5. Anthropic의 대응 — 새 안전 분류기

Anthropic은 경계 사례라고 판단하면서도 빠르게 조치했어요. 정부와 협력해 문제된 동작을 겨냥하는 개선된 안전 분류기(classifier, 위험한 요청을 자동으로 걸러내는 장치)를 새로 학습시킨 거예요.

AI 시스템의 안전장치와 필터링을 상징하는 이미지

이 분류기 덕분에 Amazon 보고서에서 설명한 기법은 이제 99% 이상 차단돼요. 요청이 막히면 사용자에게 알림이 가고, 해당 요청은 Opus 4.8로 대신 전달돼요. 미국 상무부 산하 CAISI(AI 표준·혁신 센터)도 이전과 새 안전장치를 시험한 뒤 매우 강력하다고 평가했다고 해요. 다만 새 분류기는 정상적인 코딩·디버깅 요청까지 더 자주 걸러내는 부작용이 있어서, Anthropic은 오탐(false positive)을 줄이는 방향으로 계속 다듬겠다고 밝혔어요.

6. 업계 공동 프레임워크와 정부 협력

이번 일을 계기로 Anthropic은 한 걸음 더 나갔어요. Amazon·Microsoft·Google 등 파트너들과 함께 ‘탈옥(jailbreak, 모델의 안전장치를 우회하는 기법)‘의 심각도를 판단하는 공통 프레임워크를 만들기 시작한 거예요.

새로운 우회 기법이 발견됐을 때 그 위험도를 일관된 기준으로 분류할 수 있으면, 개발사들이 문제를 빠르게 선별하고, 더 안전하게 모델을 출시하며, 정부·업계와 위험 수준을 같은 언어로 소통할 수 있어요. 여기에 더해 미국 정부와의 사전 출시 테스트, 정보 공유, 연구 협력도 강화한다고 해요.

7. 이 소식이 시사하는 점

이번 사례는 두 가지를 잘 보여줘요. 하나는 AI 모델의 가용성이 기술 문제만이 아니라 정책·규제 같은 외부 변수에도 영향을 받는다는 점이에요. 또 하나는 모델의 안전장치가 실제 사건을 거치며 어떻게 조정되는지예요.

AI를 업무에 도입하는 입장에서 보면, 특정 모델 하나에 서비스를 깊게 묶어두기보다 상황에 따라 유연하게 대응할 수 있는 구조가 왜 중요한지 다시 생각하게 하는 소식이기도 해요. 저희처럼 서비스를 직접 만들고 운영해온 곳에서는, 외부 변수에 흔들려도 버틸 수 있게 설계해두는 일이 늘 중요한 과제였거든요.

8. 자주 묻는 질문 (FAQ)

Fable 5는 지금 바로 쓸 수 있나요?

7월 1일(수)부터 Claude Platform·Claude.ai·Claude Code·Claude Cowork에서 전 세계 사용자에게 제공돼요. 클라우드 경로(AWS·Google Cloud·Microsoft Foundry)는 순차적으로 다시 열려요.

안전장치가 강화되면 일반 사용에도 영향이 있나요?

새 분류기는 위험한 요청을 더 강하게 차단하는 대신, 정상적인 코딩·디버깅 요청까지 더 자주 걸러낼 수 있어요. Anthropic은 이 오탐을 줄이는 방향으로 계속 개선하겠다고 밝혔어요.

Mythos 5도 다시 열렸나요?

Mythos 5는 6월 26일 정부 승인 이후 일부 미국 조직에 한해 접근이 복원됐어요. 더 넓은 파트너로의 확대는 계속 협의 중이에요.

9. 마무리

정리하면, Claude Fable 5는 6월의 수출 통제와 안전장치 이슈를 거쳐 7월 1일 다시 전 세계에 제공돼요. AI 모델의 가용성과 안전장치가 실제로 어떻게 관리되는지 한눈에 보여준 사례라, 흐름을 알아두면 도움이 될 거예요.

이 글이 도움이 됐다면 저장해두고, 비슷한 고민을 하는 동료와 함께 보세요.


관련해서 함께 보면 좋은 글이에요.