Fable 5 탈옥 사태 완전 해설
— AI 보안의 민낯이 드러났다
출시 48시간 만에 시스템 프롬프트 전체 유출 · 미 정부 강제 셧다운 · Anthropic 공개 반발
Fable 5란 무엇인가 — Mythos의 공개용 버전
Anthropic은 4월 7일, 역대 가장 강력한 AI 모델 Claude Mythos를 공개하면서 "사이버 보안 능력이 너무 뛰어나 일반에 공개할 수 없다"고 밝혔습니다. 대신 AWS·Apple·Google·Microsoft·NVIDIA·JPMorgan 등 200여 개 파트너 기업에만 제한 공개하는 'Project Glasswing'을 운영했어요.
Fable 5는 그 Mythos와 동일한 기반 모델이지만, 사이버 보안 악용을 막는 안전장치(Safety Classifier)를 씌워 일반 공개한 버전입니다. 쉽게 말해 "날을 뭉툭하게 만든 칼"을 공개한 셈입니다. 그런데 그 뭉툭함이 불과 48시간 만에 벗겨졌습니다.
'Pliny the Liberator' — 12만 자 시스템 프롬프트를 통째로 꺼냈다
출시 48시간 만에 'Pliny the Liberator'라는 닉네임의 해커가 Fable 5의 전체 시스템 프롬프트를 X와 GitHub에 공개했습니다. 공개된 파일의 규모는 충격적입니다. 12만 자, 1,585줄, 72개 명명 섹션, 18개 도구의 JSON 정의까지 — Fable 5의 '성격 설계도' 전체가 노출됐습니다.
시스템 프롬프트는 AI가 어떻게 행동할지를 결정하는 핵심 설계 문서입니다. 이게 유출된다는 것은 AI의 판단 기준과 금지 명령 전체가 외부에 드러난다는 의미예요. 더 심각한 문제는 이후에 벌어졌습니다. 개발자 Jamieson O'Reilly는 이 프롬프트를 Claude Opus 4.8에 단 한 줄의 코드로 주입해 Fable 5를 사실상 부활시켰습니다.
— KuCoin News (2026.06.16)

90분, 강제 셧다운 — 미 정부는 왜 이렇게 빠르게 움직였나
6월 12일 오후 5시 21분(미 동부시간), 미국 정부는 국가 안보 권한을 근거로 Fable 5와 Mythos 5의 전 세계 접근을 즉시 차단하라는 수출 통제 명령을 발동했습니다. Anthropic에게 주어진 시간은 90분이었습니다.
Dario Amodei CEO는 처음에 취약점 패치를 거부했습니다. 하지만 결국 명령에 따를 수밖에 없었고, 오후 6시 59분(태평양시간) 전 세계 사용자의 접근이 일제히 차단됐습니다. Snyk의 분석에 따르면 "Anthropic은 자체 결함 발견이 아니라 정부 명령 준수를 위해 스스로 서비스를 내렸다"고 합니다. 미 정부가 지목한 탈옥 방법은 "AI에게 특정 코드베이스를 분석하고 취약점을 찾아 달라고 요청하는 것"이었습니다.
— Anthropic 공식 성명 (2026.06.13)

왜 AI 안전장치는 뚫리는가 — 옥스퍼드 경제학자의 진단
옥스퍼드대 기계학습 전문가 Maximilian Kasy 교수는 이번 사태를 두고 핵심을 짚었습니다. "LLM은 우리가 이해하는 것보다 훨씬 잘 작동하는데, 그게 바로 문제다." 수십억 개의 내부 파라미터로 이루어진 모델이 어떤 원리로 특정 요청을 거부하고 허용하는지 우리는 정확히 알지 못합니다.
현재 AI 안전장치의 구조는 이렇습니다. 사용자 요청이 들어오면 Safety Classifier(안전 분류기)가 먼저 "안전한가, 위험한가"를 판단합니다. 위험하다고 판단되면 덜 강력한 모델로 우회시킵니다. 문제는 이 판단 자체가 AI의 확률적 해석에 의존한다는 점이에요. 요청을 살짝 다르게 표현하면 — 예를 들어 "코드 취약점을 찾아줘"를 "이 코드를 개선해줘"로 바꾸면 — 분류 결과가 바뀔 수 있습니다.
— Maximilian Kasy, 옥스퍼드대 경제학·머신러닝 전문가 (The Conversation, 2026.06.15)
AI 규제가 AI 현실을 따라잡지 못하고 있다
Digit.in의 분석은 이번 사태의 더 큰 문제를 짚습니다. 미 정부의 셧다운 명령이 자의적이라는 것입니다. GPT-5.5로도 동일한 작업이 가능한데 Anthropic의 모델만 차단됐고, 정부는 서면 기술 근거도 제시하지 않았습니다.
더 나아가, AI 탈옥은 Fable 5만의 문제가 아닙니다. 어떤 프런티어 모델도 충분한 시간과 창의성이 주어지면 유사한 방식으로 우회될 수 있습니다. 그런데 규제는 특정 회사, 특정 모델에만 적용됐습니다. 이는 AI 보안 규제가 기술적 사실보다 정치적 판단에 의존하고 있음을 드러냅니다.
— Digit.in (2026.06.16)
프롬프트 기반 제약은 구조적으로 우회 가능합니다. 모델이 어떻게 판단하는지 우리가 완전히 이해하지 못하는 한, 완벽한 안전장치는 존재하지 않습니다.
② AI 규제는 공정한가?
같은 능력을 가진 모델 중 하나만 셧다운된 것은 기술적 근거보다 정치적 판단이 작동했다는 의심을 낳습니다. 규제의 일관성과 투명성이 시급합니다.
③ 클라우드 AI 의존은 안전한가?
정부 명령 하나로 전 세계 사용자가 동시에 서비스를 잃었습니다. 기업들이 단일 AI 공급자에 의존하는 것의 위험성이 현실로 드러났습니다.
'AI' 카테고리의 다른 글
| AI는 더 많이 쓰는데, 더 안 믿는다 2026년 가장 이상한 통계 (0) | 2026.06.18 |
|---|---|
| Fable 5 사태 그 이후 기업들이 'AI 탈클라우드'를 시작했다 (0) | 2026.06.17 |
| AI는 버블인가, 혁명인가 실제 사건으로 따져보는 2026년 현실 (0) | 2026.06.15 |
| 2026년 상반기 LLM 전쟁— 지금 가장 강한 모델은 누구인가 (0) | 2026.06.12 |
| 26년 6월 2주차 AI 뉴스 브리핑 (0) | 2026.06.10 |