링크가 복사되었습니다!

단 3일 천하 Fable 5, 오후 5시 21분 편지 한 통으로 중단되다

미국 정부는 수출 통제 명령을 사용해 출시 사흘 만인 6월 12일 Anthropic에 Fable 5와 Mythos 5의 가동 중단을 강제했습니다. Anthropic이 주장한 탈옥 시도는 모델에 소프트웨어 버그 수정을 요청한 것이었습니다. 불과 이틀 전, Anthropic은 정부에 바로 이러한 권한을 공개적으로 요청한 바 있습니다.

🌐
기계 번역

이 기사는 영어 원문에서 자동 번역되었습니다. 영어 원문 읽기

어두운 정장을 입은 손이 거대한 산업용 빨간색 차단기 스위치를 내리는 동안, 유리창 너머로 거대한 데이터 센터 홀의 불빛이 한 줄씩 꺼져가는 모습. 정부 명령에 의한 AI 모델 폐쇄를 상징함

핵심 요약

  • 워싱턴, 활성화된 AI 모델 회수 조치 단행: 2026년 6월 12일, 미국 정부는 수출 통제 명령을 발동하여 출시 사흘 만에 Anthropic이 모든 고객을 대상으로 Claude Fable 5 및 Claude Mythos 5 서비스를 중단하도록 강제했습니다.
  • 가동 중단 트리거에 대한 논란: Anthropic은 정부가 제시한 증거가 단일한 “비보편적이고 지엽적인” 탈옥(jailbreak) 사례에 불과하다고 밝혔습니다. 이 탈옥은 단순히 모델에 특정 코드베이스를 읽고 소프트웨어 버그를 수정해 달라고 요청하는 수준이었으며, 이는 이미 다른 공개 모델도 기본적으로 지원하는 기능이라는 설명입니다.
  • 혹독한 타이밍: 이번 행정 명령이 내려지기 불과 이틀 전, Anthropic은 정부가 위험한 AI 배포를 차단할 수 있는 법적 권한을 가져야 한다는 내용의 정책 프레임워크를 발표했습니다. 정작 본인들이 요청한 권한이 휘둘러졌으나, 그들이 함께 촉구했던 정당한 법적 절차(due process)는 생략되었습니다.
  • 진짜 쟁점은 아키텍처 구조: Fable 5와 Mythos 5는 안전장치 분류기(classifier) 유무만 다를 뿐 본질적으로 동일한 모델입니다. 따라서 Fable에 대한 확실한 탈옥 주장은 Project Glasswing의 검증을 거치지 않은 일반 대중이 Anthropic이 세계 최강의 사이버 보안 모델이라고 묘사했던 기술에 직접 도달할 수 있음을 의미합니다.

오후 5시 21분에 온 편지 한 통

6월 12일 동부 시간(ET) 오후 5시 21분, Anthropic 본사에 편지 한 통이 도착했습니다. 그리고 그날 밤이 저물기 전에, Anthropic이 “역대 출시한 그 어떤 모델의 성능도 능가한다”고 자신했던 인공지능(AI) 모델은 지구상의 모든 고객을 대상으로 비활성화되어 사라졌습니다.

Advertisement

이 서한은 국가안보 권한에 의거해 발행된 미국 정부의 수출 통제 명령이었습니다. 편지에는 “미국 국내외를 막론하고 외국 국적을 가진 Anthropic 직원들을 포함한 모든 외국인”의 Claude Fable 5 및 Claude Mythos 5에 대한 접근을 중단하라는 명령이 담겨 있었습니다. 사측은 이 행정명령의 실질적인 결과로 인해 모든 고객에 대해 “Fable 5와 Mythos 5를 갑작스럽게 차단할 수밖에 없었다”고 설명했습니다. 이유는 명백합니다. 프롬프트 창에서 여권을 검사하는 대중용 AI 서비스는 존재하지 않기 때문입니다. 다만, 다른 모든 Anthropic 모델에 대한 접근은 계속 활성화된 상태로 유지됩니다.

Fable 5는 6월 9일에 출시되었습니다. 단 사흘 동안 생존했습니다.

그동안 각국 정부가 자국 국경 내에서 특정 앱을 금지하거나, 칩 제조업체를 제재하고, 반도체 수출을 제한한 적은 있었습니다. 그러나 기업으로 하여금 자사의 대표적인 플래그십 제품을 전 세계적으로 차단하도록 명령하는 것은 진정으로 전례 없는 국가 권력의 행사입니다. 심지어 Anthropic은 이 모델이 “수억 명의 사용자”에게 배포되었다고 밝힌 바 있습니다. 그리고 이 명령을 받은 기업은 지난 4개월 동안 Trump 행정부와 공공연히 대립각을 세워왔으며, 바로 이틀 전까지 정부가 정확히 이러한 종류의 권한을 가져야 한다고 주장했던 장본인이었습니다.

행정 명령이 실제로 의미하는 바

외신 헤드라인이 시사하는 것보다 훨씬 더 기묘한 그 메커니즘부터 살펴보겠습니다. 이번 조치는 법원의 판결이나 소비자 보호법에 따른 리콜 조치가 아니었습니다. Anthropic 스스로가 제안했던 차단 권한은 회사 측 설명대로라면 “현행법이나 의회에 제출된 기존 법안들을 훨씬 뛰어넘는 수준”이었습니다. 즉, 당시로서는 AI 모델을 강제로 중단시킬 수 있는 구체적인 리콜 조항이 법적으로 존재하지 않았습니다. 대신 정부가 선택한 무기는 일반적으로 칩, 무기 설계도, 암호화 기술이 외국의 적대 세력에 유출되는 것을 차단할 때 사용하는 행정 도구인 ‘수출 통제 명령’이었습니다.

적용 범위의 모호성이 사실상의 전면 가동 중단으로 이어졌습니다. 미국 영토 내외를 막론하고 Anthropic 내부 직원을 포함한 모든 외국인의 접근을 금지함으로써, 필터링을 통한 준수 자체를 불가능하게 만들었습니다. Anthropic은 정부의 서한에 “국가안보 우려에 대한 구체적인 세부 사항은 명시되어 있지 않았다”고 밝혔습니다. 사측은 정부가 적발했다고 주장하는 문제에 대해 오직 “구두 증언”만을 전달받았을 뿐이라고 주장했습니다.

이는 향후 분쟁 과정에서 매우 중요한 요인입니다. 공식적인 법 제정 절차는 법정에서 한 줄씩 시시비비를 가릴 수 있습니다. 하지만 문서화된 내용 없이 구두로만 정당화된 명령은 피고가 자신이 제대로 보지도 못한 혐의를 상대로 무죄를 입증해야 하는 처지에 놓이게 만듭니다. 이번 싸움에서 굳이 Anthropic의 편을 들지 않더라도, 이 프로세스가 투명성과는 정반대 방향으로 흘러가고 있음은 명백합니다.

Advertisement

조치의 근거가 된 탈옥 시도

Anthropic에 따르면, 정부는 Fable 5의 안전 시스템을 우회하는 일명 “탈옥(jailbreak)” 기법을 파악한 것으로 믿고 있습니다. 탈옥이란 안전장치가 원래 거부해야 하는 작업을 모델이 실행하도록 프롬프트를 조작하는 행위를 뜻합니다.

탈옥 기법에 대한 Anthropic의 묘사를 보면 사태는 황당함에 가까워집니다. 사측은 적발된 탈옥 기법이 “본질적으로 모델에 특정 코드베이스를 읽고 소프트웨어 결함을 수정해 달라고 요청하는 수준에 불과하다”고 설명했습니다. 이는 고도의 해킹 기술이 아닙니다. 전 세계 모든 기업의 보안 부서가 매일 수행하는 일상적인 방어용 보안 업무의 묘사일 뿐입니다. Anthropic은 명령의 근거가 된 시연 자료와 보고서를 검토한 결과, 해당 우회 기법이 노출한 결함들은 “OpenAI의 GPT-5.5를 포함해” 다른 공개 모델들도 아무런 우회 절차 없이 탐지해 낼 수 있는 “이미 알려진 경미한 취약점 몇 가지”에 불과했다고 주장했습니다. 다른 경쟁사 모델에 대해 이와 유사한 가동 중단 명령이 발동된 사례는 공개된 바 없습니다.

동시에 귀를 기울여야 할 두 가지 반론이 있습니다. 첫째, 이는 전적으로 Anthropic 측의 일방적인 주장입니다. 행정 명령도, 보고서도 비공개 상태이며 정부는 Anthropic이 보지 못했거나 설명하지 않으려는 다른 증거를 쥐고 움직였을 수 있습니다. 둘째, 이번 명령이 내려지기 전에도 Fable 5에 대한 탈옥 주장은 온라인상에 공공연히 존재했습니다. 출시 며칠 후, 잘 알려진 AI 레드테이머 Pliny the Liberator는 자신의 팀이 Fable 5의 안전 분류기를 우회했다고 공개적으로 주장하며, 모델이 거부해야 할 작동 가능한 소프트웨어 공격(exploit) 코드를 생성해 내는 스크린샷을 게시했습니다. TechTimes는 6월 12일에 이 사실을 보도했지만 정부 조치와의 직접적인 연관성은 언급하지 않았으며, 현재까지 이 주장이 정부 명령으로 직결되었다는 공식적인 증거는 없습니다.

Anthropic의 반박 논점은 우회 성공 여부가 아니라 ‘절차’에 있습니다. 사측은 출시 전 수주 동안 미국 정부, 영국 AI 안전 연구소(UK AISI) 및 민간 제3자 기관들과 함께 “총 수천 시간 동안” Fable의 안전장치에 대한 레드팀 테스트를 거쳤으며, “테스터 중 그 누구도 보편적인 탈옥 경로를 찾아내지 못했다”고 강조했습니다. 아울러 어떤 서비스 제공업체도 완벽한 탈옥 방지력을 가질 수는 없다는 점을 인정하면서, 그렇기에 안전장치 외에도 모니터링 시스템과 공격 패턴 연구를 위한 30일간의 데이터 보존 정책을 병행해 왔다고 밝혔습니다.

하나의 모델, 두 개의 이름

Fable 5에 대한 우회 우려가 왜 곧바로 국가안보 통제 장치를 작동시켰는지 이해하려면 아키텍처를 보아야 합니다. Fable 5와 Mythos 5는 별개의 모델이 아닙니다. 겉옷만 다르게 입은 동일한 엔진입니다.

Advertisement

Fable 5는 일반 대중용 버전입니다. 이 버전에는 사이버 보안, 생물학 및 화학, 모델 복제 등과 관련된 요청을 감지해 하위 등급 모델인 Claude Opus 4.8로 답변을 이관하고 사용자에게 이를 고지하는 안전 분류기가 탑재되어 있습니다. Anthropic은 이러한 안전장치가 다소 보수적으로 조정되어 평균적으로 “전체 세션의 5% 미만”에서 작동한다고 밝혔습니다. 이 비율을 사용량 규모로 환산해 보면 수치가 와닿을 것입니다. 100만 세션당 최대 5만 세션이 우회 필터에 걸려 답변이 전환될 수 있습니다. Anthropic은 출시 당시 이러한 한계를 지적했고, 이번 가동 중단 선언문에서도 안전장치가 지나치게 촘촘하여 “많은 사용자가 필터가 과도하게 넓게 작동한다고 불만을 제기했다”고 시인했습니다.

Mythos 5는 미국 정부와 협력하여 운영되는 제한적 접근 프로그램인 Project Glasswing을 통해 일부 사이버 방어 조직 및 인프라 제공업체에만 공급되는 “일부 영역의 안전장치가 해제된 동일 모델”입니다. Anthropic은 이 모델을 “전 세계 모든 모델 중 가장 강력한 사이버 보안 기능을 제공하는 모델”이라고 명시했습니다.

이 구조가 핵심입니다. Fable과 Mythos의 차이는 지능의 차이가 아니라 분류기 필터의 차이입니다. 따라서 누군가 Fable 5를 탈옥했다고 주장한다면, 이는 곧 일반 대중이 Project Glasswing의 신원 검증 절차 없이도 Mythos 급의 공격용 사이버 기능을 손에 넣을 수 있음을 의미합니다. 사실일 경우, 2단계 안전 아키텍처 전체가 무력화됩니다. Anthropic의 해명은 노출된 탈옥 기법들이 “완전히 무해한 답변이거나 Mythos만의 독보적인 역량 향상과 무관한 지엽적인 발견”이라는 것입니다. 그러나 정부는 이를 받아들이지 않았습니다.

이틀 전 이 권한을 요청했던 자가 당한 역설

이 대목은 정책학 강의에서 두고두고 회자될 사례입니다. 정부 명령서가 도달하기 불과 이틀 전인 6월 10일, Anthropic은 미국 정부가 첨단 AI에 대해 새로운 법적 통제력을 가져야 한다는 정책 프레임워크를 기고했습니다. 제안서는 노골적이었습니다. 모델이 파멸적인 위험을 초래할 경우 “정부는 법적 권한을 가지고 서비스 배포를 차단할 수 있어야 하며,” 이를 어길 시 글로벌 연 매출에 비례하는 민사 처벌을 가해야 한다는 내용이었습니다. 이 기준은 학습 연산량 10²⁵ FLOPs 이상을 사용하고 AI 매출 5억 달러 이상 또는 AI 연구개발비 10억 달러 이상을 지출하는 기업이 제작한 모델에 적용되도록 설계되었는데, 이는 정확히 Fable 5를 조준한 매개변수들이었습니다.

해당 기고문은 권력 남용의 가능성도 경고했습니다. Anthropic은 정책 입안자들이 “과도하게 광범위하거나 강압적인 규제 권한 행사를 피해야 한다”며 차단 권한의 남용을 막을 구체적인 제도적 장치를 함께 제안했습니다.

그리고 이틀 뒤, 정부는 Anthropic의 서비스를 중단시켰습니다. 사측이 제안했던 독립적 평가단 검증, 테스트 결과 공개, 사법적 절차 보호 등을 동반한 적법한 절차가 아닌, 구두 설명만 곁들여진 수출 통제 공문 한 장으로 말입니다. Anthropic의 성명서는 이 난감한 역설을 숨기지 못했습니다. 사측은 정부가 안전하지 않은 배포를 차단할 수 있어야 한다는 기존 입장을 재확인하면서도 “이는 어디까지나 투명하고, 공정하며, 명확하고, 기술적 사실에 기반한 법적 절차의 틀 안에서 이루어져야 한다”고 적은 뒤, 뼈아픈 한마디를 남겼습니다. “이번 조치는 그러한 원칙들을 따르지 않았다.”

분명히 해둘 점은, 이번 명령이 Anthropic의 기고문에 대한 보복 조치였다는 공적인 증거는 없으며, 그렇게 해석하는 것은 현재로서는 추측에 불과하다는 사실입니다. 가장 단순한 설명은 이 회사와 대립 중이던 행정부가 마침 새로운 첨단 모델의 탈옥 보고서를 보고는 서랍 속에서 가장 둔탁한 도구를 꺼내 휘둘렀다는 것입니다. 그러나 시점의 평행선만큼은 명확합니다. Anthropic은 수요일에 적법 절차가 담긴 킬 스위치 도입을 주장했고, 금요일에 정부가 이미 킬 스위치를 쥐고 있으며 적법 절차는 생략 가능하다는 것을 몸소 배웠습니다.

4개월간 지속된 공공연한 전쟁

이 모든 일이 갑자기 일어난 것이 아닙니다. 이번 가동 중단 명령은 지난 2월, Anthropic이 “미국인에 대한 대규모 감시나 자율 무기 유도 기능에 Claude가 사용되는 것을 거부”하고 국방부가 Anthropic을 국가안보 공급망 위험 기업으로 지정하며 정부 전반의 사용 금지령을 내렸을 때부터 본 사이트가 추적해 온 싸움의 연장선입니다.

그 갈등의 실제 기록은 투명합니다. 3월 초 Nextgov는 연방 기관들이 Anthropic 제품 사용을 중단하라는 Trump 대통령의 지시에 따라 계약 파기에 착수했다고 보도했습니다. 재무부는 사용 중단을 확정했고, 국무부와 보건복지부(HHS)도 워크플로에서 Anthropic 도구를 배제하기 시작했습니다. 그러나 사법부가 제동을 걸었습니다. 2026년 3월 26일, 캘리포니아 북부 연방법원은 대통령 행정명령 집행을 유예하는 예비적 징벌 조치를 내렸고, GSA는 4월 3일까지 “Anthropic 기술의 지위를 2026년 2월 27일 이전 상태로 복구한다”고 선언했습니다.

즉, Anthropic은 법정에서 정부 계약 파기 싸움을 이겨내고 있었습니다. 이번 수출 통제 명령은 사법부의 가처분 판결이 미치지 않는 제2의 전선을 형성했으며, 정부의 기술 구매를 막는 것이 아니라 Anthropic의 상업적 생명줄 자체를 직접 겨냥했습니다. 이것이 우연의 일치인지 전략적 고사 작전인지에 대해 행정부는 아무런 해명도, 공식 문서도 내놓지 않고 있습니다.

데이터

확인된 타임라인은 잔인한 일주일로 요약됩니다.

날짜 (2026년)사건
6월 9일Fable 5 및 Mythos 5 출시. Anthropic은 Fable의 능력이 자사 역대 공개 모델 중 최강이라고 발표
6월 10일Anthropic, 위험한 AI의 배포를 정부가 차단할 수 있게 하는 정책 기고문 발표
6월 12일 (낮)TechTimes, 레드테이머 Pliny the Liberator의 Fable 5 우회 성공 주장 보도
6월 12일 오후 5:21 ET수출 통제 행정명령 송달. Anthropic 두 모델 서비스 중단

강제 종료된 서비스의 경제적 피해 규모 또한 실증적입니다. Fable 5와 Mythos 5의 요금은 입력 토큰 100만 개당 10달러, 출력 토큰 100만 개당 50달러로 책정되었는데, 이는 초대 전용 모델인 “Claude Mythos Preview” 요금의 “절반 이하”라고 Anthropic은 밝힌 바 있습니다. 이 한 문장으로 이전까지 초대 전용 모델의 요금 하한선을 산출할 수 있습니다.

PMythosPreview>2×PFable5    PMythosPreview>20 (입력)  /  100 (출력)P_{\text{MythosPreview}} > 2 \times P_{\text{Fable5}} \;\Rightarrow\; P_{\text{MythosPreview}} > 20 \text{ (입력)} \;/\; 100 \text{ (출력)}

단위는 100만 토큰당 달러입니다. 공식 출시로 세계 최강의 사이버 보안 모델의 단가가 반값 이하로 떨어졌고, Claude 계정을 가진 누구나 필터링된 형태로 쓸 수 있게 되었으나, 사흘 뒤 그 필터링 장치 자체가 국가안보 위험 요인으로 지목된 셈입니다.

다음에 닥쳐올 파장

이제 선례가 남았으며, 그 파장은 사방으로 뻗어 나갑니다.

프론티어 AI 연구소들에게 제품 출시의 셈법이 완전히 달라졌습니다. Anthropic의 경고가 본질을 찌릅니다. 만약 “지엽적인 수준의 우회 가능성”이 서비스 회수의 근거가 된다면, 이 기준은 “사실상 모든 프론티어 AI 기업들의 신규 모델 배포를 전면 중단시키는 결과를 낳을 것”입니다. 실리콘밸리의 모든 AI 기업 법무팀은 오늘 밤 이 서한을 읽고 오후 5시 21분의 편지에 대비한 자체 비상 대책 초안을 작성하기 시작했습니다.

기업 고객들에게는 상황이 더욱 나쁩니다. 운영 워크로드를 Fable 5로 이전했던 기업들은 자체 시스템 가동 시간이나 결함과 무관하게 하루아침에 추천 모델을 잃었습니다. 향후 기업용 AI 서비스 계약에는 모델 강제 중단 조항이 신설될 것이며, 멀티 모델 아키텍처 도입이 가속화되고, 출시된 지 며칠 안 된 모델보다 시장에서 수년간 검증된 모델에 보이지 않는 프리미엄이 붙을 것입니다. Anthropic은 현 상황을 “오해”로 규정하고 접근 권한을 복구하기 위해 노력 중이며, 성명 발표 후 24시간 이내에 추가적인 기술 세부 사항을 공개하겠다고 약속했습니다. 그때까지 다른 모든 Anthropic 모델은 정상 작동합니다.

정책 대결 구도에서는 이 역설이 규제 반대론자들의 단골 논거가 될 것입니다. Anthropic을 포함해 제도적 AI 감시를 옹호하던 진영은 자신들이 주장했던 가이드라인(공개 검증, 독립 평가, 이의 제기 절차)이 결여된 통제 권력이 얼마나 파괴적인지 목격했습니다. 규제에 반대하는 진영은 이 사건을 빌미로 정부의 규제 권한 자체를 결코 신뢰할 수 없다는 증거로 삼을 것입니다. 양 진영 모두 똑같은 사흘간의 비극을 두고 각자의 칼을 갈고 있습니다.

결론

상표명을 떼고 보면 상황은 이렇습니다. 한 기업이 최첨단 AI 모델을 출시했고, 투명한 절차를 통해 규제해 달라고 정부에 요청했으며, 그 후 극도로 불투명한 행정명령을 통해 서비스가 중단당했습니다. 그 근거는 극소수를 제외하고는 아무도 보지 못했고, 중단의 이유가 된 모델의 역량은 사측 설명대로라면 이미 경쟁사들도 다 제공하고 있는 수준의 기능이었습니다.

정부가 일반에 공개되지 않은 엄청난 정보나 우려를 쥐고 있을 수도 있습니다. 그것은 충분히 가능한 시나리오이며, 기밀 정보의 존재야말로 이번 행정 명령을 옹호할 수 있는 유일하고도 가장 강력한 논거입니다. 그러나 법적 프레임워크나 문서화된 증거도 없이 구두 전달에 의존해 민간 상업 기술을 강제 회수하는 권력은 제대로 된 안전 규제 시스템이 아닙니다. 그것은 ‘자의적 재량권’입니다. 그리고 행정부가 지난 4개월 동안 공공연히 탄압해 온 특정 기업을 상대로 행사한 자의적 재량권은 실질적인 증거가 테이블 위에 올라올 때까지 한 치의 신뢰도 얻을 자격이 없습니다. 돌파구는 이 싸움의 모든 당사자가 겉으로는 원한다고 주장하는 바로 그 방향입니다. 킬 스위치를 법제화하고, 증거를 투명하게 공개하며, 독립적인 검토 과정을 거치게 만들어 다음 오후 5시 21분의 편지에는 그 타당성을 입증하도록 강제하는 것입니다.

출처 (9)

Advertisement

🦋 Bluesky 토론

Bluesky에서 토론하기

게시물 검색 중...