미국 정부가 6월 12일 금요일 오후 5시 21분 ET, Anthropic에 Claude Mythos 5와 Fable 5의 즉시 전면 차단을 명령했다. 형식은 외국인 접근을 제한하는 수출통제 조치지만, 실제로는 전 세계 모든 사용자가 두 모델에서 잘려 나갔다. 다른 Claude 모델은 그대로 살아 있다. Anthropic은 X 공지로 이행 사실을 밝히면서도, 이 결정 자체에는 정면으로 반박하는 긴 블로그 글을 같이 올렸다.
Mythos 5는 4월 프리뷰 이후 일반 공개가 봉인된 Anthropic의 최강 모델이다. Anthropic 스스로 "테스트한 모든 주요 OS와 브라우저에서 취약점을 찾아냈다"고 밝혔고, 그 능력 때문에 일반 배포 대신 Project Glasswing이라는 약 50개 조직 한정 프로그램으로만 운영해왔다. Amazon, Apple, Google, Microsoft, CrowdStrike 같은 곳이 방어용 보안 작업에 활용 중이었다. Fable 5는 3일 전 공개된 "가드레일 씌운 Mythos"다. 사이버보안·생물학 같은 고위험 영역의 응답을 막아 일반 배포가 가능하게 만든 버전이고, Vals AI 벤치마크에서는 현재 공개된 모델 중 최강으로 측정됐다.
정부가 제시한 근거는 Fable 5에 대한 "좁고 비보편적인 jailbreak" 가능성 하나, 그것도 구두로만 전달됐다고 Anthropic은 적었다. 회사 설명에 따르면 그 jailbreak는 "특정 코드베이스를 읽혀 소프트웨어 결함을 식별하게 만드는 수준"이며, OpenAI GPT-5.5 같은 공개 모델에서도 이미 가능한 능력이고, 방어 측 보안 전문가들이 일상적으로 사용하는 작업이다. Anthropic의 더 본질적인 항변은 안전 아키텍처에 있다. 가장 강한 보호 장치는 모델 가중치 안이 아니라 모델 바깥에 있는 독립 classifier 계층에 구현돼 있어, 모델이 거절 라인을 우회당해도 가장 위험한 출력 카테고리는 별도 시스템이 막아준다는 것이다.
이 사건의 진짜 신호는 기술이 아니라 정치 쪽에 있다. Anthropic은 수개월 동안 "우리 모델은 너무 위험해서 50개 조직에만 줄 수 있다"는 서사를 IPO 직전 정체성으로 굳혀왔다. 4월에 Sam Altman은 그 전략을 "fear-based marketing"이라 조롱했지만, 이번 명령은 그 마케팅이 그대로 fear-based regulation으로 돌아온 장면에 가깝다. 모델 능력 자체보다 그 모델이 어디서, 누구에게, 어떤 통제 면 위에서 실행되는지가 규제 트리거가 되는 시대로 넘어가는 중이고, 프런티어 랩들에게는 능력 자랑과 안전 경고를 같은 문장에 담는 일이 점점 비싼 선택이 되고 있다.