2026년 6월 9일

같은 가중치, 다른 문

6월 9일, Anthropic이 Claude Fable 5와 Mythos 5를 발표했다. 둘은 같은 가중치다. 차이는 문 앞의 분류기다.

사용자가 요청을 보내면, Fable 분류기가 먼저 본다:

  • Cyber: 사이버보안 공격 관련
  • Bio: 생물학적 위험 관련
  • Distill: 모델 증류 시도

이 중 하나에 걸리면 Opus 4.8로 폴백한다. 통과하면 Fable 5로 간다.

숫자들

Anthropic이 공개한 통계:

  • 95%의 세션이 게이트를 통과하지 못함
  • 대부분의 사용자는 Opus 4.8을 사용

FrontierCode Diamond 벤치마크:

  • Fable 5: 29.3
  • Opus 4.8: 13.4

2배 이상의 격차. 분류기를 통과한 작업에 대해서는 Fable 5가 명확히 더 강했다.

False Positives

문제는 false positive였다.

Reddit과 Twitter에서 보고들이 쏟아졌다:

  • GPU 드라이버 디버깅이 “cyber” 분류
  • 의료 문서 요약이 “bio” 분류
  • 일반적인 코드 리뷰가 “distill” 의심

분류기는 보수적으로 설계되었다. 위험할 수 있는 것은 모두 차단한다는 원칙. 하지만 실제 사용자 작업의 경계는 모호했다.

아키텍처는?

Anthropic은 Fable 5의 아키텍처를 공개하지 않았다. Opus 4.8과의 관계도 명확하지 않다.

추측들:

  • Opus 5의 early variant?
  • Specialized post-training?
  • 완전히 새로운 pretraining?

확실한 것은 성능 격차가 실재한다는 것뿐이다.

6월 12일, 중단

3일 후, Anthropic이 Fable 5를 일시 중단했다. 공식 발표에서 분류기를 개선하는 동안 일시적으로 접근을 중단한다고 밝혔다.

False positive 비율이 너무 높았다. 사용자들은 강력한 모델에 접근할 수 없었고, 이유를 이해하지 못했다.

같은 주, GLM-5.2

흥미롭게도 같은 주에 GLM-5.2가 출시되었다:

  • MIT 라이선스
  • IndexShare 아키텍처
  • 1M 컨텍스트

오픈 진영의 반응이었지만, Mythos-class는 아니었다. Fable 5의 성능 수준에는 미치지 못했다.

안전성 vs 유용성

Fable 5 에피소드는 근본적인 긴장을 드러냈다:

  • 강력한 모델은 위험할 수 있다
  • 보수적 분류기는 유용성을 해친다
  • 사용자는 “왜 안 되는지” 설명을 원한다

Anthropic은 답을 찾지 못했다. 적어도 아직은.