Anthropic releases its first Mythos-class model Claude Fable
Anthropic이 Mythos급 모델인 Claude Fable 5를 출시했다. 회사는 새로운 안전장치 덕분에 이전에는 너무 위험하다고 판단했던 모델을 공개할 수 있었다고 밝혔다.
Anthropic이 자사의 가장 강력한 모델인 Claude Fable 5를 발표했다. 이 모델은 Mythos급 모델로, 소프트웨어 엔지니어링, 지식 작업, 비전 분야에서 뛰어난 성능을 보이며, 작업이 길고 복잡해질수록 다른 모델과의 격차가 벌어진다고 회사는 주장했다.
Anthropic은 이전에 Mythos급 모델이 사이버보안 작업에 너무 뛰어나 공개하기에 위험하다고 밝힌 바 있다. 이번 출시는 특정 고위험 영역에서 응답을 차단하는 새로운 안전장치 덕분에 가능해졌다. 안전장치가 작동할 경우 시스템은 Claude Opus 4.8로 대체된다. 회사는 테스트에서 95%의 세션이 Fable 응답만으로 처리되었으며, Opus 4.8로 대체되지 않았다고 밝혔다.
Anthropic이 안전장치를 통해 이전에는 공개 불가능하다고 여겼던 고성능 모델을 출시한 것은 AI 안전성 연구의 진전을 보여준다. 그러나 사이버보안과 생물학 등 민감한 영역에서 응답이 차단될 수 있다는 점은 여전히 논란의 여지가 있다. 이번 출시는 AI 모델의 성능과 안전성 간 균형을 맞추는 중요한 사례가 될 것이다.