x

이메일로 만나보는 스타트업 가이드

투자, 행사, 정부사업 등 스타트업 생태계 소식을 이메일로 편하게 받아보세요.

앤트로픽(Anthropic)이 AI에 관한 리스크 리포트를 공개했다. 그 안에서 일반 공개되어 있는 최고 성능 모델인 클로드 미토스 5(Claude Mythos 5)보다 성능이 높은 수수께끼 모델이 등장한 게 화제다.

8월 15일 공개된 리포트에서는 클로드 미토스 5와 모델 2(Model 2)를 대상으로 몇 가지 안전성 심사를 실시한 결과가 공유되고 있다. 앤트로픽에 따르면 모델 2는 클로드 미토스 5보다 다소 높은 능력을 가진 모델로, 앤트로픽 사내에서는 클로드 미토스 5와 함께 널리 사용되고 있다고 한다. 클로드 미토스 5는 추가 안전 대책이 시행되어 클로드 페이블 5(Claude Fable 5)라는 이름으로 일반 공개되어 있지만 모델 2가 일반 공개될 예정은 없다고 한다.

모델 2는 앤트로픽 사원에 의한 평가 결과 많은 작업에서 클로드 미토스 5보다 명백히 개선되어 있다는 인식을 얻고 있다. 다만 클로드 오퍼스 4.6(Claude Opus 4.6)에서 클로드 미토스 5 원본 모델인 클로드 미토스 프리뷰로 갈아탔을 때만큼의 비약적인 향상은 보이지 않으며 어디까지나 전체적으로 좀더 유능하다는 평가에 그친다고 한다.

구체적인 예로 감시자에게 눈치채이지 않도록 AI가 비밀 작업을 실행하는 테스트에서는 확장 사고를 활성화한 상태에서 클로드 미토스 프리뷰 성공률이 6~10%, 모델 2 성능은 클로드 미토스 5보다 조금 높지만 클로드 미토스 프리뷰보다는 대폭 낮다는 결과가 제시됐다.

또 리포트 안에는 모델 1(Model 1)이라는 모델도 등장한다. 어느 사용자는 모델 1 후계가 모델 2이며 이들 교사 모델인 클로드 미토스 프리뷰, 모델 2를 증류해 만들어진 소규모 모델이 클로드 미토스 5와 클로드 페이블 5가 아니냐고고 지적하기도 했다. 관련 내용은 이곳에서 확인할 수 있다.

뉴스 레터 구독하기

Related Posts

Next Post