x

이메일로 만나보는 스타트업 가이드

투자, 행사, 정부사업 등 스타트업 생태계 소식을 이메일로 편하게 받아보세요.

앤트로픽(Anthropic)이 새 AI 모델 클로드 오퍼스 5.5(Claude Opus 5.5)를 발표했다. 클로드 5.5 제품군 가운데 첫 모델로 기존 클로드 오퍼스 5(Claude Opus 5)보다 성능과 효율, 안전성을 개선했다. 앤트로픽은 일반적인 처리에서 오퍼스 5보다 40% 낮은 비용으로 쓸 수 있다고 밝혔다. 출력 속도도 오퍼스 5보다 30% 이상 빨라졌다.

클로드 오퍼스 5.5는 앤트로픽 오퍼스 시리즈 신모델로 AI가 여러 단계를 스스로 진행하는 에이전트형 작업에서 성능이 올랐다. 주요 AI 모델과 벤치마크를 비교한 결과 오퍼스 5.5는 에이전트형 코딩과 지식 처리, 추론, 컴퓨터 조작, 그래프 인식 등 폭넓은 항목에서 높은 점수를 기록했다. 반면 오토메이션벤치(AutomationBench)와 터미널벤치 사이언스 0.1(Terminal-Bench-Science 0.1)에서는 GPT-6 아스트라(GPT-6 Astra)가 오퍼스 5.5를 앞섰다. 앤트로픽은 고성능 모델끼리는 벤치마크상 작은 차이가 실제 사용감 차이를 정확히 보여주는 건 아니라고 설명했다.

명령줄에서 복잡한 작업을 수행하는 능력을 재는 터미널벤치 4.0(Terminal-Bench 4.0)에서는 66.4%를 기록해 오퍼스 5 52.3%와 GPT-6 아스트라 57.9%를 모두 넘어섰다. 소프트웨어 개발 능력을 측정하는 프런티어코드 v1.1(FrontierCode v1.1)에서는 54.4%를, 커서벤치 4.0(CursorBench 4.0)에서는 57.8%를 기록했다.

오퍼스 5.5는 대규모 코드베이스를 오랜 시간 처리하는 작업에 무게를 뒀다. 초기 이용자 테스트에서는 코드 20만 줄을 감사하고 수정하는 작업을 3시간 안에 끝냈다. 오퍼스 5는 같은 작업에 20시간 넘게 걸렸고 사용한 토큰 수도 오퍼스 5.5의 2.5배였다.

앤트로픽은 웹 서비스 등에 쓰이는 로드밸런서 HA프록시(HAProxy)를 C언어에서 러스트(Rust)로 다시 작성하는 테스트도 진행했다. 오퍼스 5.5와 클로드 페이블 5.1(Claude Fable 5.1) 모두 HA프록시 회귀 테스트를 거의 전부 통과했다. 다만 오퍼스 5.5 작업 시간은 9.5시간으로 페이블 5.1 12시간보다 짧았고 비용도 51% 낮았다.

효율 면에서는 토큰당 요금 자체가 오퍼스 5보다 싸진 데다 같은 작업에 필요한 토큰 수도 줄었다. 앤트로픽에 따르면 기본 설정으로 일반적인 처리를 하면 총비용이 오퍼스 5보다 40% 줄어든다. 클로드 코드(Claude Code)와 클로드 플랫폼(Claude Platform)에서는 최대 2.5배 빠르게 처리하는 패스트 모드(Fast mode)도 쓸 수 있다.

가격도 내렸다. 100만 토큰당 입력 요금은 7,000원대(5달러)에서 5,600원대(4달러)로, 출력 요금은 3만5,000원대(25달러)에서 2만8,000원대(20달러)로 낮아졌다. 캐시 쓰기 요금은 6.25달러에서 5달러로 내렸고 캐시 읽기 요금은 0.50달러에서 0.20달러로 60% 인하했다.

문장 생성 방식도 바뀌었다. 앤트로픽은 오퍼스 5.5가 기존 모델보다 중요한 정보를 먼저 제시하고 문장을 간결하고 따라가기 쉽게 쓰도록 개선했다고 밝혔다. 초기 도입 기업인 박스(Box) 평가에서는 오퍼스 5보다 사용 토큰 수가 3분의 1 줄었고 답변도 정확도를 유지하면서 40% 짧아졌다.

앤트로픽이 시나리오 2,000종으로 모델 행동을 살피는 자동 평가에서 오퍼스 5.5는 부적절한 행동 관련 지표 다수에서 최근 클로드 모델 가운데 가장 좋은 결과를 냈다. 모델이 주어진 실행 환경 경계를 넘으려는 행동을 살피는 새 평가에서는 이런 시도가 오퍼스 5나 클로드 미토스 5.1(Claude Mythos 5.1)보다 85% 적었다. 프롬프트 인젝션 내성도 오퍼스 5와 같거나 그 이상이었다.

사이버보안과 생물학처럼 악용될 경우 파장이 큰 분야에는 추가 제한을 뒀다. 일반 소프트웨어 개발에서 코드 버그를 찾고 고치는 작업은 가능하지만 사이버보안 관련 작업 상당수는 다른 모델로 넘어간다. 생물학 분야에도 안전장치를 적용했으며 연구기관이나 기업은 심사를 거쳐 더 폭넓은 연구 용도로 쓸 수 있는 라이프사이언스 인증 프로그램(Life Sciences Verification Program)에 신청할 수 있다.

오퍼스 5.5에는 대량의 가짜 계정 등을 동원해 모델 능력을 빼내는 증류 공격에 대응하는 프리저브드 싱킹(preserved thinking)도 들어갔다. API 이용자가 클로드의 과거 맥락을 고쳐 써 추론 정보를 꺼내려는 수법을 막는 장치다.

데이터 보존과 규정 준수 측면에서는 기존 오퍼스 시리즈와 마찬가지로 대상 이용 형태에서 앤트로픽이 입력과 출력을 보관하지 않는 제로 데이터 리텐션(zero data retention)을 지원한다. 유럽연합(EU) AI법에 대응해 클로드 페이블 5.1과 같은 워터마크도 도입했다. 오퍼스 5.5에서는 싱킹(thinking) 모드를 끄고 쓸 수 없다.

클로드 오퍼스 5.5는 앤트로픽 각 플랫폼에서 이미 제공되고 있으며 아마존웹서비스(Amazon Web Services)와 구글 클라우드(Google Cloud), 마이크로소프트 애저(Microsoft Azure)에서도 쓸 수 있다. 클로드 플랫폼에서는 claude-opus-5-5라는 모델명으로 제공된다. 프로·맥스·팀·엔터프라이즈 요금제는 5시간 단위 사용 한도가 늘어난다. 앤트로픽은 앞으로 몇 주 안에 클로드 소넷 5.5(Claude Sonnet 5.5)와 클로드 하이쿠 5.5(Claude Haiku 5.5)도 내놓을 계획이다. 관련 내용은 이곳에서 확인할 수 있다.

뉴스 레터 구독하기

Related Posts