
AI 챗봇 클로드(Claude)를 개발하는 앤트로픽(Anthropic)이 사내 AI 활용 실태를 보여주는 지표를 공개했다. 2026년 8월 기준 AI 연구개발 업무 26%를 클로드가 주도하고 있으며 주요 사내 플랫폼에서는 AI 에이전트 3만 개가 동시에 돌아가고 있다.
고성능 AI 모델을 개발하는 기업에서는 AI 자체가 차세대 AI 개발에 쓰이는 일이 늘고 있다. 앤트로픽은 AI가 연구개발을 어디까지 맡고 있는지와 AI 에이전트를 얼마나 감시하고 있는지, 컴퓨팅 자원을 어떤 용도에 배분하는지 등 3가지 척도로 AI 활용 현황을 보고했다.
앤트로픽은 첫 번째 척도인 AI 연구개발 분담 정도를 나타내려고 앤트로픽 R&D 자동화 지수(Anthropic R&D Automation Index)라는 지표를 시험 삼아 만들었다. 이 지표는 AI 연구기관 에포크AI(Epoch AI)가 제안한 평가 기준을 바탕으로 연구개발에 대한 AI 관여도를 6단계로 나눈다.
레벨0은 사람만으로 과제를 수행하는 단계다. 레벨1은 AI 관여가 극히 제한적이어서 작업 대부분을 사람이 하고 레벨2는 AI가 일부 작업을 돕지만 사람이 주도해 과제를 진행한다. 레벨3에서는 AI가 사람의 세세한 지시와 감독을 받아 작업 대부분을 맡는다. 레벨4는 사람에게 큰 방향만 지시받은 AI가 작업 대부분을 스스로 진행하는 단계다. 레벨5는 AI가 과제 발굴부터 실행까지 자율적으로 해내는 완전 자율 단계다.
2026년 8월 기준 앤트로픽 연구개발 업무 26%가 레벨4에 도달했다. AI와 사람이 함께 작업하는 레벨3 이상까지 합치면 90%를 넘는다. 반면 측정 대상 AI 연구개발 업무 가운데 레벨5 완전 자율에 이른 건 없었다.
앤트로픽 연구개발 업무를 이 지수로 분류해 시계열로 보면 AI가 연구를 주도하는 레벨4(AL4) 비중은 2026년 초 거의 0%였다가 2026년 8월 26%까지 늘었다.
2026년 8월 기준 앤트로픽 주요 사내 에이전트 플랫폼에서는 연구와 엔지니어링을 맡은 AI 에이전트 3만 개가 동시에 가동되고 있었다. 에이전트 감시 수준에 대해 앤트로픽은 에이전트 조작을 실행 전에 확인하는 감시와 실행 후 활동 기록을 분석하는 감시를 함께 쓰고 있다고 밝혔다. 2026년 8월에는 판단 10억 건 이상을 감시했고 그중 우선순위가 가장 높은 50건을 매주 사람 담당자가 확인하고 있다고 설명했다.
컴퓨팅 자원 배분과 관련해 2026년 7월 13~20일 1주일을 조사한 결과 AI 연구개발용 컴퓨팅 자원 6%가 안전성 관련 연구에 쓰였다. AI가 AI 연구개발을 수행하는 용도로 좁히면 안전성 관련 비중은 12%였다.
앤트로픽은 앞으로도 각 지표를 꾸준히 공개할 계획이다. 또 여러 외부 조직에서 독립 제3자 평가자를 받아들여 사내 데이터와 평가 과정을 검증할 수 있도록 하겠다고 밝혔다. 관련 내용은 이곳에서 확인할 수 있다.
![[DailyRecipe] 막 오른 넥스트라이즈2026…올해 특징은?](https://i0.wp.com/startuprecipe.co.kr/wp-content/uploads/2026/06/260618_nextrise_ai_0023052050235235.jpg?resize=350%2C250&ssl=1)

