x

이메일로 만나보는 스타트업 가이드

투자, 행사, 정부사업 등 스타트업 생태계 소식을 이메일로 편하게 받아보세요.

오픈AI가 9월 22일 GPT-6 솔(GPT-6 Sol)과 GPT-6 루나(GPT-6 Luna)를 출시했다. 두 모델 모두 GPT-6 아스트라(GPT-6 Astra)와 같은 방식으로 훈련했으며 전 세대 모델보다 비용 효율이 크게 높아졌다.

지난 7월 나온 GPT-5.6 시리즈는 최상위 모델인 GPT-5.6 솔과 균형형 모델인 GPT-5.6 테라(GPT-5.6 Terra), 저가형 모델인 GPT-5.6 루나 3종으로 구성됐다. 오픈AI에 따르면 GPT-6 아스트라는 솔 계열보다 위에 있는 모든 면에서 최고 모델이라는 위치다. 여기에 고성능 모델 GPT-6 솔과 저가형 모델 GPT-6 루나를 새로 더한 셈이다.

API 요금은 100만 토큰당 GPT-6 솔이 입력 2,800원대(2달러)와 출력 1만4,000원대(10달러)다. GPT-6 루나는 입력 140원대(0.1달러)와 출력 700원대(0.5달러)다. 두 모델 모두 GPT-5.6 시리즈보다 절반 이하로 내렸다.

에이전트 성능 벤치마크인 오토메이션벤치(AutomationBench)로 GPT-6 아스트라와 GPT-6 솔, GPT-5.6 솔, GPT-6 루나, GPT-5.6 루나, 클로드 오퍼스 5(Claude Opus 5), 클로드 페이블 5.1(Claude Fable 5.1) 성능을 측정한 결과는 벤치마크 점수와 작업당 비용을 함께 비교하는 형태로 나왔다. GPT-6 솔은 클로드 페이블 5.1보다 높은 점수를 10분의 1 비용으로 달성했다. GPT-6 루나도 GPT-5.6 루나보다 낮은 비용으로 더 높은 점수를 기록했다.

 

코딩 성능을 측정하는 프런티어코드(FrontierCode)에서도 GPT-6 솔은 GPT-5.6 솔보다 크게 높은 점수를 내면서 비용은 낮게 유지했다. GPT-6 루나 역시 GPT-5.6 루나보다 비용 효율이 크게 나아졌다.

GPT-6 솔은 출력 텍스트 분위기도 조정했다. 같은 프롬프트를 넣은 출력 예시를 보면 GPT-5.6 솔은 물론이라는 뜻의 앱솔루틀리(Absolutely)나 작업을 마쳤으니 사이트를 열어보라는 식의 불필요한 문구를 넣는 경향이 있었다. 반면 GPT-6 솔은 군더더기를 덜어내 간결하게 답했다.

GPT-6 솔과 GPT-6 루나에는 GPT-6 아스트라와 같은 정렬 기술을 적용해 오해를 부르거나 위험한 출력이 나오는 비율을 낮췄다. 의도적으로 부정행위를 유도하도록 설계한 프롬프트를 여러 AI에 입력해 부정행위 발생률을 비교한 결과 GPT-6 솔과 GPT-6 루나는 전 세대 모델보다 발생률이 낮았다.

GPT-6 솔과 GPT-6 루나는 플러스·프로·비즈니스·엔터프라이즈·에듀 요금제 가입자를 대상으로 출시됐으며 챗GPT(ChatGPT) 워크와 코덱스(Codex)에서 바로 쓸 수 있다. 무료 요금제와 고 요금제 이용자도 데스크톱용 챗GPT에서 GPT-6 루나를 사용할 수 있다. 관련 내용은 이곳에서 확인할 수 있다.

뉴스 레터 구독하기

Related Posts