x

이메일로 만나보는 스타트업 가이드

투자, 행사, 정부사업 등 스타트업 생태계 소식을 이메일로 편하게 받아보세요.

중국 대형 기술 기업인 텐센트(Tencent)가 8월 28일 AI 모델 Hy4 preview를 공개했다. GPT-5.6 Sol 같은 최첨단 모델에 필적하는 성능을 갖추고 있으며 오픈 모델로 무상 공개됐다.

Hy4 preview는 전체 파라미터 수 7700억, 활성 파라미터 수 490억 MoE 모델로 최대 컨텍스트 길이는 100만 토큰이다.

텐센트는 Hy4 preview를 최첨단 오픈 모델로 어필하고 있다. 각종 벤치마크 결과를 보면 Hy4 preview는 에이전트 성능을 측정하는 SWE Atlas Refactoring에서 GPT-5.6 Sol을 상회하고 있다. SWE-bench Pro에서도 GPT-5.6 Sol을 상회했다.

Hy4 preview는 장기적인 작업 이해·계획·검증과 같은 능력이 향상되어 문서 작성이나 게임 개발 등 폭넓은 작업에 대응 가능하다고 한다.

100만 토큰당 API 요금은 캐시 완료 입력이 0.042달러, 일반 입력이 0.834달러, 출력이 2.501달러다.

 

Hy4 preview는 오픈 모델로 공개되어 있으며 다운로드할 수 있다. 라이선스는 아파치 라이선스 2.0이다. 다만 Hy4 preview를 실행하려면 1.5TB에 달하는 VRAM이 필요하다. 텐센트는 Hy4 preview 양자화판도 공개하고 있으며 Q4_K_M판이라면 435GiB, STQ1_0판이라면 214GiB VRAM으로 실행할 수 있다.

STQ1_0판은 양자화할 대상을 선택해 1.31비트 STQ1_0과 2.06비트 IQ2_XXS를 구분해 사용하는 기법을 채용해 성능 저하를 억제하는 데 성공했다고 한다. 양자화를 실시하지 않은 오리지널 모델인 BF16판과 STQ1_0 벤치마크 점수를 비교해보면 크기 차이에 비해 성능 차이가 작다. 관련 내용은 이곳에서 확인할 수 있다.

뉴스 레터 구독하기

Related Posts

Next Post