
중국 대형 기술 기업인 텐센트(Tencent)가 8월 28일 AI 모델 Hy4 preview를 공개했다. GPT-5.6 Sol 같은 최첨단 모델에 필적하는 성능을 갖추고 있으며 오픈 모델로 무상 공개됐다.
Hy4 preview는 전체 파라미터 수 7700억, 활성 파라미터 수 490억 MoE 모델로 최대 컨텍스트 길이는 100만 토큰이다.
텐센트는 Hy4 preview를 최첨단 오픈 모델로 어필하고 있다. 각종 벤치마크 결과를 보면 Hy4 preview는 에이전트 성능을 측정하는 SWE Atlas Refactoring에서 GPT-5.6 Sol을 상회하고 있다. SWE-bench Pro에서도 GPT-5.6 Sol을 상회했다.
Hy4 preview는 장기적인 작업 이해·계획·검증과 같은 능력이 향상되어 문서 작성이나 게임 개발 등 폭넓은 작업에 대응 가능하다고 한다.
100만 토큰당 API 요금은 캐시 완료 입력이 0.042달러, 일반 입력이 0.834달러, 출력이 2.501달러다.
🚀 Hy4 preview is here.
770B, 49B active, 1M context.
Built for productivity.
Open source frontier.
Consistent affordable price.
Use it. Tell us what breaks.More on Hy blog:https://t.co/rbl1IWRk3C
HuggingFace:https://t.co/mE9wevH5XR
Github:https://t.co/pyl9zckpoL pic.twitter.com/4iW6gSuZKr— Tencent Hy (@TencentHunyuan) August 28, 2026
Hy4 preview는 오픈 모델로 공개되어 있으며 다운로드할 수 있다. 라이선스는 아파치 라이선스 2.0이다. 다만 Hy4 preview를 실행하려면 1.5TB에 달하는 VRAM이 필요하다. 텐센트는 Hy4 preview 양자화판도 공개하고 있으며 Q4_K_M판이라면 435GiB, STQ1_0판이라면 214GiB VRAM으로 실행할 수 있다.
STQ1_0판은 양자화할 대상을 선택해 1.31비트 STQ1_0과 2.06비트 IQ2_XXS를 구분해 사용하는 기법을 채용해 성능 저하를 억제하는 데 성공했다고 한다. 양자화를 실시하지 않은 오리지널 모델인 BF16판과 STQ1_0 벤치마크 점수를 비교해보면 크기 차이에 비해 성능 차이가 작다. 관련 내용은 이곳에서 확인할 수 있다.
![[DailyRecipe] 막 오른 넥스트라이즈2026…올해 특징은?](https://i0.wp.com/startuprecipe.co.kr/wp-content/uploads/2026/06/260618_nextrise_ai_0023052050235235.jpg?resize=350%2C250&ssl=1)
![[AI서머리] GES 2026, 9월 DDP서 개막‧CONEX KOREA 2027 킨텍스서 개최](https://i0.wp.com/startuprecipe.co.kr/wp-content/uploads/2026/09/260901_GPP_50205020235_slimpic.webp?resize=75%2C75&ssl=1)
![[AI서머리] 에이블랩스, 121억 시리즈A 투자 유치‧‘오픈AI 게임 빌더스 서울’ 개막](https://i0.wp.com/startuprecipe.co.kr/wp-content/uploads/2026/08/260831_OpenAI-Game-Builders-Seoul_5023050250523_slimpic.webp?resize=350%2C250&ssl=1)
