Tencent의 Hunyuan 팀이 일상 업무와 전문 작업을 위한 최신 이미지 생성 모델 Hy Image 3.5의 미리보기를 공개했다.
팀은 화요일자 게시물에서 최신 모델이 Hy Image 제품군을 이어가는 모델로, 텍스트 렌더링과 레이아웃, 포토리얼리즘과 스타일 범위, 편집 일관성이 개선됐다고 밝혔다.
Tencent는 전문 디자이너 100명 이상을 대상으로 한 내부 블라인드 테스트에서 새 모델의 이전 버전 대비 종합 승률이 30% 이상 상승했다고 밝혔다. 외부 연구소들은 이에 상응하는 점수를 발표하지 않았다.
Hy Image 3.5 미리보기는 텍스트-이미지 및 이미지-이미지 생성을 지원한다. 사용자는 요청마다 최대 5개의 참조 이미지를 업로드할 수 있으며, 대화 기록을 활용해 여러 요청에 걸쳐 편집을 계속할 수 있다. 미리보기 모델은 최대 2K 해상도에서 다양한 화면 비율을 지원한다.
Tencent는 정확한 텍스트, 계층화된 정보, 편집 과정에서 일관된 피사체, 자연스러운 조명과 재질이 필요한 작업에 맞춰 모델을 최적화했다고 밝혔다.
블로그 게시물에 따르면 Tencent의 AI 비서 겸 챗봇 앱 Yuanbao는 공개 미리보기보다 약 한 달 앞서 제한적인 출시를 시작했다. 현재 이 모델은 WorkRally, OnSolo, Miora 등 다른 Tencent AI 애플리케이션에서도 이용할 수 있다.
Hy Image 3.5 미리보기는 Alibaba Group의 신형 AI 칩 Zhenwu V900이 공개된 날 함께 나왔다. Zhenwu V900은 이전 세대보다 3배 높은 성능을 제공할 것으로 예상된다. 이러한 움직임은 미국의 첨단 AI 기술에 대한 국내 대안을 구축하려는 중국의 노력을 보여준다. 특히 미국이 수출 통제를 통해 중국의 일부 고급 AI 칩과 칩 제조 장비에 대한 접근을 차단한 이후 더욱 두드러진다.
