TencentのHunyuanチームは、日常業務やプロフェッショナルな作業向けの最新画像生成モデル「Hy Image 3.5」のプレビューを公開した。
チームの火曜日の発表によると、最新モデルはHy Imageシリーズの後継で、テキスト描画とレイアウト、フォトリアリズムと表現の幅、編集時の一貫性を改善した。
Tencentによると、プロのデザイナー100人超を対象にした社内のブラインドテストで、前バージョンに対する新モデルの総合勝率は30%以上上昇した。外部の研究機関は、これに対応するスコアを公表していない。
Hy Image 3.5のプレビューは、テキストから画像を生成する機能と、画像から画像を生成する機能に対応する。ユーザーは1回のリクエストにつき最大5枚の参照画像をアップロードでき、会話履歴を使って複数回のリクエストにわたり編集を続けられる。プレビューモデルは、最大2Kの解像度で複数のアスペクト比に対応する。
Tencentによると、このモデルは、正確なテキストや階層化された情報、編集前後で被写体の一貫性を保つこと、自然な照明や素材を必要とするタスク向けに最適化されている。
ブログ記事によると、TencentのAIアシスタント兼チャットボットアプリ「Yuanbao」は、一般向けプレビューの約1カ月前に限定的な提供を開始した。現在、このモデルはWorkRally、OnSolo、Mioraなど、Tencentの他のAIアプリケーションでも利用できる。
Hy Image 3.5のプレビューは、前世代の3倍の性能を実現すると見込まれるAlibaba Groupの新AIチップ「Zhenwu V900」と同じ日に公開された。これらの動きは、特に米国が輸出規制によって中国から一部の高性能AIチップやチップ製造装置へのアクセスを遮断した後、中国が米国の先端AI技術に代わる国内製品の構築を推進していることを浮き彫りにしている。
