El equipo Hunyuan de Tencent presentó una vista previa de Hy Image 3.5, su modelo más reciente de generación de imágenes para el trabajo cotidiano y profesional.

La nota del martes del equipo señaló que el modelo más reciente es una continuación de la línea Hy Image, con mejoras en la representación y la composición del texto, el fotorrealismo y la variedad de estilos, así como en la consistencia de la edición.

En una prueba interna a ciegas con más de 100 diseñadores profesionales, Tencent afirmó que la tasa general de victorias del nuevo modelo frente a la versión anterior aumentó más del 30 %. Los laboratorios externos no han publicado puntuaciones comparables.

La vista previa de Hy Image 3.5 admite la generación de texto a imagen y de imagen a imagen. En cada solicitud, los usuarios pueden cargar hasta cinco imágenes de referencia y seguir editando en múltiples solicitudes mediante el historial de conversaciones. El modelo de vista previa admite diversas relaciones de aspecto en resoluciones de hasta 2K.

Tencent afirmó que el modelo se ha optimizado para tareas que requieren texto preciso, información en capas, sujetos consistentes entre distintas ediciones y una iluminación y unos materiales naturales.

Según la publicación del blog, el asistente de IA y la aplicación de chatbot de Tencent, Yuanbao, comenzaron un despliegue limitado aproximadamente un mes antes de la vista previa pública. El modelo ya está disponible en otras aplicaciones de IA de Tencent, como WorkRally, OnSolo y Miora.

La vista previa de Hy Image 3.5 se publicó el mismo día que el nuevo chip de IA Zhenwu V900 de Alibaba Group, que previsiblemente ofrecerá tres veces el rendimiento de su predecesor. Estos acontecimientos ponen de relieve el impulso de China para desarrollar alternativas nacionales a la tecnología avanzada de IA de Estados Unidos, especialmente después de que Estados Unidos bloqueara el acceso de China a algunos chips de IA de alta gama y equipos para su fabricación mediante controles de exportación.