A equipe Hunyuan da Tencent divulgou uma prévia do Hy Image 3.5, seu mais recente modelo de geração de imagens para trabalhos cotidianos e profissionais.
A nota da equipe, publicada na terça-feira, disse que o modelo mais recente é uma continuação da linha Hy Image, com melhorias na renderização e no layout de textos, no fotorrealismo e na variedade de estilos, além de maior consistência na edição.
Em um teste cego interno com mais de 100 designers profissionais, a Tencent disse que a taxa geral de vitórias do novo modelo contra a versão anterior aumentou mais de 30%. Laboratórios externos não publicaram pontuações comparáveis.
A prévia do Hy Image 3.5 oferece geração de texto para imagem e de imagem para imagem. Em cada solicitação, os usuários podem enviar até cinco imagens de referência e continuar editando em várias solicitações usando o histórico da conversa. O modelo em prévia é compatível com várias proporções, em resoluções de até 2K.
A Tencent disse que o modelo foi otimizado para tarefas que exigem texto preciso, informações em camadas, consistência dos elementos entre edições e iluminação e materiais naturais.
O assistente de IA e aplicativo de chatbot da Tencent, Yuanbao, começou a ser disponibilizado de forma limitada cerca de um mês antes da prévia pública, segundo a publicação no blog. O modelo agora está disponível em outros aplicativos de IA da Tencent, como WorkRally, OnSolo e Miora.
A prévia do Hy Image 3.5 foi lançada no mesmo dia que o novo chip de IA Zhenwu V900, do Alibaba Group, que deve oferecer três vezes o desempenho de seu antecessor. Esses acontecimentos destacam o esforço da China para criar alternativas domésticas à tecnologia avançada de IA dos EUA, especialmente depois que os EUA bloquearam o acesso da China a alguns chips de IA de ponta e equipamentos para fabricação de chips por meio de controles de exportação.
