MADRID 22 jul. (Portaltic/EP) -
A Alibaba apresentou o Qwen-Image-3.0, uma nova versão do seu modelo de geração de imagens que enfatiza o realismo dos resultados oferecidos por meio de conteúdo enriquecido, detalhes e conhecimento aprofundado.
A empresa de tecnologia atualizou seu modelo de geração de imagens, que vai além do realismo já oferecido pelo Qwen-Image-2.0 para aprofundar a realidade, com resultados que são “úteis” e não apenas “bonitos”.
Para isso, a Alibaba concentrou-se em três dimensões, começando pelo conteúdo enriquecido, ou seja, resultados com designs complexos que se expandem horizontalmente e organizam múltiplos conceitos de maneira ordenada dentro de uma única imagem e sem interferências, conforme destaca em um comunicado.
Um exemplo disso é uma história em quadrinhos sobre segurança em túneis ou uma aula de geometria espacial. Como é necessária uma instrução muito detalhada para alcançar isso, o Qwen-Image-3.0 aceita entradas de até 4.500 tokens, para que possa compreender e renderizar todas as informações.
A segunda dimensão é composta pelos detalhes autênticos, ou seja, a precisão com que as imagens são geradas. Nesse caso, o modelo é capaz de renderizar texto de 10 pixels e reproduzir elementos como os poros da pele ou os fios utilizados em um bordado.
Por fim, a renderização do Qwen-Image-3.0 abrange doze idiomas, diversas fontes, mais de cem estilos artísticos e uma variedade de interfaces de usuário, como páginas da web, jogos e transmissões ao vivo. Tudo isso respaldado por seu profundo conhecimento do mundo, conforme destacou a Alibaba.
Esta notícia foi traduzida por um tradutor automático