OpenAI lança ChatGPT Images 2.0 com avanços em renderização de texto não latino e raciocínio visual
A OpenAI anunciou o lançamento do ChatGPT Images 2.0, uma atualização significativa em seu modelo de geração de imagens. A nova versão promete melhorias na capacidade de seguir instruções detalhadas, renderizar texto denso e posicionar objetos com precisão. Além disso, o sistema agora possui habilidades de raciocínio, como busca na web e verificação de saídas, aumentando a confiabilidade em tarefas que exigem acurácia e coesão visual.
Melhorias em texto não latino e resolução
Uma das principais novidades do ChatGPT Images 2.0 é a capacidade aprimorada de renderizar texto em idiomas não latinos, como japonês, coreano, chinês, hindi e bengali. Segundo a OpenAI, houve 'ganhos significativos' na precisão e fidelidade desses idiomas, além de melhorias na reprodução de características visuais específicas de diferentes culturas. O modelo também suporta resoluções de até 2K e proporções de aspecto flexíveis, variando de 3:1 a 1:3, permitindo maior versatilidade em aplicações como prototipagem de jogos e storyboards.
Raciocínio e múltiplas saídas
Pela primeira vez, a OpenAI integrou capacidades de raciocínio ao modelo de geração de imagens, permitindo que o sistema verifique suas próprias saídas e busque informações na web para garantir maior precisão. Outra funcionalidade destacada é a capacidade de gerar até oito imagens simultaneamente em uma única solicitação, otimizando o fluxo de trabalho para designers e criadores de conteúdo.