A OpenAI anunciou o ChatGPT Images 2.0, uma nova versão de IA para geração de imagens que privilegia maior fidelidade à realidade. O lançamento ocorreu nesta quarta-feira, 22, com a promessa de imagens mais sofisticadas a partir de prompts, antes mesmo de renderizar o primeiro pixel. A ideia é planejar internamente a composição visual, aumentando a precisão de detalhes, textos e interfaces.
O modelo traz uma melhoria estrutural: ao ativar o modo de raciocínio, o sistema avalia relações espaciais, conta objetos e define a cena antes de desenhar. A OpenAI afirma que a capacidade de gerar até oito imagens por vez permanece, mas com maior alinhamento entre intenção do usuário e resultado final.
A empresa ressalta que a novidade não se limita à qualidade estética. Segundo a OpenAI, o Images 2.0 passa a seguir instruções com maior fidelidade, preservando especificações solicitadas e renderizando elementos refinados, como textos pequenos e iconografia, em resoluções de até 2K.
O que muda na prática
Para usuários dos planos Plus, Pro, Business e Enterprise, o modo de raciocínio amplia funções. O gerador consegue consultar a web em tempo real para referências e dados durante a criação, elevando a precisão factual de infográficos, diagramas e materiais educativos.
Além disso, a ferramenta passa a oferecer geração em série, protegendo a consistência entre quadros em pedidos múltiplos. Exemplos mostrados pela empresa incluem páginas de mangá, textos manuscritos simulados, fotos com aparência de câmeras digitais e designs gráficos com continuidade entre as peças.
A OpenAI também destaca avanços na renderização de textos em alfabetos não latinos. Melhorias próprias para japonês, coreano, chinês, hindi e bengali ajudam a evitar deformações frequentes em geradores de imagem ocidentais.
Como acessar o ChatGPT Images 2.0
O ChatGPT Images 2.0 já está disponível para todos os usuários do ChatGPT e do Codex, com funções avançadas de raciocínio restritas às assinaturas pagas. A API da OpenAI também oferece acesso para desenvolvedores, com precificação variável conforme resolução e qualidade da saída.
Entre na conversa da comunidade