A OpenAI apresentou o ChatGPT Images 2. 5, novo modelo de geração de imagens da empresa que chega com melhorias na qualidade dos resultados, na edição e na velocidade de criação.
A novidade está disponível para usuários do ChatGPT, ChatGPT Work e Codex em desktop, dispositivos móveis e web.
Segundo a empresa, o modelo foi desenvolvido para produzir iluminação mais natural, texturas mais detalhadas e maior fidelidade ao trabalhar com imagens de referência.
A OpenAI também afirma ter reduzido em até 50% a latência de geração em comparação com o Images 2. 0.
Modelo preserva melhor detalhes durante as edições.
Entre os principais avanços está a capacidade de realizar edições mais precisas. O Images 2. 5 busca alterar somente o elemento solicitado pelo usuário, preservando outros componentes da imagem, como o assunto principal, a composição e o plano de fundo.
A OpenAI também destaca melhorias na consistência durante conversas com várias etapas de edição. De acordo com a empresa, alterações feitas anteriormente têm maior probabilidade de permanecer preservadas, enquanto novos comandos podem ser aplicados sem degradar a qualidade da imagem ao longo do processo.
O modelo também passou a lidar melhor com instruções visuais complexas, informações presentes no mundo real e layouts mais elaborados, incluindo imagens com fundo transparente.
A empresa afirma ainda que o sistema consegue reproduzir estilos visuais com maior precisão.
Sketch permite desenhar antes de gerar a imagem.
Outra novidade é o Sketch, recurso que permite desenhar diretamente no ChatGPT para usar o esboço como referência na criação da imagem. A ferramenta pode ser usada, por exemplo, para indicar o layout de um ambiente, o contorno de uma roupa ou uma ideia visual.
A atualização também inclui templates para formatos criativos populares. Em vez de começar com uma tela em branco, o usuário pode escolher opções como “Poster” ou “Merch” e acrescentar informações, elementos de design e estilos para personalizar o resultado.
Outro recurso permite compartilhar, junto com uma imagem, o prompt usado para criá-la. Dessa forma, outra pessoa pode utilizar a mesma ideia com suas próprias imagens e detalhes.
Para desenvolvedores, a OpenAI anunciou dois modelos na API: GPT-Image-2. 5 Flare e GPT-Image-2. 5 Sunburst. O primeiro reúne as melhorias de qualidade, edição e velocidade e é apresentado como a opção padrão para a maioria das aplicações.
A empresa afirma que ele entrega imagens de maior qualidade que o GPT-Image-2 com 50% menos latência.
Já o GPT-Image-2. 5 Sunburst foi desenvolvido para fluxos que exigem maior controle sobre as edições, incluindo trabalhos criativos e imagens de produtos. Os dois modelos estão disponíveis na API.
A OpenAI afirma ainda que o Images 2. 5 mantém mecanismos de segurança já utilizados pela empresa, incluindo verificações de prompts e imagens, além de metadados C2PA e marca d’água invisível para ajudar a identificar conteúdos produzidos pelas ferramentas.
Ana Figueiredo é repórter de tecnologia do Olhar Digital. É formada em jornalismo pela Universidade Federal de Uberlândia (UFU).
Comentários
Participe da conversa. Comentários passam por moderação antes de aparecer.
Carregando comentários…