ChatGPT Images 1.5: Este é o grande salto da OpenAI em imagens.

  • O ChatGPT Images lança o modelo GPT Image 1.5, até quatro vezes mais rápido e com melhor rastreamento de instruções.
  • A nova ferramenta permite edições precisas em fotos carregadas, mantendo a iluminação, a composição e as características faciais.
  • Melhoria notável na geração de texto em imagens e em cenas complexas com muitos rostos ou pequenos detalhes.
  • A OpenAI lança sua própria seção de Imagens no ChatGPT, agora disponível para a maioria dos usuários via API.

Imagens do ChatGPT

A geração de imagens com inteligência artificial tornou-se uma das demonstrações mais visíveis da corrida entre as gigantes da tecnologia. OpenAI decidiu fazer uma mudança com uma atualização profunda de Imagens do ChatGPT, seu sistema integrado de criação visual, em um contexto onde modelos como o Nano Banana Pro do Google dominavam grande parte da discussão.

Com este lançamento, a empresa por trás do ChatGPT quer que sua ferramenta deixe de ser um simples complemento de bate-papo e passe a funcionar como um recurso completo. um verdadeiro estúdio criativo integradoMais rápido, mais preciso e com uma interface projetada desde o início para funcionar com imagens, em vez de se limitar a texto.

Novo modelo GPT Image 1.5: velocidade e precisão como suas principais características.

O ponto central da atualização é Imagem GPT 1.5O novo modelo principal da OpenAI para imagens. A empresa afirma que ele pode gerar conteúdo visual de até quatro vezes mais rápido do que a versão anterior, algo que na prática é especialmente perceptível durante os horários de pico e em dispositivos móveis, onde antes não era incomum que o processo fosse interrompido ou demorasse uma eternidade ao trocar de aplicativos.

Além do desempenho, a principal melhoria reside no rastreamento de instruções. O sistema interpreta as instruções com mais precisão. instruções complexas e relações espaciais precisaspara que solicitações como alterar apenas um objeto, ajustar a iluminação ou modificar a roupa de uma pessoa não causem mais mudanças inesperadas no resto da cena.

A OpenAI explica que o GPT Image 1.5 foi treinado para manter constantes elementos cruciais da imagem, como... identidade facial, composição geral ou paleta de coresmesmo após várias rodadas de edição encadeada. Este ponto é especialmente relevante para uso profissional, onde a consistência visual não é um capricho, mas uma exigência.

Edição pontual e em cadeia: altere apenas o que importa.

Uma das áreas em que os modelos anteriores falharam foi a edição direcionada de áreas específicasTrocar um chapéu, ajustar a iluminação ou adicionar um elemento ao fundo pode acabar remixando toda a cena. As novas imagens do ChatGPT resolvem esse problema diretamente.

O modelo é capaz de adicionar, remover, combinar, misturar e transpor elementos dentro da mesma imagem, mantendo todos os outros componentes importantes estáveis. Na prática, isso significa poder solicitar ações como: mudar a cor de uma camisa, modificar um chapéu, ajustar uma placa de trânsito ou transformar um caminhão em um caminhão de bombeiros sem distorcer o restante do ambiente.

O comportamento em chamadas telefônicas também foi reforçado. edições em cadeiaAté agora, uma terceira ou quarta alteração geralmente fazia com que o modelo "reinventasse" completamente a imagem. Com o GPT Image 1.5, a ferramenta preserva o estilo, a pose e a cena de forma muito mais confiável, permitindo que você itere sobre a mesma base sem precisar começar do zero a cada modificação.

Transformações criativas: da selfie ao pôster de filme

Além da precisão técnica, a OpenAI está levando o ChatGPT Images para um território nitidamente criativo. O sistema permite que os usuários carreguem suas próprias fotos e, com uma instrução relativamente simples, obtenham a imagem em questão de segundos. versões transformadas críveisDe um anúncio publicitário dos anos 90 a uma cena na Times Square em pleno inverno, ou uma cidade japonesa com estética cyberpunk.

O modelo também é capaz de recriar estilos artísticos específicos, como cartazes de filmes clássicos, ilustrações em estilo anime ou composições com aparência histórica, respeitando as principais características da pessoa original. A ideia é que o usuário possa se "ver" em contextos muito diferentes, sem perder a sensação de que se trata da mesma pessoa.

Essa abordagem lembra o que modelos como o Nano Banana já ofereciam, mas a OpenAI está tentando se diferenciar apostando em transformações conceituais mais controladasonde o sistema mantém a essência da foto original enquanto altera roupas, ambiente, iluminação ou época com considerável coerência visual.

O ChatGPT Images abandona o estilo amarelado e aprimora cenas complexas.

Durante muito tempo, foi relativamente fácil identificar se uma imagem havia sido criada com as primeiras versões do ChatGPT: elas predominavam. Tons quentes, acabamentos cremosos e um certo tom amarelado. que revelou sua origem artificial. Comparações internas realizadas pela OpenAI e testes independentes, em comparação com alternativas como Criador de imagens do BingEssa característica parece ter ficado para trás.

O novo modelo oferece um espectro de cores mais neutro e variadoIsso faz com que as imagens pareçam mais com fotografias convencionais, a menos que o usuário solicite explicitamente o contrário no prompt. Isso ajuda as imagens a parecerem menos "marcadas" e mais úteis em contextos onde se deseja realismo ou integração com material fotográfico existente.

Melhorias também foram feitas na representação de cenas com muitos elementos pequenostais como multidões ou planos de fundo ricos em detalhes. Os rostos em grandes grupos agora são mais distintos uns dos outros, com poses e expressões mais naturais, e imperfeições típicas, como marcas de mãos, traços minúsculos ou repetições estranhas, são reduzidas.

O ChatGPT Images permite inserir texto em imagens: perfeito para pôsteres, infográficos e maquetes.

Historicamente, gerar texto legível dentro de uma imagem tem sido um dos calcanhares de Aquiles da IA ​​generativa. A OpenAI afirma que o GPT Image 1.5 representa um avanço significativo nessa área, com um renderização tipográfica muito mais consistente do que nas versões anteriores.

O modelo consegue lidar com blocos de texto densos e pequenosIsso abre caminho para a criação de pôsteres, infográficos, maquetes de páginas de jornal ou designs com tabelas e formatos do tipo Markdown com um nível de legibilidade que, embora não seja perfeito, se aproxima de algo utilizável sem retoques intensivos.

Para quem trabalha em marketing, educação, comércio eletrônico ou conteúdo digital, essa melhoria significa reduzir o tempo gasto em Corrigir letras deformadas ou palavras incompletasEm contextos onde há necessidade de produzir materiais visuais com mensagens claras e prontos para publicação, o fato de o próprio modelo gerar textos razoavelmente limpos torna-se um fator diferenciador.

Uma nova experiência de usuário: uma seção dedicada a Imagens no ChatGPT.

A atualização não se limita ao modelo; ela também afeta a forma como ele é usado. A OpenAI adicionou um novo recurso à barra lateral do ChatGPT. uma seção específica chamada “Imagens”Isso se aplica tanto ao aplicativo móvel quanto à versão web. O objetivo é separar a experiência visual do chat tradicional e facilitar a navegação para aqueles que não querem se preocupar com instruções complexas.

A partir desse novo espaço, o usuário encontra estilos predefinidos, sugestões de tendências e modelos Para tarefas frequentes como criar cartões de felicitação, restaurar fotos antigas, alternar entre diferentes estilos artísticos ou gerar variações do mesmo produto, essa abordagem reduz a barreira de entrada para pessoas sem experiência técnica.

Outro aspecto prático é que a seção Imagens funciona como repositório centralizado de todas as criações visuais do usuário. A partir daí, fica mais fácil revisar versões anteriores, repetir um estilo com novo conteúdo ou continuar editando uma imagem já gerada, algo especialmente útil em fluxos de trabalho contínuos.

De acessório atraente a ferramenta de trabalho visual

A própria OpenAI reconhece que, até agora, a geração de imagens no ChatGPT funcionava mais como uma... Extremamente atraente em uma interface projetada para texto. que serve como um ambiente de trabalho visual sólido. Com esta atualização, a empresa pretende dar um salto qualitativo: passar de imagens de "teste" para redes sociais para uma ferramenta utilizável em processos do mundo real.

A melhoria na consistência e na iteração tem um impacto direto em setores como... design, marketing, comércio eletrônico ou brandingEmpresas que precisam adaptar o mesmo conceito criativo a múltiplos formatos, testar variações de um produto ou manter a consistência de logotipos e elementos corporativos em centenas de peças encontram uma clara vantagem nesse tipo de controle.

Plataformas criativas que operam na Europa, como editores web e ferramentas de design baseadas na nuvem.Eles já estão integrando esses modelos em seus fluxos de trabalho. Nessa área, o compromisso da OpenAI com um ambiente visual mais abrangente pode ser uma boa opção tanto para PMEs que buscam acelerar a produção de materiais gráficos quanto para equipes de comunicação interna em grandes corporações.

Disponibilidade de imagens ChatGPT para usuários, empresas e desenvolvedores.

A OpenAI começou a implementar as novas imagens ChatGPT para A maioria dos usuários da plataforma, incluindo aqueles com contas gratuitas.Muitos usuários já estão vendo uma notificação ao abrir o aplicativo, convidando-os a experimentar a função de imagem, além de uma nova aba dedicada no menu lateral para centralizar seu uso.

No setor empresarial, a empresa confirmou que o acesso avançado para contas Business e Enterprise será implementado gradualmente, com foco em integrações dentro da plataforma. fluxos de trabalho profissionaisPara as organizações europeias que já utilizam o ChatGPT para tarefas internas, isso significa poder estender seu uso de texto para material gráfico gerado com as mesmas credenciais.

Em paralelo, o GPT Image 1.5 está disponível através do API OpenAIIsso permite que os desenvolvedores integrem recursos de geração e edição de imagens em seus próprios aplicativos. A empresa afirma que o custo de entrada e saída de imagens é aproximadamente 20% menor do que o modelo anterior, uma vantagem significativa para projetos de grande escala ou serviços que operam com margens apertadas.

Concorrência com Nano Banana Pro e outros modelos visuais

A iniciativa da OpenAI surge em um momento de intensa pressão competitiva. O Google tem pressionado. Nano Banana Pro como um dos principais modelos visuais generativos, integrado ao seu ecossistema de ferramentas criativas e ligado ao seu Família Gemini, o que impulsionou seu uso globalmente.

Essa situação levou ao estabelecimento de [incompreensível] em alguns serviços concorrentes. limites rigorosos para usuários gratuitosPor exemplo, reduzindo o número de imagens que podem ser geradas por dia, em parte devido à alta demanda. Em contrapartida, a OpenAI parece apostar em uma combinação de amplo alcance, maior velocidade e um ambiente de edição mais refinado para reter e atrair usuários.

Entretanto, outros players como a xAI com seu chatbot Grok ou vários especialistas em imagem estão pressionando para que... A geração visual torna-se uma frente central Na batalha pela atenção do usuário, a estratégia da OpenAI envolve consolidar o ChatGPT como um "aplicativo tudo-em-um", onde busca, voz, texto, imagens e vídeo coexistem em um único ponto de acesso.

Com essas novas imagens ChatGPT, a OpenAI dá um passo importante rumo a um futuro mais seguro. ferramenta visual mais maduraUm modelo mais rápido e preciso, uma interface diferenciada e recursos de edição claramente voltados para o trabalho no mundo real, tanto em contextos pessoais quanto profissionais. Resta saber até que ponto essas melhorias serão integradas ao cotidiano de usuários e empresas na Espanha e na Europa, mas a mensagem é clara: a imagem deixou de ser apenas um recurso divertido para o chat e se tornou um componente central do ecossistema ChatGPT.

ChatGPT criando imagens
Artigo relacionado:
ChatGPT agora gera imagens com GPT-4o: tudo o que você precisa saber

Adicionar como fonte preferencial no Google