GPT Image 2

O GPT Image 2 é o modelo GPT Image mais recente da OpenAI para gerar e editar imagens. A Aiberm o expõe por endpoints de imagem compatíveis com a OpenAI, então você pode usar o SDK da OpenAI alterando base_url / baseURL para https://aiberm.com/v1.

Endpoint de geração: POST https://aiberm.com/v1/images/generations

Endpoint de edição: POST https://aiberm.com/v1/images/edits

Modelo: gpt-image-2

Escolher uma API

Use a Image API quando precisar de uma única solicitação para gerar ou editar uma imagem. Este é o caminho recomendado para a maioria das integrações com a Aiberm.

A OpenAI também documenta a geração de imagens como uma ferramenta na Responses API para fluxos conversacionais ou de várias etapas. Se sua integração depende de edição em vários turnos, primeiro confirme se o modelo e o endpoint da Aiberm oferecem suporte à Responses API.

Gerar uma imagem

A Image API retorna os dados da imagem em base64 em data[0].b64_json. Decodifique-os e grave os bytes em um arquivo.

1from openai import OpenAI
2import base64
3 
4client = OpenAI(
5 api_key="YOUR_API_KEY",
6 base_url="https://aiberm.com/v1",
7)
8 
9result = client.images.generate(
10 model="gpt-image-2",
11 prompt="A clean product photo of a matte black smart desk lamp on a white background",
12 size="1024x1024",
13 quality="medium",
14)
15 
16image_base64 = result.data[0].b64_json
17image_bytes = base64.b64decode(image_base64)
18 
19with open("lamp.png", "wb") as f:
20 f.write(image_bytes)

Saída de exemplo verificada

Esta imagem foi gerada com o exemplo em Python acima e salva a partir de data[0].b64_json.

Luminária de mesa inteligente preta fosca gerada

Editar com imagens de referência

Passe uma ou mais imagens para images.edit e descreva a saída desejada. Várias imagens de entrada podem ser usadas como referências para uma nova composição.

1from openai import OpenAI
2import base64
3 
4client = OpenAI(
5 api_key="YOUR_API_KEY",
6 base_url="https://aiberm.com/v1",
7)
8 
9result = client.images.edit(
10 model="gpt-image-2",
11 image=[
12 open("product.png", "rb"),
13 open("background.png", "rb"),
14 ],
15 prompt="Place the product from the first image onto the desk in the second image. Keep realistic lighting.",
16 size="1536x1024",
17 quality="high",
18)
19 
20image_bytes = base64.b64decode(result.data[0].b64_json)
21with open("edited-product.png", "wb") as f:
22 f.write(image_bytes)

Edição de referência verificada

O exemplo de edição combina a imagem do produto com o fundo da mesa e retorna um novo PNG 1536x1024.

Entrada do produtoEntrada do fundoSaída editada
Imagem de referência do produtoImagem de referência do fundo da mesaProduto editado colocado na mesa

Editar com uma máscara

Use uma máscara quando quiser orientar qual área deve mudar. A imagem de origem e a máscara devem ter as mesmas dimensões e o mesmo formato, e a máscara deve incluir um canal alfa.

1from openai import OpenAI
2import base64
3 
4client = OpenAI(
5 api_key="YOUR_API_KEY",
6 base_url="https://aiberm.com/v1",
7)
8 
9result = client.images.edit(
10 model="gpt-image-2",
11 image=open("room.png", "rb"),
12 mask=open("mask.png", "rb"),
13 prompt="Replace the masked area with a modern walnut bookshelf.",
14)
15 
16image_bytes = base64.b64decode(result.data[0].b64_json)
17with open("room-bookshelf.png", "wb") as f:
18 f.write(image_bytes)

Edição com máscara verificada

A imagem da máscara usa um canal alfa para orientar a área editável. A imagem retornada é um PNG normal.

Imagem de origemImagem da máscaraSaída editada
Imagem de origem do cômodoImagem da máscara alfaSaída da edição com máscara da estante

Streaming de imagens parciais

A API original da OpenAI documenta stream e partial_images para receber imagens intermediárias antes do resultado final. Na Aiberm, trate isso como dependente de compatibilidade: use o fluxo padrão sem streaming, a menos que seu endpoint tenha confirmado explicitamente o suporte a streaming.

Se você enviar stream: true e partial_images, a resposta ainda pode ser um payload JSON final normal com data[0].b64_json.

Opções de saída

ParâmetroValoresObservações
sizeauto, 1024x1024, 1536x1024, 1024x1536, 2048x2048, 2048x1152, 3840x2160, 2160x3840 ou outro tamanho personalizado válidoCada lado deve ser um múltiplo de 16 px, o lado máximo é 3840 px, a proporção não pode ser maior que 3:1 e o total de pixels deve estar entre 655.360 e 8.294.400.
qualityauto, low, medium, highUse low para rascunhos rápidos e medium ou high para ativos finais.
output_formatpng, jpeg, webpO padrão é png. jpeg costuma ser mais rápido quando a transparência não é necessária.
output_compression0 a 100Aplica-se a jpeg e webp.
backgroundauto, opções de fundo opacoO gpt-image-2 atualmente não oferece suporte a background: "transparent".
stream, partial_imagesDependente de compatibilidadeA Aiberm pode retornar uma resposta JSON final normal em vez de eventos de imagens parciais em streaming.
moderationauto, lowauto é o nível de filtragem padrão.

Observações e limitações

  • Prompts complexos podem demorar mais para serem processados; projete seu aplicativo considerando timeouts e trabalho em segundo plano.
  • A renderização de texto melhorou, mas ainda não é garantida como exata. Para logotipos, rótulos ou mockups de UI, verifique a saída antes de publicar.
  • O modelo pode não preservar perfeitamente personagens recorrentes, layouts exatos ou detalhes de marca em gerações separadas.
  • Nas edições, omita input_fidelity com gpt-image-2; o modelo processa as entradas de imagem com alta fidelidade automaticamente.
  • Nas edições com máscara, a máscara é uma orientação, e não uma seleção pixel a pixel.