GPT Image 2

GPT Image 2 là mô hình GPT Image mới nhất của OpenAI để tạo và chỉnh sửa ảnh. Aiberm cung cấp nó qua các endpoint ảnh tương thích OpenAI, vì vậy bạn có thể dùng OpenAI SDK bằng cách đổi base_url / baseURL thành https://aiberm.com/v1.

Endpoint tạo ảnh: POST https://aiberm.com/v1/images/generations

Endpoint chỉnh sửa: POST https://aiberm.com/v1/images/edits

Mô hình: gpt-image-2

Chọn API

Dùng Image API khi bạn cần một yêu cầu để tạo hoặc chỉnh sửa ảnh. Đây là đường dẫn khuyến nghị cho hầu hết tích hợp Aiberm.

OpenAI cũng tài liệu hóa việc tạo ảnh như một công cụ trong Responses API cho các quy trình ảnh hội thoại hoặc nhiều bước. Nếu tích hợp của bạn phụ thuộc vào chỉnh sửa nhiều lượt, hãy xác nhận trước rằng mô hình và endpoint Aiberm hỗ trợ Responses API.

Tạo ảnh

Image API trả về dữ liệu ảnh base64 trong data[0].b64_json. Giải mã rồi ghi các byte ra tệp.

1from openai import OpenAI
2import base64
3 
4client = OpenAI(
5 api_key="YOUR_API_KEY",
6 base_url="https://aiberm.com/v1",
7)
8 
9result = client.images.generate(
10 model="gpt-image-2",
11 prompt="A clean product photo of a matte black smart desk lamp on a white background",
12 size="1024x1024",
13 quality="medium",
14)
15 
16image_base64 = result.data[0].b64_json
17image_bytes = base64.b64decode(image_base64)
18 
19with open("lamp.png", "wb") as f:
20 f.write(image_bytes)

Đầu ra ví dụ đã xác minh

Ảnh này được tạo bằng ví dụ Python ở trên và lưu từ data[0].b64_json.

Generated matte black smart desk lamp

Chỉnh sửa với ảnh tham chiếu

Truyền một hoặc nhiều ảnh vào images.edit và mô tả đầu ra mong muốn. Nhiều ảnh đầu vào có thể dùng làm tham chiếu cho một bố cục mới.

1from openai import OpenAI
2import base64
3 
4client = OpenAI(
5 api_key="YOUR_API_KEY",
6 base_url="https://aiberm.com/v1",
7)
8 
9result = client.images.edit(
10 model="gpt-image-2",
11 image=[
12 open("product.png", "rb"),
13 open("background.png", "rb"),
14 ],
15 prompt="Place the product from the first image onto the desk in the second image. Keep realistic lighting.",
16 size="1536x1024",
17 quality="high",
18)
19 
20image_bytes = base64.b64decode(result.data[0].b64_json)
21with open("edited-product.png", "wb") as f:
22 f.write(image_bytes)

Chỉnh sửa tham chiếu đã xác minh

Ví dụ chỉnh sửa kết hợp ảnh sản phẩm với nền bàn và trả về PNG 1536x1024 mới.

Đầu vào sản phẩmĐầu vào nềnĐầu ra đã chỉnh
Product reference imageDesk background reference imageEdited product placed on desk

Chỉnh sửa với mask

Dùng mask khi bạn muốn hướng dẫn vùng nào nên thay đổi. Ảnh nguồn và mask phải cùng kích thước và định dạng, và mask phải có kênh alpha.

1from openai import OpenAI
2import base64
3 
4client = OpenAI(
5 api_key="YOUR_API_KEY",
6 base_url="https://aiberm.com/v1",
7)
8 
9result = client.images.edit(
10 model="gpt-image-2",
11 image=open("room.png", "rb"),
12 mask=open("mask.png", "rb"),
13 prompt="Replace the masked area with a modern walnut bookshelf.",
14)
15 
16image_bytes = base64.b64decode(result.data[0].b64_json)
17with open("room-bookshelf.png", "wb") as f:
18 f.write(image_bytes)

Chỉnh sửa mask đã xác minh

Ảnh mask dùng kênh alpha để hướng dẫn vùng có thể chỉnh. Ảnh trả về là PNG thông thường.

Ảnh nguồnẢnh maskĐầu ra đã chỉnh
Room source imageAlpha mask imageBookshelf mask edit output

Stream ảnh từng phần

API gốc của OpenAI tài liệu hóa streampartial_images để nhận ảnh trung gian trước kết quả cuối. Trên Aiberm, hãy coi đây là phụ thuộc tương thích: dùng luồng không stream tiêu chuẩn trừ khi endpoint của bạn đã xác nhận rõ hỗ trợ streaming.

Nếu bạn gửi stream: truepartial_images, phản hồi vẫn có thể là payload JSON cuối cùng thông thường với data[0].b64_json.

Tùy chọn đầu ra

Tham sốGiá trịGhi chú
sizeauto, 1024x1024, 1536x1024, 1024x1536, 2048x2048, 2048x1152, 3840x2160, 2160x3840, hoặc kích thước tùy chỉnh hợp lệ khácMỗi cạnh phải là bội số của 16 px, cạnh tối đa là 3840 px, tỷ lệ khung hình không quá 3:1, và tổng số pixel phải nằm trong khoảng 655,360 đến 8,294,400.
qualityauto, low, medium, highDùng low cho bản nháp nhanh và medium hoặc high cho tài sản cuối.
output_formatpng, jpeg, webpMặc định là png. jpeg thường nhanh hơn khi không cần trong suốt.
output_compression0 đến 100Áp dụng cho jpegwebp.
backgroundauto, các tùy chọn nền đụcgpt-image-2 hiện không hỗ trợ background: "transparent".
stream, partial_imagesPhụ thuộc tương thíchAiberm có thể trả về phản hồi JSON cuối cùng thông thường thay vì các sự kiện ảnh từng phần được stream.
moderationauto, lowauto là mức lọc mặc định.

Lưu ý và giới hạn

  • Prompt phức tạp có thể mất nhiều thời gian xử lý hơn; hãy thiết kế ứng dụng với timeout và công việc nền.
  • Kết xuất chữ đã cải thiện nhưng vẫn không đảm bảo chính xác tuyệt đối. Với logo, nhãn hoặc mockup UI, hãy kiểm tra đầu ra trước khi xuất bản.
  • Mô hình có thể không giữ nguyên nhân vật lặp lại, bố cục chính xác hoặc chi tiết thương hiệu hoàn hảo qua các lần sinh riêng biệt.
  • Khi chỉnh sửa, bỏ input_fidelity với gpt-image-2; mô hình tự xử lý đầu vào ảnh ở độ trung thực cao.
  • Với chỉnh sửa mask, mask là hướng dẫn chứ không phải vùng chọn chính xác từng pixel.