GPT Image 2 API
GPT Image 2 của OpenAI — các endpoint text-to-image và chỉnh sửa chất lượng cao từ prompt ngôn ngữ tự nhiên. Các bậc chất lượng (low / medium / high) và tùy chỉnh độ phân giải cho phép bạn cân đối chi phí với độ trung thực cho mỗi lần gọi.
Các endpoint text-to-image và chỉnh sửa với bậc chất lượng (low / medium / high) và tùy chỉnh độ phân giải (cơ bản, 2K, 4K). Endpoint chỉnh sửa nhận một hoặc nhiều ảnh tham chiếu để chỉnh sửa bằng ngôn ngữ tự nhiên.
/filters:quality(82)/examples/bdc87732ca150d74d58327357a20ecdd/1783683931539388653_vcluDNzJ.webp)
Tổng quan
Giới thiệu về GPT Image 2 API
GPT Image 2 làm được gì, nằm ở đâu trong dòng mô hình của OpenAI, và vì sao các đội ngũ chọn nó.
GPT Image 2 là mô hình tạo và chỉnh sửa ảnh từ OpenAI, có sẵn qua REST API của WaveSpeedAI. GPT Image 2 của OpenAI — các endpoint text-to-image và chỉnh sửa chất lượng cao từ prompt ngôn ngữ tự nhiên. Các bậc chất lượng (low / medium / high) và tùy chỉnh độ phân giải cho phép bạn cân đối chi phí với độ trung thực cho mỗi lần gọi.
Các endpoint text-to-image và chỉnh sửa với bậc chất lượng (low / medium / high) và tùy chỉnh độ phân giải (cơ bản, 2K, 4K). Endpoint chỉnh sửa nhận một hoặc nhiều ảnh tham chiếu để chỉnh sửa bằng ngôn ngữ tự nhiên.
Họ GPT Image 2 trên WaveSpeedAI cung cấp 2 endpoint REST bao gồm 2 quy trình Text-To-Image, Image-To-Image. Mỗi biến thể có giá, các tham số điều chỉnh và kết quả mẫu riêng — hãy chọn biến thể phù hợp với dạng đầu vào và ràng buộc sản xuất của bạn, hoặc gọi nhiều biến thể từ cùng một API key để ghép các pipeline nhiều bước.
Chạy GPT Image 2 bằng cùng API key, tài khoản thanh toán và hạn mức tốc độ bạn dùng cho hơn 1.000 mô hình AI khác trên WaveSpeedAI. Không cần thiết lập nhà cung cấp riêng, không cần SDK cho từng nhà cung cấp, không có hạn mức tốc độ riêng của từng hãng — một lần tích hợp bao quát mọi thứ, từ text-to-image và text-to-video đến tổng hợp âm thanh, tạo 3D, nâng cấp và chỉnh sửa.
Endpoint
Tất cả endpoint API GPT Image 2
2 endpoint GPT Image 2 hiện có sẵn trên WaveSpeedAI — hãy chọn biến thể phù hợp với quy trình của bạn.
/filters:quality(82)/media/images/1782721508918099909_oCMW3dT2.webp)
Gpt Image 2 Text To Image
OpenAI's GPT Image 2 Text-to-Image generates high-quality images from natural-language prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782721434327650196_n8i8hqAK.webp)
Gpt Image 2 Edit
OpenAI's GPT Image 2 Edit enables image editing from natural-language instructions with one or more reference images. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Ví dụ
Xem GPT Image 2 hoạt động
Kết quả thật do API GPT Image 2 tạo ra. Rê chuột lên video để xem trước, nhấp để mở trình xem kích thước đầy đủ.
Hướng dẫn
Cách dùng API GPT Image 2
Bốn bước từ đăng ký đến khi có kết quả. Ví dụ đầy đủ bằng Python, Node.js và cURL nằm ở phần API bên dưới.
- 01
Lấy API key
Đăng ký tài khoản WaveSpeedAI và sao chép API key từ bảng điều khiển. Tài khoản mới được tặng credit dùng thử miễn phí — đủ để chạy playground vài chục lần trước khi bắt đầu tính phí.
- 02
Gửi một prediction
POST đầu vào của bạn dưới dạng JSON tới https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image. Endpoint trả về prediction id ngay lập tức — việc tạo là bất đồng bộ nên bạn không phải giữ kết nối mở trong lúc suy luận.
- 03
Poll để chờ hoàn tất
GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Trả về kết quả khi completed; dừng và báo lỗi khi failed, cancelled, timeout hoặc deleted; tiếp tục poll với mọi trạng thái khác.
- 04
Đọc URL kết quả
Khi status là "completed", đọc URL từ data.outputs[0]. URL trỏ tới media bạn đã tạo trên CDN của WaveSpeedAI — ảnh, video, âm thanh hoặc tệp 3D tùy biến thể GPT Image 2 bạn đã gọi.
Trường hợp sử dụng
Bạn có thể xây dựng gì với GPT Image 2
Các quy trình phổ biến mà nhà phát triển và người sáng tạo dùng API GPT Image 2 cho.
Text-to-image với các bậc chất lượng
openai/gpt-image-2/text-to-image tạo ảnh chất lượng cao từ prompt ngôn ngữ tự nhiên. Tham số quality (low / medium / high) cho phép bạn chọn mức đánh đổi giữa chi phí và chất lượng cho mỗi lần gọi mà không cần đổi endpoint.
Chỉnh sửa với ảnh tham chiếu
openai/gpt-image-2/edit cho phép chỉnh sửa ảnh theo chỉ dẫn bằng ngôn ngữ tự nhiên với một hoặc nhiều ảnh tham chiếu được cung cấp. Hữu ích cho các lượt tinh chỉnh theo prompt dựa trên một nguồn cụ thể.
Tùy chỉnh độ phân giải khi bàn giao
Tham số độ phân giải gồm cơ bản, 2K và 4K. Chọn kích thước nhỏ nhất đáp ứng yêu cầu bàn giao, chỉ nâng lên khi cần. Cùng một định dạng prompt cho mọi độ phân giải.
Lặp thử ở chất lượng low / medium
Chất lượng low để lặp hướng prompt; medium cho đầu ra đạt chuẩn bàn giao; high khi ưu tiên độ trung thực cao nhất.
Quy trình chỉnh sửa bằng ngôn ngữ tự nhiên
Endpoint chỉnh sửa nhận ảnh nguồn + văn bản chỉ dẫn, có thể kèm thêm ảnh tham chiếu. Nhẹ hơn quy trình dùng mask; đặc biệt hữu ích cho các lượt tinh chỉnh về phong cách ("làm ấm hơn", "thêm một tách cà phê", "xóa watermark").
Mẹo
Mẹo viết prompt cho GPT Image 2
Lời khuyên thực tế để có kết quả tốt hơn từ GPT Image 2 — rút ra từ các mẫu hiệu quả trên các mô hình ảnh trong các pipeline sản xuất.
- 01
Dùng tham số quality có chủ đích
GPT Image 2 có tham số quality với các bậc low / medium / high. Lặp trên low để chọn hướng prompt, tinh chỉnh trên medium (mặc định), dành high cho đầu ra chủ lực / phân phối cần độ trung thực tối đa.
- 02
Dùng endpoint Edit với ảnh tham chiếu
openai/gpt-image-2/edit nhận một ảnh nguồn cùng chỉ dẫn văn bản, có thể kèm thêm ảnh tham chiếu. Nhẹ hơn quy trình dùng mặt nạ — đặc biệt hữu ích cho tinh chỉnh phong cách ("make this warmer", "add a coffee cup").
- 03
Chọn độ phân giải nhỏ nhất đáp ứng phân phối
Tham số resolution của GPT Image 2 hỗ trợ base, 2K và 4K. Đừng tạo 4K khi 2K là đủ — cùng định dạng prompt dùng được cho mọi độ phân giải và kích thước lớn hơn chậm hơn.
- 04
Viết prompt cụ thể, có cấu trúc
Chủ thể + cảnh + ánh sáng + ngôn ngữ máy quay khai thác phần mạnh nhất trong dữ liệu huấn luyện của mô hình. 'A tabby cat sitting on a windowsill, afternoon light, shallow depth of field, 50mm lens' hiệu quả hơn hẳn 'a cat'.
- 05
Dùng mô tả phong cách thay vì tên nghệ sĩ
"In the style of editorial photography" hoặc "studio product lighting" hiệu quả hơn việc nêu tên nghệ sĩ còn sống — vừa tránh rủi ro bản quyền thương mại vừa thường cho đầu ra dùng được hơn.
Giá
Giá API GPT Image 2
Giá tính theo từng kết quả đầu ra. Khoản phí cuối cùng thay đổi theo các tham số bạn đặt trong playground của từng biến thể (độ phân giải, thời lượng, số kết quả, tham chiếu).
| Endpoint | Loại | Giá khởi điểm |
|---|---|---|
| openai/ | text-to-image | GIẢM 5%$0.06$0.057 |
| openai/ | image-to-image | GIẢM 5%$0.07$0.0665 |
API
Gọi API GPT Image 2
Đăng ký API key tại wavespeed.ai/accesskey, rồi gửi prediction qua REST. Playground tạo sẵn mã mẫu có thể dán ngay cho mọi tổ hợp đầu vào.
POSThttps://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)So sánh
GPT Image 2 so với các lựa chọn khác
Khi nào nên chọn GPT Image 2 thay vì các mô hình tương tự trên WaveSpeedAI.
GPT Image 2 so với Nano Banana Pro
Nano Banana Pro hỗ trợ text-to-image 4K, bậc Ultra và các biến thể Multi cho công việc hàng loạt. GPT Image 2 rẻ hơn ở chất lượng medium, với các bậc chất lượng rõ ràng (low/medium/high) và endpoint chỉnh sửa dựa trên ảnh tham chiếu.
GPT Image 2 so với Seedream 4.5
Seedream 4.5 nhấn mạnh typography và có biến thể Sequential cho nhất quán nhiều ảnh, còn GPT Image 2 có tham số chất lượng để tinh chỉnh và quy trình chỉnh sửa theo tham chiếu bằng ngôn ngữ tự nhiên mà Seedream xử lý theo cách khác.
GPT Image 2 so với Nano Banana 2
Nano Banana 2 có nhất quán nhiều nhân vật (tối đa 5) và tìm kiếm web tùy chọn. GPT Image 2 có các bậc chất lượng rõ ràng và endpoint chỉnh sửa bằng ảnh tham chiếu, với tùy chỉnh độ phân giải rộng hơn (cơ bản / 2K / 4K).
GPT Image 2 so với GPT Image 2.5
GPT Image 2.5 là phiên bản kế nhiệm: hai bậc (Flare cho tốc độ, Sunburst cho độ trung thực), năm mức chất lượng thay vì ba và giá mỗi ảnh thấp hơn. GPT Image 2 vẫn khả dụng cho các pipeline đã tinh chỉnh prompt với nó; việc chuyển đổi chỉ là đổi model ID. Xem /gpt-image-2-5-api.
Câu hỏi thường gặp
GPT Image 2 API — Câu hỏi thường gặp
Giá, giấy phép, tích hợp — những câu hỏi phổ biến về việc chạy GPT Image 2 trên WaveSpeedAI.
API GPT Image 2 là gì?
GPT Image 2 là mô hình tạo ảnh của OpenAI, được cung cấp dưới dạng REST API trên WaveSpeedAI. GPT Image 2 của OpenAI — các endpoint text-to-image và chỉnh sửa chất lượng cao từ prompt ngôn ngữ tự nhiên. Các bậc chất lượng (low / medium / high) và tùy chỉnh độ phân giải cho phép bạn cân đối chi phí với độ trung thực cho mỗi lần gọi. Bạn có thể gọi bằng lập trình hoặc thử từ playground ở liên kết phía trên.
Làm sao để gọi API GPT Image 2?
Đăng ký tài khoản WaveSpeedAI, sao chép API key từ /accesskey, rồi POST tới https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image với đầu vào dưới dạng JSON. Endpoint trả về prediction id. Hãy poll endpoint kết quả khoảng mỗi 2 giây, tăng khoảng cách với các tác vụ chạy lâu, và dừng ở bất kỳ trạng thái kết thúc nào. Ví dụ Python / Node.js / cURL hướng tới môi trường production ở phía trên.
API GPT Image 2 có giá bao nhiêu?
GPT Image 2 bắt đầu từ $0.057 mỗi lượt chạy. Chi phí chính xác thay đổi theo các tham số bạn đặt (độ phân giải, thời lượng, số kết quả, tham chiếu). Phần xem trước chi phí trực tiếp cạnh nút Tạo trong playground hiển thị giá chính xác cho đầu vào hiện tại của bạn.
Có những biến thể GPT Image 2 nào?
WaveSpeedAI cung cấp 2 endpoint GPT Image 2 đang hoạt động: openai/gpt-image-2/text-to-image, openai/gpt-image-2/edit. Mỗi biến thể có trang playground và giá riêng.
Tôi có thể dùng kết quả của GPT Image 2 cho mục đích thương mại không?
Quyền sử dụng thương mại tuân theo giấy phép mô hình của OpenAI. Hầu hết mô hình của OpenAI cho phép dùng kết quả đầu ra cho mục đích thương mại; hãy xem trang playground của từng mô hình để biết tóm tắt giấy phép cụ thể, và Điều khoản dịch vụ của WaveSpeedAI cho các điều kiện cấp nền tảng.
Tại sao dùng GPT Image 2 trên WaveSpeedAI thay vì gọi trực tiếp?
Một API key + một tài khoản thanh toán cho GPT Image 2 VÀ hơn 1.000 mô hình AI khác từ các nhà cung cấp khác. Không cần thiết lập SDK cho từng hãng, không có hạn mức tốc độ riêng, không phải viết lại mã tích hợp cho từng hãng. Giá thường ngang bằng hoặc thấp hơn API trực tiếp của OpenAI.
Nhà cung cấp
Giới thiệu về OpenAI
Đội ngũ đứng sau GPT Image 2 và dòng mô hình OpenAI rộng hơn trên WaveSpeedAI.
OpenAI là phòng thí nghiệm đứng sau ChatGPT, GPT-4 và GPT-5, DALL·E, Sora và Whisper. Các mô hình ảnh và video của hãng được triển khai rộng rãi trong ứng dụng người dùng và doanh nghiệp, tập trung vào khả năng bám sát chỉ dẫn, độ chân thực nhiếp ảnh và các rào chắn an toàn thận trọng. API ảnh thường được chọn cho marketing và biên tập, nơi cần sự rõ ràng nghiêm ngặt về quyền sử dụng thương mại.
Bắt đầu xây dựng với GPT Image 2 trên WaveSpeedAI
Tặng credit dùng thử miễn phí khi đăng ký. Một API key cho hơn 1.000 mô hình AI từ OpenAI và mọi nhà cung cấp khác.
/filters:quality(82)/examples/874ce526dc7b45f758856a297ebe3554/1783683932960323788_1NW4enxG.webp)
/filters:quality(82)/examples/109ce7033b5441fb1eff58b63d16863b/1783683934369707528_qazInwFP.webp)
/filters:quality(82)/examples/8c270f7907b063ff49eabce65b002171/1783683935824334487_V58ZZaju.webp)
/filters:quality(82)/examples/05380da16689443ee6dc4544b1744b71/1783683937583622712_z9xxqlg6.webp)