用 OpenAI Image API 生成第一张图
按官方 Image generation 指南,用 GPT Image 2 从提示词生成一张图片。
基于 OpenAI Developers 整理 · Image Generation · 官方资料
只想从一句话出图时,优先走 Images API;若要在对话或多步流程里出图,再用 Responses 的 image_generation 工具。
这篇先完成 Images API 最小路径:提交提示词,拿到图片并保存。
用 images.generate 出图
官方 images.generate
python
import base64
from openai import OpenAI
client = OpenAI()
result = client.images.generate(
model="gpt-image-2",
prompt="A calm river through a winter forest, soft daylight",
size="1024x1024",
)
image_base64 = result.data[0].b64_json
with open("river.png", "wb") as f:
f.write(base64.b64decode(image_base64))
print("saved river.png")需要预览时打开 partial images
流式出图时必须设置非零 partial_images(1–3)。设为 0 或省略可能导致 streaming 报错。
最容易踩的坑
Streaming must have non-zero partial images
stream=True 时设置 partial_images=1 到 3。
把 gpt-image 写进 Responses 的 model 字段
Responses 用主模型 + image_generation 工具;Images API 才直接选 GPT Image 模型。
官方资料
OpenAI DevelopersImage generation相关 AI 工具
相关 AI 模型
相关 TodayAI 指南
- 用 Structured Outputs 拿到可解析的模型结果用 json_schema + strict 约束 Chat Completions 输出,让结果可以直接解析进入应用逻辑。
- 用 Gemini Embeddings 做文本向量化按 Gemini API Embeddings 文档:用 embedContent 生成向量,配置 task 前缀或 task_type,并用 output_dimensionality 控制维度。
- 用 Gemini Structured Outputs 约束 JSON 结果按官方 Structured outputs:用 JSON Schema / Pydantic 约束 Gemini 的最终回答格式,提取菜谱等结构化数据并可直接校验。