OpenRouter 推出统一 Image API,一个接口接入 30+ 图像模型
Introducing the Unified Image API
OpenRouter 发布专用 Image API,统一接入 30+ 图像生成模型,覆盖 Google、OpenAI、Black Forest Labs、Recraft、ByteDance、Microsoft、xAI 等厂商。
原文给出了统一接口、能力描述端点和按提供商计价细节,读者可以据此评估切换图像模型时的工作流收益。
OpenRouter 上的图像生成现在有了专用 API,可统一访问 30 多个模型。
与我们所有的媒体生成 API 一样,我们标准化了接口以便轻松切换模型,允许透传各模型的独特能力,并提供程序化访问以发现每个模型的详细信息。我们支持来自 Google、OpenAI、Black Forest Labs、Recraft、ByteDance、Sourceful、Microsoft 和 xAI 的模型,并且还在不断添加更多。
浏览图像模型 | API 文档 | 在 Playground 中试用
了解每个模型能做什么
图像模型之间的差异会导致请求失败。Seedream 4.5 支持 18 种宽高比;Gemini 3.1 Flash Image 支持 14 种(有重叠,但不完全相同)。有些模型每次调用最多生成 10 张图像;有些则上限为 1 张。有些接受 16 个输入参考;有些只接受 4 个。
/api/v1/images/models 端点会为每个模型返回类型化的能力描述符:
{
"id": "bytedance-seed/seedream-4.5",
"supported_parameters": {
"resolution": { "type": "enum", "values": ["1K", "2K", "4K"] },
"aspect_ratio": { "type": "enum", "values": ["1:1", "16:9", "9:16", "..."] },
"n": { "type": "range", "min": 1, "max": 10 },
"input_references": { "type": "range", "min": 0, "max": 14 },
"seed": { "type": "boolean" }
},
"supports_streaming": false
}你的代码可以适应任何模型,而无需硬编码提供商的差异,也不会因为不可接受的参数而陷入 400 错误。
这对智能体尤其有用。将 /api/v1/images/models 响应交给你的编码智能体,它就拥有了选择模型、验证输入并生成图像所需的一切,无需反复试错。
按提供商的粒度
每个模型可能由多个提供商提供服务。按端点的记录(/api/v1/images/models/{id}/endpoints)为你提供每个端点的确切真相:这个特定端点接受哪些参数、允许哪些透传键、流式支持以及细粒度定价。
curl "https://openrouter.ai/api/v1/images/models/google/gemini-3.1-flash-image/endpoints"每个端点还会返回一个 pricing 数组,其中包含确切的计费结构。不同提供商按不同单位收费:
"pricing": [
{ "billable": "output_image", "unit": "image", "cost_usd": 0.04 }
]Seedream 4.5 每张图像固定收费 $0.04。FLUX.2 Pro 按每百万像素 $0.03 计费(因此分辨率会影响成本)。GPT-5.4 Image 2 和 Gemini 3.1 Flash Image 按 token 计费。不再需要猜测一次生成为何花费如此;每个响应中的 usage 对象都包含以美元计的确切成本。
一种请求形态,适配任何模型
该 API 将碎片化的图像生成世界统一为一个模式:
curl -X POST "https://openrouter.ai/api/v1/images" \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "bytedance-seed/seedream-4.5",
"prompt": "a red panda astronaut floating in space, studio lighting",
"resolution": "2K",
"aspect_ratio": "16:9"
}'分辨率、宽高比、质量、输出格式、背景透明度、输入参考、流式传输:所有内容都在每个提供商之间进行了标准化。当你需要提供商特定功能(例如 Black Forest Labs 的 steps 或 guidance)时,通过 provider.options 传入它们,并以 endpoints API 中的提供商 slug 作为键。
GPT Image 模型的流式预览
OpenAI 的 GPT Image 模型(GPT-5 Image、GPT-5 Image Mini、GPT-5.4 Image 2)通过 Image API 支持原生 SSE 流式传输。设置 "stream": true,你将在图像渲染时收到部分图像预览,这样用户就能看到进度,而不是等待完整生成。检查任意端点上的 supports_streaming 字段以了解是否可用。
常见问题
通过聊天补全进行的图像生成会怎样?
到目前为止,我们通过 completions 和 responses 支持图像生成。所有现有图像模型仍在此处受支持,但新的图像模型将仅添加到专用 Image API 中。
如果你正在使用 openai/gpt-5-image、openai/gpt-5-image-mini 或 openai/gpt-5.4-image-2,我们建议切换到专用图像模型之一。GPT 5 和 5.4 版本通过 LLM 生成图像,因此它们无法访问完整的受支持参数集,并且可能会产生额外的推理成本。
我可以使用提供商特定功能吗?
可以。每个端点都会公开一个 allowed_passthrough_parameters 列表。在 provider.options 下传入提供商特定的键,并以提供商 slug 作为键。endpoints API 会确切告诉你接受哪些键。
定价如何运作?
每个端点返回细粒度的定价明细,包含计费单位、以美元计的成本以及可选的变体层级(例如基于分辨率的定价)。每个响应中的 usage 对象都包含确切的成本。
告诉我们你的想法以及你接下来想要哪些模型,请在 Discord 的 #feedback 中留言。
来源:OpenRouter:Announcements(RSS) · openrouter.ai