跳到正文
OpenRouter Blog·· 17 天前精选AI 评分62

OpenRouter 实测 20 个图像生成模型:成本、编辑与质量对比

Image Generation Models Compared: Cost, Edit, Quality

AI 导读

OpenRouter 用同一提示词实测了 20 个图像生成模型,读取每次响应的 usage.cost 作为真实计费,单张图价格从 0.006 美元到 0.134 美元,相差 22 倍。

推荐理由

同一提示词实测 20 个图像模型的真实计费与参数差异,可据此按成本、参考图数量和文字渲染能力选型。

正文 · AI 翻译

我们通过一个 API路由了 50 多个图像生成模型。我们用同一个提示词跑通了其中 20 个,并记录了每次调用计费多少、返回了什么,以及它接受什么。

成本是难点,因为这些模型不是按同一单位售卖的。FLUX.2 按每兆像素计价。Gemini、OpenAI 和 Microsoft MAI 按 token 计价。Grok、Recraft、Riverflow、Qwen 和 Seedream 按每张图计价,费率会随你要求的质量和分辨率而变化。每个模型页面用各自的单位标价都是正确的,所以你无法通过并排阅读两个模型的价格来比较它们。

我们把它们放在同一基准上。我们测试的 20 个模型都收到相同尺寸的相同提示词,并从每个响应中读取 usage.cost 字段,也就是我们被收取的金额。

本页上的每个价格都来自一次真实生成,测量于 2026 年 9 月 11 日。价格和模型经常变化,所以任何超过一个月的数字都应视为提示,而非预算条目。你可以用 GET /api/v1/images/models 重新拉取当前接受的参数,用 GET /api/v1/images/models/{model}/endpoints 重新拉取标明了单位的定价。

摘要

  • 从 openai/gpt-image-2 开始。它在短提示词上计费 $0.006,在较长提示词上计费 $0.0135,这使它成为我们测量到的最便宜的模型,而且它正确渲染了我们的两行标签和参考编辑。
  • 当图像很难做对时,可以选用 sourceful/riverflow-v2.5-pro,价格为 $0.064;当回复既需要文字又需要图片时,可以选用 google/gemini-3-pro-image,价格为 $0.134;当你需要可编辑的 SVG 而不是像素时,可以选用 recraft/recraft-v4.1-vector,价格为 $0.08。
  • 在我们测量的 20 个模型中,一张默认设置的图像计费在 $0.006 到 $0.134 之间,相差 22 倍。
  • 每个模型页面都用各自的单位标价,而计费成本可能与标价不同。比较两个模型的方法是各生成一张图像,然后从响应中读取 usage.cost。
  • 在 OpenAI 模型上,quality 设置将同一张图像从 $0.006 变为 $0.211。
  • n,即一次调用返回的图像数量,在 FLUX.2、Gemini、Grok、Riverflow 和 MAI 上上限为 1。seed 在 Gemini、Grok、OpenAI、Riverflow、Recraft 或 MAI 上不存在。在 FLUX.2 Klein 上存在时,相同的种子逐字节复现了图像。
  • 我们要求渲染可读文字的六个模型中,有五个正确渲染了它,包括最便宜的那个。
  • 原始 API 返回 data[0].b64_json。TypeScript SDK 返回 data[0].b64Json。

每个模型向我们收取了多少费用

我们向这 20 个模型中的每一个发送了提示词“A studio packshot of a glass bottle, hard key light, no text.”,使用 aspect_ratio: "1:1" 且没有其他设置,然后从响应中读取 usage.cost。本文中的表格显示 usage.cost 四舍五入到四位小数。计费单位列是每个端点定价记录中的 unit 字段。

模型计费返回格式计费单位
openai/gpt-image-2$0.00601024x1024PNGtoken
black-forest-labs/flux.2-klein-4b$0.01401024x1024JPEGmegapixel
sourceful/riverflow-v2.5-fast$0.01761024x1024WebPimage
black-forest-labs/flux.2-pro$0.03001024x1024JPEGmegapixel
qwen/qwen-image-3$0.03001024x1024PNGimage
krea/krea-2-medium$0.03001024x1024PNGnot published
openai/gpt-image-1-mini$0.03331024x1024PNGtoken
google/gemini-3.1-flash-lite-image$0.03361024x1024JPEGtoken
recraft/recraft-v4.1$0.03501024x1024WebPimage
bytedance-seed/seedream-5-0-lite$0.03502048x2048JPEGimage
microsoft/mai-image-2.5$0.04821024x1024PNGtoken
black-forest-labs/flux.2-flex$0.05001024x1024JPEGmegapixel
x-ai/grok-imagine-image-quality$0.05001024x1024JPEGimage
x-ai/grok-imagine-image-2.0$0.06001024x1024JPEGimage
sourceful/riverflow-v2.5-pro$0.06411024x1024WebPimage
google/gemini-3.1-flash-image$0.06721024x1024PNGtoken
black-forest-labs/flux.2-max$0.07001024x1024JPEGmegapixel
recraft/recraft-v4.1-vector$0.0800vectorSVGimage
bytedance-seed/seedream-5-0-pro$0.09002048x2048JPEGimage
google/gemini-3-pro-image$0.13441024x1024PNGtoken

Horizontal bar chart of the measured cost of one default-settings image on 20 image models, sorted from cheapest to most expensive. openai/gpt-image-2 is cheapest at $0.006 and google/gemini-3-pro-image is most expensive at $0.134. Each bar is labelled with its billing unit, and the per-token, per-megapixel, and per-image units are mixed throughout the range.

图 1. 相同的价格,经过排序。三种计费单位在整个区间内混合出现,因此单位并不能告诉你某个模型落在区间中的哪个位置。

在根据这张表做预算之前,你需要知道三件事。

  1. 当我们不设置 resolution 时,两个 Seedream 模型都返回了 2048x2048,而不是 1024x1024。Seedream 5.0 Lite 将 2K 列为它接受的最低分辨率。Seedream 5.0 Pro 接受 1K,但其默认调用返回 2K,并按 0.09 美元的高分辨率费率计费,而不是 0.045 美元的基础费率。Seedream 5.0 Lite 以 0.035 美元给你四百万像素,因此按像素计算,它比表格看起来更便宜。
  2. FLUX.2、Grok 和 Seedream 返回 JPEG。OpenAI、Qwen、Microsoft 和 Krea 返回 PNG。Sourceful 和 Recraft 返回 WebP,Recraft 的矢量模型返回 SVG。我们测试的三个 Gemini 模型不接受 output_format,而且它们返回的格式并不完全相同,所以不要硬编码文件扩展名。在接受该参数的目录模型上设置 output_format。在不接受该参数的模型上,读取每个响应中返回的 media_type 字段。
  3. 对 sourceful/riverflow-v2.5-fast 使用相同请求体进行两次调用,分别计费 0.017623 美元和 0.017639 美元。请根据多次调用的平均值来做预算,而不是根据单次调用。

质量设置会让价格变动 35 倍

在 OpenAI 模型上,quality 对你的账单的影响比任何其他设置都大。我们在相同的提示词、相同的 1024x1024 尺寸下运行 gpt-image-2,分别将 quality 保持未设置、设为 low 和设为 high。

quality图像 token计费
unset196$0.0060
low196$0.0060
high7,024$0.2108

将 quality 保持未设置时,我们得到的 token 数量和账单与 low 相同。当图像很重要时,请显式设置 quality,并且除非 OpenAI 模型的单张图像价格注明了质量层级,否则应将其视为不完整。high 调用还花了 123 秒才返回,而默认调用只用了 12 秒。

宽高比对账单的影响要小得多

在按百万像素计费的模型上,你要求的画幅会改变账单,但变化幅度小于像素数量所暗示的程度。我们以两种形状运行了 black-forest-labs/flux.2-klein-4b。21:9 的调用返回 2400x1024,即 2.46 百万像素,而正方形为 1.05 百万像素。正方形计费 0.014 美元,宽幅裁剪计费 0.016 美元。

标价与计费成本可能不同

每个模型都会在其页面和 API 的 endpoints 路由上公布费率。这些费率只是规划用的数字,而响应才是你实际支付的费用。2026 年 9 月 11 日,sourceful/riverflow-v2.5-pro 在其默认分辨率下列出每张图像 0.13 美元,但向我们计费 0.064 美元。black-forest-labs/flux.2-flex 列出每百万像素 0.06 美元,但对一张百万像素图像向我们计费 0.05 美元。black-forest-labs/flux.2-max 列出 0.07 美元,并恰好向我们计费 0.07 美元。krea/krea-2-medium 在其 endpoint 上未发布定价记录,并向我们计费 0.03 美元。

当两者不一致时,请阅读 usage.cost,而不是用标价乘以估算值。

我们对已完成的图像请求全额计费,对失败的请求不收取任何费用。Image API 计费文档 说明了哪些结果会被计费。

参考资料、格式和限制

价格只是一个维度。以下是其他维度,其中两个维度在成本成为考虑因素之前就已经把某些模型排除在外了。这些数值来自每个端点在 2026 年 9 月 11 日的 supported_parameters。

系列输出模态最大参考图片数output_format每次调用生成的图片数(n)seed
FLUX.2 Kleinimage4png, jpeg1yes
FLUX.2 Flex, Pro, Maximage8png, jpeg1yes
Gemini 3.x imageimage, text14not settable1no
Grok Imagine Imageimage3not settable1no
OpenAI gpt-imageimage16not settable1 to 10no
OpenAI gpt-5-imageimage, text16not settable1 to 10no
Seedream 5.0image14not settable1 to 4 on Lite, 1 on Proyes
Recraft v4.1image1svg on the vector model1 to 6no
Qwen Image 3image4not settable1 to 6yes
Riverflow 2.5image4 on Fast, 10 on Projpeg on Fast, png, jpeg, webp on Pro1no
Microsoft MAI Image 2.5image1not settable1no
Krea 2 Mediumimage1not settablen not publishedyes

参考图片是你在请求中随附、供模型参考的图片,可以是你想要编辑的图片,也可以是你想要匹配的风格或产品的示例。可发送数量的上限是一个硬性天花板。Grok 接受三张,Gemini 接受十四张,因此一套六张图片的品牌素材包在你还未比较其他任何东西之前就已经把 Grok 排除在外了。

输出模态这一列是第二个维度。这些模型大多接受文本和图片输入,只返回图片字节。Gemini 图像模型和 OpenAI 的 gpt-5-image 模型还可以在同一次回复中返回文字,如果你希望模型解释它生成了什么,这一点很重要。我们在下文进一步测试了它们做到这一点的可靠性。

用 GET /api/v1/images/models 重新拉取任意模型的这张表,它会公布每个模型接受的参数及其范围。supported_parameters 中不存在的参数在该端点上不受支持。

Seed 在 FLUX.2 Klein 上精确复现了图像

seed 是你发送的、用于让结果可复现的数字。在我们目录中的每个 Gemini、Grok、OpenAI、Riverflow、Recraft 和 MAI 图像模型上都缺失它。它存在于 FLUX.2、Seedream、Qwen 和 Krea 上。

我们用相同的提示词和 seed: 424242 运行了 black-forest-labs/flux.2-klein-4b 两次。两次响应逐字节完全相同,且都计费 $0.014。我们只测试了 Klein,因此请将其他支持 seed 的模型视为未经测试,而不要假设它们的行为相同。作为对比,两次不带 seed 参数的 sourceful/riverflow-v2.5-fast 调用在相同请求体下返回了两张不同的图片。

排行榜怎么说

我们在每个模型的页面上展示 Design Arena 评分。当我们在 2026 年 9 月 11 日通过我们的 benchmarks API 拉取当前评分时,sourceful/riverflow-v2.5-pro 在图像榜和图像编辑榜上都拥有最高评分。微软的 MAI Image 2.6 模型和谷歌的 Gemini 图像模型在图像榜上紧随其后,而 black-forest-labs/flux.2-klein-4b 在两个榜单所列模型中评分最低。

这些评分来自模型之间的两两投票,Design Arena 将其转化为 Elo 评分,即一种模型在对决中获胜时上升、落败时下降的分数。

有两点需要注意。Gemini 的评分基于这些 slug 的 -preview 版本,而非我们在此页面链接的正式发布 slug。而且 Elo 告诉你的是投票者在他们的提示词上偏好什么,而不是你的。评分最高的模型在我们的运行中每张图片计费 $0.064,评分最低的则计费 $0.014。先从榜单中筛选,再根据你自己的提示词做决定。

我们用一个提示词测试了六个模型

我们把一个提示词发送给价格区间内的六个模型,并把账单放在每张图片下方。我们要求生成一个哑光黑色咖啡袋,上面印有两行文字。

提示词

一张哑光黑色咖啡袋的影棚产品照,置于纯白背景上,硬质主光。袋子正面以简洁的无衬线大写字母印着 OPENROUTER ROASTERS,其下方以较小的字体印着 SINGLE ORIGIN。

我们选择可读的文字,因为它们容易评分。袋子要么写着你要求的内容,要么没有。

Six generated product photographs of a black coffee bag arranged in a grid, each labelled with its model slug and measured cost. Five of the six show the words OPENROUTER ROASTERS and SINGLE ORIGIN rendered correctly. The black-forest-labs/flux.2-klein-4b image shows the second line as SINGLE ORISION.

图 2。同一提示词通过六个模型生成,并标注了每次调用的实测成本。

六个模型中有五个正确印出了两行文字。例外是 black-forest-labs/flux.2-klein-4b,它正确渲染了品牌名,却把第二行拼错成了 SINGLE ORISION。

最有用的比较是 Design Arena 榜单上最便宜的模型与最贵的模型之间的对比。openai/gpt-image-2 计费 $0.0135,sourceful/riverflow-v2.5-pro 计费 $0.0654,两者都生成了正确、可用的产品照。多花约五倍的钱带来的是不同的观感,而不是更好的文字。

这并不意味着 Riverflow 定价过高。它领跑 Design Arena 榜单,而在更难的图像、不寻常的构图或更长的文字串上,差距可能会显现。这真正说明的是,无论是排行榜还是价格栏,都无法预测这个提示词上的结果,只有实际运行提示词才能。

同一次测试还得出了两个较小的发现。在按 token 计费的模型上,提示词长度会改变你的账单,因为 openai/gpt-image-2 在之前的一行提示词上计费 $0.006,而在这个更长的提示词上计费 $0.0135。而且每个模型对“studio packshot”的理解都不同,从硬阴影的产品照到柔光产品照,因此构图是一个值得测试的风格选择。

按任务挑选

根据对你而言最紧张的约束来挑选模型。这可能是大批量下的成本、图像是否必须包含可读文字、你需要发送多少张参考图,或者回复是否需要图片旁附带文字。

大批量、普通提示词

从 openai/gpt-image-2 开始。在成本表中,它在短提示词上计费 $0.006,在较长的咖啡袋提示词上计费 $0.0135,因为它按 token 计费,你的提示词也是账单的一部分。对于类似长度的产品提示词,按这个范围做预算。它是我们测过的最便宜的模型,并且以最低的成本正确渲染了我们的文字。

black-forest-labs/flux.2-klein-4b 以 $0.014 是另一个便宜选项,但有一个实测的注意事项。它是六个模型中唯一拼错标签的,并且在两个榜单上都是 Design Arena 评分最低的模型。将它用于画面中没有可读文字的大批量工作。当产品名必须准确无误时,不要使用它。

OpenAI 的数字假设你未设置 quality。将其改为 high 会使我们账单中那一行乘以 35。Klein 没有 quality 设置,因此它的成本更容易预测,也没有可在需要更好结果时调高的设置。

在咖啡袋提示词上,两者分别为 $0.0135 和 $0.014,也就是一万张图像 $135 对 $140。到那时价格已不决定任何事,所以把你自己的提示词跑过两者,让输出决定。

关于 Klein 的一条操作说明。Black Forest Labs 在 Hugging Face 上发布其权重,仓库名为 black-forest-labs/FLUX.2-klein-4B,而不是使用我们 slug 的大小写。你现在可以通过我们调用它,之后再迁移到内部,而无需改变你所围绕构建的模型家族。

画面中的文字

当模型把产品名弄乱时,包装、UI 模型图、幻灯片和海报就会失败。

我们测试的六款模型中有五款无需任何帮助就能处理两行标签,所以按成本和风格来选,然后拿你自己的文字而不是我们的文字去核对结果。

black-forest-labs/flux.2-flex 正确渲染了我们的标签,每张图收费 $0.05,并且最多可接受八张参考图。如果你已经在用 FLUX.2,而且文字很重要,那它就是你应该迁移到的 FLUX.2 模型。如果你没有绑定某个系列,openai/gpt-image-2 以大约四分之一的价格完成了同样的工作。

在最终决定之前,看看 recraft/recraft-v4.1-vector,它用不同的方式解决了这个问题。它返回的是 SVG 而不是像素,其端点接受 style、controls 和 text_layout 作为 provider.options 下的透传参数。对于需要缩放并保持可编辑的 logo 或标签,矢量输出胜过更锐利的位图,而每张图 $0.08 就能得到一个可以在设计工具中打开的文件。

参考图一致的品牌素材

在这里,同一个物体在它出现的每个地方都必须看起来一样。产品页面上的瓶子和广告图中的同一个瓶子不应该出现偏差。

我们测试了这一点。我们拿 openai/gpt-image-2 已经做好的咖啡袋,把它作为 input_references 图片发回去,并要求四款模型在保留袋子及其印刷标签完全不变的同时,把白色背景替换为暖色侧光下的深胡桃木台面。

One source image of a black coffee bag on white, followed by four edited outputs from openai/gpt-image-2, black-forest-labs/flux.2-pro, google/gemini-3-pro-image, and sourceful/riverflow-v2.5-pro. Each output shows the same bag on a wooden counter with the label text preserved, and each is labelled with the measured cost of the edit.

图 3。一张源图,一条指令,四款模型,以及每次编辑的实测成本。

四款模型都保留了文字和字体。四款模型也都在某种程度上改变了袋子的形状、比例或光照,而且没有一款逐像素复现了源袋子,所以如果一次广告活动中的每张图都必须匹配某一张主视觉图,那就把输出与源图对比,而不是只看标签。

为了公平地比较编辑与生成,我们也用编辑指令作为提示词跑了生成这一侧,因此两列来自相同的文字。这一点很重要,因为这些模型中有两款按 token 计费,提示词越长,账单本身就越高。

模型生成编辑
openai/gpt-image-2$0.0133$0.0142
black-forest-labs/flux.2-pro$0.0300$0.0450
google/gemini-3-pro-image$0.1345$0.1356
sourceful/riverflow-v2.5-pro$0.0646$0.0760

black-forest-labs/flux.2-pro 的编辑费用高出一半。它的编辑响应报告了 4,096 个提示词 token,而生成响应报告了 34 个,这就是参考图被计为输入,而且它的端点只列出了输出百万像素的费率,所以仅凭列出的费率无法预测编辑价格。sourceful/riverflow-v2.5-pro 的编辑费用高出 18%。在 openai/gpt-image-2 和 google/gemini-3-pro-image 上,差距不到 7%。这些都是单次运行,所以请把小的差距视为近似值,而不是精确的溢价。

有两个数字可以缩小编辑模型的选择范围,即模型接受多少张参考图,以及它在 Design Arena 图像编辑榜上的评分。

black-forest-labs/flux.2-pro 接受八张参考图,生成收费 $0.03,编辑收费 $0.045。black-forest-labs/flux.2-max 提供同样的八张参考图,每张生成图 $0.07。

如果你的品牌素材超过八张图,FLUX.2 就无法接受。Gemini 3.x 图像模型和 Seedream 5.0 接受十四张,OpenAI 图像模型接受十六张。Grok 上限为三张。

同时包含图片和文字的回复

有时用户正在进行对话,答案应该包含一张图片和一段文字说明。我们目录中有九款图像模型将文本列为其输出模态之一,它们就是能做到这一点的模型。它们是 Gemini 图像模型和 OpenAI 的 gpt-5-image 模型。

能够返回文本和实际做到是两回事。我们选取了这九个中的四个,通过聊天补全端点用 modalities: ["image", "text"] 向每个模型发送相同的请求,要求提供一张图片外加两句话的解释,并统计我们同时得到两者的频率。这些成本高于成本表中相同模型的数字,因为回复携带文本,而在按 token 计费的模型上,两者都要付费。

模型回复带文本每次调用成本
openai/gpt-5-image3 次中 2 次$0.20 至 $0.28
google/gemini-3-pro-image3 次中 3 次$0.138 至 $0.140
google/gemini-3.1-flash-image4 次中 1 次$0.067
google/gemini-3.1-flash-lite-image2 次中 0 次$0.034

这些调用中的每一次都至少返回了一张图片。google/gemini-3-pro-image 每次调用返回两张图片。差异在于文字那一半,而两个更便宜的 Gemini 模型大多跳过了它,尽管提示词直接要求了它。

如果文本是可选的,google/gemini-3.1-flash-image 以 $0.067 可用,你处理空的情况即可。如果你的产品没有文本就会出问题,google/gemini-3-pro-image 约 $0.139 是四个模型中唯一在我们的运行中每次都回复文本的。

我们建议新的图像工作使用专用的 Image API 而非聊天补全,因为新的图像模型只添加到 Image API,而聊天路径给你的参数更少。openai/gpt-5-image 也是这里最贵的选项,每次调用 $0.20 至 $0.28,并且它在三次调用中有两次返回了文本。这些聊天调用在图像之外还计费提示词和补全 token,因此长指令和长回答的成本高于按图像计算的数字。

三项任务,两个端点

生成、编辑和聊天看起来相似,但它们是不同的请求。生成和编辑使用 images 端点,仅相差一个字段。聊天则改用聊天补全端点,只有上面九个具备文本能力的模型才能做到。我们的 OpenRouter 上的图像生成模型教程涵盖了这两个端点的完整请求和响应契约。

Diagram of three request shapes. Generate and edit both go to POST /api/v1/images, and edit adds an input_references array. Chat goes to POST /api/v1/chat/completions. The Image API response carries data[].b64_json, data[].media_type, and usage.cost. The chat response carries message.content and message.images.

图 4。生成和编辑是同一个端点,只是请求体不同。聊天是另一个端点。

生成是 POST /api/v1/images 加上 model 和 prompt。你得到图像字节作为返回。

编辑是同一个端点加上 input_references,因为你是在修改已有的图像,而不是制作新的。

聊天向 POST /api/v1/chat/completions 发送一个 messages 数组。文本和图像输入,文本和图像可以返回。

在 OpenRouter 上调用

images 路由是 POST https://openrouter.ai/api/v1/images。唯一必填的字段是 model 和 prompt。

curl https://openrouter.ai/api/v1/images \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "black-forest-labs/flux.2-klein-4b",
    "prompt": "A studio packshot of a glass bottle, hard key light, no text.",
    "aspect_ratio": "1:1"
  }'

响应包含图像及其成本。这是我们在 2026 年 9 月 11 日收到的该请求的响应,已裁剪至本文讨论的字段并移除了图像字节。

{
  "data": [
    {
      "b64_json": "<base64>",
      "media_type": "image/jpeg"
    }
  ],
  "usage": {
    "prompt_tokens": 16,
    "completion_tokens": 4096,
    "total_tokens": 4112,
    "cost": 0.014,
    "completion_tokens_details": {
      "image_tokens": 4096
    }
  }
}

要改为编辑图像,向同一个请求体添加一个 input_references 数组。每个条目是一个 image_url 对象,携带 HTTP(S) URL 或 base64 数据 URL。

{
  "model": "black-forest-labs/flux.2-pro",
  "prompt": "Keep the bag and its printed label exactly as they are. Replace the white background with a dark walnut counter under warm side light.",
  "aspect_ratio": "1:1",
  "input_references": [
    {
      "type": "image_url",
      "image_url": {
        "url": "data:image/png;base64,<base64>"
      }
    }
  ]
}

我们的 TypeScript SDK 封装了相同的路由并将字段名转为驼峰式,因此 b64_json 变为 b64Json,media_type 变为 mediaType,aspect_ratio 变为 aspectRatio。generate 方法的返回类型也覆盖了流式情况,因此在读取之前先对 data 属性进行收窄。

import { OpenRouter } from '@openrouter/sdk';

const openRouter = new OpenRouter({ apiKey: process.env.OPENROUTER_API_KEY ?? '' });

const result = await openRouter.images.generate({
  imageGenerationRequest: {
    model: 'black-forest-labs/flux.2-klein-4b',
    prompt: 'A studio packshot of a glass bottle, hard key light, no text.',
    aspectRatio: '1:1',
  },
});

if (!('data' in result)) {
  throw new Error('Expected a non-streaming image response');
}

const image = result.data[0]?.b64Json;
const mediaType = result.data[0]?.mediaType;
const cost = result.usage?.cost;

常见问题

2026 年最好的图像生成模型是什么?

没有单一的最佳模型,因此要按任务来选择。在我们 2026 年 9 月 11 日的测试中,openai/gpt-image-2 是我们测得最便宜的模型,根据提示词长度不同,每张图像收费 0.006 至 0.0135 美元,并且它正确渲染了两行标签和一次参考编辑。sourceful/riverflow-v2.5-pro 在 Design Arena 图像和图像编辑榜单上领先,每张图像收费 0.064 美元。recraft/recraft-v4.1-vector 以每张图像 0.08 美元的价格返回可编辑的 SVG。

OpenRouter 上最便宜的图像生成模型是哪个?

在我们以 1024x1024 默认设置测量的 20 个模型中,openai/gpt-image-2 收费最低,一行提示词为 0.006 美元。black-forest-labs/flux.2-klein-4b 收费 0.014 美元,sourceful/riverflow-v2.5-fast 收费 0.0176 美元。在按 token 计费的模型上,提示词长度会改变账单,而在 OpenAI 模型上,quality 设置将同一张图像的费用从 0.006 美元变为 0.211 美元。

哪些图像模型可以编辑现有图像?

任何端点列出 input_references 的模型都通过 POST /api/v1/images 接受参考图像。限制因模型而异。2026 年 9 月 11 日,OpenAI 图像模型接受 16 张,Gemini 3.x 图像模型和 Seedream 5.0 接受 14 张,sourceful/riverflow-v2.5-pro 接受 10 张,FLUX.2 Flex、Pro 和 Max 接受 8 张,FLUX.2 Klein 和 Qwen Image 3 接受 4 张,Grok Imagine 接受 3 张,Recraft、Krea 和 MAI Image 接受 1 张。请阅读 GET /api/v1/images/models/{model}/endpoints 获取当前值。

哪些图像模型可以同时回复文本和图像?

输出模态包含文本的模型。2026 年 9 月 11 日,这在我们目录中的 52 个图像模型里有九个,即所有 Gemini 图像模型和 OpenAI gpt-5-image 模型。通过 POST /api/v1/chat/completions 调用它们。在我们的测试中,google/gemini-3-pro-image 在 3 次调用中有 3 次返回文本,openai/gpt-5-image 在 3 次中有 2 次,google/gemini-3.1-flash-image 在 4 次中有 1 次,google/gemini-3.1-flash-lite-image 在 2 次中有 0 次。

Image API 返回什么图像格式?

这取决于模型。在我们的测试中,FLUX.2、Grok 和 Seedream 返回 JPEG,OpenAI、Qwen、Microsoft 和 Krea 返回 PNG,Sourceful 和 Recraft 返回 WebP,而 recraft/recraft-v4.1-vector 返回 SVG。目录中有十多个模型接受 output_format 参数。请阅读每个响应上的 media_type 字段,而不是假设文件扩展名。

来源:OpenRouter Blog · openrouter.ai