希望在 Claude Code、Codex 等 Agent 工具中通过自然语言生图、编辑图片或融合多张参考图,可以使用 NoneLinear 生图 Skill

参数表

qwen-image-2.0qwen-image-2.0-proqwen-image-3.0qwen-image-3.0-pro 官方参数支持 n=1~6。NoneLinear 透传实测中,n=2 请求可能只返回 1 个图片 URL,业务侧请以实际响应中的 data 数组长度为准。

cURL 调用示例

图像生成接口为同步返回:客户端发起请求后,服务端会等待图片生成完成,并在同一个响应中返回图片 URL。生成耗时可能较长,建议设置较长的 --max-time OpenAI gpt-image-2:文生图,使用 size 控制输出尺寸
OpenAI gpt-image-2:图片编辑,使用 image 传入参考图,并使用 size 控制输出尺寸
OpenAI gpt-image-2:生成透明背景 PNG gpt-image-2 支持通过 background: "transparent" 生成带 Alpha 通道的透明背景图片。为了更稳定地获得真正透明的 PNG,请求参数和提示词中都需要明确指定透明背景
生成透明背景图片时,请同时满足以下要求:
  • 请求体设置 "background": "transparent"
  • 提示词明确写出“透明背景”,并排除白色背景、场景背景、地面和投影
  • 设置 "output_format": "png",确保输出格式支持 Alpha 透明通道
只在提示词中要求透明背景,可能生成白色实心背景;只设置 background: "transparent",也可能出现部分背景未完全透明的情况。参数与提示词同时指定时,透明背景的生成效果更稳定。
background 参数支持以下取值:
gpt-image-2 尺寸说明gpt-image-2size 参数支持任意满足约束的分辨率,方图通常生成速度最快。常用尺寸:
  • 1024x1024:方图
  • 1536x1024:横图
  • 1024x1536:竖图
  • 2048x2048:2K 方图
  • 2048x1152:2K 横图
  • 3840x2160:4K 横图
  • 2160x3840:4K 竖图
  • auto:默认值
尺寸约束:
  • 最大边长不超过 3840px
  • 宽和高都必须是 16px 的倍数
  • 长边与短边比例不超过 3:1
  • 总像素不少于 655360,不超过 8294400
quality 使用说明quality 参数仅适用于 gpt-image-2,其他生图模型不支持该参数。调用 gpt-image-2 时,可以通过 quality 控制图片的渲染质量;将其添加到请求体中,与 modelprompt 等参数同级。切换为其他生图模型时,请移除该参数。支持以下取值:
  • low:生成速度最快,适合草稿、缩略图和快速迭代
  • medium:兼顾生成质量、速度和费用
  • high:提供更高的渲染质量,适合生成最终成品
  • auto:由模型根据提示词自动选择,默认值
Python 请求体示例:
质量档位越高,通常生成耗时、输出 Token 数量和费用也会相应增加。
Google gemini-2.5-flash-image(Nano Banana):使用 aspect_ratio 控制画面比例
Google gemini-3.1-flash-image-preview(Nano Banana 2):使用 aspect_ratio + size 控制比例和清晰度
Google gemini-3-pro-image-preview(Nano Banana Pro):使用 aspect_ratio + size 控制比例和清晰度
Google Gemini 图片生成注意事项Google Gemini 图片生成偶发会返回未出图结果,调用方需要判断响应中是否实际包含图片 URL 或 base64 图片内容。常见情况:
  • IMAGE_RECITATION:Google 官方定义为图片生成因 recitation 停止,通常不会返回图片结果。
  • NO_IMAGE / 空图片结果:Google 官方定义为期望生成图片,但未生成图片。实际响应中可能表现为 data: [],或只返回文本说明但没有图片 payload。
示例:
建议调用方以 data[0].urldata[0].b64_json 是否存在作为出图成功判断;如果 data 为空,或只有文本没有图片内容,应按未出图处理。对于 IMAGE_RECITATION,建议调整 prompt 后重试;对于普通空图片结果,可按业务需要进行重试。Google 官方说明: https://ai.google.dev/api/generate-content#FinishReason

1、豆包seedream

模型ID: doubao-seedream-4-0-250828, doubao-seedream-4-5-251128, doubao-seedream-5-0-pro-260628 参数size使用区别:
  • doubao-seedream-4-0-250828:支持 1K2K4K,默认 2K;也支持传入上文参数表中的像素尺寸。
  • doubao-seedream-4-5-251128:支持 2K4K,默认 2K;不支持 1K,也支持传入上文参数表中的像素尺寸。
  • doubao-seedream-5-0-pro-260628:支持 1K2K,默认 2K;不支持 4K。如需 4K 输出,请使用支持 4K 的 Seedream 4/4.5 模型。Seedream 5.0 Pro 不使用 aspect_ratio 参数,如需横图或竖图,可以使用像素尺寸,或在 prompt 中明确描述构图。
doubao-seedream-5-0-pro-260628 支持文生图、单图编辑和多图融合。与 Seedream 4/4.5 相比,Seedream 5.0 Pro 可额外使用 output_formatoptimize_prompt_options,但不支持 sequential_image_generation 组图参数。Seedream 5.0 Pro 常用补充参数:
  • output_format:可选,支持 pngjpeg
  • watermark:可选,false 表示不添加水印。
  • optimize_prompt_options.mode:可选,支持 standardfaststandard 更偏质量和完整优化,fast 更适合快速预览。
图片输入限制:
  • 图片格式:jpeg、png、webp、bmp、tiff、gif
  • 宽高比(宽/高)范围:[1/16, 16]
  • 宽高长度(px) > 14
  • 大小:不超过 10 MB
  • 总像素:不超过 6000×6000 px
  • Seedream 4/4.5 最多支持传入 14 张参考图;Seedream 5.0 Pro 最多支持传入 10 张参考图。
(1)文生图(纯文本输入单图输出) 通过文字描述来生成对应图像。
Seedream 5.0 Pro cURL 示例:文生图
如需更快预览,可以将 optimize_prompt_options.mode 改为 fast,也可以将 output_format 改为 jpeg
(2)【图片编辑】图文生图(单图输入单图输出) 基于已有图片,结合文字指令进行图像编辑,包括图像元素增删、风格转化、材质替换、色调迁移、改变背景/视角/尺寸等。 如果是本地图片,可以先上传到官方服务器,操作指南:文件上传API
Seedream 5.0 Pro cURL 示例:单图编辑
也可以在 prompt 中使用 <point> 指定编辑位置:
(3)【图片编辑】多图融合(多图输入单图输出) 根据您输入的文本描述和多张参考图片,融合它们的风格、元素等特征来生成新图像。如衣裤鞋帽与模特图融合成穿搭图,人物与风景融合为人物风景图等。 不指定 sequential_image_generation,或配置为 disabled 如果是本地图片,可以先上传到官方服务器,操作指南:文件上传API
Seedream 5.0 Pro cURL 示例:多图融合
也可以使用 <bbox> 在多张参考图中指定局部区域:
(4)组图输出(多图输出)
doubao-seedream-5-0-pro-260628 不支持 sequential_image_generation 组图参数。以下组图示例请使用支持组图的豆包 Seedream 4/4.5/Lite 系列模型。
支持通过一张或者多张图片 and 文字信息, 生成漫画分镜、品牌视觉等一组内容关联的图片。 文生组图
【图片编辑】单张图生组图 如果是本地图片,可以先上传到官方服务器,操作指南:文件上传API
【图片编辑】多参考图生组图 如果是本地图片,可以先上传到官方服务器,操作指南:文件上传API

2、谷歌nano banana、OpenAI DALLE/GPT、阿里千问qwen/wan、智谱glm/cogview、快手可灵kling/Kolors、MiniMax、flux、riverflow、谷歌imagen、StableDiffusion、阶跃星程step、vidu、lumaAI、Reve

(1)文生图(纯文本输入单图输出) 通过文字描述来生成对应图像。 【模型ID】:
  • 谷歌nano banana: gemini-2.5-flash-image(Nano Banana)gemini-3-pro-image-preview(Nano Banana pro)gemini-3.1-flash-image-preview(Nano Banana 2)
  • OpenAI: dall-e-2, dall-e-3-hd, dall-e-3-standard, gpt-image-1-high, gpt-image-1-medium, gpt-image-1-low, gpt-image-1-mini-high, gpt-image-1-mini-medium, gpt-image-1-mini-low, gpt-image-2, gpt-image-1.5-high, gpt-image-1.5-medium, gpt-image-1.5-low
  • 千问qwen: qwen-image-3.0, qwen-image-3.0-pro, qwen-image-2.0, qwen-image-2.0-pro, Qwen-Image, qwen-image-max, qwen-image-plus
  • 千问wan: wan2.7-image, wan2.7-image-pro, wan2.6-t2i, wan2.5-t2i-preview, wan2.2-t2i-plus, wan2.2-t2i-flash, wanx2.1-t2i-plus, wanx2.1-t2i-turbo, wanx-v1, z-image-turbo
  • 智谱: glm-image, cogview-4-250304, cogview-4, cogview-3-flash
  • 快手可灵: kling-image-o1, kling-v2-1, kling-v2, kling-v1-5, kling-v1, Kolors
  • MiniMax: minimax-image-01, minimax-image-01-live
  • flux: flux.2-klein-4b, flux.2-max, flux.2-flex, flux.2-pro
  • riverflow: riverflow-v2-max-preview, riverflow-v2-standard-preview, riverflow-v2-fast-preview
  • 谷歌imagen: imagen-4.0-generate-001, imagen-4.0-ultra-generate-001, imagen-4.0-fast-generate-001
  • StableDiffusion: Stable-Image-Ultra, Stable-Diffusion-3.5-Large, Stable-Diffusion-3.5-Large-Turbo, Stable-Diffusion-3.5-Medium, Stable-Diffusion-3.5-Flash, Stable-Image-Core
  • 阶跃星程step: step-1x-medium, step-2x-large
  • vidu: viduq2
  • lumaAI: uni-1, uni-1-max
  • Reve: reve-create-latest
(2)【图片编辑】图文生图(单图输入单图输出) 基于已有图片,结合文字指令进行图像编辑,包括图像元素增删、风格转化、材质替换、色调迁移、改变背景/视角/尺寸等。 如果是本地图片,可以先上传到官方服务器,操作指南:文件上传API 【模型ID】:
  • 谷歌nano banana: gemini-2.5-flash-image(Nano Banana)gemini-3-pro-image-preview(Nano Banana pro)gemini-3.1-flash-image-preview(Nano Banana 2)
  • OpenAI: gpt-image-1-high, gpt-image-1-medium, gpt-image-1-low, gpt-image-1-mini-high, gpt-image-1-mini-medium, gpt-image-1-mini-low, gpt-image-2, gpt-image-1.5-high, gpt-image-1.5-medium, gpt-image-1.5-low
  • 千问qwen: qwen-image-3.0, qwen-image-3.0-pro, qwen-image-2.0, qwen-image-2.0-pro, Qwen-Image-Edit, qwen-image-edit-max, qwen-image-edit-plus
  • 千问wan: wan2.7-image, wan2.7-image-pro, wanx-v1, wan2.6-image, wan2.5-i2i-preview, wanx2.1-imageedit
  • qwen-mt-image:通义千问-图像翻译模型,支持中/英文与其他语种之间的互译,但不支持在非中/英语种之间直接翻译(例如,从日语翻译为韩语)。详情请参见 支持的语种
  • MiniMax: minimax-image-01, minimax-image-01-live
  • flux: flux.2-klein-4b, flux.2-max, flux.2-flex, flux.2-pro
  • riverflow: riverflow-v2-max-preview, riverflow-v2-standard-preview, riverflow-v2-fast-preview
  • 快手可灵: kling-image-o1, kling-v2-new, kling-v2, kling-v1-5, kling-v1
  • 阶跃星程step: step-1x-edit
  • vidu: viduq1, viduq2
  • lumaAI: uni-1(参考生图image_ref), uni-1-max(参考生图image_ref), uni-1-edit, uni-1-max-edit
  • Reve: reve-edit-latest
(3)【图片编辑】多图融合(多图输入单图输出) 根据您输入的文本描述和多张参考图片,融合它们的风格、元素等特征来生成新图像。如衣裤鞋帽与模特图融合成穿搭图,人物与风景融合为人物风景图等。 如果是本地图片,可以先上传到官方服务器,操作指南:文件上传API 【模型ID】:
  • 谷歌nano banana: gemini-2.5-flash-image(Nano Banana)gemini-3-pro-image-preview(Nano Banana pro)gemini-3.1-flash-image-preview(Nano Banana 2)
  • OpenAI: gpt-image-1-high, gpt-image-1-medium, gpt-image-1-low, gpt-image-1-mini-high, gpt-image-1-mini-medium, gpt-image-1-mini-low, gpt-image-2, gpt-image-1.5-high, gpt-image-1.5-medium, gpt-image-1.5-low
  • 千问qwen: qwen-image-3.0, qwen-image-3.0-pro, qwen-image-2.0, qwen-image-2.0-pro, qwen-image-edit-max, qwen-image-edit-plus
  • 千问wan: wan2.7-image, wan2.7-image-pro, wan2.5-i2i-preview, wan2.6-image
  • flux: flux.2-klein-4b, flux.2-max, flux.2-flex, flux.2-pro
  • riverflow: riverflow-v2-max-preview, riverflow-v2-standard-preview, riverflow-v2-fast-preview
  • 快手可灵: kling-image-o1, kling-v2-1, kling-v2
  • vidu: viduq1, viduq2
  • lumaAI: uni-1(参考生图image_ref), uni-1-max(参考生图image_ref)
  • Reve: reve-remix-latest
谷歌nano banana aspect_ratio对应分辨率: