logo
logo
请输入关键词搜索产品或者文档
中国

中国站

创蓝云智

国际站

Innopaas

图片生成

更新时间:2026-09-14 19:54:04

基础信息

通用请求头

{
  "Content-Type": "application/json",
  "Authorization": "Bearer sk-xxx"
}

doubao-seedream 格式

基础请求

端点:POST https://router.253.com/v1/images/generations

curl --location --request POST 'https://router.253.com/v1/images/generations' \
--header 'Authorization: Bearer sk-xxxxxx' \
--header 'Content-Type: application/json' \
--data-raw '{
    "model": "doubao-seedream-5-0-pro",
    "prompt": "小男孩在电脑前写代码,父亲在旁边玩游戏机,漫画风",
    "sequential_image_generation": "disabled",
    "size": "2K",
    "response_format": "url",
    "watermark": false
  }'

请求参数

参考火山官网

参数名类型必填说明
modelstring模型 ID,支持doubao-seedream-5-0-pro,doubao-seedream-5-0-lite,doubao-seedream-4-5,doubao-seedream-4-0
promptstring用于生成图像或指定图层拆分意图的提示词。
说明
- 提示词语言支持 :所有模型均支持中英文提示词;
- Seedream 5.0 pro 额外支持俄语、阿拉伯语、菲律宾语、泰语、土耳其语、韩语、马来语、西班牙语、葡萄牙语、印尼语、法语、德语、越南语、日语。
- 提示词字数建议 :中文提示词不超过 300 字,英文提示词不超过 600 词。字数过多信息容易分散,模型可能因此忽略细节,只关注重点,造成图片缺失部分元素。
imagestring / string[]输入的图片信息,支持 URL 或 Base64 编码。
- 图片 URL:请确保图片 URL 可被访问。
- Base64 编码:请遵循此格式 data:image/<图片格式>;base64,<Base64 编码>。注意 <图片格式> 需小写,如 data:image/png;base64,<base64_image>。
layer_decompositionboolean控制是否开启图层拆分功能。默认值 false
图层拆分会将单张图片的主体、背景、文字等内容自动拆解为 1 张底图和最多 16 个可独立编辑的图层。每个图层为带透明通道的 PNG 图片。
- true:图层拆分模式。模型将输入图拆解为一张底图和多个图层。
- false:图片生成模式,不进行图层拆分。
模型支持
- Seedream 5.0 pro
sizestring
指定生成图像的尺寸信息。对于不同模型和不同场景,参数的配置方式、可选分辨率、默认值、总像素取值范围、宽高比取值范围不同,请展开以下各模型对应说明查看。
Seedream 5.0 pro(图片生成场景)
支持以下两种方式,不可混用:
- 方式 1(推荐):指定分辨率档位,并在 prompt 中用自然语言描述图片宽高比、图片形状或图片用途,最终由模型判断生成图片的大小。
- 默认值:2K
- 可选值:1K、1.5K、2K
- 方式 2:指定宽高像素值(宽x高)。
- 总像素取值范围:[1280x720(921600), 2048x2048x1.1025(4624220)]
- 宽高比取值范围:[1/16, 16]
Seedream 5.0 pro(图层拆分场景)
仅支持通过指定分辨率档位的方式设置。输出图的分辨率规则如下:
- 底图 :输出底图的分辨率和 size 指定的分辨率一致;输出底图和原待拆分图的宽高比一致。
- 各图层 :输出图层的分辨率和 size 指定的分辨率接近;每个输出图层和其在原图中的宽高比一致。
size 的默认值与可选值:
- 默认值:auto
- 可选值:1K、1.5K、2K、auto(根据输入图的尺寸和宽高比进行输出)
Seedream 5.0 lite
支持以下两种方式,不可混用:
- 方式 1:指定分辨率,并在 prompt 中用自然语言描述图片宽高比、图片形状或图片用途,最终由模型判断生成图片的大小。
- 可选值:2K、3K、4K
- 方式 2:指定生成图像的宽高像素值。
- 默认值:2048x2048
- 总像素取值范围:[2560x1440(3686400), 4096x4096(16777216)]
- 宽高比取值范围:[1/16, 16]
Seedream 4.5
支持以下两种方式,不可混用:
- 方式 1:指定分辨率,并在 prompt 中用自然语言描述图片宽高比、图片形状或图片用途,最终由模型判断生成图片的大小。
- 可选值:2K、4K
- 方式 2:指定生成图像的宽高像素值。
- 默认值:2048x2048
- 总像素取值范围:[2560x1440(3686400), 4096x4096(16777216)]
- 宽高比取值范围:[1/16, 16]
Seedream 4.0
支持以下两种方式,不可混用:
- 方式 1:指定分辨率,并在 prompt 中用自然语言描述图片宽高比、图片形状或图片用途,最终由模型判断生成图片的大小。
- 可选值:1K、2K、4K
- 方式 2:指定生成图像的宽高像素值。
- 默认值:2048x2048
- 总像素取值范围:[1280x720(921600), 4096x4096(16777216)]
- 宽高比取值范围:[1/16, 16]
optimize_prompt_optionsobjectoptimize_prompt_options.mode string 默认值 standard | 优化模式
设置提示词优化功能使用的模式。
- standard:标准模式,生成内容的质量更高,耗时较长。
- fast:快速模式,生成内容的耗时更短,效果略低于标准模式;Seedream 5.0 lite / 4.5 当前不支持。
output_formatstring指定生成图像的文件格式。可选值:
- png
- jpeg。
模型支持
- Seedream 5.0 pro
- Seedream 5.0 lite
backgroundstring用于控制是否生成带透明通道的图片。可选值:
- transparent:透明背景模式,输出带有透明背景的图。
- opaque:不透明背景模式,生成常规的实体背景图。
模型支持
- Seedream 5.0 pro
response_formatstring默认值 url,指定生成图像的返回格式。支持以下两种返回方式:
- url:返回图片下载链接, 链接在图片生成后 24 小时内有效,请及时下载图片
- b64_json:以 Base64 编码字符串的 JSON 格式返回图像数据。
sequential_image_generationstring默认值 disabled,控制是否关闭组图功能(组图:基于您输入的内容,生成的一组内容关联的图片)。
- auto:自动判断模式,模型会根据用户提供的提示词自主判断是否返回组图以及组图包含的图片数量。
- disabled:关闭组图功能,模型只会生成一张图。
模型支持
- Seedream 5.0 lite
- Seedream 4.5
- Seedream 4.0
sequential_image_generation_optionsobject组图功能的配置。仅当 sequential_image_generation 为 auto 时生效。
模型支持
- Seedream 5.0 lite
- Seedream 4.5
- Seedream 4.0
sequential_image_generation_options.max_images 指定本次请求,最多可生成的图片数量。取值范围 :[1, 15]
streamboolean默认值 false,控制是否开启流式输出模式。
- false:非流式输出模式,等待所有图片全部生成结束后再一次性返回所有信息。
- true:流式输出模式,即时返回每张图片输出的结果。在生成单图和组图的场景下,流式输出模式均生效。
模型支持
- Seedream 5.0 lite
- Seedream 4.5
- Seedream 4.0
toolsobject[]配置模型要调用的工具。
模型支持
- Seedream 5.0 lite
tools.type string 必选 | 指定使用的工具类型。
值有:web_search-》联网搜索功能。
watermarkboolean是否在生成的图片中添加水印。
- false:不添加水印。
- true:在图片右下角添加“AI 生成”字样的水印标识。

响应参数

参数名类型说明
createdinteger本次请求创建时间的 Unix 时间戳(秒)
modelstring本次请求使用的模型 ID(模型名称-版本)
dataobject[]输出图像的信息。不同任务场景返回字段有所区别,其中 url、b64_json、size、output_format 为公共返回字段。
- 组图生成场景,若某张图生成失败,额外返回该图片的错误信息(error)。
- 图层拆分场景,额外返回每个图层的叠放顺序(z_index)、名称(name)、描述(description)、边界框坐标(bounding_box)。
errorobject本次请求顶层错误信息。当整个请求未能生成任何图片时返回
**error.code 错误码,请参见 **错误码
error.message 错误消息
toolsobject[]工具调用列表
usageobject用量信息

通义千问格式

图片生成

基础请求

百炼qwen-image系列图片生成

端点:POST https://router.253.com/v1/images/generations

curl --location --request POST 'https://router.253.com/v1/images/generations' \
--header 'Authorization: Bearer sk-xxxxxx' \
--header 'Content-Type: application/json' \
--data-raw '{
    "model": "z-image-turbo",
    "input": {
      "messages": [
        {
          "role": "user",
          "content": [
            {`
              "text": "小男孩在电脑前写代码,父亲在旁边玩游戏机,漫画风"
            }
          ]
        }
      ]
    },
    "parameters": {
      "size": "1028*1028",
      "n": 1,
      "negative_prompt": "模糊,低清晰度,文字乱码,水印",
      "prompt_extend": true,
      "watermark": false
    },
    "response_format": "url"
  }'

请求参数

详情请 参考阿里官网

参数名类型必填说明案例
modelstring模型 ID,支持qwen-image-3.0-pro,qwen-image-3.0,qwen-image-2.0-pro,qwen-image-2.0-pro-2026-06-22,qwen-image-2.0-pro-2026-04-22,qwen-image-2.0-pro-2026-03-03,qwen-image-2.0,qwen-image-2.0-2026-03-03,qwen-image-max,qwen-image-max-2025-12-30,qwen-image-plus,qwen-image,z-image-turbo
input
object
input.messages object[] 必填
仅支持单轮对话。必须包含且只包含一条角色为 user 的消息。
input.messages.role enum<string> 必填
必须为 user
input.messages.content object[] 必填
消息内容数组,必须且只包含一个文本对象。
input.messages.content.text string 必填
描述目标内容、风格和构图的正向提示词。支持中英文。qwen-image-3.0 系列推荐不超过 4500 Token;qwen-image-2.0 系列上限为 1300 Token;其他模型为 800 Token。超出部分将自动截断。
示例:画面是一张竖幅户外人像摄影,左上方深蓝色招牌上以白色哥特体大字写着 Il Messaggero,招牌下方是报刊亭的玻璃展示窗,内部陈列着许多报纸与杂志封面。
JSON<br>"input": {<br> "messages": [<br> {<br> "role": "user",<br> "content": [<br> {<br> "text": "画面是一张竖幅户外人像摄影,整体从上到下呈现温暖的午后街景氛围。顶部左侧到上方大面积被深绿色藤蔓和橙色小花覆盖,花叶从建筑檐口自然垂落,受阳光照射的叶片呈黄绿色高光,阴影处则偏深绿,形成浓密而柔和的背景层次。左上至中上区域是一块深蓝色横向招牌,招牌表面较暗、略带磨砂质感,上面以白色哥特体大字写着 Il Messaggero,文字位于画面左侧偏上,部分被前景花叶轻微遮挡,字体高对比、带装饰性尖角和粗细变化。招牌下方是报刊亭或书报摊的玻璃展示窗,黑色金属框架将橱窗分隔成多个矩形区域,内部陈列着许多报纸、杂志和书刊封面,但大多因景深虚化和光线反射而难以辨读,形成浅色纸张与深色边框交错的背景纹理。画面右上方是强烈的逆光区域,阳光从街道尽头照入,背景建筑被虚化成米灰色块面,边缘柔和,呈现明显的浅景深效果。画面中部偏右是一名年轻成年女性的半身至膝上人像,她回头面向镜头微笑,身体略向右转,肩背朝向观者,姿态自然放松。她有长而浓密的黑色波浪卷发,发丝被逆光勾勒出金色轮廓光,发梢在右侧向外散开,显得轻盈蓬松。她肤色白皙,脸型柔和偏鹅蛋形,眉形细致,眼睛明亮,眼妆清透,睫毛明显,面部带有自然高光,唇部为柔和珊瑚红色,笑容露齿,表情亲切明朗。她佩戴小巧耳饰,身穿黑色细肩带露背连衣裙,面料颜色深黑、轮廓简洁,细肩带从肩部向背部延伸,背部线条清晰。画面下部偏左到中部,她双手抱着一束玫瑰花,花束体积较大,主要由橙色、杏色、粉色和浅桃色玫瑰组成,花瓣层层卷曲,边缘被阳光照亮,绿色叶片和长花茎从花束下方垂出,花束与黑色裙装形成鲜明色彩对比。右侧背景是一条被阳光照亮的城市街道,地面呈暖灰与金黄色调,远处建筑、街边设施和一个模糊的红色圆形交通标志位于右下远景,均因焦外虚化而只保留色块和轮廓。整张照片采用暖色胶片感处理,带有细腻颗粒、柔和对比和明显逆光边缘光,人物位于视觉焦点,背景报刊亭、花藤、街道和阳光共同营造出浪漫、明亮、都市漫步式的氛围。"<br> }<br> ]<br> }<br> ]<br> },<br>
parameters
object
图像生成参数。
parameters.negative_prompt string
描述不希望在图像中出现的内容。最多 500 个字符,超出部分自动截断。
parameters.size string 默认值 "2048*2048"
输出分辨率,格式为 宽*高
- qwen-image-3.0 系列:总像素在 512*512 到 2048*2048 之间,宽高比在 1:8 到 8:1 之间,不指定时由模型根据提示词自动推荐分辨率。
- qwen-image-2.0 系列:总像素在 512*512 到 2048*2048 之间,默认 2048*2048
- qwen-image-max:支持自定义分辨率(总像素在 512*512 到 2048*2048 之间)和固定尺寸。
- qwen-image-plus/image:仅支持固定尺寸。
qwen-image-max/plus/image 的固定尺寸:1664*928(16:9,默认)、1472*1104(4:3)、1328*1328(1:1)、1104*1472(3:4)、928*1664(9:16)。
parameters.n integer 默认值1
生成图像数量。默认值:1。
- qwen-image-3.0 / qwen-image-2.0 系列:1-6 张。
- qwen-image-max/plus 系列:固定为 1 张。
parameters.prompt_extend boolean 默认值true
启用提示词改写。true(默认):模型先优化提示词再生成;qwen-image-3.0 系列按 prompt_extend_mode 指定的方式改写。false:直接使用原始提示词。
parameters.prompt_extend_mode enum<string> 默认值"direct"
提示词改写方式。仅 qwen-image-3.0 系列支持。
- direct(默认):直接提示词增强(DPE),适用于大多数场景。
- agent:智能体提示词增强(APE),改写更精细,仅文生图支持。
可选值:direct,agent
parameters.watermark boolean 默认值false
在图像右下角添加 "Qwen-Image" 水印。默认值:false
parameters.seed integer
随机数种子。范围:[0, 2147483647]。相同种子可产生更一致(但不完全相同)的结果。若不指定,则使用随机种子。
JSON<br>"parameters": {<br> "negative_prompt": "",<br> "prompt_extend": true,<br> "watermark": false,<br> "size": "2048*2048"<br> }<br>

响应参数

参数名类型说明
createdinteger本次请求创建时间的 Unix 时间戳(秒)
data
object[]网关封装的返回结果图片,可以忽略,建议使用metadata 对象里的结果
metadata
objectmetadata.output.rewrite_status string
提示词改写状态。具体取值由请求是否开启改写以及改写执行结果决定。
metadata.output.choices object[]
生成结果列表。
metadata.output.choices.finish_reason string
stop 表示正常完成。
metadata.output.choices.message object
metadata.output.choices.message.role enum<string>
固定为 assistant
metadata.output.choices.message.content object[]
包含生成图像 URL 的响应内容数组。
metadata.output.choices.message.content.image string
生成图像的 URL(PNG 格式)。有效期 24 小时,请及时下载。
metadata.usage object
用量统计(仅统计成功结果)。字段随模型系列不同:qwen-image-3.0 系列返回 output_* / input_* 字段,其他系列返回 image_count / width / height

编辑图像

百炼qwen-image系列图片编辑

基础请求

端点:POST https://router.253.com/v1/images/``edits

curl --location --request POST 'https://router.253.com/v1/images/edits' \
--header 'Authorization: Bearer sk-xxxxx' \
--header 'Content-Type: application/json' \
--data-raw '{
    "model": "qwen-image-edit-plus",
    "input": {
        "messages": [
            {
                "role": "user",
                "content": [
                    {
                        "image": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/thtclx/input1.png"
                    },
                    {
                        "image": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/iclsnx/input2.png"
                    },
                    {
                        "image": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/gborgw/input3.png"
                    },
                    {
                        "text": "图1中的女生穿着图2中的黑色裙子按图3的姿势坐下"
                    }
                ]
            }
        ]
    },
    "parameters": {
        "negative_prompt": "",
        "watermark": false
    }
}'

请求参数

详细请参考阿里官网

参数名类型必填说明案例
modelstring模型名称。
可选值:qwen-image-3.0-pro,qwen-image-3.0,qwen-image-2.0-pro,qwen-image-2.0-pro-2026-06-22,qwen-image-2.0-pro-2026-04-22,qwen-image-2.0-pro-2026-03-03,qwen-image-2.0,qwen-image-2.0-2026-03-03,qwen-image-edit-max,qwen-image-edit-max-2026-01-16,qwen-image-edit-plus,qwen-image-edit-plus-2025-12-15,qwen-image-edit-plus-2025-10-30,qwen-image-edit
示例:qwen-image-3.0-pro
input
object
input.messages object[] 必填
仅支持单轮对话,messages 数组必须包含且仅包含一条 role 为 user 的消息。
input.messages.role enum<string> 必填
必须为 user
input.messages.content object[] 必填
消息内容数组,须包含 1 到 3 个图像对象和恰好 1 个文本对象。多图输入时,图像按位置引用(图像 1、图像 2、图像 3),输出图像的宽高比由最后一张图像决定。
input.messages.content.image string
输入图像,支持公开可访问的 URL(HTTP/HTTPS)或 Base64 编码字符串(格式:data:{mime_type};base64,{data})。支持的格式:JPG、JPEG、PNG、BMP、TIFF、WEBP、GIF(仅第一帧)。建议图像宽高在 384 到 3072 像素之间以获得最佳效果。最大文件大小:10 MB。
input.messages.content.text string
图像编辑指令,描述期望输出图像包含的元素和视觉特征。支持中英文,qwen-image-3.0 系列推荐不超过 4500 Token;qwen-image-2.0 系列上限为 1300 Token;其他模型为 800 Token。超出部分将自动截断。仅支持传入一条文本输入,不传或传入多条将报错。
JSON<br>"input": {<br> "messages": [<br> {<br> "role": "user",<br> "content": [<br> {<br> "image": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/thtclx/input1.png"<br> },<br> {<br> "image": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/iclsnx/input2.png"<br> },<br> {<br> "image": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/gborgw/input3.png"<br> },<br> {<br> "text": "图1中的女生穿着图2中的黑色裙子按图3的姿势坐下"<br> }<br> ]<br> }<br> ]<br> },<br>
parameters
objectparameters.n integer
生成图像的数量。默认值:1。
- qwen-image-3.0 / qwen-image-2.0 / qwen-image-edit-max / qwen-image-edit-plus 系列:1-6 张。
- qwen-image-edit:仅支持 1 张。
parameters.negative_prompt string
描述不希望出现在图像中的内容。支持中英文,最多 500 个字符,超出部分自动截断。
parameters.size string
输出分辨率,格式为 宽*高
- qwen-image-3.0 系列:总像素在 512*512 到 2048*2048 之间,宽高比在 1:8 到 8:1 之间,不指定时由模型根据提示词自动推荐分辨率。
- qwen-image-2.0 系列:总像素在 512*512 到 2048*2048 之间,默认与输入图像相同(多图请求以最后一张图像为准)。
- qwen-image-edit-max/plus:宽和高均在 [512, 2048] 范围内,默认约 1024*1024,宽高比与输入图像相近,自动调整为最近的 16 的倍数。
- qwen-image-edit:不支持此参数。
parameters.prompt_extend boolean默认值true
启用提示词优化。开启后模型将对编辑指令进行优化,当提示词描述不够详细时效果提升显著;qwen-image-3.0 系列按 prompt_extend_mode 指定的方式改写。qwen-image-edit 不支持此参数。
parameters.prompt_extend_mode enum<string> 默认值"direct"
提示词改写方式。仅 qwen-image-3.0 系列支持。
- direct(默认):直接提示词增强(DPE),适用于大多数场景。
- agent:智能体提示词增强(APE),仅文生图支持;图像编辑场景传入将返回 400 错误。
parameters.watermark boolean 默认值false
在图像右下角添加 "Qwen-Image" 水印。
parameters.seed integer
随机数种子,范围:[0, 2147483647]。相同的种子可生成较为一致(但不完全相同)的结果。不指定时使用随机种子。
parameters.size
推荐尺寸:1024*1024(1:1)、768*1152 / 1024*1536(2:3)、1152*768 / 1536*1024(3:2)、720*1280 / 1080*1920(9:16)、1280*720 / 1920*1080(16:9)。

响应参数

参数名类型说明
createdinteger本次请求创建时间的 Unix 时间戳(秒)
data
object[]网关封装的返回结果图片,可以忽略,建议使用metadata 对象里的结果
metadata
objectmetadata.output.rewrite_status string
提示词改写状态。具体取值由请求是否开启改写以及改写执行结果决定。
metadata.output.choices object[]
生成结果列表。
metadata.output.choices.finish_reason string
stop 表示正常完成。
metadata.output.choices.message object
metadata.output.choices.message.role enum<string>
固定为 assistant
metadata.output.choices.message.content object[]
包含生成图像 URL 的响应内容数组。
metadata.output.choices.message.content.image string
生成图像的 URL(PNG 格式)。有效期 24 小时,请及时下载。
metadata.usage object
用量统计(仅统计成功结果)。字段随模型系列不同:qwen-image-3.0 系列返回 output_* / input_* 字段,其他系列返回 image_count / width / height

响应示例

{
  "data": [],
  "created": 1786625861,
  "metadata": {
    "output": {
      "choices": [
        {
          "finish_reason": "stop",
          "message": {
            "content": [
              {
                "image": "https://dashscope-7c2c.oss-cn-shanghai.aliyuncs.com/7d/c0/20260813/82a15263/9924b81b-9a53-4fc6-ae37-92b7c0a3b435-1.png?Expires=1787231675&OSSAccessKeyId=LTAI5tKPD3TMqf2Lna1fASuh&Signature=ymmH6ZMU1ehZHYGOJNBMVIc1QSo%3D"
              }
            ],
            "role": "assistant"
          }
        }
      ]
    },
    "usage": {
      "height": 1248,
      "image_count": 1,
      "width": 832
    },
    "request_id": "a1cbcb6c-66e2-9f97-970d-da0b1b1a686a"
  }
}
24小时热线 400-9669-253