Skip to main content
Qwen-Image-3.0 支持最大 4.5k token 输入,支持图中图密集信息排版,让报纸、分镜、菜单、试卷等复杂版面一次生成。 细节真实:支持 10px 小字精准渲染,微表情、毛孔、发丝等细节生动还原,逼近真实摄影的质感。知识厚实:支持 12 国语言、20+ 字体原生渲染,主流网页、游戏、直播等界面仿真,外部知识全纳入。 Qwen-Image-3.0-Pro 不只是在追求”好看”,更在追求“好用”——让图像生成真正成为可落地的生产力工具。

模型参数

不支持画图 API 中的以下参数:
  • strength
  • aspect_ratio
  • quality
  • style_preset
  • response_format
  • output_format
  • mask
  • background
附:千问图像生成与编辑 3.0 官方 API 文档
支持通过 size 字段实现输出图像的分辨率,格式为宽x高,例如”1024x1024”,未指定时由模型根据提示词自动推荐分辨率:
  • 文生图(T2I):像素面积范围 512x5122048x2048 之间的任意尺寸,宽高比限制 1:88:1
  • 图生图(I2I):像素面积范围 512x5122048x2048 之间的任意尺寸,宽高比限制 1:88:1
极客智坊支持通过 enhance_prompt 字段替代官方的 prompt_extend 对提示词进行自动优化,增强后的提示词会在原始提示词的基础上进行优化,提升生成图像的质量和细节表现。 支持通过 n 字段指定生成图像的数量,最大支持 6 张,默认值为 1 张。 图生图场景支持通过 image 字段传入参考图,支持 URL 或 Base64 编码的图片数据,最大支持 3 张,多张图片通过数组传递即可。图像要求如下:
  • 支持的图片格式:PNG、JPG、JPEG、WEBP;
  • 图片大小限制:单张图片不超过 10MB;
  • 图片分辨率:建议图像的宽和高均在384像素至2048像素之间。

模型价格

和 GPT-Image-2 类似,Qwen-Image-3.0 支持 512x5122048x2048 的任意分辨率图片生成,不同分辨率对应的价格不同,以下是价格表: 不同于 GPT-Image-2 按 tokens 计费,Qwen-Image-3.0 按图片宽高总像素对输出图片分档次计费,以图片总像素2250000像素为分界线,超过该像素的图片按 2K 分辨率计费,低于(含)该像素的图片按 1K 分辨率计费。 qwen-image-3.0 1K 和 2K 分辨率价格一样,qwen-image-3.0-pro 2K 分辨率价格是 1K 的 2 倍。两个模型都对输入的参考图计费,单价为 0.02 元/张。

文生图

通过给模型提供清晰准确的文字指令,即可快速获得符合描述的高质量图片:
响应是一个包含生成图片的 URL 和 Base64 编码图片数据的 JSON 对象:
这里 billed_units 表示生成图片的计费数量,output_image_type 表示输出图片的分辨率类型,qima_output_1k 表示输出图片的分辨率为 1K,qima_output_2k 表示输出图片的分辨率为 2K。

图生图

单图 通过 image 传入单图即可实现基于参考图生成图像或者图片编辑:
响应是一个包含生成图片的 URL 和 Base64 编码图片数据的 JSON 对象:
多图 通过 image 传入多图即可实现基于多张参考图生成图像: