Skip to main content
通义千问-文生图模型(Qwen-Image)是一款通用图像生成模型,支持多种艺术风格,尤其擅长复杂文本渲染。模型支持多行布局、段落级文本生成以及细粒度细节刻画,可实现复杂的图文混合布局设计。 通义-文生图-Z-Image 是一款轻量级文生图模型,可快速生成图像,支持中英文字渲染,并灵活适配多种分辨率与宽高比例。

模型参数

  • 模型 ID:qwen-image/qwen-image-plus/z-image-turbo
  • 模型价格:你可以在模型广场查看最新价格信息
  • 调用入口:https://geekai.co/api/v1/images/generations
  • 模型参数:参考画图 API 手册
  • API 认证:获取 API KEY
不支持画图 API 中的以下参数:
  • image
  • strength
  • aspect_ratio
  • quality
  • style_preset
  • response_format
  • output_format
  • mask
  • background
附:千问文生图官方 API 文档
千问文生图 可以通过 size 字段实现输出图像的分辨率: 可选的分辨率及其对应的图像宽高比例为:

文生图

qwen-image 通过给模型提供清晰准确的文字指令,即可快速获得符合描述的高质量单张图片:
响应是一个 JSON 对象,包含生成图片的 URL:
z-image-turbo Z-Image 不支持的参数除了上述之外,还包括 negative_prompt,watermark 总像素为 1024x1024 的推荐分辨率: 总像素为 1280x1280 的推荐分辨率: 总像素为 1536x1536 的推荐分辨率: 总像素在[512x512, 2048x2048]之间,推荐分辨率范围在 [1024x1024, 1536x1536]之间,出图效果更佳
响应是同上述的 qwen-image 一样,是一个 JSON 对象,包含生成图片的 URL。