跳转到主要内容
通用的图像生成与编辑技能,支持 OpenAI、Gemini、Seedream(火山方舟)、Qwen(百炼)、MiniMax、LinkAI 共六家厂商。配好任意一家的 Key 即可使用,配多家可享受自动回退。

支持的模型

模型选择

默认走「自动路由 + 失败回退」:
  1. OpenAI → Gemini → Seedream → Qwen → MiniMax → LinkAI 顺序选第一个已配置的厂商
  2. 遇到 401、模型未开通、网络异常等错误时,自动切到下一家
  3. 用户在对话里指定模型时(如「用 seedream 画一只猫」),对应厂商会被提到最前优先尝试
如需固定使用某个模型:

配置 API Key

推荐通过 Web 控制台 的「模型管理」页面配置,配好的对话模型 Key 会被图像生成技能自动复用,无需重复配置。也可手动编辑配置文件或在对话中通过 env_config 工具临时设置。
凭证统一复用主模型厂商的 Key:

开启和关闭

技能会根据 API Key 自动调整状态:
  • 已配置 Key:Agent 收到画图请求时直接调用
  • 未配置 Key:技能仍会出现在上下文中(标记为「需要配置」),Agent 会引导用户去配 Key
如需手动控制:
终端等价命令:cow skill disable image-generation / cow skill enable image-generation

参数

质量越高、分辨率越大,耗时和成本越高。 日常对话用默认(auto)或 quality=low + size=1K 即可,约 20 秒出图;做海报或明确要高清时再上 high + 2K/4K,可能需要 1–5 分钟。

常见用法

  • 文生图:根据描述生成插画、海报、图标、头像、分镜图等
  • 图生图:在已有图片上改风格、换元素、加装饰、加文字等
  • 多图融合:把多张参考图合成一张(换装、角色合影等)
  • bash 超时建议设 600 秒:单厂商 HTTP 超时 300 秒,脚本可能依次尝试多家
  • 输入图片自动压缩到 4MB 以内、最长边不超过 4096px
  • Gemini / Seedream / Qwen / MiniMax 不支持 quality 参数
  • Seedream 默认出 2K 图;seedream-5.0-lite 支持到 3K,seedream-4.5 支持到 4K