Qwen Image Gen

SkillMedia

Helps your agent write and refine image prompts for Qwen image generation, including edits, aspect ratios, and same-character series.

Available today. Use it from your connected AI after setup.

Add ahel to your AI once: Claude, ChatGPT, Cursor, Claude Code or Codex. Then ask it to use this.

Then ask your AI: use the Qwen Image Gen skill

About this skill

Write and refine image-generation prompts for Qwen-Image, distinguishing local edits from reference-subject creation, and handling same-character series, aspect ratios, and review against the original image. When the user asks to generate, connect to their existing Qwen image workflow. Not for downl

What this skill tells your AI

The instructions your AI receives, as published by zseven-w/craft-skills in skills/qwen-image-gen/SKILL.md and read by ahel’s review.

将创作需求转成可执行的提示词、参考图关系和尺寸决策。默认由当前 Agent 改写,无需额外部署提示词增强模型。参考图任务需要视觉理解能力;纯文本执行者应先取得准确的图片描述。

先区分任务

  • 提示词、改写、翻译:交付可复制文本与尺寸建议,不提交生图。
  • 文生图:描述最终可见画面。身份、数量、文字、动作、颜色和位置是固定要求;只补全必要的构图与光照细节。
  • 修改这张图:先说改哪里、改成什么,再简洁锁定未修改内容。改变姿势时不能同时要求姿势不变。
  • 参考主体创作新图:先实际看图,明确哪张图提供身份、服装或背景,再描述新姿势与场景。不要只靠重复人物形容词维持同一张脸。

写提示词前读 rewriting.md。保留用户的创作意图,不用通用美化词覆盖具体要求。简单需求不必扩成长文。

把单张、系列和画幅拆开

单张只安排一个明确动作。系列总提示词包含多个动作时,拆为各自完整的单图提示词;同人物系列分别从一张通过验收的身份参考出发,避免逐张把上次生成的误差累积进去。只有用户要拼图时才描述多面板。

画幅是独立参数。明确像素或比例优先;没有指定时,根据构图建议比例并落实到下游接口。不要只在文字里说竖图,却提交方形画布。相同比例可以对应不同像素尺寸。

可供程序衔接的结构:

{"rewritten_prompt":"最终画面描述","wh_ratio":"9:16"}
{"rewritten_prompt":"具体编辑要求及保留条款","wh_ratio":"","ratio_follow":"<image1>"}

wh_ratio 与 ratio_follow 互斥。仅将 rewritten_prompt 送入模型的文字输入,不把 JSON 包装或解释一并送进去。用户只要提示词时,用普通文本交付即可。

已要求生成时

使用用户指定且已有的 Qwen 入口,沿用当前授权。先读 integration.md,核对实际接口:是否支持参考图、多图、显式宽高和原生 Alpha。模型有某能力,不代表当前封装已经接入。

本 Skill 不预置服务器地址或密钥,也不默认下载模型。没有生成连接时仍可交付提示词;不能把“已准备请求”说成“已生成”。

应用需要加载同一份版本化规则时,读 shared-runtime.md。可选 Node.js 模块只构造规划消息、校验结构和整理质量反馈,不联网、不执行生成;普通 Agent 无需运行它。

附带的 scripts/prepare_workbench_request.py 只是一个可选、离线、特定工作台协议的请求构建器。它不调用模型、不进行提示词改写、不联网。其 2048 像素和单参考图限制仅适用于该适配器,不是 Qwen 的模型上限。详见 workbench-adapter.md。

验收与修正

检查未经修饰的原图:目标文字、动作、肢体连接、身份、保留区域、实际像素尺寸;需要透明时检查 Alpha 和边缘,而非仅看文件扩展名。

为每个结果保留原提示词、实际提交文本、参考图、生成设置及结果位置。质量缺陷与审美不喜欢分开记录:多肢不代表不喜欢坐姿。修正时附上缺陷、目标状态和需要保留的内容;保留原图与新版本,让用户比较验收。没有更多生成授权时停止,不无限重抽。

当用户要 A/B 对照,固定图像模型、尺寸、步数、种子和参考图,只改变待测因素。把采用新画幅的实验单独比较。生成成功、图片更美观、严格完成要求是三个不同判断。

遇到文字泄漏、多宫格、姿势粘连、尺寸异常或透明边缘问题时读 tested-behavior.md。这些是具体条件下的观察,不能扩展为通用成功率。

Signals

GitHub stars
201
Forks
27
Last commit
Sep 2026
Advanced
Catalog kind
skill
Key
qwen-image-gen
Source
github.com/zseven-w/craft-skills