ComfyUI 中使用 Qwen-Image-2.1 生成图片
前言
Qwen-Image-2.1 采用轻量简洁的模型结构,视觉生成部分包含 32 层 Single-Stream DiT,参数量为 7B。在较小的模型规模下,Qwen-Image-2.1 依然具备出色的图像生成能力。
官方文章
性能对比

模型下载
链接:https://pan.quark.cn/s/91323e606523?pwd=uNQd
提取码:uNQd
提示词
正向
1 | 一位25岁左右的年轻东方新娘,拥有清丽脱俗的东方古典美貌,五官精致而自然,脸型柔和秀美,眉眼细长,清澈明亮的杏仁形眼睛,眉毛自然纤细,鼻梁秀挺,嘴唇柔和饱满,肌肤白皙细腻通透,带有真实自然的皮肤纹理,乌黑柔顺的长发半挽成古典发髻,发间点缀精致的珍珠发簪与细碎银饰,少量发丝随微风轻轻飘动,额前垂落几缕碎发,温柔地修饰着脸庞。 |
负面提示词
1 | 低质量,模糊,卡通,动漫,插画,塑料皮肤,蜡像感,假脸,五官畸形,五官不对称,眼睛大小不一致,脸部变形,身体比例异常,人体结构错误,手部畸形,多余手指,缺失手指,多余肢体,多人,重复人物,过度磨皮,过度美颜,浓妆,夸张胸部,不自然身材,低俗姿势,色情姿势,裸露,过度暴露,杂乱背景,文字,水印,Logo |
效果预览

所需插件
1 | https://github.com/leejet/ComfyUI-GGUF |
分辨率设置
| 目标分辨率 | 标准像素尺寸 | 百万像素数(16:9) | 百万像素数(1:1) |
|---|---|---|---|
| 1080P | 1920×1080 | ≈ 2.0 MP | ≈ 1.0 MP(1024×1024) |
| 2K | 2560×1440 | ≈ 3.7 MP | ≈ 2.0 MP(1440×1440) |
| 4K | 3840×2160 | ≈ 8.3 MP | ≈ 4.0 MP(2048×2048) |
倍数(Multiple)统一设为 32(或 64),确保输出尺寸对齐模型要求。
个人体验
显卡 4070 12G 的前提下
| 分辨率 | 生成时间 |
|---|---|
| 1376x768 | 46s |
| 1920x1088 | 58s |
| 3872x2176 | 200s |
不要直出 4K 的
建议
生成图片为1080P的,再用扩图的模型进行扩图,这样时间要短很多,效果也更好。