ComfyUI FLUX 出图不清晰怎么办?脸糊、细节差、构图不稳定排查记录
先说结论
出图不清晰,不要一上来就把所有参数都改一遍。先分清楚是 prompt 问题、分辨率问题、steps 问题、模型量化问题,还是构图/背景问题。
排查顺序比参数本身更重要。先固定变量,只改一个东西,跑一次,记录结果,再改下一个。
这是我在 RTX 4060 Laptop 8GB + FLUX GGUF Q6_K + T5 FP8 工作流下的实测记录,不代表所有硬件和方案都适用。
这篇文章适合谁
- 能正常出图,但觉得画面不够清晰
- 人脸发糊、眼睛不稳、五官变形
- prompt 写了很多细节,画面还是不听话
- 不确定要先改 prompt、改分辨率、还是改 steps
如果你刚接触 ComfyUI FLUX,建议先看”从安装节点到第一次出图的完整顺序”。
我的测试环境
| 项目 | 配置 |
|---|---|
| GPU | NVIDIA GeForce RTX 4060 Laptop GPU |
| 专用显存 | 8GB |
| 系统内存 | 32GB |
| ComfyUI | 0.24.0 |
| 方案 | FLUX GGUF Q6_K + T5 FP8 |
| UNet | flux1-dev-Q6_K.gguf |
| Text Encoder | t5xxl_fp8_e4m3fn_scaled.safetensors + clip_l.safetensors |
| VAE | ae.safetensors |
| 默认采样 | 1024x1024, batch 1, CFG 1.0, euler, simple |
常见现象 1:整张图都糊
可能原因:
- 分辨率太低。768 以下的分辨率可能在某些构图下缺乏细节。
- prompt 里没有明确风格和清晰度方向。光写主体不写画质词,模型可能给你一张”柔和”的结果。
- 画面主体太复杂。多个人物、复杂场景、大量物品同时出现时,模型分配到每个元素的注意力会被稀释。
- 冷启动第一次出图——模型刚加载完,缓存还没稳定,不适合当作画质评判依据。
建议:
- 先用 768x768 跑通工作流,再上 1024x1024。
- batch size 固定 1。
- prompt 先简化,确保主体明确后再加细节。
- 测试清晰度时,不要同时改 steps、sampler、scheduler。只改一个变量。
常见现象 2:脸糊、眼睛不稳
这是新手最常遇到的问题。FLUX 不是所有构图下都能自动把脸修好。
什么时候脸容易糊:
- 远景或全身人物。画面中人脸只占很小的像素区域,模型分配给脸部的计算资源有限。
- 多人场景。同时出现两个以上人物时,各人脸部细节都会下降。
- 复杂背景分散了模型注意力。
- prompt 里有 conflicting 的风格词。
建议:
- 人像测试优先用
portrait、upper body shot、close-up portrait。半身或头像比全身更容易获得清晰脸部。 - 新手阶段先只写一个人物。跑通了再加多人。
- 背景先用
clean background或simple background。 - prompt 里加
detailed eyes、detailed face、sharp focus。 - 如果是远景人物,不要期待脸部像证件照一样清楚。 8GB 机器上 1024x1024 的全身人像,脸部像素本来就不够。
常见现象 3:prompt 写了很多,画面还是乱
prompt 太长、主体太多、风格混杂,模型不知道优先听谁的。
不建议这样写:
a woman, a cat, a dog, city street, forest, anime, realistic photography, oil painting, cinematic, watercolor
主体堆了三个,背景堆了两个,风格堆了四个。出图结果不可预测。
建议这样写:
young Chinese woman, realistic portrait, upper body shot, long black hair, clean background, soft studio lighting, detailed eyes, sharp focus
先明确一个主体、一种风格、一种光线、一个背景。能稳定出图了再慢慢加。
核心原则:prompt 不是越长越好,是越明确越好。
常见现象 4:20 steps 和 30 steps 画质差别不明显
steps 主要影响采样时间和出图稳定性,不是”30 一定比 20 清楚”的万能按钮。
- 20 steps:适合快速测试 prompt 是否写对、构图是否合理。约 108 秒(热状态)。
- 30 steps:适合确认 prompt 方向后出最终图。细节通常更好,但不是每次肉眼可见的差别。
如果你在 20 steps 下脸已经很糊,换到 30 steps 可能改善有限。脸糊优先检查构图(是否太远)、prompt(是否写了 detailed face)和分辨率。
详见:FLUX 20 steps 和 30 steps 怎么选?
常见现象 5:1024 不一定比 896 更好看
分辨率更高会增加显存压力,给模型更多像素空间,但不保证每次画面更好。
不同启动状态(冷启动、热状态)、后台 GPU 占用、浏览器显存占用,都会影响同一次测试的结果。不能只看一次 1024 和一次 896 的对比就下结论。
详见:ComfyUI FLUX 第一次出图很慢怎么办? 和 OOM 排查记录
常见现象 6:Q6_K、Q5、Q4 影响画质吗
目前本站实测的主要是 Q6_K。其他量化级别(Q5_K_M、Q4_K_M)还没有完整的同 prompt 对比记录。
理论上,量化级别越低,模型体积和显存占用越小,但可能对细节有影响。具体到多大影响,需要同一个 prompt、同一个 seed、同一台机器跑完再下结论。
本文不写”Q6 画质一定好于 Q5”这种没测过的判断。
详见:ComfyUI FLUX GGUF Q4_K_M、Q5_K_M、Q6_K 怎么选?
我建议的新手排查顺序
按这个顺序来,不要跳步:
- 固定 seed,确保每次对比的是同一个随机起点
- 固定 prompt,不要一边排查一边改词
- 固定分辨率 1024x1024 或 768x768
- batch size 保持 1
- 先用 20 steps 快速试构图
- prompt 稳定后再试 30 steps
- 如果 OOM,先降分辨率或检查后台 GPU 占用,不要先怪 prompt
- 如果脸糊,先改构图为 close-up 或 upper body
- 如果构图乱,减少主体数量和背景复杂度
- 每次改完参数后记录结果,不要凭感觉比较
一次只改一个变量。 这是排查问题的基本纪律。
prompt 示例
以下是三个在我这台机器上实测能正常出图、且清晰度可接受的 prompt。
示例 1:清晰人像
young Chinese woman, close-up portrait, detailed eyes, natural skin texture, soft studio lighting, clean gray background, sharp focus, realistic photography, high quality
解释: 特写头像,强调眼睛细节和皮肤质感。灰色纯背景避免干扰。适合专门测脸部清晰度。
示例 2:半身人像
beautiful Chinese woman, upper body shot, long black hair, gentle expression, wearing white blouse, natural window light, detailed face, sharp focus, realistic photography
解释: 半身构图,自然窗光。头发和服装写了具体颜色和款式,不会跑偏。适合日常测试。
示例 3:快速测试
a woman, portrait, realistic photography, clean background, sharp focus
解释: 最简 prompt。如果这个都出图不清晰,先排查参数,不要怀疑 prompt。
不建议新手一开始做的事
- 一上来就 1280x1280。8GB 显存压力明显变大,OOM 风险增加。
- batch size 改成 2。显存翻倍压力,新手不要碰。
- prompt 写几百个词。先写 15-30 个词,跑通了再扩展。
- 同时改 steps、CFG、sampler、scheduler。一次只改一个。
- 把 SD 的负面提示词习惯直接搬过来。FLUX GGUF 这套工作流不依赖负面提示词。
- 一次出图不满意就判断”模型不行”。先跑 3 次同一参数,确认一致性。
FAQ
Q: 脸糊是不是模型坏了? 大概率不是。先检查构图是否太远(全身 vs 半身)、prompt 是否写了 detailed face、分辨率是否至少 768x768。模型文件损坏通常直接报错,不会只让脸糊。
Q: 30 steps 一定比 20 steps 清楚吗? 不一定。30 steps 通常更稳定,但如果 20 steps 已经比较清晰,切换后的提升可能不明显。如果 20 steps 脸很糊,先排查构图和 prompt,不要指望加 10 个 steps 就能解决。
Q: CFG 调高会不会让画面更听话? 在 FLUX GGUF + BasicGuider 这套工作流里,CFG 1.0 是实测稳定值。调高 CFG 的行为和 SD 不同,不建议新手随便试。
Q: 分辨率越高画质越好吗? 更高分辨率给模型更多像素空间,但同时增加显存压力和计算时间。在我这台 8GB 机器上,1024x1024 是当前比较实用的上限。再高没有完整测试。
Q: prompt 越长越好吗? 不是。明确 > 长度。15-30 个词的简洁 prompt 比 100 个词的大杂烩更可控。
Q: 为什么别人图很清楚,我的不清楚? 可能差异来自:硬件不同、模型方案不同(Q4/Q5/Q6/FP16)、分辨率不同、prompt 写法不同、后处理不同。不要只看结果,要对比完整的条件链。
后续待测
- 1024x1024 和 896x896 同 prompt 同 seed 的清晰度对比
- Q4_K_M、Q5_K_M、Q6_K 同 prompt 同 seed 的细节差异
- 不同 sampler / scheduler 对清晰度的影响
- 是否需要后期放大节点(Upscale)来提升脸部细节
- 全身人像 + 后期面部修复的可行性