ComfyUI FLUX GGUF 提示词怎么写?RTX 4060 8GB 实测 prompt 记录
先说结论
新手写 FLUX 提示词,最容易犯的错不是”词不够多”,而是一上来就堆一大堆词。什么摄影术语、风格词、画家名全往上摞,结果出图不受控——不知道哪个词在起作用,也不知道哪个词得罪了模型。
先写清三个东西:画面主体、构图/镜头、风格/光线。其余的慢慢加。
这是我在 RTX 4060 Laptop 8GB + FLUX GGUF Q6_K + T5 FP8 工作流里的实测记录,不代表所有硬件和方案都适用。
这篇文章适合谁
- 第一次用 ComfyUI 跑 FLUX GGUF,不知道 prompt 从哪写起
- 看到别人一堆英文 prompt,不知道每段分别控制什么
- 出图和预期差很多,不确定是不是 prompt 有问题
- 想先拿到”能跑通、能看”的结果,再慢慢打磨
如果你已经能熟练写出各种 FLUX prompt,这篇文章对你可能太基础。
我的测试环境
| 项目 | 配置 |
|---|---|
| GPU | NVIDIA GeForce RTX 4060 Laptop GPU |
| 专用显存 | 8GB |
| 系统内存 | 32GB |
| ComfyUI | 0.24.0 |
| 方案 | FLUX GGUF Q6_K + T5 FP8 |
| UNet | flux1-dev-Q6_K.gguf |
| Text Encoder | t5xxl_fp8_e4m3fn_scaled.safetensors + clip_l.safetensors |
| VAE | ae.safetensors |
| 默认采样参数 | 1024×1024, batch 1, CFG 1.0, euler, simple, 20 steps |
我当前用过的人像 prompt 示例
下面是我这套工作流里实测跑通过的人像 prompt。先说英文原文,再逐段解释每部分控制什么。
英文 prompt 原文
beautiful young Chinese woman, realistic portrait, long black hair, natural makeup, gentle expression, wearing elegant traditional Chinese-inspired clothing, upper body shot, looking at the camera, soft studio lighting, detailed eyes, detailed skin texture, clean background, sharp focus, realistic photography, high quality
逐段中文解释
主体描述(beautiful young Chinese woman) 先明确画面里是谁。中文人像就写 Chinese woman / man / child,年龄写 young / middle-aged / elderly。性别和年龄会直接影响画面气质。
风格方向(realistic portrait) 告诉 FLUX 这是写实肖像,不是动漫、插画、油画。这一步能避免模特五官往二次元方向偏。
发型和妆容(long black hair, natural makeup, gentle expression) 这三项控制人物外观细节。发型和妆容越具体,出图越符合预期。gentle expression 控制表情方向,是温柔的,不是冷酷的。
服装(wearing elegant traditional Chinese-inspired clothing) 穿什么。不要只写 dress,要写明风格。Chinese-inspired 是关键——因为主体是 Chinese woman,如果不写服装风格,可能会偏现代便装或西式礼服。
构图和镜头(upper body shot, looking at the camera) 控制画面范围:上半身、半身、全身、头像。looking at the camera 控制眼神方向。如果去掉 looking at the camera,模特可能会往侧面看。
光线(soft studio lighting) 控制画面光照。soft studio lighting 是棚拍柔光,适合肖像。换成 natural sunlight 会变成户外光照。
细节和质量(detailed eyes, detailed skin texture, clean background, sharp focus) 这些是质量控制词,告诉模型注意眼睛细节、皮肤质感、背景干净、焦点锐利。可以按需加减,但不用堆太多。
风格锚定(realistic photography, high quality) 最后再锚定一次写实摄影方向。FLUX 对 prompt 结尾的词比较敏感,结尾放风格方向的词有助于统一整体效果。
为什么先用简单 prompt 测工作流
新手第一件事不是写好 prompt,是先确认工作流能跑通。如果工作流本身有问题——模型放错、节点连错、参数不对——再好的 prompt 也出不了图。
建议顺序:
- 先用一个简单 prompt 跑 768×768 / 20 steps,确认能出图。
- 再用同一个 prompt 跑 1024×1024 / 20 steps,确认分辨率没问题。
- 确认工作流稳定后,再开始打磨 prompt。
简单 prompt 示例:a woman, portrait, realistic photography。就这几个词,先跑通再说。
正向提示词应该包含哪些信息
按重要程度排列:
| 优先级 | 内容 | 示例 |
|---|---|---|
| 1 | 画面主体 | Chinese woman, man, cat, landscape |
| 2 | 风格方向 | realistic photography, oil painting, anime |
| 3 | 构图/镜头 | portrait, upper body, close-up, wide shot |
| 4 | 主体细节 | hair color, clothing, expression, age |
| 5 | 光线和氛围 | studio lighting, sunlight, moody |
| 6 | 背景 | clean background, city street, forest |
| 7 | 质量词 | detailed, sharp focus, high quality |
新手建议从 1-4 开始,先不要管 5-7。能稳定出图了再加。
负面提示词要不要写
本文当前工作流主要记录正向提示词。FLUX 本身对负面提示词的依赖程度和 SD 不同,在 GGUF Q6_K + T5 FP8 这套方案里,我没有单独配置负面提示词也能正常出图。
负面提示词后续单独测试,暂时不要把它当成必须项。
CFG 为什么先用 1.0
CFG 控制提示词对最终画面的”引导强度”。SD 系常见 CFG 7-10,但 FLUX GGUF 配合 BasicGuider 的引导机制不同。在我这套工作流里,CFG 1.0 是实测稳定值。
新手建议:先用 CFG 1.0,不要照搬 SD 的 7-10 经验。
20 steps 和 30 steps 下 prompt 的作用区别
两种步数都跑过同一个 prompt 的情况下:
- 20 steps:出图快,约 108 秒(热状态)。适合快速看 prompt 有没有写错、构图是否对、能不能继续打磨。
- 30 steps:出图慢一些,但画面更稳定。适合确认 prompt 方向后出最终图。
同一条 prompt 在 20 steps 和 30 steps 下内容方向一致,但 30 steps 的细节通常更好。我说”通常”,是因为这不是严格 A/B 画质评测,只是我这台机器上的经验。
我的习惯: 改 prompt 时用 20 steps 快速试,确定了再 30 steps 出。
常见错误
1. 主体太多
a woman, a dog, a cat, a flower, mountain background——FLUX 不是不能处理多主体,但新手一上来就堆,很难判断哪个词在”打架”。建议先从一个明确主体开始。
2. 风格词太乱
oil painting, anime style, realistic photography, watercolor——四种风格叠在一起,模型只能”综合”一个不确定的结果出来。选一种主风格。
3. 摄影词和动漫词混在一起
photorealistic anime girl——写实和动漫是矛盾的。写真就写摄影相关词,动漫就写 anime illustration 之类。
4. 没写背景
beautiful woman, portrait——背景可能随机、抽象、甚至不合理。至少写个 clean background 或 solid background。
5. 没写构图
不写 portrait / upper body / full body / close-up,FLUX 会自己决定画面范围,可能裁掉你不想裁的部分。
6. 把中文直接翻译成奇怪英文
“高贵冷艳” 直接写成 noble cold gorgeous,英文里这几个词放一起不通。建议用自然英文——写 elegant, cool expression 更合适。
新手推荐 prompt 模板
[主体描述], [风格方向], [关键细节], [构图], [光线], [背景], [质量词]
示例组合:
beautiful young Chinese woman, realistic portrait, long black hair with gentle expression, upper body shot, soft studio lighting, clean background, sharp focus, high quality
先用这个模板跑通 1024×1024 / 20 steps。出图正常了再微调。
可直接复制的 5 个 prompt 示例
每个示例下面都配中文解释。
示例 1:写真人像
beautiful young Chinese woman, realistic portrait, long black hair, natural makeup, gentle smile, wearing casual white shirt, upper body shot, looking at camera, soft natural lighting, clean background, sharp focus, high quality
解释: 年轻中国女性写实半身像,长发、淡妆、微笑、白衬衫。自然光、干净背景。适合测试基础人像 prompt。
示例 2:传统服饰
elegant Chinese woman in traditional hanfu, full body shot, standing in bamboo forest, soft diffused sunlight, flowing fabric, graceful pose, natural colors, realistic photography, high quality
解释: 汉服女性全身像,竹林背景,漫射柔光。适合测服装和场景搭配。
示例 3:都市人像
young Asian woman, fashion portrait, short wavy hair, wearing modern streetwear, city street at night, neon lights background, cinematic lighting, medium shot, sharp details, realistic photography
解释: 年轻女性时尚街拍,夜间都市,霓虹灯背景,电影感光线。适合测暗光场景。
示例 4:简约头像
Chinese woman close-up portrait, simple black background, dramatic side lighting, intense eyes, natural skin texture, minimalist, sharp focus, high quality
解释: 特写头像,黑背景,侧面光,眼神聚焦。极简风格,适合单独测脸部细节。
示例 5:快速测试
a woman, portrait, realistic photography, clean background
解释: 最简 prompt。先跑通工作流再用它。如果这个都跑不出正常图,先排查节点和模型,不要怀疑 prompt。
FAQ
Q: FLUX 应该用中文还是英文 prompt? T5 文本编码器以英文为主训练。用英文 prompt 效果更稳定。中文可以放进 CLIP 文本编码 (Flux) 的第二个文本框,但主力 prompt 建议用英文。
Q: prompt 越长越好吗? 不是。先写清楚主体和风格,比堆 50 个词更有效。我当前实际使用的 prompt 一般 15-30 个词。
Q: 可以不加负面提示词吗? 可以。我这套 GGUF Q6_K + T5 FP8 工作流没配置负面提示词,仍然正常出图。不要因为 SD 习惯就觉得必须加。
Q: 改 prompt 后多久能看到效果? 20 steps / 1024×1024 热状态约 108 秒。改一个小词就可以跑一次,不用等太久。
Q: prompt 没写对,会 OOM 吗? 不会。prompt 影响的是内容方向,不直接影响显存。OOM 优先检查分辨率、batch_size、模型方案。
后续待测
- 同一 prompt 下 T5 FP8 和全精度 T5 的风格差异
- 同一 prompt 下 Q4_K_M、Q5_K_M、Q6_K 的画质差异
- 负面提示词对 FLUX GGUF 的实际影响
- 中文 prompt 和英文 prompt 在 FLUX 中的对比
- 不同 sampler/scheduler 对同一 prompt 的影响