← ComfyUI 实测笔记

ComfyUI FLUX 8GB 显存占用怎么看?任务管理器、专用 GPU 内存、共享 GPU 内存区别

ComfyUIFLUXGGUFGPUlow-vramtask-manager

先说结论

很多新手看到任务管理器里 GPU 使用率是 0%,就觉得显存没被占——这是最常见的误判。

GPU 使用率GPU 显存占用 是两回事。ComfyUI 跑 FLUX 时,显存可能已经被占掉 6~7GB,但 GPU 使用率可以很低,甚至短时间降到 0%。

这篇文章不写官方原理,只记录我在 RTX 4060 Laptop 8GB 上跑 FLUX GGUF Q6_K + T5 FP8 时,怎么看显存、怎么判断是不是不够用。

这篇文章适合谁

  • 第一次用任务管理器看 GPU 显存
  • 不清楚「专用 GPU 内存」和「共享 GPU 内存」的区别
  • ComfyUI 出图变慢或 OOM,但不知道怎么看显存占用
  • 怀疑浏览器、录屏、其他软件在偷显存

我的测试环境

项目参数
GPUNVIDIA GeForce RTX 4060 Laptop GPU
专用显存8GB
系统内存32GB
系统Windows 11
ComfyUI0.24.0
UNetflux1-dev-Q6_K.gguf
Text Encodert5xxl_fp8_e4m3fn_scaled.safetensors + clip_l.safetensors
VAEae.safetensors
默认参数1024x1024, 20/30 steps, batch 1, CFG 1.0, euler, simple

打开任务管理器看显存

在 Windows 11 上,按 Ctrl + Shift + Esc 打开任务管理器,切到「性能」标签,左侧点「GPU 0」。

你会看到几个关键数字:

  • GPU 使用率:当前 GPU 计算核心的利用率。0% 不代表显存没被占。
  • 专用 GPU 内存:显卡上自带的显存(我这台是 8GB)。跑 FLUX 时主要看这个
  • 共享 GPU 内存:系统内存分给 GPU 用的一部分,速度远慢于专用显存。这个不要当显存用
  • 专用 GPU 内存使用量:当前实际占用了多少专用显存。

新手最容易犯的错:把「共享 GPU 内存」的数字当成可用显存。8GB 专用显存炸了就炸了,共享那部分只是兜底,速度会崩。

专用 GPU 内存 vs 共享 GPU 内存

项目专用 GPU 内存共享 GPU 内存
物理位置显卡板载 VRAM系统内存(DDR)分出一半
速度极快(几百 GB/s)慢很多(几十 GB/s)
ComfyUI 主要用哪个专用仅在溢出时被动使用
满了之后OOM 或严重变慢继续用但速度明显下降
8GB 显卡典型值~8GB显示约 16GB(系统内存的一半)

跑 ComfyUI FLUX 时,盯着专用 GPU 内存使用量就够了。 共享部分显示的数字误导性很强。

GPU 使用率 0% 不代表没占显存

这是新手最常见的误解。举个例子:

  • 你刚 Queue Prompt,模型已经加载完了
  • 采样结束了,图已经存到了 output
  • 这时候 GPU 使用率可能降回 0%
  • 但专用 GPU 内存使用量可能仍然是 6~7GB,因为模型还在显存里

模型加载后会驻留在显存中,除非你关掉 ComfyUI 或显存被其他东西挤掉。所以不要看到 GPU 使用率低就觉得”没事”——你要看的是专用 GPU 内存使用量。

哪些程序可能在偷显存

8GB 显存本来就不宽裕,下面这些东西每个都可能占掉几百 MB 到 1GB:

程序可能占用说明
Chrome / Edge 浏览器200~800MB硬件加速、视频解码会占显存
Discord100~300MB硬件加速默认开启
Steam100~500MB后台常驻可能占显存
OBS / 录屏300~800MB编码需要显存
壁纸引擎 / Wallpaper Engine200~600MB动态壁纸占显存
视频播放器100~500MB尤其 4K 视频
其他 AI 工具不定SD WebUI、Ollama 等同时运行

我实测跑 1024x1024 FLUX GGUF Q6_K 时,关闭 Chrome 能释放约 400~600MB 专用显存——在 8GB 这个档位,这几百 MB 很可能就是 OOM 和正常出图之间的差距。

怎么排查是不是显存不够

看 ComfyUI 控制台

OOM 最直接的信号是控制台报错:

CUDA out of memory

或者:

RuntimeError: CUDA error: out of memory

看任务管理器

跑 FLUX 时切到任务管理器 > 性能 > GPU,看专用 GPU 内存使用量:

  • 如果接近或等于 8GB,说明显存基本吃满
  • 如果长时间保持 7.8~8.0GB 且控制台报错,基本就是 OOM
  • 如果跑的过程中突然涨到 8GB 然后报错,说明某个步骤显存不够了

不是 OOM 但也很慢的情况

GPU 使用率很低 + 专用显存没满 + 出图还是很慢,可能是:

  • 冷启动加载模型(参考 第一次出图很慢
  • 共享 GPU 内存在兜底,速度被系统内存拖慢
  • CPU 或磁盘瓶颈,尤其第一次加载大模型
  • 后台程序占用:Chrome、录屏、Steam

我建议的排查顺序

  1. 打开任务管理器 > 性能 > GPU
  2. 关掉 Chrome、Discord、Steam、录屏
  3. 确认专用 GPU 内存使用量尽量在 2GB 以下(空闲状态)
  4. 启动 ComfyUI,加载工作流
  5. Queue Prompt,观察专用 GPU 内存使用量的变化
  6. 如果撞 8GB 上限且报错,降分辨率或检查是否用错模型
  7. 如果没报错但很慢,看是否冷启动

共享 GPU 内存到底能不能用

能用,但不建议当主力

共享 GPU 内存本质是系统内存(DDR),速度远低于专用显存(VRAM)。当专用显存不够时,Windows 会把一部分数据放到共享内存里——这不是 GPU 在”借内存”,而是 Windows 在兜底。

实际效果:

  • 轻度溢出:可能只是变慢一点,图还能出
  • 重度溢出:出图时间可能翻倍甚至更久,稳定性也会下降

我在这台 8GB 机器上跑 FLUX GGUF Q6_K 时,正常情况下不依赖共享 GPU 内存就能出图。如果你发现自己跑 FLUX 时共享 GPU 内存也被大量使用,那通常是专用显存已经不够了。

常见误区

  1. 「GPU 使用率 0%,所以显存没被占」 使用率和显存占用是两回事。模型加载后会驻留在显存中,使用率为 0% 不代表显存被释放。

  2. 「共享 GPU 内存有 16GB,等于我有 24GB 显存」 共享内存速度远慢于专用显存,不能当显存用。8GB 专用显存的上限就是 8GB。

  3. 「任务管理器不显示,就代表没吃完显存」 如果控制台报了 CUDA out of memory,那就已经是 OOM。任务管理器的采样有延迟,可能没抓到峰值。

  4. 「浏览器占了显卡说明浏览器有问题」 浏览器硬件加速正常会占显存。跑 FLUX 时顺手关掉 Chrome 能释放几百 MB。

  5. 「只有 AI 程序才占显存」 Discord、Steam、录屏、动态壁纸都可能占显存。8GB 本就紧张,多个程序同时用就容易撞墙。

FAQ

为什么 GPU 使用率 0% 但显存还占着?

模型加载后会驻留在显存中,直到 ComfyUI 释放或被其他程序挤掉。使用率反映的是计算核心的繁忙程度,不是显存占用。

共享 GPU 内存应该看多少才算正常?

跑 FLUX 时,如果专用显存还没满,共享 GPU 内存的使用量不应该很高。如果共享显存也被大量使用,说明专用显存已经不够了。

8GB 跑 FLUX 一般占多少显存?

在我这台机器上,FLUX GGUF Q6_K + T5 FP8、1024x1024、batch 1 的情况下,专用 GPU 内存使用量通常在 6~7.5GB 左右,不撞 8GB 上限。

怎么知道自己是不是 OOM?

最直接的信号是 ComfyUI 控制台报 CUDA out of memory。任务管理器里专用 GPU 内存使用量接近 8GB 且图没出来,也基本可以判断。

关闭浏览器真的能省显存吗?

能。我这台机器实测关闭 Chrome 能释放 400~600MB 专用显存。8GB 的机器上,这几百 MB 可能就是能不能出图的差别。

任务管理器和 nvidia-smi 哪个准?

两者都有延迟。任务管理器更方便日常看, vidia-smi 在命令行里更实时。遇到疑难时两个都看。

后续待测

  • 不同 GGUF 量化级别(Q4/Q5/Q6)的准确显存占用对比
  • 关闭浏览器前后,同一 prompt 的显存占用差值记录
  • FLUX GGUF 加载后显存驻留时间测试
  • nvidia-smi 和任务管理器读数差异对比
  • 多个模型热加载时的显存占用叠加情况

相关文章