FP8 與 GGUF

FP8 和 GGUF 都能縮小 Wan,但不能互換。FP8 是稠密計算圖上的 GPU tensor core 元素型別。GGUF 是分塊量化檔案格式(Q4–Q8),給邊載入邊反量化的載入器準備。

e4m3Q4_KComfyUI
本頁目錄 4
FP8 與 GGUF 及其他 Wan 壓縮路徑
FP8 留在 CUDA 矩陣乘路徑。GGUF 是來自 llama.cpp 世界的儲存/執行時格式。

FP8(e4m3 / e5m2)

  • Ada / Hopper / Blackwell tensor core 原生支援。
  • 通常是 FP8 DiT 加一條 FP32/BF16 殘差;VAE 往往保持更高精度。
  • 工具:DiffSynth-Studio、LightX2V、部分 ComfyUI 的 fp8_e4m3fn safetensors。
  • 畫質:校準正常時,通常是便宜方案裡最接近 bf16 的。

GGUF(Q8_0、Q5_K、Q4_K …)

  • 分塊量化,可選重要性矩陣(K-quant)。
  • 在 ComfyUI-GGUF 裡流行,讓 16 GB 卡也能載入總參 27B 的 MoE。
  • 速度取決於反量化核心。在強 GPU 上 Q4 可能比 FP8 更慢,因為要反量化、tensor core 利用率更低。
  • 很多圖裡 A14B 仍是兩個專家對應兩個 GGUF 檔案。
FP8GGUF Q4/Q5
典型 GPU4090 / 5090 / A100+12–24 GB 消費卡
計算圖稠密 FP8 GEMM反量化 tile → GEMM
相對 bf16 畫質通常 FP8 更近Q8 接近;Q4 更軟
載入器DiffSynth、原生 ComfyComfyUI-GGUF、llama.cpp 風格
MoE兩個專家都留著,或 offload常拆檔案 + 順序換入

常見問題

GGUF 是「官方量化模型」嗎?
是社群重打包。雜湊和 VAE 必須對上父模型(A14B vs 5B vs I2V)。
NVFP4?
更新的 LightX2V 風格 4-bit GPU 格式。精神上更接近 FP8(GPU GEMM),而不是 GGUF 檔案。

一手來源

已對照 Wan-Video/Wan2.2 README 核對 · 2026-08-28

© 2026 wan2.video