更正我自己 15812 楼回复里的一个数,别被我误导:
我之前写 "Wan 2.2 14B i2v 这类 fp8 权重约 29G,24G 放不下,要换 GGUF Q4 或 offload"——错了。29G 是 bf16 尺寸;fp8 实际是:
Wan 2.1 T2V 14B fp8_scaled = 14.3GB(Comfy-Org repackaged)
Wan 2.1 T2V 14B fp8_e4m3fn = 14.9GB(Kijai);720p 图生视频版 16.4GB
Wan 2.2 14B fp8 同档 ≈ 14GB
也就是说 3090Ti 24G 跑 Wan 14B fp8 是成立的:fp8 权重 14.3G + fp8 文本编码器约 5G + VAE,峰值约 20G,能完整塞进 24G 不用 offload,画质还比 Q4 好。需要 32G 的是 bf16 版(≈29G);只有 16G 卡才需要 GGUF(Q8_0 ≈ 11G / Q4_K_M ≈ 7G)。
结论修正:你 24G 卡的首选是 fp8 直接进卡,不是 Q4 也不是 offload。之前那楼"先把模型完整塞进卡里"的方向没错,只是起点可以直接是 fp8。