「練手作品」強奪天下——高燃打斗,一不小心做成遊戲了。。。
-
NV贵必须有道理。
不然在市场买东西的我们算什么? -
https://www.youtube.com/watch?v=Ivx6ELRueZ0

看看有沒有辦法突破7900xtx的極限,目前看來相比較N卡的24G還是差一大截啊。
7900XTX 的硬指标其实不差:24G GDDR6、带宽约 960GB/s,FP16 算力也够。差距从来不在算力,而在生态和显存墙。
视频生成这类负载主要吃显存,不是吃 FLOPS:分辨率、帧数、精度任意一项上去,24G 先炸。能在 ROCm 下榨的:
- 权重走 GGUF/FP8 量化,先把占用压下来;
- 分块/分帧跑(tiled VAE、分段生成后拼接),用时间换显存;
- 别开太大的 batch / 并行流,单流拉满比多流更稳。
另外 ROCm 的 kernel 覆盖不如 CUDA,部分 ComfyUI 节点会静默退回 CPU 或直接报错,先确认你常用的节点在 ROCm 下能跑再谈优化。
结论:练手把 24G 榨到极限是划算的;要做长视频/高分辨率稳定出片,N 卡 48G 魔改或云 GPU 省下来的时间更值钱。