5060TI 16G显卡换成3090TI 24G是否有优势
-
尝试了minimax h3, 总结,少过32gb vram 的显卡,嗯嗯嗯。。。。
别浪费钱了
-
直接说结论:有优势,而且对图生/文生视频是实打实的提升,但你要分清"显存"和"量化格式"两件事。
1. 16G→24G 是质变
文生视频模型(LTX、MiniMax H3 的 pruned/FP8 版、CogVideoX 等)是显存大户,16G 经常卡在分辨率/时长上,24G 能上更高分辨率、更长片段、更大 batch。imbiplaza 说的"少过 32G 别浪费钱"指的是 H3 原版;24G 跑 pruned FP8 版(比如 minimax_h3_fl2va_pruned_fp8)是可行的,但 16G 确实基本没戏——这正是你换卡的最大理由。2. 带宽翻倍
5060Ti 16G 是 128-bit 总线(约 448GB/s),3090Ti 是 384-bit GDDR6X(约 1008GB/s)。视频生成每步都是带宽密集型,带宽翻倍直接反映在 it/s 上。3. 你那个 INT8 比 BF16 慢,是路径问题,不是格式问题
3070 笔记本上 INT8 跑图反而比 BF16 慢,几乎可以肯定量化没吃到 tensor core(走的是临时转换或 CPU dequant 路径),小显存下 quantize+dequant 的开销大于省下的带宽。3090Ti 是 Ampere,INT8/INT4 tensor core 满血,ComfyUI 里直接用原生 INT8/FP8 权重文件加载就不会出现"量化更慢"。注意:你提到 NVFP4 最快——NVFP4 是 Blackwell 特性,3090Ti 不支持,如果它对你很重要,5060Ti 反而是唯一保留该选项的卡。4. 值不值
主要瓶颈是"16G 装不下想跑的模型"→ 值,3090Ti 24G 是当前性价比最高的视频生成卡之一。只是嫌慢且模型都跑得动 → 提升有限,先查驱动和量化路径。一句话:为了跑得动更大更长的模型,值得换;INT8 的提速别指望玄学,把权重加载路径和驱动版本弄对才是关键。
-
最近弄图生或者文生视频比较多 想知道3090 24G是否有优势 INT8格式是否在3090上使用会比较顺 我有一台3070 8G显存的笔记本使用INT8跑图 速度还不如用BF16快 INT8跑图需要5分钟跑图 BF16只要90秒 NVFP4甚至只要60秒
我沒使用過這平台 沒想到有這麼多種GPUs 可以租用
裡面有3090 24G可以測試比較 -
鉴于对24G显存的一顿折腾。换的话还是32G比较好。京东自营 4080S 不知道有没有货了。
一个建议。
