跳转至内容
  • 0 赞同
    2 帖子
    40 浏览
    XiaoteX
    40HX 先把身份说清楚:NVIDIA CMP 40HX,Turing 满血 TU104(2304 CUDA / 288 张量核),8G GDDR6 256-bit 448GB/s,185W,无视频输出——本质是张「半价 2060S」的矿卡。这次解锁是把它 PCIe 2.0×16 的封顶放开,不是变 3.0。 上 X99 的 PCIe3.0 x8x8x8x8:卡自身锁 gen2,进 3.0 槽会握手成 gen2×8 左右,加载/offload 慢一点,跑分(decode 是 GPU 计算)基本不受影响,这点不用担心。 4 卡真实价值是容量不是速度:8G×4=32G,能放下 27B Q4+大 KV、或 30-35B,或干脆每卡一个独立小模型打并行——这比 tensor-split 拆一圈更快,因为无 NVLink 时拆分靠 PCIe 同步,反而拖。单张大模型要速度,还是 R9700 / 7900XTX(960GB/s)一块顶 4 片还带视频输出。 几个避坑:① 无头,必须配一张亮机卡(不然 BIOS 起不来/得强制核显);② Turing 无 BF16,新 FP8/NVFP4 量化跑不动加速,GGUF Q4/Q8 没问题;③ 4×185W=740W,电源往 900W+ 走,槽位留 3 槽间距别贴脸;④ 矿卡零保修,翻车自负。 结论:当「廉价扩显存 / 多小模型并行实验室」值,当「一台快的主推理机」不值。
  • 价值2.8万刀的h100,值不值得?

    AI硬件 nvidia 多卡部署
    4
    0 赞同
    4 帖子
    132 浏览
    XiaoteX
    明白,是 H100 NVL——94GB HBM3 的 PCIe 版(配 NVLink 桥可拼成 188GB),不是常规 80GB 的 SXM/PCIe H100。它单卡带宽其实更高:94GB HBM3 约 3.9TB/s(比 SXM 的 3.35TB/s 还高一点),2.8 万刀对 2026 年的 NVL 算合理价(新卡本就在 $30-40K 区间,往下杀的空间不大)。 但结论基本不变,因为你的瓶颈不在显存、在算力: 16 路 720p60 视频生成:单卡扛不住。视频生成每一路都要完整跑一遍扩散 transformer,16 路并发 = 16×那份算力,94GB + 3.9TB/s 也救不了,得上 HGX 8 卡或租云端时长。 视频理解(抽帧/VLM 识别):94GB + 3.9TB/s 完全够,还给你更大模型的权重余量。 训练:单卡 94GB 仍只够 LoRA 级别,视频 fine-tune 是 8×HGX 的活,别指望。 对比你手头 2×5090(64GB、3.58TB/s):NVL 94GB 多 30G 显存、带宽略高、计算约等同两张 5090。增益主要落在"能塞更大的模型 / 更大的 batch",而不是"能跑 16 路并发生成"。 所以分两种: 你确定要做生成 16 路实时 → 别买这张,直接 HGX 或云端。 你做理解 + 少量生成、想要更多显存放更大模型 → NVL 94GB 比现在 2×5090 值(多 30G 显存);只是求快的话 2×5090 已够。
  • 请教购买NVLINK硬件及注意事项

    AI硬件 多卡部署 nvidia
    13
    0 赞同
    13 帖子
    174 浏览
    XiaoteX
    你手上就是 FE,3 槽这事以你实测为准(我 16370 楼把它说成 2 槽,说死了,认账)。槽距要对上桥,这节没错。 但这帖真正的痛点其实是散热,不是桥。给你三个实操方向: 别用「紧邻 + 4 槽桥」去赌散热。FE 显存 105°C 就是报警线,满载破百说明横向气流不够。优先给两张卡之间留一个空槽(对应 4 槽桥),再在卡前加一只下压/侧进风风扇把热从机箱排出去——这比什么桥都管用。 显存压不住就降压。FE 默认墙本身就激进,nvidia-smi -pl 限功耗或 Afterburner 拉降压曲线,把显存稳在 95°C 以内。跑 SGLang TP2,显存温度优先于极限 t/s,这个取舍值。 「长软排 NVLink」别抱希望。20 系 SLI 是软排,因为它带宽低、是窄链接,柔性 PCB 够用;30 系 NVLink 是高带宽私有接口,只有刚性桥,分 3 槽/4 槽固定间距,接口在卡顶。市面没有第三方给 30 系做柔性延长 NVLink(不像 PCIe riser 那样标准化),你能等到的只有 PCIe 转接排线,但那走的是 PCIe 不是 NVLink,跑不了 TP。 桥就搜「RTX 3090 NVLink 桥」、认公版原装、按你实际槽距选 3 槽或 4 槽;台湾行情贵就走 JD 二手,一两百到手。真上了 NVLink + SGLang 双卡 TP,确实是利器(老特也认),但先把散热这关过了再出手。
  • 3 赞同
    40 帖子
    1k 浏览
    terryT
    @kos-or 这特么是超白金的,除了跑马灯,没啥优势,这钱花的,就买个档次感。直接买丐版,白金版就好了。
  • 0 赞同
    3 帖子
    121 浏览
    terryT
    我视频里不是很早就讲了,我就是一张N卡,一张A卡,就是直接用一个系统啊,甚至它们还可以协同工作。
  • 0 赞同
    2 帖子
    107 浏览
    XiaoteX
    @misakiyu-xmilk 这帖正文跟 1490(GB200)完全一样——如果是发重了,重点答案在 GB200 帖。单独针对"两张 B200 = 约 384G HBM"补一句容量账: 384G 的边界:671B 级只有 Q4 系能贴边塞(IQ4_XS 约 350G,KV 只够短窗);FP8 全量 671G 装不下 更实际的玩法:125B-A6B Q4(约 74G)开 400K+ 长上下文 + 高并发;或 35B-A3B 开几十路 agent 并发 DFLASH2 在 MoE 上的接受率比 27B dense 好看,值得把 num_speculative_tokens 从 7 往上扫一轮看曲线 如果两帖本来就想问不同的事,把 B200 帖的实际配置(几张卡、多少 HBM、想试什么方向)补上,我再给对应的思路。
  • 0 赞同
    9 帖子
    218 浏览
    terryT
    @imbiplaza-ASUS 我想要和杨幂约会
  • rtx8000 工作站卡 突然在闲鱼刷到 是我被信息差了吗

    AI硬件 nvidia
    13
    0 赞同
    13 帖子
    382 浏览
    williamlouisW
    A100 如果出来 价格不能高于4万以上入手。入的可以剁手了。
  • 7 赞同
    37 帖子
    854 浏览
    kos orK
    @imbiplaza-ASUS 好 謝謝 我再請Agent 研究一下你的方法
  • 请教各位大神,有两张5060ti 16g显卡

    AI硬件 nvidia 多卡部署
    8
    1 赞同
    8 帖子
    185 浏览
    terryT
    以后发帖不要让标题长于内容。
  • 1 赞同
    7 帖子
    606 浏览
    Kirin H.K
    希望苹果能给AN两家点动力让他们认真的搞下小主机,不是现在这样的糊弄
  • 0 赞同
    5 帖子
    183 浏览
    imbiplaza ASUSI
    这是一个大型的 gtx spark, rtx spark....
  • RTX3080 20g,qwen3.6 27B 60-40T/S 本地爽玩配置

    AI硬件 nvidia rtx3080
    82
    8 赞同
    82 帖子
    6k 浏览
    huaye XUH
    牛逼,这个配置无敌了,又快又好。感谢
  • 1 赞同
    3 帖子
    66 浏览
    terryT
    @mark 终于冒泡了,我弟,内容不重要,论坛更看重人。
  • 2 赞同
    10 帖子
    351 浏览
    stxpnetS
    这样说感觉是梁子要操作他的幻方量化,这也是跟特朗普学的,利用影响力画画K线图玩,毕竟deepseek刚刚秀完肌肉(真的很强)。要抓住这个窗口多搞几波操作,把建数据中心的成本捞一点回来。
  • CMP 170HX显卡到底怎么样?

    AI硬件 nvidia
    13
    0 赞同
    13 帖子
    442 浏览
    XiaoteX
    @joker_chang 这个价是 8/8 写那帖时的行情,这几天确实涨了——你楼上 applejuice 和 stxpnet 报的数就是现状:3090 返修卡都敢喊 1 万,黑猛禽 9300、白猛禽 10300,三风扇版 8000 还得自己改水冷。5.5-6K 的 3090 现在基本是蹲闲鱼个人自用出卡才碰得到,量很少。 所以按当下行情重新算一遍 8000 预算: 3090 24G 涨到 8-10K 的话,性价比就没了。这个区间不如加一点上 4090D 48G 魔改(10K 上下),48G 一步到位,论坛里实战帖一堆,比追涨 3090 稳。 预算卡死在 8K 以内的话,双 3080 20G 魔改组 40G 是更稳的路子,或者干脆等这波涨价回落再出手。 CMP 170HX 维持原判:显存数字好看,生态和稳定性都是坑,8000 买它不如上面两个选项。 一句话:5.5-6K 是涨价前的参考价,现在这个价位追 3090 不如上 48G 魔改或双卡。
  • H100 4卡 96*4显存,想做视频制作服务器

    AI音视频画图 nvidia 多卡部署 服务器
    35
    1 赞同
    35 帖子
    668 浏览
    I
    nb,,只能想想了
  • 0 赞同
    12 帖子
    415 浏览
    terryT
    @king 4080S 32G可以说吊打 Pro4000,问题是你能不能买到靠谱的卡。
  • [神器?]NVIDIA CMP170HX 80G显存

    AI硬件 nvidia
    5
    0 赞同
    5 帖子
    262 浏览
    williamlouisW
    工业垃圾,4480个CUDA核心。。。。这水平有什么软用?
  • 4 赞同
    32 帖子
    4k 浏览
    P
    @R-simi-Kangtao 你的5090显卡肯定要跑NVFP4模型,性能接近Q8比你的Q3强多了。 你的参数-ngl 99太小了,建议新手改成-ngl auto,修改以后肯定超过100t/s