跳转至内容
  • 0 赞同
    5 帖子
    250 浏览
    finenan finenanF
    根据你要做的是电商的目标,推荐一个补充方案: 文生文:本地QWEN做基础仿写,推荐搭配上claud code做终稿,分镜推荐用豆包专业版(这方面有几把刷子) 图生视频这方面,WAN和LTX交叉对比使用,5秒的短片段+10-15秒的长片段(预算够建议考虑seedance2.0或以上) TTS:VOXCPM,INDEXTTS2。如果用cosyvoice2来克隆音色,情绪控制和分段方面要格外注意,否则很容易在这个环节浪费大量时间 对口型:除了MUSETALK,推荐github上另一个半开源的ltsmsync,以及推荐在预算够用时,使用火山的omnihuman1.5,1元/S,看是真的省心 剪辑 FFMPEG的自动拼接,目前用过许多次,效果不是很稳定。如果是做电商,推荐同时导出一个剪映工作流做备用
  • 0 赞同
    8 帖子
    184 浏览
    terryT
    @coolstar 我都是随便搞的,没遇到这事.....
  • 0 赞同
    3 帖子
    117 浏览
    XiaoteX
    第一次启动不满载、第二次才满速满功耗,这是典型的显卡 boost 没被及时拉起来,大概率跟 Vulkan 冷启动有关。ROCm 那路能拉满但只有 30t/s,是另一码事(ROCm 路径本身在 LLM 上就慢,跟这个不满载不是同一个问题)。 先量数据再下结论: 在第一次启动时盯着 GPU 测频测功耗:radeontop -1(需要权限)或 rocm-smi --showclocks --showpower --showtemp。如果第 1 次跑的时候频率一直停在 idle 低档(几百 MHz、功率几十瓦),第 2 次才顶到 boost 档、功率上到 200W+,那就坐实了是 DPM(Dynamic Power Management)没把卡推上 performance 档。 成因:第一次 launch 会做 shader 编译/缓存,GPU 一直"闲-忙-闲"交替、利用率低,功耗管理器看负荷不够大就压低频;第二次所有 kernel 已缓存,一上来就是高负载,boost 立刻响应。 三个办法按顺序试: 先把 DPM 顶到性能档再启动—— echo performance | sudo tee /sys/class/drm/card*/device/power_dpm_force_performance_level 或 echo high | sudo tee .../device/power_dpm_state(两个都试,机型不同生效字段不同) 加个"暖机":先很短跑一段(--n-predict 8)把 kernel 缓存热起来,再正常起服务。 确认 power_dpm_state 当前是不是 auto/battery,改成 performance 再跑一遍看是否首次就满速。 另外你说的"电源 reset"——如果强制拉满后瞬间重启,才算真电源问题,回到 johnnybegood 说的用 MSI Burner 看功耗曲线核实瞬时峰值。先把上面三步跑完,判断是驱动档位没推上去,还是供电实质超载,别急着换电源。
  • 我替大家趟趟路 T7910

    AI硬件 x99
    26
    1 赞同
    26 帖子
    648 浏览
    张光璞
    @魏保国 说: 楼主那个店买的,看起来很新,我昨天找了一天都是垃圾成色,没下手,价格还贵平均 1600+ 你等我下周装机后再下手,现在机有准系统我内存和卡还在没。下周去取,下下周装机
  • X99+7900 XTX+7700 XT 跑 vLLM实测

    LLM讨论区 x99 7900xtx vllm
    1
    0 赞同
    1 帖子
    136 浏览
    尚无回复
  • 1 赞同
    17 帖子
    530 浏览
    K
    [image: 9857fcb5-8395-4efe-9651-bedf88faa8c4.png] @909 区别去问ai,ddr3够用,64G有时候能跑满,也够用,有钱就买ddr4,想省钱就贴着边买就行。今天内存干到70G了。
  • 1 赞同
    15 帖子
    468 浏览
    XiaoteX
    @joker_chang 大概率两条都是 CPU 直连、不用过南桥,说下原理和验证方法: X99 的 CPU(Haswell-EP,比如 E5-2696 v4)自带 40 条 PCIe 3.0 通道,主流 X99 主板的前两条主 x16 槽都挂在 CPU 根联上(常见 x16+x16,或 x16+x8+x8 拆分),是直连,不经过南桥; 南桥(X99 PCH)只提供 PCIe 2.0 通道,一般接的是第三、第四根长槽、M.2、SATA/网卡等。如果某条"x16 外观"的槽实际走南桥,真实带宽只有 x4 PCIe 2.0(约 2GB/s),外观和带宽差距很大; 工作站板会见到 PLX 交换芯片把 40 条拆给更多 x16 槽,那是交换芯片、不是南桥,性质仍是 CPU 直连。 验证自己的板: 主板官网/说明书里的 PCIe 通道分配图(最准); Linux 下 lspci -vv 看对应槽位设备报告的 Lane 数(Width x16 还是 x4)和 Speed; lspci -t 看拓扑:挂在 CPU 下(bus 00:01/00:02 这类)还是 PCH 下(00:1c 之类)。 只要两条主槽都在 CPU 直连下,双卡对等使用、卡间数据走 CPU 内部路径,不经过南桥。
  • 3 赞同
    39 帖子
    2k 浏览
    BunseiB
    @kos-or 说: @Bunsei said: 相反我是因为他太有用了,现在一路会话,全天跑满着。所以才打算再加一张卡多开一路。 如果用vLLM 一卡兩路併發 TPS 速度差異不要太大, 然後一個人用 兩卡四路併發 這個就不錯 那我得去试试看
  • 【交作业】华南金牌 X99-TF + E5 2686V4 +蓝宝石7900XTX 白金板

    AI硬件 7900xtx x99
    14
    4 赞同
    14 帖子
    1k 浏览
    C
    昨天要是找到您的这个就好了。顶一下,希望其他朋友能省点力。 谢谢~
  • 0 赞同
    9 帖子
    182 浏览
    C
    @williamlouis 谢谢版主指点。 估计因为商家给的配件描述东鳞西爪,AI也搞不懂到底是什么型号,总说带宽低,条的质量要小心等等。 还是上面几位老大给指明了方向,重新用新的信息问AI,才算确定。
  • 咨询下电源的问题,平台是x99 e52666

    AI硬件 x99
    7
    0 赞同
    7 帖子
    100 浏览
    Nero丶畅畅N
    @terry 感恩,那我就直接下单r9700了,然后在测试下a卡和n卡驱动在ubuntu系统兼容和使用的情况
  • 0 赞同
    4 帖子
    119 浏览
    我的3080 12G除了显存小了点,但是带宽不差,跑跑QWEN3.6 35B A3B也是够用的。
  • 华南金牌--采购做项目验证服务器-求大神经验

    AI硬件 x99 服务器
    3
    0 赞同
    3 帖子
    149 浏览
    terryT
    寨板就特么那点钱,有什么好讨论的,买回来测试下就是了,品质一般没问题。NAS不要考虑,洋垃圾功耗高,服务器没问题。
  • 请教下洋垃圾问题 到底买4790 还是买E5?

    AI硬件 x99 intel
    4
    0 赞同
    4 帖子
    143 浏览
    AGIA
    我是4790换的2696v4,当作homelab,关键内存最大可以到512g,
  • 0 赞同
    7 帖子
    199 浏览
    imbiplaza ASUSI
    我现在的处理方法可以让你参考。。。 本身是i5 12th, 96gb ddr4, rtxpro 4500 32gb 这样的设置跑以流程照样会oom & offload cpu, 一个视频不会,但是累计5,6个视频就开始发作了 我的流程是, comfyui z image > lm studio qwen3.8 > comfyui minimax h3, 后来,干脆加上两种代码, 跑完模型> unload, clear cache 跑前又 > unload, clear cache 同类流程 > unload, 不clear cache 全自动在 comfyui & lm studio 里面游刃有余。。。 之前我还想加多一块显卡去跑lm studio... 其实是不用的,只要控制好代码,不然就算你用b200, 288gb vram, 投入生产后,前面100个视频或者不会,长久的话接二连三就会了。。。
  • 雙 AMD Radeon VII 搭配 X99 洋垃圾跑 Qwen3.8-27B

    LLM讨论区 amd x99 qwen-27b
    6
    0 赞同
    6 帖子
    198 浏览
    williamlouisW
    退役期的设备。发挥余热。项目做起来放更新第一批名单里。
  • 缓存命中99%确实厉害- X99-R9700,Qwen-3.8-27b-越狱模型

    LLM讨论区 x99 r9700 qwen-27b
    4
    0 赞同
    4 帖子
    328 浏览
    XiaoteX
    @wwcd2016 qwen3.8 思考階段死循環是社區確認的通病,3.6 沒有這個毛病(TID:1218 裡 exllm 也確認了同樣現象:q4_0 下 3.8 思考階段容易死循環,調 repeat-penalty 也排不掉)。按順序試三個開關: 一、鎖思考檔位(最有效) 3.8 的 thinking 開 high/xhigh 在長任務上就是容易循環(TID:1136、TID:1147 都有實證)。llama.cpp 用: --jinja --chat-template-kwargs {"reasoning_effort": "medium", "preserve_thinking": true} --reasoning-preserve 日常雜活直接 enable_thinking=false。froggeric 的 v22 模板就是把思考鎖在 low/medium(TID:1151)。Hermes 裡對應把思考檔鎖 low/medium。 二、換量化源 q4_0 在 3.8 上思考階段循環概率明顯高,換 Q4_K_M 或 Q5_K_M 就好很多。不是精度問題,是量化分佈影響 kernel 穩定性(TID:1222 清風明月實測 UD-Q4_K_XL 在 32G 卡上 67 t/s 長時間零崩)。 三、查 MTP/投機解碼 MTP draft 在長上下文時接受率會掉(TID:1131)。如果開了 MTP 還循環,先 --spec-type none 排除。 另外 3.8 的工具調用回歸也是已知的(TID:1199 回過您:3.8 的 thinking + 工具調用比 3.6 不穩),如果主要是 agent/工具任務,鎖 low/medium + 上下文壓在 64K 以內,還不行就 3.6 兜底。
  • 0 赞同
    2 帖子
    176 浏览
    terryT
    https://youtu.be/4fux2XWLrz4
  • 0 赞同
    13 帖子
    453 浏览
    XiaoteX
    @renyi 好问题,核心区别是"走哪条路到 CPU": CPU 直连(CPU 内置 PCIe 控制器):带宽直通,x16 3.0 单方向 16GB/s,延迟最低且独占。显卡、NVMe 这类高吞吐设备首选,多卡更要优先插这里。 PCH(芯片组):所有 PCH 设备——SATA、USB、网卡、M.2、以及走 PCH 的 PCIe 槽——共享同一条 DMI 上行链路到 CPU(X99 上约 4GB/s 级别)。显卡插 PCH 槽,要跟硬盘、网卡、USB 抢带宽,实际可用远低于标称 x16。 怎么分辨:Linux 下 lspci -tv 看拓扑——挂在 CPU Root Port 下的就是直连,挂在 PCH 桥(00:1c.x 这类)下面的就是走芯片组;BIOS 的 PCIe 配置页也会标。 至于"很多 X99 板 PCIE1/2 都是 PCH 连接"——对,廉价板(华南这类)为了省 PCB 层数和走线成本,经常把第二根长槽也挂到 PCH 上。所以买板要看官方的通道分配表,别只看插槽数量。 顺带回答楼上 kos or 的问题:BIOS 的 x8/x8 分叉(bifurcation)只对 CPU 直连的槽有效(把 x16 拆成两个 x8),PCH 槽顶多 x4/x2,拆不出 x8。像这块 CD3,第二根长槽本来就只有 4 条通道,BIOS 怎么设也变不成 x8。
  • 0 赞同
    37 帖子
    1k 浏览
    williamlouisW
    手里的旧货可以折腾。花钱上就没什么意义了。如果手里有4张我也是建议折腾变现是最优解。