跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(不使用皮肤)
  • 不使用皮肤
折叠
品牌标识

抡锤者

A

applejuice

@applejuice
技术大牛 劳动模范
取消关注 关注
关于
帖子
204
主题
10
分享
0
群组
2
粉丝
2
关注
0

帖子

最新 最佳 有争议的

  • 大热的3090风冷改造方案 大幅降温稳定AI大脑
    A applejuice

    @Leon-Y 换了电源就没事了? 我的症状跟你有点不同 也不懂是什么问题

    你的nvlink 3 slot 版本?

    AI硬件 rtx3090

  • 关于显卡的购买。
    A applejuice

    想了解 ai 崩掉的原因

    随便聊聊

  • 大热的3090风冷改造方案 大幅降温稳定AI大脑
    A applejuice

    @Leon-Y 我羡慕nvlink
    想问是什么平台

    AI硬件 rtx3090

  • 想问 成功用上 nvlink 3090 的你们. 是用在什么平台上?
    A applejuice

    @terry
    暂时根据ai看来 是gpu 出问题
    已经第2个nvlink 一样问题
    第一个nvlink 卖家用别的卡测试也是有问题

    感觉 4张 gpu 2条nvlink 都刚好出问题
    所以怀疑是平台问题

    AI硬件

  • SGLANG跑RTX4090D-48G-QWEN3.6-27B-FP8配置
    A applejuice

    @terry 说:

    @applejuice 这个我可以参考下,抄作业,有空弄下。awq的还是值得玩的。你Hermes调度时,有思考过程吗?

    6c677317-ae1b-43f5-a2fd-7ba5ea72e3e3-image.jpeg

    有的.
    其实也不是我弄的
    ai 全自动搞

    LLM讨论区 sg-lang qwen3.6-27b

  • SGLANG跑RTX4090D-48G-QWEN3.6-27B-FP8配置
    A applejuice

    @用户名违规 是的 3090

    LLM讨论区 sg-lang qwen3.6-27b

  • SGLANG跑RTX4090D-48G-QWEN3.6-27B-FP8配置
    A applejuice

    跟着 https://github.com/mattbucci/2x-3090-GA102-300-A1-sglang-inference
    我也用起来了 3090x2

    python -m sglang.launch_server
    --model-path /home/ccadmin/AI/models/hf-mattbucci/Qwen3.6-27B-AWQ
    --tensor-parallel-size 2
    --dtype float16
    --kv-cache-dtype fp8_e4m3
    --context-length 262144
    --mem-fraction-static 0.85
    --max-running-requests 8
    --chunked-prefill-size 8192
    --num-continuous-decode-steps 32
    --trust-remote-code
    --watchdog-timeout 600
    --port 30000
    --host 0.0.0.0
    --enable-metrics
    --disable-custom-all-reduce
    --served-model-name qwen36-dense
    --max-mamba-cache-size 8
    --chat-template …/Qwen3.6-27B-AWQ/chat_template.jinja
    --reasoning-parser qwen3
    --sampling-defaults model
    --tool-call-parser qwen3_coder
    --sampling-backend pytorch

    Prefill (time-to-first-token, max_tokens=1)

    Prompt tokens TTFT (s) Prefill rate (tok/s)
    1,344 1.12 1,203
    5,352 3.83 1,398
    10,680 7.71 1,386
    21,336 15.58 1,369
    42,672 33.41 1,277
    Typical — ~1,350

    Decode (steady-state generation)

    Metric Value
    Completion tokens 571
    Time (s) 9.16
    Decode rate 62.3 tok/s
    GPU utilization 98%
    Power draw 244 W (cap)
    Repo ref (w/ NVLink) 69 tok/s
    LLM讨论区 sg-lang qwen3.6-27b

  • 想问 成功用上 nvlink 3090 的你们. 是用在什么平台上?
    A applejuice

    想问 成功用上 nvlink 3090 的你们. 是用在什么平台上?

    我换了两个nvlink 问题都一样
    卖家测试不同的卡也是一样问题

    通道 3 一直报错

    AI硬件

  • 8g的HBM矿卡170hx解封了
    A applejuice

    @c0aster 暂时来看 只有大显存优势
    肯定不值7000-8000的价钱
    2000 都还要考虑

    AI硬件

  • 8g的HBM矿卡170hx解封了
    A applejuice

    @fcme 有便宜的玩玩还可以 5000-6000 就不好玩了
    等他跌回1000 才买来玩吧

    AI硬件

  • 大热的3090风冷改造方案 大幅降温稳定AI大脑
    A applejuice

    @znl 不大敢搞水冷 怕弄坏了

    AI硬件 rtx3090

  • 8g的HBM矿卡170hx解封了
    A applejuice

    @maverick 暴涨就没动力试了

    AI硬件

  • 3090x2 nvlink 翻车
    A applejuice

    记错了 是26%,差不多30%了

    Heretic (qwen3.6-27b-heretic) — NVLink vs No-NVLink (TP=2, 245 W cap)

    Metric With NVLink Without NVLink (NCCL_P2P_DISABLE=1) Change
    Decode, single-stream (tok/s) 68 65.6 −3.5 %
    Prefill, cold (tok/s) ~1,950 ~1,438 −26 %
    AI硬件 rtx3090

  • 3090x2 nvlink 翻车
    A applejuice

    话说 nvlink 少了nvlink 就损失了 20% prefill 速度.

    AI硬件 rtx3090

  • 3090x2 nvlink 翻车
    A applejuice

    @terry 我一开始就买了 只是有问题 一直在折腾
    快一个月了 现在证实翻车

    AI硬件 rtx3090

  • 3090x2 nvlink 翻车
    A applejuice

    买的两张涡轮3090
    link3 严重报错
    高强度 跑模型 gpu 会假死.
    换了两个nvlink bridge 都不行,应该是显卡问题了

    这波亏了不止2000

    继续用个2-3年存钱换5090 好了.

    AI硬件 rtx3090

  • 大热的3090风冷改造方案 大幅降温稳定AI大脑
    A applejuice

    我前两天要把卡移下一格 结果发现 机箱根本没地方了

    AI硬件 rtx3090

  • 让你们看看垃圾魔改卡2080ti 的威力 qwen3.6-27b fp8 精度 速度能到 60tokens/s nvlink 连接
    A applejuice

    @Metal-Zhao 为什么超过双3090?的确是便宜过3090好多

    AI硬件

  • 双3090 本地AI,大家现在还用消费级平台,还是已经转 TRX40 了?
    A applejuice

    @williamlouis 但是现在5090 太贵了
    可以用3年就当赚到

    AI硬件 rtx3090
  • 登录

  • 没有帐号? 注册

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组