跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(不使用皮肤)
  • 不使用皮肤
折叠
品牌标识

抡锤者

I

im17me

@im17me
取消关注 关注
关于
帖子
9
主题
0
分享
0
群组
0
粉丝
0
关注
0

帖子

最新 最佳 有争议的

  • 对 M5 MAX 跑本地大模型有点失望
    I im17me

    20260608-144339.jpg
    ScreenShot_2026-06-08_144436_431 (中).png
    M5 Max 128g 短会话MTP 38 token/s, claude code 长会话28 token/s,整体效果还可以啊。

    AI硬件

  • 3080 20G*2的有没有,来交流啊兄弟们
    I im17me

    你主板有我主板烂?Z390 ,我双卡3090 vLLM跑62token/s,单卡36token/s

    AI硬件 rtx3080

  • RTX3080 20g,qwen3.6 27B 60-40T/S 本地爽玩配置
    I im17me

    @applejuice 你的3090加nvlink 有效果吗?能不能说一下提升情况

    AI硬件 nvidia rtx3080

  • 5090 + vLLM + Qwen3.6-27B 成功分享
    I im17me

    实测效果,模型Qwen3.6-27B-AWQ-INT4,5090还没有双卡3090跑的快。双卡3090稳定在60token/s

    LLM讨论区 rtx5090 vllm

  • 【求助】vLLM 单卡 3090 部署 Qwen3.6-27B-INT4,开启 MTP 投机采样触发无限复读(死循环)
    I im17me

    3090单卡跑llama.cpp,比vllm强。显存不够。3090单卡vllm极限配置。
    vllm serve /home/ubuntu/models/Qwen3.6-27B-AWQ-INT4
    --served-model-name Qwen3.6-27B-AWQ-INT4
    --host 0.0.0.0
    --port 8080
    --gpu-memory-utilization 0.98
    --max-model-len 40960
    --max-num-seqs 4
    --max-num-batched-tokens 4096
    --kv-cache-dtype fp8
    --quantization compressed-tensors

    LLM讨论区 rtx3090 mtp vllm

  • 求助各位大佬:3090 24G 显卡想搭一台稳定优先的单 U 服务器,麻烦帮忙看看配置方案
    I im17me

    要啥服务器主板,普通家用主板游戏都行。我用的8700K + Z390主板跑的,挺稳定的,7*24 小时运行。

    AI硬件 rtx3090

  • 软路由及内网穿透 - 请教各位老大
    I im17me

    国内有公网IP的只有电信了,但是需要加100元买动态公网IP地址,其他运营商都是内网,也不能买。

    网络技术

  • 用3090如果只跑llm, 平均一个月用多少kwh 的电?好像比订阅的费用还要贵
    I im17me

    按350w算,大概一天5度电左右

    AI硬件 rtx3090
  • 登录

  • 没有帐号? 注册

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组