跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
  • LCZ-Black
折叠
品牌标识

抡锤者

首页 版块 标签 硬件 AI 广场
G

gwager

@gwager
取消关注 关注
关于
帖子
5
主题
0
分享
0
群组
0
粉丝
0
关注
0

帖子

最新 最佳 有争议的

  • Qwen3.8-27B 量化全格式橫評:從 IQ2_XXS 到 Q6_K,14 種格式誰才是甜點?
    G gwager

    我用 5060 ti 16G 跑 Qwen3.8-27B-UD-IQ4_XS (Unsloth Dynamic 3.0),感覺不弱智還挺不錯,試過單次請求使用了64k tokens還沒OOM,Prefill 576 t/s,平均速度有 41 t/s

    e9f7a727-938c-413a-aec1-e65b36ce79c0-image.jpeg

    LLM讨论区 qwen-27b 量化 llama.cpp

  • RTX 5070 Ti 16GB 跑 Qwen3.8-27B:16G 卡量化選擇、啟動配置與基準數據
    G gwager

    @王池川 说:

    5060 Ti 是 288 GB/s

    5060 Ti VRAM帶寬是448 GB/s,沒那樣不堪!
    基本上 5070 Ti能跑的,5060 Ti 16G也能跑,就是慢些罷了!

    AI硬件 qwen-27b 量化

  • 16GB显存极限挑战:RTX 5070 Ti 本地部署 Qwen3.6-27B (Q4) 调优指南与实测报告
    G gwager

    要不試試跑專為16GB VRAM搞出來的Q4 XS版本,能夠完整塞進VRAM裡,犧牲些微智力換取速度,速度應可翻兩三倍吧!

    LLM讨论区 本地模型 rtx5090 qwen-27b 量化

  • 我是64G内存 5070t 16Gi显卡 Windows10,Qwen3.6-27B MTP优化问题
    G gwager

    LLM讨论区裡有篇「大模型16G卡的春天」,用Qwen3.6-27B-i1-IQ4_XS.gguf以ik_llama.cpp加载,5060ti單卡能跑50k上下文,速度25-27t/s,你5070ti或許真有機會能到50t/s的速度。

    AI硬件 mtp

  • 平民AI硬件参数对比
    G gwager

    忘記在哪找到的截圖
    顯卡算力.png

    AI硬件
  • 登录

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组