跳转至内容
  • 首页
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(不使用皮肤)
  • 不使用皮肤
折叠
品牌标识

抡锤者

Chang Ching-ChunC

Chang Ching-Chun

@Chang Ching-Chun
取消关注 关注
关于
帖子
7
主题
0
分享
0
群组
0
粉丝
0
关注
1

帖子

最新 最佳 有争议的

  • 本地大模型部署记录:Qwen3.6-27B MTP 在双 7900 XTX 上的推理优化
    Chang Ching-ChunC Chang Ching-Chun

    @Chan-Ivan 说:

    剩余 VRAM 不足以支持满 64K 的 KV cache

    KV cache 做 TurboQuant 量化,看你的配置應該可以放到 256K context

    LLM讨论区 7900xtx mtp

  • 本地大模型部署记录:Qwen3.6-27B MTP 在双 7900 XTX 上的推理优化
    Chang Ching-ChunC Chang Ching-Chun

    感謝大大的測試分享,好人一生平安👍

    LLM讨论区 7900xtx mtp

  • M5pro 64G LLM性能参考.
    Chang Ching-ChunC Chang Ching-Chun

    感謝大大無私的分享!
    我有在猶豫要不要等 MacStudio M5Ultra,不過就現在看起來 CP 值可能不太高😢 我有看國外 YT 跑 Qwen-3.6-27B 4bit 在 MBP M5Max 128GB 上,TG 大概就是 23 t/s, PP 忘記多少,就最近觀看的數據相比於 7900XTX, 距離是被甩開的,就再等看看 MacStudio M5Ultra 出來的表現囉~
    總之,謝謝大大分享,給我們這實用的數據👍

    AI硬件 mac

  • Lucebox DFlash + PFlash 编译与部署指南 Qwen3.6-27B 方便抄作业 (Linux)
    Chang Ching-ChunC Chang Ching-Chun

    感謝大大無私分享,DFlash 概念很酷,跟 Pyramid 算法很像,更有效發揮顯卡效能!
    另外想請問,DFlash 跟 MTP 不能混著用對吧?感覺是相互排斥的

    LLM讨论区 dflash linux

  • 部署llm用于写代码,构建本地项目
    Chang Ching-ChunC Chang Ching-Chun

    感謝大大,數據非常詳盡👍

    LLM讨论区

  • 分享自己的經驗 # 7900 XTX 本地 LLM 優化實測報告(Qwen3.6-27B)
    Chang Ching-ChunC Chang Ching-Chun

    感謝大大無私分享😊

    LLM讨论区 7900xtx

  • 7900XTX + llama.cpp Qwen3.6 27B TurboQuant + MTP 测试结果分享
    Chang Ching-ChunC Chang Ching-Chun

    感謝大神分享!好人一生平安

    LLM讨论区 7900xtx mtp llama.cpp
  • 登录

  • 没有帐号? 注册

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 首页
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组