跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
折叠
品牌标识

抡锤者

C

coolstar

@coolstar
取消关注 关注
关于
帖子
6
主题
1
分享
0
群组
0
粉丝
0
关注
0

帖子

最新 最佳 有争议的

  • RTX 5070 Ti 16GB 跑 Qwen3.8-27B:16G 卡量化選擇、啟動配置與基準數據
    C coolstar

    谢谢评测,非常详尽!
    请问 RTX 5060 Ti 16GB 这个卡可以期待 NVFP4 (Blackwell 專用) 版吗?

    AI硬件 qwen-27b 量化

  • Kimi K3编程,SVG绘图,Agent能力实测,能力不错,但成本较高,过度思考,风格很像Claude,能够做到国产平替,但是不如Deepseek等有性价比!
    C coolstar

    @terry 嗯,就像奢侈品,质量、用途也完全配不上其价格。

    LLM讨论区 deepseek claude

  • Kimi K3编程,SVG绘图,Agent能力实测,能力不错,但成本较高,过度思考,风格很像Claude,能够做到国产平替,但是不如Deepseek等有性价比!
    C coolstar

    同意老特的观点, 不过kimi顶多算个高仿。

    LLM讨论区 deepseek claude

  • 12G 及以下显存的朋友可以试试这个,号称Qwen3.6-35B-A3B专家模型 在4g 显存能跑19t/s
    C coolstar

    @stxpnet 说:

    我的P100 16G显卡上面主要跑QWEN 3.5 9B,Q4KM,效果还行。

    嗯,9B 也很不错了,我的能跑非常流畅,处理文档什么的秒回。

    就是参数少点,觉得有点虚,所以一直在折腾35B这个,满足一下虚虚荣心。

    话说也没用编程任务实测过,不知道到底智商能力上有多大差别。

    LLM讨论区 本地模型 qwen-27b

  • 12G 及以下显存的朋友可以试试这个,号称Qwen3.6-35B-A3B专家模型 在4g 显存能跑19t/s
    C coolstar

    我在12g 显存上实测 256k上下文 + mmproj 能到40t/s,干点普通活感觉可以用了。

    原帖:

    https://www.reddit.com/r/LocalLLM/comments/1unmzqc/surprisingly_fast_qwen3635ba3b_on_a_4_gb_vram/

    他的脚本参数:

    
    /opt/llama.cpp/build/bin/llama-server \
    -m /opt/llama.cpp/models/Qwen3.6-35B-A3B-UDT-Q4_K_XL_MTP.gguf \
    --host 0.0.0.0 \
    --port 8080 \
    -c 64000 \
    -ngl 999 \   
    --override-tensor "blk\..*\.ffn_(gate_up|gate|up|down)_exps\.weight=CPU"
    --flash-attn on \
    --cache-type-k q8_0 \
    --cache-type-v q8_0 \
    --mlock \
    -b 3072 \
    --ubatch-size 3072 \
    -ctxcp 128 \
    --reasoning off \
    --parallel 1 \
    -t 6 \
    -tb 12 \
    --cache-ram 16384 \
    --swa-full \
    --no-kv-unified \
    --spec-type none \
    --cache-reuse 256 \
    
    LLM讨论区 本地模型 qwen-27b

  • 关于 Hermes 干活的, 严!重!警!告!!!
    C coolstar

    一直弄不太清楚Agent和它挂接的LLM,哪个在这种事情上的责任多一些。
    我用Opencode挂DeepSeek, 似乎也觉得它挺放飞自我的,其他模型感觉好些,不知道是不是心理作用。

    AI Agent hermes
  • 登录

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组