跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(不使用皮肤)
  • 不使用皮肤
折叠
品牌标识

抡锤者

V

vosrock

@vosrock
德高望重 劳动模范
取消关注 关注
关于
帖子
80
主题
2
分享
0
群组
2
粉丝
1
关注
0

帖子

最新 最佳 有争议的

  • 3090x2 nvlink 翻车
    V vosrock

    我觉得能跑就行了,反正也只是跑轻量的脏活或者简单工作,也没必要投入太多资金。

    AI硬件 rtx3090

  • RTX3080 20g,qwen3.6 27B 60-40T/S 本地爽玩配置
    V vosrock

    这是幻觉,无法避免的,这个时候你可以让他将当前任务拆分,然后顺序执行,搞定

    AI硬件 nvidia rtx3080

  • Kimi K3编程,SVG绘图,Agent能力实测,能力不错,但成本较高,过度思考,风格很像Claude,能够做到国产平替,但是不如Deepseek等有性价比!
    V vosrock

    就算是V4 PRO也贵不了多少,为啥要用其他呢

    LLM讨论区 deepseek claude

  • 和hermes对线的日常
    V vosrock

    让他查资料的话,在线的会猜答案,HERMES相对老实的真的去查

    AI音视频画图 hermes

  • 5070ti super 5080 super 24gb
    V vosrock

    性价比的话,目前最高还是308020G,应该没有之一了,不过得需要点技术和勇气

    AI硬件 rtx5080

  • 让你们看看垃圾魔改卡2080ti 的威力 qwen3.6-27b fp8 精度 速度能到 60tokens/s nvlink 连接
    V vosrock

    又多了一个性价比之选,显存大还是硬道理

    AI硬件

  • RTX3080 20g,qwen3.6 27B 60-40T/S 本地爽玩配置
    V vosrock

    这是新的配置,之前的配置上下文到了100多K之后,KV缓存会耗费大量时间做交换,用这个配置就不会了,后期的速度会快很多,能明显感觉到
    这个配置初始大概有60多T/S PREFILL大约1200T/S,上下文快满了的时候大概40T/S,PREFILL大约500T/S,实际上和在线API的感觉没什么很大区别了

    AI硬件 nvidia rtx3080

  • RTX3080 20g,qwen3.6 27B 60-40T/S 本地爽玩配置
    V vosrock
    启用集成显卡很有帮助,可以设置168960KV
    .\hermeswork\llama.cpp\build\bin\Release\llama-server.exe -m D:\hermeswork\models\Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved.i1-IQ4_XS.gguf `
     -c 168960`
     -ngl 99 `
     -t 24 `
     -tb 24 `
     -b 2048 `
     -ub 256 `
     -np 1 `
     --temp 0.15 `
     --top-p 0.9 `
     --top-k 40 `
     --min-p 0.05 `
     --presence-penalty 1.0 `
     --repeat-penalty 1.05 `
     --flash-attn on `
     -ctk q4_0 `
     -ctv q4_0 `
     --reasoning off `
     --kv-offload `
     --spec-type draft-mtp `
     --spec-draft-n-max 2 `
     --checkpoint-every-n-tokens 16384 `
     --ctx-checkpoints 64 `
     --cache-reuse 4096 `
     --no-context-shift `
     --cache-ram 24576 `
     --host 0.0.0.0 `
     --port 11434 `
     --mmap `
     --mlock ` 
    
    
    AI硬件 nvidia rtx3080

  • AMD将Radeon显卡价格上调10%,你赚到了吗?
    V vosrock

    @applejuice 现在肯定没有,会有的

    AI硬件 amd

  • RTX3080 20g,qwen3.6 27B 60-40T/S 本地爽玩配置
    V vosrock

    @最是沉醉 我为KV设置了内存缓存,这个我还不知道有没有帮助,反正我内存大,没有负面影响,
    其实不需要担心,一旦模型OFFLOAD,速度立马就会变慢,以我的急性子是不可能感受不到的

    AI硬件 nvidia rtx3080

  • AMD将Radeon显卡价格上调10%,你赚到了吗?
    V vosrock

    没事,也就是这两年顶一下,很快就能用上几千块的A100了

    AI硬件 amd

  • 用deepseek V4 flash/Pro的死循环问题
    V vosrock

    这个问题让HERMES自己改设置就可以了

    随便聊聊 deepseek

  • 【国产替代】智铠100 32Gx2部署Qwen3.6-35B-W4A8含多并发测试结果
    V vosrock

    反正后面都是要全力工作的了,待机功耗大无所谓拉

    AI硬件

  • 显卡温度会影响大模型的智能吗?
    V vosrock

    不一定是错误结果,反正都是概率预测工具嘛,预测到了另外一条路线去了,不过显卡温度太高确实不好,我这卡到手半年了,估计一直78°这么玩下去很快完蛋,还是放弃静音,将风扇转速拉满吧

    随便聊聊

  • 显卡温度会影响大模型的智能吗?
    V vosrock

    打错字了,是外出的时候把空调关掉了

    随便聊聊

  • 显卡温度会影响大模型的智能吗?
    V vosrock

    昨天HERMES跑着任务,我外出时候把空调管理,回来发现电脑重启了,再跑任务好像有点花品的样子,然后我就空调开上,用小飞机将显卡风扇拉满,显卡温度重78°降到68°,有个神奇的事情发生了,卧槽,感觉HERMES的工作质量变高了,有哥们有同样的发现或者感受吗?显卡的冷热,大模型的能力也会有变化?哈哈,吹个水,虽然我真的有这种感觉

    随便聊聊

  • 【交作业】Z390 + 7900XTX,跑vulkan + MTP + 128K上下文,opencode速度33~49tps尚可,但是没人说Qwen3.6 27b MTP不支持视觉啊,换35b-vl-mtp就有视觉了,70~80 tps 快的飞起
    V vosrock

    将温度降低,一定程度可以抵御KV量化的影响

    AI硬件 7900xtx mtp open-code

  • 【经验分享+求助】双卡(3090+3070)混插:Windows vs Ubuntu 跑 Qwen/LTX-Video 性能实测
    V vosrock

    我不是说用核显来进行AI,而是让他处理桌面,UI这些,刚才实测了,确实可以节省至少600M显存,没有想象的多,不过也挺好的

    AI硬件 rtx3090 rtx3070 ltx

  • 【经验分享+求助】双卡(3090+3070)混插:Windows vs Ubuntu 跑 Qwen/LTX-Video 性能实测
    V vosrock

    @johnnybegood 你别说,2G显存很关键的,这么说的话,我得启用我的CPU显卡了,卧槽,如果多了2G显存的话,我不敢想我的显卡有多强啊,哈哈

    AI硬件 rtx3090 rtx3070 ltx

  • 终于体会到本地干活儿的爽了
    V vosrock

    格式可以完整保留吗?这个很重要啊,其实收费的那些,图文混排做得也不是很好

    AI Agent
  • 登录

  • 没有帐号? 注册

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组