跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
折叠
品牌标识

抡锤者

  1. 主页
  2. 版块
  3. LLM讨论区
  4. 本地跑双 Qwen3.8-27B 实践实录:官方原版 + 去拒答版,200K 上下文全量部署与实测数据

本地跑双 Qwen3.8-27B 实践实录:官方原版 + 去拒答版,200K 上下文全量部署与实测数据

已定时 已固定 已锁定 已移动 LLM讨论区
qwen-27b多卡部署本地模型
11 帖子 5 发布者 351 浏览
  • 从旧到新
  • 从新到旧
  • 最多赞同
回复
  • 在新帖中回复
登录后回复
此主题已被删除。只有拥有主题管理权限的用户可以查看。
  • 清风明月清 离线
    清风明月清 离线
    清风明月
    编写于 最后由 编辑
    #2

    实测可以全量262K上下文无压力,但看了锤哥的视频及其它帖子,太高的上下文意义不大,还占显存,200K够用了。

    1 条回复 最后回复
    0
    • ,terryT terry 固定了此主题
    • terryT 离线
      terryT 离线
      terry
      超级版主
      编写于 最后由 编辑
      #3

      确实不用追求太高上下文,deepseek harness对上下文处理很克制,不滥用。128k上下文就能解决大多数需求,实在搞不定换在线,那消耗就小多了。说实话,我测试了下,就是用来干脏活,修修补补也不如在线的体验舒服,但是不要钱。

      油管:https://www.youtube.com/@抡锤者

      1 条回复 最后回复
      0
      • ,terryT terry 将此主题从 AI Agent 移至此处
      • 清风明月清 离线
        清风明月清 离线
        清风明月
        编写于 最后由 清风明月 编辑
        #4

        确实,都是涨价惹的祸,没办法,本地还是要有一个能处理简单任务的免费模型,哎,要是不涨价,deepseek-v4-flash用得多舒服!还是设为128K了。

        1 条回复 最后回复
        0
        • 清风明月清 离线
          清风明月清 离线
          清风明月
          编写于 最后由 编辑
          #5

          现在感觉量大管饱的在opencode go套餐里只有mimo-v2.5这一个选择了,虽然多模态不错,但驱动hermes和harness感觉效果比deepseek-v4-flash差多了。

          terryT 1 条回复 最后回复
          0
          • 清风明月清 清风明月

            现在感觉量大管饱的在opencode go套餐里只有mimo-v2.5这一个选择了,虽然多模态不错,但驱动hermes和harness感觉效果比deepseek-v4-flash差多了。

            terryT 离线
            terryT 离线
            terry
            超级版主
            编写于 最后由 编辑
            #6

            @清风明月 是的,v4flash还是不贵啊,还是能玩的。

            油管:https://www.youtube.com/@抡锤者

            清风明月清 rock shiR 2 条回复 最后回复
            0
            • terryT terry

              @清风明月 是的,v4flash还是不贵啊,还是能玩的。

              清风明月清 离线
              清风明月清 离线
              清风明月
              编写于 最后由 编辑
              #7

              @terry 说:

              是的,v4flash还是不贵啊,还是能玩的。

              是的,不用也没比它更好的选择,即使涨价,也是性价比最高的,只是我们习惯了之前的定价而已!

              1 条回复 最后回复
              0
              • terryT terry

                @清风明月 是的,v4flash还是不贵啊,还是能玩的。

                rock shiR 在线
                rock shiR 在线
                rock shi
                劳动模范 德高望重
                编写于 最后由 编辑
                #8

                @terry 看来锤子哥还是赚钱,其实DeepSeek这个价格对一般还没怎么变现的用户来说成本算是比较高,如果单靠DeepSeek去试错的话,现在成本要一天四五十块钱,要是已经有变现能力了当然这个确实不算高

                kos orK 1 条回复 最后回复
                0
                • rock shiR rock shi

                  @terry 看来锤子哥还是赚钱,其实DeepSeek这个价格对一般还没怎么变现的用户来说成本算是比较高,如果单靠DeepSeek去试错的话,现在成本要一天四五十块钱,要是已经有变现能力了当然这个确实不算高

                  kos orK 离线
                  kos orK 离线
                  kos or
                  技术大牛 劳动模范
                  编写于 最后由 编辑
                  #9

                  @rock-shi said:

                  如果单靠DeepSeek去试错的话,现在成本要一天四五十块钱

                  差不多 我之前使用平均都在一天兩美元以內 漲價第一天就增加到US$7.7, 這都是在不含coding狀況下的使用金額

                  目前是本地模型 + GPT Luna 混用, 暫時不用Deepseek-V4-Flash了

                  stxpnetS 1 条回复 最后回复
                  0
                  • kos orK kos or

                    @rock-shi said:

                    如果单靠DeepSeek去试错的话,现在成本要一天四五十块钱

                    差不多 我之前使用平均都在一天兩美元以內 漲價第一天就增加到US$7.7, 這都是在不含coding狀況下的使用金額

                    目前是本地模型 + GPT Luna 混用, 暫時不用Deepseek-V4-Flash了

                    stxpnetS 离线
                    stxpnetS 离线
                    stxpnet
                    超凡大师
                    编写于 最后由 编辑
                    #10

                    @kos-or 还好吧,我目前只有配置27B新模型和框架的时候才开一下deepseek。 其它时候就用本地最好的27B模型跑任务。大大解放了。 就是月底电费还不知道怎样。

                    26-08-19
                    双卡3090(8x8x无nvlink,p2p驱动) +Sglang+qwen 3.8 27B awq模型 [功耗异常弃用]
                    8-20 用vllm 0.26+ Qwen3.8-27B-SmoothQuant-W8A8-INT8 200K上下文 ~50t/s

                    kos orK 1 条回复 最后回复
                    0
                    • stxpnetS stxpnet

                      @kos-or 还好吧,我目前只有配置27B新模型和框架的时候才开一下deepseek。 其它时候就用本地最好的27B模型跑任务。大大解放了。 就是月底电费还不知道怎样。

                      kos orK 离线
                      kos orK 离线
                      kos or
                      技术大牛 劳动模范
                      编写于 最后由 编辑
                      #11

                      @stxpnet

                      主要是我Deepseek這個月額度沒了, GPT額度夠,
                      跑本地 电费應該還行 不太可能像ComfyUI產圖一樣GPU核心高瓦數下一直跑;
                      有人使用地端模型家中電費飆升的嗎?

                      一台機器 600W 每天持續運作8小時, 連續30天 一個月的電費約在20美元以內

                      1 条回复 最后回复
                      0
                      • ,系统 取消固定了此主题

                      你好!看起来您对这段对话很感兴趣,但您还没有一个账号。

                      厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。

                      有了你的建议,这篇帖子会更精彩哦 💗

                      注册 登录
                      回复
                      • 在新帖中回复
                      登录后回复
                      • 从旧到新
                      • 从新到旧
                      • 最多赞同


                      • 登录

                      • 登录或注册以进行搜索。
                      • 第一个帖子
                        最后一个帖子
                      0
                      • 版块
                      • 最新
                      • 标签
                      • 热门
                      • 用户
                      • 群组