跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
  • LCZ-Black
折叠
品牌标识

抡锤者

首页 版块 标签 硬件 AI 广场
  1. 主页
  2. 版块
  3. AI硬件
  4. 我换回3.6 35B了

我换回3.6 35B了

已定时 已固定 已锁定 已移动 AI硬件
qwen
24 帖子 15 发布者 750 浏览 1 关注中
  • 从旧到新
  • 从新到旧
  • 最多赞同
回复
  • 在新帖中回复
登录后回复
此主题已被删除。只有拥有主题管理权限的用户可以查看。
  • daniel zhouD 离线
    daniel zhouD 离线
    daniel zhou
    编写于 最后由 编辑
    #12

    ornith1.5下载中...

    daniel zhouD 1 条回复 最后回复
    0
    • fcmeF fcme

      @kos-or
      哦,我的是r9700,没有试Q5以下的版本,Q5反正挺好用

      kos orK 离线
      kos orK 离线
      kos or
      技术大牛 劳动模范
      编写于 最后由 编辑
      #13

      @fcme

      我現在被32GB VRAM卡住了 Q5用不起 😢
      好吧 等以後有緣分再試試

      1 条回复 最后回复
      0
      • daniel zhouD daniel zhou

        ornith1.5下载中...

        daniel zhouD 离线
        daniel zhouD 离线
        daniel zhou
        编写于 最后由 编辑
        #14

        1.5 ornith测试中,太慢了,Deepseek说由于新框架的原因,不建议现在部署,等段时间吧

        1 条回复 最后回复
        0
        • imbiplaza ASUSI 在线
          imbiplaza ASUSI 在线
          imbiplaza ASUS
          至尊王者
          编写于 最后由 编辑
          #15

          我现在q3.8 不是live,而是 开,关,开关。。。留言学习。。。。。。。

          https://lcz.me/project/dcs

          1 条回复 最后回复
          0
          • K 离线
            K 离线
            kadingche
            编写于 最后由 编辑
            #16

            这里楼主的机器配置是什么样的似乎并没清楚。如果是类似于英伟达的显卡,那么使用稠密模型27B。如果是使用的Mac电脑,那么就使用MoE模型3.6 35B,在此基础上才能讨论是使用3.6还是3.8版本,我个人还没有测试3.8版本,只能说以上是自己的理解。不吝赐教

            daniel zhouD 1 条回复 最后回复
            0
            • K kadingche

              这里楼主的机器配置是什么样的似乎并没清楚。如果是类似于英伟达的显卡,那么使用稠密模型27B。如果是使用的Mac电脑,那么就使用MoE模型3.6 35B,在此基础上才能讨论是使用3.6还是3.8版本,我个人还没有测试3.8版本,只能说以上是自己的理解。不吝赐教

              daniel zhouD 离线
              daniel zhouD 离线
              daniel zhou
              编写于 最后由 编辑
              #17

              @kadingche 7900XTX

              1 条回复 最后回复
              0
              • 西域草影西 离线
                西域草影西 离线
                西域草影
                编写于 最后由 编辑
                #18

                尝试了一下Ornith-1.5-35B-A3B,确实比Qwen3.6-35B-A3B好用(双6800xt llama.cpp-turboquant-hip)。每秒51t/s,比Qwen稍慢一点,但是一些中短链任务能力实测要比Qwen强。

                kos orK 1 条回复 最后回复
                0
                • S 离线
                  S 离线
                  stormaround
                  编写于 最后由 编辑
                  #19

                  35b经常死循环,一直重复

                  sean leeS 1 条回复 最后回复
                  0
                  • S stormaround

                    35b经常死循环,一直重复

                    sean leeS 离线
                    sean leeS 离线
                    sean lee
                    编写于 最后由 编辑
                    #20

                    @stormaround 确实,俺也1样

                    1 条回复 最后回复
                    0
                    • 西域草影西 西域草影

                      尝试了一下Ornith-1.5-35B-A3B,确实比Qwen3.6-35B-A3B好用(双6800xt llama.cpp-turboquant-hip)。每秒51t/s,比Qwen稍慢一点,但是一些中短链任务能力实测要比Qwen强。

                      kos orK 离线
                      kos orK 离线
                      kos or
                      技术大牛 劳动模范
                      编写于 最后由 kos or 编辑
                      #21

                      @西域草影

                      我用的是 Ornith-1.5-35B-A3B-NVFP4 , N卡專用格式, 速度約 120~180 tok/s
                      速度恨快 但穩定性不佳, 雖然結果不會出錯 但過程試錯的程度太高 (類似鬼打牆 東撞西撞) , 忘東忘西的, 不過它的自我審查機制都會把它導到正確的道路上

                      這個當聊天工具, 查資料和輕度工作使用 非很快, 多併發使用沒問題,
                      如果配合上好的Engineering Harness 框架 例如Deepseek Harnesss 可能也不錯

                      我覺得是個有潛力的model, 應該可以調整的更好
                      或許Q8, Q6, Q5 高精度版本會有更好的表現

                      1 条回复 最后回复
                      0
                      • stxpnetS 离线
                        stxpnetS 离线
                        stxpnet
                        超凡大师
                        编写于 最后由 编辑
                        #22

                        35B是文科生,擅长写文章吹水,收集资讯。 编程的话,就是俗称的抽卡了,看运气的。

                        26-08-19
                        双卡3090(8x8x无nvlink,p2p驱动) +Sglang+qwen 3.8 27B awq模型 [功耗异常弃用]
                        8-20 用vllm 0.26+ Qwen3.8-27B-SmoothQuant-W8A8-INT8 200K上下文 ~50t/s

                        terryT 1 条回复 最后回复
                        0
                        • stxpnetS stxpnet

                          35B是文科生,擅长写文章吹水,收集资讯。 编程的话,就是俗称的抽卡了,看运气的。

                          terryT 在线
                          terryT 在线
                          terry
                          超级版主
                          编写于 最后由 编辑
                          #23

                          @stxpnet 我弟文采斐然,吹水一次非常生动

                          油管:https://www.youtube.com/@抡锤者

                          1 条回复 最后回复
                          0
                          • Dady PanD 离线
                            Dady PanD 离线
                            Dady Pan
                            编写于 最后由 编辑
                            #24

                            这卡本来就被吹高的

                            1 条回复 最后回复
                            0

                            你好!看起来您对这段对话很感兴趣,但您还没有一个账号。

                            厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。

                            有了你的建议,这篇帖子会更精彩哦 💗

                            注册 登录
                            回复
                            • 在新帖中回复
                            登录后回复
                            • 从旧到新
                            • 从新到旧
                            • 最多赞同


                            • 登录

                            • 登录或注册以进行搜索。
                            • 第一个帖子
                              最后一个帖子
                            0
                            • 版块
                            • 最新
                            • 标签
                            • 热门
                            • 用户
                            • 群组