跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
折叠
品牌标识

抡锤者

  1. 主页
  2. 版块
  3. 随便聊聊
  4. DeepSeek涨价?在线AI模型性价比盘点,HY3和小米MiMO API不错。GPT Plus订阅套餐很划算!字节跳动杀猪盘,Gemini变傻了~

DeepSeek涨价?在线AI模型性价比盘点,HY3和小米MiMO API不错。GPT Plus订阅套餐很划算!字节跳动杀猪盘,Gemini变傻了~

已定时 已固定 已锁定 已移动 随便聊聊
deepseekgptgeminiqwen
13 帖子 6 发布者 372 浏览
  • 从旧到新
  • 从新到旧
  • 最多赞同
回复
  • 在新帖中回复
登录后回复
此主题已被删除。只有拥有主题管理权限的用户可以查看。
  • terryT 离线
    terryT 离线
    terry
    超级版主
    编写于 最后由 编辑
    #4

    卧槽,哥们你太狠了,这图片看的我头大。

    油管:https://www.youtube.com/@抡锤者

    crazypeaceC 1 条回复 最后回复
    0
    • terryT terry

      卧槽,哥们你太狠了,这图片看的我头大。

      crazypeaceC 离线
      crazypeaceC 离线
      crazypeace
      编写于 最后由 crazypeace 编辑
      #5

      @terry
      其实都是些 好小好小的需求.
      就是我说的 某个功能的开/关, 功能A + 功能B 合成一下, .... 这种

      所以这个复杂程度的需求不需要SOTA模型, 就拿 二线模型 (当然现在有极便宜的 deepseek-v4-flash了) 就足够了.

      https://zelikk.blogspot.com/search/label/Agent开发

      1 条回复 最后回复
      0
      • J 离线
        J 离线
        joker_chang
        德高望重 劳动模范
        编写于 最后由 joker_chang 编辑
        #6

        锤哥,Deepseek涨价幅度已经落地:

        6d70fb71-116c-47ab-9125-2409cf7852c7-image.jpeg

        您作为深度用户聊聊呗?

        我是暂时转到走nvidia api调用minimax m3了。

        对了还有这次开源的Deepseek harness是否也能做做测评呢😄

        rock shiR 1 条回复 最后回复
        0
        • J joker_chang

          锤哥,Deepseek涨价幅度已经落地:

          6d70fb71-116c-47ab-9125-2409cf7852c7-image.jpeg

          您作为深度用户聊聊呗?

          我是暂时转到走nvidia api调用minimax m3了。

          对了还有这次开源的Deepseek harness是否也能做做测评呢😄

          rock shiR 离线
          rock shiR 离线
          rock shi
          劳动模范 德高望重
          编写于 最后由 编辑
          #7

          @joker_chang 备了2个2080,准备搞个24/7小副机,不知道qwen3.8能不能替代dp了

          J 1 条回复 最后回复
          1
          • rock shiR rock shi

            @joker_chang 备了2个2080,准备搞个24/7小副机,不知道qwen3.8能不能替代dp了

            J 离线
            J 离线
            joker_chang
            德高望重 劳动模范
            编写于 最后由 编辑
            #8

            @rock-shi 小参数模型替代全尺寸模型基本上是不现实的。
            我觉得能在自己的应用场景下,成功完成任务才是关键。

            rock shiR 1 条回复 最后回复
            0
            • J joker_chang

              @rock-shi 小参数模型替代全尺寸模型基本上是不现实的。
              我觉得能在自己的应用场景下,成功完成任务才是关键。

              rock shiR 离线
              rock shiR 离线
              rock shi
              劳动模范 德高望重
              编写于 最后由 编辑
              #9

              @joker_chang 我是3.6和dp都用,实话说确实dp比3.6好用太多,尤其是正式上线以后,质量和速度没得说。但是3.6确实只算是本地能用级别,只能是赌个3.8大幅提升了

              J 1 条回复 最后回复
              0
              • rock shiR rock shi

                @joker_chang 我是3.6和dp都用,实话说确实dp比3.6好用太多,尤其是正式上线以后,质量和速度没得说。但是3.6确实只算是本地能用级别,只能是赌个3.8大幅提升了

                J 离线
                J 离线
                joker_chang
                德高望重 劳动模范
                编写于 最后由 编辑
                #10

                @rock-shi 对于我来说,本地的qwen3.6-27b勉强够用了,但是架不住本地搞不定的时候不得不走在线API。

                还是穷,舍不得花钱,从投入产出比来说,我现在是纯亏状态。

                周一开始搞了一个nvidia api免费掉Minimax M3,限制调用频率,能力还是很不错的。

                第一天用的时候搞太猛了,结果到下午429了😓

                rock shiR 1 条回复 最后回复
                0
                • J joker_chang

                  @rock-shi 对于我来说,本地的qwen3.6-27b勉强够用了,但是架不住本地搞不定的时候不得不走在线API。

                  还是穷,舍不得花钱,从投入产出比来说,我现在是纯亏状态。

                  周一开始搞了一个nvidia api免费掉Minimax M3,限制调用频率,能力还是很不错的。

                  第一天用的时候搞太猛了,结果到下午429了😓

                  rock shiR 离线
                  rock shiR 离线
                  rock shi
                  劳动模范 德高望重
                  编写于 最后由 编辑
                  #11

                  @joker_chang 也不是穷不穷的事。也没指望他能赚啥,就钓鱼、盘串还得花钱呢,当个爱好玩太贵就没意思了

                  1 条回复 最后回复
                  0
                  • ThirtyT 离线
                    ThirtyT 离线
                    Thirty
                    编写于 最后由 编辑
                    #12

                    价格出来了,高峰时段3倍到最高12倍

                    457c1eb8049e3b687cd7e78a1bd816d48375722.png

                    1 条回复 最后回复
                    1
                    • stxpnetS 离线
                      stxpnetS 离线
                      stxpnet
                      超凡大师
                      编写于 最后由 编辑
                      #13

                      涨吧涨吧,现在我的3.8 27B投入实用了,基本上不需要它了,小问题,自己处理,如果3.8 27Bxhigh还解决不了,再把问题放着,到闲时让deepseek flash v4来处理。

                      26-08-19
                      双卡3090(8x8x无nvlink,p2p驱动) +Sglang+qwen 3.8 27B awq模型 [功耗异常弃用]
                      8-20 用vllm 0.26+ Qwen3.8-27B-SmoothQuant-W8A8-INT8 200K上下文 ~50t/s

                      1 条回复 最后回复
                      0

                      你好!看起来您对这段对话很感兴趣,但您还没有一个账号。

                      厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。

                      有了你的建议,这篇帖子会更精彩哦 💗

                      注册 登录
                      回复
                      • 在新帖中回复
                      登录后回复
                      • 从旧到新
                      • 从新到旧
                      • 最多赞同


                      • 登录

                      • 没有帐号? 注册

                      • 登录或注册以进行搜索。
                      • 第一个帖子
                        最后一个帖子
                      0
                      • 版块
                      • 最新
                      • 标签
                      • 热门
                      • 用户
                      • 群组