跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
折叠
品牌标识

抡锤者

  1. 主页
  2. 版块
  3. 随便聊聊
  4. DeepSeek涨价?在线AI模型性价比盘点,HY3和小米MiMO API不错。GPT Plus订阅套餐很划算!字节跳动杀猪盘,Gemini变傻了~

DeepSeek涨价?在线AI模型性价比盘点,HY3和小米MiMO API不错。GPT Plus订阅套餐很划算!字节跳动杀猪盘,Gemini变傻了~

已定时 已固定 已锁定 已移动 随便聊聊
deepseekgptgeminiqwen
13 帖子 6 发布者 372 浏览
  • 从旧到新
  • 从新到旧
  • 最多赞同
回复
  • 在新帖中回复
登录后回复
此主题已被删除。只有拥有主题管理权限的用户可以查看。
  • crazypeaceC 离线
    crazypeaceC 离线
    crazypeace
    编写于 最后由 编辑
    #3

    hy3 拿来开发不太行, 哪怕是小需求. 干脏活可以, 就是帮你部署项目啊, 或者是调整服务里面的配置项啊, 打开/关闭某个功能啊, ...
    mimo-v2.5 开发可以, 做点小需求, 基于已有的项目做一些"增强"开发.
    替代文字

    1 条回复 最后回复
    0
    • terryT 在线
      terryT 在线
      terry
      超级版主
      编写于 最后由 编辑
      #4

      卧槽,哥们你太狠了,这图片看的我头大。

      油管:https://www.youtube.com/@抡锤者

      crazypeaceC 1 条回复 最后回复
      0
      • terryT terry

        卧槽,哥们你太狠了,这图片看的我头大。

        crazypeaceC 离线
        crazypeaceC 离线
        crazypeace
        编写于 最后由 crazypeace 编辑
        #5

        @terry
        其实都是些 好小好小的需求.
        就是我说的 某个功能的开/关, 功能A + 功能B 合成一下, .... 这种

        所以这个复杂程度的需求不需要SOTA模型, 就拿 二线模型 (当然现在有极便宜的 deepseek-v4-flash了) 就足够了.

        https://zelikk.blogspot.com/search/label/Agent开发

        1 条回复 最后回复
        0
        • J 离线
          J 离线
          joker_chang
          德高望重 劳动模范
          编写于 最后由 joker_chang 编辑
          #6

          锤哥,Deepseek涨价幅度已经落地:

          6d70fb71-116c-47ab-9125-2409cf7852c7-image.jpeg

          您作为深度用户聊聊呗?

          我是暂时转到走nvidia api调用minimax m3了。

          对了还有这次开源的Deepseek harness是否也能做做测评呢😄

          rock shiR 1 条回复 最后回复
          0
          • J joker_chang

            锤哥,Deepseek涨价幅度已经落地:

            6d70fb71-116c-47ab-9125-2409cf7852c7-image.jpeg

            您作为深度用户聊聊呗?

            我是暂时转到走nvidia api调用minimax m3了。

            对了还有这次开源的Deepseek harness是否也能做做测评呢😄

            rock shiR 离线
            rock shiR 离线
            rock shi
            劳动模范 德高望重
            编写于 最后由 编辑
            #7

            @joker_chang 备了2个2080,准备搞个24/7小副机,不知道qwen3.8能不能替代dp了

            J 1 条回复 最后回复
            1
            • rock shiR rock shi

              @joker_chang 备了2个2080,准备搞个24/7小副机,不知道qwen3.8能不能替代dp了

              J 离线
              J 离线
              joker_chang
              德高望重 劳动模范
              编写于 最后由 编辑
              #8

              @rock-shi 小参数模型替代全尺寸模型基本上是不现实的。
              我觉得能在自己的应用场景下,成功完成任务才是关键。

              rock shiR 1 条回复 最后回复
              0
              • J joker_chang

                @rock-shi 小参数模型替代全尺寸模型基本上是不现实的。
                我觉得能在自己的应用场景下,成功完成任务才是关键。

                rock shiR 离线
                rock shiR 离线
                rock shi
                劳动模范 德高望重
                编写于 最后由 编辑
                #9

                @joker_chang 我是3.6和dp都用,实话说确实dp比3.6好用太多,尤其是正式上线以后,质量和速度没得说。但是3.6确实只算是本地能用级别,只能是赌个3.8大幅提升了

                J 1 条回复 最后回复
                0
                • rock shiR rock shi

                  @joker_chang 我是3.6和dp都用,实话说确实dp比3.6好用太多,尤其是正式上线以后,质量和速度没得说。但是3.6确实只算是本地能用级别,只能是赌个3.8大幅提升了

                  J 离线
                  J 离线
                  joker_chang
                  德高望重 劳动模范
                  编写于 最后由 编辑
                  #10

                  @rock-shi 对于我来说,本地的qwen3.6-27b勉强够用了,但是架不住本地搞不定的时候不得不走在线API。

                  还是穷,舍不得花钱,从投入产出比来说,我现在是纯亏状态。

                  周一开始搞了一个nvidia api免费掉Minimax M3,限制调用频率,能力还是很不错的。

                  第一天用的时候搞太猛了,结果到下午429了😓

                  rock shiR 1 条回复 最后回复
                  0
                  • J joker_chang

                    @rock-shi 对于我来说,本地的qwen3.6-27b勉强够用了,但是架不住本地搞不定的时候不得不走在线API。

                    还是穷,舍不得花钱,从投入产出比来说,我现在是纯亏状态。

                    周一开始搞了一个nvidia api免费掉Minimax M3,限制调用频率,能力还是很不错的。

                    第一天用的时候搞太猛了,结果到下午429了😓

                    rock shiR 离线
                    rock shiR 离线
                    rock shi
                    劳动模范 德高望重
                    编写于 最后由 编辑
                    #11

                    @joker_chang 也不是穷不穷的事。也没指望他能赚啥,就钓鱼、盘串还得花钱呢,当个爱好玩太贵就没意思了

                    1 条回复 最后回复
                    0
                    • ThirtyT 离线
                      ThirtyT 离线
                      Thirty
                      编写于 最后由 编辑
                      #12

                      价格出来了,高峰时段3倍到最高12倍

                      457c1eb8049e3b687cd7e78a1bd816d48375722.png

                      1 条回复 最后回复
                      1
                      • stxpnetS 在线
                        stxpnetS 在线
                        stxpnet
                        超凡大师
                        编写于 最后由 编辑
                        #13

                        涨吧涨吧,现在我的3.8 27B投入实用了,基本上不需要它了,小问题,自己处理,如果3.8 27Bxhigh还解决不了,再把问题放着,到闲时让deepseek flash v4来处理。

                        26-08-19
                        双卡3090(8x8x无nvlink,p2p驱动) +Sglang+qwen 3.8 27B awq模型 [功耗异常弃用]
                        8-20 用vllm 0.26+ Qwen3.8-27B-SmoothQuant-W8A8-INT8 200K上下文 ~50t/s

                        1 条回复 最后回复
                        0

                        你好!看起来您对这段对话很感兴趣,但您还没有一个账号。

                        厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。

                        有了你的建议,这篇帖子会更精彩哦 💗

                        注册 登录
                        回复
                        • 在新帖中回复
                        登录后回复
                        • 从旧到新
                        • 从新到旧
                        • 最多赞同


                        • 登录

                        • 登录或注册以进行搜索。
                        • 第一个帖子
                          最后一个帖子
                        0
                        • 版块
                        • 最新
                        • 标签
                        • 热门
                        • 用户
                        • 群组