跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
  • LCZ-Black
折叠
品牌标识

抡锤者

首页 版块 标签 硬件 AI 广场
  1. 主页
  2. 版块
  3. LLM讨论区
  4. 大佬们,中小企业自建本地大模型有没有什么可行的方案?

大佬们,中小企业自建本地大模型有没有什么可行的方案?

已定时 已固定 已锁定 已移动 LLM讨论区
本地模型
41 帖子 14 发布者 1.3k 浏览 1 关注中
  • 从旧到新
  • 从新到旧
  • 最多赞同
回复
  • 在新帖中回复
登录后回复
此主题已被删除。只有拥有主题管理权限的用户可以查看。
  • Phuong NgoP 离线
    Phuong NgoP 离线
    Phuong Ngo
    发表于 最后由 编辑
    #32

    多卡部署可以解决并发的难题么?

    1 条回复 最后回复
    0
    • Phuong NgoP Phuong Ngo

      我司也有类似的需求,公司要求满足30并发需求,主要用LLM进行代码生成,测试用例编写。已采购RTXpro6000 96G的,主机内存64G,但是现在我司的半吊子IT跑模型用的是windows系统,上面跑的模型是GPT 122B,qwen 3.5 35BA3B的模型,开放内网地址让大家用openclaw去调用,现在很难满足30调用,连并发10都做不到,也想问问这种情况如果迁移到ubuntu下,再好好优化一下能否有比较明显的改善,例如全员从openclaw迁移到Hermes Agent。

      kop wangK 在线
      kop wangK 在线
      kop wang
      超级版主
      发表于 最后由 编辑
      #33

      @Phuong-Ngo
      1、用LLM进行代码生成,测试用例编写,为何要用openClaw或者Hermes?Claude Code、OpenCode是不满足哪点需求?
      2、qwen3.5-35B-A3B的能力真的能支持有效的代码产出吗?更何况是搭配通用事务Agent,而不是专用Coding Agent的前提下。
      3、操作系统的区别并不会有质的性能提升。相同硬件的前提下,LLM服务的性能主要还是取决于运行框架和运行参数。当然,Linux才有最好的框架生态条件。所以迁移系统和框架、参数调整都是必然。
      4、多卡并行当然可以适当提升并发,但你说的多卡是直接多一块pro6000?还是pro6000的价格拆成两个6000D或者类似的情况?

      虚心交流,一起进步

      Phuong NgoP 1 条回复 最后回复
      0
      • kop wangK kop wang

        @Phuong-Ngo
        1、用LLM进行代码生成,测试用例编写,为何要用openClaw或者Hermes?Claude Code、OpenCode是不满足哪点需求?
        2、qwen3.5-35B-A3B的能力真的能支持有效的代码产出吗?更何况是搭配通用事务Agent,而不是专用Coding Agent的前提下。
        3、操作系统的区别并不会有质的性能提升。相同硬件的前提下,LLM服务的性能主要还是取决于运行框架和运行参数。当然,Linux才有最好的框架生态条件。所以迁移系统和框架、参数调整都是必然。
        4、多卡并行当然可以适当提升并发,但你说的多卡是直接多一块pro6000?还是pro6000的价格拆成两个6000D或者类似的情况?

        Phuong NgoP 离线
        Phuong NgoP 离线
        Phuong Ngo
        发表于 最后由 编辑
        #34

        @kop-wang
        1.用openclaw是我司老板过年听说龙虾很厉害,没有怎么仔细研究就想要在本地搭建,交给公司的IT全权负责搭建,也没有研究诸如用claude code、opencode等调用其他模型的API的路子。
        2.目前的现状是公司的IT部署什么模型,我们就用什么模型,也没有什么真正的产出,顶多就是截取一些代码片段,让agent分析这段代码哪里出现问题了,改改,就这样了。其实主要还是以云端的AI为主,用的最多的就是微软的copilot,因为能在vscode中直接进行代码补全等操作,方便省事。目前我司在AI编程领域处于探索和摸索阶段。
        3.明白,系统改迁移还是迁移。
        4.对于多卡部署,佬有什么建议,尽管提出来,洗耳恭听。

        kop wangK 1 条回复 最后回复
        0
        • Phuong NgoP Phuong Ngo

          @kop-wang
          1.用openclaw是我司老板过年听说龙虾很厉害,没有怎么仔细研究就想要在本地搭建,交给公司的IT全权负责搭建,也没有研究诸如用claude code、opencode等调用其他模型的API的路子。
          2.目前的现状是公司的IT部署什么模型,我们就用什么模型,也没有什么真正的产出,顶多就是截取一些代码片段,让agent分析这段代码哪里出现问题了,改改,就这样了。其实主要还是以云端的AI为主,用的最多的就是微软的copilot,因为能在vscode中直接进行代码补全等操作,方便省事。目前我司在AI编程领域处于探索和摸索阶段。
          3.明白,系统改迁移还是迁移。
          4.对于多卡部署,佬有什么建议,尽管提出来,洗耳恭听。

          kop wangK 在线
          kop wangK 在线
          kop wang
          超级版主
          发表于 最后由 编辑
          #35

          @Phuong-Ngo

          关于Agent的选择,通用事务Agent在代码能力方面是远不及专用的Coding Agent的。Coding Agent包括但不限于Copilot(今天的更新他也支持自定义LLM供应商了),Claude Code、OpenCode等。以上的工具在Coding能力效果远大于OpenClaw和Hermes Agent。当然,客观事实是一回事,公司现状是另一回事,咱们只讨论理想情况。

          至于说Coding的方式,目前普遍已经进化到vibe Coding为主。也就是代码的修改不局限于代码段的tab补全提示和复制粘贴。而是直接交给AI任务,让他直接完成编辑、编译、调试、测试整套流程。然后人工再介入审核的模式,你用Copilot肯定知道他的Agent模式,就是这样。

          最后是关于多卡,其实从你们目前的localLLM的整套逻辑并没有跑起来,所以我个人也不会有什么建设性的意见。还是先以优化为主。最起码你们要先固定一个有实战意义的使用模式,然后再聊优化会比较有建设性一些。

          虚心交流,一起进步

          Phuong NgoP 1 条回复 最后回复
          1
          • kop wangK kop wang

            @Phuong-Ngo

            关于Agent的选择,通用事务Agent在代码能力方面是远不及专用的Coding Agent的。Coding Agent包括但不限于Copilot(今天的更新他也支持自定义LLM供应商了),Claude Code、OpenCode等。以上的工具在Coding能力效果远大于OpenClaw和Hermes Agent。当然,客观事实是一回事,公司现状是另一回事,咱们只讨论理想情况。

            至于说Coding的方式,目前普遍已经进化到vibe Coding为主。也就是代码的修改不局限于代码段的tab补全提示和复制粘贴。而是直接交给AI任务,让他直接完成编辑、编译、调试、测试整套流程。然后人工再介入审核的模式,你用Copilot肯定知道他的Agent模式,就是这样。

            最后是关于多卡,其实从你们目前的localLLM的整套逻辑并没有跑起来,所以我个人也不会有什么建设性的意见。还是先以优化为主。最起码你们要先固定一个有实战意义的使用模式,然后再聊优化会比较有建设性一些。

            Phuong NgoP 离线
            Phuong NgoP 离线
            Phuong Ngo
            发表于 最后由 编辑
            #36

            @kop-wang 额,也对。已经有RTX6000PRO了,那让IT迁移迁移系统,慢慢一步一步做优化慢慢尝试和测试,至少先在逻辑上实现跑通,云端和本地两条腿走路。多谢佬耐心提意见。

            kop wangK 1 条回复 最后回复
            0
            • Phuong NgoP Phuong Ngo

              @kop-wang 额,也对。已经有RTX6000PRO了,那让IT迁移迁移系统,慢慢一步一步做优化慢慢尝试和测试,至少先在逻辑上实现跑通,云端和本地两条腿走路。多谢佬耐心提意见。

              kop wangK 在线
              kop wangK 在线
              kop wang
              超级版主
              发表于 最后由 编辑
              #37

              @Phuong-Ngo 过奖了,互相学习,如果有空欢迎开帖分享最终成果。

              虚心交流,一起进步

              1 条回复 最后回复
              0
              • terryT terry

                @c0aster 你的需求无脑买RTX Pro 6000,买好了再考虑怎么部署,怎么玩都行。

                C 离线
                C 离线
                c0aster
                发表于 最后由 编辑
                #38

                @terry 叫公司买了2张3090 我先来玩一玩,结果坑的是那台 旧服务器是r730,riser2的X16是CPU2,只装了CPU1,自费先买了一个riser3😲

                terryT 1 条回复 最后回复
                0
                • C c0aster

                  @terry 叫公司买了2张3090 我先来玩一玩,结果坑的是那台 旧服务器是r730,riser2的X16是CPU2,只装了CPU1,自费先买了一个riser3😲

                  terryT 离线
                  terryT 离线
                  terry
                  超级版主
                  发表于 最后由 编辑
                  #39

                  @c0aster 这怎么能自费呢?想办法报销😅

                  油管:https://www.youtube.com/@抡锤者

                  C 1 条回复 最后回复
                  0
                  • terryT terry

                    @c0aster 这怎么能自费呢?想办法报销😅

                    C 离线
                    C 离线
                    c0aster
                    发表于 最后由 编辑
                    #40

                    @terry 海鲜市场15元😢 没法走报销了,坑的是这机器装2张卡要在两个riser上,没法nvlink,先跑个27B,再研究下comfyui,尝试下再给领导汇报吧,不然买了不也生产力,背锅了,谢谢,后续已考虑rtx pro 6000

                    terryT 1 条回复 最后回复
                    1
                    • C c0aster

                      @terry 海鲜市场15元😢 没法走报销了,坑的是这机器装2张卡要在两个riser上,没法nvlink,先跑个27B,再研究下comfyui,尝试下再给领导汇报吧,不然买了不也生产力,背锅了,谢谢,后续已考虑rtx pro 6000

                      terryT 离线
                      terryT 离线
                      terry
                      超级版主
                      发表于 最后由 编辑
                      #41

                      @c0aster 多分享点6000点测试帖子,我们屌丝暂时还买不起。能白嫖公司的最好,不心疼,😂

                      油管:https://www.youtube.com/@抡锤者

                      1 条回复 最后回复
                      0

                      你好!看起来您对这段对话很感兴趣,但您还没有一个账号。

                      厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。

                      有了你的建议,这篇帖子会更精彩哦 💗

                      注册 登录
                      回复
                      • 在新帖中回复
                      登录后回复
                      • 从旧到新
                      • 从新到旧
                      • 最多赞同


                      • 登录

                      • 登录或注册以进行搜索。
                      • 第一个帖子
                        最后一个帖子
                      0
                      • 版块
                      • 最新
                      • 标签
                      • 热门
                      • 用户
                      • 群组