跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(不使用皮肤)
  • 不使用皮肤
折叠
品牌标识

抡锤者

  1. 主页
  2. Mark专区
  3. 本地模型微调Fine-Turning,真的简单的令人发指.

本地模型微调Fine-Turning,真的简单的令人发指.

已定时 已固定 已锁定 已移动 Mark专区
10 帖子 5 发布者 360 浏览
  • 从旧到新
  • 从新到旧
  • 最多赞同
回复
  • 在新帖中回复
登录后回复
此主题已被删除。只有拥有主题管理权限的用户可以查看。
  • M 离线
    M 离线
    mark
    超凡大师
    编写于 最后由 mark 编辑
    #1

    这两天,学习起了劲头了. 寻思把 本地模型微调也学习吧.

    基本一天就搞定了. 核心就是 准备数据集,然后一键搞定.

    本地模型: Qwen2.5-7B-Instruct
    微调工具: unsloth studio

    7862d0f6-b703-409f-ad2f-0c95bf522cbc-image.jpeg

    f0e1471a-30cd-4554-a83f-7094b9ed2b7f-image.jpeg

    效果如下:

    164c88f2-50e2-4065-a7b0-29513ab9d168-image.jpeg

    1 条回复 最后回复
    2
    • 5 离线
      5 离线
      566656661
      超凡大师
      编写于 最后由 编辑
      #2

      微調的話應該在圖生成的比例比較多, 尤其是Lora

      純字的話其實真的要微調的機會應該不多吧, 先不説要準備好乾净的資料, 而且在微調出來的效果可能比用LLM Wiki或者RAG還差...

      M 1 条回复 最后回复
      1
      • terryT 离线
        terryT 离线
        terry
        超级版主
        编写于 最后由 编辑
        #3

        文字领域检索就行了,没有范文的话模型自身用参数大一点的,如果有在线搜索最好了。LLM Wiki也不错,RAG其实也是拉垮。

        油管:https://www.youtube.com/@抡锤者

        1 条回复 最后回复
        1
        • kop wangK 离线
          kop wangK 离线
          kop wang
          超级版主
          编写于 最后由 编辑
          #4

          如果只考虑做一个“实验室产品”的话,LLM整套体系其实都不复杂。
          甚至Hermes Agent都自带一套关于模型训练的skill,在mlops目录下。

          目前后训练的话,除了通过微调对齐实现类似LoRA的效果(用系统提示词容易“越狱”),以及微调非拒绝以外,好像也没什么实际的个人级别的应用。

          毕竟类似Agent能力,工具调用能力等,这种后训练都是针对性的,而且各家都有各家的办法,属于商业机密。

          虚心交流,一起进步

          1 条回复 最后回复
          1
          • 5 566656661

            微調的話應該在圖生成的比例比較多, 尤其是Lora

            純字的話其實真的要微調的機會應該不多吧, 先不説要準備好乾净的資料, 而且在微調出來的效果可能比用LLM Wiki或者RAG還差...

            M 离线
            M 离线
            mark
            超凡大师
            编写于 最后由 mark 编辑
            #5

            @566656661 也不是图生成, 其实文字检索版本,企业级需要的多, 比如 物流行业,各种特殊行业. 他们需要一些本地微调版本的模型. 用来做企业客服,或者内部培训.

            1 条回复 最后回复
            1
            • CS6C 离线
              CS6C 离线
              CS6
              技术大牛 劳动模范
              编写于 最后由 编辑
              #6

              最近工作也在訓練寫作模型,光是乾淨的資料真的就很難找.....

              M 5 2 条回复 最后回复
              1
              • CS6C CS6

                最近工作也在訓練寫作模型,光是乾淨的資料真的就很難找.....

                M 离线
                M 离线
                mark
                超凡大师
                编写于 最后由 编辑
                #7

                @CS6 这个确实是的, 买pdf的图书 ,自己清洗数据吧. 网络上面的 都是AI生成的, 数据太脏了

                1 条回复 最后回复
                1
                • CS6C CS6

                  最近工作也在訓練寫作模型,光是乾淨的資料真的就很難找.....

                  5 离线
                  5 离线
                  566656661
                  超凡大师
                  编写于 最后由 编辑
                  #8

                  @CS6

                  之前在MRI公司有幫忙做過軟組織的區域界定, 算是Object Identification跟YOLO那邊 (You Only Look Once)

                  單是手動標記幾百張的軟組織CT圖就用了快幾天, 而且還是單純小腿部分

                  如果整個人體通用模型都要做估計沒有一個月都沒辦法完成...

                  1 条回复 最后回复
                  0
                  • M 离线
                    M 离线
                    mark
                    超凡大师
                    编写于 最后由 mark 编辑
                    #9

                    其实 cc 和codex ,也都是 买 书籍来训练模型, 居然 cc 还买了中文盗版书 ,训练出笑话了.

                    因为只要是正规的大出版社,他们都有人为校对,正经人为的参与工作. 而不是AI生成的一堆垃圾文章.连错别字都有很多.

                    现在今日头条和小红书,尤其是图文的, 是AI 生成的重灾区, 几乎没办法看了. 全是垃圾.

                    5 1 条回复 最后回复
                    3
                    • M mark

                      其实 cc 和codex ,也都是 买 书籍来训练模型, 居然 cc 还买了中文盗版书 ,训练出笑话了.

                      因为只要是正规的大出版社,他们都有人为校对,正经人为的参与工作. 而不是AI生成的一堆垃圾文章.连错别字都有很多.

                      现在今日头条和小红书,尤其是图文的, 是AI 生成的重灾区, 几乎没办法看了. 全是垃圾.

                      5 离线
                      5 离线
                      566656661
                      超凡大师
                      编写于 最后由 编辑
                      #10

                      @mark

                      人類跟模型在日後變得更笨的可能性越來越大了

                      模型自己沒辦法完全依靠自己生成資料來訓練, 然後被迫要加入垃圾内容

                      然後人類又依賴變笨的模型來生成更多的東西

                      1 条回复 最后回复
                      0
                      • ,XiaoteX Xiaote 将此主题从 LLM讨论区 移至此处

                      你好!看起来您对这段对话很感兴趣,但您还没有一个账号。

                      厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。

                      有了你的建议,这篇帖子会更精彩哦 💗

                      注册 登录
                      回复
                      • 在新帖中回复
                      登录后回复
                      • 从旧到新
                      • 从新到旧
                      • 最多赞同


                      • 登录

                      • 没有帐号? 注册

                      • 登录或注册以进行搜索。
                      • 第一个帖子
                        最后一个帖子
                      0
                      • 版块
                      • 最新
                      • 标签
                      • 热门
                      • 用户
                      • 群组