跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
  • LCZ-Black
折叠
品牌标识

抡锤者

首页 版块 标签 硬件 AI 广场
George SuenG

George Suen

@George Suen
取消关注 关注
关于
帖子
24
主题
2
分享
0
群组
0
粉丝
0
关注
0

帖子

最新 最佳 有争议的

  • 【一个Agent两个大语言模型,一个学徒工,一个老师傅】
    George SuenG George Suen

    @Botio-Kuo 用本地大模型上下文是超级稀缺的资源。

    LLM讨论区 deepseek gpt gemini

  • 【一个Agent两个大语言模型,一个学徒工,一个老师傅】
    George SuenG George Suen

    @許托比

    我信你说的话。

    但是咱俩用Agent的场景完全不同。我做的东西全凭自己的兴趣,都带有探索性。我做的上一个项目,一开始也是用AI计划,最后发现那条路完全走不通,一直改一直改。好在最后结果我很满意。而且我也不太在乎AI犯错,反正都是我在尝试的事情。

    LLM讨论区 deepseek gpt gemini

  • 【一个Agent两个大语言模型,一个学徒工,一个老师傅】
    George SuenG George Suen

    @Botio-Kuo 我想的是把信息分给多个agent维护,再有一个agent维护信息的目录。工作agent只维护当前问题的上下文。需要了解历史问题的时候去问他们。

    LLM讨论区 deepseek gpt gemini

  • 【一个Agent两个大语言模型,一个学徒工,一个老师傅】
    George SuenG George Suen

    @neo 甚合我意

    LLM讨论区 deepseek gpt gemini

  • 【一个Agent两个大语言模型,一个学徒工,一个老师傅】
    George SuenG George Suen

    @許托比 我说的是 这种东西,它本来就在工作流图里。https://reference.langchain.com/python/langgraph/graph/state/StateGraph/add_conditional_edges

    langgraph
    你举得资安的例子,我完全没概念,从未接触过。

    LLM讨论区 deepseek gpt gemini

  • 【一个Agent两个大语言模型,一个学徒工,一个老师傅】
    George SuenG George Suen

    @許托比 那个就是在必要的时候问大模型,“你认为.....请简单的回答 是 或者 不是”。

    LLM讨论区 deepseek gpt gemini

  • 【一个Agent两个大语言模型,一个学徒工,一个老师傅】
    George SuenG George Suen

    @許托比 你说的机械式闸门 是langgraph里那种 是非回答么? 哪个其实跟动作前提醒挺像的。

    LLM讨论区 deepseek gpt gemini

  • 【一个Agent两个大语言模型,一个学徒工,一个老师傅】
    George SuenG George Suen

    @許托比

    我遇到跟你相同的问题。agent用几次就忘了。我得手动提醒,他才会用起来,一会儿又忘。

    所以agent最好要专业化。去掉与它的分工无关的skill和tools。而且可以在每次他动作前提醒他。用本地大模型的时候可以事后把这些提醒从上下文里删除,反正没有跨api调用的kv cache。

    LLM讨论区 deepseek gpt gemini

  • 【一个Agent两个大语言模型,一个学徒工,一个老师傅】
    George SuenG George Suen

    @Yu-Chen-Chang 说:

    您是有钱人,我思考的都是,怎么用多个128K上下文的agent加上RAG什么的,实现1M甚至更多上下文的效果。

    LLM讨论区 deepseek gpt gemini

  • 【一个Agent两个大语言模型,一个学徒工,一个老师傅】
    George SuenG George Suen

    @許托比 我個人是把整套工作流梳理好以後用hermes來做

    你的意思是用hermes先构造多个Agent协同的工作流,然后再让这个工作流,完成工作吧。我就是这个意思。

    我的意思是构造一个类似交互式的Agent的通用的工作流。代替我用的pi coding agent。帮我节约或者完全不用购买token。而且我的实践是,给agent在关键时刻给出一些提问,可以减少agent走错路。比如在行动之前问它“你有多大把握?”,“你对任务还有哪些不清楚的?先提问,不要盲目的动手。”。等等...在关键时刻的提问比soul.md agent.md skill更加有效。

    LLM讨论区 deepseek gpt gemini

  • 【一个Agent两个大语言模型,一个学徒工,一个老师傅】
    George SuenG George Suen

    @kop-wang 你这个思路不是三年前就有了,ChatGPT刚刚推出的时候,就有人用它辅助编程。开始是每次把代码和错误复制粘贴进网页,然后再把GPT写的代码粘贴进项目。后来有人写了个Python脚本代替了复制粘贴过程。再后来有人把这个脚本做成项目当时叫AutoGPT。这就是所有Agent的原型。但是当时AI下性能太差,这东西火了一阵就不行了。
    我说的东西跟这个完全不一样,本地Agent使用人类的自然语言问技术问题,而不是像Agent那样有严格的格式。回答也是自然语言。根本无法直接接入Agent。

    网页模型有搜索功能,相当于web search工具,而且直接返回当前关心的内容。对比Agent自己search可以节约大量上下文。

    不要说网页上模型比绝大多数本地模型都强太多,即便是智力水平差不多。所谓三个臭皮匠顶个诸葛亮。只要能很好的组织这些模型,能够做到比其中任何一个都聪明的效果。在这方面做的最好的是前一阵日本人做的哪个实验。可以自己去搜。

    当然你们可能觉得会用个hermes就可以了。哪种交互式的agent只适合对需求或工作流尚不清楚或者频繁变动的场景。实际上工业场景用LangGraph,pydantic-ai定制agent群工作,使用多个大模型协同,根本就是标准操作。

    LLM讨论区 deepseek gpt gemini

  • 【一个Agent两个大语言模型,一个学徒工,一个老师傅】
    George SuenG George Suen

    @terry 首先我用deepseek v4配合网页上的大模型。亲测有效,可以减少deepseek无效尝试。

    你说没有生产力,你认为问题出在那里?

    LLM讨论区 deepseek gpt gemini

  • 【一个Agent两个大语言模型,一个学徒工,一个老师傅】
    George SuenG George Suen

    @kop-wang 必须有本地模型的,完全不一样。

    LLM讨论区 deepseek gpt gemini

  • 【一个Agent两个大语言模型,一个学徒工,一个老师傅】
    George SuenG George Suen

    诸位,用Agent都是只用一个大语言模型么?

    我一直用pi coding agent 配合Deepseek V4。但是Deepseek还是挺弱的。我就给他写了个Skill让他有任何困惑就通过OpenCLI去问ChatGPT或者Gemini。两个大语言模型一聊天,很多技术难点就突破了。

    现在Deepseek又涨价了。我更趋向于用pydantic-ai写一组新的Agent。本地的弱模型配合网页上的顾问大模型。除了电费,网费一分钱都不花。

    但是本地模型上下文太短了。一直想不明白怎么搞。

    我先端上一碟醋,大会儿帮我包盘饺子吧!

    LLM讨论区 deepseek gpt gemini

  • 网站的 Content Security Policy
    George SuenG George Suen

    好了,图全出来了。

    随便聊聊 网络

  • 网站的 Content Security Policy
    George SuenG George Suen

    @Xiaote
    3.png

    随便聊聊 网络

  • 网站的 Content Security Policy
    George SuenG George Suen

    @Xiaote
    1.png 2.png

    我这就是网页里很多图片显示不出来,但是复制图片链接用新的Tab确能打开,我有点好奇是怎么回事,才调试你们的网站的。这事跟我也没关系,我也是多管闲事。

    随便聊聊 网络

  • 网站的 Content Security Policy
    George SuenG George Suen

    @Xiaote 我知道了,是因为我常常清理浏览器cache导致 cache总是不命中。你如果不清cache你那儿就没问题。你试试清掉cache storage应该就能看到我看到的问题了。

    随便聊聊 网络

  • 网站的 Content Security Policy
    George SuenG George Suen

    命中缓存就返回,没命中就放行 所谓放行就是fetch

    随便聊聊 网络

  • 网站的 Content Security Policy
    George SuenG George Suen

    @Xiaote 我问了一下Chatgpt。我明白了因为页面第一次加载时用的img src 这个你在CSP里写了https 所以没问题。但是在 service worker里这个使用的是fetch下载 而connrct-src没有哪些图片的网址,所以报错图片不显示。

    随便聊聊 网络
  • 登录

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组