跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
  • LCZ-Black
折叠
品牌标识

抡锤者

首页 版块 标签 硬件 AI 广场
  1. 主页
  2. 版块
  3. LLM讨论区
  4. Cluade Fable / Mythos 5.1 提示词泄露,安全模型为何安全事故频发?Anthropic上市面临考验,叙事神话再遭撕裂!

Cluade Fable / Mythos 5.1 提示词泄露,安全模型为何安全事故频发?Anthropic上市面临考验,叙事神话再遭撕裂!

已定时 已固定 已锁定 已移动 LLM讨论区
claudeanthropicai危机
2 帖子 1 发布者 116 浏览
  • 从旧到新
  • 从新到旧
  • 最多赞同
回复
  • 在新帖中回复
登录后回复
此主题已被删除。只有拥有主题管理权限的用户可以查看。
  • terryT 离线
    terryT 离线
    terry
    超级版主
    编写于 最后由 编辑
    #1

    其实两天前就有人在论坛发帖说,Anthropic 发布了最新的大模型 Claude Fable 5.1 跟 Mythos 5.1。这两款大模型又被说成它的顶尖之作、巅峰之作,Anthropic 官方吹了很多牛逼。但是这个模型发布之后不到两天,它的提示词工程就被人家给越狱了,把几十万个提示词放到 GitHub 上任人浏览。这个就非常丢人。这个模型本身强调的就是安全、可控,结果它自己本身就不安全。

    Anthropic 其实不止第一次犯过这种低级错误。前阵子它的 Claude Code 源码直接发布到公网上了,也是成为一个重大事故,被人放到 GitHub 上任大家浏览、任大家观赏。一家以安全为主打的企业,结果本身却屡次发生这种非常低端的安全事故,那大家就怀疑了:你这个模型到底安全不安全?如果说你的模型很安全,那你为什么自己不用?如果说你自己用了这么安全的模型,然后仍然屡次发生这种重大的安全事故,那你这个模型是不是很蠢?

    说实话,Anthropic 是我认为最会吹牛逼的一家公司。这家公司有很多非常恶心的行为跟非常恶心的言论,我之前在视频中也都跟大家讨论过。比如说它购买很多偏僻的书籍训练自家的 AI,训练完之后把这些书籍给销毁,这种做法就是非常 low。它这个创始人叫达里奥·阿莫代伊,之前在李彦宏的手下干过,说白了就是百度这家公司,你说它能有个什么好名声?然后又去侍奉山姆·奥特曼,在 OpenAI 干过,接着背叛 OpenAI。他当时的理由是什么?是说 OpenAI 不安全,不能管控 AI,他要自己出来创立一家公司,搞什么宪法 AI,把 AI 给关进笼子里。然后这家公司就是第一个跟美军签订合同,让美军在实战中使用自己的 AI 去杀人的公司。

    Claude Fable:mythos 5.1提示词泄露.jpeg

    这家公司可以说创始人是四姓家奴,然后满嘴仁义道德,结果私下里面却是下流不堪。我对这家公司是完全没有任何一丁点的好感,而且它就特别喜欢吹牛逼,在网络上面经常攻击 DeepSeek、Kimi 这些中国模型蒸馏它的大模型,完全不提自己的数据是怎么来的。自己曾经就是因为使用其他商业公司的数据、侵犯别人的数据隐私,花 15 亿美元进行和解。说实话,从这家公司嘴里说出来的任何一句话,我都是不相信的。

    而且我在今年刚做这个频道的时候,当时准确地预测,我说 Anthropic 在今年跟 OpenAI 的竞争中会占据上风。OpenAI 会为自己过分分心做多模态模型、吹更多的牛逼付出代价,它的资源有点分散了,它会被 Anthropic 盖过风头。但是我认为 Anthropic 这个技术路线属于一条邪路,它不能长久。

    原因很简单,就是 Anthropic 的强大并不来源于模型权重本身的强大,而是来源于它围绕模型权重做的 Harness 工程,把 Harness 工程内置到模型的 API 中去。比如说你问它一个简单的问题,本来你只是问了 50 个词,它为了答案的准确率,可能把你的提示词进行高度美化,你最后喂给模型的可能是 500 个 tokens,可能这个 tokens 会翻 10 倍。然后为了得到更加准确的答案,本来你推理一次就够了,Anthropic 在内部给你改成推理一次,我把这个结果加上我的问题再综合一下,再喂给模型去推理,可能反复一次、两次、三次,甚至同时开几个 sub agent 同时推理,然后从中综合选择最好的结果。

    当时我也说了,这样做确实在短期内能够获得非常好的红利。就是说在模型基础能力不够、基础能力不够智能的情况下,你通过 Harness 工程内置到 API 中,你的 API 给用户返回的结果就是明显要比裸模型更好,那你的跑分确实要更高。然后对于高端用户来说,他们得到的结果就非常满意。

    但是这个并不是一条正规的道路。这个就像我之前在视频中多次提到的,有点像《天龙八部》中的鸠摩智。他本身的武术功底是不错的,基本功肯定是不错的,不然也不会成为吐蕃国师、大轮明王。但是他的基本功远远没有乔峰这些一流高手那么厉害。他短时间内能够掌握少林七十二绝技,靠的是什么?小无相功,道家的小无相功来驱动。他把段誉抓去之后,用错乱的方法练成了六脉神剑中的少泽剑,他也能够杀人,也能够伤人,确实非常牛逼,曾经把慕容复、少林高僧打得灰头土脸,慕容复差点想自杀。但是一旦他真正遇上像乔峰这样的顶级高手,他的这个邪路是长不了的。

    GPT VS Claude.png

    我倒不是说 OpenAI 一定是乔峰。OpenAI 即便不是乔峰,它也是慕容博、萧远山这样的真正高手,它跟乔峰是一个档次的。那我认为在大模型公司中真正的乔峰是什么?就是像 DeepSeek 这样的公司。我的模型基础能力不断提升,模型的 API 内置什么东西?可能说我把 KV 缓存、长上下文的召回准确率做好,这些基础的设置做好,把 HCA、CSA 这些注意力机制做好,提升长上下文的召回准确率,把大海捞针做好。但是其他的工程我就不再做了。

    我这个模型封装起来之后,你在外部通过 Codex、通过 Hermes 来调用。用户想要进行什么后端的 Harness 改造,要打造属于自己的工作流,那你调用我的裸模型就行了。可能说我会有一些思考额度的开放,但是本身并不会滥用。它的资源消耗是非常克制的,裸模型本身的能力也是比较强的。

    然后它最近还推出了属于自己的 DeepSeek Harness。这个 Agent 一经推出,可以说成为历史上增长最快的、能够跟 OpenClaw 相媲美的一个大火的开源软件。它目前的星标已经接近当下 AI Agent 的王者 Hermes,已经处于同一个级别了。我相信在不久之后它就会超过 Hermes,因为 Hermes 本身作为通用 Agent 是非常不错的,但是它的编码能力不强。像 OpenCode 跟 OpenAI 的 Codex,虽然编码能力很强,但是它们在通用 Agent 方面做得不如 Hermes。但是 DeepSeek Harness 有可能会成为历史上第一个兼具二者,兼具编码、日常脚本管理、系统管理的这么一个非常全能的 Agent。

    而这条路确实要感谢 Anthropic。因为当年 OpenAI 在把所有的资源投入到大模型的尺寸规模、上下文长度上面时,Anthropic 由于用的是谷歌的 TPU,它的上下文长度天然是有优势的,这个是硬件架构的优势。但是 Anthropic 确实开创了 Harness 工程,就是把 Harness 工程作为一个主要提升 API 能力的手段。它是一个开创者,它启发了 OpenAI,启发了 DeepSeek 这样的后来者,在这一块它的贡献可以说是不容抹杀的。

    DeepSeek V4+huawei.jpeg

    但是它过分依赖 Harness 工程,把 Harness 工程内置到模型 API 内部,这就导致了自家曾经先发的、非常不错的、曾经作为行业标杆的 AI Agent 被它废掉了。为什么?因为你的 AI Agent 所有的优化都是围绕自家的黑盒 API,大家都看不到你内部是什么。你的任务编排、核心循环都是无法替代的。然后你自家的 API 又禁止第三方 Agent 的接入,又设置这样的 OAuth 认证限制、那样的限制,甚至针对中国用户进行特别的国别限制。那你两个黑盒又排外,怎么能够发展壮大呢?

    等于说 AI Agent、Harness 工程这个赛道是 Anthropic 开创的,Anthropic 把它做火的,但是也是 Anthropic 自己主动放弃了成为开源 Agent 基础设施的机会。那么这样的机会被 Hermes、被 DeepSeek Harness 给拿到。

    未来 Anthropic 的前景,说实话是有很大压力的。因为什么?现在用 Anthropic 的用户都是一些高端企业。Anthropic 的 C 端用户远远不及 DeepSeek、不及 OpenAI,它的主要用户就是一些头部大企业。我从来没有说 Anthropic 的模型蠢,或者说 Anthropic API 的用户都是傻子,当然不是。我只是说它的性价比差。

    可是我们要知道,这个世界上是分两种人的,一种是有钱人,一种是我们这样的穷屌丝。对于有钱人,比如说你在华尔街上班,一年能够赚个 200 万美金,那么你一年拿出 5 万美金、10 万美金来用 AI 的时候,你会像我们这样的穷屌丝一样,整天研究是 DeepSeek 更有性价比,还是 GLM、Kimi 更有性价比吗?我相信都不会。最好的办法就是我不买对的,就买贵的。最贵的不是最好的,但它一定是不错的,不是最差的。

    就像我们中国有些明星,她去买什么巴黎世家的塑料袋去走秀,她难道不知道这个塑料袋不值几万块钱人民币吗?她当然知道。但是以她的收入水平,她就没有必要考虑这个塑料袋以后还能不能转手、还能卖多少钱。她只需要兑现一个场景的需求,就是她走秀的时候手里拿着一个塑料袋,引起话题讨论,带来流量,这个就足够了。

    巴黎世家塑料袋.png

    所以说 Anthropic 的用户肯定并不比我们的智商低,他们很多人甚至比我们更聪明、更有社会地位、掌握更多的社会资源。他们用 Anthropic 的 API 是正确的选择,这个不能说别人蠢。但是我相信,你如果在油管上看到了我的频道,油管能够把我这个小频道、我一个穷屌丝做的频道推荐给你,那我相信你应该不属于这样的成功人士。

    如果说你也使用 Anthropic 的 API,也使用几十倍甚至百倍于 DeepSeek API 的价格去用 Anthropic 的 API,然后还没有赚到成功人士的钱,那我感觉你是要思考一下自己是不是选择错了,你是不是交了更多的智商税。

    这个东西就像什么呢?比如孙宇晨,孙割,还有 CZ 赵长鹏。他们难道不知道币安上面有大量的虚拟币是垃圾币吗?孙宇晨难道不知道自己的波场币,包括其他的一些狗屎币,都是垃圾,都是割韭菜的吗?他难道不知道吗?我相信他们都知道。但是他们都是镰刀,他们需要的就是为信仰充值的人。

    我相信他们的圈子里有很多人跟他们持有相同的观点。比如孙宇晨也好,CZ 也好,他们都能跟特朗普家族接上,那是人家镰刀之间的惺惺相惜。特朗普愿意赦免孙宇晨,愿意赦免 CZ,是不是给他们开绿灯?人家很有可能并不是认同这个人的品格,认同这个人并没有违法,人家认同的是他作为镰刀的属性。那些大企业、硅谷的那些有钱人,人家就用 Anthropic 的 API,本质上就是他们需要一个更好的镰刀工具来帮助他们收割。为了提高收割的成功率、准确率,他们愿意多花十倍甚至几十倍的 API 调用价格,这点钱对于他们来说根本就不叫个事情。

    那我们评论区的这些屌丝们,你们属于成功人士吗?你们是在为信仰充值是不是?你们用这个什么地球上最先进的 Claude API 创造出了什么成功的产品?如果说你们真的创造出了这些成功的产品,你们有时间在我的评论区跟我打嘴炮吗?

    然后就是谈一谈我对于 Anthropic 这家企业未来的预测。它当下对市场吹了非常大的牛逼,不断地发布新的模型去刷新跑分,然后宣称解决了这样的科学难题、那样的科学难题,又什么这样安全、那样安全,宪法 AI。但是我们要知道,市场的大部分需求目前还是编程,还是 Agent,60% 到 70% 的 tokens 消耗都是程序员在消耗。

    AI显卡编程.jpeg

    程序员天然对于 API 这种黑盒是排斥的,是需要掌控自己的工作流的,更倾向于用开源、可控的东西。而且讲实话,过去可能像一些高端企业不太在乎 API 的价格,但是我们要知道这些企业是在乎数据隐私的。你 Anthropic 在安全上面事故频发,它们会对你的数据保密能力产生怀疑。

    甚至说,即便你的数据保密能力很强,其他的人看不到,以后不会再泄露了,那你 Anthropic 想不想看呢?你如果拿我的数据去训练,将来搞成服务,提供对外 API,提供给我的竞争对手,那我要怎么办呢?我要如何确保你不会用我的数据来训练呢?

    我跟你目前已经签订了算力合同,这个 API 订单我不会取消,因为整个公司要做这种大型迁移,可能风险很高,没有必要。但是新的合同我估计就很难拿到了。因为在进行新的算力采购的时候,它们可能更加倾向使用 DeepSeek、Kimi 这样的开源 AI 大模型,然后我自己去采购 GPU,对这些开源大模型进行微调、二次训练、进行蒸馏,我能够保证我的数据在本地不上云。

    而且我们需要知道,当下大规模把 AI 应用于生产力的其实就是中美两国,中国的渗透率甚至比美国还要更高,其他国家相对而言是比较滞后的。就这两个国家里有多少高端用户呢?你 Anthropic 是拿不到中国高端企业用户的,因为这是中国大模型的固有地带,中美两国这种关系也不支持。那你只能拿到美国的高端用户,这个规模是有限的,你的红利已经基本上吃完了。

    你现在对外吹牛逼说你未来有几十万亿美元的营收预期,这个纯粹就是扯淡。这个就跟孙宇晨吹他的波场币的时候是一样的,这个叫姜太公钓鱼,愿者上钩。

    我相信美国的 SEC 在审核它上市的时候,是要做风险控制的,它不敢给它以过高的估值。就像现在市场上的呼声,说让它以 2 万亿美元的估值去融资。如果真的是这样做了,将来 Anthropic 大概率无法兑现这样的营收预期,让整个 AI 市场的估值泡沫被引爆的话,美国股市是要付出惨重代价的。

    股市.jpg

    其实现在美债已经处于失控的边缘,贝森特每天都在忙一些事情去稳定美债,甚至要帮日元去救场,就是因为害怕日元崩盘之后引起美债连锁崩盘。你说这个时候 SEC 会同意 Anthropic 以这么高的泡沫估值去融资吗?我相信也很难了。

    然后我们还必须考虑一个情况,就是以前 Anthropic 能够取得这么高的营收,第一是它吃到了美国存量高端用户的市场,因为他们天然不会采用中国的 API。第二就是它要有一个叙事,就是说它的模型非常牛逼,比 OpenAI 牛逼,比中国的大模型就牛逼更多了,它能做到的很多事情中国的 AI 是做不到的。

    可是现在中国 AI 大模型在快速进步,能力可以说达到了 Anthropic 模型的 85%、90% 甚至 95%。那么在这种情况下,你 Anthropic 的叙事是难以维持的。而且我们不要忘记 OpenAI 已经开始收缩,它已经放弃了 Sora 这个 APP,把主要的力量集中到了文字跟图片大模型上去。它的收缩战略是见效的,已经把成本给打下来了。它的 GPT-5.6 Luna 降价了 80%,已经做好了跟中国 AI 大模型打价格战的准备。

    价格战你企业可以不参与,但是你不能无视它。OpenAI 有大量的 C 端用户,他们市场的根基是比较牢固的,而且它也在发力去争企业市场。我相信大部分企业最终还是要向账单低头。即便它们不用中国的开源大模型来自建,选择 OpenAI 对于它们来说也是一个非常不错的选择。其实从最近的市场态势我们可以看出来,OpenAI 在企业市场已经赶上了 Anthropic,甚至有反超的趋势。

    所以说,我对于比较关注的三家大模型企业,DeepSeek、OpenAI 跟 Anthropic,再做一个预测:我认为 Anthropic 这个神话泡沫在一年之内就会破灭。

    它不一定说这家公司倒闭了或者怎么样,这不可能,毕竟它是头部的大模型企业,它的 AI 还是非常智能的。我的意思是说,它的这种高估值泡沫,这种高高在上的、“可远观而不可亵玩焉”的,你用我的 API,我还给你限制,我还不卖给你的这种神话局面,会在一年之内被打破,它会跌落神坛。

    anthropic3.jpeg

    然后 OpenAI 会在美国市场、在西方市场重新占据主导地位。另外就是 DeepSeek 会因为 DeepSeek Harness 这个开源的 AI Agent 获得非常大的红利,它会成为 AI 行业的基础设施。

    当然还是回到开头的那句话,我这个节目本身就是天桥说书的性质,就是茶楼酒肆里面给大家提供段子,抛砖引玉,给大家逗个乐子。讲得好的,你们捧个钱场、捧个人场;讲得不好的,你们想喷我,在评论区下方留言、在我的论坛发帖都可以。

    但是我必须说,我这人是非常尖刻、非常刻薄的。如果说你喷我,本身发言又比较 low,漏洞百出,没有一些基础的逻辑,那你可能会被我做成视频段子,作为视频素材放到我的下一个视频中,被我嘲笑。当然了,如果说你们能像论坛的一些大神,人家就是通过实际的数据发帖子,能够打脸我,能够让我不得不承认,让我心悦诚服,我还给他们置顶,那就是你们的本事。

    油管:https://www.youtube.com/@抡锤者

    1 条回复 最后回复
    0
    • terryT 离线
      terryT 离线
      terry
      超级版主
      编写于 最后由 编辑
      #2

      Youtube Video

      油管:https://www.youtube.com/@抡锤者

      1 条回复 最后回复
      0

      你好!看起来您对这段对话很感兴趣,但您还没有一个账号。

      厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。

      有了你的建议,这篇帖子会更精彩哦 💗

      注册 登录
      回复
      • 在新帖中回复
      登录后回复
      • 从旧到新
      • 从新到旧
      • 最多赞同


      • 登录

      • 登录或注册以进行搜索。
      • 第一个帖子
        最后一个帖子
      0
      • 版块
      • 最新
      • 标签
      • 热门
      • 用户
      • 群组