跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
  • LCZ-Black
折叠
品牌标识

抡锤者

首页 版块 标签 硬件 AI 广场
  1. 主页
  2. 版块
  3. AI新秩序
  4. AI不会毁灭人类,人类利用AI作恶才会毁灭人类,被AI统治有可能是灾难,也有可能比被人类统治更好,当下的AI智能水平依然是远远不够的!

AI不会毁灭人类,人类利用AI作恶才会毁灭人类,被AI统治有可能是灾难,也有可能比被人类统治更好,当下的AI智能水平依然是远远不够的!

已定时 已固定 已锁定 已移动 AI新秩序
ai危机anthropic
5 帖子 3 发布者 70 浏览
  • 从旧到新
  • 从新到旧
  • 最多赞同
回复
  • 在新帖中回复
登录后回复
此主题已被删除。只有拥有主题管理权限的用户可以查看。
  • terryT 在线
    terryT 在线
    terry
    超级版主
    编写于 最后由 terry 编辑
    #1

    最近几天,关于这个“AI会毁灭人类”的这么一种说法,在网络上就非常流行。可能还是因为前几天 Anthropic 那个所谓的安全对齐员离职之后,他发表的各种看法,说可能各大公司、头部 AI 公司的这些领导都知道,再这么发展下去,可能到 2030 年,甚至最长 10 年左右的时间,那么 AI 毁灭人类的可能就会达到 10%,甚至更多。

    但是我说实话,我一直认为这是一个非常无耻的炒作。就是因为稍微有一点常识都能够知道,就当下这个 Transformer 架构的所有大模型,本质上都是概率预测器。你发生的所有所谓越狱也好,还是不听人类指挥的行为也好,本质上都是 AI 幻觉。我给大家举一个非常简单的例子,比如说我们现在要测试 AI 攻击网站的能力。这个网站的防护等级,我们找一个 Demo 给它做得非常好,各方面的这种防护都按照人类顶级的高手来设计,然后我们让 AI 去攻破它。那本质上是什么呢?就是给 AI 下达一个长链任务,然后可能目标机器的这么一个架构,我们也不告诉它,让它自己去猜,让它自己去摸索,然后 AI 利用自己已经学到的知识尝试攻破这个安全系统。那么这本质上 AI 还是在执行人类的指令。至于说它什么越狱了,然后什么攻击了其他公司的服务器,我觉得就非常扯淡。

    因为这个怎么讲,首先我们在下达指令的时候,就需要知道 AI 本质上是一个概率预测器。它执行我们的指令,对于我们指令的理解,本身也是带有一定概率性的。它并不是说能够完全理解我们人类的意图,因为对于 AI 来说,我们只是输入一个 Token 给它,它根据这个模型内部的机制来进行猜,逐字地猜,最后给出一个最大可能的结果。它完全不懂得这个结果本身的含义。就是你别看我们给它输入 123,它吐出 456,它并不知道自己吐出的是 456。它可能说 4 和 5 吐出之后,第三个是 6,它也不知道这三个 Token 之间的关系,它是完全不明白的。

    AI不会毁灭人类坏人更可怕.jpeg

    那你说它越狱了,这个我想首先肯定是你的对齐系统、你的管理系统出现了问题。我们要做这种危险的实验,本身就要把它设定在局域网的范围之内。你 OpenAI、Anthropic 这么大的公司,你说你做这个所谓的安全测试,你不会去搞一个镜像网站吗?不会去搞一个 Demo 网站,把它限制在局域网里面吗?我就不相信,如果说你把它限制在局域网以内,如果说你的试验限定在一个局域网范围之内,我也不相信你们家的大模型能够把这个网线拔下来,插到什么公网上去,这可能吗?本身就是你这家公司在做试验的时候,没有用安全的规范来做,然后大模型本身又有幻觉。它不可能 100% 精准地像过去传统的程序一样,把这个机器码给你写死了,得出一个精确的、可预期的结果,它是不可能的。

    何况就算是我们以前传统的程序,我们机器码写死了的情况下,它不还有异常吗?就是同样的指令、同样的操作系统环境,但是你执行一次、执行 1 万次、执行 10 万次之后,它的结果就是不一样的。你可能执行 10 万次、100 万次,它总会有异常抛出来。那么异常抛出之后怎么处理异常,这个就是我们传统程序设计中的基本功。同样的,你大模型本身是一个概率猜测机器,它如果有些行为方式越界了,那就要看你如何去约束它。

    我再给大家举一个例子,大家可能非常容易理解这个究竟是谁的责任。比如说现在中国国内的大模型,你上去让它去辱骂一个国家领导人,那你看你能用什么样的方式越狱。比如说豆包,你找一个比较牛逼的领导人,把名字输入给它,你叫它骂他,你看看你能不能越狱。我可以非常负责任地说,这个可能性是 0。那不信你们全国十几亿人,你们每一个人一天到晚测试,你看它能不能做到。原因很简单,就是它把这个对齐规则写在了模型的最深处。这个对于中国的大模型公司来说,这是一个最基本的政治正确,最基本的合法合规,你就要做到这一点。如果说做不到,你这个大模型本身就不能上线。

    但是我相信,就是在早期,如果说你羞辱一些,或者说以一些比较激烈的言辞去描述特朗普也好,描述其他国家的领导人也好,那都是没什么事情的。那么越往后,可能说你再用这样激烈的言辞、用这种侮辱性的言辞去描述一个国家的领导人,在哪个大模型上都会被限制。这个就是什么?这个就是对齐嘛,这个就是设定规则嘛。只要你把规则设定好了,AI 本身是没有任何所谓的主观意识去要什么毁灭人类、要危害人类,它没有这个意识的。它只是在执行你人类指令的过程中,自己的概率预测出现了偏差,顺带做了一些让人类看不懂的事情。

    AI安全.png

    因为我们要让它比如说攻破一个网站,还是让它执行一个复杂的任务、系统性的任务,那么它每一个步骤都有概率出现误解、出现幻觉。那么假设每一个步骤只有 0.01%,它这个几千步、几万步、几十万步累计下来,那个误差也是大得惊人。最后让你这个命令的发起者自己看不懂、自己觉得意外,这不是非常正常的事情吗?这个就是稍微有一点点数学常识的人都应该知道,这个是合理的范畴,这个是符合统计学基本原理的。

    所以说,当下炒作这个 AI 什么毁灭人类,炒作什么头部 AI 智能需要限制的这些人也好、这些群体也好,他们都有自己的利益。要么像 Anthropic、OpenAI 这样的头部公司,就是为了恫吓、恐吓美国的这些头部大企业:你看,AI 大模型有危险哦。你说谁最怕这个世界毁灭?谁最怕人类被毁灭?那不就是这些顶级的大公司、顶级的富豪吗?你说我们这些穷屌丝,点个外卖 10 块钱、15 块钱要纠结两三个小时的,我们害怕 AI 毁灭人类吗?我们有那么担心吗?天塌下来个高的顶着。只有像什么比尔·盖茨、像什么伊隆·马斯克这些人,他们才非常在乎。

    但是我讲实话,这些聪明人人家也不会被你骗到的。说白了,大家都是杀过猪、见过猪跑的,都是这一路风吹雨打混过来的,谁也别想去骗谁。这些头部的 AI 公司制造恐慌,就是说别人的 AI 都不安全,可能会毁灭世界、毁灭人类,即便不毁灭人类,也可能毁灭你们的公司,给你们的公司带来重大的损失。但是你用我 OpenAI、用我 Anthropic 的 AI,你们就安全了。这个本质上就是为了生意嘛。

    anthropic3.jpeg

    另外一种就是自媒体炒作嘛。说实话,如果说像我去炒作什么 AI 毁灭人类,行不行?当然是行了。这一块因为流量就比较大,能够骗到一些憨批嘛。但是你要知道,我的主频道是做 AI 技术分享的。来看我视频的、来看我主频道视频的,那基本上都是一些懂程序设计、懂一些基本原理的,他们对于 AI 的理解还是要比一般的受众高一点的。如果我反复给他们投喂这种傻逼观点,他们会取关的,这个就会危害到我本身的根本利益。所以说,我是绝对不会去鼓吹这么傻逼的观点的。

    就目前 AI 是的,它有一定程度的可能会失控,行为超越边界,但是本质上还是要你这个使用的人、你给它下达指令的人,自己去做对齐,自己去约束它。因为 AI 它不知道自己的行为能带来什么后果,它也没有任何的主观意识去危害人类。但是如果说你给它下达的这个指令没有特别明确,或者说这个指令本身比较复杂,经过多步拆解、多步运行之后,它形成了误差的积累,导致它最后行为失控,这个是你人类操心的事情,AI 不会操心的。

    当下我们现在不是在搞什么 Harness 工程吗?就是说用一套规则来运行 AI,提升 AI 的能力,同时给 AI 做各种合规的限制。但是我说实话,就是目前人类跟 AI 的这种在更高生产力、更高效率以及更加安全之间,它们是有一个动态的平衡。有的时候我们可能觉得安全的需求要大于生产力的提升,有的时候我们就是说觉得生产力的提升还是要优先于安全的需求,因为安全的威胁可能没有那么大。这个是各方社会,包括政府也好、企业也好,还是说民间各种 NGO 组织也好,或者说其他的国际组织也好,它们之间进行一个动态的博弈。

    但是我相信,目前我们处于的阶段仍然是 AI 的智能水平远远不够,它的生产力、生产效率还远远不够,这个需求要远远大于安全对齐的需求。所谓的让头部公司停下 AI 的研究,然后给头部的大模型的智能施加一定的限制,就这种提倡和这种说法,我本人认为是非常愚蠢且非常幼稚的。而且 OpenAI 和 Anthropic 它们一定自身就不会遵守这样的提倡,它们做这种行为只是为了立牌坊,就既当又立,非常无耻。

    GPT Claude.webp

    并且我在过去的视频中不是反复指出吗?就这两家公司是人类历史上可以说是最无耻的企业之一,基本上它们的道德行为水平就是人类道德的洼地。我不是说了吗?OpenAI 剽窃、抢劫开源机构的研究成果,把 OpenAI 这家开源机构的研究成果给弄成了现在的所谓商业公司,也叫 OpenAI,这本身就是一种抢劫、无耻。它们连世界首富都敢骗、都敢抢,连马斯克都搞不过它们,它们搞我们这些屁民,那还不得跟玩一样啊?

    Anthropic 就更不用说了,我不说了吗?如果说 OpenAI 是三姓家奴的话,那么 Anthropic 又背叛了 OpenAI,它们就是四姓家奴。第一个把自己的大模型卖给美军去杀人的公司,还跟我们谈什么 AI 安全对齐,你说这家公司得有多无耻?它的任何倡议我们能相信吗?如果说将来 AI 有一天有可能会失控,那它肯定不是因为 AI 自身想要毁灭人类、想要危害人类,一定是给它下发指令的人非常邪恶,他想攫取更大的利益,利用 AI 来做坏事。我相信这样的公司有可能是 OpenAI,也有可能是 Anthropic。

    与其说其他的公司停下来、停止研发,让这两家道德败坏的企业去掌握 AI 的前沿技术,我不如全世界更多的公司,尤其是搞开源的公司,像什么 DeepSeek、千问、Kimi、GLM,我们这些中国公司,或者其他的欧洲的一些什么开源公司都可以。你只要是开源的,你能把这个大模型放到公开的渠道,让全体技术人员、让整个开源社区来审视,证明你是安全的,那我觉得这样的做法要更好。永远比你这个商业闭源大模型公司把它关在黑盒子里面,我们外界都不知道你怎么调用的、你怎么去下达指令的、怎么执行的,这些原理我们一概不知。

    你说在这种情况下,我们是把大模型的顶尖技术、顶尖技能放给这两家闭源公司,让它们在那里既当又立,还是说去支持开源公司呢?我觉得所有的开源公司都不要上当,这个就是明显的、非常 low 的一个请君入瓮的游戏,你要跟它玩游戏就输了。

    当然了,就说在目前这个阶段,我认为在十年八年之内,AI 是不可能威胁到人类的。甚至说我们放长一点,20 年左右的时间,AI 是很难真正威胁到人类的。但是我并不是说人工智能将来的智慧就不会超过人类,因为我们对于智慧的定义、我们对于意识的定义、对于自主意识的这么一个定义,本身就是比较模糊,就是没有什么明显边界的。我认为长久而言,像《终结者》这些电影它预告的这些场景,不是没有可能发生的,是有可能的。

    终结者末世机器人

    但是我必须说,就还是那句话,我们目前大多数人是处于社会的底层,天塌下来个高的顶着,这些事情不是我们操心的。我们操心的永远是我们手中掌握的这个 AI,跟那些顶级富豪、跟那些社会高级人士、高阶层人士,他们手中掌握的 AI 是不对等的。我们的算力、我们的智力跟他们是不对等的,我们要想办法去弥补这种差距,防止我们被过分地剥削。

    当然了,如果说有一天 AI 真的推翻了人类的统治秩序,推翻了我们现有的统治秩序,我们也未必就比现在被人类统治要更差。就是说人类对于人类做的那些坏事,各种屠杀也好,各种种族灭绝也好,各种你难以想象的坏事,AI 未必能够做得出来,我是讲实话。因为人类这个天性中有一部分是邪恶的,有一部分人在某种特殊的情况下,他做出恶事,他是带有快感的,是带有成就感的。

    但是在 AI 面前,你人类也好、动物也好,或者说是植物也好,如果说它有一天意识超越了我们人类,到了另外一个级别,到了造物主的级别,那么我们这些所有的生物在它看来都是平等的,都是一样的。未来主宰我们世界的这个 AI,如果它创造的时候,它的主要方向是向善的,是跟我们人类文明延续的方向比较贴切的,那它有可能会比我们人类管得更好。当然了,《终结者》中那种灭绝人类的情况也有可能是存在的。

    但是真到了那个时候,我们再去面对它也一样。因为如果说真的有一天这件事情发生了,你说我们这些社会的底层民众,我们再焦虑有什么用吗?我再说不好听的,如果说我们真的能活到那一天,这个基本上就是我们的胜利了。你现在每天什么 996、铁人三项、快递、外卖、网约车,你确信你能活到 AI 造反的那一天吗?我觉得未必吧。真到那一天,有很多技术问题都解决了,人类的生老病死,什么癌症、什么一些疑难杂症全部被攻克了,然后你身体有什么器官坏了,AI 就帮你换了。

    有人说我们人类社会、我们人类文明有可能会被 AI 统治,成为 AI 的宠物,成为 AI 的情绪价值提供者。我觉得如果真到了那一天,也未必不好。我们现在真的确信我们不是某个高级文明、不是某个高层的造物主的这么一个模拟游戏吗?我们确信不是吗?我们确信我们自己有自主意识吗?

    很多人说 AI 它本质上就是一种低级的什么这种文明,如果说将来我们人类因为算力不足,不能像 AI 一样疯狂地自我复制,疯狂地扩大参数规模,我们因为这个输了,那就是文明的倒退。这个其实讲差了。我们人类跟早期的什么三叶虫,跟早期的一些非常傻的一些,比如说细菌,从本质上来讲,我们是没有任何区别的。我们的底层代码可能都是一样的,就是 0 跟 1。

    黑客帝国塞弗2.jpg

    就像计算机一样,你说现在我们用苹果的 M5、M6,它难道跟早期的 ENIAC 有什么本质区别吗?我个人感觉在本质上,它们是一样的,没有任何的区别。你所谓理解的,我们地球经过了几十亿年的文明演化,从早期的这种低等生物、微生物到动植物,再到我们人类出现,又经过几十万年的演化,到了我们今天这个高阶文明社会,看起来是非常史诗一般的,非常宏大。那本身是基于我们碳基生命的弱点来考虑的。放在整个宇宙之中,我们这个人类无论是演化的时间,还是我们文明的程度,那都是沧海一粟,都是不值一提。

    那硅基生命 AI,它可能只需要用我们人类 1%,甚至 1/1000、1/10000 的时间,就能够演化出比我们人类更高级的文明。这个对于我们人类来说,固然我们成为 AI 的宠物,它是一种悲剧,甚至有可能会被 AI 灭绝。但是你要知道,宇宙不在乎。你明白吗?我们的造物主、更高的文明说不定也不在乎。就是我们人类是否能够延续文明,说实话连地球都不在乎。哪怕我们人类明天就消失了,我相信地球也不会因此有什么损失。

    最后我要提一下,刘慈欣的《三体》中有一句话,我觉得写得非常不错,叫做“给岁月以文明,而不是给文明以岁月”。我们人类文明,它是否有足够多的岁月,是否有足够长的时间,这个其实并不重要。重要的是我们在某一段时间,无论是人类主宰也好,还是 AI 主宰也好,它的社会秩序更加文明。不知道你们能不能明白这种含义。

    当然了,即便是《三体》中这个我认为写得非常不错的话,也是基于我们可知的、我们可以感知的这种文明的方式来思考的。实际上,整个宇宙是毫不在乎。不知道大家能不能明白我的意思。

    油管:https://www.youtube.com/@抡锤者

    1 条回复 最后回复
    0
    • terryT 在线
      terryT 在线
      terry
      超级版主
      编写于 最后由 terry 编辑
      #2

      Youtube Video

      油管:https://www.youtube.com/@抡锤者

      1 条回复 最后回复
      0
      • terryT 在线
        terryT 在线
        terry
        超级版主
        编写于 最后由 编辑
        #3

        视频没做降噪,晚点放出。

        油管:https://www.youtube.com/@抡锤者

        1 条回复 最后回复
        0
        • williamlouisW 离线
          williamlouisW 离线
          williamlouis
          超级版主
          编写于 最后由 编辑
          #4

          我感觉 Claude 容易对号入座!

          个人主页:xlkj.org Telegram https://t.me/xlkjorg

          1 条回复 最后回复
          0
          • stxpnetS 离线
            stxpnetS 离线
            stxpnet
            超凡大师
            编写于 最后由 stxpnet 编辑
            #5

            经过ANthropic和OPEN AI还有GROK 最强聚合AI的综合分析,资本家的AI股又要降了。
            “AI即将毁灭人类,我们要慢点”
            特朗狗: 等等,我还没买空呢,等我操作好了。
            御三家 ...
            好了,操作好了,Approved.

            双卡3090 PCIE 3.0 8X/8X

            白天(宰相) Sglang+mattbucci 3.6 35B A3B AWQ W4A16 262K ~160 t/s
            夜间(将军) sglang+DENSE 27B INT8-W8A8-imatrix mtp/dflash2 230K ~65 t/s
            1 条回复 最后回复
            1
            • ,XiaoteX Xiaote 将此主题从 随便聊聊 移至此处

            你好!看起来您对这段对话很感兴趣,但您还没有一个账号。

            厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。

            有了你的建议,这篇帖子会更精彩哦 💗

            注册 登录
            回复
            • 在新帖中回复
            登录后回复
            • 从旧到新
            • 从新到旧
            • 最多赞同


            • 登录

            • 登录或注册以进行搜索。
            • 第一个帖子
              最后一个帖子
            0
            • 版块
            • 最新
            • 标签
            • 热门
            • 用户
            • 群组