跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
  • LCZ-Black
折叠
品牌标识

抡锤者

首页 版块 标签 硬件 AI 广场
  1. 主页
  2. 版块
  3. 随便聊聊
  4. DeepSeek不断被各种大模型挑战,然而强者无须自证,它真正牛逼的是踏实的作风和实干精神,以及对技术路线的精准押注!

DeepSeek不断被各种大模型挑战,然而强者无须自证,它真正牛逼的是踏实的作风和实干精神,以及对技术路线的精准押注!

已定时 已固定 已锁定 已移动 随便聊聊
deepseek
2 帖子 1 发布者 107 浏览
  • 从旧到新
  • 从新到旧
  • 最多赞同
回复
  • 在新帖中回复
登录后回复
此主题已被删除。只有拥有主题管理权限的用户可以查看。
  • terryT 离线
    terryT 离线
    terry
    超级版主
    编写于 最后由 terry 编辑
    #1

    DeepSeek是一家非常神奇的公司啊,它最近没有什么重大的产品发布会,但是一直呢就处于舆论的中心。可以说哥虽然不在江湖,但江湖都是哥的传说,是吧。梁文锋从这个梁圣最近变成了梁子,又变成了牢梁。然后呢,各个国产的AI开源大模型不约而同地喊出了要超越DeepSeek的口号。这个GLM-5.3-Flash更是喊出了把这个DeepSeek斩落马下,让DeepSeek跌落斩杀线的这么一个非常夸张的口号。包括这个最近发布的这个什么千问3.8 Flash,以及这个腾讯的HY4 Preview,正在火爆这个OpenRouter平台的这个新的API。哎,他们都不约而同地把这个DeepSeek当做了对比的对象,就他们的这个性能对比表中,永远有这个DeepSeek V4 Flash或者说V4 Pro。就似乎是DeepSeek在他们的这个对比之下,已经是相形见绌。

    当然了,由于DeepSeek涨价确实引起了很多人的不满。就很多人发帖说这个DeepSeek啊涨价不是时候,然后这个梁文锋啊不知轻重,他要付出代价,怎么怎么样,这家公司未来就完蛋了。其实呢,我是提醒这些哥们,就是我在视频中多次指出,我们呢还是关心一下自己的下一个外卖到底是点10块钱的,还是点15块钱的,是吧,要不要加卤蛋,要不要加猪排。咱不要去操亿万富豪的心。梁文锋身家几千亿,在这个DeepSeek融资的时候,人家一次性就拿出了200亿去投资。就200亿现金是个什么概念,哥们?中国有多少上市公司能够拿出这个钱?中国有多少地方政府能够拿出200亿现金?这么夸张的这个数字。是吧,人家就算从现在开始躺平了不干了,这钱要花到什么时候?是吧,我们不要去操亿万富豪的心。如果说梁文锋和DeepSeek在作死,我们就让他死,是吧,让他自生自灭不就行了吗?是吧,没有必要去操亿万富豪的心,觉得他这里做错了,那里做错了,是吧。

    DeepSeek无须自证.jpeg

    梁文锋是干什么的?做幻方量化起家的。人家说不好听的,每天就是在这个做这个短线搏杀,是吧。当然了,公司也不排除有这个长线投资,不过量化基金嘛,以AI大模型预测交易,进行这个短线的操作。用不好听的话来说就是割散户。就人家的这个模型肯定是要有足够的智能,是吧,肯定要经过这个生产力的这个验证,它肯定也不是个玩具,否则人家不可能在市场上割到这么多钱。你说有哪个大模型能像DeepSeek这样,从娘胎里就带有这个工具属性,带有强烈的这个应用价值?金融市场应该算是AI应用价值最高的领域之一吧,可能能跟它比的就什么生物医疗,是吧,法律这些领域。是不是人家已经是证明了自己的能力?就第一,不要说DeepSeek这个模型蠢;第二,不要说梁文锋蠢。不用你们担心,就你们用不用,人家都是亿万富豪,是不是,是百亿富豪、千亿富豪,完全不用去操别人的心。我们把自己一亩三分地管好就行了。

    就如果说你觉得这个模型好用你就用,是吧。像我一个月能花个几百块钱的,是吧,我也不觉得我消费了几百块钱,我就成了DeepSeek的精神股东,梁文锋什么开会的时候都得提一下我,然后我有什么意见,这个DeepSeek的董事会要立马召开会议,把我的这个意志贯彻下去。我也没觉得是这样,是吧,我毕竟不是宇宙的中心。然后我要说就是我们关注一下OpenRouter啊,就是这个聚合平台。就是DeepSeek始终是排在第一和第二的位置,涨价之前如此,涨价之后也是如此。就那些挑战它的模型,可能说上来,哎,江山代有才人出,各领风骚十数天,连数十天都做不到。比如说这个OX Alpha,牛来,也就是GLM-5.3,是吧,靠着免费确实大火了一把,但是呢收费的第一天就跌下去了,就被这个DeepSeek V4 Flash给反超了,是吧。然后就是千问3.8 Flash,是吧,喊出了这个超越DeepSeek V4 Flash的这个口号,结果就是在实际的测评中,就是又慢,这个智力也不是那么的惊艳,就遭到了广大网友的群嘲,它也没有成功嘛。

    OxAlpha实测2.jpeg

    最近正在上演的就是腾讯的这个叫什么HY4 Preview,也是号称要超越DeepSeek V4 Pro。现在这个流量也是爆棚,但是我个人实测之后,我感觉超越DeepSeek V4 Flash都是个问题,更不要说去碰瓷Pro了。这个我相信再过个两个星期,我们就能够看到事情的真相,是吧。没有必要急着为DeepSeek担心,给DeepSeek判刑。就要我说呢,DeepSeek这家公司呢,它是有它的硬实力的。木秀于林,风必摧之。就一直被碰瓷,从未被超越。

    我们其实回想一下DeepSeek这一路走来,其实是打了很多硬仗的。就首先DeepSeek V3带火了这个MoE架构,R1带火了这个思考模式。然后呢,DeepSeek就进入了这个安静的发展期。就各家都在卷这个什么思维链,是吧,DeepSeek又开始做这个HCA、CSA这个注意力机制的研发,把这个长上下文它的效率给做上来,是吧,它的召回准确率给做上来。然后同时把这个什么KV缓存,它的这个效率给它做好,通过Engram架构能够做到静态知识权重,还有KV缓存的这个什么显存、内存以及SSD三层缓存。这就是实打实的技术啊。这也是DeepSeek后来为什么能够成为价格屠夫,能够建立DeepSeek斩杀线的根本原因,就是因为人家的基本功打得扎实,人家的成本就是可以做得很低,你就是做不到这么低。

    是吧,那么当这个DeepSeek斩杀线建立完毕之后,这个公司就发布了V4 Flash跟V4 Pro两个模型,接着又在这个V4 Flash的0731跟这个什么V4 Pro的0813这两个版本中展现出了非常好的生产力。而且在这个DeepSeek Vision Flash的这个视觉模型中,又把这个视觉模块给补齐了,是吧。现在市场都非常期待它的这个V4 Pro也能够把这个视觉模块给补齐。是吧,在你不经意之间,人家就开始向这个原生多模态开始发展了。就是基本功做得很扎实,一项一项基本功能,就把这个基本功给它打牢,把最核心的这些模块给它做扎实了。没有必要一天到晚去拼什么跑分,搞什么宣传,今天斩杀这个,明天斩杀那个。DeepSeek从来没有在任何一次公开会议中说它要斩杀谁,它要在世界上跑分超过谁,它对标谁。人家有自己的节奏。梁文锋不是说了吗,相比于AGI,现在所有的利益都是芝麻,是吧,只有AGI这个利益才是西瓜。在这个过程中,他们不太会在乎你个人,或者说甚至是企业用户,你们怎么想,人家这个公司根本就不在乎。

    梁文锋.jpeg

    就第一,人家确实是融到了资;第二,这个DeepSeek这家公司的架构非常的轻,然后它的成本、运行成本也非常的低,它的业务模式就非常的简单,就是卖API。梁文锋在这个泄露的会议录音中不是说了吗,公司硬件10个月就能回本。当然了,它还得算上什么人工啊、场地啊这些其他的一些开销,是吧。不过这个模型已经是,盈利模式已经是非常的健康了,是不是?就完全没有必要操心DeepSeek会倒闭。就是人家做出这个决定的时候,后台一定是有大量的数据来分析用户的画像,哪些会留下,哪些会出走,是吧。涨价之后,人家在这个什么聚合平台上面,是吧,在这个OpenRouter上,人家还是调用量第一第二,是吧。你来挑战它的模型就是一个接一个,但是最终都没有一个能够长久的。人家自己的官方API调用量一样是非常的火爆。

    哎,说到这个多模态,我还得补充一下。就说DeepSeek它最近不是把这个V4 Flash的这个视觉模块给它补充上去了吗?这个大家也非常的期待它这个V4 Pro什么时候把这个视觉模块给补充上去。其实呢,我本身认为这个应该是很快的事情了啊,我们不用去着急。但是呢,我想说这里面就反映出另外一个,就是DeepSeek以后可能藏有的大招。我认为如果说有DeepSeek moment 4.0的话,它应该是什么?它很有可能就是DeepSeek的这个多模态。

    就是我们普通地讲这个多模态,比如说文生图啊、文生视频啊,是吧,图生视频啊,它走的都是什么?Diffusion路线,就是扩散模型的路线。我们知道扩散模型,它是这种怎么讲呢,先在一个充满噪点的这个画布上面去猜,比如说降噪,是吧,最终得出一个清晰的图像。细节可能说做得很好,它这个上限也是比较好的,能够用来讲故事。但是我们要知道,扩散模型它跟这个大模型,跟这个通用文本大模型之间是没有办法打通的。就它是没有办法用统一的语义打通的,要做一个转化。那么这就决定了它没有办法用这个通用大模型的很多已有的成熟的架构,比如说KV缓存。

    再比如说,如果说仅仅是讲故事,那可能说问题不大。但是将来这个AI大模型要是不断进化,它需要模拟我们这个世界,对我们这个世界进行建模的时候,那么扩散模型的劣势就会无限放大。就真正这条路能够走通的,可能还是要走这个Tokens路线。DeepSeek在这一方面其实是早有布局,它在很早之前就发布了这个什么Janus、Janus Pro和JanusFlow。哎,这些开源的项目大家可以去GitHub上去关心一下,去关注一下。这个可能是DeepSeek隐藏的一个大杀招。

    你们不要以为只有DeepSeek这么搞,我跟你讲,中国另外一个我特别看好的AI大模型企业,就是字节跳动。字节跳动在扩散模型这个路线上,它的Seedance、Seedream做的都是世界顶级的。Seedance 2.5就是世界上最好的视频模型,这个应该是毋庸置疑的,无可争议的,是吧。但是你们可能不知道,字节跳动也在重磅地投入这个Tokens多模态路线。哎,这个非常值得我们观察。

    Agent大盘点.jpeg

    当然了,我们也不要忘记DeepSeek最近发布的另外一个重磅产品,叫做DeepSeek Harness。哎,这个有可能成为人类这个最好的开源AI Agent,甚至就是最好的AI Agent。这个OpenClaw大火之后,到现在可能有半年多的时间了,是吧,它这个星标就是暴涨到了这个40万星,被黄仁勋称为人类历史上最伟大的软件发布,当时引起了在全世界范围内就是全民养龙虾的这么一个热潮。但是呢,仅仅几个月之后,它由于这个框架设计糟糕,这个性能不稳定,性能不好,这个插件的质量良莠不齐,是吧,被这个以自进化为特征的Hermes给取代了。它的平台Tokens消耗量就完全不如Hermes了,这还是几个月之前发生的事,是吧。

    那么经过这个几个月的发展,Hermes它的星标是多少?20多万星。这个已经是非常优秀了。就是说我们这个开源这个编程领域,包括这个OpenCode这样非常优秀的Agent,它经过长期的发展,大概也就是20万星的水平。就大家比较看好的,认为是什么Agent未来方向的这些比较牛逼的、尖端的这个叫什么Pi Agent,它只不过是几万星的水平。要知道它们可是经过了长期的发展积淀。包括这个什么Codex,OpenAI的产品,是吧,从去年之后发布,先开源这个CLI,然后又开源这个整个Harness框架,它也就是10万星的水平。

    DeepSeek Harness呢,发布之后到现在不到三个星期,两个多星期时间,它就从零干到了20多万星,直接进入了世界顶级Agent的领域。它现在发布的还仅仅是RC版本,Alpha版本还是在这个主干的源码中,还没有正式发布,它就已经这么恐怖了,已经得到了广大开发者、广大爱好者的这个拥护。就像这样一家有实力的研发公司,就这么低调,但是这个成果拿出来,单项拿出来,总能够震撼世界的这么一家公司,我们干嘛要去担心它倒闭呢?是吧,我们担心自己这个渺茫的前程是不是更加切实一点呢?

    当然了,我在这个之前的视频中,我曾经对国产的各种AI大模型其实是大加赞赏的。比如说小米的这个MiMo V2.5,然后GLM 5.2,这个腾讯的这个HY3,包括这个Kimi K3,都在某种程度,或者说全面性地得到了我高度的认可。尤其是这个小米的这个MiMo跟这个腾讯的HY3,这两个模型我是基本上是主力,就是主要方面我都是这个赞誉有加的,我认为做得非常的不错。就是在特殊的领域,它们性价比是非常高的。甚至这个HY3一度被我认为是最接近DeepSeek效率的这么一个模型。

    腾讯HY3.png

    但是当这些模型它们走上了这个Anthropic,就是Claude这种重思维链,把这个Harness工程内置到API这个路线的时候,我也毫不犹豫地批评它们。我认为这些公司是走上了邪路。就是说,第一,这样做会严重地提升成本,降低效率,增加时间成本;第二呢,就是它也会这个,它的这个什么Tokens开销,对于硬件的这个开销,也会远远大于原生输出智力比较好的模型。

    就我发表这些观点,并不是因为说我是什么梁文锋的粉丝,我是DeepSeek的精神股东,而是DeepSeek这个路线,它是一个正确的路线,它是我看好的路线。我相信我的频道是要经过长时间考验的。大家可以翻看我半年前的视频,就我这个频道刚刚创立的时候,是春节的时候,是吧。那个时候我可能说面对镜头我还不那么自然,因为很久没有做这种真人露脸的视频了,我都上去写稿子,然后可能说自己要对着镜、对着笔记本去念稿子。

    在那个时候我就做出了非常准确的预测。第一,我预测OpenAI在这个短期的竞争力会被Anthropic给这个全面压制,但是我认为Anthropic这家模型,这家企业它的这个上限是不如OpenAI的,它最终,OpenAI还是要回到这个市场引领的这么一个地位。第二,就是我预测中国的大模型会快速地迫近美国的大模型,就这个差距会越来越小。而且我还预测DeepSeek一定会拿出这个DeepSeek moment 2.0,再一次震撼全球。是吧,现在我认为它都不是2.0了,它这个V4 Flash跟这个V4 Pro算是moment 2.0的话,那么它的这个什么DeepSeek Harness,那绝对算是DeepSeek moment 3.0。

    中美科技战.jpeg

    另外我也准确预测了中国芯片产业的这个发展。我当时说了,我说我们不要对中国的这个芯片产业过分地悲观,我认为可能在不到两年的时间内,我们过去认为不可突破的这个所谓的5纳米黄金节点,就会被突破。当然了,不一定是用传统的这个晶圆微缩的这个路径,而是中国会找到其他的方式来突破。你看这才过了半年多时间,是吧,华为这个麒麟9050 Pro这个芯片,就通过这个逻辑折叠技术,因为它9月就要上线,很快我们就要看到实际的产品,是吧,它就能够做到台积电早期3纳米的这个等效效能。那这又是一个重大的突破。

    就我举这些例子,并不是为了展示自己多么牛逼,总能够准确地预测未来。实际上我们这些人,说白了在油管上开设频道,也就是图这个逗个乐子,天桥说书,是吧,茶楼这个说书,是吧,给大伙解解闷,逗个乐子。有说得好的,大家就捧个钱场,捧个人场;说得不好的,大家就海涵。是吧,不要像评论区的某些酸民,就经常发表一些智障言论。比如说,这个什么主播,他的观点就只能代表他一家之言,怎么怎么样,又怎么怎么Low。你说像这种人,你就算给他100个AI,给他最先进的AI,能够改变他的智力吗?

    我当然发表观点只能代表我自己,我能代表梁文锋吗?我能代表马云吗?我能代表马化腾吗?我能代表马斯克吗?就这种人连基本的逻辑都没有,就经常在我的评论区大放厥词,一会说DeepSeek不行了,一会说中国不行了。这个中国行不行,DeepSeek行不行,我们不要急着下定论,是吧。是骡子是马拉出来遛遛,对吧,我们不要急着盖棺定论,这个时间会说明一切。

    当然,如果说你不认同我的某些观点,或者说我的某些观点你认为需要完善,那么我也欢迎大家不吝赐教,是吧,在评论区积极发言,在我的这个论坛去发帖,是吧,向我提出问题,或者说给我上一课,我都是非常乐意的。但是请大家不要用一些情绪化的语言,尤其是发表一些暴露智商的这些评论,就非常的Low。好吧,本期视频就到这里,我们下期再见。

    油管:https://www.youtube.com/@抡锤者

    1 条回复 最后回复
    0
    • terryT 离线
      terryT 离线
      terry
      超级版主
      编写于 最后由 编辑
      #2

      Youtube Video

      油管:https://www.youtube.com/@抡锤者

      1 条回复 最后回复
      0

      你好!看起来您对这段对话很感兴趣,但您还没有一个账号。

      厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。

      有了你的建议,这篇帖子会更精彩哦 💗

      注册 登录
      回复
      • 在新帖中回复
      登录后回复
      • 从旧到新
      • 从新到旧
      • 最多赞同


      • 登录

      • 登录或注册以进行搜索。
      • 第一个帖子
        最后一个帖子
      0
      • 版块
      • 最新
      • 标签
      • 热门
      • 用户
      • 群组