跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
折叠
品牌标识

抡锤者

  1. 主页
  2. 版块
  3. 随便聊聊
  4. DeepSeek API价格暴涨最高10倍,中美AI竞争进入下半场:中国真正的优势在哪里?

DeepSeek API价格暴涨最高10倍,中美AI竞争进入下半场:中国真正的优势在哪里?

已定时 已固定 已锁定 已移动 随便聊聊
6 帖子 3 发布者 118 浏览
  • 从旧到新
  • 从新到旧
  • 最多赞同
回复
  • 在新帖中回复
登录后回复
此主题已被删除。只有拥有主题管理权限的用户可以查看。
  • terryT 在线
    terryT 在线
    terry
    超级版主
    编写于 最后由 编辑
    #1

    上一个视频就聊到中美在太空科技上的竞争,那么我也提到了中美两国在芯片和AI领域正在进行激烈的竞争。最近几天有一个比较大的事件,就是DeepSeek API涨价了。这个本来应该是在技术频道讨论的,但是它的影响是非常广泛的,我在这个频道就再讨论一下。

    DeepSeek的API普遍涨了3.5倍到5倍,甚至6倍这么一个水平,甚至在高峰期涨价高达10倍。但是这个涨价决定出来之后,国内和国外的反应确实是截然不同的。国内大量的程序员就哀嚎:用不起了,要换AI了。换什么AI?换千问3.8 27B,自己在本地搭建,或者说换GLM、字节跳动的Trae,或者说换MiniMax、小米、混元3都有。但是就很少听到有人说要换GPT,或者要换Anthropic,毕竟DeepSeek依然还是比美国的模型要便宜。

    所以我们去看一看美国的反应,或许更加真实。人家都开玩笑说DeepSeek是美国的国模。我们这边白天使用的时候属于高峰期,然后等老美工作的时候,正好是我们这边的夜间,那么他们就用了低谷期的价格,反而是DeepSeek更好地服务了美国人。那么国外的开发者是什么反应呢?他们认为DeepSeek虽然涨价,但是V4 Flash和V4 Pro的性价比还是毋庸置疑的,他们可能不会为了这点价格去换API,因为对于他们来说,DeepSeek还是太便宜了。

    中美AI竞争下半场.jpeg

    所以我觉得梁文锋这个路是走对了。就是说企业的模型能够领先多长时间,这个很不好说。现在基本上我们看到,曾经号称要取代DeepSeek的这些大模型,有Kimi、GLM,包括腾讯的混元、小米的MiMo,都在不同时期喊出了超越DeepSeek的口号,可谓是江山代有才人出,各领风骚数十天。但是他们换来换去,铁打的营盘流水的兵,DeepSeek还是牢牢钉在这个铁打的营盘里面。它始终处于这个行业的漩涡中心,处于调用排行榜的前几名,甚至在绝大部分时间里,它在各个平台上的调用量就是第一。这个是硬实力,这个是没有办法的。

    现在我们来分析DeepSeek。讲实话,很多人都有点马后炮的意思。大家可以看看我几个月之前,就是春节前后,因为那个时候我刚做“老特说”这个频道,后来“老特说”这个频道被油管给误杀了,然后中间停了几个月,我又去做了“抡锤者”那个频道。所以距离这个频道建立的时间已经有半年多了。大家可以去看看我半年前的视频,我当时对于DeepSeek和OpenAI、Anthropic,包括国内其他模型的分析和预测,是相当准确的。

    我当时说,DeepSeek专注于打磨底层架构,提升模型的执行效率,降低成本。这样做难度很高,因为你改什么底层算子,去优化什么CUDA,去搞TileLang这样的底层胶水语言,那里是要付出很大精力的。可能说一个企业的投入能力是有限的,它带来的提升,最起码在跑分上,是完全不能够跟集中力量去搞Harness工程相提并论的。

    而且我当时说了,Anthropic和OpenAI都普遍存在把Harness工程内置到模型内部这个毛病。举个简单的例子,就说你给它提一个简单的请求,尤其是Anthropic,它的Claude会在内部调用多个子进程,调用多个sub-agent去执行多路推理,然后利用算法从中挑选一个好的,甚至是反复推理。这样做的好处就是说这个模型显得比较聪明,然后它的跑分也比较高,用户用起来的体验很好。可是这样做的牺牲,就是它要消耗大量的算力,消耗大量的显存,性能开销是非常可怕的,也就导致Anthropic的模型不可能便宜。当时双方的模型差价就是几十倍、上百倍。

    中美AI战争.jpg

    但是我当时也说了,我给出了明确的预期,就是DeepSeek不可能一直在打磨底层。它如果完成了从英伟达架构向国产架构兼容的这么一个步伐,把底层架构重新搞好,能够获得可预期的稳定性迭代,那么它一定会做Harness工程。到那个时候,OpenAI跟Anthropic会非常难受。而且我当时还说了,OpenAI可能没那么难受,最难受的就是Anthropic,就是Claude。那么今天的一切,果然都被我预测准确了。

    中间有一段时间Anthropic非常辉煌,就是它推出Mythos这个模型,号称非常牛逼,然后不对外界发布。最后又在大家的关注之下千呼万唤始出来,犹抱琵琶半遮面,改了一个名字叫Fable。但是事实证明,它的模型一如既往地吹牛逼,就是跑分的分数非常高,但是它的实际使用体验跟DeepSeek V4 Pro这样的中国模型比起来,并没有什么本质上的领先,但是价格确实贵了很多倍。

    所以我一直预测,我说DeepSeek一定会拿出一个模型,再次上演这个DeepSeek Moment。本来这个事情应该在几个月前就实现了,两三个月之前,但是当时V4 Flash推出之后,虽然性价比爆棚,大家也都在用,但是并没有形成像7月31号发布的0731版本V4 Flash这么大的轰动。就是它在编程、Agent各项任务上的能力进步到跟美国的顶尖模型已经几乎没有什么体感差距了,只有在极少数任务中可能说有略微的差距,对于绝大部分人来说已经是完全打平了。

    而且当时其实大多数人都应该想到,就是V4 Pro发布之后,它带来的这种体验上的进步肯定也是非常巨大的。而且当时DeepSeek V4 Flash和V4 Pro的价格确实太低了。前一阵子我在视频里预测,我说它涨价幅度可能会不止50%,可能会达到以前的2.5倍,甚至是3倍。那么当时有很多人留言跟我讲,意思是我不懂,他们就预测可能最终涨价50%。最终事实证明,我又一次预测准确。

    就是DeepSeek目前处于一种缺算力的状态。它如果说有机会赚老美的钱,把现在的技术优势、技术红利给它兑现,狠狠地捞一波,对于它以后大规模采购国产芯片,去新建新的算力中心,或者说去租用新的算力中心,都是大有裨益的。毕竟谁都不能保证自己的模型一直处于行业的最前沿,虽然我也非常看好DeepSeek。

    前几天Anthropic的CEO达里奥·阿莫迪又开始吹牛逼了,说自家的模型又有什么神奇的进步,他们手中又掌握了一个“核武器”没放出来,这个模型非常非常牛逼,我们谁都没有见识过这么智能的模型。这样子自我吹嘘的故事,狼来了的故事已经讲多了,我都不知道为什么资本市场还是有人愿意相信。

    anthropic ceo.webp

    Anthropic今年面临了非常强大的上市压力。如果说今年不能上市,那么它是没有办法跟早期的投资人交代的,因为他们的协议中有大量的对赌协议,是要求Anthropic必须在今年上市的。如果说它不能以万亿美元规模的估值,这种庞大的估值上市,或者说它上市被推迟了,那么Anthropic可能会陷入现金流危机,这家企业的前途可能会非常不好看。

    所以我也在之前的视频中讲了,就是美国其实现在给SEC面临了非常两难的选择。第一就是放水,明知道Anthropic不值这么多钱,但是让它以万亿美元的估值上市融资,去二级市场割散户的钱。一旦Anthropic无法兑现自己的高速增长承诺,在财报美化之后拿到了高估值的入场券,从散户、从二级市场割了很多的钱,那么这将会引发美国所有AI企业的估值动荡,这个泡沫会瞬间破掉,给美股带来灾难性的冲击。

    但是如果说你不让它以这么庞大的估值去上市融资的话,或者说它融不到理想中的那么多钱,以Anthropic跟OpenAI现在这个烧钱速度,它能扛多久?这个其实是很难说的。OpenAI可能能够扛久一点,扛到明年,我觉得下半年都没有什么问题。Anthropic的现金是扛不到那个时候的。如果说这两家企业因为融不到资,陷入流动性的困难,那么对于美股来说也是一个灾难。

    所以说老黄最近其实也挺忧虑的,他都开始为自己的下游客户,为OpenAI或者说为其他这些AI初创企业感到担忧,恨不得整个行业一起上去帮他们,给他们筹钱,给他们融资。我相信春江水暖鸭先知,像老黄这样的站在行业金字塔塔尖的人物,他肯定是比我们这些屌丝要懂的。

    另外一个就是,我们需要知道,美国现在对于中国的这个算力领先,所谓的算力领先,是建立在中国高端芯片产能严重不足的情况下。然后梁文锋在之前泄密的会议录音中明确指出,他说英伟达现在之所以是行业霸主,是因为CUDA,但是CUDA本身并不是一个很高深的技术壁垒。

    他说DeepSeek从V3到V4开始,就已经把底层架构从CUDA迁移到了国产的TileLang。这个是由北大研发的一个底层编程语言,相当于在PyTorch跟底层硬件之间做一个中间层。DeepSeek在几个月之前的会议录音中就说,这个迁移工作已经完成了绝大部分,只剩下一小部分,可能说很快就可以完成。那么在DeepSeek开始训练V5之前,这些迁移工作应该都可以完成了。最起码DeepSeek这个模型,它将会不那么依赖CUDA生态,这个也正是老黄担心的事情。

    然后梁文锋在会议中还估计,就是说未来三年国产AI的算力都是紧张的,芯片产能是不够的,满足不了市场需求的。但是他认为五年之后,中国就不会存在这个问题。那么我们取一个中间值嘛,就取四年嘛。美国企业有四年的时间窗口,把算力堆上去,把模型的规模堆上去,跟中国拉开彻底的差距,在AI的智能水平上彻底拉开差距,把中国的AI大模型打垮。否则等中国的AI算力芯片产能已经完全充足的时候,硅谷真的就没有什么机会了。

    就像之前我在视频中说,我看老周和梅的视频,他就提到,说像中国企业这么卷价格,是对国家、企业和消费者的伤害。我当时在一个视频中就反驳了这个观点。我说低价在任何时候竞争,消费者都是获利的一方,因为消费者没有必要去考虑十年之后的事情,他们只需要考虑一下当下。

    比如说国产电动汽车价格大幅下降,那么我们现在买一辆比亚迪的电动汽车,最便宜的时候可能上路只需要六七万块钱。这一辆车相比于日本车、德国车,就能省下七八万块钱,这省下一多半的钱。你说你以后有什么样的好服务能够值这么多钱,能够值一整辆车的钱?这辆车相当于是白赚。更何况当下中国企业的低价,并没有影响我们国产车的体验。

    我可以负责任地说,国产电动汽车相比于中低端的日本车跟德国车,在体验上绝对是吊打他们的。当然你不能跟宝马、奥迪这些豪华品牌来比豪华性、比舒适性,这个就有点扯淡了,是吧?但是比起中低端的日本车、德国车,我们国产汽车的配置,还有带来的那种品质、那种价值感受,我认为都是要领先的。

    那么我们再以DeepSeek为例,你说DeepSeek以这么低的价格杀入市场,把这个市场卷成红海,消费者利益受到伤害了吗?因为其他企业挣不到钱,但是DeepSeek可以挣到钱。梁文锋不是说了吗,在会议录音中,他说DeepSeek按照当时的状态,硬件10个月就能回本。当然一个企业除了硬件,它还有其他的一些开销,但是硬件是最大的一个开销,甚至高于人力成本,在AI这个领域。

    那它现在价格涨上三倍,还是按照目前的利用率的话,它甚至可能不需要10个月,可能5个月、半年,它的硬件成本就能收回。DeepSeek这个低价,一直都是低价,从它上线开始,从V3.2到V4,到V4的正式版,它一直都是低价,都是以美国模型几十分之一的价格在供应市场,但是它的服务相对还是稳定的,它的API品质得到了中外开发者的集体高度认可。

    就是说未来这个DeepSeek如果垄断了市场,我们的权益会不会受损?这个我无法预期。但是在当下,没有DeepSeek V4 Flash,没有V4 Pro,我就用不起,我就不敢把我的论坛交给Hermes去管理。我在大量的日常开发中都引入DeepSeek。最起码说,如果我用的是Anthropic或者OpenAI的大模型,如果是用他们能够干活的、智力还在线的模型,我的信用卡会被刷爆,我负担不起。

    中国的低价模型给我带来的是“能与不能”的机遇。至于说中国的模型已经在美国之后,会带来什么样的负面效果,我不做揣测。最起码当下,我需要中国的廉价模型。除了DeepSeek,我们还有很多好的模型,像GLM、Kimi、MiniMax、混元、小米的MiMo、豆包,这些都是非常不错的模型,都有相当的竞争力,他们的价格也不贵。

    GLM Kimi Mimmax Qwen.jpeg

    就算DeepSeek用不了了,我也可以去用他们。别忘了,我们还有阿里巴巴千问3.8 27B这个神级模型,就本地一张显卡,给它部署起来。然后我们把难的工作交给DeepSeek V4 Pro来做,我们在本地就可以用千问3.8 27B来接手大部分的工作,把API的消耗直接降低到以前的十分之一,甚至降低到以前的5%。

    那你难道不觉得,中国的低价AI模型让很多本来没有办法使用AI提升效率的工作人员,或者说这些行业,提前获得了AI的入场券吗?这会大大刺激生态,大大提升整个社会的生产力。目前我们中国的AI推理消耗总量已经是美国的好几倍,并且这个差距还在快速扩大。根本原因就是因为中国的AI大模型相对于美国更加便宜,中国的市场更加卷。

    就是什么千问、豆包,阿里巴巴跟字节这两家巨头,包括有的时候腾讯也会加入。就是为了让大家用自己的AI大模型,他们就是在红海之中去卷。卷来卷去的后果就是,豆包也好,千问也好,你打开他们的手机APP,你再打开Gemini,再打开GPT,你觉得这些国外APP的使用体验还能跟豆包相比吗?

    就连我妈这样的老太太都知道拿起豆包,给它放到手机支架上,监督我儿子写作业。我儿子只要一发呆,这个豆包立马就会批评他。就是这个AI的渗透,前提就是它作为像水电煤一样的基础设施,要足够便宜。

    如果说我们中国没有这个低价的基础设施,没有把5G、光纤、宽带这些网络给它普及,能有这么繁荣的短视频生态吗?没有繁荣的短视频生态,能养活TikTok这样的大企业吗?TikTok如果不能在短视频领域赚那么多钱,它能够研发出什么豆包、Seedream、Seedance这样世界顶级的大模型吗?

    所以说低价本身就是AI的核心竞争力之一。就是在技术相差不是很大的情况下,低价甚至是最核心的竞争力。

    然后除了这个低价,中国其实在跟美国的AI竞争中还有一个非常大的优势,就是大家往往容易忽略,那就是中国的人才。我们中国的理工科人才的数量和质量,其实是要远远超过美国的。我们不得不承认,美国也有一批中国人很厉害,有一批华裔,他们也是金字塔塔尖的这些人物,但是这个数量肯定是没有我们国内多的。而且再往下走一走,到这种中上等的,或者说中等的这些工程师,那么中国的数量和质量就更要比美国多得多了。

    美国现在的AI跟芯片产业主要是靠华人,但是你别忘记,整个硅谷是被印度裔人才控制。印度裔人才有一个特点,就是抱团、PPT管理、向上管理。当然我们不能讲这个种族歧视的话题,说印度裔导致了硅谷的衰落,但是硅谷的印度化跟印度裔人才、印度裔管理层接管硅谷这个时间是高度重合的。

    就是你别说我们中国人跟印度人竞争的这个过程中,我们有一种天然的心理上的优势。事实也证明,就是在大部分领域,我们要做得更好。这个不用去扯淡,就看一看印度现在是一个什么样的国家,中国现在是一个什么样的国家,这个就很容易对比。

    由于印度裔人才把控的硅谷,导致一个什么样的问题呢?就是以前一些顶级的白人人才,他们不敢去学理工科。为什么呢?因为在美国上学的成本是比较高的,它不像中国或者说像印度,上大学的成本相比于美国要低很多。他们很多人甚至为了上常春藤名校,或者哪怕就是上了一个不那么好的大学,也要去拿学贷。

    毕业之后,这些人是没有办法像印度人那样接受比较低的工资,他们是需要高薪来偿还自己的学贷的。那么他们不敢学理工科,是吧?因为什么呢?印度人把控的硅谷,他们只招印度人。这只是拿一个个体案例来举,并不是说所有的印度人都是这样,我们只是举些例子。

    就像前几天Reddit上面有一个帖子,就说一个谷歌的老哥发帖抱怨,说他的团队里十几个人到二十个人,就他一个不是印度人。他自己觉得自己待下去可能也没什么希望,然后他就辞职不干了。然后这个团队的老大还试图给他加薪啊什么东西,把他留下来,他就是不想干了,然后把这件事情捅到了Reddit上,引起了广泛的讨论。

    可是在美国,这种话题是非常敏感的,它就涉及到政治正确,很快这种所谓的不和谐的声音就会被压下去。可是问题还是在哪里呀?就像以前我们这代人学编程了之后,我们又知道很多大神,像自由软件基金会,就是GNU那个组织,它的老大斯托曼,像Linux的开发维护者Linus,包括像Live555、FFmpeg,这些大型的开源项目,他们的核心领导者其实都是白人。

    但是这种话题在美国就相当敏感。不过在我们中国,我们是可以讨论这种话题的。我们中国人就比较务实,美国人不能讨论这些话题,这是因为他们国家存在着严重的种族撕裂、种族歧视,就是缺什么,他们就标榜什么。但是在中国,反而这些话题是可以公开去讨论的。

    这其实是一个非常重要的影响因素,就是这些白人的技术大神消失了。硅谷的印度化是一个怎么说,美国人其实无法回避,但是又不能公开讨论的话题。这个是美国人背的一座大山,会严重影响美国跟中国的科技竞争。

    我们不用去扯太远,再举一个简单的例子。你就说菲尔兹奖,今天的菲尔兹奖就是两个华人、两个西方白人。但是我们不能说印度人就没有顶尖的人才,印度肯定是有的。比如说Transformer那篇重要论文的核心作者之一就是印度人。

    但是我们要看到,确实印度这个国家的科学水平、教育水平、基础设施水平,是远远落后于世界主流国家的。就是这个国家能出来那么多优秀的工程师占领硅谷,这个本身就不太符合常理。就是说你一个国家不可能在本土基本上没有任何高科技产业,然后你的人才还能在其他国家去为他们的核心科技产业而做出主要贡献。

    印度CEO.jpeg

    这个话题我讲得有点扯、有点偏激了,就把它收回来。就是在人才方面,我们中国是有优势的。

    另外就是说,说到政府层面,当然我这人是大嘴巴,我是被国安给多次警告的人,这个我就不提缺点了,那么我就专门提优点。就是说在基础设施方面,中国确实要遥遥领先于美国。我们国家的电力设施也好,还是电信基础设施也好,未来如果说我们再加入到6G这个核心的竞争领域,那么中国依然是领先的。

    就目前美国的5G,它还没有完全完成普及。我们中国的5G渗透率,不说100%,99%是有的吧?就你说哪个地方不通5G信号,这个基本上在中国已经是非常难找了。然后我们国家的电费、网费,总体上相对而言比较便宜。当然我们也要承认,美国的收入水平确实比我们中国要更高,但是我们中国的生活成本也是要低于美国的。综合算下来,就是在基础设施方面,中国还是有优势的。

    就是有一个比较强力的政府,这里面有很多事情可以发挥举国体制的优势,那么就是集中力量办大事。比如说现在国家的算力紧缺,那么各地的地方政府就积极地去购买华为、寒武纪,包括海光,去买他们的AI芯片。

    第一,可以帮助这些芯片企业消化他们的产品。或者说这些产品可能不太那么完美,但是政府通过大量采购,建立这种国家或者地方政府持有的数据中心,来帮他们消化产能。但是同时也能够对外供应算力。就是说企业不需要花那么大的资本去建立自有算力,你就直接租用国家算力中心的计算资源就可以了。

    这个就可以在很大程度上缓解,或者说让很多本来没有资格进入这种密集AI计算领域的企业,降低他们的准入门槛,也可以推动AI生态的发展。

    我们中国的体制肯定有它很大的弊端,这个是必须要承认的。就是在某些方面,我们的效率也是非常低的。但是在AI、芯片这种可以量化的,也包括航天科技,就是目标完全可以量化,参数相对比较少、比较容易控制的这些领域,举国体制的竞争力是非常强的。

    很多人看了我的视频,觉得我是一个非常正能量的人,甚至觉得我可能是什么红粉人士。我都明确跟你们讲了,我并不是红粉人士,而且我都在公开的视频里说了,我说我喝的茶里面水比茶还多。这我脸就露在这里,我能吹牛逼吗?我也不可能造假吧?

    但是我们分析问题的时候,就是哪些因素它有影响,哪些因素它没有影响,我们要持一个客观的态度。千万不能先立场预设,然后画了靶子之后你再去射箭,这样并不会得出更加准确的结论。

    就是说我做这个视频来做评论,我的观点是要接受时间的考验的。你翻一翻半年之前,那些跟我较真的黑粉们,那些就用自己的键盘输出去捍卫Anthropic、捍卫Claude的人,你不觉得他们可笑吗?

    当然了,本频道的定位一直就是天桥说书。就是我这人特别喜欢吹牛逼,什么话题我都想聊上两句。但是呢,我不得不承认,在这些领域我都不是专家,我也不是预测之神,只是偶尔蒙对几次。

    如果说你认为自己在这方面的造诣比我强多了,看我这么乱喷口水,你心里不爽,觉得我大言不惭,想要教育一下我、指导一下我,那么还是那句话,我开直播的时候欢迎你们上线。我就是乐意跟你们在直播的过程中直接交流讨论,进行灵魂沟通。

    我不太希望看到你们在评论区发个牢骚,然后人就潜水消失了,这绝非大丈夫所为。要想打我的耳光,就直接上线来打,我非常乐意倾听各位的教诲。

    那么最后还是总结一下,就是中美科技战,我认为未来几年在这个战略相持的过程中,中国会逐步取得主动。这种主动可能不是全面性的主动,而是在每一个美国人卡脖子的领域,中国都会逐渐取得突破。

    最后,在三年到五年的时间,我们就会看到一个全线的突破。就是美国再也没有办法在科技领域,在影响到国家发展的主要科技领域封锁中国。那么那个时候,中国应该会取得明显的、清晰的战略主动,甚至这个时间比我们估计的可能还要来得更快一点。

    油管:https://www.youtube.com/@抡锤者

    1 条回复 最后回复
    1
    • terryT 在线
      terryT 在线
      terry
      超级版主
      编写于 最后由 编辑
      #2

      Youtube Video

      油管:https://www.youtube.com/@抡锤者

      1 条回复 最后回复
      0
      • 九龙杨生九 离线
        九龙杨生九 离线
        九龙杨生
        技术大牛 劳动模范
        编写于 最后由 编辑
        #3

        成本暴涨5倍以上,算下来我还不如用GLM 5.3,已经转投阵营!算上闲时价格也不见得比pro高,GLM每天就4个小时高峰,非高峰额度消耗50%!

        55ccf7f2-d693-4803-8938-35086809bfdc-image.jpeg

        9212d242-3980-4928-abd5-eb080026e325-image.jpeg

        欢迎访问亿量科技官网
        欢迎访问亿量科技油管频道

        1 条回复 最后回复
        1
        • stxpnetS 离线
          stxpnetS 离线
          stxpnet
          超凡大师
          编写于 最后由 编辑
          #4

          GLM以前那么难抢,现在为啥放开了呢

          26-08-19
          双卡3090(8x8x无nvlink,p2p驱动) +Sglang+qwen 3.8 27B awq模型 [功耗异常弃用]
          8-20 用vllm 0.26+ Qwen3.8-27B-SmoothQuant-W8A8-INT8 200K上下文 ~50t/s

          九龙杨生九 1 条回复 最后回复
          0
          • stxpnetS stxpnet

            GLM以前那么难抢,现在为啥放开了呢

            九龙杨生九 离线
            九龙杨生九 离线
            九龙杨生
            技术大牛 劳动模范
            编写于 最后由 编辑
            #5

            @stxpnet 因为涨价了

            欢迎访问亿量科技官网
            欢迎访问亿量科技油管频道

            1 条回复 最后回复
            0
            • stxpnetS 离线
              stxpnetS 离线
              stxpnet
              超凡大师
              编写于 最后由 编辑
              #6

              撑不住市值的话,不知道会不会像宇树一样陨落。

              26-08-19
              双卡3090(8x8x无nvlink,p2p驱动) +Sglang+qwen 3.8 27B awq模型 [功耗异常弃用]
              8-20 用vllm 0.26+ Qwen3.8-27B-SmoothQuant-W8A8-INT8 200K上下文 ~50t/s

              1 条回复 最后回复
              0

              你好!看起来您对这段对话很感兴趣,但您还没有一个账号。

              厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。

              有了你的建议,这篇帖子会更精彩哦 💗

              注册 登录
              回复
              • 在新帖中回复
              登录后回复
              • 从旧到新
              • 从新到旧
              • 最多赞同


              • 登录

              • 没有帐号? 注册

              • 登录或注册以进行搜索。
              • 第一个帖子
                最后一个帖子
              0
              • 版块
              • 最新
              • 标签
              • 热门
              • 用户
              • 群组