<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[DeepSeek算力危机严重？朋友反驳了我，也抛出了OpenAI和Anthropic更大的问题！硅谷AI的估值泡沫也不容忽视！]]></title><description><![CDATA[<p dir="auto">前几天我做了个视频，谈DeepSeek的算力危机。我说DeepSeek如果在年底开训V5版本，它的激活参数从49B提升到150B，总参从1.6万亿提升到4万亿到5万亿左右的规模，它很有可能找不到足够多的算力。梁文锋在这个泄露的会议录音中，表达了对于华为某种程度的不满。他提到，华为给他们的卡的配额大概就只有16,000张，只相当于四五千张英伟达的B系列计算卡，但是华为给头部大厂，像字节跳动、腾讯的卡，可能都是10万卡左右的规模。DeepSeek可能受到了冷落，因为我帮你做这个生态，但是你给我的卡却不够。</p>
<p dir="auto">但是我们也需要看到一个比较吊诡的现象，就是在8月1日，DeepSeek在OpenCode这一个平台上，单日就消耗了8万亿tokens。再加上它自己的免费网页平台、它的API，包括V4 Pro的调用，还有OpenRouter.ai这些聚合平台上的调用，它的单日tokens消耗量应该是冲到了15-20万亿tokens这么一个非常夸张的区间。这个区间就已经和OpenAI这样的头部模型处于同一个梯次了。那么我们知道，OpenAI可是有200万卡规模的计算集群（估算），而且他们的显卡质量可能比DeepSeek要更高，因为他们有大量的B200、B300，算力肯定要比DeepSeek的主力H100、H200、H800这些要更好。</p>
<p dir="auto"><img src="https://upload.lcz.me/uploads/c5159c35-be65-44be-a75f-5e8612cd5c91.jpeg" alt="DeepSeek算力够不够用.jpeg" class=" img-fluid img-markdown" /></p>
<p dir="auto">所以说，我朋友看了这个视频之后，他就跟我聊天，嘲讽我对这个问题不懂，叫我不要乱说。他说我的有些信息可能是错误的。比如说，外界普遍估算DeepSeek有2万张卡，就是英伟达卡。那么这2万卡指的是什么呢？H100、H200、H800这样的算力比较好的卡。在这个禁令生效之后，DeepSeek又囤积了大概3-4万张H20。这个H20就是阉割版了，它虽然说用来做训练性价比不高，但是做推理的话，它还是能够胜任的。另外，就是华为今年说向DeepSeek交付16,000张卡，包括950PR、950DT。无论如何，它能够把一部分的英伟达卡给解放出来。如果说是这个当量，按照梁文锋在会议中抱怨的那样，对比B200、B300，它只相当于四五千张；但是如果说是对比他们现在正在用的H20，950PR的单卡算力就相当于H20的三倍，这个对于DeepSeek在推理侧的能力提升是非常非常重大的。</p>
<p dir="auto"><img src="https://upload.lcz.me/uploads/3bbf4002-2433-40f2-8dc4-d10d9e4aadac.jpeg" alt="华为atlas950超节点.jpeg" class=" img-fluid img-markdown" /></p>
<p dir="auto">另外，华为也不仅仅限于这样的交付方式。就是说我给你卡，如果这个卡不够的话，那么华为的云计算中心、华为云也可以给DeepSeek提供备份算力。就是说API依然走你DeepSeek官网，但是如果你这个洪峰流量来的时候你接不住，我这边给你开这个智算集群，来承担你的洪峰算力请求。另外，华为在各地和地方政府合作建了很多的万卡计算中心。不止华为了，像海光，其他的一些什么寒武纪这些厂商，他们都提供了不同的算力方案。海光跟郑州市政府最近不是开了个10万卡集群吗？总体上你可能说这个规模也只相当于英伟达的1万张B200的算力，但我不知道具体的参数，我只是做一个类比。因为海光的DCU走的是AMD的路子，相当于也是走HIP、ROCm兼容CUDA的这个生态，它的算力等效比起英伟达的顶级显卡肯定是差的，但是我们姑且估算为1万张B200吧。</p>
<p dir="auto">那么这样的算力中心供应出来之后，如果说DeepSeek将来需要训练超大规模的模型，它可以租个一个月、两个月、三个月，这个就可以训练非常大规模的AI大模型了。并且不同的计算中心之间，它们是可以跨城协调的。大模型的训练并不需要你所有的计算都发生在一个计算中心，可以通过路由调度的方式，把这个延迟高的通信部分给它抽象出来，整体打包发送。那么超大规模的MoE是可以分散到不同的地方去训练的，不仅仅是在不同的云计算中心，甚至是在不同架构的芯片上面也可以协调。</p>
<p dir="auto"><img src="https://upload.lcz.me/uploads/e408bdc1-ed13-422e-80aa-0adf9fb2d87e.png" alt="TileLang.png" class=" img-fluid img-markdown" /></p>
<p dir="auto">比如说现在我们中国北大团队搞的这个TileLang，DeepSeek梁文锋在前一阵子的会议录音中不是已经宣布了吗？他是在几个月之前说，DeepSeek在V3版本、V4版本的时候，已经完成了从CUDA向TileLang迁移的主体工作，还有一些收尾工作，他相信很快就能完成。我估计到年底开训V5的时候，这个TileLang迁移应该是基本上完成了，这个就可以让DeepSeek实现华为的卡、英伟达的卡，甚至是什么寒武纪的卡跨卡协调。当然我们要知道，除了像什么华为、寒武纪、海光、沐曦科技、壁仞科技这些走传统AI芯片路线的，我们中国还有什么东方算芯，对吧？它这个DF1000、DF2000，DF2000年底就会发布，它的算力也会达到跟H200相当的水平，而且它在带宽上面、在数据交换的效率上面还要更好。并且它是14纳米制程，中国在这块的产能是非常充足的，几乎可以说不限量供应。</p>
<p dir="auto">也就是说，从短期来看的话，DeepSeek并不存在所谓的算力危机。最起码说它算力可能紧张，但是没有到严重危机的地步，没有到无法延续、无法发展的地步。另外，他还提出了一个非常有趣的观点，这也是我为什么想开直播跟大家讨论技术问题的这么一个原因。当然了，他不一定会上麦，因为这个人比较自闭，比较内向。他说什么呢？他说我们可以反过来看，如果说DeepSeek以现在比如说五六万张英伟达显卡，加上少量华为950PR芯片的计算能力，能够承担跟OpenAI几乎是同等规模的请求的话，那么也就意味着OpenAI模型的整体效率可能只有DeepSeek的几十分之一。</p>
<p dir="auto"><img src="https://upload.lcz.me/uploads/033ecbdf-8c95-41d4-a28b-5d110234f5db.jpeg" alt="梁文锋.jpeg" class=" img-fluid img-markdown" /></p>
<p dir="auto">现在我们不能说DeepSeek的模型能够取代OpenAI，能够取代Anthropic，但是我们要知道，相比于GPT，相比于Claude，它的成本也要便宜几十倍。90%的请求，90%的任务，甚至95%的任务，都是可以用便宜的DeepSeek模型来完成的。那么最后留给你Anthropic、留给OpenAI的高端市场，可能就只有那10%，甚至不到。那么问题来了，仅靠这10%，甚至是5%的市场，能够支撑你们两家那么庞大的估值吗？硅谷如果说投入了几万亿美元，甚至是几十万亿美元的总体AI相关投资，最后你没有办法回本，这个成本最后要由谁来承担？</p>
<p dir="auto">我这个人获取信息的方式是比较碎片化的。然后我聊什么话题，大家有的时候说，你对着笔记本念稿子啊，还是怎么样？实际上我是完全不需要对着笔记本念稿子的。只是由于很长时间我是深居简出，那么与人沟通的次数比较少，我的语言表达能力出现了一定程度的退化。我现在要重新激活这个能力，其实并不难。但是我也不得不承认，我在很多问题的及时反应上，可能说我的思维能力还不错，但是在于深度分析，找到一些比较独特的视角来窥探整个事件，来切中整个事件的要害，在这一方面，我可能说比起我的一些朋友还是要有差距的。</p>
<p dir="auto">就像前几天我在视频中提到，Anthropic跟OpenAI他们都面临着上市的压力。Anthropic跟很多投资者承诺，就是今年必须要上市。如果今年不上市的话，当然了，这些投资者就有权利要求他们回购巨额的股份。但是不一定会发生的，不一定会真的强制要求，不过他们是有这个权利的。OpenAI是说拒绝以低于万亿美元的估值上市。Anthropic最后要不要妥协，这个不好说。但是我们假设这两家公司就算真正地上市了，从二级市场融到了钱，从散户那里割到了韭菜，如果说这两家公司在后续的运营中，他们的模型没有办法比DeepSeek拉开明显的差距，然后越来越多的人都知道DeepSeek便宜好用，他们的市场又被高度分化，没有办法兑现他们那么高的市场估值，这个就可能引发市场对于硅谷企业高估值的信仰崩塌，引发这个雪崩式的效应。</p>
<p dir="auto"><img src="https://upload.lcz.me/uploads/5a3e93e9-862d-417b-8465-361034c77181.jpeg" alt="谷歌openAI XAI.jpeg" class=" img-fluid img-markdown" /></p>
<p dir="auto">当然了，他还提到，我们中国不仅有DeepSeek，还有什么字节跳动的豆包、Seedance、Seedream，还有什么阿里的千问、Wan，还有什么混元、Kimi、MiniMax、GLM、StepFlash、LongCat这些模型。虽然它们的能力都算不上是顶尖，当然也包括小米的模型了，但是这些模型都是在各自的领域有一定的生态影响力。它们放到整个国际市场上来还是有性价比的，美国企业要如何应对如此多的高性价比的中国模型，这也是个很大的问题。</p>
<p dir="auto">当然了，他也非常认同我关于中美两国AI竞争的总体局势的判断，就是中美两国各有优势、各有劣势，并不存在谁碾压谁。比如说我们中国在算力方面，我们确实存在着供应短缺的现象，但是这并不能用算力危机来概括。就是通过各地地方政府，包括中央政府，建立国家级或者地方级的智算中心，统一调度算力，来应对洪峰流量的请求，或者超大规模训练的短暂密集算力请求，这个是可以暂时度过这一关的。那么剩下来的就要看像华为、东方算芯、寒武纪这些企业，他们设计的芯片能不能被我们中国的芯片制造业承载起来，把这个产能给冲上去。</p>
<p dir="auto"><img src="https://upload.lcz.me/uploads/35c469b3-eb05-4bfd-9995-faac51cad82b.jpeg" alt="DeepSeek中美大模型.jpeg" class=" img-fluid img-markdown" /></p>
<p dir="auto">像梁文锋估计的那样，可能说未来3年，我们中国企业在算力方面可能都要勒紧裤腰带过苦日子。但是5年之后，他是看到中国在芯片的生产供应上、在算力的供应上，应该就不会有问题了。这5年中国企业要做的并不是说要超过美国的AI企业，超过美国的AI生态，中国要做的就是跟上步伐。因为中美两国的AI竞争，它是综合国力的长期消耗。你说在短期内取得决定性的优势，就战胜对方，这个基本上是不现实的。</p>
<p dir="auto">那么在两国长期胶着、长期相持的这么情况下，不仅仅要比拼谁的突破能力更强，也要比拼谁的耐受力更强。当下在这一方面中国是占据优势的，因为我们突破能力不能说超过美国，但是起码跟美国是属于同一个档次，或者说比它略差一点。但是在耐受力这个方面，包括说在AI的应用生态创新上面，我们是要比美国走得更好，能力要更强的。因此，长期关于中美两国的AI竞争，他跟我是一样，是比较看好我们中国取得胜利。</p>
<p dir="auto">我或者我朋友的观点，我们经常在私底下吹牛逼聊天的这种素材，这个是不能当做正规的媒体分析的，也不能当做什么所谓的行业专家的结论。所以说，能够讲出来，抛砖引玉。那么我开直播的时候，我希望有足够的高手到场来指导。或者说我们就是底层的科技屌丝，我们就是纯粹的爱好者，那么我们商业互吹，一起来表达一下自己的观点，自嗨一下，小范围的自嗨，这也是个不错的选择。反正我能赚点钱，你们能够过过嘴瘾。</p>
]]></description><link>https://lcz.me/topic/1087/deepseek算力危机严重-朋友反驳了我-也抛出了openai和anthropic更大的问题-硅谷ai的估值泡沫也不容忽视</link><generator>RSS for Node</generator><lastBuildDate>Fri, 21 Aug 2026 23:15:23 GMT</lastBuildDate><atom:link href="https://lcz.me/topic/1087.rss" rel="self" type="application/rss+xml"/><pubDate>Wed, 12 Aug 2026 02:00:00 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to DeepSeek算力危机严重？朋友反驳了我，也抛出了OpenAI和Anthropic更大的问题！硅谷AI的估值泡沫也不容忽视！ on Wed, 12 Aug 2026 02:00:00 GMT]]></title><description><![CDATA[<p dir="auto"><a href="https://youtu.be/RnG6vh3raAU" rel="nofollow ugc"><i class="fa fa-youtube" aria-hidden="true"></i> Youtube Video</a></p><div class="js-lazyYT lazyYT-container" data-youtube-id="RnG6vh3raAU" data-width="640" data-height="360" data-parameters style="width:640px;padding-bottom:360px">
 <div class="ytp-thumbnail lazyYT-image-loaded" style="background-image:url(&quot;https://i.ytimg.com/vi/RnG6vh3raAU/hqdefault.jpg&quot;)">
  <button class="ytp-large-play-button ytp-button" tabindex="23" aria-live="assertive" style="transform:scale(0.85)" onclick="$(this).lazyYT(this);return false;">
   <svg height="100%" version="1.1" viewbox="0 0 68 48" width="100%">
    <path class="ytp-large-play-button-bg" d="m .66,37.62 c 0,0 .66,4.70 2.70,6.77 2.58,2.71 5.98,2.63 7.49,2.91 5.43,.52 23.10,.68 23.12,.68 .00,-1.3e-5 14.29,-0.02 23.81,-0.71 1.32,-0.15 4.22,-0.17 6.81,-2.89 2.03,-2.07 2.70,-6.77 2.70,-6.77 0,0 .67,-5.52 .67,-11.04 l 0,-5.17 c 0,-5.52 -0.67,-11.04 -0.67,-11.04 0,0 -0.66,-4.70 -2.70,-6.77 C 62.03,.86 59.13,.84 57.80,.69 48.28,0 34.00,0 34.00,0 33.97,0 19.69,0 10.18,.69 8.85,.84 5.95,.86 3.36,3.58 1.32,5.65 .66,10.35 .66,10.35 c 0,0 -0.55,4.50 -0.66,9.45 l 0,8.36 c .10,4.94 .66,9.45 .66,9.45 z" fill="#1f1f1e" fill-opacity="0.9">
    </path>
    <path d="m 26.96,13.67 18.37,9.62 -18.37,9.55 -0.00,-19.17 z" fill="#fff">
    </path>
    <path d="M 45.02,23.46 45.32,23.28 26.96,13.67 43.32,24.34 45.02,23.46 z" fill="#ccc">
    </path>
   </svg>
  </button>
 </div>
</div><p></p>
]]></description><link>https://lcz.me/post/11920</link><guid isPermaLink="true">https://lcz.me/post/11920</guid><dc:creator><![CDATA[terry]]></dc:creator><pubDate>Wed, 12 Aug 2026 02:00:00 GMT</pubDate></item></channel></rss>