在deepseek R1出现的时候,资本市场就对这场竞争给了结论性的回应,大模型的护城河并不高,美国的公司无法一枝独秀。当然这个护城河“不高”是有前提的,就是玩家得能够入围所谓的“斩杀线”,人才,电力,芯片都得具备,才有当玩家的资格。
国内的模型能力能跟住第一梯队,离不开自己的电力和人才储备,还有一个重要因素来自对美国模型的蒸馏。所有模型的训练,都需要有高质量的数据,数据清洗的过程普遍依赖人工标注的,特别是科学类的论文,而蒸馏是获得高质量标注数据的捷径。换句话讲,国内模型的进步很大程度上被美国模型拉着进步的。
未来芯片问题终究会被解决,决定竞争胜负终究会是性价比,openai和anthropic都不是未来国内玩家的主要对手,毕竟在一个维度上竞争,全世界都不是国货的对手,这个在电动车领域已经体现的淋漓精致了。国内公司真正的对手来自spaceX,太空算力中心30万亿美金的故事才是最大的威胁,老马的愿望万一实现了,才是真正的“维度”竞争,这个方案的核心是占据特定的卫星轨道资源,这种特殊的轨道资源是有限的,先到先得,目前spaceX的单公斤发射成本还是国内的20分之一左右,有望拉到百分之一的差距数量级,这种差距不是2年能赶上来的,因此spaceX才是未来国内公司最大的竞争对手。
lukun ge
@lukun ge
-
DeepSeek V4 Flash爆火,调用量破纪录,但是梁文锋谈话泄露华为芯片短期内供货不足,V5训练还得仰仗英伟达算力集群,会被CUDA生态锁死吗? -
关于ai 模型,我有话说,也是吐槽一下chatgpt 5.6 sol 吧!,重点是关于模型背答案这个事情。ai目前的架构完全不支持产生人类的意识,从物理层面,人类是先有意识,后有计算能力的,现在ai想通过计算能力来产生意识,本来就不符合物理规律。但是,ai即使没有产生意识,它也会让人类短期内大量失业,人类当前的社会分工,大部分是流程化和计算类似的工作,而不是意识类需要创新和思考的工作。这就给能驾驭ai的人,一个人干100个人的工作的能力。残酷现实是:ai并没有提升整个社会的生产力,它只提升了生产效率。因此就会出现新方向的就业机会前还看不到,老的就业岗位的饼的大小也没有发生变化,但人的需求量降低了,失业就是必然结果。
失业的结果很大可能会催生游戏和娱乐产业的蓬勃发展,将来要为领着社会失业保障的失业群体打发时间创造条件。