「梁老板讲了很多敏感信息,请大家千万不要外传,包括卡量。」 提醒之后,这份 3.4 万字的内部讲话还是流了出来。中美 AI 真实的差距,就藏在其中几百个字里。 DeepSeek 创始人梁文锋面向投资人做了近四小时闭门讲话,整理成文约 3.4 万字,随后外流;多家媒体援引知情人士称,DeepSeek 因此暂停了原本正在推进的新一轮融资。墙外的讨论大多停在"果然用的是英伟达的卡",但这场讲话里最值钱的不是卡的来路,而是梁文锋自己给出的那条因果链——中美最大的差距是算力,算力不足让研究人员没有实验机会,实验少则经验少,最后连"人才差距"都可能只是算力差距长期积累出来的结果。 本期从这段话拆起:先讲清楚为什么今天的 AI 研究更像化学甚至炼丹,而不是数学,所以"能失败多少次"才是硬通货;再算一笔账,两万张 H 等效算力能支撑多少组并行实验,为什么美国前沿模型的激活参数能到数百 B 而国内还在几十 B;然后拆解中国模型便宜的真正来源——MoE 与激活参数,说明这是成本领先而不是成本垄断;接着讲蒸馏的边界、数据飞轮、企业采购里价格之外的东西,以及智谱与 OpenAI、Anthropic 之间那道上千倍的收入沟;最后回到一个更难受的问题:只要 Transformer、GPU 和 Scaling Law 这条路线不变,所谓弯道超车,弯道到底在哪。 这不是又一期唱衰。DeepSeek 在极端资源约束下把每张卡掰成两张用,这件事值得尊重。问题在于,低成本能不能变成永久护城河,以及一个追赶者,会不会又一次活成百度对 Google 的样子。 📚 本期信源 · 梁文锋 DeepSeek 闭门讲话流出纪要(约 3.4 万字,面向投资人,含卡量与激活规模口径) · 多家媒体援引知情人士:讲话外流后 DeepSeek 暂停新一轮融资 · 讲话中的算力口径:约 2 万张 H 等效;美国前沿模型或达约 800B 激活;同规模训练估需约 5 万张 GB300 或 20 万张华为 950 · 2026 年中期市场估算:Anthropic 年化收入运行率约 700 亿美元,OpenAI 约 500 亿美元 · 智谱 2025 年全年收入 7.24 亿元人民币,其中云端 API 与开放平台约 1.9 亿元 · DeepSeek R1 系列公开发布的多个蒸馏模型 · OpenAI 近期下调部分模型价格以扩大企业采用 ⏱ 章节 00:00 泄漏的 3.4 万字:DeepSeek 为何暂停融资 03:12 AI 研究更像炼丹:没有卡就没有失败的资格 07:39 两万张 H 等效卡,够失败几次 10:50 中国模型为什么便宜:激活参数的真相 15:36 蒸馏抄得到答案,抄不到无人区 18:26 比语料更值钱的,是数据飞轮 19:31 便宜 30%,银行为什么还是不敢用 21:02 中美 AI 收入差上千倍:飞轮怎么转 22:09 百度的老路:功能很多,底层不属于你 24:45 只要路线不变,就没有弯道超车 🔔 订阅频道,打开小铃铛
ADVERTISEMENT
周末加餐,真是太幸福了😂
全部看完,感觉看了一锅大杂烩,很多逻辑讲不通啊,蒸馏那么有用,欧洲,印度,日韩为什么追不上?而且汉字编码带有天然压缩属性,在数学三维树上,每个分词占用的相对空间就更少,这是算力省下最关键基础吧。而且在经济上美元和人民币不能简单考虑汇率,相差几千倍有点言过其实了。还有deepseek强调很多次没有蒸馏美国模型。这就有点天然刻板印象输出了。天然的以为美国媒体的说法是对的。看了个视频疑问更多了,更乱了,信息太杂了。媒体和事实信息混在一起组成了这个视频。
把AI中美差距讲明白了,听明白了。
前排,狗剩加油
很多行业发展到一定程度 瓶颈就是政治
正确君的讲解也很深入啊,期待下一次的更新
梁文峰说的最重要的是,他已经用华为的芯片做训练,华为的四张卡顶英伟达一张卡,英伟达的生态垄断可能已经逐步消失,目前中国智能芯片产能不足,只给他一万张,给了字节跳动10万张,估计五年能够解决这个产能的问题,这就是中国的成本优势,第二个,关于AGI,那是方法的问题,不是算力的问题,现在每个公司都在找,但是目前没有有效的方法,这不是大力出奇迹的问题,第三点,真正改变世界的是AI用于物理世界,即具身机器人,这才是美国想解决的问题,梁文峰说目前的世界模型方法没有用,工作量太大了,也不一定行的通,世界模型和AGI没有关系,只能通过AGI解决,你说的很多都是有道理的,但你说的没有捉住重点,带着政治立场说问题,我只能听一点技术细节了,
苹果在美国也没有隐私,棱镜门显得吧
分析的不错,注意不要刻舟求剑,芯片不会一直落后,能源和电力是美国的短板,一切都在快速变化,一年后再来会看这条视频
FBI 让苹果解锁,苹果可以拒绝?真他妈搞笑!FBI 已经接入苹果服务器了
這些話就是再告訴政府單位,趕快開放購買H200 …
周末突然发现新节目,狗哥敬业啊
你说的没错,中国真正要想超越,只能在算力上有突破,算力的突破意味着GPU架构的设计和euv光刻机,中国不缺GPU架构的设计,缺的是euv光刻设备。如果设备能够突破,加上中国大量工业数据迭代,中国的人工智能就会完全向工业倾斜,美国因为工业落后,只能向金融倾斜。以后美国会做出开创性的研究,中国在实际应用上碾压美国,并且在开创性研究上逐步追平或者只小步骤落后美国。但是双方之间承担的代价是千差万别的,美国要做开创性研究的投入能不能一直支撑美国走下去绝对是一个变量和未知数,中国已工业落地为基础的研究,至少能保证每一步走的更稳定。中国有工业基础,有时间突破,美国不一定有时间和资金继续做全球的技术领导者。美中之间会在未来30年,也就是2050年内做分晓,要嘛超越美国,要嘛和美国之间的差距不断扩大,因为中国的国力和人口也在下降。未来30年将是绝对共产党能不能守住江山的时刻,能不能稳定自己权利的时刻。如果国内继续存在大量的贪腐或者制度创建不利于创新,中国就会失去现在的优势。但是我更不看好美国,因为美国现在所有的资金都集中在极少部位人,而且钱并没有用来社会投入,加强教育,只是通过吸引全球人才。对于全球人才本地人才才是最稳定的,美国这个国家培养不了自己的本地人才,最终美国经济的衰弱,人才效益越来越低的时候,将是美国内部分裂的时候。
推流还有限啊,正确君这个放王局平台至少好十来几万播放量了
666, 周末也有节目看了👏👏
来了来了最爱听的节目更新了❤
果断关注了,发现才发过两篇,精品
22:09 百度的老路:功能很多,底层不属于你。这次录音里梁文峰已经明确反对这么做了,deepseek愿景只有AGI,不追求C端用户,连多模态都可以不做。至少深度求索不会走上百度的老路
只知其一不知其二。中国开源模型会有全世界的研究人员使用,他们训练不会有卡的限制,他们会反馈训练结果,相当于为deepseek免费测试,免费试用,免费反馈。这也是美国为啥开始反对社会主义的ai开源了😂
中美差距如果由目前的算力推斷,決定未來誰領先,那美國就就繼績封鎖,拒賣算卡就可以了。AI 競爭關鍵的因素 是大環境,政治因素,中國政府扮演的是輔助,整合,懂王辦演的是扯後腿角色,中美差距不斷縮小,算力已經無法決定未來勝負。