0:00
27:44
27:44

DEEPSEEK梁文锋内部讲话流出,意外泄露中美ai真实差距

Tech

「梁老板讲了很多敏感信息,请大家千万不要外传,包括卡量。」 提醒之后,这份 3.4 万字的内部讲话还是流了出来。中美 AI 真实的差距,就藏在其中几百个字里。 DeepSeek 创始人梁文锋面向投资人做了近四小时闭门讲话,整理成文约 3.4 万字,随后外流;多家媒体援引知情人士称,DeepSeek 因此暂停了原本正在推进的新一轮融资。墙外的讨论大多停在"果然用的是英伟达的卡",但这场讲话里最值钱的不是卡的来路,而是梁文锋自己给出的那条因果链——中美最大的差距是算力,算力不足让研究人员没有实验机会,实验少则经验少,最后连"人才差距"都可能只是算力差距长期积累出来的结果。 本期从这段话拆起:先讲清楚为什么今天的 AI 研究更像化学甚至炼丹,而不是数学,所以"能失败多少次"才是硬通货;再算一笔账,两万张 H 等效算力能支撑多少组并行实验,为什么美国前沿模型的激活参数能到数百 B 而国内还在几十 B;然后拆解中国模型便宜的真正来源——MoE 与激活参数,说明这是成本领先而不是成本垄断;接着讲蒸馏的边界、数据飞轮、企业采购里价格之外的东西,以及智谱与 OpenAI、Anthropic 之间那道上千倍的收入沟;最后回到一个更难受的问题:只要 Transformer、GPU 和 Scaling Law 这条路线不变,所谓弯道超车,弯道到底在哪。 这不是又一期唱衰。DeepSeek 在极端资源约束下把每张卡掰成两张用,这件事值得尊重。问题在于,低成本能不能变成永久护城河,以及一个追赶者,会不会又一次活成百度对 Google 的样子。 📚 本期信源 · 梁文锋 DeepSeek 闭门讲话流出纪要(约 3.4 万字,面向投资人,含卡量与激活规模口径) · 多家媒体援引知情人士:讲话外流后 DeepSeek 暂停新一轮融资 · 讲话中的算力口径:约 2 万张 H 等效;美国前沿模型或达约 800B 激活;同规模训练估需约 5 万张 GB300 或 20 万张华为 950 · 2026 年中期市场估算:Anthropic 年化收入运行率约 700 亿美元,OpenAI 约 500 亿美元 · 智谱 2025 年全年收入 7.24 亿元人民币,其中云端 API 与开放平台约 1.9 亿元 · DeepSeek R1 系列公开发布的多个蒸馏模型 · OpenAI 近期下调部分模型价格以扩大企业采用 ⏱ 章节 00:00 泄漏的 3.4 万字:DeepSeek 为何暂停融资 03:12 AI 研究更像炼丹:没有卡就没有失败的资格 07:39 两万张 H 等效卡,够失败几次 10:50 中国模型为什么便宜:激活参数的真相 15:36 蒸馏抄得到答案,抄不到无人区 18:26 比语料更值钱的,是数据飞轮 19:31 便宜 30%,银行为什么还是不敢用 21:02 中美 AI 收入差上千倍:飞轮怎么转 22:09 百度的老路:功能很多,底层不属于你 24:45 只要路线不变,就没有弯道超车 🔔 订阅频道,打开小铃铛

ADVERTISEMENT
Comments 100 josué_costela: 周末加餐,真是太幸福了😂