People knowledge base

梁文锋

DeepSeek 创始人 · 材料数 6 · 由 AI 人物知识库生成,旧观点不删只追加

梁文锋

  • 身份:DeepSeek 创始人
  • 一句话主张:持续学习、开源与克制;目标函数是提高做成 AGI 的概率,而非收入份额
  • 利益位置:DeepSeek 实际控制人。开源与低价同时是其人才凝聚工具与战略手段,不是纯粹的价值观表达。
  • 材料数:6(一级 3,二级 1,三级 2)
  • 最后更新:2026-08-07

本档最重要的证据事实:其最广为流传的"投资人会议 95 分钟视频"(M-001)是三级材料——流传文字稿→第三方精校→AI 配音→烧录字幕,发布者自述"并非梁文锋本人现场原声",全网无现场原音。不可写"梁文锋亲口说"。2019 年后他几乎没有可核验的一手公开讲话。


观点账本

日期 观点 来源状态 观点类型 现实状态 材料编号
约 2026 目标函数是"提高做成 AGI 的概率",不是收入/份额 三级(AI 配音还原稿) 商业判断 待验证 M-001
约 2026 团队稳定是硬约束——"只有一个没法退让的" 三级 商业判断 待验证 M-001
约 2026 开源三层机制:人才凝聚/战略克制/按十个月回本定价压第三方套利;同段自承"确实还有降价空间" 三级 商业判断 部分兑现 M-001
约 2026 路线排序:CoT→Agent→持续学习→渐进奇点→具身;"奇点"应理解为连续过程,本人主动降温 三级 技术判断 待验证 M-001
约 2026 世界模型与视频生成排除在路线图外,理由"跟智能的上限没有太大的关系" 三级 技术判断 待观察 M-001
2024-05 以 MLA 压缩 KV cache、细粒度 MoE 降低激活计算,追求"更强同时更经济" 一级:DeepSeek-V2 技术报告 公司技术路线 部分兑现 M-003
2024-12 算法-框架-硬件协同设计提高大规模 MoE 训练效率,并公开权重 一级:DeepSeek-V3 技术报告 公司技术路线 部分兑现 M-004
2025-01 纯强化学习可在无人工推理轨迹情况下激发自我反思、验证和策略调整 一级:DeepSeek-R1 论文 公司技术路线 部分兑现、边界待核 M-005
2026-05-20大模型终局差距只剩成本、时间、用户体验三样,「成本是排在第一位的区别」;不至于哪一家有暴利未核实流传商业判断待验证M-015(三级,交流会文字稿)
2026-05-20CUDA 护城河「在快速地被瓦解」:AI 写代码+TileLang+计算卡与游戏卡解耦;一年内可验证国产芯片生态,唯一问题是产能未核实流传技术判断待验证(约至 2027 中)M-015(三级)
2026-05-20API 定价按「买一批设备十个月收回成本」(约六倍利润);ARR 到十亿美金现金流可回正;第三方独立部署无利可图未核实流传商业判断待验证(无审计数字)M-015(三级)
2026-05-20与美国的差距「只有资源」:算力差约一个数量级;人才几乎无差距,人才差距本质也是算力差距未核实流传事实+判断待验证(卡数为流传稿口径)M-015(三级)

材料库(精选)

  • M-001|投资人会议 95 分钟视频|三级|真实链条:流传文字稿→第三方精校→AI 配音→烧录字幕;合并终稿 liangwenfeng_video/liangwenfeng_merged_final.txt(SHA256 20b33409…)|可以怎么用:提炼假说、建立证伪清单、与 DeepSeek 实际资源配置行为交叉印证;不可以怎么用:写"亲口说"、把数字当公司披露、仅凭它调整母题置信度。方法约束:中文长音频不得直接用 Whisper small 输出作引用底稿(实测「奇点」→「起点」11 次)。
  • M-003|DeepSeek-V2 报告(2024-05,https://arxiv.org/abs/2405.04434 ,作者名单含 Wenfeng Liang)|一级|236B/激活 21B;MLA+DeepSeekMoE;自报训练成本省 42.5%、KV cache 减 93.3%|为"受限算力推动效率创新"提供公司行为证据。
  • M-004|DeepSeek-V3 报告(2024-12,https://arxiv.org/abs/2412.19437 )|一级|671B/激活 37B;FP8 训练;自报 2.788M H800 GPU 小时、全程无不可恢复 loss spike|部分兑现"开源旗舰+工程效率是核心竞争力"。
  • M-005|DeepSeek-R1(2025-01,https://arxiv.org/abs/2501.12948 )|一级|纯 RL 激发推理;重点是可验证任务,不能外推为开放环境/长期 Agent/持续学习已解决|与 Karpathy 可验证性框架一致:最硬结果仍集中在可自动打分的任务。
  • M-006|《DeepSeek Harness 负责人吐槽"融资材料"吹过头》(AI 前线,2026-08-07)|二级;其中"泄露 BP"为三级|可用线索(待核):首轮 2026-06 交割约 500 亿元、估值超 3500 亿元;二轮拟再募约 500 亿、投前约 5000 亿元;V4-Pro 定价 $0.435/$0.87 每百万 token(对比 Opus 5 的 $10/$50,约便宜 46 倍——可自行核验官网价目,是本材料最硬的部分)|已证伪部分:流出 BP 称"V4-Pro 编程仅比 Claude 旗舰低 0.3%"——实为对旧版 Opus 4.6 的单项 SWE-bench 差值被包装成整体能力;DeepSeek Harness 负责人崔添翼调侃"也不能说完全是瞎编,对吧?"是内部人士对材料真实性的间接否定|三条研究含义:①最硬的是价格不是跑分;②3 亿规模基金收 10% 前端费=一级市场稀缺溢价扭曲(是融资市场情绪,不是基本面证据);③大额融资+极低定价与"AGI 概率优先"弱一致,但不能反推目标函数。

隐含假设

  1. 在公司生存与核心团队稳定约束下,AGI 概率可作为主目标函数长期坚持。
  2. 开源不会削弱模型能力优势,反而通过人才与生态回补。
  3. API 现金流足以支撑研究所需算力,无需转向超级入口或广告变现。
  4. 世界模型/视频生成对智能上限贡献有限——强路线判断,与 Musk、Hassabis 方向相反。

反证条件 / 待验证清单

  • [ ] 若资源明显转向超级 App 入口、广告/流量、广铺垂直产品或短期收入最大化→下调"AGI 目标函数主导"置信度
  • [ ] 真实发布是否按 CoT→Agent→持续学习排序推进;持续学习是否出现可信突破
  • [ ] 开源与低价能否保持;团队稳定性与算力供给
  • [ ] M-006 融资数字(500 亿/5000 亿)与"个人跟投 30 亿美元"传闻的官方口径

与其他人的真实分歧

  • 对 Musk/Hassabis(2026-08-10 证据纠错):「梁明确排除世界模型/视频生成」仅见于未认证三级流传稿;2024 年可核验访谈中他明确押注多模态、认为真实世界学习可能必要。故不再作为已确认对立,仅记录三级稿与可核验访谈的口径冲突,以可核验材料为准(canonical M-014 纠错)。
  • 对 Altman:目标函数排序不同——AGI 概率优先 vs 基础设施飞轮与规模化商业。

更新日志

日期 动作
2026-08-03 M-001 由"一级转写"降为三级(AI 配音,非本人原声),jairl 已同步。
2026-08-07 迁入知识库;补一级公司材料 V2/V3/R1;录入 M-006(二轮融资传闻+BP 证伪+V4-Pro 定价)。
2026-08-11录入邱婷婷调研 M-015~M-019:2026-05-20 投资者交流会文字稿(三级,与 M-001 同源)、晚点 V4 详解(二级)、开源分发路径与四家 API 链路分析(三级)、开源许可证 sheet(三级)。观点账本追加 7 条三级观点(本页精选 4 条);许可证按 checkpoint 级收紧:R1 之后才纯 MIT。参数口径冲突(V4-Flash 158B 等)以一级技术报告为准,不作事实引用。

本页由「AI 人物知识库」canonical 生成(呈现层)。一级/二级/三级只表示来源距离,不表示观点正确概率;本人亲口说过也只是观点,正确与否只看后续现实状态。