DeepSeek(杭州深度求索)

DeepSeek(杭州深度求索)是 AI 圈最特殊的玩家之一。


1. 出身与资本结构

  • 成立:2023年7月,总部杭州,创始人梁文锋(1985年生,广东湛江人)。
  • 孵化方:幻方量化(High-Flyer)——国内顶级量化私募,靠机器学习做股票起家,2022年10月美国出口管制前囤了约1万张 A100 GPU。
  • 控制力极强:前三年零外部融资,完全由幻方供血。2026年6月才完成首轮超500亿元融资(投后估值约3500亿),梁文锋个人出资约200亿,直接+间接控制约99.72%股权。腾讯出资100亿、宁德时代50亿,但表决权与运营否决权全部锁在创始人手里——外部资本只能分红,不能干预。

2. 反创业公司的运营逻辑

这是它最反常的地方:

  • 三年不融资、不打广告、没销售团队、不碰消费级变现
  • App免费,API 定价贴近成本。本质是披着公司外壳的研究所
  • 不像 OpenAI/Anthropic 那样烧钱抢市场,靠技术口碑和开源生态自然获客。

3. 技术基因:极致性价比

  • 核心架构 MoE(混合专家)+ MLA(多头潜在注意力),把训练/推理成本压到西方大厂的零头。
  • 2025年1月R1一出,传说 560万美元训练成本 直接引爆全球 AI 估值地震(纳斯达克单日蒸发万亿级)。
  • 2026年7月 V4 正式版:100万 Token 上下文窗口、业界首个峰谷分时 API 定价、DSpark 推测解码加速框架。
  • V4-Flash 强化Agent 能力,支持 Responses API 和 Codex 集成。

4. 开源策略(核心杀手锏)

  • 开源权重为核心打法,是全球使用量最大的开放权重模型开发者。
  • 混合许可:核心算法库 AGPL-3.0,预训练权重 CC BY-NC-SA 4.0(商用需授权)。
  • 这让它绕开”闭源护城河”,靠生态和开发者绑定取胜。

5. 市场地位(2026年中数据)

  • OpenRouter路由Token 占比 **17.6%**(周约5.13万亿 token),单一模型家族第一,超过 Anthropic 的14.8%。
  • 国内App月活 1.3亿,仅次于豆包(3.82亿)和通义千问(1.67亿)。
  • 已与腾讯、华为、中国移动、国家管网集团达成合作。

6. 最新动向

  • 2026年8月战略投资宇树科技,切入具身智能
  • 已聘投行筹备科创板 IPO,计划2026年内递交申请,目标估值约5000亿。
  • 启动第二轮融资,目标募资500亿。