DeepSeek 的故事要从量化交易说起。创始人梁文锋毕业于浙江大学,2010 年前后开始量化投资,沪深 300 股指期货推出后抓住机遇,自营资金超过 5 亿元,为后续 AI 创业积累了资金与工程能力。
关键时间线
- 2023 年:梁文锋正式创立 DeepSeek,专注大模型研发
- 2024 年 5 月:发布 DeepSeek-V2,以创新的 MoE 架构和史无前例的性价比引发关注
- 2024 年 12 月:发布 DeepSeek-V3,总参数 6710 亿,训练成本仅约 557 万美元
- 2025 年 1 月:发布 DeepSeek-R1 系列,推理能力对标 OpenAI o1,引爆全球下载与讨论
- 持续迭代:Coder(代码)、Math(数学)、VL(视觉语言)、Janus-Pro(多模态生成)等系列陆续推出
团队与理念
- 团队规模约 140 人,成员多来自清华、北大、北航等顶尖高校的应届博士与在校生
- 人才原则:只招 1% 的天才,去做 99% 中国公司做不到的事情
- 深度求索名字取意「深度钻研、不断求索」,与量化交易时代的极致工程文化一脉相承
- 罗福莉等核心成员在 ACL 等顶会发表多篇论文,参与 MoE 大模型 DeepSeek-V2 研发
DeepSeek 的崛起本质是「工程极简主义」的胜利:用更聪明的架构,把成本打下来,把能力送出去。