融资
深度寻求(DeepSeek)以100亿美元估值寻求首轮外部资金

深度寻求(DeepSeek),这家中国人工智能实验室曾在2025年1月以其低成本的R1推理模型震惊了行业,如今正在与投资者谈判,计划首次外部融资至少3亿美元,根据《信息》(The Information)的一份报告。该轮融资将使这家总部位于杭州的公司估值达到100亿美元或以上。
这次融资标志着创始人兼首席执行官梁文峰(Liang Wenfeng)的一个重大转变,他曾将深度寻求(DeepSeek)作为其量化对冲基金——高飞者资本管理(High-Flyer Capital Management)的一个副项目,并多次拒绝了中国主要风险投资公司和科技巨头的出价。高飞者资本管理(High-Flyer)一直是深度寻求(DeepSeek)的唯一资金来源,这是一种刻意的策略,梁文峰将其视为使实验室免受商业压力的方式。
然而,这种独立性现在正面临来自两个方向的压力:成本上升和人才流失。
关键工程师跳槽到竞争对手
深度寻求(DeepSeek)最近几个月已经失去了几位高调的研究人员。2025年11月,V2模型的核心开发者罗富利(Luo Fuli)离开加入小米(Xiaomi),领导公司的MiMo空间智能团队。更近期,R1模型的首席作者郭大亚(Guo Daya)离开加入字节跳动(ByteDance)的Seed AI部门,根据《南华早报》(South China Morning Post)的报道。字节跳动否认了有关郭大亚的薪酬包年值高达1亿人民币(约合1400万美元)的报道,但确认其遵循包括股权在内的标准框架。
这些离职反映了中国人工智能市场日益激烈的人才战争,资金充足的竞争对手如阿里巴巴(Alibaba)、字节跳动(ByteDance)和腾讯(Tencent)正在积极从较小的实验室中挖角人才。王冰轩(Wang Bingxuan),另一位深度寻求(DeepSeek)工程师,据报道也在同一时期离开加入腾讯(Tencent)。
V4延迟和华为芯片赌局
深度寻求(DeepSeek)的下一代旗舰模型V4已经被推迟多次。延迟部分是由于努力使V4与华为(Huawei)的昇腾AI芯片兼容,这是一项技术上具有挑战性的迁移,需要克服较慢的芯片间连接和较不成熟的软件工具,相比Nvidia的CUDA生态系统。
V4模型被设计为运行在华为芯片上,这是北京推动中国减少对美国半导体依赖的一部分。如果深度寻求(DeepSeek)成功,这将代表国内芯片开发的一个重要里程碑。然而,技术障碍是真实的——华为工程师据报道已经被嵌入深度寻求(DeepSeek)团队,以排除训练运行期间的稳定性问题。
与此同时,竞争对手并没有等待。阿里巴巴(Alibaba)的Qwen家族的开源大型语言模型现在占据了全球开源模型下载量的50%以上,截至2026年3月,累计下载量超过9.4亿次。字节跳动(ByteDance)的Doubao聊天机器人在2025年底已经超过1亿日活跃用户,公司宣布了成为全球第三大生成性人工智能玩家的目标。最新的《斯坦福人工智能指数》(Stanford AI Index)显示,全球人工智能开发竞赛正在加速,中国正在缩小与领先的美国公司的差距,大约在3到6个月之间。
100亿美元的估值使深度寻求(DeepSeek)远低于人工智能领域其他公司的天文数字——例如,Anthropic最近吸引了8000亿美元的估值,甚至基础设施公司如Databricks也达到134亿美元的估值。然而,对于一家曾以560万美元的成本在2048个Nvidia H800 GPU上训练其V3基础模型的公司来说,这将是一个重要的步骤,这只是西方实验室花费的一小部分。
投资者预计将主要是国内中国公司,因为美国风险投资面临着监管和国家安全障碍,难以投资中国人工智能。目前尚未有交易完成,梁文峰是否会接受稀释高飞者资本管理(High-Flyer)近乎完全控制的条款仍不明确。然而,很明显,仅凭对冲基金的资产负债表运行前沿人工智能实验室的日子似乎即将结束——即使对于曾经证明这是可能的公司来说也是如此。因此,投资者和公司都在寻求新的资金和合作方式,以推动人工智能技术的发展和应用。












