DeepSeek 以 4000 亿元估值完成首轮外部融资:510 亿元到账,投资方含梁文锋、腾讯、宁德时代、京东、网易等
企查查数据显示,杭州深度求索于 2026 年 6 月 16 日完成首轮外部融资,规模约 510 亿元,估值近 4000 亿元,投资方包括创始人梁文锋、腾讯、宁德时代、网易、京东、Monolith 砺思资本、IDG 资本、正心谷投资、拾象科技及国家人工智能产业投资基金合伙企业。
推荐理由:融资规模、估值和投资方名单披露较完整,可据此观察开源模型公司引入产业资本后的资金结构。
DeepSeek(深度求索)的模型发布、开源权重与技术报告——开源大模型价格与性能双卷的风向标。
当前仅显示精选新闻企查查数据显示,杭州深度求索于 2026 年 6 月 16 日完成首轮外部融资,规模约 510 亿元,估值近 4000 亿元,投资方包括创始人梁文锋、腾讯、宁德时代、网易、京东、Monolith 砺思资本、IDG 资本、正心谷投资、拾象科技及国家人工智能产业投资基金合伙企业。
推荐理由:融资规模、估值和投资方名单披露较完整,可据此观察开源模型公司引入产业资本后的资金结构。
DeepSeek 已完成首轮外部融资,募资超过 500 亿元人民币(约 74 亿美元),公司估值超 500 亿美元。据 The Information 报道,投资者并非直接投资 DeepSeek,而是通过由 CEO 梁文锋管理的有限合伙企业入股,普通投资者不享有投票权,只能获得财务信息访问权限和后续融资轮次优先权,且持股均设 5 年锁定期。
推荐理由:融资细节披露了梁文锋借助有限合伙结构保持控制权的安排,可作为观察 AI 公司融资治理与谈判筹码的样本。
DeepSeek 已完成首轮外部融资,募资超过 500 亿元人民币(约合 74 亿美元),公司估值超过 500 亿美元。据 The Information 报道,投资者并非直接投资 DeepSeek,而是通过由 CEO 梁文锋管理的有限合伙企业入股,普通投资者不享有投票权,仅中国国家人工智能产业投资基金直接投资并获得投票权,所有投资者持股设 5 年锁定期。
推荐理由:融资条款中的有限合伙结构与5年锁定安排,提供了一个观察创始团队如何保持控制权的具体案例。
DeepSeek 完成超 70 亿美元融资,估值超过 500 亿美元,为中国 AI 行业迄今规模最大的单轮融资。此轮融资采用不寻常结构,投资者获得经济权益但没有投票权,还面临五年锁定期,预计不会获得董事会席位。
推荐理由:这轮超 70 亿美元融资把经济权益与投票权分离,为观察资本与头部 AI 公司的关系提供了样本。
DeepSeek 将 V4-Pro 降价 75% 的举措永久化,小米 MiMo 则把 V2.5 价格最高下调 99%,即日生效。



推荐理由:文章把两家公司的降价归因到注意力架构的改动,读者可据此理解长上下文推理成本为何能结构性下降。
DeepSeek 正在推进一轮 102.9 亿美元的融资,消息来自彭博。报道称梁文锋仍专注于构建开源 AI 模型,而不是追求短期商业化。
推荐理由:融资规模与创始人仍坚持开源路线并置,提供了一个观察 DeepSeek 商业取向的窗口。
We are making our discount permanent! 🎉 Enjoy building with DeepSeek-V4-Pro and bring your innovative ideas to life! 🚀
推荐理由:作者用 $0.87/M tokens 与主流模型约 15 的价差,说明 DeepSeek 把降价做成了定价权的争夺。
We are making our discount permanent! 🎉 Enjoy building with DeepSeek-V4-Pro and bring your innovative ideas to life! 🚀
推荐理由:DeepSeek-V4-Pro 将 75% 折扣改为永久定价,读者可据此比较它与 v3.2 在算力与缓存开销上的差距。
Introducing Pareto Code: a new, free, experimental coding router Set `min_coding_score` in your request and route to the cheapest code-capable model that clears your bar, ranked by @ArtificialAnlys. See the Pareto frontier shifting in real time👇
推荐理由:原文给出按编程分数门槛路由到最便宜模型的做法,读者可据此了解低成本编码模型的选型方式。
SGLang 与 Miles 团队宣布在发布当天为 DeepSeek-V4 (1.6T Pro, 284B Flash) 提供推理与 RL 训练的开源支持,针对其混合稀疏注意力、mHC 和 FP4 专家权重架构做了专项适配。
推荐理由:原文给出 ShadowRadix、HiSparse 等具体优化机制和基准数字,读者可以了解混合稀疏注意力架构对推理与 RL 训练系统的实际工程要求。
DeepSeek V4 发布,包含 Flash 和 Pro 两个型号,支持 JSON 输出、工具调用、对话前缀续写和 FIM 补全。Flash 每百万输入/输出价格为 ¥0.2 和 ¥1,Pro 为 ¥1 和 ¥12,100 万上下文的输出价格翻倍,详情见 api-docs.deepseek.com/zh-cn/quick_start/pricing。
推荐理由:原文汇总了两个型号的功能支持与每百万输入输出价格,读者可据此对比选型和使用成本。
深度求索上线并开源全新系列模型 DeepSeek-V4 预览版,按大小分为 V4-Pro 与 V4-Flash 两个版本,1M(一百万)上下文成为其所有官方服务标配。
推荐理由:DeepSeek-V4 预览版把 1M 上下文设为官方服务标配,并同步开源 Pro 与 Flash 两个版本。
DeepSeek 发布 V4,Hub 上提供两个 MoE 检查点:DeepSeek-V4-Pro 总参数 1.6T、激活 49B,DeepSeek-V4-Flash 总参数 284B、激活 13B,两者均支持 1M token 上下文窗口。
推荐理由:原文拆解了 V4 面向长上下文智能体的注意力与后训练设计,可据此判断开源模型跑长任务时的成本变化。
DeepSeek API 已支持 V4-Pro 与 V4-Flash,兼容 OpenAI ChatCompletions 接口与 Anthropic 接口,base_url 不变,model 参数改为 deepseek-v4-pro 或 deepseek-v4-flash。
推荐理由:官方说明了新模型接入方式与旧模型名停用时间,开发者可以据此安排迁移。
DeepSeek 宣布 API 的 deepseek-chat 和 deepseek-reasoner 均已升级为 DeepSeek-V3.2。deepseek-chat 对应非思考模式,deepseek-reasoner 对应思考模式。
推荐理由:官方说明了两条 API 模型线与 DeepSeek-V3.2 思考模式的对应关系,方便使用 API 的开发者确认升级后的调用变化。
DeepSeek 非正式部署 DeepSeek-V3.2-Speciale API 服务,用户通过 base_url="https://api.deepseek.com/v3.2_speciale_expires_on_20251215" 访问。价格不变,仅支持思考模式下的对话功能,不支持工具调用,最大输出长度默认 128K,支持至北京时间 2025-12-15 23:59。
推荐理由:原文给出了非正式部署的访问方式和明确截止时间,用户可以据此判断是否短期试用这个思考模式模型。
deepseek-chat 和 deepseek-reasoner 均已升级为 DeepSeek-V3.2-Exp。deepseek-chat 对应该模型非思考模式,deepseek-reasoner 对应思考模式,详细更新内容需参阅官方文档。
推荐理由:官方说明两个 API 端点均已切换至新实验版模型,读后可据此确认调用行为是否受影响。
DeepSeek 官方宣布 deepseek-chat 和 deepseek-reasoner 均已升级为 DeepSeek-V3.1-Terminus,分别对应其非思考模式和思考模式。此次更新保持模型原有能力,针对用户反馈改进了语言一致性,缓解中英文混杂和偶发异常字符问题,并优化了 Code Agent 与 Search Agent 的表现。
推荐理由:官方说明升级后的接口对应关系和两类具体改进,现有用户可据此判断是否切换或观察效果。
DeepSeek 宣布 deepseek-chat 和 deepseek-reasoner 均升级为 DeepSeek-V3.1,分别对应其非思考模式与思考模式。
推荐理由:官方说明了两个 API 端点对应的模式切换,并给出 SWE-bench 等三项基准分数,读者可据此评估升级影响。
DeepSeek 官方宣布 deepseek-reasoner 模型升级为 DeepSeek-R1-0528,推理能力增强,AIME 2025 Pass@1 从 70.0 升至 87.5,GPQA 从 71.5 升至 81.0,Aider 从 57.0 升至 71.6。
推荐理由:官方更新日志列出各基准的具体分数变化,读者可以直接对比新旧 R1 在推理和幻觉上的差异。