跳到正文

DeepSeek

DeepSeek(深度求索)的模型发布、开源权重与技术报告——开源大模型价格与性能双卷的风向标。

当前仅显示精选新闻
106条精选相关主题千问 Qwen开源生态模型发布

最新精选

第 81–100 条 · 共 106 条
6月17日周三
  1. IT Home77

    DeepSeek 以 4000 亿元估值完成首轮外部融资:510 亿元到账,投资方含梁文锋、腾讯、宁德时代、京东、网易等

    企查查数据显示,杭州深度求索于 2026 年 6 月 16 日完成首轮外部融资,规模约 510 亿元,估值近 4000 亿元,投资方包括创始人梁文锋、腾讯、宁德时代、网易、京东、Monolith 砺思资本、IDG 资本、正心谷投资、拾象科技及国家人工智能产业投资基金合伙企业。

    推荐理由:融资规模、估值和投资方名单披露较完整,可据此观察开源模型公司引入产业资本后的资金结构。

6月16日周二
  1. AI前线 · 微信公众号77

    DeepSeek 完成超 500 亿元首轮融资,腾讯等投资方 5 年锁定期且无投票权

    DeepSeek 已完成首轮外部融资,募资超过 500 亿元人民币(约 74 亿美元),公司估值超 500 亿美元。据 The Information 报道,投资者并非直接投资 DeepSeek,而是通过由 CEO 梁文锋管理的有限合伙企业入股,普通投资者不享有投票权,只能获得财务信息访问权限和后续融资轮次优先权,且持股均设 5 年锁定期。

    推荐理由:融资细节披露了梁文锋借助有限合伙结构保持控制权的安排,可作为观察 AI 公司融资治理与谈判筹码的样本。

  2. InfoQ · 微信公众号77

    DeepSeek 融资交易曝光:腾讯、宁德时代等被锁 5 年且无投票权,梁文锋保持绝对控制

    DeepSeek 已完成首轮外部融资,募资超过 500 亿元人民币(约合 74 亿美元),公司估值超过 500 亿美元。据 The Information 报道,投资者并非直接投资 DeepSeek,而是通过由 CEO 梁文锋管理的有限合伙企业入股,普通投资者不享有投票权,仅中国国家人工智能产业投资基金直接投资并获得投票权,所有投资者持股设 5 年锁定期。

    推荐理由:融资条款中的有限合伙结构与5年锁定安排,提供了一个观察创始团队如何保持控制权的具体案例。

  3. IT Home77

    消息称 DeepSeek 完成超 70 亿美元融资,估值超 500 亿美元

    DeepSeek 完成超 70 亿美元融资,估值超过 500 亿美元,为中国 AI 行业迄今规模最大的单轮融资。此轮融资采用不寻常结构,投资者获得经济权益但没有投票权,还面临五年锁定期,预计不会获得董事会席位。

    推荐理由:这轮超 70 亿美元融资把经济权益与投票权分离,为观察资本与头部 AI 公司的关系提供了样本。

5月27日周三
5月23日周六
  1. @AYi_AInotes76

    DeepSeek 宣布将 V4-Pro 的 75% 折扣永久化,作者 @AYi_AInotes 认为这不只是降价,更像是在打定价权。作者给出的对比是 V4-Pro 输出价格 $0.87/M tokens,而主流模型普遍在 15 区间。他判断 AI 模型的商业模式正从卖服务转向卖基础设施,走先规模后利润的路径。

    引用DeepSeek (@deepseek_ai)@deepseek_ai

    We are making our discount permanent! 🎉 Enjoy building with DeepSeek-V4-Pro and bring your innovative ideas to life! 🚀

    推荐理由:作者用 $0.87/M tokens 与主流模型约 15 的价差,说明 DeepSeek 把降价做成了定价权的争夺。

  2. @kimmonismus77

    DeepSeek 宣布把 DeepSeek-V4-Pro 的折扣永久化,折扣幅度 75%,输入 $0.43、输出 $0.87。发帖作者引用该模型技术论文称,相比 v3.2 它只用 27% 的算力和 10% 的缓存,并提到 SemiAnalysis 写过相关文章。作者由此认为 DeepSeek 现在的重点转向成本与 token 效率。

    引用DeepSeek (@deepseek_ai)@deepseek_ai

    We are making our discount permanent! 🎉 Enjoy building with DeepSeek-V4-Pro and bring your innovative ideas to life! 🚀

    推荐理由:DeepSeek-V4-Pro 将 75% 折扣改为永久定价,读者可据此比较它与 v3.2 在算力与缓存开销上的差距。

5月11日周一
  1. @OpenRouter65

    OpenRouter 推出实验性免费编码路由 Pareto Code,在请求中设置 min_coding_score 后,可路由到满足该门槛的最便宜编程模型,模型排名来自 ArtificialAnlys。按其展示的实时 Pareto 前沿,DeepSeek V4 Pro 居首,其后为 GPT 5.4 Mini 和 Gemini 3.1 Pro。

    引用OpenRouter (@OpenRouter)@OpenRouter

    Introducing Pareto Code: a new, free, experimental coding router Set `min_coding_score` in your request and route to the cheapest code-capable model that clears your bar, ranked by @ArtificialAnlys. See the Pareto frontier shifting in real time👇

    推荐理由:原文给出按编程分数门槛路由到最便宜模型的做法,读者可据此了解低成本编码模型的选型方式。

4月25日周六
  1. LMSYS Blog73

    SGLang 与 Miles 实现 DeepSeek-V4 (1.6T Pro, 284B Flash) Day-0 推理与 RL 训练支持

    SGLang 与 Miles 团队宣布在发布当天为 DeepSeek-V4 (1.6T Pro, 284B Flash) 提供推理与 RL 训练的开源支持,针对其混合稀疏注意力、mHC 和 FP4 专家权重架构做了专项适配。

    推荐理由:原文给出 ShadowRadix、HiSparse 等具体优化机制和基准数字,读者可以了解混合稀疏注意力架构对推理与 RL 训练系统的实际工程要求。

4月24日周五
  1. 歸藏的AI工具箱 · 微信公众号76

    DeepSeek V4 发布 Flash 与 Pro 两个型号

    DeepSeek V4 发布,包含 Flash 和 Pro 两个型号,支持 JSON 输出、工具调用、对话前缀续写和 FIM 补全。Flash 每百万输入/输出价格为 ¥0.2 和 ¥1,Pro 为 ¥1 和 ¥12,100 万上下文的输出价格翻倍,详情见 api-docs.deepseek.com/zh-cn/quick_start/pricing。

    推荐理由:原文汇总了两个型号的功能支持与每百万输入输出价格,读者可据此对比选型和使用成本。

12月1日周一
  1. DeepSeek API updates69

    DeepSeek-V3.2-Speciale 开放非正式 API 访问,截止 2025-12-15

    DeepSeek 非正式部署 DeepSeek-V3.2-Speciale API 服务,用户通过 base_url="https://api.deepseek.com/v3.2_speciale_expires_on_20251215" 访问。价格不变,仅支持思考模式下的对话功能,不支持工具调用,最大输出长度默认 128K,支持至北京时间 2025-12-15 23:59。

    推荐理由:原文给出了非正式部署的访问方式和明确截止时间,用户可以据此判断是否短期试用这个思考模式模型。

9月29日周一
9月22日周一
  1. DeepSeek API updates65

    DeepSeek-V3.1-Terminus 发布,deepseek-chat 与 deepseek-reasoner 均已升级

    DeepSeek 官方宣布 deepseek-chat 和 deepseek-reasoner 均已升级为 DeepSeek-V3.1-Terminus,分别对应其非思考模式和思考模式。此次更新保持模型原有能力,针对用户反馈改进了语言一致性,缓解中英文混杂和偶发异常字符问题,并优化了 Code Agent 与 Search Agent 的表现。

    推荐理由:官方说明升级后的接口对应关系和两类具体改进,现有用户可据此判断是否切换或观察效果。

8月21日周四
5月28日周三