跳到正文

DeepSeek

DeepSeek(深度求索)的模型发布、开源权重与技术报告——开源大模型价格与性能双卷的风向标。

当前仅显示精选新闻
106条精选相关主题千问 Qwen开源生态模型发布

最新精选

第 61–80 条 · 共 106 条
8月13日周四
  1. 机器之心 · 微信公众号80

    DeepSeek 开源智能体框架 Harness,主打一切皆插件

    DeepSeek 开源了开发者预览版智能体框架 DeepSeek Harness,它是一套用来构建、运行和扩展智能体的 SDK 与应用框架,默认可连接 DeepSeek 模型,开源地址在 GitHub。

    推荐理由:作者以提前内测的第三方身份跑通游戏与 3D 动画案例,展示了这套插件化智能体框架的组装方式与能力边界。

  2. 赛博禅心 · 微信公众号82

    DeepSeek Harness 开发者预览版上线并开源

    DeepSeek Harness 开发者预览版上线并开源,定位为类似 Claude Code 的 Agent 框架。它采用插件式架构,模型、工具、技能、会话、沙箱、循环、UI 等能力均由可替换的插件组合,基于具备时空可组合性的 Cordis 插件系统构建。

    推荐理由:全文拆解了 DeepSeek Harness 的插件化架构与模式设计,读者可据此判断这类 Agent 框架的定制边界与取舍。

  3. DeepSeek68

    DeepSeek 发布 DeepSeek-V4-Pro,重点升级 Agent 能力并已在 app/web 的 Expert Mode 和 API 上线,模型名不变。V4-Pro 与 V4-Flash 支持灵活推理档位,简单任务用 low、日常 Agent 工作流用 high、复杂任务用 max。同时原生支持 OpenAI Responses API,针对 Codex 优化并提供一键设置,详情见 API 文档。

    推荐理由:发布方直接给出 Agent 能力升级、可调推理档位和 OpenAI Responses API 兼容,读者可对照判断是否切换日常模型。

  4. Simon Willison76

    DeepSeek V4 Pro 0813 上线 OpenRouter,权重随后在 Hugging Face 开放

    DeepSeek 最新 Pro 模型 DeepSeek V4 Pro 0813 已通过 API 上线,作者因找不到官方发布页面而链接到 OpenRouter;随后更新称权重已在 Hugging Face 开放,1.7T 参数、893 GB。

    推荐理由:记录了新模型仅以 API 形式上线、权重随后开放至 Hugging Face,以及作者自测不同推理档位的输出差异。

  5. 量子位 · 微信公众号78

    DeepSeek V4 Pro 正式版发布,多项基准对标 Fable 5

    DeepSeek V4 Pro 正式版发布,API 平台已上线 DeepSeek-V4-Pro-0813,官方博客尚未发布。在 HLE、Terminal Bench、Cybergym、DeepSWE 等 Agent 基准上,它几乎全面超过 Opus 4.8,逼近 Fable 5,部分榜单反超;百万 tokens 输入 3 元、缓存命中 0.025 元、输出 6 元。

    推荐理由:素材给出多项 Agent 基准对比与 API 定价,可据此判断国产开源模型与闭源前沿的差距及调用成本。

  6. DeepSeek API updates84

    DeepSeek-V4-Pro 正式版上线,Agent 能力提升并支持 Responses API

    DeepSeek-V4-Pro 正式版已在 APP、网页端和 API 上线,模型名 deepseek-v4-pro,API 调用方式不变。官方称 Agent 能力大幅提升,生产环境性能表现提升尤为显著,并公布 HLE (wo / w tools) 42.7/60.0、Terminal Bench 2.1 87.9、NL2Repo 61.5 等基准成绩。

    推荐理由:官方公告列出了正式版在多项 Agent 与编码基准上的分数、Responses API 支持和峰谷定价细节,方便用户评估迁移与调用时机。

8月10日周一
  1. 量子位 · 微信公众号77

    宇树科技IPO路演,王兴兴回应破发、估值与具身大模型等问题

    宇树科技董事长兼CEO王兴兴在IPO路演中回答了200多道提问,对股票是否破发仅回应请关注公司上市后的股价走势,并称按2025年扣非净利润计算的发行价对应市盈率为92.92倍。

    推荐理由:路演问答集中回应了破发风险、估值依据与具身大模型进展,可借此了解宇树上市前的自我说明。

7月31日周五
  1. DeepSeek68

    DeepSeek 宣布 DeepSeek-V4-Flash 官方 API 正式开启公测,Agent 能力大幅升级,基准成绩远超 V4-Pro-Preview。官方版本原生支持 Responses API 格式并完整适配 Codex,配置详情见官方文档 https://api-docs.deepseek.com/quick_start/agent_integrations/codex。

    推荐理由:官方宣布 V4-Flash 公测上线,Agent 能力大幅升级并原生支持 Responses API,配有与多款模型的基准对比数据。

7月28日周二
  1. 硅星人Pro · 微信公众号79

    拆解 Kimi K3 技术报告:月之暗面开始给 DeepSeek 出题了

    月之暗面公开 Kimi K3 的完整权重与 47 页技术报告,报告称相较 K2 整体 scaling 效率提升约 2.5 倍。技术报告显示,K3 采用 3:1 的 KDA 线性注意力与 MLA 混合架构、AttnRes 层间检索,以及 896 个专家、每个 token 激活 16 个的 MoE 配置。

    推荐理由:结合 K3 技术报告的关键架构与训练改动,对比 DeepSeek 的路线差异,呈现开源模型在预训练一侧的进展。

7月17日周五
  1. 量子位 · 微信公众号79

    安徽开润股份公告暴露DeepSeek估值约3509亿元

    7月16日晚,安徽开润股份发布投资进展公告,其全资子公司宁波浦润出资4000万元认购的砺思星灵基金,将29亿元实缴资金全部间接投向DeepSeek,获得0.8265%股权,按此计算DeepSeek估值约3508.8亿元。

    推荐理由:通过上市公司公告可推算DeepSeek估值约3509亿元,并呈现同一轮融资两个估值口径的差异。

6月30日周二
  1. OpenRouter Announcements74

    OpenRouter 数据分析:DeepSeek V4 上线后 token 份额从 9% 翻倍至 18%

    OpenRouter 基于 2026 年 1 月 1 日至 6 月 14 日超 450 万亿 token 的日志分析,DeepSeek V4 于 4 月 24 日发布后,DeepSeek token 份额从年初约 9% 升至 6 月初近 20%,并自 5 月中旬起成为 OpenRouter 上用量第一的模型,智能体工作负载贡献了主要增量。

    推荐理由:基于 OpenRouter 450 万亿 token 日志分析 V4 上线后的份额变化,并区分智能体与人类流量,数据口径和价格对比都有可参考价值。

6月27日周六
  1. OpenRouter Announcements76

    OpenRouter 评出 2026 年 6 月最值得关注的四款开放权重模型

    OpenRouter 认为 2026 年 6 月最值得关注的四款开放权重模型是 DeepSeek V4 Flash、GLM 5.2、MiniMax M3 和 NVIDIA Nemotron 3 Ultra,并指出开放权重模型与美国前沿实验室的能力差距已连续 18 个月保持在 3-6 个月且未在扩大。

    推荐理由:OpenRouter 用自家价格与吞吐数据逐一点评四款开放权重模型的适用场景,读者可以按成本、质量和模态对号入座选型。

6月18日周四
  1. 虎嗅APP · 微信公众号81

    DeepSeek 完成500亿元融资,为何有人质疑庆祝过早

    DeepSeek完成首轮外部融资超500亿元人民币,估值突破500亿美元,成为中国AI行业迄今最大规模单轮融资。梁文锋自掏200亿元成为本轮最大出资方,外部投资者资金进入其管理的有限合伙企业,无投票权且五年锁定期。文章对比互联网泡沫等历史案例,并指出DeepSeek约7亿美元的年收入预期与500亿美元估值之间的倍数压力。

    推荐理由:文章梳理梁文锋的融资条款设计,并以历史泡沫案例和估值收入倍数提供冷静的判断视角。