

推荐理由:转述 Bloomberg 报道并给出融资规模、估值和资金用途细节,读者可以了解 DeepSeek 这轮募资的构成与去向。
DeepSeek(深度求索)的模型发布、开源权重与技术报告——开源大模型价格与性能双卷的风向标。
当前仅显示精选新闻

推荐理由:转述 Bloomberg 报道并给出融资规模、估值和资金用途细节,读者可以了解 DeepSeek 这轮募资的构成与去向。
据彭博社报道,DeepSeek 新一轮融资接近敲定,规模至少 800 亿元,腾讯和宁德时代是出资最大的投资方之一,最终总额可能逼近 1000 亿元,为 2027 年初的 IPO 铺路。
推荐理由:融资消息汇总了规模、投资方、估值目标和 IPO 节奏,还带出内蒙古算力布局与坚持开源的表态,信息较全。
DeepSeek 于 4 月 24 日发布并开源 V4 系列预览版,华为同期宣布昇腾超节点全系支持 V4,9 月 30 日 DeepSeek 进一步开源面向昇腾的全套底层基础设施组件。文章梳理指出,推理端的国产化已可验证,但 V4 训练是否使用国产芯片证据依然模糊,V4-Pro 服务能力与价格将与昇腾 950 出货量挂钩;DeepSeek 另被曝研发自研推理芯片以降低对英伟达和华为的依赖。
推荐理由:文章梳理了 DeepSeek V4 与昇腾从推理首日适配到训练、产能各环节的实际进展,帮助读者看清国产算力替代的真实边界。
https://x.com/i/article/2105994013270847488
推荐理由:原文拆解了用免费模型与前端代码驱动无骨骼 3D 模型动起来的可复用方法,并给出压缩数据与适用边界。
Please check out @DeepSeekHarness. We just released packaged desktop versions for macOS and Windows; Linux users can get it from the @deepseek-ai/dsh package on npm. https://deepseek.com/harness
推荐理由:原文拆解了桌面端发布的入口形态与插件化架构,读者可以据此判断它对本地 Agent 工作流的适配度。
DeepSeek Harness 进入全球公开预览并开源,基于 Cordis 的“一切皆插件”架构,可作为桌面应用运行或从代码启动 Web UI。它支持日常办公、编码、研究、后台任务,可通过“Creator mode”在聊天中创建插件,用 npx @deepseek-ai/dsh web 一条命令启动,源码在 github.com/deepseek-ai/deepseek-harness。
推荐理由:原文给出 DeepSeek Harness 的插件架构、安装方式和适用场景,读者可据此评估是否纳入自己的工作流。
Claude Code 开放 Mod 机制,用户可像游戏打补丁一样修改其界面、操作逻辑和底层功能,甚至输入一段 Prompt 让 Claude 现场生成 Mod 并热加载。
推荐理由:官方 Mod 机制支持用 TypeScript 或一句话让 Claude 生成扩展并热加载,文章还给出从零手写 Token Weather 的完整步骤。
Claude Code 团队发布 Mods,用户通过提示词即可自定义 Claude 的行为和外观,并可将 mods 作为插件分享。
Mods are absolutely insane. You can now customize Claude to work and look the way you want by just prompting it. Each person works differently, so there's no reason why everyone should have an identical Claude experience. Make Claude your own, and share mods as plugins so others can try your mods too.
推荐理由:作者借 Claude Code Mods 之机,指出 DeepSeekHarness 从一开始就把模型、工具、UI 等全部做成可替换插件,可通过提示词在线修改并持久化。
量子位作者实地走访内蒙古乌兰察布,当地截至今年6月已获约12.5GW数据中心容量承诺,超过OpenAI Stargate的10GW初始承诺,但2025年已投运容量约1.2GW、利用率约66%。文章分析其依托0.35元/度电价、风光资源、冷凉气候和到北京240公里区位吸引华为、阿里、快手、远景等落地,并提示规划容量向实际Token产出转化仍面临审批、接电、利用率和租金等考验。
推荐理由:作者实地走访乌兰察布算力园区,把12.5GW规划承诺与现场落地进度对照,读者可据此理解容量数字与实际运行的距离。
机器之心援引《金融时报》报道,美国企业开始把 AI 任务从 OpenAI、Anthropic 闭源模型迁移到开放权重模型上,中国公司 DeepSeek、智谱成为重要受益方。
推荐理由:文章基于金融时报报道和调用数据,梳理美国企业用开放模型替代闭源 API 的成本与数据主权考量。
9 月 30 日 DeepSeek 宣布开源面向华为昇腾平台的基础设施组件,包括 TileLang 编译工具、DeepGEMM、DeepEP、TileKernels、FlashMLA 和 DeepSelect,分别覆盖矩阵运算、跨设备通信、向量计算与访存、稀疏注意力和数据筛选,与其英伟达平台组件一一对应。
推荐理由:原文梳理了 DeepSeek 开源昇腾计算与通信组件的构成和性能数据,开发者可以据此评估在国产算力上复用这些基础工具的空间。
DeepSeek 正式推出 DeepSeek Harness 桌面端,官网可直接下载 macOS 和 Windows 版本,登录即送 6 元赠金(有效期到 10 月 6 日)。
推荐理由:作者实测桌面版安装、文档处理和 Automation 定时任务,读者可据此判断它能否取代网页版进入日常工作流。
DeepSeek 正式开源面向华为昇腾算力平台的基础设施组件,包括 TileLang 编译工具、DeepGEMM、DeepEP、TileKernels、FlashMLA 和 DeepSelect,与此前英伟达平台组件一一对应。
推荐理由:原文给出各组件与英伟达版本的一一对应关系和昇腾 950 128 卡超节点合作细节,可帮助读者评估昇腾软件生态的可用程度。
推荐理由:OpenRouter 的用量曲线显示 DeepSeek V4.1 Flash 上线 24 小时消耗 1T token,可作为观察付费模型早期采用节奏的横向参照。
推荐理由:Anthropic 指控阿里、Moonshot 与 DeepSeek 未授权用 Claude 训练竞品模型,并给出各家调用量数字,可用于观察模型蒸馏争议的走向。




推荐理由:报告披露封禁后转售商数日内恢复服务,可用于观察模型能力提升后生物滥用管控的边界变化。
推荐理由:文中给出同一套指数下的横向对比和每任务成本,可据此判断轻量模型与旗舰 Pro 之间的性价比差距。
⚡ V4.1-Flash is now live on the DeepSeek API with native multimodal support. Set your model to deepseek-flash. 🔹 V4-Flash & V4-Flash-Vision-Exp are retired. For compatibility, deepseek-v4-flash and deepseek-v4-flash-vision-exp temporarily route to V4.1-Flash. 🔹 Tests by multiple parties put V4.1-Flash ahead of V4-Pro on performance, cost, speed & total runtime. We’re phasing out V4-Pro. 🔹 Starting at 04:00 UTC on Sept 14, 2026, all deepseek-v4-pro requests will route to V4.1-Flash at V4.1-Flash rates. This will continue until V4.1-Pro launches. 🤝 Official partners @WorkBuddy_AI (including Codebuddy) & @opencode now fully support V4.1-Flash. Try it today! 4/6
推荐理由:DeepSeek 以 V4.1-Flash 取代 V4-Pro,读者可以据此了解模型迭代在性能、成本与速度之间的取舍。
推荐理由:原文给出 DeepSeek-V4.1-Flash 的参数结构、上下文长度和开源协议,读者可据此评估其部署与成本价值。
推荐理由:给出了 V4.1-Flash 的稀疏激活与记忆查找设计,读者可据此对比 V4-Flash 的持久 KV 占用变化。