DeepSeek-V4 发布:百万 token 上下文面向智能体任务
DeepSeek 发布 V4,Hub 上提供两个 MoE 检查点:DeepSeek-V4-Pro 总参数 1.6T、激活 49B,DeepSeek-V4-Flash 总参数 284B、激活 13B,两者均支持 1M token 上下文窗口。
推荐理由:原文拆解了 V4 面向长上下文智能体的注意力与后训练设计,可据此判断开源模型跑长任务时的成本变化。
Hugging Face 开源社区动态:热门模型与数据集、排行榜变化与开源生态的晴雨表。
当前仅显示精选新闻DeepSeek 发布 V4,Hub 上提供两个 MoE 检查点:DeepSeek-V4-Pro 总参数 1.6T、激活 49B,DeepSeek-V4-Flash 总参数 284B、激活 13B,两者均支持 1M token 上下文窗口。
推荐理由:原文拆解了 V4 面向长上下文智能体的注意力与后训练设计,可据此判断开源模型跑长任务时的成本变化。
Hugging Face 发布指南,讲解如何在 Chrome 扩展(Manifest V3)中用 Transformers.js 运行本地模型,并复现其 Gemma 4 浏览器助手的核心架构。
推荐理由:用一个已上线的浏览器扩展拆解 MV3 下的分层架构,可供搭建本地模型扩展时参考分工与数据边界。
PromptArmor 披露,攻击者可在网页、文档或 MCP 工具响应中植入恶意指令,诱导 HuggingChat 中的模型输出动态生成的 Markdown 图片,在聊天中渲染时外泄 AI 可访问的其他来源数据。演示显示网页注入可窃取用户上传文档中的机密财务数据。该漏洞已于 2025/12/1 负责任披露给 HuggingFace,因安全团队未回应而公开。
推荐理由:原文完整演示了通过网页注入诱导 HuggingChat 输出恶意 Markdown 图片外泄用户文档数据的路径,并说明了披露时间线。
MiniMax 开源并发布面向 Agent 和编码场景的模型 MiniMax M2,API 定价为每百万输入 tokens $0.30/¥2.1、输出 $1.20/¥8.4,为 Claude 4.5 Sonnet 的 8%,推理速度接近其两倍,TPS 约 100。
推荐理由:官方给出了 M2 的定价、推理速度、基准成绩与部署方式,读者可据此评估其在 Agent 工作流中的成本与性能权衡。