deepseek-chat 升级为 DeepSeek-V3-0324,多项基准测试显著提升
DeepSeek 官方宣布 deepseek-chat 模型升级为 DeepSeek-V3-0324。基准测试提升明显,MMLU-Pro 75.9 → 81.2,GPQA 59.1 → 68.4,AIME 39.6 → 59.4,LiveCodeBench 39.2 → 49.2。
推荐理由:原文给出各基准测试的具体提升数字和功能变化,读者可据此评估升级对现有应用的影响。
DeepSeek(深度求索)的模型发布、开源权重与技术报告——开源大模型价格与性能双卷的风向标。
DeepSeek 官方宣布 deepseek-chat 模型升级为 DeepSeek-V3-0324。基准测试提升明显,MMLU-Pro 75.9 → 81.2,GPQA 59.1 → 68.4,AIME 39.6 → 59.4,LiveCodeBench 39.2 → 49.2。
推荐理由:原文给出各基准测试的具体提升数字和功能变化,读者可据此评估升级对现有应用的影响。
DeepSeek 在 API 中上线 deepseek-reasoner,即新模型 DeepSeek-R1,通过指定 model=deepseek-reasoner 调用。详细更新见 DeepSeek-R1 正式发布说明,调用指南见推理模型文档。
推荐理由:原文说明 deepseek-reasoner 即 DeepSeek-R1,给出了调用方式,方便开发者在 API 中直接使用新推理模型。
deepseek-chat 模型已升级为 DeepSeek-V3,接口不变,仍可通过指定 model=deepseek-chat 调用。详细更新可参考官方 DeepSeek-V3 正式发布说明。
推荐理由:API 接口保持不变,现有用户可无迁移成本地用上 DeepSeek-V3,原文还指向了详细更新说明。
DeepSeek 将 DeepSeek V2 Chat 与 DeepSeek Coder V2 合并升级为 DeepSeek V2.5,API 用户通过 deepseek-coder 或 deepseek-chat 均可访问新模型。
推荐理由:原文来自官方更新日志,给出了合并后的模型名称、API 兼容方式和多项评测分数变化,便于读者对照评估升级效果。
DeepSeek API 创新采用硬盘缓存技术,价格再降一个数量级。更新详情见官方文档 API 上线硬盘缓存,发布于 2024/08/02。
推荐理由:官方宣布 API 采用硬盘缓存并称价格再降一个数量级,读者可以据此评估调用成本的下降幅度。
DeepSeek 官方宣布 deepseek-chat 模型升级为 DeepSeek-V2-0628,推理能力提升。
推荐理由:官方给出代码、数学、推理和对战胜率的前后对比数据,读者可以据此评估这次升级的实际幅度。