跳到正文

公司与模型

DeepSeek 最新动态

DeepSeek(深度求索)的模型发布、开源权重、技术报告与 API 价格变化。

29 条精选近 30 天 6 条共收录 103 条

更新

精选归档 · 第 2 页

5月28日周三第 21–29 条
  1. DeepSeek API News64

    DeepSeek 将 deepseek-reasoner 升级至 DeepSeek-R1-0528

    DeepSeek 将 deepseek-reasoner 模型升级至 DeepSeek-R1-0528,多项基准 Pass@1 提升:AIME 2025 从 70.0 升至 87.5,GPQA 从 71.5 升至 81.0,LCB_v6 从 63.5 升至 73.3,Aider 从 57.0 升至 71.6。

    推荐理由:DeepSeek-R1-0528 在 AIME、GPQA、Aider 等基准上的提升幅度,可用于判断推理模型迭代节奏。

3月27日周四
3月24日周一
  1. DeepSeek API News66

    DeepSeek 将 deepseek-chat 升级至 DeepSeek-V3-0324

    DeepSeek 将 deepseek-chat 模型升级为 DeepSeek-V3-0324,推理能力显著提升,MMLU-Pro 从 75.9 升至 81.2,GPQA 从 59.1 升至 68.4,AIME 从 39.6 升至 59.4,LiveCodeBench 从 39.2 升至 49.2。

    推荐理由:官方给出 V3-0324 在推理、编码与中文写作上的基准变化,可据此判断升级幅度。

2月2日周日
  1. Hugging Face Blog66

    Open-R1 更新:复现 DeepSeek-R1 评测与训练管线进展

    Hugging Face 的 Open-R1 项目发布首周进展,在 MATH-500 上复现了 DeepSeek-R1 蒸馏系列模型的评测分数,例如 DeepSeek-R1-Distill-Qwen-32B 得 95.0、DeepSeek-R1-Distill-Llama-70B 得 93.4。

    推荐理由:Open-R1 一周内复现了 DeepSeek-R1 蒸馏模型的 MATH-500 评测分数,并公开了合成数据生成与 GRPO 训练的工程细节。

1月31日周五
1月28日周二
1月20日周一
  1. DeepSeek API News83

    DeepSeek 发布新模型 DeepSeek-R1,API 模型名 deepseek-reasoner

    DeepSeek 官方 API 文档显示,deepseek-reasoner 是新的 DeepSeek-R1 模型,调用时指定 model='deepseek-reasoner' 即可使用。文档同时给出 DeepSeek-R1 发布说明与 Thinking Mode 指南的链接。

    推荐理由:DeepSeek 官方文档确认 deepseek-reasoner 对应新模型 DeepSeek-R1,读者可据此了解 API 调用入口的变化。

12月26日周四
  1. DeepSeek API News76

    DeepSeek 将 deepseek-chat 升级至 DeepSeek-V3

    DeepSeek 官方宣布 deepseek-chat 模型已升级为 DeepSeek-V3,API 保持不变,开发者仍通过指定 model='deepseek-chat' 调用 DeepSeek-V3。官方同时给出介绍 DeepSeek-V3 的详情链接。

    推荐理由:DeepSeek 官方说明 deepseek-chat 已升级为 DeepSeek-V3,开发者可据此判断现有 API 调用是否需要调整。

6月14日周五
  1. DeepSeek API News60

    DeepSeek 将 deepseek-coder 升级至 DeepSeek-Coder-V2-0614

    DeepSeek 将 deepseek-coder 模型升级为 DeepSeek-Coder-V2-0614,显著提升编码能力。官方称其在代码生成、代码理解、代码调试和代码补全上达到 GPT-4-Turbo-0409 的水平,同时具备较强的数学与推理能力,通用能力与 DeepSeek-V2-0517 相当。

    推荐理由:官方给出升级后模型在代码生成、理解、调试与补全上的对标基准,可据此判断编码能力定位。