跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

最新精选

第 21–29 条 · 共 29 条
3月24日周一
  1. DeepSeek 更新日志80

    DeepSeek 将 deepseek-chat 升级至 DeepSeek-V3-0324

    DeepSeek 将 deepseek-chat 模型升级至 DeepSeek-V3-0324,推理能力显著提升,MMLU-Pro 从 75.9 升至 81.2、GPQA 从 59.1 升至 68.4、AIME 从 39.6 升至 59.4、LiveCodeBench 从 39.2 升至 49.2。

    推荐理由:官方更新日志列出 DeepSeek-V3-0324 在推理、代码与中文写作上的基准变化,可对照上一版判断升级幅度。

1月20日周一
  1. DeepSeek 更新日志85

    DeepSeek 发布新模型 DeepSeek-R1,API 模型名 deepseek-reasoner

    DeepSeek 更新日志显示,deepseek-reasoner 是新的 DeepSeek-R1 模型,用户可通过指定 model='deepseek-reasoner' 调用。官方同时给出 DeepSeek-R1 发布说明和 Thinking Mode 指南的参考链接。

    推荐理由:DeepSeek 官方更新日志确认 deepseek-reasoner 对应新模型 DeepSeek-R1,读者可据此了解 API 调用入口的变化。

12月26日周四
  1. DeepSeek 更新日志78

    DeepSeek 将 deepseek-chat 升级为 DeepSeek-V3

    DeepSeek 官方更新日志显示,deepseek-chat 模型已升级为 DeepSeek-V3,API 保持不变,开发者只需指定 model='deepseek-chat' 即可调用 DeepSeek-V3。

    推荐理由:DeepSeek 官方更新日志确认 deepseek-chat 已升级为 DeepSeek-V3,API 调用方式不变,便于开发者直接切换。

12月10日周二
  1. DeepSeek 更新日志62

    DeepSeek 将 deepseek-chat 升级至 DeepSeek-V2.5-1210

    DeepSeek 将 deepseek-chat 模型升级至 DeepSeek-V2.5-1210,多项能力得到提升。数学方面 MATH-500 基准从 74.8% 提升至 82.8%,编码方面 LiveCodebench(08.01-12.01)准确率从 29.2% 提升至 34.38%,写作与推理在内部测试数据集上也有相应改进。新版本还优化了文件上传和网页摘要功能的用户体验。

    推荐理由:官方更新日志给出数学与编码基准的具体提升幅度,可据此判断 DeepSeek-V2.5-1210 的能力变化。

9月5日周四
7月24日周三
6月28日周五
  1. DeepSeek 更新日志72

    DeepSeek 将 deepseek-chat 升级至 DeepSeek-V2-0628

    DeepSeek 将 deepseek-chat 模型升级至 DeepSeek-V2-0628,推理能力在多项基准上提升:编码 HumanEval Pass@1 从 79.88% 升至 84.76%,数学 MATH ACC@1 从 55.02% 升至 71.02%,推理 BBH 从 78.56% 升至 83.40%。

    推荐理由:官方更新日志给出多项基准提升数字,读者可据此判断 DeepSeek-V2-0628 在编码、数学与推理上的能力变化。

6月14日周五
  1. DeepSeek 更新日志72

    DeepSeek 将 deepseek-coder 升级至 DeepSeek-Coder-V2-0614

    DeepSeek 将 deepseek-coder 模型升级为 DeepSeek-Coder-V2-0614,显著提升编码能力。官方称其在代码生成、代码理解、代码调试和代码补全上达到 GPT-4-Turbo-0409 的水平,同时具备出色的数学与推理能力,通用能力与 DeepSeek-V2-0517 相当。

    推荐理由:官方更新日志给出 DeepSeek-Coder-V2-0614 的编码与通用能力定位,便于对照 GPT-4-Turbo 判断升级幅度。

5月17日周五
  1. DeepSeek 更新日志62

    DeepSeek 将 deepseek-chat 升级至 DeepSeek-V2-0517

    DeepSeek 将 deepseek-chat 模型升级至 DeepSeek-V2-0517,指令遵循能力明显提升,IFEval Benchmark Prompt-Level 准确率从 63.9% 升至 77.6%。

    推荐理由:官方更新日志给出 IFEval 与 JSON 解析率的具体提升数字,可据此判断 deepseek-chat 在指令遵循和结构化输出上的变化。