跳到正文

DeepSeek

DeepSeek(深度求索)的模型发布、开源权重与技术报告——开源大模型价格与性能双卷的风向标。

最新精选

第 21–25 条 · 共 25 条
8月2日周五
7月24日周三
6月28日周五
  1. DeepSeek 更新日志72

    DeepSeek 将 deepseek-chat 升级至 DeepSeek-V2-0628

    DeepSeek 将 deepseek-chat 模型升级至 DeepSeek-V2-0628,推理能力在多项基准上提升:编码 HumanEval Pass@1 从 79.88% 升至 84.76%,数学 MATH ACC@1 从 55.02% 升至 71.02%,推理 BBH 从 78.56% 升至 83.40%。

    推荐理由:官方更新日志给出多项基准提升数字,读者可据此判断 DeepSeek-V2-0628 在编码、数学与推理上的能力变化。

6月14日周五
  1. DeepSeek 更新日志72

    DeepSeek 将 deepseek-coder 升级至 DeepSeek-Coder-V2-0614

    DeepSeek 将 deepseek-coder 模型升级为 DeepSeek-Coder-V2-0614,显著提升编码能力。官方称其在代码生成、代码理解、代码调试和代码补全上达到 GPT-4-Turbo-0409 的水平,同时具备出色的数学与推理能力,通用能力与 DeepSeek-V2-0517 相当。

    推荐理由:官方更新日志给出 DeepSeek-Coder-V2-0614 的编码与通用能力定位,便于对照 GPT-4-Turbo 判断升级幅度。

5月17日周五
  1. DeepSeek 更新日志62

    DeepSeek 将 deepseek-chat 升级至 DeepSeek-V2-0517

    DeepSeek 将 deepseek-chat 模型升级至 DeepSeek-V2-0517,指令遵循能力明显提升,IFEval Benchmark Prompt-Level 准确率从 63.9% 升至 77.6%。

    推荐理由:官方更新日志给出 IFEval 与 JSON 解析率的具体提升数字,可据此判断 deepseek-chat 在指令遵循和结构化输出上的变化。