DeepSeek API 上线硬盘上下文缓存技术
DeepSeek API 采用硬盘缓存技术,将价格再降低一个数量级。官方文档显示上下文缓存功能于 2024/08/02 上线,更多更新细节可查阅该文档。
推荐理由:DeepSeek API 用硬盘缓存降低调用价格,读者可据此判断长上下文场景的成本变化。
DeepSeek(深度求索)的模型发布、开源权重与技术报告——开源大模型价格与性能双卷的风向标。
DeepSeek API 采用硬盘缓存技术,将价格再降低一个数量级。官方文档显示上下文缓存功能于 2024/08/02 上线,更多更新细节可查阅该文档。
推荐理由:DeepSeek API 用硬盘缓存降低调用价格,读者可据此判断长上下文场景的成本变化。
DeepSeek 更新日志显示,deepseek-coder 模型已升级为 DeepSeek-Coder-V2-0724。
推荐理由:官方更新日志确认 deepseek-coder 升级到 DeepSeek-Coder-V2-0724,读者可据此核对版本变化。
DeepSeek 将 deepseek-chat 模型升级至 DeepSeek-V2-0628,推理能力在多项基准上提升:编码 HumanEval Pass@1 从 79.88% 升至 84.76%,数学 MATH ACC@1 从 55.02% 升至 71.02%,推理 BBH 从 78.56% 升至 83.40%。
推荐理由:官方更新日志给出多项基准提升数字,读者可据此判断 DeepSeek-V2-0628 在编码、数学与推理上的能力变化。
DeepSeek 将 deepseek-coder 模型升级为 DeepSeek-Coder-V2-0614,显著提升编码能力。官方称其在代码生成、代码理解、代码调试和代码补全上达到 GPT-4-Turbo-0409 的水平,同时具备出色的数学与推理能力,通用能力与 DeepSeek-V2-0517 相当。
推荐理由:官方更新日志给出 DeepSeek-Coder-V2-0614 的编码与通用能力定位,便于对照 GPT-4-Turbo 判断升级幅度。
DeepSeek 将 deepseek-chat 模型升级至 DeepSeek-V2-0517,指令遵循能力明显提升,IFEval Benchmark Prompt-Level 准确率从 63.9% 升至 77.6%。
推荐理由:官方更新日志给出 IFEval 与 JSON 解析率的具体提升数字,可据此判断 deepseek-chat 在指令遵循和结构化输出上的变化。