跳到正文

DeepSeek

DeepSeek(深度求索)的模型发布、开源权重与技术报告——开源大模型价格与性能双卷的风向标。

最新精选

第 21–23 条 · 共 23 条
6月28日周五
  1. DeepSeek 官方更新69

    原文发布 6月28日 00:00

    DeepSeek 将 deepseek-chat 升级至 DeepSeek-V2-0628

    DeepSeek 将 deepseek-chat 模型升级至 DeepSeek-V2-0628,推理能力在多项基准上提升:编码 HumanEval Pass@1 从 79.88% 升至 84.76%,数学 MATH ACC@1 从 55.02% 升至 71.02%,推理 BBH 从 78.56% 升至 83.40%。

    推荐理由:原文给出 DeepSeek-V2-0628 在编码、数学、推理基准上的具体提升数字,便于读者判断这次升级的幅度。

6月14日周五
  1. DeepSeek 官方更新62

    原文发布 6月14日 00:00

    DeepSeek 将 deepseek-coder 升级至 DeepSeek-Coder-V2-0614

    DeepSeek 将 deepseek-coder 模型升级为 DeepSeek-Coder-V2-0614,显著提升编码能力。官方称其在代码生成、代码理解、代码调试和代码补全上达到 GPT-4-Turbo-0409 的水平,同时具备出色的数学与推理能力,通用能力与 DeepSeek-V2-0517 相当。

    推荐理由:官方给出升级后模型在代码生成、理解、调试与补全上的对标水平,便于读者判断编码能力定位。

5月17日周五
  1. DeepSeek 官方更新62

    原文发布 5月17日 00:00

    DeepSeek 将 deepseek-chat 升级至 DeepSeek-V2-0517

    DeepSeek 将 deepseek-chat 模型升级至 DeepSeek-V2-0517,指令遵循能力明显提升,IFEval Benchmark Prompt-Level 准确率从 63.9% 升至 77.6%。

    推荐理由:官方给出 IFEval 与 JSON 解析率的具体提升数字,可据此判断指令遵循和结构化输出能力的实际变化。