跳到正文

技术方向

推理能力 最新动态

模型推理能力的进展:思维链、推理模型、数学与逻辑基准的突破与争议。

61 条精选近 30 天 11 条共收录 172 条

更新

精选归档 · 第 4 页

5月17日周五第 61–61 条
  1. DeepSeek 官方更新62

    DeepSeek 将 deepseek-chat 升级至 DeepSeek-V2-0517

    DeepSeek 将 deepseek-chat 模型升级至 DeepSeek-V2-0517,指令遵循能力明显提升,IFEval Benchmark Prompt-Level 准确率从 63.9% 升至 77.6%。

    推荐理由:官方给出 IFEval 与 JSON 解析率的具体提升数字,可据此判断指令遵循和结构化输出能力的实际变化。