跳到正文
热点事件观察中

Volanea 实测 Mistral Large 4 编码基准得 5.25/10

1 篇报道1 个报道来源2 天前更新

先了解这件事

AI 综述

Volanea 发布了对 Mistral Large 4 的 KingBench 编码基准实测结果:在 OpenCode 与 OpenRouter 环境下,该模型首轮总分 42/80,即 5.25/10。测试使用八项 KingBench 风格任务,覆盖 AI 编码工作流的不同环节,每个提示都从全新文件夹开始,以减少此前项目、缓存产物或手动配置对结果的帮助。 总分不计入隐形眼镜项目和 3D 手表项目的单独重试,但计入了微调重跑,因为其最初受阻于本地环境的权限设置。 Mistral 于 2026 年 10 月 6 日将该模型作为公开预览发布,并称权重预计在 10 月底推出。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. Exa Semantic Discovery
    Mistral Large 4 编码基准实测:Le Chonk 首轮得分 5.25/10

    一项基于 KingBench 的八任务实测显示,Mistral Large 4 在 OpenCode 与 OpenRouter 环境下首轮总分 42/80,即 5.25/10。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。