Volanea 实测 Mistral Large 4 编码基准得 5.25/10
热点事件观察中
Volanea 实测 Mistral Large 4 编码基准得 5.25/10
1 篇报道1 个报道来源2 天前更新
先了解这件事
AI 综述
Volanea 发布了对 Mistral Large 4 的 KingBench 编码基准实测结果:在 OpenCode 与 OpenRouter 环境下,该模型首轮总分 42/80,即 5.25/10。测试使用八项 KingBench 风格任务,覆盖 AI 编码工作流的不同环节,每个提示都从全新文件夹开始,以减少此前项目、缓存产物或手动配置对结果的帮助。 总分不计入隐形眼镜项目和 3D 手表项目的单独重试,但计入了微调重跑,因为其最初受阻于本地环境的权限设置。 Mistral 于 2026 年 10 月 6 日将该模型作为公开预览发布,并称权重预计在 10 月底推出。
AI 根据报道生成 · 1 小时前更新
最新进展10月7日 08:00
Mistral Large 4 编码基准实测:Le Chonk 首轮得分 5.25/10报道时间线
沿着报道,了解事件的不同侧面。
10月7日
- Exa Semantic DiscoveryMistral Large 4 编码基准实测:Le Chonk 首轮得分 5.25/10
一项基于 KingBench 的八任务实测显示,Mistral Large 4 在 OpenCode 与 OpenRouter 环境下首轮总分 42/80,即 5.25/10。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。