跳到正文
原文
Kimi 官方 Blog·精选AI 评分67

Kimi 发布 k1.5:用 LLM 扩展强化学习

Kimi K1.5: Scaling Reinforcement Learning with LLMs

AI 导读

Kimi 团队发布 Kimi k1.5,并公开了该模型设计与训练的几个关键要点。相关论文以《Kimi k1.5: Scaling Reinforcement Learning with LLMs》为题发布在 arXiv(编号 2501.12599)。

推荐理由

Kimi 官方给出 k1.5 的设计与训练要点,读者可据此了解其强化学习路线的关键取舍。

来源:Kimi 官方 Blog · github.com