跳到正文
原文
Qwen Blog·· 2024-04-02精选AI 评分71

Qwen1.5-32B 与 Qwen1.5-32B-Chat 发布

Qwen1.5-32B: Fitting the Capstone of the Qwen1.5 Language Model Series

AI 导读

Qwen 团队发布 Qwen1.5 系列新成员 Qwen1.5-32B 及其对话版本 Qwen1.5-32B-Chat,架构上引入 GQA 以提升推理效率。基础能力评测中,Qwen1.5-32B 在 MMLU 得 73.4、GSM8K 得 77.4、BBH 得 66.8,多数任务超过 Llama2-34B 和 Mixtral-8x7B,略低于 Qwen1.5-72B。

推荐理由

原文给出 Qwen1.5-32B 与 72B、Llama2-34B、Mixtral-8x7B 的基准对比,读者可据此判断中等规模模型的取舍。

来源:Qwen Blog · qwenlm.github.io