最新精选
第 121–125 条 · 共 125 条Qwen 团队发布 QwQ-Max-Preview,这是基于 Qwen2.5-Max 构建的推理模型预览版,在数学、编码和通用领域任务上表现突出,并擅长 Agent 相关工作流。官方表示 QwQ-Max 与 Qwen2.5-Max 将以 Apache 2.0 协议开源,后续还会推出 Qwen Chat App,并开源 QwQ-32B 等更小的推理模型供本地部署。
推荐理由:原文给出 QwQ-Max-Preview 的能力定位与后续开源、App 和小模型计划,读者可据此判断 Qwen 推理模型的路线。
Qwen 发布新一代旗舰视觉语言模型 Qwen2.5-VL,并开源 3B、7B、72B 的 base 与 instruct 版本,可在 Hugging Face 和 ModelScope 获取。
推荐理由:原文给出 Qwen2.5-VL 三个尺寸的开源权重与视觉智能体、长视频理解等能力变化,便于读者判断多模态模型的可选范围。
Qwen2-VL 发布,这是 Qwen 系列基于 Qwen2 的新版视觉语言模型,开源 Qwen2-VL-2B 和 Qwen2-VL-7B(Apache 2.0),并开放 Qwen2-VL-72B 的 API。
推荐理由:原文给出 Qwen2-VL 的视觉理解基准表现、开源规格与视频、智能体能力,读者可据此判断多模态选型。
Qwen 团队发布博客,介绍如何用 8k 上下文的 Qwen2 模型构建智能体来处理 1M token 的文档,效果超过 RAG 和原生长上下文模型。该智能体分三级:基于 BM25 关键词检索的 RAG、逐块阅读、以及将前两级封装为工具进行多跳推理的 ReAct 式智能体。
推荐理由:原文给出用 8k 上下文模型处理 1M token 文档的三级智能体方案,可迁移到长文档问答场景。
Qwen 团队发布 Qwen1.5 系列,开源 0.5B、1.8B、4B、7B、14B、32B、72B、110B 八种尺寸的 base 与 chat 模型,以及一个 MoE 模型,并提供 Int4、Int8 GPTQ 和 AWQ、GGUF 量化版本。
推荐理由:原文给出六种尺寸的开源模型与量化版本,并列出与 transformers、vLLM 等框架的集成方式,便于开发者评估迁移成本。