跳到正文

Agent 智能体

让模型自主规划、调用工具、完成多步任务的技术方向——从 Claude Code、Manus 到各家 Agent 框架与评测基准的全部动态。

最新精选

第 121–125 条 · 共 125 条
2月25日周二
  1. Qwen Blog62

    Qwen 发布 QwQ-Max-Preview 推理模型预览版

    Qwen 团队发布 QwQ-Max-Preview,这是基于 Qwen2.5-Max 构建的推理模型预览版,在数学、编码和通用领域任务上表现突出,并擅长 Agent 相关工作流。官方表示 QwQ-Max 与 Qwen2.5-Max 将以 Apache 2.0 协议开源,后续还会推出 Qwen Chat App,并开源 QwQ-32B 等更小的推理模型供本地部署。

    推荐理由:原文给出 QwQ-Max-Preview 的能力定位与后续开源、App 和小模型计划,读者可据此判断 Qwen 推理模型的路线。

1月26日周日
8月29日周四
6月6日周四
  1. Qwen Blog62

    Qwen 团队用 Qwen-Agent 让 8k 上下文模型处理 1M token 文档

    Qwen 团队发布博客,介绍如何用 8k 上下文的 Qwen2 模型构建智能体来处理 1M token 的文档,效果超过 RAG 和原生长上下文模型。该智能体分三级:基于 BM25 关键词检索的 RAG、逐块阅读、以及将前两级封装为工具进行多跳推理的 ReAct 式智能体。

    推荐理由:原文给出用 8k 上下文模型处理 1M token 文档的三级智能体方案,可迁移到长文档问答场景。

2月4日周日
  1. Qwen Blog78

    Qwen 团队开源 Qwen1.5 系列模型

    Qwen 团队发布 Qwen1.5 系列,开源 0.5B、1.8B、4B、7B、14B、32B、72B、110B 八种尺寸的 base 与 chat 模型,以及一个 MoE 模型,并提供 Int4、Int8 GPTQ 和 AWQ、GGUF 量化版本。

    推荐理由:原文给出六种尺寸的开源模型与量化版本,并列出与 transformers、vLLM 等框架的集成方式,便于开发者评估迁移成本。