跳到正文
原文
Qwen Blog·· 2024-06-06精选AI 评分62

Qwen 团队用 Qwen-Agent 让 8k 上下文模型处理 1M token 文档

Generalizing an LLM from 8k to 1M Context using Qwen-Agent

AI 导读

Qwen 团队发布博客,介绍如何用 8k 上下文的 Qwen2 模型构建智能体来处理 1M token 的文档,效果超过 RAG 和原生长上下文模型。该智能体分三级:基于 BM25 关键词检索的 RAG、逐块阅读、以及将前两级封装为工具进行多跳推理的 ReAct 式智能体。

推荐理由

原文给出用 8k 上下文模型处理 1M token 文档的三级智能体方案,可迁移到长文档问答场景。

来源:Qwen Blog · qwenlm.github.io