清华大学自然语言处理实验室、中国人民大学、面壁智能与 OpenBMB 开源社区联合发布并开源 AgentCPM-Report,一个本地化、私有化、拥有 SOTA 性能的深度调研智能体。
AgentCPM-Report 核心亮点
极致效能,以小博大:通过平均 40 轮的深度检索与近 100 轮的思维链推演,实现对信息的全方位挖掘与重组,让端侧模型也能产出逻辑严密、洞察深刻的万字长文,在深度调研任务上以 8B 参数规模达成与顶级闭源系统的性能对标。
物理隔绝,本地安全:专为高隐私场景设计,支持完全离线的本地化敏捷部署,彻底杜绝云端泄密风险。基于 UltraRAG 框架,它能高效挂载并理解您的本地私有知识库,让核心机密数据在“不出域”的前提下,安全地转化为极具价值的专业决策报告。
据介绍,AgentCPM-Report 之所以能以 8B 参数媲美闭源系统源于两大技术创新:
创新一:“写作即推理”模式,让思考更贴近人脑
传统方案试图让模型“一口气”生成完整大纲或内容,容易造成产出报告的逻辑崩塌,对于小模型来说是更是难上加难。AgentCPM-Report 创新性地采用了“边写作,边规划”的迭代精炼框架打破这一局限:
两阶段循环:系统在 “起草” 与 “深化” 两个状态间不断交替。就像人类专家一样,写完一段草稿后,会立即停下来反思:“有没有需要补充的地方?侧重点应该是怎样的?”,然后回头扩展章节、补充检索、填充新内容。
渐进式优化:将宏大的万字长文任务,拆解为一系列可执行的微小目标。模型在每一轮循环中只需解决当下的局部问题,从而在较小的参数规模条件下产出逻辑严密、细节丰富的长篇报告。
创新二:“多阶段智能体学习”,全方位能力提升
01 四大核心能力拆解
将完整报告协作拆解为四个核心能力模块,并针对性地进行强化训练:
🔍 智能检索能力:以“召回率”为核心优化指标,确保检索内容高度相关,为写作奠定坚实基础;
📝 流畅写作能力:建立多维度质量评估体系,从内容深度到表达清晰度全面把关;
🗺️ 科学规划能力:对生成大纲进行结构化评估,确保报告逻辑严谨、层次分明;
🎯 精准决策能力:采用“轨迹剪枝”技术,构造高质量数据,解决“何时停止深化”的关键决策问题。
02 三阶段训练法:从入门到精通
有监督微调:高质量范文引导,掌握写作基本范式;
原子能力强化:针对每项核心原子能力进行专项提升;
全流程优化: 端到端全链路强化学习,以最终报告质量为唯一目标,打通所有能力关节。
AgentCPM-Report 开源地址
评论删除后,数据将无法恢复
AgentCPM-Report 正式开源,8B 端侧写作智能体
清华大学自然语言处理实验室、中国人民大学、面壁智能与 OpenBMB 开源社区联合发布并开源 AgentCPM-Report,一个本地化、私有化、拥有 SOTA 性能的深度调研智能体。
AgentCPM-Report 核心亮点
极致效能,以小博大:通过平均 40 轮的深度检索与近 100 轮的思维链推演,实现对信息的全方位挖掘与重组,让端侧模型也能产出逻辑严密、洞察深刻的万字长文,在深度调研任务上以 8B 参数规模达成与顶级闭源系统的性能对标。
物理隔绝,本地安全:专为高隐私场景设计,支持完全离线的本地化敏捷部署,彻底杜绝云端泄密风险。基于 UltraRAG 框架,它能高效挂载并理解您的本地私有知识库,让核心机密数据在“不出域”的前提下,安全地转化为极具价值的专业决策报告。
据介绍,AgentCPM-Report 之所以能以 8B 参数媲美闭源系统源于两大技术创新:
创新一:“写作即推理”模式,让思考更贴近人脑
传统方案试图让模型“一口气”生成完整大纲或内容,容易造成产出报告的逻辑崩塌,对于小模型来说是更是难上加难。AgentCPM-Report 创新性地采用了“边写作,边规划”的迭代精炼框架打破这一局限:
两阶段循环:系统在 “起草” 与 “深化” 两个状态间不断交替。就像人类专家一样,写完一段草稿后,会立即停下来反思:“有没有需要补充的地方?侧重点应该是怎样的?”,然后回头扩展章节、补充检索、填充新内容。
渐进式优化:将宏大的万字长文任务,拆解为一系列可执行的微小目标。模型在每一轮循环中只需解决当下的局部问题,从而在较小的参数规模条件下产出逻辑严密、细节丰富的长篇报告。
创新二:“多阶段智能体学习”,全方位能力提升
01 四大核心能力拆解
将完整报告协作拆解为四个核心能力模块,并针对性地进行强化训练:
🔍 智能检索能力:以“召回率”为核心优化指标,确保检索内容高度相关,为写作奠定坚实基础;
📝 流畅写作能力:建立多维度质量评估体系,从内容深度到表达清晰度全面把关;
🗺️ 科学规划能力:对生成大纲进行结构化评估,确保报告逻辑严谨、层次分明;
🎯 精准决策能力:采用“轨迹剪枝”技术,构造高质量数据,解决“何时停止深化”的关键决策问题。
02 三阶段训练法:从入门到精通
有监督微调:高质量范文引导,掌握写作基本范式;
原子能力强化:针对每项核心原子能力进行专项提升;
全流程优化: 端到端全链路强化学习,以最终报告质量为唯一目标,打通所有能力关节。
AgentCPM-Report 开源地址