HuggingFace Daily Papers(社区热门论文)
65
面向可验证的多模态深度研究:一个用于交错式报告生成的多智能体框架
AI 摘要
大语言模型已将智能体从深度搜索推进至能生成长篇报告的深度研究。然而,可验证的多模态深度研究仍面临挑战。为此,研究提出了Ptah,一个多智能体框架。它通过规划、研究和写作阶段,协调从用户查询到网页报告的生成全流程,其中智能体负责构建计划、收集证据并维护视觉记忆。一个验证智能体确保整个流程的事实依据和跨模态一致性。研究还引入了PtahEval评估协议。实验表明,Ptah能生成比基线更可靠、视觉信息更丰富、更实用的多模态报告。
该来源未收录可展示正文,站内仅提供摘要。
阅读原文arxiv.org