HuggingFace Daily Papers·· 2 天前AI 评分43
超越语义相似度:智能体检索在复杂任务中的性能与成本
Beyond Semantic Similarity: Performance and Costs of Agentic Retrieval for Complex Tasks
AI 导读
研究将 LLM 的推理能力与检索器的语料探索能力结合进 ReAct 智能体循环,构建智能体检索。相同嵌入模型下,其 nDCG@10 比标准检索提升 8.7 分,并在 ViDoRe v3 与 BRIGHT 榜单上取得有竞争力的结果。但代价高昂:平均每次查询耗时 107.4 秒(标准检索为 0.67 秒),消耗 764.1K 输入 token 和 5.8K 输出 token。
来源:HuggingFace Daily Papers · arxiv.org