时间:2026-08-18
地点:美国/全球
人物:Artificial Analysis、Parallel、Exa、Firecrawl、Tavily、Brave
事件详情:Artificial Analysis 于 2026 年 8 月 18 日发布 Search Index(搜索索引)基准,针对 AI 代理使用场景对多家搜索 API 提供商进行质量、成本与速度三维评估。首批参与评测的厂商包括 Parallel、Exa、Firecrawl、You.com、Tavily、Keenable 与 Brave。所有测试统一使用 GPT-5.6 Luna 模型作为答题端,运行于 Artificial Analysis 开源代理框架 Stirrup 之上,每个任务最多 25 次工具调用机会。
背景:Search Index 由三项等权基准组成——DeepSearchQA(900 道深度研究问答)、BrowseComp 200 题硬核事实子集、AA-Omniscience(覆盖 6 个领域的 600 道事实问答),并将"无搜索工具"基线作为对照。无搜索能力时,模型仅得 33 分;接入搜索后,得分跃升至 65-75。Parallel、Exa、Firecrawl 分别以 75、74、73 居综合得分前三。Artificial Analysis 表示,Parallel、Firecrawl 与 Parallel(turbo)取得最佳性价比,其他厂商可申请加入评测。
影响:该榜单首次为 AI 代理搜索场景建立可比、可复现的供应商对比框架,将直接影响开发者在 RAG、深度研究、多步推理代理中的搜索选型决策。Parallel Search(advanced)相比基础版可让 token 用量降低超 40%,单任务总成本由 0.11 美元降至 0.084 美元,证明"高质量搜索换更少 token"的经济性,为代理开发者提供明确的优化路径。
总结:Artificial Analysis 推出 Search Index 基准,定义 AI 代理搜索 API 评测标准,Parallel/Exa/Firecrawl 三家并列前三,质量更高的搜索可显著降低代理总体成本,为 AI 代理选型提供决策依据。
参考来源:
- https://the-decoder.com/new-benchmark-ranks-search-apis-for-ai-agents-on-quality-cost-and-speed/
- https://artificialanalysis.ai/methodology/search-api
- https://artificialanalysis.ai/models/search-api
- https://artificialanalysis.ai/
- https://stirrup.artificialanalysis.ai/









