Claude动态过滤提升网络搜索准确性与效率
译文 AI 逐段翻译
通过动态过滤提高网络搜索的准确性和效率
动态过滤使Claude在复杂的网络搜索任务中更加准确和高效。以下是其工作原理以及如何在API上启用它。
- 类别产品公告
- 产品Claude平台
- 日期2026年2月17日
- 阅读时间5分钟
- 分享复制链接https://claude.com/blog/improved-web-search-with-dynamic-filtering
与Claude Opus 4.6 和 Sonnet 4.6一起,我们发布了新版本的网络搜索 和 网页获取工具。Claude现在可以在网络搜索期间原生编写和执行代码,在结果进入上下文窗口之前进行过滤,从而提高其准确性和令牌效率。
使用动态过滤的网络搜索
网络搜索是一项高度令牌密集的任务。使用基本网络搜索工具的代理需要进行查询、将搜索结果拉入上下文、从多个网站获取完整HTML文件,并在响应前对其全部进行推理。但是从搜索中拉入的上下文通常是不相关的,这会降低响应的质量。为了提高Claude在搜索网络时的性能,我们的网络搜索和网页获取工具现在自动编写和执行代码来后处理查询结果。Claude不是对完整的HTML文件进行推理,而是可以在将搜索结果加载到上下文之前动态过滤它们,只保留相关的内容并丢弃其余部分。我们已经先前发现 这种技术在其他代理工作流程中有效,并且我们在API中添加了诸如代码执行 和 程序化工具调用等工具。现在我们将这些技术应用于网络搜索和网页获取。
评估Claude搜索网络的能力
我们在Sonnet 4.6和Opus 4.6上评估了网络搜索,启用了和不启用动态过滤,并且没有其他工具。在两个基准测试中,BrowseComp 和 DeepsearchQA,动态过滤平均提高了11%的性能,同时使用了24%更少的输入令牌。 BrowseComp:搜索网络以找到一个答案
BrowseComp测试代理是否能够浏览许多网站以找到特定信息,这些信息是有意难以在线找到的。动态过滤显著提高了Claude的准确性,使Sonnet 4.6从33.3%提升到46.6%,Opus 4.6从45.3%提升到61.6%。
DeepsearchQA:搜索网络以找到许多答案
DeepsearchQA向代理提出具有多个正确答案的研究查询,所有这些都必须通过网络搜索找到。它测试代理是否能够系统地计划并执行多步搜索而不错过任何答案。它通过“F1分数”来衡量,该分数平衡了精确度和召回率——同时捕捉返回答案的准确性和搜索的完整性。
动态过滤将Sonnet 4.6的F1分数从52.6%提高到59.4%,对于Opus 4.6则从69.8%提高到77.3%。
令牌成本将根据模型需要编写多少代码来过滤上下文而有所不同。在Sonnet 4.6上,价格加权的令牌在两个基准测试中均减少,但在Opus 4.6上增加。为了更好地了解您自己的成本,我们建议使用您的代理在生产环境中可能遇到的一组代表性网络搜索查询来评估此工具。
客户焦点:Quora
Poe 由 Quora 是最大的多模型AI平台之一,通过单一界面为数百万用户提供对200多个模型的访问。Quora的内部团队发现,使用动态过滤的Opus 4.6“在我们的内部评估中与其他前沿模型测试时获得了最高的准确性,”产品和研究负责人Gareth Jones说。“该模型的行为类似于真正的研究者,编写Python来解析、过滤和交叉引用结果,而不是在上下文中对原始HTML进行推理。”
网络搜索和获取工具中的动态过滤
使用Sonnet 4.6使用我们的新网络搜索和网页获取工具时,动态过滤将默认开启, 并且在Claude API上使用Opus 4.6。对于复杂的网络搜索查询,例如筛选技术文档或验证引用,您可以期望获得类似上述的性能改进。
以下是如何在API中使用它:
{
"model": "claude-opus-4-6",
"max_tokens": 4096,
"tools": [
{
"type": "web_search_20260209",
"name": "web_search" },
{
"type": "web_fetch_20260209",
"name": "web_fetch" }
],
"messages": [
{
"role": "user",
"content": "Search for the current prices of AAPL and GOOGL, then calculate which has a better P/E ratio." }
]
}
代码执行、内存和更多工具现已正式可用
我们还升级了几个工具到正式可用,以帮助代理在令牌密集型任务上表现更好:
- 代码执行: 提供一个沙箱,供代理在对话期间运行代码,以过滤上下文、分析数据或执行计算。
- 内存:通过持久文件目录在对话之间存储和检索信息,使代理能够保留上下文,而无需将所有内容保存在上下文窗口中。
- 程序化工具调用: 在代码中执行复杂的多工具工作流程,将中间结果排除在上下文窗口之外。
- 工具搜索: 在不将所有定义加载到上下文窗口的情况下,从大型库中动态发现工具。
- 工具使用示例:在工具定义中直接提供示例工具调用,以演示使用模式并减少参数错误。
开始使用
改进的网络搜索和网页获取——以及代码执行、内存、程序化工具调用、工具搜索和工具使用示例——现已在Claude平台上提供。阅读我们的API文档 以开始使用。
未找到项目。
0/5
电子书
常见问题
未找到项目。
相关文章
探索更多产品新闻和与Claude构建的团队最佳实践。
2026年8月11日
合规API覆盖扩展到Claude Cowork和Claude Code
企业AI
合规API覆盖扩展到Claude Cowork和Claude Code
合规API覆盖扩展到Claude Cowork和Claude Code
2026年8月5日
推理钩子:Claude Enterprise的内联数据丢失防护
企业AI
推理钩子:Claude Enterprise的内联数据丢失防护
推理钩子:Claude Enterprise的内联数据丢失防护
2026年8月6日
在您自己的计算资源上运行Claude Code会话
产品公告
2026年7月28日
将MCP 2026-07-28引入Claude
产品公告
通过 Claude 转变您组织的运营方式
查看定价
联系销售
获取开发者通讯
产品更新、操作指南、社区亮点等。每月发送至您的收件箱。
谢谢!您已订阅。
抱歉,您的提交出现问题,请稍后重试。