返回
官网 Claude 官方博客 收录 2026-08-11 10:19 14

Outtake基于Claude构建网络调查Agent

Outtake使用Claude Code和Agent SDK构建了名为Recon Agent的自主网络调查Agent,用于检测、调查和瓦解数字威胁,包括克隆登录页面和整个对抗性网络。该公司2023年成立,2025年扫描超过2000万次潜在网络攻击,年经常性收入增长6倍。该Agent通过多小时会话保持追踪,以揭示攻击网络运营。
推荐理由:涉及AI Agent构建,但内容为网络安全调查场景,与数据垂直领域无关。
AnthropicClaude

译文 AI 逐段翻译

Outtake如何在Claude上构建网络调查员

Outtake如何确保多小时的代理会话保持在轨道上以揭露攻击网络操作

在我们的系列中,初创公司如何用Claude构建,我们重点介绍初创公司如何利用AI转变其行业。在本文中,我们分享Outtake如何构建一个自主网络调查员,用于检测、调查和瓦解数字威胁,从克隆的登录页面到整个对抗性网络。

快速简介
名称Outtake
成立时间2023年
创始人Alex Dhillon(首席执行官),曾任职于Palantir的登月团队
增长年度经常性收入增长了6倍,客户群同比增长超过10倍,仅2025年就扫描了超过2000万次潜在的网络攻击。

即使有强大的保障和控制措施,恶意行为者也可能掩盖他们对AI的使用,使其看似良性目的却隐藏恶意意图。代码生成平台可以创建令人信服的登录门户,代理驱动的市场化工具可以为钓鱼攻击的传播提供动力,图像生成能力可以伪造身份。传统的网络安全防御难以跟上。

“如果戴上恶意行为者的帽子,现在实际上是发动攻击的好时机,”AI网络安全平台Outtake的创始人兼首席执行官Alex Dhillon说。“平均攻击不仅因为AI而执行得更快,而且还因为AI而获得了更深的访问权限”

Outtake将完整的数字信任攻击链统一为单一防御,使用AI代理群自主检测、调查和瓦解针对其客户的威胁,这些客户包括领先的AI实验室、主要对冲基金和美国联邦机构。

以下是Outtake团队最近如何使用Claude上的Claude CodeAgent SDK构建Recon Agent(一个长期运行的自主网络调查员)的过程。

代理性进攻需要代理性防御

当针对一家公司时,攻击者通常会经历相同的过程:将公共数据武器化 → 构建冒充作为诱饵 → 利用内部系统。这一过程已被AI加速。

在入侵任何系统之前,他们会收集有关组织及其高管和员工的公开可用信息。

然后,他们将情报转化为诱饵,比如带有欺诈性登录页面的虚假网站,以诱使受害者交出凭据。这些诱饵获得的访问权限帮助攻击者进入边界,到达组织最有价值和最敏感的资产。

这个三部分序列是可预测的,但传统安全工具只一次保护一个部分:

  • 威胁情报工具监控公共数据阶段,
  • 品牌保护工具监控冒充行为,以及
  • 端点工具保护内部系统。

Outtake的Recon Agent调查冒充行为背后的整个网络。例如,不只是拆除克隆的登录页面,代理还会从冒充事件中收集和分类证据。

它会跟随线索到连接的设施,比如一个自称“客户支持”的虚假Telegram账户,并在图中映射这个对抗性网络。代理的最后一步生成一份报告,解释调查过程、威胁行为者的画像,以及攻击者所做的事情的重建时间线。

为了执行这个复杂的工作流,Recon Agent可以读取、编写和运行代码。它甚至可以直接与恶意登录页面交互,看看被盗的凭据实际去了哪里。

这些调查可能要求代理长时间自主运行。代理会话的中位时间为16分钟,但通常延长到一个小时以上;迄今为止最长的一次运行持续了两个小时的代理工作才返回结果。

未找到项目。

上一页

0/5

下一页

获取Claude Code

或阅读文档

尝试Claude Code

尝试Claude Code

开发人员文档

开发人员文档

电子书

Outtake如何使用Claude构建复杂的长时运行代理

Outtake大约分四个阶段构建了Recon Agent。每个阶段都关于理解什么是一次好的调查,然后逐步将该判断交给代理。

步骤1:先成为专家。

在构建代理的任何部分之前,Outtake的工程师自己进行了真实的网络调查,并从客户和设计合作伙伴那里获取了领域专业知识。

目标是定义“好”的样子。对于这些类型的调查,这意味着识别哪些证据重要,如何组织它们,以及什么将可操作的结论与猜测区分开来。该标准成为他们在每个后续阶段都返回的固定参考点。

“构建长期运行的代理最重要的事情是,你真的必须理解好的样子是什么样的? 代理应该做什么?”Outtake代理平台的工程负责人Jack Hayford说。“因为最终你要确保代理每次都能做到。”

步骤2:在Claude Code中制作原型

最初,Outtake团队使用传统的代理框架来逐步自动化他们正在标准化的调查。

然而,他们很快意识到,Recon Agent不能只是一个简单的调查员。它需要编写、运行代码,即时构建工具,并实际与恶意域名交互。

“每次调查都不同,并且技术性很强,”Hayford说。“代理需要编码能力和技能,而Claude Code是我们在实际验证这些假设并开始更多实验的强初始工具。” 正是在Claude Code中制作原型,他们锻造了他们的核心设计原则:在编排层面严格约束代理(“调查域名时总是做X、Y、Z”),但在需要判断时让它自由即兴发挥。

步骤3:升级到生产级工具

“我们真的很喜欢Claude Code引入的模式,但我们需要更底层原语(primitives)的额外访问权限,而我们并不打算自己构建这些,”Hayford说。

使用Claude Agent SDK是将Recon Agent投入生产的自然下一步。继承Claude Code的技能和模式确保了团队在获得对Recon Agent的记忆、上下文和文件系统的更严格控制时不会降低速度,同时无需在代理循环和处理会话方面重新发明轮子。

第4步:构建由评估驱动的紧密迭代循环。

在网络安全领域,低成本、快速响应的迭代能力尤为关键,因为攻击者一旦发现防御工具存在就会立即适应。团队从一开始就整合了代理评估,并构建了一套强大的评估套件,可以同时运行许多场景。这让他们能够安全、自信地进行大规模更改,如模型升级和完整记忆系统重构。

这也让团队得以从代理循环中抽身。例如,当Recon Agent完成一项调查并报告说如果拥有某个工具本可以做得更好时,一个单独的编码代理会读取这些建议,编写新工具,并构建一个测试场景来试用它。

只有在最后才需要人工介入检查结果:代理用了那个工具是否真的做得更好?“我们是瓶颈,当你构建这些长期运行的复杂代理时,反馈循环的自动化非常重要。这样更快,也让开发者更有成就感,”Hayford说。

构建长期运行代理的经验教训

在代理发展的早期,开发者会用硬编码的、确定性的、逐步的路径预先脚本化代理行为,以防止它失控。现在,复杂的工作流程正被一种“外在环境”(harness)取代:一种由记忆、工具、技能和护栏组成的支持性环境。

以下是Outtake团队在实施Recon Agents构建过程中的一些心得。

工具:文件系统和bash就足够了

文件系统启用能够在压缩(compaction)后存活的记忆。代理通常被给予非常具体而精细的工具,但给代理一个文件系统以及写入、读取和运行代码的能力,有助于代理应对障碍。

“将这些极其强大的开放式工具和能力交给代理是一个巨大的飞跃。我们观察到很多情况,代理使用某个工具时因网络抖动或其他原因失败,它就能找到合适的变通方法并继续前进,”Hayford说。“因为我们构建的其余外在环境足够强大,并且它留给代理用这些强大的开放式工具进行即兴发挥的机会,它仍然能够取得成功的最终结果。”

提示是建议

提示(prompts)在需要时提供灵活性,但在可能的地方硬编码能确保稳定性。“当你构建这些长期运行的代理,它们会随着时间变得复杂,提示只是建议,”Hayford说。“当代理没有做你想要的事情时,自然的反应是给代理最可塑的部分添加内容。在系统提示中塞入‘当X发生时,确保你做Y’可能最初有效,但随着代理运行时间增长,提示中的每一个词最终都可能会被忽略。” 正确的方法是通过识别代理每次都应该做什么,并将其作为代理护栏的一部分来围绕这种可能性进行构建。“把这些东西从提示中拿出来,放到外在环境中,”他说。“现在代理不再需要考虑它们,它有更多的上下文空间和注意力投入到它真正擅长的领域。”

了解更多关于指导Claude的最佳实践,以及每种方法的上下文成本和权威性。

评估是为了速度,而不仅仅是可靠性

使用手动“反思”作为路线图,转向自动化评估,以缩短开发周期。 传统观点认为评估是可靠性的质量门。但对于长期运行的代理,更大的回报是速度。

早期,每次Recon Agent运行时,团队都会对其性能进行手动审查。但阅读代理30分钟所做的一切记录既苛刻又不可扩展。

“在现代化代理开发中,评估输出是循环中最昂贵的步骤,”Jack说。

评估只是反思的结构化、评分化、可自动化的版本。一旦你将优秀的样貌编码为可重复的检查,你就可以让一个代理担任评委,阅读30分钟的记录并为运行评分。

“我认为一些工程师对构建评估感到担忧,因为这是构建完美案例的想法,”Jack说。“从一开始就构建某种版本的评估,无论它们多么官方或‘完美',都会让你更快地构建代理。”

保护你的代理

提示注入(Prompt injection)是一个真实威胁,因此将代理放入沙箱或给它盔甲至关重要。Outtake团队选择Claude部分是因为它在对抗提示注入方面的强度。

“安全是我们构建Recon Agent的一个重要问题,”Hayford说。“我们给了它文件系统和bash,并将其发送到对抗性环境,所以我们必须解决的最重要问题是构建一种‘爆炸箱’(blastbox),你可以在不真正妨碍代理的情况下尝试将代理隐藏在敏感内部之外。”

他们的方法假设代理可能被劫持,因此周围系统被设计来遏制损害。然而,安全因代理的目的而异,并非所有代理都是爆炸箱的候选。

Outtake 现在在代理接触互联网的确切位置对信任级别进行评分,实施一个检查点,评估代理即将接触的任何内容:‘这个页面是冒名顶替的吗?是恶意软件吗?它现在是否试图对代理进行提示注入?’当代理穿越日益充满敌意的互联网时,这可能正是它们需要的护甲。

Outtake 团队的最佳实践
你知道“优秀”是什么样子吗?首先成为代理。自己运行真实任务,并从客户和设计伙伴那里获取领域专业知识,这样你就有固定的标准来对照每一个后续迭代。
每一处复杂性是否都值得?找到最简单的可用版本,并逐步自动化。只有在结果证明有必要时才增加复杂性——这与传统软件的纪律相同。
你的编排框架是否与工作负载匹配?在 Claude Code 中快速验证假设,然后在需要对内存、上下文和会话进行更细粒度控制时,升级到 Agent SDK。不要自己重建代理循环。
代理应该在哪里受到约束?在编排层硬编码护栏,但不要让这些约束影响到低层的判断。即兴发挥的空间是产生最佳结果的地方。

接下来是什么

Recon Agent 现已上线并正在运行调查。如果你想更深入地了解 Outtake 如何使用 Claude 大规模映射敌对基础设施:

常见问题

未找到项目。

相关文章

探索更多产品新闻和适合使用 Claude 构建的团队的最佳实践。

2026 年 8 月 7 日

自动模式现已成为 Claude Code 中 Pro、Max 和 Team 计划的默认模式

Claude Code

自动模式现已成为 Claude Code 中 Pro、Max 和 Team 计划的默认模式

自动模式现已成为 Claude Code 中 Pro、Max 和 Team 计划的默认模式

2026 年 8 月 7 日

在生产中运行自动模式

Claude Code

在生产中运行自动模式

在生产中运行自动模式

2026 年 8 月 6 日

Millennium 和 Anthropic 正在使用 Claude 构建数字风险分析师

企业 AI

Millennium 和 Anthropic 正在使用 Claude 构建数字风险分析师

Millennium 和 Anthropic 正在使用 Claude 构建数字风险分析师

2026 年 7 月 24 日

Claude 模型详解:选择最适合您用例的模型

企业 AI

Claude 模型详解:选择最适合您用例的模型

Claude 模型详解:选择最适合您用例的模型

使用 Claude 改变您组织的运营方式

查看定价

查看定价

联系销售

联系销售

获取开发者通讯

产品更新、操作指南、社区亮点等。每月发送到您的邮箱。

谢谢!您已订阅。

抱歉,您的提交出现问题,请稍后重试。

分享这条资讯
分享海报
保存图片
iOS 也可以长按图片保存