Outtake基于Claude构建网络调查Agent
译文 AI 逐段翻译
Outtake如何在Claude上构建网络调查员
Outtake如何确保多小时的代理会话保持在轨道上以揭露攻击网络操作
- 类别代理Claude Code
- 产品Claude CodeClaude平台
- 日期2026年7月22日
- 阅读时间5分钟
- 分享复制链接https://claude.com/blog/how-outtake-built-a-cyber-investigator-on-claude
在我们的系列中,初创公司如何用Claude构建,我们重点介绍初创公司如何利用AI转变其行业。在本文中,我们分享Outtake如何构建一个自主网络调查员,用于检测、调查和瓦解数字威胁,从克隆的登录页面到整个对抗性网络。
| 快速简介 | |
|---|---|
| 名称 | Outtake |
| 成立时间 | 2023年 |
| 创始人 | Alex Dhillon(首席执行官),曾任职于Palantir的登月团队 |
| 增长 | 年度经常性收入增长了6倍,客户群同比增长超过10倍,仅2025年就扫描了超过2000万次潜在的网络攻击。 |
即使有强大的保障和控制措施,恶意行为者也可能掩盖他们对AI的使用,使其看似良性目的却隐藏恶意意图。代码生成平台可以创建令人信服的登录门户,代理驱动的市场化工具可以为钓鱼攻击的传播提供动力,图像生成能力可以伪造身份。传统的网络安全防御难以跟上。
“如果戴上恶意行为者的帽子,现在实际上是发动攻击的好时机,”AI网络安全平台Outtake的创始人兼首席执行官Alex Dhillon说。“平均攻击不仅因为AI而执行得更快,而且还因为AI而获得了更深的访问权限”
Outtake将完整的数字信任攻击链统一为单一防御,使用AI代理群自主检测、调查和瓦解针对其客户的威胁,这些客户包括领先的AI实验室、主要对冲基金和美国联邦机构。
以下是Outtake团队最近如何使用Claude上的Claude Code和Agent SDK构建Recon Agent(一个长期运行的自主网络调查员)的过程。
代理性进攻需要代理性防御
当针对一家公司时,攻击者通常会经历相同的过程:将公共数据武器化 → 构建冒充作为诱饵 → 利用内部系统。这一过程已被AI加速。
在入侵任何系统之前,他们会收集有关组织及其高管和员工的公开可用信息。
然后,他们将情报转化为诱饵,比如带有欺诈性登录页面的虚假网站,以诱使受害者交出凭据。这些诱饵获得的访问权限帮助攻击者进入边界,到达组织最有价值和最敏感的资产。
这个三部分序列是可预测的,但传统安全工具只一次保护一个部分:
- 威胁情报工具监控公共数据阶段,
- 品牌保护工具监控冒充行为,以及
- 端点工具保护内部系统。
Outtake的Recon Agent调查冒充行为背后的整个网络。例如,不只是拆除克隆的登录页面,代理还会从冒充事件中收集和分类证据。
它会跟随线索到连接的设施,比如一个自称“客户支持”的虚假Telegram账户,并在图中映射这个对抗性网络。代理的最后一步生成一份报告,解释调查过程、威胁行为者的画像,以及攻击者所做的事情的重建时间线。
为了执行这个复杂的工作流,Recon Agent可以读取、编写和运行代码。它甚至可以直接与恶意登录页面交互,看看被盗的凭据实际去了哪里。
这些调查可能要求代理长时间自主运行。代理会话的中位时间为16分钟,但通常延长到一个小时以上;迄今为止最长的一次运行持续了两个小时的代理工作才返回结果。
未找到项目。
0/5
获取Claude Code
或阅读文档
尝试Claude Code
开发人员文档
电子书
Outtake如何使用Claude构建复杂的长时运行代理
Outtake大约分四个阶段构建了Recon Agent。每个阶段都关于理解什么是一次好的调查,然后逐步将该判断交给代理。

步骤1:先成为专家。
在构建代理的任何部分之前,Outtake的工程师自己进行了真实的网络调查,并从客户和设计合作伙伴那里获取了领域专业知识。
目标是定义“好”的样子。对于这些类型的调查,这意味着识别哪些证据重要,如何组织它们,以及什么将可操作的结论与猜测区分开来。该标准成为他们在每个后续阶段都返回的固定参考点。
“构建长期运行的代理最重要的事情是,你真的必须理解好的样子是什么样的? 代理应该做什么?”Outtake代理平台的工程负责人Jack Hayford说。“因为最终你要确保代理每次都能做到。”
步骤2:在Claude Code中制作原型
最初,Outtake团队使用传统的代理框架来逐步自动化他们正在标准化的调查。
然而,他们很快意识到,Recon Agent不能只是一个简单的调查员。它需要编写、运行代码,即时构建工具,并实际与恶意域名交互。
“每次调查都不同,并且技术性很强,”Hayford说。“代理需要编码能力和技能,而Claude Code是我们在实际验证这些假设并开始更多实验的强初始工具。” 正是在Claude Code中制作原型,他们锻造了他们的核心设计原则:在编排层面严格约束代理(“调查域名时总是做X、Y、Z”),但在需要判断时让它自由即兴发挥。
步骤3:升级到生产级工具
“我们真的很喜欢Claude Code引入的模式,但我们需要更底层原语(primitives)的额外访问权限,而我们并不打算自己构建这些,”Hayford说。
使用Claude Agent SDK是将Recon Agent投入生产的自然下一步。继承Claude Code的技能和模式确保了团队在获得对Recon Agent的记忆、上下文和文件系统的更严格控制时不会降低速度,同时无需在代理循环和处理会话方面重新发明轮子。
第4步:构建由评估驱动的紧密迭代循环。
在网络安全领域,低成本、快速响应的迭代能力尤为关键,因为攻击者一旦发现防御工具存在就会立即适应。团队从一开始就整合了代理评估,并构建了一套强大的评估套件,可以同时运行许多场景。这让他们能够安全、自信地进行大规模更改,如模型升级和完整记忆系统重构。
这也让团队得以从代理循环中抽身。例如,当Recon Agent完成一项调查并报告说如果拥有某个工具本可以做得更好时,一个单独的编码代理会读取这些建议,编写新工具,并构建一个测试场景来试用它。
只有在最后才需要人工介入检查结果:代理用了那个工具是否真的做得更好?“我们是瓶颈,当你构建这些长期运行的复杂代理时,反馈循环的自动化非常重要。这样更快,也让开发者更有成就感,”Hayford说。
构建长期运行代理的经验教训
在代理发展的早期,开发者会用硬编码的、确定性的、逐步的路径预先脚本化代理行为,以防止它失控。现在,复杂的工作流程正被一种“外在环境”(harness)取代:一种由记忆、工具、技能和护栏组成的支持性环境。
以下是Outtake团队在实施Recon Agents构建过程中的一些心得。
工具:文件系统和bash就足够了
文件系统启用能够在压缩(compaction)后存活的记忆。代理通常被给予非常具体而精细的工具,但给代理一个文件系统以及写入、读取和运行代码的能力,有助于代理应对障碍。
“将这些极其强大的开放式工具和能力交给代理是一个巨大的飞跃。我们观察到很多情况,代理使用某个工具时因网络抖动或其他原因失败,它就能找到合适的变通方法并继续前进,”Hayford说。“因为我们构建的其余外在环境足够强大,并且它留给代理用这些强大的开放式工具进行即兴发挥的机会,它仍然能够取得成功的最终结果。”
提示是建议
提示(prompts)在需要时提供灵活性,但在可能的地方硬编码能确保稳定性。“当你构建这些长期运行的代理,它们会随着时间变得复杂,提示只是建议,”Hayford说。“当代理没有做你想要的事情时,自然的反应是给代理最可塑的部分添加内容。在系统提示中塞入‘当X发生时,确保你做Y’可能最初有效,但随着代理运行时间增长,提示中的每一个词最终都可能会被忽略。” 正确的方法是通过识别代理每次都应该做什么,并将其作为代理护栏的一部分来围绕这种可能性进行构建。“把这些东西从提示中拿出来,放到外在环境中,”他说。“现在代理不再需要考虑它们,它有更多的上下文空间和注意力投入到它真正擅长的领域。”
了解更多关于指导Claude的最佳实践,以及每种方法的上下文成本和权威性。
评估是为了速度,而不仅仅是可靠性
使用手动“反思”作为路线图,转向自动化评估,以缩短开发周期。 传统观点认为评估是可靠性的质量门。但对于长期运行的代理,更大的回报是速度。
早期,每次Recon Agent运行时,团队都会对其性能进行手动审查。但阅读代理30分钟所做的一切记录既苛刻又不可扩展。
“在现代化代理开发中,评估输出是循环中最昂贵的步骤,”Jack说。
评估只是反思的结构化、评分化、可自动化的版本。一旦你将优秀的样貌编码为可重复的检查,你就可以让一个代理担任评委,阅读30分钟的记录并为运行评分。
“我认为一些工程师对构建评估感到担忧,因为这是构建完美案例的想法,”Jack说。“从一开始就构建某种版本的评估,无论它们多么官方或‘完美',都会让你更快地构建代理。”
保护你的代理
提示注入(Prompt injection)是一个真实威胁,因此将代理放入沙箱或给它盔甲至关重要。Outtake团队选择Claude部分是因为它在对抗提示注入方面的强度。
“安全是我们构建Recon Agent的一个重要问题,”Hayford说。“我们给了它文件系统和bash,并将其发送到对抗性环境,所以我们必须解决的最重要问题是构建一种‘爆炸箱’(blastbox),你可以在不真正妨碍代理的情况下尝试将代理隐藏在敏感内部之外。”
他们的方法假设代理可能被劫持,因此周围系统被设计来遏制损害。然而,安全因代理的目的而异,并非所有代理都是爆炸箱的候选。
Outtake 现在在代理接触互联网的确切位置对信任级别进行评分,实施一个检查点,评估代理即将接触的任何内容:‘这个页面是冒名顶替的吗?是恶意软件吗?它现在是否试图对代理进行提示注入?’当代理穿越日益充满敌意的互联网时,这可能正是它们需要的护甲。
| Outtake 团队的最佳实践 | |
|---|---|
| 你知道“优秀”是什么样子吗? | 首先成为代理。自己运行真实任务,并从客户和设计伙伴那里获取领域专业知识,这样你就有固定的标准来对照每一个后续迭代。 |
| 每一处复杂性是否都值得? | 找到最简单的可用版本,并逐步自动化。只有在结果证明有必要时才增加复杂性——这与传统软件的纪律相同。 |
| 你的编排框架是否与工作负载匹配? | 在 Claude Code 中快速验证假设,然后在需要对内存、上下文和会话进行更细粒度控制时,升级到 Agent SDK。不要自己重建代理循环。 |
| 代理应该在哪里受到约束? | 在编排层硬编码护栏,但不要让这些约束影响到低层的判断。即兴发挥的空间是产生最佳结果的地方。 |
接下来是什么
Recon Agent 现已上线并正在运行调查。如果你想更深入地了解 Outtake 如何使用 Claude 大规模映射敌对基础设施:
- 观看完整网络研讨会,观看现场演示,并深入讨论 Outtake 如何使用 Claude 自主调查和映射大规模威胁基础设施。
- 查看 Recon Agent 的实际运行。探索代理如何从单个冒名顶替者发展到完整的威胁行为者画像。
- 获取免费的 Recon Agent 评估,看看调查能在你自己的暴露面上发现什么。
常见问题
未找到项目。
相关文章
探索更多产品新闻和适合使用 Claude 构建的团队的最佳实践。
2026 年 8 月 7 日
自动模式现已成为 Claude Code 中 Pro、Max 和 Team 计划的默认模式
Claude Code
自动模式现已成为 Claude Code 中 Pro、Max 和 Team 计划的默认模式
自动模式现已成为 Claude Code 中 Pro、Max 和 Team 计划的默认模式
2026 年 8 月 7 日
在生产中运行自动模式
Claude Code
2026 年 8 月 6 日
Millennium 和 Anthropic 正在使用 Claude 构建数字风险分析师
企业 AI
Millennium 和 Anthropic 正在使用 Claude 构建数字风险分析师
Millennium 和 Anthropic 正在使用 Claude 构建数字风险分析师
2026 年 7 月 24 日
Claude 模型详解:选择最适合您用例的模型
企业 AI
使用 Claude 改变您组织的运营方式
查看定价
联系销售
获取开发者通讯
产品更新、操作指南、社区亮点等。每月发送到您的邮箱。
谢谢!您已订阅。
抱歉,您的提交出现问题,请稍后重试。