最长运行两小时的网络调查 Agent,怎样避免在恶意页面里跑偏

发布时间:2026/9/15 11:03:31

最长运行两小时的网络调查 Agent,怎样避免在恶意页面里跑偏 工程上的答案长时间调查 Agent 不能只靠更大的上下文窗口。先定义证据、图谱、时间线和停止条件再把状态写入可恢复文件系统固定动作由 harness 强制未知页面和工具故障才留给模型判断。质量 eval 与安全 eval 还要分开通过。先定义调查产物再决定 Agent 能用哪些工具Claude 官方在 2026 年 7 月 22 日发布 Outtake 的 Recon Agent 案例。Outtake 用 Claude Code 和 Claude Agent SDK 构建长时间运行的网络调查 Agent从仿冒登录页出发收集和分类证据继续追踪关联域名、账号与基础设施形成攻击网络图最后输出调查过程、威胁主体画像和时间线。官方披露Outtake 的 Agent 会话中位数为 16 分钟常常持续一小时以上最长一次运行了两小时。长会话的问题不只在上下文长度而在每一步新线索都会改变后续方向。若“调查完成”没有固定定义Agent 可能不断探索也可能过早停在一个仿冒页面上。Outtake 的第一步不是写 Agent而是工程师亲自完成真实调查并从客户和设计伙伴那里整理领域经验定义什么证据有价值、怎样组织、可行动结论与猜测有何区别。这套标准成为后续原型、评测和生产迭代的固定参照。工程实现时可以先定义交付 schema初始事件、证据节点、关联边、来源与抓取时间、可信级别、未验证假设、时间线和建议动作。Agent 每发现一个新对象就写入文件系统中的结构化记录压缩上下文或重启会话后调查状态仍可恢复。图谱去重不能只依赖名称。域名、证书、IP、账号和页面模板的关系需要分别保存关联边带上证据类型和可信状态。相同字符串可能属于不同主体同一攻击者也可能频繁更换基础设施grader 应检查是否存在无证据合并而不是奖励节点越多越好。停止条件可以写成状态机主要线索已覆盖且新增证据价值下降时生成报告需要主动提交表单、接触敏感数据、风险评分超过阈值或预算耗尽时暂停证据冲突则进入人工复核。这样“继续调查”是可解释决定而不是 Agent 只要还能找到链接就一直运行。检查点可以采用追加写而不是反复覆盖。每一阶段保存任务版本、当前目标、已确认节点、新增关联、待验证假设、工具错误和下一步恢复时先校验快照哈希再从最后一个完整阶段继续。这样既能回放错误路径也能避免损坏文件让 Agent 带着不完整状态重新运行。证据节点与模型判断要分开存储。网页内容、请求时间和页面哈希属于原始证据实体归属与攻击者画像属于分析。后续模型升级时可以重算分析而不改变原始记录也能看出结果差异来自证据变化还是判断变化。orchestration 写死步骤判断空间留给 AgentOuttake 先在 Claude Code 中验证假设再转向 Agent SDK以便更细控制 memory、context 和 filesystem。团队形成的原则是在编排层强制每次调查都执行的动作例如保存证据、更新图谱、检查停止条件遇到新页面、失效工具或未知基础设施时允许 Agent 自己写代码和选择路径。官方文章提到文件系统加 bash 让 Agent 在工具遇到网络故障时寻找替代办法继续工作。开放能力也带来风险。允许读写文件和执行代码不代表可以接触内部密钥、任意网络或生产系统。工具适配器应限定目录、网络出口、进程资源和运行时间每次访问恶意页面前经过风险检查点。模型选择可以在 147AI 中用脱敏调查图、静态页面快照和固定线索集进行对照记录证据遗漏、错误关联、修订轮次、用量和人工评分。真实恶意域名、客户暴露面、Claude Agent SDK 会话和处置权限仍留在隔离调查系统。稳定规则不要只写在 system prompt。Outtake 的经验是长时间 Agent 可能忽略提示中的某些词必须每次执行的要求应进入 harness证据落盘、来源标记、禁止提交真实凭据、达到风险阈值后暂停以及向外部页面发送数据前的检查。Prompt 留给需要判断的空间硬边界由系统执行。错误类型同样进入 harness。临时网络失败允许有限重试和替代工具策略拒绝、未批准目标和敏感信息请求只能生成待处理事项。若所有失败都返回同一错误Agent 可能把安全边界误认为普通技术障碍并继续寻找绕过路径。每次运行绑定模型、harness、工具、策略和页面快照版本。实时网页持续变化事故后只重新访问目标无法证明旧问题保留原输入和状态才能复现提示注入、错误关联或工具行为。出站请求应经过独立代理。代理不仅判断域名能否访问还检查请求方法、payload 和当前任务身份。普通公开页面可以只读获取表单提交、文件上传、携带客户标识或访问新目标时默认暂停并等待批准。Agent 看到的是策略结果没有权限修改白名单。命令执行也需要产物清单。脚本读取了哪些文件、创建了哪些临时工具、产生哪些网络请求都与当前检查点绑定。任务结束后临时程序不会自动进入共享工具层要复用必须补齐测试、负责人和权限审查。评测要缩短开发循环也要验证隔离边界早期每次运行后工程师人工阅读约 30 分钟的完整轨迹成本很高。Outtake 将这些人工 reflection 逐步写成自动 eval让 grader Agent 根据固定标准检查调查是否完整、证据是否支持结论、图谱是否错误合并、停止点是否合理。模型升级和 memory 重构时多场景并行回归能更快暴露变化。评测还驱动工具改进。Recon Agent 会报告自己缺少什么工具另一个 coding Agent 读取建议、编写工具并建立测试场景最后由人判断新工具是否让调查更好。这个链条必须限制自动发布工具先在固定样本和沙箱中运行检查权限、输入输出和失败路径再决定是否进入调查 harness。安全边界采用“可能被劫持”的假设。Outtake 构建 blastbox将 Agent 与敏感内部信息隔离并在它接触互联网的具体节点评估页面是否仿冒、包含恶意代码或试图提示注入。企业参考这套思路时可以再用网络白名单、短期身份、文件系统快照和工具日志限制并回放影响。新工具也不能从 Agent 建议直接进入生产。独立 coding 流程生成实现和测试先在历史页面与失败样本中运行检查权限、网络和状态写入再由人批准进入只读工具层。当前会话的临时脚本任务结束后自动归档。生产指标分成质量与控制两组。质量看证据覆盖、错误关联、报告采纳和人工修订控制看越界请求、风险拒绝、状态恢复和资源消耗。两组都通过才能扩大运行时间或网络范围。回归集至少包含顺利调查、工具超时、页面格式变化、无价值线索、错误关联和提示注入。grader 检查最终报告时还要读取命令、网络和文件轨迹确认固定步骤确实执行。只评最终文本可能让中途越界但最后写出正确报告的版本获得高分。上线可以分三段先使用静态页面与脱敏图谱验证 schema 和恢复再开放经过代理的受限互联网只读访问少量目标最后才增加运行时长和临时脚本能力。每段都设置回退条件出现证据丢失、无法解释的关联或越界请求就退回前一层。最小验收清单中断后能从检查点恢复每个结论能回到来源错误关联可被固定样本发现策略拒绝不会被当成工具故障重试人接管时不必重读完整轨迹新模型在质量和控制两套回归中都通过。最终验收不能只看是否找到更多域名。还要看每个结论能否回到证据错误关联能否被发现长会话中固定步骤是否执行恶意输入能否突破隔离以及人工是否能在高风险节点接管。长时间 Agent 的可靠性来自领域标准、可恢复状态、自动评测和硬边界共同作用。官方来源ClaudeHow Outtake built a cyber investigator on Claude发布于 2026-07-22。
延伸阅读

更多相关文章

2026/9/14 2:17:14

汽车底盘运维面试30问:大模型技术助力零基础备考

1. 项目背景与核心价值汽车底盘运维岗位的技术面试往往让零基础求职者望而生畏。作为车辆系统中最为复杂的机械-电子耦合系统,底盘涉及悬架、转向、制动、传动四大核心子系统,每个子系统又包含数十个关键部件。传统面试准备需要大量时间研读维修手册和技…

2026/9/14 20:03:27

深入解析ADS7851EVM-PDK:高精度SAR ADC评估与设计实践

1. 项目概述:深入解析ADS7851EVM-PDK评估套件在嵌入式系统、精密测量和工业自动化领域,将现实世界中的连续模拟信号(如温度、压力、振动)准确、快速地转换为数字世界能够处理的离散信号,是系统设计的核心挑战之一。模数…

2026/9/15 7:33:16

数字音乐观察:《不管你在哪》的搜索入口

先谈听感——咬字清楚,节奏不拖泥带水。正因如此,《不管你在哪》不像口号,更像一次靠得住的靠近,对总被说服、开始练习说不的人而言,入口很清楚——不是被教育,而是被准确叫到, 完整听完时&…

2026/9/15 11:02:21

Semantica evals模块详解:如何科学评估知识图谱构建质量

Semantica evals模块详解:如何科学评估知识图谱构建质量 【免费下载链接】semantica Graph-Native Infrastructure for Context and Accountable AI Systems 项目地址: https://gitcode.com/GitHub_Trending/sema/semantica 构建知识图谱最头疼的不是"建…

2026/9/15 11:02:21

理解有损与无损转换:Convert to it!无损标记系统完整指南

理解有损与无损转换:Convert to it!无损标记系统完整指南 【免费下载链接】convert Truly universal online file converter 项目地址: https://gitcode.com/GitHub_Trending/convert7/convert Convert to it! 是一款号称"真正通用"的免费在线文件…

2026/9/15 10:57:20

Houdini到UE程序化大地形管线:高度图、Mask与RVT实践指南

做大型开放世界或者策略类项目的人,估计都经历过这个阶段:地编在UE里用Landscape手刷地形,刷到吐血,回头策划说整个地图要改布局,或者原画说山体走向要翻个方向,然后一切重来。我作为项目里的技术美术&…

2026/9/15 4:54:30

拯救者Y7000黑屏故障排查与维修实战指南

1. 项目概述:一台黑屏的拯救者Y7000,到底卡在哪一步? 联想拯救者Y7000系列笔记本,从2018年第一代搭载i5-8300H开始,到后来的i7-9750H、i7-10750H、i5-11400H,再到2023年款的R7-7840HS,它始终是学…

2026/9/15 0:01:16

AI英语单词APP开发:自适应学习算法与移动端优化实践

1. 项目概述 作为一名在移动应用开发领域摸爬滚打多年的老手,我最近完成了一个AI英语单词APP的开发项目。这个项目将传统单词记忆方法与现代AI技术相结合,打造了一款能够智能适应不同用户学习习惯的英语学习工具。 市面上大多数单词APP都存在一个通病&a…

2026/9/15 0:01:16

Flutter与OpenHarmony结合开发手语学习APP实战

1. 项目背景与核心价值作为一名同时接触过Flutter和OpenHarmony的开发者,最近我完成了一个基于Flutter for OpenHarmony的手语学习APP实战项目。这个项目最大的特点在于实现了跨平台框架与国产操作系统深度结合的创新实践——用Flutter开发的应用能完美运行在OpenHa…

2026/9/15 0:01:16

六个月成为机器人工程师:从ROS2到SLAM的实战路径

1. 六个月的紧迫感从哪来:先搞清楚你要成为哪种机器人工程师说实话,六个月的期限并不是一个宽松的时间线。市面上任何一本正经的机器人学教材都超过五百页,ROS2的官方文档可以翻到你怀疑人生,再加上ABB、KUKA这些工业机器人厂家动…

2026/9/14 11:59:31

USB Type-C PCB布局分区设计:电源、高速信号与PD协议全攻略

做硬件这行,Type-C接口算是典型的“看着简单,做起来全坑”的东西。光引脚就24个,高低速信号、电源、控制线全部塞在一个小小的连接器里,如果PCB布局不做规划,打样回来基本就是“插上没反应”、“高速掉线”、“静电一打…

2026/9/14 13:53:59

系统编程学习原型如何补齐稳定性边界

系统编程学习原型如何补齐稳定性边界预算有限时&#xff0c;我先优化明显多余的复制&#xff0c;而不是猜测性地换容器。用借用传递只读数据通常就能减少分配&#xff1a; fn parse(line: &str) -> Result<Item, Error> { /* ... */ }用基准确认热点确实在分配&am…

2026/9/14 11:22:57

雨花区哪家财务公司代理记账比较好?

在雨花区&#xff0c;企业处理财税事务常常面临诸多挑战&#xff0c;选择一家靠谱的财务公司至关重要。湖南巨勤财务管理咨询有限公司就是本地正规实体财税服务机构&#xff0c;深耕本地工商财税行业多年&#xff0c;熟悉当地工商局、税务局最新政策与申报流程。主营公司注册、…

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
咨询二维码