如何防止AI“编造漏洞“?security-audit-skill候选门槛7条规则解读

发布时间:2026/9/20 20:46:47

如何防止AI“编造漏洞“?security-audit-skill候选门槛7条规则解读 如何防止AI编造漏洞security-audit-skill候选门槛7条规则解读【免费下载链接】security-audit-skillA coding-agent skill for multi-phase security audits with independently verified, machine-readable findings项目地址: https://gitcode.com/GitHub_Trending/se/security-audit-skill用AI做安全审计最让人头疼的往往不是找不到漏洞而是AI编造漏洞——把想象写成结论。security-audit-skill 是一个让编程 Agent 变身安全审计员的开源技能包它将多阶段审计流程固化成可执行的规则其中 HUNTING.md 里写死的候选门槛Candidate gate7条规则正是压制AI幻觉误报的核心防线。本文逐条拆解它们如何拦截编造。为什么AI安全审计容易误报AI审计员的幻觉通常有四种惯犯把检查清单偏差直接当漏洞没用加密算法X把影响夸大一个崩溃说成代码执行看不见就编猜测部署环境、代理、云配置的行为把加固建议包装成低危漏洞凑数。这些都不是猜测而是项目作者在 SKILL.md Anti-patterns 一节中列出的 10 种反模式——等于把AI最容易犯的错写成了明牌。候选门槛7条规则就是冲着这几种错设计的。候选门槛7条规则一览这7条规则位于 HUNTING.md 的 Candidate gate 小节会被逐字复制进每一个猎手Agent的提示词中任何候选漏洞必须全部通过才能进入后续验证#规则一句话解读针对的幻觉1完整源码溯源 证据必须给出仓库内的完整调用链并附最强的源码可见控制无据下结论2confirmed 需有界本地观测结果有真实边界跨越的影响、完整条件、且无可见防护层纸上谈兵3禁止夸大影响崩溃≠代码执行、普通工作≠共享可用性、同主体≠越权影响通胀4看不见就用 needs_validation缺失事实要指名道姓禁止猜部署、禁止给严重度瞎猜环境5缺失最佳实践≠漏洞没有受影响主体/资源的只能算加固建议被源码反驳的直接 rejected凑数式低危6指纹稳定唯一同一根因在所有状态下共用一个 fingerprint重复报新漏洞7过不了就返回空数组没找到是合法结果强迫凑数规则1漏洞必须自带完整溯源证据候选不能只是一句这里可能有问题必须包含一条仓库相对路径的完整 trace以entrypoint入口开始、sink汇聚点结束中间用propagation标注每个断言都有file:line级证据还要附最强的源码可见控制——也就是你尽力找过防护的证据防止挑完路径就下结论。这套 trace/evidence 结构由 report-schema.json 严格约束additionalProperties: false多一个字段都不收。规则2confirmed 是全场最硬的坎想要打上confirmed标签必须同时满足有界本地观测结果在沙箱里真实跑出的最小结果而不是理论上会有意义的跨边界影响说清楚哪个低信任主体越过了哪条边界完整条件无可见防护层。SKILL.md 还规定只有confirmed才能配严重度且总体严重度不得高于已证明的影响——severity 由可能性 × 已证明影响决定而不是由偏离检查清单决定。规则3禁止影响通胀这是拦截幻觉最直白的一条不许把崩溃夸成代码执行、把普通工作夸成共享服务不可用、把同一主体内的操作夸成权限提升。配合 SKILL.md 的严重度锚点critical 未认证者获得代码执行/全库数据high 完全打穿某个明确安全控制……AI连感觉很严重这条路也被堵死了说不出具体损害严重度就得往下调。规则4看不见就诚实说待验证部署配置、代理行为、身份策略等仓库里看不到的事实AI不许两头猜。规则4要求缺失的关键事实必须落成needs_validation记录并指名道姓写出具体 blocker 和安全的验证方案同时禁止给这类记录配严重度、禁止脑补完成。这对应 SKILL.md 的Respect source visibility原则——部署控制是真实存在的控制源码里看不到时既不能假设它存在也不能假设它不存在。规则5缺失最佳实践不是漏洞这里没做限流/没用XX方案但没有受影响的主体和资源那不是漏洞是hardening加固笔记。更狠的后半句一个被源码反驳的候选不能降级成needs_validation苟活必须记为rejected——反例也要留痕让以后的运行不再重复同一个错误主张。 项目的设计原则同样明确防御纵深缺口不是漏洞见 README.md如果 A 层已经挡住了攻击缺 B 层只是加固笔记。规则6指纹一致杜绝分身报障同一根因无论处于哪种状态候选、确认、驳回都必须使用同一个源码派生的 fingerprint格式受正则约束见 report-schema.json不得包含行号、波次、Agent、严重度或结论——否则换个行号或换个验证者同一个问题就会被当成新漏洞重复上报。这是防止AI编数量的关键机制指纹按根因去重一份报告里同一根因只允许存在一条最终记录。规则7空数组也是合法答案当没有任何候选通过门槛时返回空的 candidates 数组。再配合 VALIDATION-AND-REPORTING.md 的最后一句干净的一轮运行可能确认漏洞数为零如实报告即可不要硬造 LOW 级发现。——允许AI说我没找到是从制度上消灭凑数式误报。门槛之后两道独立验证 机器校验过了7条门槛还不算完候选还要再闯三关Phase 3 独立验证每个候选交给一个从未参与狩猎的全新验证者任务不是确认而是尝试证伪它检查发现的Agent永远不是发现它的Agent——README.mdPhase 4 结构化输出所有confirmed/needs_validation/rejected记录写入findings.json并由零依赖的 validate-findings.cjs 按 report-schema.json 做机器校验结构错误一律打回Phase 5 终审再上一批全新Agent逐条复核最终记录的每个路径、行号与影响若替换会实质升级结论还得换一个更独立的验证者再审详见 VALIDATION-AND-REPORTING.md。也就是说候选门槛是第一道筛后面还有独立人格的复核和机器校验——三重拦截下AI的编造很难活着走完整个流程。如何上手 security-audit-skill使用非常简单细节见 README.md通过 Skills CLI 把技能装到你的编程 Agent 中支持--global用户级安装在目标代码库中启动 Agent直接说security audit this codebase或find security vulnerabilities in ./src技能会自动触发等待六阶段流程跑完在输出目录得到REPORT.md、FINDINGS-DETAIL.md、NEEDS-VALIDATION.md三份报告。⚙️ 前置要求支持工具调用与并行子 Agent 的编程 Agent、Node.js供校验脚本使用、以及用于本地执行检查的操作系统级沙箱。总结security-audit-skill 用一句话回答了如何防止AI编造漏洞不给AI留编造的空间只给它留举证的路径。门槛前7条规则把完整溯源、真实影响、不夸大、不猜测、不凑数、可去重、可为零写进每个猎手Agent的提示词门槛后独立验证者专职证伪、JSON Schema 机器校验、终审Agent换人再审。这正是它能从单个仓库工具演化为云厂商级漏洞发现系统的原因——对AI安全审计而言可信的前提不是AI很强而是每条结论都经得起一个陌生人重新证伪。【免费下载链接】security-audit-skillA coding-agent skill for multi-phase security audits with independently verified, machine-readable findings项目地址: https://gitcode.com/GitHub_Trending/se/security-audit-skill创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
延伸阅读

更多相关文章

2026/9/20 20:46:47

10 分钟用 TaoToken 跑通 MCP 文件检索服务

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/9/20 21:41:51

BrewUI:macOS上Homebrew的图形化包管理客户端,告别命令行依赖

1. 为什么我放着好好的命令行不用,偏要找Homebrew的图形界面先说结论:BrewUI 是 macOS 上一款专门给 Homebrew 做图形化封装的客户端,它的定位非常清晰——让你不敲命令行也能完成绝大多数 Homebrew 包管理操作。Homebrew 是 macOS 生态里最主…

2026/9/20 21:41:51

AssetRipper 提取游戏资源实操指南

AssetRipper 提取游戏资源实操指南 【免费下载链接】AssetRipper GUI application to analyze game files 项目地址: https://gitcode.com/GitHub_Trending/as/AssetRipper 当你拿到一个 Unity 游戏的 .assets 或 .bundle 文件,想把里面的角色模型、贴图和音…

2026/9/20 21:36:51

纳什博弈在微电网协同优化中的应用与实践

1. 项目背景与核心价值去年参与某工业园区综合能源系统规划时,我亲历了多个微电网运营商为争夺有限的可再生能源配额而陷入"囚徒困境"的典型案例。这种非合作博弈导致整体系统效率损失高达23%,正是这次经历让我开始关注纳什博弈在微网协同中的…

2026/9/20 0:04:49

GAMP 5 基于风险的计算机化系统验证:软件分类与审计追踪实践

简介:《A Risk-Based Approach to Compliant GxP Computerized Systems》即业内熟知的GAMP 5指南,面向制药企业质量与IT合规人员、验证工程师及计算机化系统管理者,用于解决GxP法规环境下系统合规性难以科学落地的问题。文档以风险管理为主线…

2026/9/20 0:04:49

安全托管MSSP实战:从静态防御到人机协同的攻防运营与应急响应

简介:这份PPT围绕互联网业务安全托管服务展开,面向企业安全负责人、IT运维人员及关注MSSP/MSS选型的读者,重点回应传统安全过度依赖人工、碎片化静态防御难以对抗产业化攻击等痛点。资源共1个pptx文件,包体约30.63MB,以…

2026/9/20 0:04:49

GAMP 5 基于风险的计算机化系统验证:软件分类与审计追踪实践

简介:《A Risk-Based Approach to Compliant GxP Computerized Systems》即业内熟知的GAMP 5指南,面向制药企业质量与IT合规人员、验证工程师及计算机化系统管理者,用于解决GxP法规环境下系统合规性难以科学落地的问题。文档以风险管理为主线…

2026/9/20 0:04:49

安全托管MSSP实战:从静态防御到人机协同的攻防运营与应急响应

简介:这份PPT围绕互联网业务安全托管服务展开,面向企业安全负责人、IT运维人员及关注MSSP/MSS选型的读者,重点回应传统安全过度依赖人工、碎片化静态防御难以对抗产业化攻击等痛点。资源共1个pptx文件,包体约30.63MB,以…

2026/9/20 4:54:47

USB Type-C PCB布局分区设计:电源、高速信号与PD协议全攻略

做硬件这行,Type-C接口算是典型的“看着简单,做起来全坑”的东西。光引脚就24个,高低速信号、电源、控制线全部塞在一个小小的连接器里,如果PCB布局不做规划,打样回来基本就是“插上没反应”、“高速掉线”、“静电一打…

2026/9/20 5:01:23

系统编程学习原型如何补齐稳定性边界

系统编程学习原型如何补齐稳定性边界预算有限时&#xff0c;我先优化明显多余的复制&#xff0c;而不是猜测性地换容器。用借用传递只读数据通常就能减少分配&#xff1a; fn parse(line: &str) -> Result<Item, Error> { /* ... */ }用基准确认热点确实在分配&am…

2026/9/20 5:09:33

雨花区哪家财务公司代理记账比较好?

在雨花区&#xff0c;企业处理财税事务常常面临诸多挑战&#xff0c;选择一家靠谱的财务公司至关重要。湖南巨勤财务管理咨询有限公司就是本地正规实体财税服务机构&#xff0c;深耕本地工商财税行业多年&#xff0c;熟悉当地工商局、税务局最新政策与申报流程。主营公司注册、…

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
咨询二维码