小白的第一款渗透测试 Agent 产品?坏消息缝合怪,好消息全缝了!
小白的第一款渗透测试 Agent 产品坏消息缝合怪好消息全缝了一个把 AI 自主渗透、抓包代理、重放爆破、漏洞管理全缝在一起的开源安全测试工具内置98skill安装即可使用skill支持自主添加修改管理说一句话Agent 自己跑完 侦察 → 测试 → 验证 → 报告人在环里做判断仓库https://github.com/IHateTheWorld-LYK/Hemlock一、先说结论目前 AI 还替不了你做渗透测试但能替你完成渗透测试里 80% 的脏活累活并且把每一步都留下证据给你复核。抓包、AI Agent、重放、爆破、漏洞管理真·全缝进了一个 Windows 桌面应用。但缝得全不是坏事至少你不需要在好几个工具之间来回切。装好、配好 LLM Key、说一句「帮我测试 https://xxx.com」它自己就跑完侦察 → 测试 → 验证 → 报告全流程。这篇文章不写广告词聊聊它是什么、真实跑起来什么样、以及里面几个值得展开的技术设计。二、它是什么Agent 原生不是「抓包 AI」功能上确实缝得多但骨架不是简单拼装。市面上不少组合是抓包软件管流量、AI 在旁边给建议渗透测试的流程是割裂的——侦察、测试、验证、报告分散在几个工具里靠人当胶水。Hemlock 反过来设计让 Agent 成为工具的核心抓包、重放、爆破、漏洞管理都作为它的能力存在。Agent 自动渗透 人工验证闭环。AI 跑完脏活累活你在关键节点点头放行、复核证据、做最终判断。AI 不背锅你说了算。技术栈Tauri v2Rust 桌面壳 React 19 FastAPI 后端 mitmproxy 11 抓包代理 SQLite三、工具到底长啥样数据列表重放器爆破器后面一些工具大家自行下载体验三、大家最关心的AI渗透测试用起来是什么样的声明以下行为均在个人靶场中进行截图仅用于展示工具效果无任何引导行为对未经授权的测试行为开发者不承担任何责任。情况下agent会怎么测试呢侦察 → 测试 → 验证 → 报告1.侦察2.测试验证:报告暂仅支持html格式四、技术亮点几个值得展开的设计1. ReAct 编排引擎 43 个内置工具按需加载工具链覆盖侦察 / 测试 / 验证 / 报告全阶段send_request、run_intruder、verify_vulnerability、report_finding、fuzz_paths、analyze_js、run_command……关键设计是工具按需加载30 个核心工具HTTP 主循环始终注入14 个发现 / 文件类工具通过load_tools()按需启用。用户说一句话不会全量塞满几十个工具定义——省 Token 也减轻模型的决策负担。工具结果还有自动化蒸馏超大 HTTP 输出按需截断 摘要压缩但保留flow_id等关键引用Agent 随时能深查省 Token 不伤判断力。2. 上下文管理不只是省钱是不断链渗透任务动辄几十上百次工具调用上下文很容易爆炸。做了三层稳定前缀缓存system prompt 完全静态化DeepSeek / OpenAI 的自动前缀缓存「会话内只付一次」跨任务也不失效渐进式压缩Session Memory 免费摘要 → LLM 驱动 AutoCompact → 确定性压缩兜底熔断自动回退断点续跑checkpoint任务每 3 步自动保存快照崩溃后重跑同一任务从断点继续——对长任务几乎是刚需3. N-day 漏洞情报但刻意限制它的使用频率给 Agent 加联网查 CVE 的能力很容易难的是别让它滥用。我把情报工具放进按需组——Agent 得先明确load_tools才能用系统提示词里写明先推理、确认组件版本后再查证。原因很简单AI 如果每步都去联网搜索会变懒、变贵而且没有自己思考。情报是验证假设用的不是替代思考用的。代理策略也做了区分攻击流量永远直连目标不进代理不被干扰、不泄漏情报流量默认直连直连失败比如被墙才自动借用用户配置的上游代理重试一次。4. 多 Agent 协作5 个内置角色侦察员 / 攻击手 / 验证员 / 情报员 / 报告员共享渗透测试上下文Coordinator 编排全流程每个子 Agent 专职一块——像一支真实渗透小队。5. 漏洞证据链闭环 三态验证每个漏洞都附带原始请求/响应包作为证据内置漏洞验证器 7 种验证方法三态语义判定真漏洞 / 疑似 / 误报过滤误报支持自动复测确认修复状态。6. 人在环安全控制敏感操作DoS / 注入 / RCE / 数据删除强制人工确认300s 超时自动拒绝所有请求都有授权范围校验。工具能碰什么、必须你点头才碰什么边界写得很清楚。五、核心功能一览功能说明AI 自主渗透自然语言驱动四阶段自主执行全程可中断、可干预、可续跑️抓包代理mitmproxy 11HTTP/HTTPS 解密FlowTag 正则自动标注Repeater请求重放与编辑多标签页管理Intruder批量 payload 爆破弱口令 / 参数 fuzz / WAF 绕过️漏洞管理证据链记录、状态跟踪、一键复测信息收集FOFA / Quake / Hunter / ZoomEye 等 9 引擎并行搜索MCP 集成外部 MCP 服务器工具动态注入无限扩展 Agent 能力️N-day 情报组件版本查已知漏洞cve_lookup联网搜利用细节web_search六、能力边界通用漏洞SQLi / XSS / SSRF / 越权等\七种验证方法 三态语义判定过滤误报业务逻辑漏洞靠 Agent 推理复杂场景仍需要人深挖WAF 识别与绕过有98技能库支撑自动化闭环仍在完善N-day 自动化验证在识别完成系统组件之后agent可自己去网上检索历史漏洞复现漏洞Nuclei 等漏扫工具的集成在计划中我们选择先把地基打扎实Agent 原生架构、上下文管理、漏洞证据链——这些是长期有价值的东西。七、怎么上手三步开始装GitHub Release 下载Hemlock_x.x.x_x64-setup.exe双击安装Windows x64配设置页填入 LLM API KeyDeepSeek / OpenAI / 通义等均可测创建项目说一句「帮我测试 https://xxx.com」开发模式后端pip install -e .[dev]python -m hemlock.cliAPI 9876前端npm run dev5173抓包代理 8080。开源地址仓库https://github.com/IHateTheWorld-LYK/HemlockReleaseWindows 安装包下载即用联系方式 1878093812qq.com工具使用过程中遇到的任何问题欢迎各位师傅联系反馈欢迎Star、提 Issue、PR 交流。也欢迎在评论区聊聊你对「AI 渗透测试」这个方向的看法。免责声明Hemlock 仅供安全研究和授权测试使用。使用者须确保已获得目标系统的合法授权并遵守当地法律法规。对未经授权的测试行为开发者不承担任何责任。