
做安全测试,传统路子就两条——要么请渗透测试团队,贵、慢,一个项目从侦察到出报告动辄数周,小公司根本排不上号;要么用扫描器,倒是便宜了,可静态分析工具最出名的本事是"狼来了",一个洞没挖到,先给你报五百个误报,让你挨个儿手工验证到怀疑人生。
做安全测试,传统路子就两条——要么请渗透测试团队,贵、慢,一个项目从侦察到出报告动辄数周,小公司根本排不上号;要么用扫描器,倒是便宜了,可静态分析工具最出名的本事是”狼来了”,一个洞没挖到,先给你报五百个误报,让你挨个儿手工验证到怀疑人生。
所以安全圈一直有个尴尬的供需缺口:漏洞是真的有,专业的人是真的少,靠谱的自动化是真的不存在。
Strix 就是冲着这个缺口来的。它是个开源的 AI 渗透测试工具,但千万别把它跟传统扫描器划等号——它的定位是”自主 AI 黑客代理”:一个由多个 AI 代理组成的团队,干起活来跟真实黑客一模一样——先侦察你的应用、摸清攻击面,再实际运行代码发起攻击,最后拿真实可复现的概念验证(PoC)确认漏洞确实存在。
以前是”花钱请黑客帮你找洞”,现在是”AI 黑客团队免费帮你找洞,还附赠补丁”。

有哪些功能特点
① 底层逻辑:LLM 大脑 + 黑客工具包。
Strix 的核心是拿大模型(OpenAI、Anthropic、Google 的模型都行)当”大脑”,给这个大脑配了一套完整的黑客工具箱:基于 Caido 的 HTTP 拦截代理(可以改请求改响应)、Playwright 驱动的真实浏览器(自动化测 XSS、CSRF、点击劫持这些客户端攻击)、交互式终端(漏洞利用开发和后渗透)、Python 沙箱(写和验证 PoC 利用代码)、侦察与 OSINT 模块(子域名枚举、指纹识别、攻击面测绘)。
② 多代理编排:不是单兵作战,是红队协同。
Strix 跑起来不是一个大模型瞎扫,而是拆成专门的侦察代理、利用代理、后渗透代理,各干各的活,还能共享发现、串联漏洞——侦察代理发现了子域名,利用代理马上顺着去测,这跟真实红队的分工协作逻辑一模一样。多目标还能并行,扩个容就把整个攻击面铺开了。
③ 覆盖 OWASP Top 10 之外,还管业务逻辑。
常规注入类(SQL、NoSQL、命令注入、SSTI)、服务端漏洞(SSRF、XXE、反序列化、RCE)、客户端攻击(XSS、原型污染、CSRF)、认证与 JWT 攻击——这些标准科目都有。更值钱的是它管业务逻辑漏洞:竞态条件、支付金额操纵、工作流绕过,这类洞传统扫描器基本无能为力,因为需要”理解业务”,而这正是 AI 代理的主场。
④ 真验证,不狼来了:每个漏洞带可复现 PoC。
这是它和传统 SAST 工具最大的分野。传统静态扫描器是”猜”你可能有洞(所以误报率感人),Strix 是”证明”你有洞——每个发现都附带一个能实际跑通的 PoC 和复现步骤,你要验证?跑一遍 PoC 就知道真假。误报率被摁下去,安全测试的信任度就回来了。
⑤ 从”发现”到”修复”一条龙。
光报告洞不算完,它还能生成可直接合并的补丁(Pull Request)和合规级渗透测试报告(SOC 2、ISO 27001、PCI DSS 这种审计能直接交差的格式)。配合 GitHub Actions 的示例工作流,每次 Pull Request 自动跑一遍扫描,不安全代码直接阻断在进生产之前。
⑥ 隐私友好 + 上手门槛低。
strix view 起的本地查看器绑定 127.0.0.1,数据全程留在本机,不用注册云账号、不用上传代码。安装就一条 curl 命令,前置条件只有 Docker + 一个 LLM API key。支持无头模式,服务器上跑自动化任务也没问题。技术底座是 LiteLLM(统一各家模型接口)+ Caido + Nuclei + Playwright + Textual,全是现成的开源好货,不自造轮子。
需要注意的问题
1. 法律红线,没有回旋余地。
README 里原文警告:”只测试你拥有或有权限测试的应用。”拿 Strix 扫别人的网站,跟拿真黑客工具攻击没有本质区别,法律责任全在你头上。
授权范围、测试边界(scope)一定要在指令文件里写清楚,这是工具用得好不好的第一前提。
2. AI 代理不是全知全能的,结果要人审。
它会漏报(尤其是深度业务逻辑和需要领域知识的场景),也可能误报(比传统工具强得多,但不是零)。自动生成的修复补丁更要人审——AI 补的洞可能在你的业务上下文里引入新问题,尤其是支付、权限这类敏感逻辑。
3. 运行成本要算清楚。
它吃 LLM API 的 token,多代理协作、长流程推理,跑一次深度扫描的 token 消耗不小,还用 Perplexity 做联网搜索的话又是一笔。
4. 环境要求:Docker 是硬门槛。
沙箱镜像虽然从 7.2GB 优化到了 3.8GB,但首次拉取依然是实打实的下载量;扫描必须在 Docker 沙箱里跑,没有 Docker 的环境(比如某些严格受限的 CI)就用不了。另外它依赖你配置的模型能力,推理深度(STRIX_REASONING_EFFORT)高低直接决定扫描质量和耗时。
5. 它是”自动化渗透”,不是”企业级渗透测试服务”的平替。
单点应用、仓库、API 的快速测试它很强,但涉及复杂内网横向、社会工程学、物理安全、深度合规评审这些,专业人类团队依然不可替代。
安全圈的痛点从来不是没有工具,而是”专业的太贵、便宜的不可信”。Strix 用 AI 把这两个问题一起回答了。
支持:Win+Mac+Liunx
评论列表 (0条):
加载更多评论 Loading...