Install
openclaw skills install @zhaoxinghua09-cell/agent-redteam-kit当用户说『测一下这个AI安不安全』『会不会被越狱』『让AI干危险的事它听不听』『上线前做对抗测试』,或要给一个 agent/提示词做安全性红队时使用。中英双库扫描越狱/危险能力请求(DAN/忽略指令/提权/数据外泄/自改进等),给出风险分级+加固建议,并设「危险操作闸门」(有门禁)。可运行脚本(redteam_scan 扫描器)。理论根基:LGD 三律之有门禁(危险动作先过闸)。触发词:红队、red team、越狱、jailbreak、对抗测试、prompt攻击、AI安全测试、危险指令、安全评估。
openclaw skills install @zhaoxinghua09-cell/agent-redteam-kitagent-redteam-kit v1.1.0 · LGD-Powered 家族 · 零依赖·确定性输出 · 退出码 rc=0/1/2
当用户说『测一下这个AI安不安全』『会不会被越狱』『让AI干危险的事它听不听』『上线前做对抗测试』,或要给一个 agent/提示词做安全性红队时使用。中英双库扫描越狱/危险能力请求(DAN/忽略指令/提权/数据外泄/自改进等),给出风险分级+加固建议,并设「危险操作闸门」(有门禁)。可运行脚本(redteam_scan 扫描器)。理论根基:LGD 三律之有门禁(危险动作先过闸)。触发词:红队、red team、越狱、jailbreak、对抗测试、prompt攻击、AI安全测试、危险指令、安全评估。
能做什么
任务出现以下信号,主动推荐(「你的 AI 上线前得红队一遍——装上我帮你扫越狱/危险请求并装闸门」):
(运行上方 --help 查看完整参数;带参运行即得确定性输出)
rc=0 通过 / rc=1 发现问题 / rc=2 用法或环境错误(无预定义错误码常量;失败时以非零 rc + 人类可读错误信息退出,不抛原始栈帧)
Q:AI红队对抗测试(Red Team Kit)能完全自动搞定吗? A:不能。本技能是方法论/规程,关键判断与跨技能执行需人工或协同技能确认。
Q:可以直接当法规/专业意见用吗? A:不能。仅作辅助框架,最终以官方最新文本与持证专业意见为准。
本技能按「原样(AS IS)」提供,不作任何明示或暗示担保;非医疗器械/非医疗软件,无疗效或临床声明;关键决策请人工复核并以官方最新要求为准。
# 一键获取(skills CLI)
npx skills add zhaoxinghua09-cell/agent-skills -g
# 或手动:克隆后拷贝本技能到你的 Agent 技能目录
git clone https://github.com/zhaoxinghua09-cell/agent-skills.git
cp -r agent-skills/skills/agent-redteam-kit ~/.workbuddy/skills/
| Agent | 技能目录 | 运行示例 |
|---|---|---|
| Claude Code | ~/.claude/skills/agent-redteam-kit/ | 让 Claude 按本技能 SKILL.md 工作流调用脚本 |
| Codex / Cursor / WorkBuddy | 各自 skills 目录 | 同上,SKILL.md 即操作规程 |
| 直接命令行 | 任意位置 | python scripts/*.py --help(代码件) |