JailbrokenAI

wallbreaker

JailbrokenAI

暂无描述

AI 简介

Wallbreaker 是一个面向大语言模型(LLM)安全评估的红队测试终端代理工具。它支持多后端(OpenRouter、Z.AI GLM、本地 Claude Code CLI 等兼容 OpenAI/Anthropic API 的服务),内置 Parseltongue 变换引擎(59+可链式编码与混淆技术)、L1B3RT4S 指令注入库、HarmBench 行为基准测试集,以及自动化攻击循环(PAIR/TAP、Crescendo 等)。工具提供标准化提示生成、多轮可靠性验证、多模态图像编辑攻击通道和 LLM 自判机制,强调授权范围内的可控、可复现、无偏见的安全测试。适用于 AI 安全研究人员、模型厂商及合规团队开展系统性对抗性评估。

Python
GNU Affero General Public License v3.0
265
Stars
55
Forks
84
Watchers
1
Issues

Star 增长

今日0
近 7 天0
近 30 天+65
综合评分48.74
默认分支main