
HarnessAudit
UCSB-AI
Official codebase for the paper "Auditing Agent Harness Safety"
AI 简介
HarnessAudit 是一个用于评估智能体系统安全边界的开源评测框架,聚焦于工具调用、资源访问和信息流三类关键安全约束的合规性审计。它通过完整执行轨迹分析(而非仅结果判断),支持单/多智能体运行、状态化领域模拟、原生CLI集成及LLM-as-judge评分,并提供标准化迹线Schema与六项可复现安全指标(如sar_tool、avs、tcr)。适用于AI安全研究、智能体系统开发与第三方合规性验证等场景,强调在完成任务前提下的行为级安全可观测性。
Python
MIT License49
Stars
3
Forks
40
Watchers
0
Issues
Star 增长
今日0
近 7 天0
近 30 天0
综合评分1.81
默认分支main