DeepTeam 只要求一个 `model_callback` 就能动态生成越狱、提示注入和多轮利用,不需要预先准备攻击数据集;目标可是一整个 agent、RAG pipeline 或 chatbot。框架内置 50 多类漏洞、OWASP LLM/Agent Top 10、NIST、MITRE 等映射,以及七种 production guard,可从 Python 或 YAML/CLI 运行。评估由可配置 LLM-as-judge 输出二元分数,覆盖广但存在裁判偏差和可重复性问题;把风险报告用于 release gate 前,应先固定 attack/judge 版本并校准误报。
–浏览
评论 · Comments