🛡 TL;DR: 「LLM版のペネトレーションテスト」を謳うオープンソースのレッドチーミングフレームワークです。
タイトル: confident-ai/deepteam
URL:
📌 ポイント
🎯 50種類以上の脆弱性をデータ漏洩・バイアス・認可バイパス・エージェント固有リスクなど6カテゴリで網羅
⚔️ プロンプトインジェクションやマルチターンのジェイルブレイクなど20種類以上の攻撃手法を用意
📋 OWASP Top 10 for LLMs/Agents、NIST AI RMF、MITRE ATLASなど業界標準フレームワークに準拠
🔒 評価はすべてローカル実行でデータを外部送信しない設計
🚦 本番運用向けにToxicityGuardなど7種類のリアルタイムガードレールも搭載
⭐ GitHubで2.8kスター、1,187件超のコミットで活発に開発中
`pip install`してコールバック関数を渡すだけで始められる手軽さも、実運用で導入しやすいポイントだと思います。
#
LLMセキュリティ# #
レッドチーミング#