AEGIS
ストックにはログインが必要です
実際のバイパス率を公開する、オープンソースのLLM防御
Artificial Intelligence
GitHub
Development
Software Engineering
概要
- LLMアプリとエージェントの間に配置し、入力・出力のフィルタリングやポリシーエンジンで危険な処理を制御します。
- プロンプトインジェクションによってエージェントがツールを不正利用する事態を、権限管理と汚染追跡で防ぎます.
主な特徴
- 過去の攻撃成功例から新たな攻撃を生成する、適応型レッドチームテストで防御性能を評価します。
- 固定テストだけでは見えにくい実際の攻撃耐性を、バイパス率などの数値として正直に公開しています。
こんな人におすすめ
- LLMアプリや自律型エージェントに、オープンソースで自前運用できる防御層を導入したい開発者。
- ガードレール製品の検知率だけでなく、適応型攻撃への耐性や評価手法まで検証したいセキュリティ担当者。
投票数: 2