ProgressGate
ストックにはログインが必要です
暴走するAIエージェントのための、Jev搭載サーキットブレーカー
Artificial Intelligence
Developer Tools
GitHub
Open Source
概要
- AIエージェントの各ステップと次のモデル呼び出しの間に入り、見かけ上は異なるものの進展につながらない行動の連鎖を検知します。
- TypeSafe Jevが進捗や戦略の新規性、矛盾した前提への依存、状況悪化の有無を意味的に判断します。
- 判定結果をもとに、決定論的なコードが継続・警告・再計画・停止のいずれかを実行します。
検証結果と特徴
- 意図的に行き詰まらせた20シナリオでは、モデル呼び出しを115回から80回、トークン使用量を15.17万から10.49万に削減しました。
- これはモデル呼び出し30.4%、トークン30.8%の削減に相当し、最大では12回から4回、1.99万から5,100トークンまで減少しました。
- 健全な対照セットでは20回中20回が完了し、誤ってHALTされたケースはありませんでした。ただし単一モデルと決定論的なシミュレーションツールによる検証結果です。
こんな人におすすめ
- 同じ前提に依存したまま、ログ確認やツール切り替えなど別の行動を繰り返すエージェントの失敗を抑えたい開発者。
- エージェントの実行トレースを分析し、単なる行動の変化と本当の進展を区別したいAIシステム設計者。
- オープンソースのv0.1段階の実装を試し、誤判定や想定外のエージェント挙動を検証したい人。
投票数: 0