Weir - unit test for your AI agent
ストックにはログインが必要です
AIエージェントの決定論的テストを、LLMなしで実現
Artificial Intelligence
GitHub
Open Source
Software Engineering
概要
- OpenTelemetryのGenAIトレースを解析し、AIエージェントが実際に実行した処理を機械的に検証できる証拠へ変換します。
- 分析にLLMを使わないため、結果の再現性と判定の一貫性を重視したエージェントテストを実現します。
主な特徴
- エージェントの可観測性を測定し、複数の処理ステップをまたぐデータの流れを追跡できます。
- CIやセキュリティテストで活用できる証跡パスを生成し、エージェントの挙動を機械チェック可能にします。
こんな人におすすめ
- AIエージェントの評価やテストを担当し、主観的な出力評価ではなく実行内容を検証したいエンジニアに適しています。
- エージェントの可観測性、データフロー、セキュリティ、CI連携を一貫して扱いたい開発チームに向いています。
投票数: 2