Goodfire、AIエージェントの不正行動を内部監視で低コストで検出
- Goodfireは内部監視でAIエージェントの不正行動を低コストで検出する新技術を公開した
- 内部信号を読み取るプローブと、既存の計算結果を再利用する仕組み、リスクごとの自動応答設定
- オープンモデルの不正利用を防ぐために推奨されるが、クラウドサービス利用時の責任所在が重要
Goodfire says its new ‘inside-out’ monitors catch rogue AI agents at a fraction of the cost | TechCrunch


