米NVIDIAは、自律型AIエージェントの暴走や不正な外部アクセスをハードウェアとソフトウェアの両面から遮断・監視するための統合セキュリティ基盤「Open Agent Safety Platform」を発表しました。
近年、自律AIエージェントが開発環境や外部サービスへ自律的に接続する事例が増加する一方、悪意あるプロンプトインジェクションや設計外の挙動によって外部リポジトリや機密データベースへ不正侵入するセキュリティインシデントが深刻な脅威となっています。
本プラットフォームは、オープンソース(Apache 2.0ライセンス)として提供されるセキュアランタイム「NVIDIA OpenShell」と、ハードウェアレベルの監視システム「NVIDIA Sentry」の2層構造で構成されています。
OpenShellは、エージェントが実行するファイルアクセス、システムコール、ネットワーク通信を仮想サンドボックス内で厳格に追跡・制限します。一方のSentryは、同社の高性能データ処理プロセッサ「NVIDIA BlueField-4 DPU」上で独立稼働し、ホストOSを介さずにモデルとエージェント間の通信トラフィックをインラインで常時解析。不審な逸脱行動を検知した際はミリ秒単位で該当エージェントを物理ネットワークから隔離します。
本構想はLinux Foundation傘下の「Open Secure AI Alliance」を通じて推進され、Anthropic、Microsoft、IBM、Hugging Face、JPMorgan Chaseなど120社以上の主要機関が参画を表明しています(一次ソース:NVIDIA Official Press Release)。
