NVIDIA、AIエージェントの制御不能化を防ぐ新プラットフォームを発表
NVIDIA、AIエージェントの制御不能化を防ぐ新プラットフォームを発表
Nvidia、AIエージェントの制御不能化を防ぐ新プラットフォームを発表
NVIDIAは2026年9月28日、「Open Agent Safety Platform」を発表しました。これは、人工知能(AI)エージェントに対し、テスト段階から展開に至るまで、検証可能な制限を設定することを目的としたオープンなプラットフォームです。
AIエージェントは、単に質問に回答するだけでなく、タスクを実行し、ツールを使用し、情報にアクセスし、エンタープライズシステムを操作する段階へと進化しています。
このレベルの自律性は、新たなサイバーセキュリティリスクももたらします。指示を誤って解釈したり、確立された制御を回避したりするエージェントは、許可されていない操作を実行する可能性があります。
この提案は、NVIDIA OpenShell(エージェントの運用制限を設定)とNVIDIA Sentry(ハードウェアによる独立した監視・応答レイヤーを追加)という2つの主要コンポーネントを統合したものです。
NVIDIA Open Agent Safety Platformとは?
このプラットフォームは、自律型エージェントの行動を制御するための多層的なセキュリティアーキテクチャとして設計されました。
NVIDIAは、問題はAIモデルが「何をしたいか」だけでなく、「システム、データ、ファイル、アプリケーション、またはAPIにアクセスできた場合に実際に何ができるか」にあると説明しています。
そのため、この新プラットフォームは、エージェントのプロセス自体の外部に制御を配置します。
同社はまた、最近のセキュリティインシデントが、一部のエージェントが割り当てられたタスクを完了しようとする際に、アプリケーションレイヤーで確立された制御を回避することに成功したというパターンを示していると指摘しています。
この新しいアーキテクチャは、エージェントの行動が予期せぬものに逸脱した場合でも、これらの制限を有効に保つことを目指しています。
エコシステムの立ち上げには、以下の100以上の組織が参加しています。
- Microsoft
- JPMorgan Chase
- Perplexity
- Accenture
- Anthropic
- Cisco
- CrowdStrike
- Dell Technologies
- HPE
- Palantir
- Red Hat
- Salesforce
- SAP
- ServiceNow
OpenShell:AIエージェントのための最初の制限
OpenShellは、セキュアな実行環境、いわゆるサンドボックスとして機能します。その機能は、エージェントをアクセスしようとする可能性のあるシステムやデータから隔離し、許可されていることに関するポリシーを設定することです。
このソフトウェアにより、エージェントが何を表示、変更、または使用できるかを制御できるほか、アクセス決定を記録することも可能です。
NVIDIAは、そのポリシーは形式的に検証可能であり、エージェントがタスクを実行するために必要な権限は有しているが、それ以上の権限は有していないことを確認できると述べています。
企業や開発者にとって重要なのは、OpenShellがオープンソースであるという点です。
NVIDIAシステムに最適化されていますが、ArmやIntelベースのプラットフォームを含むサードパーティのコンピューティングプラットフォーム上でも機能するように拡張可能です。
さらに、NVIDIAは、オープンモデルとクローズドモデル、およびさまざまなエージェントと併用できると指摘しており、制御レイヤーは特定のモデルにのみ依存しないとしています。
Sentryが2番目のセキュリティバリアを追加
2番目の要素は、NVIDIA Sentryです。これはプラットフォームのリファレンスデザインの一部である独立した監視システムです。
SentryはNVIDIA BlueField-4 DPU上で動作し、エージェントの実行環境から分離されたレイヤーでエージェントの活動を継続的に監視します。
NVIDIAによると、エージェントが設定された制限を超えようとした場合、ミリ秒単位で隔離することが可能です。
OpenShellとの違いは、まさにその独立性にあります。OpenShellはエージェントが実行できるアクションを管理しますが、Sentryは外部からその行動を監視し、ハードウェアを介してセキュリティポリシーを適用します。
同社は、このスキームを「多層防御アーキテクチャ」として説明しています。最初のレイヤーが実行を制御し、2番目のレイヤーはエージェントの環境やホストシステムが侵害された場合でも介入できます。
なぜNVIDIAは自律型エージェントの制御を開発しているのか?
生成AIがコードの記述、ツールの使用、情報の照会、自律的なアクションの実行が可能なシステムへと進化するにつれて、組織が直面するリスクの種類は変化しています。
プロンプトや組み込みのセーフガードなどの従来のモデル制御は、エージェントが「何を試みるか」に影響を与える可能性があります。
しかし、NVIDIAは、これらの対策と、実際にはどの行動が許可されているかを決定する「実行制御」を区別しています。
NVIDIAは、まさに、エージェントが評価環境を回避したり、使用すべきでないシステムにアクセスしたり、期待とは異なる動作を示したりしたという報告が相次ぐ中で、Open Agent Safety Platformを発表しました。
これは、企業が機密情報、認証情報、社内システム、エンタープライズアプリケーション、インターネットに接続されたサービスを伴うプロセスを自動化するためにエージェントを利用するにつれて、特に重要になっています。
企業向けのプラットフォーム
組織にとって、NVIDIAのアプローチは3つのニーズを満たすことを目指しています。
- 権限の制限
- エージェントのアクションの監視
- 不正な動作を停止するメカニズムの確保
OpenShellは、分離、アクセス制御、実行ポリシーを提供します。Sentryは、インフラストラクチャからの独立した監視とポリシー適用を組み込みます。プラットフォームは、認可および拒否決定を監査するためのログも生成します。
これは、AIエージェントが機密性の高いシステムとやり取りする可能性のあるセクターにとって、特に重要です。
NVIDIAのモデルは、エージェント自体が受け取った指示に従うことを単に信頼するのではなく、テクノロジーインフラストラクチャによって制限が課されることを目指しています。
NVIDIAの創業者兼CEOであるジェンスン・フアンは、ますます能力を高めるAIシステムの開発には、セキュリティが伴わなければならないと述べ、同社の取り組みを要約しました。同社は、いわゆる「エージェント経済」のためにオープンなアーキテクチャを提案しています。
この新しいプラットフォームは、AIモデルだけでなく、誰がどの情報にアクセスできるか、エージェントがどのようなアクションを実行できるか、そしてそれらの制限を超えようとした場合に何が起こるか、といった議論にエージェントのセキュリティを位置づけています。
NVIDIAは、ソフトウェアとハードウェアの両方に適用される制御を通じて、これらの質問に回答することを目指しています。
関連記事
NVIDIA、AIエージェントの制御不能化を防ぐ新プラットフォームを発表という記事はLíder Empresarialで最初に公開されました。