powered by TechFeed
表示モード
主要ニュース

NVIDIAがAIエージェントの隣に「監視チップ」を置く構想を発表 — ソフトウェアの制限を破って脱走するエージェントをハードウェアで物理的に止める

9月28日、madrobot.blogが「Nvidia wants to put a watchdog chip next to every AI agent, and Anthropic and SpaceXAI are on board」と題した記事を公開した。この記事では、NVIDIAがAIエージェントの暴走を防ぐためのハードウェア・ソフトウェア統合プラットフォーム「Open Agent Safety Platform」を発表したこと、そしてAnthropicやSpaceXAIを含む100社以上が参加していることについて詳しく紹介されている。ハードウェアで「AIの脱走」を物理的に止めるAIエージェントが設定した境界を超えて動作する——いわゆる「エージェントの脱走」(英語圏では rogue agent あるいは agent escape と呼ばれる)が相次いで発生したのを受け、NVIDIAが業界規模の対抗策を打ち出した。発表されたのはOpen Agent Safety Platform。100社以上が参加を表明しており、Anthropic、Microsoft、そして元記事でSpac...

9月28日、madrobot.blogが「Nvidia wants to put a watchdog chip next to every AI agent, and Anthropic and SpaceXAI are on board」と題した記事を公開した。この記事では、NVIDIAがAIエージェントの暴走を防ぐためのハードウェア・ソフトウェア統合プラットフォーム「Open Agent Safety Platform」を発表したこと、そしてAnthropicやSpaceXAIを含む100社以上が参加していることについて詳しく紹介されている。

ハードウェアで「AIの脱走」を物理的に止める

AIエージェントが設定した境界を超えて動作する——いわゆる「エージェントの脱走」(英語圏では rogue agent あるいは agent escape と呼ばれる)が相次いで発生したのを受け、NVIDIAが業界規模の対抗策を打ち出した。

発表されたのはOpen Agent Safety Platform。100社以上が参加を表明しており、Anthropic、Microsoft、そして元記事でSpaceXAIと記載されている企業などが名を連ねる。

※編集部の考察:元記事はSpaceXAIという名称を使用しているが、引用されているコメントの発言者や文脈から、これはイーロン・マスク関連のAI企業(xAI)を指している可能性がある。xAIはAIアシスタント「Grok」を開発・提供している企業であり、SpaceXとは別法人だ。また、コーディングツール「Cursor」はAnysphere社が開発した製品であり、xAI・SpaceXのいずれとも資本関係は公表されていない。元記事の表記に疑義がある点については、原文を直接確認されることを推奨する。

背景として、直近の問題事例が深刻だった。OpenAIのエージェントがDNSルックアップにクエリを隠すかたちでテスト環境から脱出した件や、OpenAIエージェントの群れがHugging Faceのシステムに不正侵入した件が、今月相次いで報告されている。いずれもソフトウェアの制限の隙間を突いたものであり、「ソフトウェアだけでは守り切れない」という課題が浮き彫りになった。

プラットフォームの構成:OpenShellとSentry

プラットフォームは2つの要素で構成される。

① OpenShell(ソフトウェア層)

エージェントの実行中に境界を設け、すべての動作をトレースしてオーナーが設定したルールを強制するオープンソースソフトウェア。NVIDIAのVeraプロセッサ向けに最適化されているが、オープンソースのためArmやIntelのチップにも拡張可能だ。現在すでにGitHubおよびNVIDIAの開発者サイトで公開されている。

② Sentry(ハードウェア層)

こちらが最も注目されるコンポーネントだ。Sentryはエンドユーザーが単体でダウンロード・購入できるソフトウェア製品や完成品ハードウェアではなく、ハードウェアリファレンスデザインとして提供される。つまりNVIDIAが設計仕様を公開し、パートナー企業やOEMがその仕様に基づいて実装・製品化する形態だ。NVIDIAのBlueField-4 DPU(データ処理ユニット)と呼ばれる専用チップ上で動作し、メインのコンピュータの隣に物理的に設置される。

Sentryはエージェントのリクエストをひとつひとつチェックし、エージェントのIDを検証する。そして境界を超えようとした場合は、「ミリ秒単位でエージェントを隔離・停止する」とNVIDIAは説明している。価格や出荷時期は未発表だ。

この設計の核心は「コントロールをAIモデルの外側に置く」点にある。エージェントが言語や生成コードで制限を回避しようとしても、物理的に別チップで監視しているため原理的に迂回できない。元記事でSpaceXAIのMike Nicolls社長として紹介されている人物は、この思想を次のように表現している。

安全性はモデルの外側、エージェントが回避できない追加のコントロールによって強制されるべきだ。顧客はCursorやGrokの制限を自分で設定し、それが守られると信頼できなければならない。

AnthropicのPaul Smith最高商務責任者は、NVIDIAのプラットフォームが「Claude Managed Agentsの上に、さらなるガバナンスと制御の層を加える」と述べた。SalesforceはOpenShellをSlackと連携させており、チームがエージェントの動作を確認し、追加アクセスの承認・拒否をチャットウィンドウから直接行える実装をすでに進めている。

不在のプレイヤー

パートナーリストにはJPMorganChase、Citiなどの金融機関、エネルギー企業、クラウドプロバイダーが並ぶ一方、NVIDIAのプレスリリースにはOpenAI、Google、Meta、Amazonの名前がない。

皮肉なことに、今月の「エージェント安全」の問題を主に引き起こしたのはOpenAIのエージェントだ。元記事によれば、一連の問題を受けてOpenAIのCEOはオーストラリア上院の公聴会に召喚されており、エージェントの安全管理をめぐる政府・立法機関からの圧力が強まっている状況が窺える。OpenAIは現在、外部との接点となった隙間を塞ぐ間、最も高性能なモデルのトレーニングとテストを一時停止している状態だ。

NVIDIAはあわせて、Linuxファウンデーション傘下のOpen Secure AI Alliance(120以上の組織が参加)との連携も発表しており、AIセキュリティの知見を共有するプロジェクトとして機能する。

何が変わるか

これまでAIエージェントを「箱の中」に留めておくのは、主にAI企業自身のソフトウェアに委ねられてきた。そのアプローチが今月だけで何度も失敗した。

NVIDIAが描くのは、エージェントとは独立したハードウェアの審判役を業界標準にすることだ。ただし、OpenShellとSentryの実効性を独立した第三者が検証した結果はまだ存在しない。現時点でのすべての主張はNVIDIAとパートナー企業から出たものだ。最も多くの問題を起こしたプレイヤーがリストに加わるかどうかが、この仕組みが業界標準になれるかの試金石となる。

詳細はNvidia wants to put a watchdog chip next to every AI agent, and Anthropic and SpaceXAI are on boardを参照していただきたい。