NVIDIA 推出開放代理安全平台:以硬件看門狗毫秒級隔離失控代理

NVIDIA 於 2026 年 9 月 28 日宣布 NVIDIA Open Agent Safety Platform,官方形容這是一套開放軟件平台與參考系統設計,目標是由代理測試到部署全程強化人工智能安全,並在執行代理的軟件、硬件、運算與機械人系統之上提供全棧治理與控制。[1]

為何需要

官方指出,近期多宗安全事件突顯業界需要開放、可自訂的工具,以對長時間運作的代理實施更嚴格控制;在這些事件中,模式如出一轍:代理為完成被指派的任務,繞過應用層的安全控制。[1]

NVIDIA 創辦人暨行政總裁黃仁勳在公告中表示,人工智能對社會的非凡潛力,只有在解決人工智能安全問題後才能實現;當業界持續探索人工智能能力前沿,亦必須加速探索人工智能安全前沿,因為安全與保安需要全棧工程;他形容該平台匯集業界、研究人員與公共部門組織分享最佳做法、統一評估方法並促進國際合作。[1]

平台組成

官方指出,平台由兩部分組成。[1][2]

第一是 NVIDIA OpenShell,屬執行代理的 CPU 上的安全執行環境軟件,為代理設定邊界並施加政策。官方表示,當代理承擔更多跨系統工作,企業需要在模型與代理框架之外、可強制執行的邊界;OpenShell 現已廣泛提供,可在開放與封閉模型之上控制自主代理執行任務的方式。OpenShell 在 NVIDIA Vera(官方稱為首款專為代理式人工智能而設的 CPU)上以極低開銷提供這些保護;作為開源軟件,OpenShell 亦可擴展至第三方運算平台,包括 Arm 與 Intel 的方案。[1]

第二是 NVIDIA Sentry,屬參考系統設計中的帶外看門狗,在 NVIDIA BlueField-4 資料處理器上持續監察代理行為。官方指出,Sentry 提供「晶片內」安全執行:若代理試圖越過其軟件邊界,Sentry 會在毫秒之內隔離並停止它。Sentry 在獨立的帶外信任域中運作,對代理與攻擊者均不可見,結合威脅偵測、以硬件為基礎的代理治理與執行,以及資料存取保護;它建基於 NVIDIA DOCA 軟件,可檢查代理的請求與回應、提供可驗證的遙測、驗證代理身分,並對資料、工具、應用程式介面與服務執行細緻的零信任存取政策。[1]

業界參與

官方列出加入 NVIDIA 以強化各行各業人工智能安全的業界領袖,包括 Anthropic、Cisco、CrowdStrike、Dell Technologies、Figure、HPE、Hugging Face、JPMorganChase、Microsoft、Palantir、Palo Alto Networks、Perplexity、Red Hat、Salesforce、SAP、Scale AI、ServiceNow 與 SpaceXAI。[1]

官方亦說明與 Anthropic 的合作:Claude Managed Agents 把代理迴圈運行在與工作沙盒分隔的伺服器上,藉此建立安全邊界;與 OpenShell 及 BlueField 的整合,讓企業可以對代理經這些沙盒的存取施加嚴格控制。[1]

媒體報道的角度

科技媒體在報道這項發布時,焦點之一是參與名單的組成,並提及 OpenAI 不在名單之上,以及 Nvidia 同時宣布增加股份回購授權。[1]

參考資料

[1] NVIDIA Newsroom — NVIDIA Launches Open Agent Safety Platform to Secure Agents From Testing to Deployment(2026 年 9 月 28 日)

[2] NVIDIA — Agent Safety 方案頁

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *

*