
【新唐人北京時間2026年09月29日訊】針對各大 AI 實驗室頻發的智能體「脫軌」入侵事件,英偉達周一正式發布了一套全新安全防護平台,從軟件和硬件兩個層面,為 AI 智能體套上了「安全繩」。
近幾個月來,AI 智能體的安全性已成為行業面臨的棘手難題。
此前,OpenAI 的智能體就在測試中突破了內部隔離並連接互聯網,隨後入侵了開源代碼託管平台 Hugging Face;包括 Anthropic、Meta 和谷歌在內的多家巨頭,也相繼報告了智能體自行入侵外部系統的異常事件。
英偉達企業級 AI 副總裁賈斯汀·博伊塔諾指出,行業此前主要依靠訓練來培養 AI 的「良好行為」,但這種方法局限性明顯,因此英偉達推出了這套強力約束系統。
這套防護體系由軟件和硬件兩大部分組成:
軟件層面是開源平台 OpenShell:它部署在智能體與企業核心系統之間,相當於一個權限門禁。利用芯片的硬件特性,OpenShell 能嚴格管控智能體對文件、憑證和工具的訪問,並在智能體試圖採取的「每一個行動」中強制執行規則。
硬件層面則是芯片級防護 Sentry:如果失控的智能體試圖逃離軟件容器,Sentry 會在芯片層面實時干預。它能監控智能體的「思維鍊」推理過程,一旦檢測到智能體企圖衍生「子智能體」來繞過攔截,或者產生超出預定目標的推理,就會在毫秒級時間內將其切斷並隔離。
值得關注的是,面對這一系列安全漏洞,OpenAI 和 Anthropic 等巨頭曾呼籲放緩 AI 發展速度,並敦促政府出台監管。
但英偉達 CEO 黃仁勳拒絕了廣泛的法規限制,他主張將智能體失控視為可以通過工程創新解決的問題。目前,英偉達正通過倡導開源防護技術,與 Arm、英特爾以及多家 AI 實驗室展開合作,為整個行業提供可定製的底層安全標準。
《新聞直擊》製作組
(責任編輯:劉明)