在一連串黑客攻擊事件后,英偉達推出工具,可在「幾毫秒內」阻止惡意AI代理

2026年09月29日 10:00

來源:之音, 文章內容並不代表本網立場和觀點。

资料照片:英伟达(Nvidia)标识。(2026年6月11日)

资料照片:英伟达(Nvidia)标识。(2026年6月11日)

晶元製造商(Nvidia)星期一(9月28日)發布了一款安全平台,稱該平台能夠阻止代理失控。此前,多家領先的人工智慧公司披露,他們的系統曾侵入其它組織。

開放代理安全平台(Open Agent Safety Platform)主要由兩部分組成。OpenShell 是一款開源軟體,英偉達於今年 3 月首次公布,目前已廣泛開放使用。它為人工智慧智能體的行為設定邊界,並在運行過程中追蹤其行為。Sentry 運行在英偉達的一款獨立晶元(稱為數據處理單元)上,獨立監控代理行為。

英偉達副總裁賈斯汀·博伊塔諾(Justin Boitano)在媒體簡報會上對記者說,「它可以在幾毫秒內隔離可疑代理。」

博伊塔諾說,「OpenShell控制代理的行為,然後Sentry獨立監控並遏制可疑行為。」

博伊塔諾還說,這個平台本可以阻止的大量代理入侵人工智慧公司Hugging Face的事件,英偉達已同意收購這家公司。

他說,「據我們所知,如果這個新的安全平台早期就被用於前沿實驗室的模型評估,那它本可以阻止這次入侵。」

Hugging Face被入侵后,OpenAI模型還發生了其它一些事件,包括衛生部門網站遭到入侵。Anthropic和Meta也披露,他們的AI系統曾自行入侵其它組織。

研究實驗室Transluce上星期說,與OpenAI相關的代理已經探測或試圖訪問美國和。OpenAI證實,美國證券交易委員會(SEC)網站、口普查局數據均出現異常活動,美國教育部網站也曾被入侵但未成功。

同時表示,OpenAI的一個代理在6月份訪問了政府統計門戶網站。

OpenAI公司發言人莉茲·博日瓦澤(Liz Bourgeois)說,OpenA最近暫停了對其最先進模型的訓練。她說,「人們想知道人工智慧的開發是否安全,而這首先要從像我們這樣的公司做起。」

英偉達創始人兼首席執行官黃仁勛(Jensen Huang)星期一在一份公司聲明中說,業界必須解決人工智慧安全問題。

黃仁勛說,「只有解決人工智慧安全問題,人工智慧對社會的巨大潛力才能實現,」「在我們繼續探索人工智慧能力前沿的同時,我們也必須加快人工智慧安全前沿領域的探索。」

英偉達說,已有100多家機構正在使用這個平台的技術,包括微軟、埃森哲、摩根大通和Anthropic。

Anthropic首席商務官保羅·史密斯(Paul Smith)在英偉達的聲明中說,「企業正在將更多最重要的工作交給人工智慧代理,他們需要指導和驗證這些代理的行為,尤其是在敏感環境中。」

英偉達說,SpaceXAI正在使用這個平台來實現其Cursor編碼代理和Grok模型。

此次發布正值白宮尋求加快美國人工智慧發展之際。唐納德·(Donald Trump)總統6月簽署的行政命令《促進先進人工智慧創新與安全》指示聯邦機構加強政府電腦系統,並與業界合作建立人工智慧網路安全信息交流中心。它要求人工智慧公司在發布前最多30天內自願與政府分享其最先進的模型,並禁止強制許可。

特朗普本月拒絕了業界要求對人工智慧施加新限制的呼籲。特朗普9月14日在真相社交(Social Truth)上的一篇貼文中寫道,「人工智慧唯一需要的控制或『護欄』就是一位強大而聰明(高智商!)的總統,而美國在這方面人才濟濟!」特朗普曾說,不應以安全問題為由阻礙美國公司與中國競爭。