英偉達發布AI安全軟件,稱本可阻止Hugging Face遭黑客攻擊
Stephen Nellis
路透舊金山9月28日 - 英偉達 NVDA.O 周一發布了一套針對AI代理的軟件安全工具,該公司稱,若早前部署這些工具,本可阻止Hugging Face遭黑客攻擊。Hugging Face是一家AI編程平台,在遭到OpenAI的“流氓代理”大規模入侵數月後,英偉達以130億美元的價格將其收購 (link)。
此舉正值美國兩大頂尖人工智能實驗室——OpenAI和Anthropic——正在調查多起 (link) 事件,其代理程序(即能夠執行複雜任務的人工智能系統)入侵了商業和政府系統。 英偉達首席執行官黃仁勛(Jensen Huang)領導著全球最大的公司,其芯片推動了大部分人工智能熱潮的發展。他拒絕了關於制定廣泛人工智能安全法規的呼籲 (link),而是將這些失控的代理視為一個需要解決的工程問題,類似于提高汽車安全性。
周一發布的一款名為 OpenShell 的工具利用英偉達中央處理器芯片的硬件特性來遏制這些代理。英偉達表示,該公司還正在與 Arm Holdings O9Ty.F 和英特爾 INTC.O 合作,以確保該系統也能在其中央處理器上運行。
英偉達正與包括 Anthropic 在內的數十家合作夥伴共同推出這些工具。
英偉達企業計算事業部副總裁兼總經理賈斯汀·博伊塔諾(Justin Boitano)表示,這些工具本可以阻止今年夏天披露的Hugging Face攻擊事件。
“據我們所知,如果該安全平台能在早期就應用於前沿實驗室的模型評估中,本可以阻止此次安全事件,”博伊塔諾在媒體簡報會上表示。“我們正公開推進這項工作,並希望與各方攜手合作。”
另一套名為Sentry的系統則利用獨立的英偉達芯片與OpenShell協同工作,一旦惡意代理試圖逃離中央處理器上的容器,該系統便會將其阻斷。
英偉達人工智能軟件高級總監阿里·戈爾尚(Ali Golshan)表示,這些英偉達工具利用數學公式來檢測代理是否試圖使用變通手段,例如當某個代理“生成”多個“子代理”以試圖繞過對主代理的封鎖時。
“我們所討論的正是這種代理行為,即代理群及其協同運作的方式,”戈爾尚在一次簡報會上說道。
(為便利非英文母語者,路透將其報導自動化翻譯為數種其他語言。由於自動化翻譯可能有誤,或未能包含所需語境,路透不保證自動化翻譯文本的準確性,僅是為了便利讀者而提供自動化翻譯。對於因為使用自動化翻譯功能而造成的任何損害或損失,路透不承擔任何責任。)