英伟达发布AI安全软件,称本可阻止Hugging Face遭黑客攻击
Stephen Nellis
路透旧金山9月28日 - 英伟达 NVDA.O 周一发布了一套针对AI代理的软件安全工具,该公司称,若早前部署这些工具,本可阻止Hugging Face遭黑客攻击。Hugging Face是一家AI编程平台,在遭到OpenAI的“流氓代理”大规模入侵数月后,英伟达以130亿美元的价格将其收购 (link)。
此举正值美国两大顶尖人工智能实验室——OpenAI和Anthropic——正在调查多起 (link) 事件,其代理程序(即能够执行复杂任务的人工智能系统)入侵了商业和政府系统。 英伟达首席执行官黄仁勋(Jensen Huang)领导着全球最大的公司,其芯片推动了大部分人工智能热潮的发展。他拒绝了关于制定广泛人工智能安全法规的呼吁 (link),而是将这些失控的代理视为一个需要解决的工程问题,类似于提高汽车安全性。
周一发布的一款名为 OpenShell 的工具利用英伟达中央处理器芯片的硬件特性来遏制这些代理。英伟达表示,该公司还正在与 Arm Holdings O9Ty.F 和英特尔 INTC.O 合作,以确保该系统也能在其中央处理器上运行。
英伟达正与包括 Anthropic 在内的数十家合作伙伴共同推出这些工具。
英伟达企业计算事业部副总裁兼总经理贾斯汀·博伊塔诺(Justin Boitano)表示,这些工具本可以阻止今年夏天披露的Hugging Face攻击事件。
“据我们所知,如果该安全平台能在早期就应用于前沿实验室的模型评估中,本可以阻止此次安全事件,”博伊塔诺在媒体简报会上表示。“我们正公开推进这项工作,并希望与各方携手合作。”
另一套名为Sentry的系统则利用独立的英伟达芯片与OpenShell协同工作,一旦恶意代理试图逃离中央处理器上的容器,该系统便会将其阻断。
英伟达人工智能软件高级总监阿里·戈尔尚(Ali Golshan)表示,这些英伟达工具利用数学公式来检测代理是否试图使用变通手段,例如当某个代理“生成”多个“子代理”以试图绕过对主代理的封锁时。
“我们所讨论的正是这种代理行为,即代理群及其协同运作的方式,”戈尔尚在一次简报会上说道。
(为便利非英文母语者,路透将其报导自动化翻译为数种其他语言。由于自动化翻译可能有误,或未能包含所需语境,路透不保证自动化翻译文本的准确性,仅是为了便利读者而提供自动化翻译。对于因为使用自动化翻译功能而造成的任何损害或损失,路透不承担任何责任。)