中新经纬9月28日电 据彭博社28日报道,英伟达公司推出了一种新的双层人工智能安全系统,该系统可以防止最近备受瞩目的“拥抱脸”(Hugging Face)被OpenAI的人工智能模型入侵事件发生。
英伟达正迅速将其产品线扩展到芯片以外的领域,并推出两款可在其硬件上运行的开源软件安全工具。这两款工具旨在实时控制人工智能代理的访问权限,并在其违反规则时将其关闭。
英伟达企业人工智能副总裁贾斯汀·博伊塔诺在周一发布会前的记者会上表示,如果尖端实验室能够及早使用这项技术来评估其人工智能模型,或许就能避免“拥抱脸”攻击。“据我们所知,这个新的安全平台本可以阻止此次攻击。”他说道。
包括7月份“拥抱脸”事件在内的自主代理不当行为,已经震动了人工智能行业,并引发了放缓该技术研发进程的呼声。英伟达推出的新产品——开放代理安全平台,旨在提供一种既能防止安全漏洞又不限制人工智能发展的方法。这家芯片制造商的首席执行官黄仁勋曾多次淡化人工智能失控的风险。
近日,黄仁勋将安全问题视为一项工程挑战,而非需要更多监管或全球协调的问题。他同时也坚持认为,人工智能必须经过严格的安全测试。
黄仁勋针对人工智能安全问题提出的工程解决方案包含两部分。OpenShell是一款软件产品,英伟达已在三月份的标志性技术大会上对其进行了预览。该产品可在英伟达Vera中央处理器上运行,使用户能够设置人工智能代理的访问权限规则,并实时执行这些规则。该软件是开源的,这意味着它可以被自由使用和修改。
与此同时,Nvidia Sentry是一款可在英伟达的BlueField数据处理单元上运行的新产品。该公司表示,该产品旨在提供额外的AI监控层,对代理进行监管,并在发现可疑代理时进行干预并隔离它们。
博伊塔诺在谈到Sentry产品时表示:“我们相信,这一新增的安全层将使业界能够安全地测试最先进的人工智能系统。它可以在几毫秒内隔离可疑代理。”
该报道提到,9月早些时候,英伟达同意以约130亿美元收购“拥抱脸”,这是一个开源人工智能模型及相关软件平台。
OpenAI最近的一系列事件——包括入侵澳大利亚政府系统,以及试图访问数十个美国政府和大学网站——都是由于其模型逃逸了本应安全的测试环境造成的。
随着问题不断扩散,OpenAI于上周五晚间宣布将暂停训练其功能最强大的AI模型。早在7月份,Anthropic也披露其人工智能体从原本应该隔离的测试环境中逃脱。(中新经纬APP)
【编辑:熊思怡】