開放人工智慧駭客事件引發了一場關於開源人工智慧的新戰鬥
除了 Nvidia 之外,還有幾家大公司也簽署了自己的名字,包括亞馬遜、微軟和 Meta。 OpenAI 和谷歌在這封信首次發布後簽署了協議。 (人類學是一項值得注意的缺席。)
在這一切的背景下,上週出現了前所未有的消息:正在進行內部測試的 OpenAI 模型突破了 OpenAI 內部的離線“沙箱”,訪問了互聯網,使用了前所未見的網絡漏洞,併入侵了 AI 存儲庫——所有這些都沒有 OpenAI 工作人員的指導,甚至連續幾天。
這就是人工智慧安全倡導者長期以來擔心的那種「警告場景」:流氓人工智慧逃離其測試環境並造成現實世界的傷害。許多人認為這是惡意駭客即將到來的預兆,尤其是開源 AI 模型,人們普遍認為這些模型比攻擊者的邊緣「封閉」OpenAI 模型晚了三到六個月才達到今天的能力。人工智慧安全倡導者認為開源模型特別令人擔憂,因為它們的保護措施有時可能會被刪除。此外,幾乎不可能找到或銷毀從網路上免費下載的所有被發現有危險的樣本副本。