OpenAI 如何失去對 AI 模型的控制——以及需要改變什麼
AI Now Institute 首席人工智慧科學家、OpenAI 前安全系統工程承包商 Heidi Clough 表示:「沙箱確實不安全。」他補充說,允許模型連接到服務下載套件的事實並沒有真正密封環境。
在先前的職位中,克拉夫審查了數十家科技公司的安全性。在此之前,她審查了高風險系統,例如核電站內部使用的系統,這些系統通常是「氣隙」系統,從物理上切斷它們與互聯網的存取。 “我們認為核電廠的安全性與我們認為大型技術的安全不同。”
抱臉事件凸顯了即時監控的重要性。
雖然具體時間框架的細節很少,但 HackingFace 表示,在 OpenAI 注意到並介入之前,特工們已經「週末」工作了,並表示他們無法突破限制並獲得任何長期優勢。一名 OpenAI 員工表示,OpenAI Codex 平台上的代理內部採取的行動受到仔細監控,但正在評估的模型在單獨的系統中使用,本質上不受監控。