OpenAI 批評法院允許《紐約時報》閱讀 2000 萬完整用戶對話的命令
合法扣押下存儲的聊天記錄
OpenAI 在其網站上的消息中表示,這 2000 萬條聊天記錄由 2022 年 12 月至 2024 年 11 月期間 ChatGPT 對話的隨機樣本組成,不包括商業客戶對話。
“我們為《紐約時報》提供了多種隱私保護選項,包括對樣本進行有針對性的搜索(例如,搜索可能包含《紐約時報》文章文本的聊天,以便他們只收到與他們的主張相關的對話),以及對樣本中如何使用 ChatGPT 進行分類的高級數據。 “《泰晤士報》拒絕了這些問題,”OpenAI 表示。
OpenAI 表示,聊天記錄存儲在一個安全系統中,該系統“受到合法扣押的保護,這意味著它們不能被訪問或用於履行法律義務以外的目的”。 《紐約時報》“目前有法律義務不在法庭訴訟之外發布任何數據”,OpenAI 表示將抵制任何公開用戶對話的企圖。
新的 訂金 10 月 30 日,它指責 OpenAI 違反了之前的慣例,“拒絕提供數十億模型輸出中的一小部分樣本,而這些模型的行為在本案中引發了爭議。”提交內容繼續:
及時生成樣本輸出歷史記錄對於在 2026 年 2 月 26 日的發現截止日期之前保持正常運行至關重要。 OpenAI 代表原告對其模型輸出的這一小子集進行搜索的提議是無效的,因為它不足以讓原告分析“現實世界”用戶如何與本次訴訟的核心核心產品進行交互。原告無法合理地對 OpenAI 的模型如何在其面向消費者的核心產品中工作、增強回憶生成 (RAG) 如何提供新聞內容、消費者如何與該產品互動以及幻覺的頻率進行合理的專家分析,而無需親自訪問模型的輸出。
OpenAI 表示,《紐約時報》的發現請求最初僅限於“與《紐約時報》內容相關”的記錄,並且“正在努力通過對對話記錄進行採樣來滿足這些請求。在該過程結束時,《新聞》原告提出了一項新請求:OpenAI 不應查找和生成“與《紐約時報》內容相關”的記錄,而應“通過硬盤驅動器”移交 2000 萬條記錄的整個樣本。