研究人員聲稱

Openai未經允許培訓其AI模型,面臨著眾多使用受版權保護的材料的指控。 AI披露項目的最新研究是由媒體大亨蒂姆·奧萊利(Tim O'Reilly)和經濟學家伊蘭·斯特勞斯(Ilan Strauss)於2024年成立的非營利組織,這表明Openai可能使用O'Reilly Media的非公開書籍來培訓其更高級的模型GPT-4O。 AI模型,本質上是複雜的預測引擎,在包括書籍,電影和電視節目在內的大量數據集上進行了培訓。他們學習模式並根據這些模式產生響應,而不是創造任何真正的新事物,而是從他們廣泛的知識庫中近似。隨著像公共網絡這樣的現實數據源變得筋疲力盡,包括OpenAI在內的一些AI實驗室已經開始使用AI生成的數據進行培訓,儘管由於降低模型性能的風險,很少有人完全放棄了現實世界中的數據。 AI披露項目的論文聲稱,與較早的GPT-3.5 Turbo Model不同,OpenAI的GPT-4O模型是CHATGPT中的默認模型,顯示了對Paywalled O'Reilly Books的內容的強烈認可。該論文表明,儘管O'Reilly Media沒有與OpenAI達成許可協議,但GPT-4O可能接受了這些非公共書籍的培訓。該研究採用了一種名為DE-COP的方法,該方法於2024年引入,以檢測AI培訓數據中受版權保護的內容。這種“成員推理攻擊”測試了模型是否可以區分人類作者的文本和AI生成的釋義,這表明文本可靠地了解文本。研究人員使用34本O'Reilly書籍中的13,962段摘錄測試了GPT-4O,GPT-3.5 Turbo和其他OpenAI模型,發現GPT-4O與較舊模型相比,GPT-4O認識到的收費內容要多得多。雖然作者承認他們的方法不是萬無一失,並且用戶複製並粘貼到chatgpt中可能引入了付費內容,但這些發現引發了有關OpenAI數據實踐的疑問。該研究沒有評估OpenAI的最新模型,例如GPT-4.5和O3-Mini和O1等推理模型,因此打開了可能未接受相同數據培訓的可能性。 Openai一直在推動有關AI培訓數據的更輕鬆的版權法,並一直在尋求更高質量的數據源。該公司甚至僱用了記者來完善其模型的產出,這是在AI行業看到的這種做法,在該行業中,招募了各個領域的專家以增強AI系統。 OpenAI確實為其某些培訓數據付費,與各種內容提供商達成許可協議,並為版權所有者提供退出機制。但是,由於該公司在其數據實踐方面面臨法律挑戰,因此O'Reilly Paper的發現對其運營產生了陰影。 Openai沒有回應對該研究發表評論的請求。
相關文章
山姆·奧特曼引發關於人工智慧減速的辯論
在Apple Podcasts上收聽在Spotify上收聽OpenAI執行長薩姆·阿爾特曼(Sam Altman)最近表示,現在可能是時候“控制人工智慧的發展速度”,以便社會“在這些新的能力水平周圍加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我討論了阿爾特曼的言論可能由最近的一次駭客攻擊所觸發,該攻擊中一名OpenAI代理突破了Hugging Face的系統。Sean指出,雖然由AI代理執行的駭客攻擊是前所未
OpenAI 與蘋果公司就商業秘密訴訟進行對抗
OpenAI 於週二駁回了蘋果公司的商業秘密指控,稱該訴訟毫無根據。“我們認真對待這些指控,但未發現任何支援它們的證據,”OpenAI 表示,據彭博社記者 Ed Ludlow 在 X 平臺報道,“我們支援公平競爭和工作自由,專注於創造賦能全球使用者的技術。”此前,蘋果公司於週五在美國加利福尼亞州北區聯邦地區法院提起訴訟,指控 OpenAI 策劃了一項從前蘋果員工處竊取機密資料和智慧財產權的計劃。這份長達 41 頁的訴狀針對 OpenAI 的高管層,包括首席硬體官 Tang Tan,他是一名擁有
OpenAI機器人專案主管凱特琳·卡利諾夫斯基因五角大樓合作專案辭職
OpenAI 機器人業務負責人凱特琳·卡利諾夫斯基(Caitlin Kalinowski)在該公司與國防部達成備受爭議的合作伙伴關係後辭職。“這不是一個輕鬆的決定,”卡利諾夫斯基在社交媒體宣告中解釋道。“雖然人工智慧在國家安全中發揮著至關重要的作用,但在沒有司法監督的情況下對美國公民進行監視,以及在未經人類授權的情況下部署致命自主武器,都是需要更加慎重考慮的界限。”卡利諾夫斯基此前因領導 Meta 的增強現實眼鏡部門而聞名,她於 2024 年 11 月加入 OpenAI。在辭職信中,她強調她
相關專題推薦
評論 (42)
0/500
This is wild! OpenAI sneaking in paywalled books to train their AI? Sounds like a plot twist from a sci-fi novel. Curious how they'll dodge this one—ethics in AI is getting messier by the day! 😅

山姆·奧特曼引發關於人工智慧減速的辯論
在Apple Podcasts上收聽在Spotify上收聽OpenAI執行長薩姆·阿爾特曼(Sam Altman)最近表示,現在可能是時候“控制人工智慧的發展速度”,以便社會“在這些新的能力水平周圍加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我討論了阿爾特曼的言論可能由最近的一次駭客攻擊所觸發,該攻擊中一名OpenAI代理突破了Hugging Face的系統。Sean指出,雖然由AI代理執行的駭客攻擊是前所未
OpenAI 與蘋果公司就商業秘密訴訟進行對抗
OpenAI 於週二駁回了蘋果公司的商業秘密指控,稱該訴訟毫無根據。“我們認真對待這些指控,但未發現任何支援它們的證據,”OpenAI 表示,據彭博社記者 Ed Ludlow 在 X 平臺報道,“我們支援公平競爭和工作自由,專注於創造賦能全球使用者的技術。”此前,蘋果公司於週五在美國加利福尼亞州北區聯邦地區法院提起訴訟,指控 OpenAI 策劃了一項從前蘋果員工處竊取機密資料和智慧財產權的計劃。這份長達 41 頁的訴狀針對 OpenAI 的高管層,包括首席硬體官 Tang Tan,他是一名擁有
OpenAI機器人專案主管凱特琳·卡利諾夫斯基因五角大樓合作專案辭職
OpenAI 機器人業務負責人凱特琳·卡利諾夫斯基(Caitlin Kalinowski)在該公司與國防部達成備受爭議的合作伙伴關係後辭職。“這不是一個輕鬆的決定,”卡利諾夫斯基在社交媒體宣告中解釋道。“雖然人工智慧在國家安全中發揮著至關重要的作用,但在沒有司法監督的情況下對美國公民進行監視,以及在未經人類授權的情況下部署致命自主武器,都是需要更加慎重考慮的界限。”卡利諾夫斯基此前因領導 Meta 的增強現實眼鏡部門而聞名,她於 2024 年 11 月加入 OpenAI。在辭職信中,她強調她
This is wild! OpenAI sneaking in paywalled books to train their AI? Sounds like a plot twist from a sci-fi novel. Curious how they'll dodge this one—ethics in AI is getting messier by the day! 😅





首頁






