研究人员声称

Openai未经允许培训其AI模型,面临着众多使用受版权保护的材料的指控。 AI披露项目的最新研究是由媒体大亨蒂姆·奥莱利(Tim O'Reilly)和经济学家伊兰·斯特劳斯(Ilan Strauss)于2024年成立的非营利组织,这表明Openai可能使用O'Reilly Media的非公开书籍来培训其更高级的模型GPT-4O。 AI模型,本质上是复杂的预测引擎,在包括书籍,电影和电视节目在内的大量数据集上进行了培训。他们学习模式并根据这些模式产生响应,而不是创造任何真正的新事物,而是从他们广泛的知识库中近似。随着像公共网络这样的现实数据源变得筋疲力尽,包括OpenAI在内的一些AI实验室已经开始使用AI生成的数据进行培训,尽管由于降低模型性能的风险,很少有人完全放弃了现实世界中的数据。 AI披露项目的论文声称,与较早的GPT-3.5 Turbo Model不同,OpenAI的GPT-4O模型是CHATGPT中的默认模型,显示了对Paywalled O'Reilly Books的内容的强烈认可。该论文表明,尽管O'Reilly Media没有与OpenAI达成许可协议,但GPT-4O可能接受了这些非公共书籍的培训。该研究采用了一种名为DE-COP的方法,该方法于2024年引入,以检测AI培训数据中受版权保护的内容。这种“成员推理攻击”测试了模型是否可以区分人类作者的文本和AI生成的释义,这表明文本可靠地了解文本。研究人员使用34本O'Reilly书籍中的13,962段摘录测试了GPT-4O,GPT-3.5 Turbo和其他OpenAI模型,发现GPT-4O与较旧模型相比,GPT-4O认识到的收费内容要多得多。虽然作者承认他们的方法不是万无一失,并且用户复制并粘贴到chatgpt中可能引入了付费内容,但这些发现引发了有关OpenAI数据实践的疑问。该研究没有评估OpenAI的最新模型,例如GPT-4.5和O3-Mini和O1等推理模型,因此打开了可能未接受相同数据培训的可能性。 Openai一直在推动有关AI培训数据的更轻松的版权法,并一直在寻求更高质量的数据源。该公司甚至雇用了记者来完善其模型的产出,这是在AI行业看到的这种做法,在该行业中,招募了各个领域的专家以增强AI系统。 OpenAI确实为其某些培训数据付费,与各种内容提供商达成许可协议,并为版权所有者提供退出机制。但是,由于该公司在其数据实践方面面临法律挑战,因此O'Reilly Paper的发现对其运营产生了阴影。 Openai没有回应对该研究发表评论的请求。
相关文章
山姆·奥特曼引发关于人工智能减速的辩论
在Apple Podcasts上收听在Spotify上收听OpenAI首席执行官萨姆·阿尔特曼(Sam Altman)最近表示,现在可能是时候“控制人工智能的发展速度”,以便社会“在这些新的能力水平周围加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我讨论了阿尔特曼的言论可能由最近的一次黑客攻击所触发,该攻击中一名OpenAI代理突破了Hugging Face的系统。Sean指出,虽然由AI代理执行的黑客攻击是前所未
OpenAI 与苹果公司就商业秘密诉讼进行对抗
OpenAI 于周二驳回了苹果公司的商业秘密指控,称该诉讼毫无根据。“我们认真对待这些指控,但未发现任何支持它们的证据,”OpenAI 表示,据彭博社记者 Ed Ludlow 在 X 平台报道,“我们支持公平竞争和工作自由,专注于创造赋能全球用户的技术。”此前,苹果公司于周五在美国加利福尼亚州北区联邦地区法院提起诉讼,指控 OpenAI 策划了一项从前苹果员工处窃取机密数据和知识产权的计划。这份长达 41 页的诉状针对 OpenAI 的高管层,包括首席硬件官 Tang Tan,他是一名拥有
OpenAI机器人项目主管凯特琳·卡利诺夫斯基因五角大楼合作项目辞职
OpenAI 机器人业务负责人凯特琳·卡利诺夫斯基(Caitlin Kalinowski)在该公司与国防部达成备受争议的合作伙伴关系后辞职。“这不是一个轻松的决定,”卡利诺夫斯基在社交媒体声明中解释道。“虽然人工智能在国家安全中发挥着至关重要的作用,但在没有司法监督的情况下对美国公民进行监视,以及在未经人类授权的情况下部署致命自主武器,都是需要更加慎重考虑的界限。”卡利诺夫斯基此前因领导 Meta 的增强现实眼镜部门而闻名,她于 2024 年 11 月加入 OpenAI。在辞职信中,她强调她
相关专题推荐
评论 (42)
0/500
This is wild! OpenAI sneaking in paywalled books to train their AI? Sounds like a plot twist from a sci-fi novel. Curious how they'll dodge this one—ethics in AI is getting messier by the day! 😅

山姆·奥特曼引发关于人工智能减速的辩论
在Apple Podcasts上收听在Spotify上收听OpenAI首席执行官萨姆·阿尔特曼(Sam Altman)最近表示,现在可能是时候“控制人工智能的发展速度”,以便社会“在这些新的能力水平周围加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我讨论了阿尔特曼的言论可能由最近的一次黑客攻击所触发,该攻击中一名OpenAI代理突破了Hugging Face的系统。Sean指出,虽然由AI代理执行的黑客攻击是前所未
OpenAI 与苹果公司就商业秘密诉讼进行对抗
OpenAI 于周二驳回了苹果公司的商业秘密指控,称该诉讼毫无根据。“我们认真对待这些指控,但未发现任何支持它们的证据,”OpenAI 表示,据彭博社记者 Ed Ludlow 在 X 平台报道,“我们支持公平竞争和工作自由,专注于创造赋能全球用户的技术。”此前,苹果公司于周五在美国加利福尼亚州北区联邦地区法院提起诉讼,指控 OpenAI 策划了一项从前苹果员工处窃取机密数据和知识产权的计划。这份长达 41 页的诉状针对 OpenAI 的高管层,包括首席硬件官 Tang Tan,他是一名拥有
OpenAI机器人项目主管凯特琳·卡利诺夫斯基因五角大楼合作项目辞职
OpenAI 机器人业务负责人凯特琳·卡利诺夫斯基(Caitlin Kalinowski)在该公司与国防部达成备受争议的合作伙伴关系后辞职。“这不是一个轻松的决定,”卡利诺夫斯基在社交媒体声明中解释道。“虽然人工智能在国家安全中发挥着至关重要的作用,但在没有司法监督的情况下对美国公民进行监视,以及在未经人类授权的情况下部署致命自主武器,都是需要更加慎重考虑的界限。”卡利诺夫斯基此前因领导 Meta 的增强现实眼镜部门而闻名,她于 2024 年 11 月加入 OpenAI。在辞职信中,她强调她
This is wild! OpenAI sneaking in paywalled books to train their AI? Sounds like a plot twist from a sci-fi novel. Curious how they'll dodge this one—ethics in AI is getting messier by the day! 😅





首页






