Microsoft探索了信用AI数据贡献者

微软正在启动一个新的研究项目,旨在了解特定训练示例如何影响生成式AI模型的输出,如文本、图像和其他媒体。此举措在一份12月的招聘广告中被提及,该广告最近在LinkedIn上重新出现,招聘一名研究实习生加入该项目。
该项目的目标是开发一种方法来训练模型,以便“高效且实用地估计”特定数据(如照片和书籍)对其输出的影响。招聘广告指出,当前神经网络架构在追踪输出来源方面缺乏透明度,解决这一问题有充分理由。其中一个原因是为向未来AI模型贡献有价值数据的个人提供激励、认可甚至补偿的潜力。
此研究的背景是涉及AI公司的持续法律争议,包括微软,关于知识产权的争端。AI模型通常在从公共网站抓取的大量数据集上进行训练,其中可能包含受版权保护的材料。虽然AI公司常以合理使用原则寻求保护,但各领域的创作者——艺术家、程序员、作家——对此立场提出异议。
微软目前面临法律挑战,包括《纽约时报》提起的诉讼,指控微软和OpenAI通过使用其文章训练模型侵犯了版权。此外,多名软件开发者因微软的GitHub Copilot AI编码助手使用他们的受版权保护代码提起诉讼。
该研究项目被称为“训练时出处”,由微软研究部门的知名技术专家Jaron Lanier参与。Lanier此前曾撰文讨论“数据尊严”,倡导建立一个系统,将数字内容与其创作者关联,并可能为他们对AI输出的贡献提供补偿。
虽然微软的项目仍处于早期阶段,但Bria、Adobe和Shutterstock等其他公司已在尝试根据数据拥有者对AI模型的贡献进行补偿。然而,大型AI实验室通常未建立个人贡献者支付计划,而是选择许可协议或版权持有者的退出机制,这些机制可能繁琐且范围有限。
微软的举措可能仅停留在概念验证阶段,类似于OpenAI尚未发布的创作者控制其作品如何用于训练数据的工具。还有猜测称,微软可能试图“道德洗白”其AI实践或预先应对监管和法律挑战。
鉴于Google和OpenAI等其他AI实验室最近呼吁美国政府放宽AI开发的版权保护,微软的这一举措尤为引人注目。微软尚未对有关该项目的评论请求作出回应。
相关文章
字节跳动加大核心AI激励,豆包增长14.6%
字节跳动近日召开豆包股权说明会,公布面向豆包部门员工的最新激励政策。豆包股票的行权价已从2026年6月的14.85美元上调至17.02美元,涨幅约为14.6%。此次调整不仅提升了豆包股票的估值,还大幅扩大了其覆盖范围。根据员工岗位的不同,部分员工可能获得相当于其总薪酬约5%的豆包股票。根据新的兑换机制,字节跳动允许员工在整体薪酬包中,将部分现金工资兑换为豆包股权。兑换比例因职级而异,设有20%和30%等不同档位。例如,L2和L3级员工可选择20%的全覆盖兑换比例,而L3和L4级员工的该比例可
MiniMax 推出 10 倍团队计划,以激励全球 AI 专家
MiniMax(稀宇科技)通用人工智能实验室正式推出“10x Team”,这是一项全球人才协作计划。该计划旨在招募跨行业的顶尖专家,探索大模型在垂直领域的深度应用。通过将深厚的行业知识与前沿人工智能技术相结合,MiniMax 致力于将大模型的生产力从通用场景拓展至专业场景,最终推动行业效率实现“十倍增长”。验证行业认知价值,开放多模态核心资源过去与行业专家的合作表明,深厚的专业洞察对于构建高质量、实用的行业专属大模型至关重要。在此基础上,“10x Team”计划将向合作伙伴开放包括多模态模型
韩国启动国家人工智能计算中心建设,投资2.5万亿韩元,目标2028年完成
韩国媒体EtNews报道,韩国AI计算中心(KOACC)的奠基仪式于8月3日在全罗南道顺天市的Solar City数据中心园区举行。该项目总投资额为2.5万亿韩元(约合118.38亿元人民币),计划于2028年投入运营,成为迄今为止韩国在AI基础设施领域规模最大的国家投资之一。该项目的股权分布凸显了深化政企合作的战略意图。三星SDS作为最大股东持有30%的股份,而包括科学技术信息通信部、金融监督院和国家成长基金在内的公共实体合计持有29%的股份。NAVER Cloud紧随其后,持股26.1%,
相关专题推荐
评论 (37)
0/500
Interesante proyecto, pero lo que realmente necesito es que alguien en la IA me explique por qué mi asistente virtual aún no puede organizarme el escritorio 😅. ¿Esto de la atribución podría cambiar cómo las empresas comparten datos? Me preocupa un poco la transparencia de todo el proceso. Ojalá no sea solo un gesto de relaciones públicas.
Lo de Microsoft parece interesante pero, ¿y la privacidad de los datos? 🤔 A veces siento que con toda esta exploración de IA, estamos perdiendo el control de lo que se usa para entrenar los modelos. ¿Habrá una compensación justa para quienes contribuyeron? No quiero que esto se convierta en otro caso de 'big tech' aprovechándose de 'datos gratis'...
이런 연구는 AI 데이터 기여자들에게 공정한 보상을 제공하는 데 중요한 단계가 될 수 있겠네요. 😊 근데 MS가 과연 저작권 문제를 해결할 수 있을지 의문이 드네요. 데이터 소싱 방식이 좀 더 투명해져야 할 시점인 것 같아요!
This is super intriguing! Microsoft's diving into how AI training data shapes outputs—mind-blowing stuff. Wonder how they'll credit contributors fairly? 🤔
This Microsoft AI project sounds intriguing! Crediting data contributors could reshape how we value creative input in AI. Curious to see if it'll spark ethical debates or just be a tech flex. 🤔

微软正在启动一个新的研究项目,旨在了解特定训练示例如何影响生成式AI模型的输出,如文本、图像和其他媒体。此举措在一份12月的招聘广告中被提及,该广告最近在LinkedIn上重新出现,招聘一名研究实习生加入该项目。
该项目的目标是开发一种方法来训练模型,以便“高效且实用地估计”特定数据(如照片和书籍)对其输出的影响。招聘广告指出,当前神经网络架构在追踪输出来源方面缺乏透明度,解决这一问题有充分理由。其中一个原因是为向未来AI模型贡献有价值数据的个人提供激励、认可甚至补偿的潜力。
此研究的背景是涉及AI公司的持续法律争议,包括微软,关于知识产权的争端。AI模型通常在从公共网站抓取的大量数据集上进行训练,其中可能包含受版权保护的材料。虽然AI公司常以合理使用原则寻求保护,但各领域的创作者——艺术家、程序员、作家——对此立场提出异议。
微软目前面临法律挑战,包括《纽约时报》提起的诉讼,指控微软和OpenAI通过使用其文章训练模型侵犯了版权。此外,多名软件开发者因微软的GitHub Copilot AI编码助手使用他们的受版权保护代码提起诉讼。
该研究项目被称为“训练时出处”,由微软研究部门的知名技术专家Jaron Lanier参与。Lanier此前曾撰文讨论“数据尊严”,倡导建立一个系统,将数字内容与其创作者关联,并可能为他们对AI输出的贡献提供补偿。
虽然微软的项目仍处于早期阶段,但Bria、Adobe和Shutterstock等其他公司已在尝试根据数据拥有者对AI模型的贡献进行补偿。然而,大型AI实验室通常未建立个人贡献者支付计划,而是选择许可协议或版权持有者的退出机制,这些机制可能繁琐且范围有限。
微软的举措可能仅停留在概念验证阶段,类似于OpenAI尚未发布的创作者控制其作品如何用于训练数据的工具。还有猜测称,微软可能试图“道德洗白”其AI实践或预先应对监管和法律挑战。
鉴于Google和OpenAI等其他AI实验室最近呼吁美国政府放宽AI开发的版权保护,微软的这一举措尤为引人注目。微软尚未对有关该项目的评论请求作出回应。
字节跳动加大核心AI激励,豆包增长14.6%
字节跳动近日召开豆包股权说明会,公布面向豆包部门员工的最新激励政策。豆包股票的行权价已从2026年6月的14.85美元上调至17.02美元,涨幅约为14.6%。此次调整不仅提升了豆包股票的估值,还大幅扩大了其覆盖范围。根据员工岗位的不同,部分员工可能获得相当于其总薪酬约5%的豆包股票。根据新的兑换机制,字节跳动允许员工在整体薪酬包中,将部分现金工资兑换为豆包股权。兑换比例因职级而异,设有20%和30%等不同档位。例如,L2和L3级员工可选择20%的全覆盖兑换比例,而L3和L4级员工的该比例可
MiniMax 推出 10 倍团队计划,以激励全球 AI 专家
MiniMax(稀宇科技)通用人工智能实验室正式推出“10x Team”,这是一项全球人才协作计划。该计划旨在招募跨行业的顶尖专家,探索大模型在垂直领域的深度应用。通过将深厚的行业知识与前沿人工智能技术相结合,MiniMax 致力于将大模型的生产力从通用场景拓展至专业场景,最终推动行业效率实现“十倍增长”。验证行业认知价值,开放多模态核心资源过去与行业专家的合作表明,深厚的专业洞察对于构建高质量、实用的行业专属大模型至关重要。在此基础上,“10x Team”计划将向合作伙伴开放包括多模态模型
韩国启动国家人工智能计算中心建设,投资2.5万亿韩元,目标2028年完成
韩国媒体EtNews报道,韩国AI计算中心(KOACC)的奠基仪式于8月3日在全罗南道顺天市的Solar City数据中心园区举行。该项目总投资额为2.5万亿韩元(约合118.38亿元人民币),计划于2028年投入运营,成为迄今为止韩国在AI基础设施领域规模最大的国家投资之一。该项目的股权分布凸显了深化政企合作的战略意图。三星SDS作为最大股东持有30%的股份,而包括科学技术信息通信部、金融监督院和国家成长基金在内的公共实体合计持有29%的股份。NAVER Cloud紧随其后,持股26.1%,
Interesante proyecto, pero lo que realmente necesito es que alguien en la IA me explique por qué mi asistente virtual aún no puede organizarme el escritorio 😅. ¿Esto de la atribución podría cambiar cómo las empresas comparten datos? Me preocupa un poco la transparencia de todo el proceso. Ojalá no sea solo un gesto de relaciones públicas.
Lo de Microsoft parece interesante pero, ¿y la privacidad de los datos? 🤔 A veces siento que con toda esta exploración de IA, estamos perdiendo el control de lo que se usa para entrenar los modelos. ¿Habrá una compensación justa para quienes contribuyeron? No quiero que esto se convierta en otro caso de 'big tech' aprovechándose de 'datos gratis'...
이런 연구는 AI 데이터 기여자들에게 공정한 보상을 제공하는 데 중요한 단계가 될 수 있겠네요. 😊 근데 MS가 과연 저작권 문제를 해결할 수 있을지 의문이 드네요. 데이터 소싱 방식이 좀 더 투명해져야 할 시점인 것 같아요!
This is super intriguing! Microsoft's diving into how AI training data shapes outputs—mind-blowing stuff. Wonder how they'll credit contributors fairly? 🤔
This Microsoft AI project sounds intriguing! Crediting data contributors could reshape how we value creative input in AI. Curious to see if it'll spark ethical debates or just be a tech flex. 🤔





首页






