Microsoft explora acreditar a los contribuyentes de datos de IA

Microsoft está iniciando un nuevo proyecto de investigación destinado a comprender cómo ejemplos de entrenamiento específicos influyen en los resultados de modelos de IA generativa, como texto, imágenes y otros medios. Esta iniciativa se destacó en una oferta de empleo de diciembre que recientemente resurgió en LinkedIn, buscando un interno de investigación para unirse al esfuerzo.
El objetivo del proyecto es desarrollar un método para entrenar modelos de modo que el impacto de datos particulares, como fotos y libros, en sus resultados pueda ser "estimado de manera eficiente y útil". La oferta de empleo señala que las arquitecturas actuales de redes neuronales carecen de transparencia para rastrear los orígenes de sus resultados, y hay razones convincentes para abordar este problema. Una razón mencionada es la posibilidad de ofrecer incentivos, reconocimiento e incluso compensación a individuos que aporten datos valiosos a futuros modelos de IA.
El trasfondo de esta investigación son las batallas legales en curso que involucran a empresas de IA, incluido Microsoft, sobre derechos de propiedad intelectual. Los modelos de IA a menudo se entrenan con vastos conjuntos de datos extraídos de sitios web públicos, que pueden incluir material protegido por derechos de autor. Mientras las empresas de IA suelen reclamar protección bajo la doctrina de uso justo, creadores de diversos campos—artistas, programadores, autores—cuestionan esta postura.
Microsoft enfrenta actualmente desafíos legales, incluida una demanda de The New York Times, que alega que Microsoft y OpenAI infringieron sus derechos de autor al usar sus artículos para entrenar sus modelos. Además, varios desarrolladores de software han demandado a Microsoft por su asistente de codificación GitHub Copilot AI, alegando que fue entrenado con su código protegido por derechos de autor.
El proyecto de investigación, denominado "training-time provenance", involucra a Jaron Lanier, un destacado tecnólogo en Microsoft Research. Lanier ha escrito previamente sobre "data dignity", abogando por un sistema que conecte el contenido digital con sus creadores y potencialmente los compense por sus contribuciones a los resultados de IA.
Aunque el proyecto de Microsoft está en sus primeras etapas, otras empresas como Bria, Adobe y Shutterstock ya están experimentando con la compensación a propietarios de datos basada en sus contribuciones a modelos de IA. Sin embargo, los grandes laboratorios de IA generalmente no han establecido programas de pago para colaboradores individuales, optando en cambio por acuerdos de licencia o mecanismos de exclusión para titulares de derechos de autor, que pueden ser engorrosos y limitados en alcance.
La iniciativa de Microsoft podría permanecer como una prueba de concepto, similar a la herramienta aún no lanzada de OpenAI para que los creadores controlen cómo se usan sus obras en los datos de entrenamiento. También hay especulaciones de que Microsoft podría estar intentando "lavar éticamente" sus prácticas de IA o anticiparse a desafíos regulatorios y legales.
Este movimiento de Microsoft es particularmente notable dado los recientes llamados de otros laboratorios de IA, como Google y OpenAI, para que el gobierno de EE. UU. relaje las protecciones de derechos de autor para el desarrollo de IA. Microsoft aún no ha respondido a solicitudes de comentarios sobre este proyecto.
Artículo relacionado
Las acciones de EE. UU. alcanzan un hito histórico mientras gigantes de la IA y la aeroespacial se preparan para su debut de un billón de dólares
Elon Musk, Sam Altman y Dario Amodei, tres titanes del sector tecnológico, están avanzando hacia ofertas públicas iniciales para sus respectivas empresas. Con SpaceX, OpenAI y Anthropic, tres gigantes de la industria que se acercan a valoraciones de
La startup sueca de inteligencia artificial Lovable Eyes alcanza una valoración de 13.200 millones de dólares tras una importante ronda de financiación
Mientras las herramientas de codificación impulsadas por inteligencia artificial ganan terreno, la startup sueca Lovable ha asegurado una importante ronda de financiación. La empresa tiene como objetivo recaudar 3 000 millones de dólares, lo que podr
Google prueba el agente Remy AI para Gemini a medida que el enfoque se desplaza hacia el control del usuario
Según Business Insider, Google está probando Remy, un nuevo agente personal de IA para Gemini. Esta herramienta tiene como objetivo ejecutar tareas en nombre de los usuarios, optimizando tanto los flujos de trabajo profesionales como las rutinas diar
Recomendaciones de temas especiales relacionados
comentario (37)
0/500
Interesante proyecto, pero lo que realmente necesito es que alguien en la IA me explique por qué mi asistente virtual aún no puede organizarme el escritorio 😅. ¿Esto de la atribución podría cambiar cómo las empresas comparten datos? Me preocupa un poco la transparencia de todo el proceso. Ojalá no sea solo un gesto de relaciones públicas.
Lo de Microsoft parece interesante pero, ¿y la privacidad de los datos? 🤔 A veces siento que con toda esta exploración de IA, estamos perdiendo el control de lo que se usa para entrenar los modelos. ¿Habrá una compensación justa para quienes contribuyeron? No quiero que esto se convierta en otro caso de 'big tech' aprovechándose de 'datos gratis'...
이런 연구는 AI 데이터 기여자들에게 공정한 보상을 제공하는 데 중요한 단계가 될 수 있겠네요. 😊 근데 MS가 과연 저작권 문제를 해결할 수 있을지 의문이 드네요. 데이터 소싱 방식이 좀 더 투명해져야 할 시점인 것 같아요!
This is super intriguing! Microsoft's diving into how AI training data shapes outputs—mind-blowing stuff. Wonder how they'll credit contributors fairly? 🤔
This Microsoft AI project sounds intriguing! Crediting data contributors could reshape how we value creative input in AI. Curious to see if it'll spark ethical debates or just be a tech flex. 🤔

Microsoft está iniciando un nuevo proyecto de investigación destinado a comprender cómo ejemplos de entrenamiento específicos influyen en los resultados de modelos de IA generativa, como texto, imágenes y otros medios. Esta iniciativa se destacó en una oferta de empleo de diciembre que recientemente resurgió en LinkedIn, buscando un interno de investigación para unirse al esfuerzo.
El objetivo del proyecto es desarrollar un método para entrenar modelos de modo que el impacto de datos particulares, como fotos y libros, en sus resultados pueda ser "estimado de manera eficiente y útil". La oferta de empleo señala que las arquitecturas actuales de redes neuronales carecen de transparencia para rastrear los orígenes de sus resultados, y hay razones convincentes para abordar este problema. Una razón mencionada es la posibilidad de ofrecer incentivos, reconocimiento e incluso compensación a individuos que aporten datos valiosos a futuros modelos de IA.
El trasfondo de esta investigación son las batallas legales en curso que involucran a empresas de IA, incluido Microsoft, sobre derechos de propiedad intelectual. Los modelos de IA a menudo se entrenan con vastos conjuntos de datos extraídos de sitios web públicos, que pueden incluir material protegido por derechos de autor. Mientras las empresas de IA suelen reclamar protección bajo la doctrina de uso justo, creadores de diversos campos—artistas, programadores, autores—cuestionan esta postura.
Microsoft enfrenta actualmente desafíos legales, incluida una demanda de The New York Times, que alega que Microsoft y OpenAI infringieron sus derechos de autor al usar sus artículos para entrenar sus modelos. Además, varios desarrolladores de software han demandado a Microsoft por su asistente de codificación GitHub Copilot AI, alegando que fue entrenado con su código protegido por derechos de autor.
El proyecto de investigación, denominado "training-time provenance", involucra a Jaron Lanier, un destacado tecnólogo en Microsoft Research. Lanier ha escrito previamente sobre "data dignity", abogando por un sistema que conecte el contenido digital con sus creadores y potencialmente los compense por sus contribuciones a los resultados de IA.
Aunque el proyecto de Microsoft está en sus primeras etapas, otras empresas como Bria, Adobe y Shutterstock ya están experimentando con la compensación a propietarios de datos basada en sus contribuciones a modelos de IA. Sin embargo, los grandes laboratorios de IA generalmente no han establecido programas de pago para colaboradores individuales, optando en cambio por acuerdos de licencia o mecanismos de exclusión para titulares de derechos de autor, que pueden ser engorrosos y limitados en alcance.
La iniciativa de Microsoft podría permanecer como una prueba de concepto, similar a la herramienta aún no lanzada de OpenAI para que los creadores controlen cómo se usan sus obras en los datos de entrenamiento. También hay especulaciones de que Microsoft podría estar intentando "lavar éticamente" sus prácticas de IA o anticiparse a desafíos regulatorios y legales.
Este movimiento de Microsoft es particularmente notable dado los recientes llamados de otros laboratorios de IA, como Google y OpenAI, para que el gobierno de EE. UU. relaje las protecciones de derechos de autor para el desarrollo de IA. Microsoft aún no ha respondido a solicitudes de comentarios sobre este proyecto.
Las acciones de EE. UU. alcanzan un hito histórico mientras gigantes de la IA y la aeroespacial se preparan para su debut de un billón de dólares
Elon Musk, Sam Altman y Dario Amodei, tres titanes del sector tecnológico, están avanzando hacia ofertas públicas iniciales para sus respectivas empresas. Con SpaceX, OpenAI y Anthropic, tres gigantes de la industria que se acercan a valoraciones de
La startup sueca de inteligencia artificial Lovable Eyes alcanza una valoración de 13.200 millones de dólares tras una importante ronda de financiación
Mientras las herramientas de codificación impulsadas por inteligencia artificial ganan terreno, la startup sueca Lovable ha asegurado una importante ronda de financiación. La empresa tiene como objetivo recaudar 3 000 millones de dólares, lo que podr
Interesante proyecto, pero lo que realmente necesito es que alguien en la IA me explique por qué mi asistente virtual aún no puede organizarme el escritorio 😅. ¿Esto de la atribución podría cambiar cómo las empresas comparten datos? Me preocupa un poco la transparencia de todo el proceso. Ojalá no sea solo un gesto de relaciones públicas.
Lo de Microsoft parece interesante pero, ¿y la privacidad de los datos? 🤔 A veces siento que con toda esta exploración de IA, estamos perdiendo el control de lo que se usa para entrenar los modelos. ¿Habrá una compensación justa para quienes contribuyeron? No quiero que esto se convierta en otro caso de 'big tech' aprovechándose de 'datos gratis'...
이런 연구는 AI 데이터 기여자들에게 공정한 보상을 제공하는 데 중요한 단계가 될 수 있겠네요. 😊 근데 MS가 과연 저작권 문제를 해결할 수 있을지 의문이 드네요. 데이터 소싱 방식이 좀 더 투명해져야 할 시점인 것 같아요!
This is super intriguing! Microsoft's diving into how AI training data shapes outputs—mind-blowing stuff. Wonder how they'll credit contributors fairly? 🤔
This Microsoft AI project sounds intriguing! Crediting data contributors could reshape how we value creative input in AI. Curious to see if it'll spark ethical debates or just be a tech flex. 🤔





Hogar






