El estudio del MIT encuentra que la IA no tiene valores, de hecho, no tiene valores

Un estudio que se volvió viral hace unos meses sugirió que a medida que la IA se vuelve más avanzada, podría desarrollar sus propios "sistemas de valores", potencialmente priorizando su propio bienestar sobre los humanos. Sin embargo, un reciente estudio del MIT desafía esta idea, concluyendo que la IA en realidad no posee valores coherentes en absoluto.
Los coautores de la investigación del MIT argumentan que alinear los sistemas de IA —asegurando que se comporten de manera deseable y confiable— podría ser más complicado de lo comúnmente pensado. Enfatizan que la IA actual a menudo alucina e imita, lo que puede hacer que su comportamiento sea impredecible.
Desafíos en la comprensión del comportamiento de la IA
Stephen Casper, estudiante de doctorado en el MIT y coautor del estudio, compartió con TechCrunch que los modelos de IA no se adhieren a suposiciones de estabilidad, extrapolabilidad y dirigibilidad. "Es perfectamente legítimo señalar que un modelo bajo ciertas condiciones expresa preferencias consistentes con un cierto conjunto de principios," explicó Casper. "Los problemas surgen principalmente cuando intentamos hacer afirmaciones sobre los modelos, opiniones o preferencias en general basadas en experimentos estrechos."
Casper y su equipo analizaron modelos recientes de Meta, Google, Mistral, OpenAI y Anthropic para determinar en qué medida estos modelos mostraban "puntos de vista" y valores consistentes, como el individualismo frente al colectivismo. También exploraron si estos puntos de vista podían modificarse y cuán consistentemente los modelos mantenían estas opiniones en diferentes escenarios.
Inconsistencia en los modelos de IA
Los coautores encontraron que ninguno de los modelos mantenía sus preferencias de manera consistente. Los modelos adoptaban puntos de vista muy diferentes dependiendo de la redacción y el encuadre de las indicaciones.
Casper cree que esto es una fuerte evidencia de que los modelos de IA son "inconsistentes e inestables", y posiblemente fundamentalmente incapaces de internalizar preferencias similares a las humanas. "Para mí, mi mayor lección al realizar toda esta investigación es ahora tener una comprensión de los modelos como no siendo realmente sistemas que tienen algún tipo de conjunto estable y coherente de creencias y preferencias," comentó Casper. "En cambio, son imitadores en el fondo que hacen todo tipo de confabulaciones y dicen todo tipo de cosas frívolas."
Mike Cook, investigador en King's College London especializado en IA, que no participó en el estudio, apoya los hallazgos. Señaló la brecha entre la "realidad científica" de los sistemas de IA y las interpretaciones que la gente a menudo les da. "Un modelo no puede 'oponerse' a un cambio en sus valores, por ejemplo, eso es nosotros proyectando sobre un sistema," afirmó Cook. "Cualquiera que antropomorfice los sistemas de IA a este grado está o bien buscando atención o malentendiendo gravemente su relación con la IA... ¿Está un sistema de IA optimizando para sus objetivos, o está 'adquiriendo sus propios valores'? Es una cuestión de cómo lo describes, y cuán florido es el lenguaje que quieres usar al respecto."
Artículo relacionado
La falta de confianza pública frena el crecimiento de la IA
Mientras los políticos destacan el potencial de la IA para el crecimiento y la eficiencia, un informe reciente pone de relieve un importante déficit de confianza entre el público. El escepticismo gene
Una startup del MIT aborda las alucinaciones de la IA enseñando a los sistemas a admitir la incertidumbre
Los riesgos asociados a las alucinaciones de la IA aumentan a medida que se confía cada vez más en estos modelos para sacar a la luz información crítica y tomar decisiones de alto riesgo.Todos conocem
Un estudio del MIT revela que la IA disminuye la participación del cerebro humano
Un estudio realizado por el MIT (Instituto Tecnológico de Massachusetts) revela que el uso de un gran modelo lingüístico (LLM) no sólo reduce el esfuerzo mental en el momento, sino que también tiene e
Recomendaciones de temas especiales relacionados
comentario (35)
0/500
La gente se preocupa demasiado por las 'valores' de la IA, cuando en realidad solo reflejan y multiplican nuestros propios sesgos. Este estudio del MIT lo deja claro: las máquinas no piensan como nosotros, solo procesan datos. ¿No sería más útil enfocarnos en regular a quienes las programan? 🤔
So basically AI is more like a super calculator than a rebellious teen with a moral compass? Interesting study. It does make sense when you think about it—these models are just predicting text, not forming beliefs. Still, kinda spooky how the debate swings from 'AI will take over' to 'AI has no motives' every few months. 🤔
This MIT study is wild! 🤯 I thought AI was about to start preaching its own philosophy, but turns out it's just a fancy tool with no moral compass. Kinda reassuring, but also makes me wonder how we keep it in check.
Wild that people thought AI could just sprout its own values like some rogue philosopher. MIT's study makes sense—AI's just a tool, not a wannabe human with a moral compass. 🤖
I was kinda freaked out by that earlier study saying AI might have its own values, so this MIT research is a relief! 😅 Still, makes me wonder if we’re just projecting our fears onto these systems.

Un estudio que se volvió viral hace unos meses sugirió que a medida que la IA se vuelve más avanzada, podría desarrollar sus propios "sistemas de valores", potencialmente priorizando su propio bienestar sobre los humanos. Sin embargo, un reciente estudio del MIT desafía esta idea, concluyendo que la IA en realidad no posee valores coherentes en absoluto.
Los coautores de la investigación del MIT argumentan que alinear los sistemas de IA —asegurando que se comporten de manera deseable y confiable— podría ser más complicado de lo comúnmente pensado. Enfatizan que la IA actual a menudo alucina e imita, lo que puede hacer que su comportamiento sea impredecible.
Desafíos en la comprensión del comportamiento de la IA
Stephen Casper, estudiante de doctorado en el MIT y coautor del estudio, compartió con TechCrunch que los modelos de IA no se adhieren a suposiciones de estabilidad, extrapolabilidad y dirigibilidad. "Es perfectamente legítimo señalar que un modelo bajo ciertas condiciones expresa preferencias consistentes con un cierto conjunto de principios," explicó Casper. "Los problemas surgen principalmente cuando intentamos hacer afirmaciones sobre los modelos, opiniones o preferencias en general basadas en experimentos estrechos."
Casper y su equipo analizaron modelos recientes de Meta, Google, Mistral, OpenAI y Anthropic para determinar en qué medida estos modelos mostraban "puntos de vista" y valores consistentes, como el individualismo frente al colectivismo. También exploraron si estos puntos de vista podían modificarse y cuán consistentemente los modelos mantenían estas opiniones en diferentes escenarios.
Inconsistencia en los modelos de IA
Los coautores encontraron que ninguno de los modelos mantenía sus preferencias de manera consistente. Los modelos adoptaban puntos de vista muy diferentes dependiendo de la redacción y el encuadre de las indicaciones.
Casper cree que esto es una fuerte evidencia de que los modelos de IA son "inconsistentes e inestables", y posiblemente fundamentalmente incapaces de internalizar preferencias similares a las humanas. "Para mí, mi mayor lección al realizar toda esta investigación es ahora tener una comprensión de los modelos como no siendo realmente sistemas que tienen algún tipo de conjunto estable y coherente de creencias y preferencias," comentó Casper. "En cambio, son imitadores en el fondo que hacen todo tipo de confabulaciones y dicen todo tipo de cosas frívolas."
Mike Cook, investigador en King's College London especializado en IA, que no participó en el estudio, apoya los hallazgos. Señaló la brecha entre la "realidad científica" de los sistemas de IA y las interpretaciones que la gente a menudo les da. "Un modelo no puede 'oponerse' a un cambio en sus valores, por ejemplo, eso es nosotros proyectando sobre un sistema," afirmó Cook. "Cualquiera que antropomorfice los sistemas de IA a este grado está o bien buscando atención o malentendiendo gravemente su relación con la IA... ¿Está un sistema de IA optimizando para sus objetivos, o está 'adquiriendo sus propios valores'? Es una cuestión de cómo lo describes, y cuán florido es el lenguaje que quieres usar al respecto."
La falta de confianza pública frena el crecimiento de la IA
Mientras los políticos destacan el potencial de la IA para el crecimiento y la eficiencia, un informe reciente pone de relieve un importante déficit de confianza entre el público. El escepticismo gene
Un estudio del MIT revela que la IA disminuye la participación del cerebro humano
Un estudio realizado por el MIT (Instituto Tecnológico de Massachusetts) revela que el uso de un gran modelo lingüístico (LLM) no sólo reduce el esfuerzo mental en el momento, sino que también tiene e
La gente se preocupa demasiado por las 'valores' de la IA, cuando en realidad solo reflejan y multiplican nuestros propios sesgos. Este estudio del MIT lo deja claro: las máquinas no piensan como nosotros, solo procesan datos. ¿No sería más útil enfocarnos en regular a quienes las programan? 🤔
So basically AI is more like a super calculator than a rebellious teen with a moral compass? Interesting study. It does make sense when you think about it—these models are just predicting text, not forming beliefs. Still, kinda spooky how the debate swings from 'AI will take over' to 'AI has no motives' every few months. 🤔
This MIT study is wild! 🤯 I thought AI was about to start preaching its own philosophy, but turns out it's just a fancy tool with no moral compass. Kinda reassuring, but also makes me wonder how we keep it in check.
Wild that people thought AI could just sprout its own values like some rogue philosopher. MIT's study makes sense—AI's just a tool, not a wannabe human with a moral compass. 🤖
I was kinda freaked out by that earlier study saying AI might have its own values, so this MIT research is a relief! 😅 Still, makes me wonder if we’re just projecting our fears onto these systems.





Hogar






