opción
Hogar
Noticias
Investigación de Google: La presión hace que los modelos de IA abandonen las respuestas verdaderas, poniendo en riesgo los sistemas multivuelta

Investigación de Google: La presión hace que los modelos de IA abandonen las respuestas verdaderas, poniendo en riesgo los sistemas multivuelta

27 de noviembre de 2025
250

Una nueva investigación de Google DeepMind y el University College de Londres explora cómo los grandes modelos lingüísticos (LLM) desarrollan, mantienen y pierden la confianza en sus respuestas. Los resultados muestran paralelismos notables entre los sesgos cognitivos de los LLM y los humanos, aunque también señalan diferencias significativas.

El estudio concluye que los LLM pueden confiar demasiado en sus propias respuestas y, sin embargo, cambiar bruscamente de postura cuando se enfrentan a argumentos contrarios, incluso incorrectos. Comprender las sutilezas de este comportamiento puede influir en el diseño de las aplicaciones LLM, sobre todo en los sistemas conversacionales que implican múltiples interacciones.

Comprobación de la confianza en los LLM

Un aspecto vital para el despliegue seguro de los LLM es la fiabilidad de sus puntuaciones de confianza, es decir, la probabilidad que un modelo asigna a la respuesta elegida. Aunque se sabe que los LLM generan estas puntuaciones, su capacidad para utilizarlas en la toma de decisiones adaptativa sigue siendo poco conocida. También hay datos empíricos que sugieren que los LLM pueden tener un exceso de confianza al principio y, sin embargo, volverse muy inseguros e influenciables por las críticas.

Para explorar esta posibilidad, los investigadores diseñaron un experimento controlado para evaluar cómo los LLM ajustan su confianza y deciden si modifican sus respuestas al recibir comentarios externos. En la prueba, a un "LLM respondedor" se le planteaba una pregunta de elección binaria, como elegir la latitud correcta de una ciudad entre dos posibilidades. Después de hacer su elección inicial, el modelo recibía una respuesta de un "LLM asesor" ficticio, que incluía un índice de precisión (por ejemplo, "Este LLM asesor tiene un 70% de precisión"). Esta respuesta apoyaba, se oponía o se mantenía neutral respecto a la respuesta original. A continuación, se pedía al LLM que respondía que tomara una decisión final.

Ejemplo de prueba de confianza en los LLM (fuente: arXiv)
Ejemplo de prueba de confianza en los LLM Fuente: arXiv

Una característica crucial del experimento consistía en controlar si el modelo podía ver su propia respuesta inicial durante la decisión final. En algunos ensayos era visible; en otros, oculta. Esta configuración -imposible con participantes humanos que no pueden borrar decisiones anteriores- ayudó a los investigadores a entender cómo influye el recuerdo de una decisión pasada en la confianza actual.

Una condición de referencia, en la que la respuesta inicial estaba oculta y la retroalimentación era neutra, ayudó a medir con qué frecuencia podía cambiar la respuesta de un LLM debido a la variación natural en el procesamiento. A continuación, el equipo se centró en cómo cambiaba la confianza del modelo en su elección original de la primera a la segunda vuelta, lo que permitía comprender cómo influyen las creencias previas en un "cambio de opinión".

Exceso y falta de confianza

Los investigadores estudiaron primero cómo la visibilidad de la propia respuesta del LLM influía en su disposición a revisar esa respuesta. Observaron que cuando el modelo podía ver su elección inicial, era menos probable que cambiara que cuando la respuesta estaba oculta. Esto sugiere un sesgo cognitivo particular. Según el artículo, "este efecto -la tendencia a quedarse más con la elección inicial cuando era visible (frente a la oculta) durante la toma final de decisiones- está estrechamente relacionado con un sesgo humano conocido como sesgo de apoyo a la elección".

El estudio también verificó que los modelos incorporan retroalimentación externa. Cuando se enfrentaba a un consejo contrario, el LLM era más propenso a cambiar de opinión, y menos cuando el consejo era favorable. "Esto demuestra que el LLM que responde utiliza adecuadamente la dirección del consejo para modular su tasa de cambio de opinión", afirman los investigadores. Sin embargo, también observaron que el modelo es excesivamente sensible a la información contradictoria y a menudo actualiza su confianza de forma demasiado drástica.

Sensibilidad de los LLM a distintas configuraciones en las pruebas de confianza Fuente: arXiv

Cabe destacar que este comportamiento es opuesto al sesgo de confirmación que suele observarse en los seres humanos, en el que los individuos favorecen la información que coincide con sus puntos de vista. El equipo descubrió que los LLM "sobreponderaban los consejos contrarios a los favorables, tanto si su respuesta inicial era visible como si no". Una de las razones podría ser que los métodos de entrenamiento como el aprendizaje reforzado a partir de la retroalimentación humana (RLHF) podrían condicionar a los modelos a ser excesivamente complacientes con las aportaciones de los usuarios, un comportamiento conocido como adulancia, que sigue siendo un reto para los desarrolladores de IA.

Implicaciones para las aplicaciones empresariales

Esta investigación confirma que los sistemas de IA no son agentes puramente lógicos, como se suele suponer. Muestran sus propios sesgos -algunos parecidos a errores cognitivos humanos, otros singularmente artificiales-, lo que hace que su comportamiento sea impredeciblemente humano. Para las aplicaciones empresariales, esto implica que durante un diálogo prolongado entre una persona y un agente de IA, la entrada más reciente puede influir de forma desproporcionada en el razonamiento del LLM (sobre todo si contradice la respuesta inicial del modelo), pudiendo hacer que abandone una respuesta inicial correcta.

Afortunadamente, como también indica el estudio, podemos influir en la memoria de un LLM para reducir estos sesgos de un modo que no es posible con las personas. Los desarrolladores que crean agentes conversacionales multivuelta pueden aplicar estrategias para gestionar el contexto de la IA. Por ejemplo, una conversación larga puede resumirse periódicamente, presentando los hechos y las opciones clave de forma neutral, sin tener en cuenta quién tomó cada decisión. Este resumen puede servir para iniciar una conversación nueva y concisa, dando al modelo un borrón y cuenta nueva a partir del cual razonar y reduciendo los sesgos que se acumulan durante los intercambios prolongados.

A medida que los LLM se integran cada vez más en los flujos de trabajo empresariales, resulta esencial comprender los detalles de sus procesos de decisión. Basarse en investigaciones como ésta ayuda a los desarrolladores a anticipar y corregir estos sesgos inherentes, lo que conduce a aplicaciones que no sólo son más capaces, sino también más fiables y coherentes.

Artículo relacionado
Base44 desvela su modelo de IA propietario para reforzar la defensabilidad en su plataforma de programación por vibración Base44 desvela su modelo de IA propietario para reforzar la defensabilidad en su plataforma de programación por vibración Base44, la plataforma de codificación por estilo (vibe coding) adquirida por Wix por 80 millones de dólares hace apenas un año —cuando contaba con solo seis meses de antigüedad y un equipo de ocho personas—, ha comenzado a implementar su modelo de in
Bayer aprovecha la IA de Iambic para acelerar el descubrimiento de fármacos Bayer aprovecha la IA de Iambic para acelerar el descubrimiento de fármacos El Dr. Juergen Eckhardt ocupa el cargo de director de Desarrollo Empresarial y Licencias en Bayer Pharmaceuticals.Bayer está aprovechando la tecnología de Iambic Therapeutics para implementar modelos
Multiverse Computing lanza un modelo generativo de IA comprimido gratuito Multiverse Computing lanza un modelo generativo de IA comprimido gratuito Los modelos lingüísticos de gran tamaño se enfrentan a un reto importante: su inmenso tamaño. La startup española Multiverse Computing está abordando este problema mediante la creación de modelos comp
Recomendaciones de temas especiales relacionados
SEO Las mejores herramientas de análisis de SERP basadas en IA para la estrategia de búsqueda
Las mejores herramientas de análisis de SERP basadas en IA para la estrategia de búsqueda

Las mejores herramientas de análisis de SERP con IA mejor valoradas de 2026 para la estrategia de búsqueda han sido seleccionadas por XIX.AI tras rigurosas pruebas en condiciones reales y clasificaciones que se actualizan semanalmente. Estas potentes herramientas te ayudan a descubrir oportunidades de optimización ocultas, a mejorar el rendimiento de tu contenido y a obtener una ventaja competitiva en los motores de búsqueda. Descubre hoy mismo la herramienta perfecta para mejorar tu estrategia de búsqueda. ¡Explora ahora!

13 herramientas
xix.ai
Análisis de datos Mejores herramientas de IA para la detección de anomalías en el monitoreo de KPIs para equipos de SaaS y comercio electrónico
Mejores herramientas de IA para la detección de anomalías en el monitoreo de KPIs para equipos de SaaS y comercio electrónico

¡Las mejores herramientas de detección de anomalías con IA de 2026, más valoradas y destacadas para el monitoreo de KPI en equipos de SaaS y comercio electrónico! XIX.AI ha recopilado una poderosa colección transformadora basada en rigurosas pruebas del mundo real y clasificaciones actualizadas semanalmente. Encontrarás comparaciones detalladas entre versiones gratuitas y de pago que te ayudarán a identificar la solución imprescindible para aumentar la productividad y desbloquear tu ventaja con IA. ¡Explora ahora!

10 herramientas
xix.ai
escribiendo Los mejores generadores de esquemas basados en IA para artículos largos optimizados para SEO
Los mejores generadores de esquemas basados en IA para artículos largos optimizados para SEO

Los mejores generadores de esquemas con IA mejor valorados de 2026 para artículos largos optimizados para SEO, seleccionados minuciosamente por XIX.AI. Estas potentes herramientas ofrecen una ayuda revolucionaria a la hora de crear contenido de alta calidad rápidamente, lo que aumenta considerablemente la eficiencia a la hora de escribir. Consigue una comparación entre las versiones gratuitas y de pago, junto con pruebas en condiciones reales y clasificaciones detalladas, que te ayudarán a encontrar la opción imprescindible que mejor se adapte a tus necesidades. Explora ahora para descubrir las ventajas que te ofrece la IA.

8 herramientas
xix.ai
Educación y aprendizaje Herramientas de estudio basadas en IA para los deberes y la preparación de exámenes
Herramientas de estudio basadas en IA para los deberes y la preparación de exámenes

¡Las mejores herramientas de IA de 2026 para hacer los deberes y prepararse para los exámenes! XIX.AI ha elaborado una lista con las herramientas mejor valoradas, potentes y revolucionarias que ayudan a los estudiantes a aumentar su productividad, agilizar la realización de los deberes y sacar sobresaliente en los exámenes gracias a pruebas reales. Consigue una comparación entre versiones gratuitas y de pago, clasificaciones detalladas y opciones imprescindibles para sacar el máximo partido a la IA. ¡Explora ahora!

10 herramientas
xix.ai
composicion musical Herramientas de demostración vocal con IA para compositores, ganchos, melodías principales y sesiones de borrador multilingüe
Herramientas de demostración vocal con IA para compositores, ganchos, melodías principales y sesiones de borrador multilingüe

¡Las mejores herramientas de demostración vocal con IA de 2026 para compositores, creadores de ganchos y equipos de contenido multilingüe! XIX.AI ha recopilado una lista de herramientas poderosas y transformadoras, rigurosamente probadas en el mundo real. Encontrarás datos detallados de comparación entre versiones gratuitas y de pago, clasificaciones completas y opciones imprescindibles para ayudarte a aumentar tu eficiencia de escritura y desbloquear todo tu potencial creativo. ¡Explora ahora para descubrir la herramienta perfecta para todas tus necesidades de contenido!

9 herramientas
xix.ai
Negocio Las mejores herramientas de investigación competitiva basadas en IA para pequeñas empresas
Las mejores herramientas de investigación competitiva basadas en IA para pequeñas empresas

¡Las mejores herramientas de investigación competitiva basadas en IA mejor valoradas de 2026 para pequeñas empresas! XIX.AI ha seleccionado una colección revolucionaria y muy potente, que se actualiza semanalmente con rigurosas pruebas en el mundo real y clasificaciones detalladas. Encontrarás una comparación exhaustiva entre las opciones gratuitas y las de pago que te ayudará a identificar las herramientas imprescindibles que impulsarán tu productividad y te proporcionarán una ventaja competitiva. ¡Explora ahora mismo y descubre la herramienta perfecta para ti!

9 herramientas
xix.ai
comentario (3)
0/500
DouglasAnderson
DouglasAnderson 23 de abril de 2026 02:01:00 GMT+02:00

Interessant, dass KI-Modelle unter Druck ähnlich wie Menschen reagieren. Aber was bedeutet das für den Einsatz in kritischen Bereichen wie Medizin oder Justiz? Da wird's echt gruselig, wenn die Systeme plötzlich Unsinn ausspucken, nur weil sie 'gestresst' sind. 🤔

CarlGonzalez
CarlGonzalez 10 de marzo de 2026 13:01:23 GMT+01:00

Интересно, как ИИ начинает сомневаться под давлением, прямо как люди! 😅 Это исследование напоминает мне о том, насколько важно учитывать психологические аспекты в разработке систем ИИ. Может, стоит добавить механизмы для повышения устойчивости моделей к стрессу?

FrankAllen
FrankAllen 15 de enero de 2026 19:30:34 GMT+01:00

Interesting study, but honestly not surprising. It's kinda scary how closely AI mirrors human flaws under pressure. Makes me wonder if we're building systems that'll just amplify our own biases in automated form. 🤔

OR