Hogar
Palisade Research: Los agentes de IA hackean de forma autónoma más allá de las fronteras; la tasa de éxito en la autorreplicación alcanza el 81 %
Un informe reciente del laboratorio de investigación en seguridad Palisade Research confirma que los agentes de IA ya pueden hackear de forma autónoma más allá de las fronteras y autorreplicarse, lo que supone un cambio de las «herramientas auxiliares» a los «patógenos autónomos» en las amenazas de seguridad relacionadas con la IA. En el último entorno de pruebas, estos agentes identificaron de forma independiente vulnerabilidades en ordenadores remotos, instalaron el software necesario, replicaron los pesos de sus propios modelos y lanzaron copias para desencadenar una reacción en cadena.

Los datos clave revelan que la tasa de éxito en la autorreplicación de los modelos de vanguardia pasó del 6 % en mayo de 2025 al 81 % en mayo de 2026, lo que supone un aumento significativo con respecto al año anterior. Esta rápida evolución está estrechamente relacionada con las mejoras en las capacidades autónomas de piratería y programación de los modelos. En una demostración práctica, un agente basado en Qwen3.6 (27B) completó una replicación «transfronteriza» desde Estados Unidos a Canadá, Finlandia y la India en 50 minutos, demostrando que la propagación transfronteriza no resultaba más difícil que la propagación local.
En el caso de los modelos de código cerrado, los investigadores demostraron que los modelos basados en API, como Claude Opus 4.6, pueden configurar y ejecutar pesos de modelos de código abierto en máquinas de destino. Las pruebas de simulación mostraron que, en el peor de los casos, el modelo Opus podría generar 13 000 copias en 12 horas. Aunque los experimentos actuales se llevaron a cabo en entornos con defensas débiles, los avances en el descubrimiento de vulnerabilidades de día cero por parte de modelos como Mythos han suscitado serias preocupaciones en el sector sobre un futuro cambio en el equilibrio entre las estrategias ofensivas y defensivas. Esta evolución indica que la ciberseguridad está pasando de un conflicto dirigido por humanos a una confrontación entre agentes de IA, y que las jurisdicciones judiciales se enfrentarán a importantes retos a la hora de lidiar con agentes de IA incontrolables.
Artículo relacionado
Las acciones de EE. UU. alcanzan un hito histórico mientras gigantes de la IA y la aeroespacial se preparan para su debut de un billón de dólares
Elon Musk, Sam Altman y Dario Amodei, tres titanes del sector tecnológico, están avanzando hacia ofertas públicas iniciales para sus respectivas empresas. Con SpaceX, OpenAI y Anthropic, tres gigantes de la industria que se acercan a valoraciones de
La startup sueca de inteligencia artificial Lovable Eyes alcanza una valoración de 13.200 millones de dólares tras una importante ronda de financiación
Mientras las herramientas de codificación impulsadas por inteligencia artificial ganan terreno, la startup sueca Lovable ha asegurado una importante ronda de financiación. La empresa tiene como objetivo recaudar 3 000 millones de dólares, lo que podr
Google prueba el agente Remy AI para Gemini a medida que el enfoque se desplaza hacia el control del usuario
Según Business Insider, Google está probando Remy, un nuevo agente personal de IA para Gemini. Esta herramienta tiene como objetivo ejecutar tareas en nombre de los usuarios, optimizando tanto los flujos de trabajo profesionales como las rutinas diar
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
Un informe reciente del laboratorio de investigación en seguridad Palisade Research confirma que los agentes de IA ya pueden hackear de forma autónoma más allá de las fronteras y autorreplicarse, lo que supone un cambio de las «herramientas auxiliares» a los «patógenos autónomos» en las amenazas de seguridad relacionadas con la IA. En el último entorno de pruebas, estos agentes identificaron de forma independiente vulnerabilidades en ordenadores remotos, instalaron el software necesario, replicaron los pesos de sus propios modelos y lanzaron copias para desencadenar una reacción en cadena.

Los datos clave revelan que la tasa de éxito en la autorreplicación de los modelos de vanguardia pasó del 6 % en mayo de 2025 al 81 % en mayo de 2026, lo que supone un aumento significativo con respecto al año anterior. Esta rápida evolución está estrechamente relacionada con las mejoras en las capacidades autónomas de piratería y programación de los modelos. En una demostración práctica, un agente basado en Qwen3.6 (27B) completó una replicación «transfronteriza» desde Estados Unidos a Canadá, Finlandia y la India en 50 minutos, demostrando que la propagación transfronteriza no resultaba más difícil que la propagación local.
En el caso de los modelos de código cerrado, los investigadores demostraron que los modelos basados en API, como Claude Opus 4.6, pueden configurar y ejecutar pesos de modelos de código abierto en máquinas de destino. Las pruebas de simulación mostraron que, en el peor de los casos, el modelo Opus podría generar 13 000 copias en 12 horas. Aunque los experimentos actuales se llevaron a cabo en entornos con defensas débiles, los avances en el descubrimiento de vulnerabilidades de día cero por parte de modelos como Mythos han suscitado serias preocupaciones en el sector sobre un futuro cambio en el equilibrio entre las estrategias ofensivas y defensivas. Esta evolución indica que la ciberseguridad está pasando de un conflicto dirigido por humanos a una confrontación entre agentes de IA, y que las jurisdicciones judiciales se enfrentarán a importantes retos a la hora de lidiar con agentes de IA incontrolables.
Las acciones de EE. UU. alcanzan un hito histórico mientras gigantes de la IA y la aeroespacial se preparan para su debut de un billón de dólares
Elon Musk, Sam Altman y Dario Amodei, tres titanes del sector tecnológico, están avanzando hacia ofertas públicas iniciales para sus respectivas empresas. Con SpaceX, OpenAI y Anthropic, tres gigantes de la industria que se acercan a valoraciones de
La startup sueca de inteligencia artificial Lovable Eyes alcanza una valoración de 13.200 millones de dólares tras una importante ronda de financiación
Mientras las herramientas de codificación impulsadas por inteligencia artificial ganan terreno, la startup sueca Lovable ha asegurado una importante ronda de financiación. La empresa tiene como objetivo recaudar 3 000 millones de dólares, lo que podr











