Hogar
Anthropic amplía el control sobre el código de Claude, pero mantiene ciertas restricciones

Para los desarrolladores que recurren a la IA, el enfoque actual de la «programación intuitiva» suele implicar o bien supervisar de cerca cada acción, o bien dar rienda suelta al modelo. Anthropic afirma que su última actualización de Claude elimina ese dilema al permitir que la IA decida de forma autónoma qué acciones son seguras de ejecutar, dentro de ciertos límites.
Esta iniciativa refleja una tendencia más amplia del sector, en la que se están creando herramientas de IA para que actúen sin necesidad de aprobación humana en cada paso. El principal reto es encontrar el equilibrio entre la rapidez y la supervisión: unas medidas de seguridad excesivas ralentizan el progreso, mientras que unas medidas insuficientes pueden dar lugar a comportamientos impredecibles y arriesgados. El nuevo «modo automático» de Anthropic, actualmente en fase de vista previa de investigación —lo que significa que está disponible para pruebas, pero aún no es un producto definitivo—, es su último esfuerzo por alcanzar este equilibrio.
El «modo automático» emplea medidas de seguridad basadas en IA para examinar cada acción antes de su ejecución, buscando comportamientos de riesgo no solicitados y signos de «prompt injection» —una técnica de ataque en la que se incrustan instrucciones maliciosas en el contenido que se está procesando, engañando a la IA para que realice acciones no deseadas—. Las acciones consideradas seguras se llevan a cabo automáticamente, mientras que las de riesgo se bloquean.
Se trata, en esencia, de una ampliación del comando ya existente de Claude Code «dangerously-skip-permissions», que delega toda la toma de decisiones a la IA, pero con una capa de seguridad adicional.
La función se basa en el reciente auge de las herramientas de programación autónoma de empresas como GitHub y OpenAI, que pueden llevar a cabo tareas en nombre de los desarrolladores. Sin embargo, va un paso más allá al trasladar la decisión de cuándo solicitar permiso al usuario a la propia IA.
Anthropic no ha revelado los criterios específicos que utiliza su capa de seguridad para diferenciar las acciones seguras de las arriesgadas —detalles que los desarrolladores probablemente querrán comprender con mayor claridad antes de adoptar ampliamente la función—. (TechCrunch se ha puesto en contacto con la empresa para obtener más información al respecto).
El modo automático llega tras el lanzamiento por parte de Anthropic de «Claude Code Review», un revisor automático de código que detecta errores antes de que lleguen al código base, y de «Dispatch for Cowork», que permite a los usuarios asignar tareas a agentes de IA para que se encarguen del trabajo en su nombre.
El modo automático se pondrá a disposición de los usuarios de Enterprise y API en los próximos días. La empresa afirma que, actualmente, funciona exclusivamente con Claude Sonnet 4.6 y Opus 4.6, y recomienda utilizar la nueva función en «entornos aislados» —configuraciones en entornos de prueba separadas de los sistemas de producción—, lo que minimiza los posibles daños si algo sale mal.
Artículo relacionado
Google prueba el agente Remy AI para Gemini a medida que el enfoque se desplaza hacia el control del usuario
Según Business Insider, Google está probando Remy, un nuevo agente personal de IA para Gemini. Esta herramienta tiene como objetivo ejecutar tareas en nombre de los usuarios, optimizando tanto los flujos de trabajo profesionales como las rutinas diar
Anthropic entra en el mercado de tecnología legal de IA mientras se intensifica la competencia
Anthropic presentó el martes un conjunto de nuevas capacidades de chatbot, destinadas a brindar soporte automatizado a despachos de abogados. Estas mejoras amplían Claude for Legal, la plataforma específica para firmas introducida a principios de est
OpenAI cierra la brecha con Anthropic entre los usuarios empresariales, según nuevos datos
Con OpenAI y Anthropic aún lejos de sus esperadas ofertas públicas iniciales (IPO) y de la publicación de informes financieros detallados, debemos recurrir a indicadores alternativos para evaluar su desempeño empresarial. Ramp, una plataforma de tarj
Recomendaciones de temas especiales relacionados
comentario (0)
0/500

Para los desarrolladores que recurren a la IA, el enfoque actual de la «programación intuitiva» suele implicar o bien supervisar de cerca cada acción, o bien dar rienda suelta al modelo. Anthropic afirma que su última actualización de Claude elimina ese dilema al permitir que la IA decida de forma autónoma qué acciones son seguras de ejecutar, dentro de ciertos límites.
Esta iniciativa refleja una tendencia más amplia del sector, en la que se están creando herramientas de IA para que actúen sin necesidad de aprobación humana en cada paso. El principal reto es encontrar el equilibrio entre la rapidez y la supervisión: unas medidas de seguridad excesivas ralentizan el progreso, mientras que unas medidas insuficientes pueden dar lugar a comportamientos impredecibles y arriesgados. El nuevo «modo automático» de Anthropic, actualmente en fase de vista previa de investigación —lo que significa que está disponible para pruebas, pero aún no es un producto definitivo—, es su último esfuerzo por alcanzar este equilibrio.
El «modo automático» emplea medidas de seguridad basadas en IA para examinar cada acción antes de su ejecución, buscando comportamientos de riesgo no solicitados y signos de «prompt injection» —una técnica de ataque en la que se incrustan instrucciones maliciosas en el contenido que se está procesando, engañando a la IA para que realice acciones no deseadas—. Las acciones consideradas seguras se llevan a cabo automáticamente, mientras que las de riesgo se bloquean.
Se trata, en esencia, de una ampliación del comando ya existente de Claude Code «dangerously-skip-permissions», que delega toda la toma de decisiones a la IA, pero con una capa de seguridad adicional.
La función se basa en el reciente auge de las herramientas de programación autónoma de empresas como GitHub y OpenAI, que pueden llevar a cabo tareas en nombre de los desarrolladores. Sin embargo, va un paso más allá al trasladar la decisión de cuándo solicitar permiso al usuario a la propia IA.
Anthropic no ha revelado los criterios específicos que utiliza su capa de seguridad para diferenciar las acciones seguras de las arriesgadas —detalles que los desarrolladores probablemente querrán comprender con mayor claridad antes de adoptar ampliamente la función—. (TechCrunch se ha puesto en contacto con la empresa para obtener más información al respecto).
El modo automático llega tras el lanzamiento por parte de Anthropic de «Claude Code Review», un revisor automático de código que detecta errores antes de que lleguen al código base, y de «Dispatch for Cowork», que permite a los usuarios asignar tareas a agentes de IA para que se encarguen del trabajo en su nombre.
El modo automático se pondrá a disposición de los usuarios de Enterprise y API en los próximos días. La empresa afirma que, actualmente, funciona exclusivamente con Claude Sonnet 4.6 y Opus 4.6, y recomienda utilizar la nueva función en «entornos aislados» —configuraciones en entornos de prueba separadas de los sistemas de producción—, lo que minimiza los posibles daños si algo sale mal.
Anthropic entra en el mercado de tecnología legal de IA mientras se intensifica la competencia
Anthropic presentó el martes un conjunto de nuevas capacidades de chatbot, destinadas a brindar soporte automatizado a despachos de abogados. Estas mejoras amplían Claude for Legal, la plataforma específica para firmas introducida a principios de est
OpenAI cierra la brecha con Anthropic entre los usuarios empresariales, según nuevos datos
Con OpenAI y Anthropic aún lejos de sus esperadas ofertas públicas iniciales (IPO) y de la publicación de informes financieros detallados, debemos recurrir a indicadores alternativos para evaluar su desempeño empresarial. Ramp, una plataforma de tarj











