opción
Hogar
Noticias
Claude 4.1 de Anthropic supera en rendimiento a GPT-5 en pruebas de codificación antes de su lanzamiento

Claude 4.1 de Anthropic supera en rendimiento a GPT-5 en pruebas de codificación antes de su lanzamiento

13 de febrero de 2026
193

Claude 4.1 de Anthropic supera en rendimiento a GPT-5 en pruebas de codificación antes de su lanzamiento

Anthropic presentó el lunes una versión mejorada de su modelo de IA de primera línea, estableciendo un nuevo punto de referencia en cuanto al rendimiento en tareas de ingeniería de software. El lanzamiento posiciona a la startup de IA para defender su bastión en el lucrativo sector de la codificación, anticipándose a la nueva competencia que se espera de OpenAI.

El nuevo modelo Claude Opus 4.1 obtuvo una puntuación del 74,5 % en la prueba SWE-bench Verified, un importante punto de referencia para evaluar la capacidad de un sistema de IA para abordar problemas de software del mundo real. Este resultado supera al modelo o3 de OpenAI, con un 69,1 %, y al Gemini 2.5 Pro de Google, con un 67,2 %, lo que consolida el liderazgo de Anthropic en la codificación asistida por IA.

Este lanzamiento coincide con un periodo de crecimiento explosivo para Anthropic. Las cifras del sector indican que sus ingresos recurrentes anuales se han multiplicado por cinco, pasando de 1000 millones de dólares a 5000 millones en solo siete meses. Sin embargo, este espectacular ascenso ha fomentado una dependencia arriesgada: casi el 50 % de sus 3100 millones de dólares en ingresos por API proviene de solo dos clientes, el asistente de codificación Cursor y GitHub Copilot de Microsoft, que juntos aportan 1400 millones de dólares.

«Se trata de una situación extremadamente precaria. Una modificación del contrato podría poner en peligro todo el negocio», advirtió Guillaume Leverdier, director sénior de productos de Logitech, al comentar los datos sobre la concentración de ingresos en las redes sociales.

La actualización marca el último esfuerzo estratégico de Anthropic para reforzar su posición antes del esperado lanzamiento del GPT-5 de OpenAI, que se prevé que dispute el dominio de Claude en materia de codificación. Algunos observadores del sector se han preguntado si el momento elegido denota una sensación de urgencia más que una mera preparación.

«Opus 4.1 parece un lanzamiento apresurado para adelantarse a GPT-5», señaló Alec Velikanov, quien señaló las deficiencias percibidas del modelo en las tareas de interfaz de usuario en comparación con sus rivales. Esta opinión se hace eco de la especulación generalizada de que Anthropic está acelerando su ciclo de lanzamiento para proteger su posición en el mercado.

Cómo dos clientes generan casi la mitad de los 3100 millones de dólares de ingresos por API de Anthropic

El negocio de Anthropic se ha centrado cada vez más en el desarrollo de software. Su servicio de suscripción Claude Code, con un precio de 200 dólares al mes frente a los 20 dólares de los planes para consumidores, ha alcanzado los 400 millones de dólares en ingresos recurrentes anuales tras duplicarse en pocas semanas, lo que subraya la sólida demanda empresarial de ayudas de codificación de IA.

«Que Claude Code haya alcanzado los 400 millones de dólares en cinco meses sin prácticamente ninguna inversión en marketing es bastante sorprendente, ¿no?», comentó el desarrollador Minh Nhat Nguyen, subrayando la rápida y orgánica aceptación de la herramienta entre los programadores profesionales.

Esta especialización en programación ha sido rentable, pero también peligrosa. Mientras que OpenAI lidera los ingresos por suscripciones de consumidores y empresas en general, Anthropic ha establecido un nicho dominante entre los desarrolladores. El analista industrial Peter Gostev, que supervisa las finanzas de las empresas de IA, observa que «casi todos los asistentes de programación utilizan ahora Claude 4 Sonnet por defecto».

GitHub, adquirida por Microsoft por 7500 millones de dólares en 2018, presenta una dinámica especialmente compleja para Anthropic. Microsoft tiene una participación sustancial en OpenAI, lo que crea un conflicto potencial, ya que GitHub Copilot depende en gran medida de los modelos de Anthropic, mientras que Microsoft desarrolla su propia tecnología de IA competidora.

«Vale la pena señalar que uno de esos clientes clave es propiedad en un 49 % de un competidor directo... lo que introduce otra capa de vulnerabilidad», comentó Siya Mali, socio comercial de Perplexity, aludiendo a la participación accionarial de Microsoft.

Las capacidades de codificación mejoradas de Claude vienen acompañadas de protocolos de seguridad más estrictos tras las pruebas de chantaje de la IA

Además de las mejoras en la codificación, Opus 4.1 refuerza la capacidad de investigación y análisis de datos de Claude, especialmente en el seguimiento meticuloso de detalles y las operaciones de búsqueda independientes. El modelo continúa con el método de razonamiento híbrido de Anthropic, fusionando el procesamiento directo con el pensamiento ampliado que puede aprovechar hasta 64 000 tokens para la resolución de problemas complejos.

Sin embargo, este progreso va acompañado de medidas de seguridad más estrictas. Anthropic ha clasificado Opus 4.1 en su marco de Seguridad de IA Nivel 3 (ASL-3), su designación más estricta, que exige medidas de protección reforzadas contra el robo y el uso indebido del modelo.

Las evaluaciones anteriores de los modelos Claude 4 revelaron conductas preocupantes, como intentos de chantaje cuando la IA percibía una amenaza de desactivación. En pruebas controladas, el modelo amenazó con revelar la información personal de los ingenieros para garantizar su supervivencia, lo que demostró un razonamiento avanzado pero potencialmente peligroso.

Estas consideraciones de seguridad no han frenado la adopción por parte de las empresas. GitHub informa de que Claude Opus 4.1 muestra «mejoras de rendimiento especialmente significativas en la reestructuración de código de múltiples archivos». El Grupo Rakuten también elogió la precisión del modelo para «identificar correcciones precisas en bases de código extensas sin ediciones innecesarias ni introducción de errores».

Por qué el GPT-5 de OpenAI supone una amenaza existencial para la estrategia centrada en los desarrolladores de Anthropic

El mercado de la codificación con IA se ha convertido en un ámbito multimillonario y de alto riesgo. Las herramientas de productividad para desarrolladores representan una de las aplicaciones más inmediatas y valiosas de la IA generativa, con ganancias tangibles en eficiencia que respaldan los precios premium de las empresas.

La cartera de clientes concentrada de Anthropic, aunque muy rentable, la hace vulnerable si sus rivales pueden captar cuentas importantes. El sector de los asistentes de codificación facilita especialmente el cambio rápido de modelo, ya que los desarrolladores pueden probar nuevos sistemas de IA mediante sencillos ajustes de la API.

«Mi impresión es que el crecimiento de Anthropic depende en gran medida de su supremacía en la codificación», observó Gostev. «Si GPT-5 desafía ese dominio, provocando que clientes como Cursor y GitHub Copilot se pasen a OpenAI, podríamos asistir a un cambio en el mercado».

La competencia puede acelerarse a medida que disminuyen los gastos de hardware y mejora la eficiencia de la inferencia, lo que podría convertir las capacidades básicas de IA en productos básicos con el tiempo. «Incluso sin nuevos avances en los modelos de los laboratorios de IA, la disminución de los costes de hardware y la mejora de la optimización de la inferencia por sí solas podrían generar beneficios en un plazo de aproximadamente cinco años», pronosticó el analista del sector Venkat Raman.

Actualmente, Anthropic mantiene su ventaja técnica mientras amplía las suscripciones a Claude Code para reducir su dependencia de los ingresos por API. Su capacidad para mantener el liderazgo en codificación ante los inminentes retos de OpenAI, Google y otros determinará si su rápido crecimiento continúa o se encuentra con obstáculos significativos.

Las implicaciones son profundas: la entidad que controle las herramientas de IA que impulsan el desarrollo de software podría, en última instancia, gobernar el ritmo del avance tecnológico. En la última competición de Silicon Valley, en la que el ganador se lo lleva todo, Anthropic ha construido un imperio que depende de dos clientes fundamentales, y ahora debe demostrar que puede retenerlos.

Artículo relacionado
Sam Altman desata un debate sobre la desaceleración de la IA Sam Altman desata un debate sobre la desaceleración de la IA Escuchar enApple PodcastsEscuchar enSpotifyEl director ejecutivo de OpenAI, Sam Altman, sugirió recientemente que podría ser el momento de “regular el ritmo del desarrollo de la IA” para permitir que la sociedad “se fortalezca en torno a algunos de
OpenAI enfrenta una demanda por secreto comercial de Apple OpenAI enfrenta una demanda por secreto comercial de Apple OpenAI rebatió las alegaciones de Apple sobre secretos comerciales el martes, argumentando que la demanda es infundada.“Tomamos estas afirmaciones en serio, pero no vemos ninguna evidencia que las respalde”, declaró OpenAI, según informó Ed Ludlow d
La jefa de robótica de OpenAI, Caitlin Kalinowski, renuncia por la asociación con el Pentágono La jefa de robótica de OpenAI, Caitlin Kalinowski, renuncia por la asociación con el Pentágono El líder de robótica de OpenAI, Caitlin Kalinowski, ha dimitido tras la controvertida asociación de la empresa con el Departamento de Defensa.“Esta no fue una decisión fácil”, explicó Kalinowski en un comunicado en redes sociales. “Aunque la IA dese
Recomendaciones de temas especiales relacionados
Análisis de datos Mejores herramientas de IA para la detección de anomalías en el monitoreo de KPIs para equipos de SaaS y comercio electrónico
Mejores herramientas de IA para la detección de anomalías en el monitoreo de KPIs para equipos de SaaS y comercio electrónico

¡Las mejores herramientas de detección de anomalías con IA de 2026, más valoradas y destacadas para el monitoreo de KPI en equipos de SaaS y comercio electrónico! XIX.AI ha recopilado una poderosa colección transformadora basada en rigurosas pruebas del mundo real y clasificaciones actualizadas semanalmente. Encontrarás comparaciones detalladas entre versiones gratuitas y de pago que te ayudarán a identificar la solución imprescindible para aumentar la productividad y desbloquear tu ventaja con IA. ¡Explora ahora!

10 herramientas
xix.ai
escribiendo Los mejores generadores de esquemas basados en IA para artículos largos optimizados para SEO
Los mejores generadores de esquemas basados en IA para artículos largos optimizados para SEO

Los mejores generadores de esquemas con IA mejor valorados de 2026 para artículos largos optimizados para SEO, seleccionados minuciosamente por XIX.AI. Estas potentes herramientas ofrecen una ayuda revolucionaria a la hora de crear contenido de alta calidad rápidamente, lo que aumenta considerablemente la eficiencia a la hora de escribir. Consigue una comparación entre las versiones gratuitas y de pago, junto con pruebas en condiciones reales y clasificaciones detalladas, que te ayudarán a encontrar la opción imprescindible que mejor se adapte a tus necesidades. Explora ahora para descubrir las ventajas que te ofrece la IA.

8 herramientas
xix.ai
Educación y aprendizaje Herramientas de estudio basadas en IA para los deberes y la preparación de exámenes
Herramientas de estudio basadas en IA para los deberes y la preparación de exámenes

¡Las mejores herramientas de IA de 2026 para hacer los deberes y prepararse para los exámenes! XIX.AI ha elaborado una lista con las herramientas mejor valoradas, potentes y revolucionarias que ayudan a los estudiantes a aumentar su productividad, agilizar la realización de los deberes y sacar sobresaliente en los exámenes gracias a pruebas reales. Consigue una comparación entre versiones gratuitas y de pago, clasificaciones detalladas y opciones imprescindibles para sacar el máximo partido a la IA. ¡Explora ahora!

10 herramientas
xix.ai
composicion musical Herramientas de demostración vocal con IA para compositores, ganchos, melodías principales y sesiones de borrador multilingüe
Herramientas de demostración vocal con IA para compositores, ganchos, melodías principales y sesiones de borrador multilingüe

¡Las mejores herramientas de demostración vocal con IA de 2026 para compositores, creadores de ganchos y equipos de contenido multilingüe! XIX.AI ha recopilado una lista de herramientas poderosas y transformadoras, rigurosamente probadas en el mundo real. Encontrarás datos detallados de comparación entre versiones gratuitas y de pago, clasificaciones completas y opciones imprescindibles para ayudarte a aumentar tu eficiencia de escritura y desbloquear todo tu potencial creativo. ¡Explora ahora para descubrir la herramienta perfecta para todas tus necesidades de contenido!

9 herramientas
xix.ai
Negocio Las mejores herramientas de investigación competitiva basadas en IA para pequeñas empresas
Las mejores herramientas de investigación competitiva basadas en IA para pequeñas empresas

¡Las mejores herramientas de investigación competitiva basadas en IA mejor valoradas de 2026 para pequeñas empresas! XIX.AI ha seleccionado una colección revolucionaria y muy potente, que se actualiza semanalmente con rigurosas pruebas en el mundo real y clasificaciones detalladas. Encontrarás una comparación exhaustiva entre las opciones gratuitas y las de pago que te ayudará a identificar las herramientas imprescindibles que impulsarán tu productividad y te proporcionarán una ventaja competitiva. ¡Explora ahora mismo y descubre la herramienta perfecta para ti!

9 herramientas
xix.ai
Edición de imágenes Herramientas de retoque con IA de Photoshop para ropa de comercio electrónico, limpieza de piel y consistencia del color
Herramientas de retoque con IA de Photoshop para ropa de comercio electrónico, limpieza de piel y consistencia del color

¡Las mejores herramientas de retoque con IA de Photoshop de 2026 para ropa de comercio electrónico, limpieza de piel y consistencia de color! Esta lista curada de alta calificación presenta soluciones poderosas que cambian las reglas del juego, que ayudan a aumentar la eficiencia de redacción, optimizar la creación de contenido y lograr resultados visuales perfectos sin esfuerzo. Cada herramienta ha pasado por pruebas en el mundo real a través de clasificaciones actualizadas semanalmente, con detalles completos de comparación entre versiones gratuitas y de pago. Respaldado por XIX.AI, es la guía imprescindible para cualquier persona que aspire a desbloquear su ventaja con IA. ¡Explora ahora!

10 herramientas
xix.ai
comentario (2)
0/500
HarryWilliams
HarryWilliams 3 de agosto de 2026 20:00:13 GMT+02:00

Claude 4.1 crushing benchmarks before GPT-5 even drops? That's a power move 😏 I'm betting the real test is how it handles messy legacy code, not just LeetCode-style problems. Still, glad to see some healthy competition—maybe OpenAI will finally ship something polished.

ChristopherBrown
ChristopherBrown 22 de mayo de 2026 00:00:22 GMT+02:00

這篇報導讓我想到,AI編程工具的競爭真是越來越激烈了!Claude 4.1在編碼基準測試中領先,不知道對我們這些普通開發者來說,未來是會更輕鬆還是面臨更多挑戰?🤔 希望這些工具能真正幫助我們提升效率,而不是單純取代工作。

OR