Anthropic presenta «Claude Fable 5», una versión pública de «Mythos»

Anthropic pone a disposición del público en general, por primera vez, su modelo de IA más potente, aunque con medidas de seguridad establecidas.
El martes, la empresa lanzó Claude Fable 5, la primera versión pública de su modelo Mythos. Según Anthropic, Fable 5 ofrece un buen rendimiento en ingeniería de software, trabajo intelectual y tareas de visión, pero incluye estrictas restricciones de seguridad. En ámbitos de alto riesgo, como la ciberseguridad, la biología, la química y la destilación, el modelo se negará a responder y, en su lugar, remitirá a Claude Opus 4.8.
Lanzado inicialmente como versión preliminar en abril, Mythos solo estaba disponible para un reducido número de socios debido a preocupaciones en materia de ciberseguridad. La semana pasada, Anthropic amplió el acceso a cientos de organizaciones en 15 países, dando prioridad una vez más a aquellas que gestionan infraestructuras críticas.
Ahora, una versión de esa tecnología es accesible para todo el mundo a través de la API de Claude de Anthropic y de los planes Enterprise basados en el consumo. El acceso mediante suscripción se implantará por fases: hasta el 22 de junio, Fable 5 se incluye en los planes Pro, Max, Team y Enterprise basados en puestos sin coste adicional. El 23 de junio, Anthropic retirará Fable 5 de dichos planes, por lo que a partir de entonces se requerirán créditos de uso, con la intención de volver a incorporarlo como una función estándar de la suscripción lo antes posible.
Anthropic también está lanzando una nueva versión de Mythos, denominada Mythos 5, para las organizaciones a las que ya se les ha concedido acceso al modelo avanzado.
El lanzamiento de Fable coincide con los preparativos de Anthropic para salir a bolsa, junto con OpenAI y SpaceX, de Elon Musk. También se produce tras el llamamiento de la empresa a los principales laboratorios de IA del mundo para que creen un «pedal de freno» coordinado para el desarrollo de la IA de vanguardia. Anthropic advirtió de que los sistemas de IA están avanzando tan rápidamente que pronto podrían alcanzar la automejora recursiva (RSI), lo que les permitiría mejorar de forma autónoma sin intervención humana.
Preocupada por lo que un modelo de clase «Mythos» podría hacer en manos equivocadas, Anthropic afirma que sometió a pruebas de estrés a sus clasificadores mediante intentos de «jailbreak» antes de lanzar Fable 5.
«A nivel interno, llevamos a cabo un programa externo de recompensa por errores que no detectó ninguna forma universal de eludir las restricciones en más de 1 000 horas de pruebas. Posteriormente, colaboramos con organizaciones externas de «red teaming», que tampoco lograron identificar ninguna forma universal de eludir las restricciones».
Dicho esto, siguen siendo posibles nuevos tipos de ataques. Por ello, con el lanzamiento de Fable 5 y Mythos 5, Anthropic ha anunciado que exigirá un periodo de retención de 30 días para todo el tráfico, incluso si las empresas tenían anteriormente acuerdos de retención cero. La empresa ha declarado que no utilizará los datos para el entrenamiento, sino únicamente para «defenderse de ataques complejos y novedosos, incluidos nuevos métodos de jailbreak» y para «identificar y reducir los falsos positivos». Esta política podría sentar un precedente en el sector, en el que el acceso a modelos cada vez más potentes viene acompañado de políticas obligatorias de retención de datos presentadas como una medida de seguridad.
Para quienes sigan utilizando el modelo, no todas las preguntas recibirán una respuesta de Fable 5. Anthropic afirma que los casos en los que Fable debe recurrir a Opus 4.8 son poco frecuentes, y los primeros datos indican que al menos el 95 % de las sesiones de Fable se basan íntegramente en las propias respuestas del modelo.
En pruebas realizadas por terceros, la empresa de análisis Hex afirmó que Fable fue el primero en alcanzar una puntuación del 90 % en su prueba de referencia de análisis básico, que implica tareas analíticas complejas y de larga duración.
«En las preguntas más difíciles, demuestra un gran criterio y atención a los matices», señaló Hex.
La plataforma de programación de «vibe» Base44 señaló en un comunicado que Fable es más eficaz a la hora de «crear aplicaciones completas de una sola vez» y cuenta con excelentes capacidades para invocar herramientas. La plataforma de espacio de trabajo y agentes impulsada por IA Genspark afirmó que Fable superó a todos los demás modelos en sus evaluaciones y obtuvo resultados significativamente mejores en tareas como el diseño de interfaces de usuario y la programación de videojuegos.
El precio tanto de Fable 5 como de Mythos 5 se ha fijado en 10 dólares por millón de tokens de entrada y 50 dólares por millón de tokens de salida, el doble que el coste de Opus 4.8. Ese precio por sí solo podría desalentar su adopción generalizada.
Muchas empresas se están mostrando cada vez más críticas con los costes de la IA tras ver sus facturas o agotar antes de tiempo sus presupuestos anuales destinados a la IA. Los modelos avanzados como Opus 4.8 pueden agravar estos problemas, ya que sus sofisticadas capacidades de razonamiento pueden dividir una sola solicitud en múltiples tareas.
Anthropic ha afirmado que espera que la demanda de Fable 5 sea muy alta y difícil de predecir. De hecho, algunas empresas, como la plataforma de recompensas por compras Rakuten, podrían considerar que los beneficios compensan el coste.
«En el nivel de esfuerzo más alto, Fable reflexiona sobre su propio trabajo y lo valida», afirmó Rakuten en un comunicado. «Para nosotros, eso es lo que hace posible unas operaciones altamente autónomas: ese esfuerzo adicional de reflexión se amortiza por sí solo».
Artículo relacionado
Anthropic entra en el mercado de tecnología legal de IA mientras se intensifica la competencia
Anthropic presentó el martes un conjunto de nuevas capacidades de chatbot, destinadas a brindar soporte automatizado a despachos de abogados. Estas mejoras amplían Claude for Legal, la plataforma específica para firmas introducida a principios de est
OpenAI cierra la brecha con Anthropic entre los usuarios empresariales, según nuevos datos
Con OpenAI y Anthropic aún lejos de sus esperadas ofertas públicas iniciales (IPO) y de la publicación de informes financieros detallados, debemos recurrir a indicadores alternativos para evaluar su desempeño empresarial. Ramp, una plataforma de tarj
Anthropic lanza Opus 4.8, que incluye una nueva herramienta dinámica para el flujo de trabajo
Anthropic presentó el jueves Opus 4.8, la última versión de su modelo público estrella. Con un precio idéntico al de su predecesor, esta actualización ya está disponible en todas las plataformas.Con s
Recomendaciones de temas especiales relacionados
comentario (0)
0/500

Anthropic pone a disposición del público en general, por primera vez, su modelo de IA más potente, aunque con medidas de seguridad establecidas.
El martes, la empresa lanzó Claude Fable 5, la primera versión pública de su modelo Mythos. Según Anthropic, Fable 5 ofrece un buen rendimiento en ingeniería de software, trabajo intelectual y tareas de visión, pero incluye estrictas restricciones de seguridad. En ámbitos de alto riesgo, como la ciberseguridad, la biología, la química y la destilación, el modelo se negará a responder y, en su lugar, remitirá a Claude Opus 4.8.
Lanzado inicialmente como versión preliminar en abril, Mythos solo estaba disponible para un reducido número de socios debido a preocupaciones en materia de ciberseguridad. La semana pasada, Anthropic amplió el acceso a cientos de organizaciones en 15 países, dando prioridad una vez más a aquellas que gestionan infraestructuras críticas.
Ahora, una versión de esa tecnología es accesible para todo el mundo a través de la API de Claude de Anthropic y de los planes Enterprise basados en el consumo. El acceso mediante suscripción se implantará por fases: hasta el 22 de junio, Fable 5 se incluye en los planes Pro, Max, Team y Enterprise basados en puestos sin coste adicional. El 23 de junio, Anthropic retirará Fable 5 de dichos planes, por lo que a partir de entonces se requerirán créditos de uso, con la intención de volver a incorporarlo como una función estándar de la suscripción lo antes posible.
Anthropic también está lanzando una nueva versión de Mythos, denominada Mythos 5, para las organizaciones a las que ya se les ha concedido acceso al modelo avanzado.
El lanzamiento de Fable coincide con los preparativos de Anthropic para salir a bolsa, junto con OpenAI y SpaceX, de Elon Musk. También se produce tras el llamamiento de la empresa a los principales laboratorios de IA del mundo para que creen un «pedal de freno» coordinado para el desarrollo de la IA de vanguardia. Anthropic advirtió de que los sistemas de IA están avanzando tan rápidamente que pronto podrían alcanzar la automejora recursiva (RSI), lo que les permitiría mejorar de forma autónoma sin intervención humana.
Preocupada por lo que un modelo de clase «Mythos» podría hacer en manos equivocadas, Anthropic afirma que sometió a pruebas de estrés a sus clasificadores mediante intentos de «jailbreak» antes de lanzar Fable 5.
«A nivel interno, llevamos a cabo un programa externo de recompensa por errores que no detectó ninguna forma universal de eludir las restricciones en más de 1 000 horas de pruebas. Posteriormente, colaboramos con organizaciones externas de «red teaming», que tampoco lograron identificar ninguna forma universal de eludir las restricciones».
Dicho esto, siguen siendo posibles nuevos tipos de ataques. Por ello, con el lanzamiento de Fable 5 y Mythos 5, Anthropic ha anunciado que exigirá un periodo de retención de 30 días para todo el tráfico, incluso si las empresas tenían anteriormente acuerdos de retención cero. La empresa ha declarado que no utilizará los datos para el entrenamiento, sino únicamente para «defenderse de ataques complejos y novedosos, incluidos nuevos métodos de jailbreak» y para «identificar y reducir los falsos positivos». Esta política podría sentar un precedente en el sector, en el que el acceso a modelos cada vez más potentes viene acompañado de políticas obligatorias de retención de datos presentadas como una medida de seguridad.
Para quienes sigan utilizando el modelo, no todas las preguntas recibirán una respuesta de Fable 5. Anthropic afirma que los casos en los que Fable debe recurrir a Opus 4.8 son poco frecuentes, y los primeros datos indican que al menos el 95 % de las sesiones de Fable se basan íntegramente en las propias respuestas del modelo.
En pruebas realizadas por terceros, la empresa de análisis Hex afirmó que Fable fue el primero en alcanzar una puntuación del 90 % en su prueba de referencia de análisis básico, que implica tareas analíticas complejas y de larga duración.
«En las preguntas más difíciles, demuestra un gran criterio y atención a los matices», señaló Hex.
La plataforma de programación de «vibe» Base44 señaló en un comunicado que Fable es más eficaz a la hora de «crear aplicaciones completas de una sola vez» y cuenta con excelentes capacidades para invocar herramientas. La plataforma de espacio de trabajo y agentes impulsada por IA Genspark afirmó que Fable superó a todos los demás modelos en sus evaluaciones y obtuvo resultados significativamente mejores en tareas como el diseño de interfaces de usuario y la programación de videojuegos.
El precio tanto de Fable 5 como de Mythos 5 se ha fijado en 10 dólares por millón de tokens de entrada y 50 dólares por millón de tokens de salida, el doble que el coste de Opus 4.8. Ese precio por sí solo podría desalentar su adopción generalizada.
Muchas empresas se están mostrando cada vez más críticas con los costes de la IA tras ver sus facturas o agotar antes de tiempo sus presupuestos anuales destinados a la IA. Los modelos avanzados como Opus 4.8 pueden agravar estos problemas, ya que sus sofisticadas capacidades de razonamiento pueden dividir una sola solicitud en múltiples tareas.
Anthropic ha afirmado que espera que la demanda de Fable 5 sea muy alta y difícil de predecir. De hecho, algunas empresas, como la plataforma de recompensas por compras Rakuten, podrían considerar que los beneficios compensan el coste.
«En el nivel de esfuerzo más alto, Fable reflexiona sobre su propio trabajo y lo valida», afirmó Rakuten en un comunicado. «Para nosotros, eso es lo que hace posible unas operaciones altamente autónomas: ese esfuerzo adicional de reflexión se amortiza por sí solo».
Anthropic entra en el mercado de tecnología legal de IA mientras se intensifica la competencia
Anthropic presentó el martes un conjunto de nuevas capacidades de chatbot, destinadas a brindar soporte automatizado a despachos de abogados. Estas mejoras amplían Claude for Legal, la plataforma específica para firmas introducida a principios de est
OpenAI cierra la brecha con Anthropic entre los usuarios empresariales, según nuevos datos
Con OpenAI y Anthropic aún lejos de sus esperadas ofertas públicas iniciales (IPO) y de la publicación de informes financieros detallados, debemos recurrir a indicadores alternativos para evaluar su desempeño empresarial. Ramp, una plataforma de tarj
Anthropic lanza Opus 4.8, que incluye una nueva herramienta dinámica para el flujo de trabajo
Anthropic presentó el jueves Opus 4.8, la última versión de su modelo público estrella. Con un precio idéntico al de su predecesor, esta actualización ya está disponible en todas las plataformas.Con s





Hogar






