Hogar
xAI Grok 4.20 alcanza la tasa de alucinaciones más baja del sector y da prioridad a la integridad frente al rendimiento
Mientras los gigantes de la IA invierten frenéticamente recursos en alcanzar las mejores puntuaciones de rendimiento, xAI, de Elon Musk, adopta un enfoque diferente, centrándose en el problema más persistente del sector: la fabricación de información. Hoy, xAI ha lanzado oficialmente Grok4.20Beta. Aunque todavía se queda por detrás de los modelos de primer nivel en puntuaciones absolutas de inteligencia, ha establecido un nuevo récord del sector en la métrica clave de veracidad.

Según la última evaluación de Artificial Analysis, Grok4.20 obtuvo una puntuación de 48 en el índice de inteligencia en modo de razonamiento. Aunque se queda por detrás de y (ambos con una puntuación de 57), su rendimiento en cuanto a la fiabilidad de los datos es especialmente impresionante:
Baja tasa de alucinaciones: en la prueba AA Omniscience, Grok4.20 alcanzó una «tasa de no alucinación» del 78 %, estableciendo un nuevo récord.
Sabe lo que sabe: cuando se enfrenta a preguntas que no puede responder, el modelo ya no tiende a inventar datos falsos, sino que admite con mayor precisión «No lo sé». Esta honestidad es crucial para entornos rigurosos de oficina e investigación.
Arquitectura técnica: una matriz de API «tres en uno»
Para satisfacer las distintas necesidades, xAI ha lanzado tres variantes de la API:
Modo de razonamiento: da prioridad al pensamiento lógico profundo frente a la velocidad, lo cual ha sido clave para batir el récord de alucinaciones en esta ocasión.
Modo estándar: optimizado para una respuesta rápida y la interacción rutinaria.
Modo multiagente: permite que varias instancias de IA trabajen juntas para gestionar tareas complejas.
Estrategia de mercado: más contenido, sin coste adicional
Más allá de su rendimiento único, Grok 4.20 también presenta una estrategia comercial agresiva:
Contexto amplio: admite una ventana de contexto de hasta 2 millones de tokens, lo que le permite asimilar un libro completo o una gran base de código de una sola vez.
Ventaja de precio: con un precio de entre 2 y 6 dólares por millón de tokens, no solo es más barato que la versión anterior, Grok 4, sino que también resulta muy competitivo frente a los principales modelos occidentales actuales.
El lanzamiento de Grok4.20 refleja el cambio estratégico de xAI: ya no se obsesiona con la carrera por la puntuación total hacia la IA general (AGI), sino que se centra precisamente en el punto débil de la «fiabilidad a nivel empresarial». Tal y como afirmó la institución evaluadora, si otros modelos se esfuerzan por convertirse en «profetas omniscientes», Grok4.20 se esfuerza por convertirse en «un asistente que nunca miente».
Para los usuarios con requisitos extremadamente exigentes en cuanto a la precisión de los datos, Grok4.20 podría convertirse en una tercera opción importante, además de OpenAI y Google.
Artículo relacionado
Las acciones de EE. UU. alcanzan un hito histórico mientras gigantes de la IA y la aeroespacial se preparan para su debut de un billón de dólares
Elon Musk, Sam Altman y Dario Amodei, tres titanes del sector tecnológico, están avanzando hacia ofertas públicas iniciales para sus respectivas empresas. Con SpaceX, OpenAI y Anthropic, tres gigantes de la industria que se acercan a valoraciones de
La startup sueca de inteligencia artificial Lovable Eyes alcanza una valoración de 13.200 millones de dólares tras una importante ronda de financiación
Mientras las herramientas de codificación impulsadas por inteligencia artificial ganan terreno, la startup sueca Lovable ha asegurado una importante ronda de financiación. La empresa tiene como objetivo recaudar 3 000 millones de dólares, lo que podr
Google prueba el agente Remy AI para Gemini a medida que el enfoque se desplaza hacia el control del usuario
Según Business Insider, Google está probando Remy, un nuevo agente personal de IA para Gemini. Esta herramienta tiene como objetivo ejecutar tareas en nombre de los usuarios, optimizando tanto los flujos de trabajo profesionales como las rutinas diar
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
Mientras los gigantes de la IA invierten frenéticamente recursos en alcanzar las mejores puntuaciones de rendimiento, xAI, de Elon Musk, adopta un enfoque diferente, centrándose en el problema más persistente del sector: la fabricación de información. Hoy, xAI ha lanzado oficialmente Grok4.20Beta. Aunque todavía se queda por detrás de los modelos de primer nivel en puntuaciones absolutas de inteligencia, ha establecido un nuevo récord del sector en la métrica clave de veracidad.

Según la última evaluación de Artificial Analysis, Grok4.20 obtuvo una puntuación de 48 en el índice de inteligencia en modo de razonamiento. Aunque se queda por detrás de
Baja tasa de alucinaciones: en la prueba AA Omniscience, Grok4.20 alcanzó una «tasa de no alucinación» del 78 %, estableciendo un nuevo récord.
Sabe lo que sabe: cuando se enfrenta a preguntas que no puede responder, el modelo ya no tiende a inventar datos falsos, sino que admite con mayor precisión «No lo sé». Esta honestidad es crucial para entornos rigurosos de oficina e investigación.
Arquitectura técnica: una matriz de API «tres en uno»
Para satisfacer las distintas necesidades, xAI ha lanzado tres variantes de la API:
Modo de razonamiento: da prioridad al pensamiento lógico profundo frente a la velocidad, lo cual ha sido clave para batir el récord de alucinaciones en esta ocasión.
Modo estándar: optimizado para una respuesta rápida y la interacción rutinaria.
Modo multiagente: permite que varias instancias de IA trabajen juntas para gestionar tareas complejas.
Estrategia de mercado: más contenido, sin coste adicional
Más allá de su rendimiento único, Grok 4.20 también presenta una estrategia comercial agresiva:
Contexto amplio: admite una ventana de contexto de hasta 2 millones de tokens, lo que le permite asimilar un libro completo o una gran base de código de una sola vez.
Ventaja de precio: con un precio de entre 2 y 6 dólares por millón de tokens, no solo es más barato que la versión anterior, Grok 4, sino que también resulta muy competitivo frente a los principales modelos occidentales actuales.
El lanzamiento de Grok4.20 refleja el cambio estratégico de xAI: ya no se obsesiona con la carrera por la puntuación total hacia la IA general (AGI), sino que se centra precisamente en el punto débil de la «fiabilidad a nivel empresarial». Tal y como afirmó la institución evaluadora, si otros modelos se esfuerzan por convertirse en «profetas omniscientes», Grok4.20 se esfuerza por convertirse en «un asistente que nunca miente».
Para los usuarios con requisitos extremadamente exigentes en cuanto a la precisión de los datos, Grok4.20 podría convertirse en una tercera opción importante, además de OpenAI y Google.
Las acciones de EE. UU. alcanzan un hito histórico mientras gigantes de la IA y la aeroespacial se preparan para su debut de un billón de dólares
Elon Musk, Sam Altman y Dario Amodei, tres titanes del sector tecnológico, están avanzando hacia ofertas públicas iniciales para sus respectivas empresas. Con SpaceX, OpenAI y Anthropic, tres gigantes de la industria que se acercan a valoraciones de
La startup sueca de inteligencia artificial Lovable Eyes alcanza una valoración de 13.200 millones de dólares tras una importante ronda de financiación
Mientras las herramientas de codificación impulsadas por inteligencia artificial ganan terreno, la startup sueca Lovable ha asegurado una importante ronda de financiación. La empresa tiene como objetivo recaudar 3 000 millones de dólares, lo que podr











