Дом
xAI Grok 4.20 демонстрирует самый низкий в отрасли уровень галлюцинаций и ставит целостность выше производительности
В то время как гиганты в сфере ИИ лихорадочно вкладывают ресурсы в погоню за максимальными показателями производительности, компания xAI Илона Маска придерживается иного подхода, сосредоточившись на самой актуальной проблеме в этой области: фабрикации информации. Сегодня xAI официально представила Grok4.20Beta. Хотя по абсолютным показателям интеллекта она по-прежнему отстает от моделей высшего уровня, она установила новый отраслевой рекорд по ключевому показателю достоверности.

Согласно последней оценке Artificial Analysis, Grok4.20 набрал 48 баллов по индексу интеллекта в режиме логического мышления. Хотя он отстает от моделей « » и « » (обе набрали по 57 баллов), его показатели достоверности фактов особенно впечатляют:
Низкий уровень галлюцинаций: в тесте AA Omniscience Grok4.20 достиг 78% «уровня отсутствия галлюцинаций», установив новый рекорд.
Осознание собственных ограничений: сталкиваясь с вопросами, на которые не может ответить, модель больше не склонна выдумывать ложные факты, а вместо этого более точно признает: «Я не знаю». Такая честность имеет решающее значение для строгих офисных и исследовательских сред.
Техническая архитектура: матрица API «три в одном»
Чтобы удовлетворить разнообразные потребности, xAI запустила три варианта API:
Режим рассуждений: отдаёт приоритет глубокому логическому мышлению, а не скорости, что стало ключом к побитию рекорда по галлюцинациям на этот раз.
Стандартный режим: оптимизирован для быстрого отклика и рутинного взаимодействия.
Режим «Мультиагент»: поддерживает совместную работу нескольких экземпляров ИИ для решения сложных задач.
Рыночная стратегия: больше контента без дополнительных затрат
Помимо уникальной производительности, Grok4.20 также представляет агрессивную коммерческую стратегию:
Большой контекст: поддерживает окно контекста размером до 2 миллионов токенов, что позволяет ему одновременно обрабатывать целую книгу или обширную кодовую базу.
Ценовое преимущество: при цене от 2 до 6 долларов за миллион токенов система не только дешевле предыдущей версии Grok4, но и весьма конкурентоспособна среди современных западных моделей широкого применения.
Выпуск Grok4.20 отражает стратегический сдвиг xAI — компания больше не зацикливается на гонке за общим баллом в стремлении к AGI, а точно нацелена на решение «болевой точки» — «надежности корпоративного уровня». Как заявила оценочная организация, если другие модели стремятся стать «всеведущими пророками», то Grok4.20 стремится стать «помощником, который никогда не лжет».
Для пользователей с чрезвычайно высокими требованиями к точности данных Grok4.20 может стать третьим основным вариантом наряду с OpenAI и Google.
Связанная статья
Акции США достигли исторической отметки, поскольку гиганты искусственного интеллекта и аэрокосмической отрасли готовятся к дебюту с оценкой в триллион долларов
Илон Маск, Сэм Алтман и Дарио Амодэй, три титана технологического сектора, продвигаются к первичным публичным предложениям акций своих respective компаний. Благодаря SpaceX, OpenAI и Anthropic — трем отраслевым гигантам, чья оценка приближается к три
Шведский стартап в области искусственного интеллекта Lovable Eyes достиг оценки в 13,2 миллиарда долларов после крупного раунда финансирования
По мере того как инструменты для программирования на основе искусственного интеллекта набирают популярность, шведский стартап Lovable привлек крупный раунд финансирования. Компания нацелена на привлечение $3 млрд, что потенциально может увеличить её
Google тестирует агента Remy AI для Gemini по мере смещения фокуса на управление пользователями
Согласно Business Insider, Google тестирует Remy, нового ИИ-персонального агента для Gemini. Этот инструмент предназначен для выполнения задач от имени пользователей, упрощая как профессиональные рабочие процессы, так и повседневные рутины.В настоящ
Рекомендации по связанным специальным темам
Комментарии (0)
В то время как гиганты в сфере ИИ лихорадочно вкладывают ресурсы в погоню за максимальными показателями производительности, компания xAI Илона Маска придерживается иного подхода, сосредоточившись на самой актуальной проблеме в этой области: фабрикации информации. Сегодня xAI официально представила Grok4.20Beta. Хотя по абсолютным показателям интеллекта она по-прежнему отстает от моделей высшего уровня, она установила новый отраслевой рекорд по ключевому показателю достоверности.

Согласно последней оценке Artificial Analysis, Grok4.20 набрал 48 баллов по индексу интеллекта в режиме логического мышления. Хотя он отстает от моделей «
Низкий уровень галлюцинаций: в тесте AA Omniscience Grok4.20 достиг 78% «уровня отсутствия галлюцинаций», установив новый рекорд.
Осознание собственных ограничений: сталкиваясь с вопросами, на которые не может ответить, модель больше не склонна выдумывать ложные факты, а вместо этого более точно признает: «Я не знаю». Такая честность имеет решающее значение для строгих офисных и исследовательских сред.
Техническая архитектура: матрица API «три в одном»
Чтобы удовлетворить разнообразные потребности, xAI запустила три варианта API:
Режим рассуждений: отдаёт приоритет глубокому логическому мышлению, а не скорости, что стало ключом к побитию рекорда по галлюцинациям на этот раз.
Стандартный режим: оптимизирован для быстрого отклика и рутинного взаимодействия.
Режим «Мультиагент»: поддерживает совместную работу нескольких экземпляров ИИ для решения сложных задач.
Рыночная стратегия: больше контента без дополнительных затрат
Помимо уникальной производительности, Grok4.20 также представляет агрессивную коммерческую стратегию:
Большой контекст: поддерживает окно контекста размером до 2 миллионов токенов, что позволяет ему одновременно обрабатывать целую книгу или обширную кодовую базу.
Ценовое преимущество: при цене от 2 до 6 долларов за миллион токенов система не только дешевле предыдущей версии Grok4, но и весьма конкурентоспособна среди современных западных моделей широкого применения.
Выпуск Grok4.20 отражает стратегический сдвиг xAI — компания больше не зацикливается на гонке за общим баллом в стремлении к AGI, а точно нацелена на решение «болевой точки» — «надежности корпоративного уровня». Как заявила оценочная организация, если другие модели стремятся стать «всеведущими пророками», то Grok4.20 стремится стать «помощником, который никогда не лжет».
Для пользователей с чрезвычайно высокими требованиями к точности данных Grok4.20 может стать третьим основным вариантом наряду с OpenAI и Google.
Акции США достигли исторической отметки, поскольку гиганты искусственного интеллекта и аэрокосмической отрасли готовятся к дебюту с оценкой в триллион долларов
Илон Маск, Сэм Алтман и Дарио Амодэй, три титана технологического сектора, продвигаются к первичным публичным предложениям акций своих respective компаний. Благодаря SpaceX, OpenAI и Anthropic — трем отраслевым гигантам, чья оценка приближается к три
Шведский стартап в области искусственного интеллекта Lovable Eyes достиг оценки в 13,2 миллиарда долларов после крупного раунда финансирования
По мере того как инструменты для программирования на основе искусственного интеллекта набирают популярность, шведский стартап Lovable привлек крупный раунд финансирования. Компания нацелена на привлечение $3 млрд, что потенциально может увеличить её











