вариант
Дом
Новости
LLMS Deep Cogito превосходит модели аналогичного размера с использованием IDA

LLMS Deep Cogito превосходит модели аналогичного размера с использованием IDA

18 апреля 2025 г.
290

Deep Cogito, компания из Сан-Франциско, вызывает ажиотаж в сообществе ИИ благодаря последнему выпуску открытых больших языковых моделей (LLM). Эти модели, варьирующиеся по размеру от 3 миллиардов до 70 миллиардов параметров, не просто очередной набор инструментов ИИ; они представляют собой смелый шаг к тому, что компания называет "общей сверхинтеллектуальностью". Deep Cogito утверждает, что каждая из их моделей превосходит ведущие открытые модели аналогичного размера, включая модели от LLAMA, DeepSeek и Qwen, по большинству стандартных тестов. Это довольно смелое заявление, но еще более впечатляюще то, что их модель 70B, как сообщается, превзошла недавно выпущенную модель Llama 4 109B Mixture-of-Experts (MoE).

Итеративная дистилляция и усиление (IDA)

В основе прорыва Deep Cogito лежит новый подход к обучению, который они называют итеративной дистилляцией и усилением (IDA). Этот метод описывается как "масштабируемая и эффективная стратегия выравнивания для общей сверхинтеллектуальности с использованием итеративного самосовершенствования". Он разработан, чтобы преодолеть ограничения традиционного обучения LLM, где интеллект модели часто достигает потолка, определяемого более крупными моделями-"надзирателями" или человеческими кураторами.

Процесс IDA включает два ключевых этапа, которые повторяются многократно:

  • Усиление: На этом этапе используется больше вычислительной мощности, чтобы помочь модели находить лучшие решения или способности, подобно продвинутым техникам рассуждения.
  • Дистилляция: Здесь модель усваивает эти улучшенные способности, уточняя свои параметры.

Deep Cogito утверждает, что это создает "положительную обратную связь", позволяя интеллекту модели расти более прямо пропорционально вычислительным ресурсам и эффективности самого процесса IDA, а не ограничиваться интеллектом надзирателя.

Компания указывает на исторические успехи, такие как AlphaGo, подчеркивая, что "продвинутое рассуждение и итеративное самосовершенствование" были ключевыми. IDA, как они утверждают, привносит эти элементы в обучение LLM. Они также подчеркивают эффективность IDA, отмечая, что их небольшая команда смогла разработать эти модели примерно за 75 дней. По сравнению с другими методами, такими как обучение с подкреплением на основе человеческой обратной связи (RLHF) или стандартная дистилляция из более крупных моделей, IDA, как утверждается, обеспечивает лучшую масштабируемость.

В качестве доказательства Deep Cogito подчеркивает, как их модель 70B превосходит как Llama 3.3 70B (дистиллированную из модели 405B), так и Llama 4 Scout 109B (дистиллированную из модели с 2T параметров).

Возможности и производительность моделей Deep Cogito

Новые модели Cogito, основанные на контрольных точках Llama и Qwen, адаптированы для программирования, вызова функций и агентских приложений. Отличительной особенностью является их двойная функциональность: "Каждая модель может отвечать напрямую (стандартный LLM) или размышлять перед ответом (как модели рассуждения)". Это напоминает возможности, наблюдаемые в моделях, таких как Claude 3.5. Однако Deep Cogito отмечает, что они не сосредотачивались на очень длинных цепочках рассуждений, отдавая приоритет более быстрым ответам и эффективности дистилляции более коротких цепочек.

Компания предоставила обширные результаты тестов, сравнивая свои модели Cogito с современными открытыми моделями эквивалентного размера как в прямом, так и в режиме рассуждений. По ряду тестов, таких как MMLU, MMLU-Pro, ARC, GSM8K и MATH, и для разных размеров моделей (3B, 8B, 14B, 32B, 70B), модели Cogito в целом демонстрируют значительные улучшения производительности. Например, модель Cogito 70B набирает 91,73% на MMLU в стандартном режиме, что на +6,40% лучше, чем Llama 3.3 70B, и 91,00% в режиме размышления, что на +4,40% лучше, чем Deepseek R1 Distill 70B. Результаты Livebench также отражают эти успехи.

Вот тесты моделей 14B для сравнения среднего размера:

Тесты моделей 14B

Хотя Deep Cogito признает, что тесты не полностью отражают реальную полезность, они остаются уверенными в практической производительности своих моделей. Этот выпуск считается предварительным, и компания заявляет, что они "все еще находятся на ранних стадиях этой кривой масштабирования". Они планируют выпустить улучшенные контрольные точки для текущих размеров и представить более крупные модели MoE (109B, 400B, 671B) в ближайшие недели и месяцы. Все будущие модели также будут с открытым исходным кодом.

Связанная статья
Олли делает ставку на приватность, чтобы выиграть гонку за лидерство в сфере ИИ-помощников Олли делает ставку на приватность, чтобы выиграть гонку за лидерство в сфере ИИ-помощников Чтобы быть по-настоящему полезным, ИИ-помощник должен глубоко понимать своего пользователя. Ollie — личный помощник, разработанный для повседневной жизни, — работает по принципу, согласно которому для
Как на мероприятии AI LIVE: London будут рассматриваться темы искусственного интеллекта и промышленной автоматизации Как на мероприятии AI LIVE: London будут рассматриваться темы искусственного интеллекта и промышленной автоматизации На саммите соберутся руководители высшего звена со всего мира, чтобы обсудить актуальные проблемы мировых отраслей — от радикальных изменений, вызванных искусственным интеллектом, до экономической нес
Anthropic выходит на рынок юридических технологий ИИ по мере усиления конкуренции Anthropic выходит на рынок юридических технологий ИИ по мере усиления конкуренции Anthropic unveiled a suite of new chatbot capabilities on Tuesday, aimed at delivering automated support to legal practices. Эти инструменты были представлены во вторник и направлены на предоставление автоматизированной поддержки юридическим фирмам.
Рекомендации по связанным специальным темам
Образование и обучение Инструменты на базе искусственного интеллекта для выполнения домашних заданий и подготовки к экзаменам
Инструменты на базе искусственного интеллекта для выполнения домашних заданий и подготовки к экзаменам

2026: лучшие современные инструменты на базе ИИ для выполнения домашних заданий и подготовки к экзаменам! XIX.AI подготовило рейтинг самых эффективных и революционных инструментов, которые помогают учащимся повысить продуктивность, оптимизировать выполнение домашних заданий и сдавать экзамены на «отлично», проходя проверку в реальных условиях. Получите сравнение бесплатных и платных версий, подробные рейтинги и варианты, которые обязательно стоит попробовать, чтобы раскрыть свой потенциал с помощью ИИ. Узнайте больше прямо сейчас!

10 инструментов
xix.ai
Музыкальная композиция Инструменты для создания вокальных демо на основе ИИ для авторов песен, создания хуков, написания тоpline-мелодий и проведения многоязычных черновых сессий
Инструменты для создания вокальных демо на основе ИИ для авторов песен, создания хуков, написания тоpline-мелодий и проведения многоязычных черновых сессий

2026 г. лучшие инструменты для демо-записи вокала на базе ИИ для авторов песен, создателей хуков и команд, работающих с контентом на нескольких языках! XIX.AI подготовил список высокооцененных мощных инструментов, изменивших правила игры, прошедших строгие реальные тесты. Вы найдёте подробные данные сравнения бесплатных и платных версий, комплексные рейтинги и обязательные к использованию варианты, которые помогут повысить эффективность написания и раскрыть ваш творческий потенциал. Исследуйте сейчас, чтобы найти идеальный инструмент для всех ваших задач по созданию контента!

9 инструментов
xix.ai
Бизнес Лучшие инструменты для анализа конкурентов на основе искусственного интеллекта для малого бизнеса
Лучшие инструменты для анализа конкурентов на основе искусственного интеллекта для малого бизнеса

2026: новейшие, лучшие и самые высокооцененные инструменты для анализа конкурентов на базе ИИ для малого бизнеса! XIX.AI подготовила чрезвычайно мощную подборку, способную кардинально изменить ситуацию на рынке, которая еженедельно обновляется на основе тщательных тестов в реальных условиях и подробных рейтингов. Вы найдете здесь исчерпывающее сравнение бесплатных и платных версий, которое поможет вам определить инструменты, которые обязательно стоит попробовать, чтобы повысить свою продуктивность и получить конкурентное преимущество. Ознакомьтесь с ней прямо сейчас, чтобы найти идеальный инструмент для себя!

9 инструментов
xix.ai
Редактирование изображений Инструменты ИИ-ретуши в Photoshop для электронной коммерции, одежды, очистки кожи и обеспечения цветового единообразия
Инструменты ИИ-ретуши в Photoshop для электронной коммерции, одежды, очистки кожи и обеспечения цветового единообразия

2026 Latest Best Photoshop AI retouch tools for ecommerce apparel, skin cleanup, and color consistency! This top-rated curated list features powerful game-changing solutions that help you boost writing efficiency, streamline content creation, and achieve perfect visual results effortlessly. Each tool has undergone real-world tests through weekly updated rankings, complete with free vs paid comparison details. Backed by XIX.AI, it’s the must-try guide for anyone aiming to unlock your AI edge. Explore now!

10 инструментов
xix.ai
Быстрый Лучшие библиотеки подсказок для ИИ в рабочих процессах ChatGPT
Лучшие библиотеки подсказок для ИИ в рабочих процессах ChatGPT

2026: новейшие и лучшие библиотеки подсказок для ИИ с высоким рейтингом, предназначенные для оптимизации всех типов рабочих процессов ChatGPT. XIX.AI подготовила мощную, революционную подборку, прошедшую тщательные тесты в реальных условиях для обеспечения максимальной производительности. Вы найдёте подробные сравнения бесплатных и платных вариантов, а также рейтинги экспертов, которые помогут вам выбрать инструменты, которые обязательно стоит попробовать, чтобы повысить свою продуктивность и раскрыть весь потенциал ИИ. Откройте для себя их прямо сейчас!

11 инструментов
xix.ai
Образование и обучение Платформы для создания викторин с ИИ для учителей, репетиторов и программ обучения в группах
Платформы для создания викторин с ИИ для учителей, репетиторов и программ обучения в группах

2026 Latest Best AI Quiz Builder Platforms for Teachers, Tutors, and Cohort-Based Learning Programs! XIX.AI has curated a top-rated list of powerful game-changing tools that go through real-world tests to deliver accurate rankings. These must-try platforms help boost writing efficiency, streamline content creation, and simplify quiz design across all learning scenarios. Explore now to discover your perfect tool for unlocking your AI edge in teaching!

13 инструментов
xix.ai
Комментарии (29)
0/500
FrankMoore
FrankMoore 1 февраля 2026 г., 15:01:04 GMT+03:00

看起来这家叫做Deep Cogito的新公司有点门道。IDA架构?之前没听说过这个技术,好奇跟MoE比怎么样。要是能出个小点的模型让大家体验一下就好了,毕竟现在动辄几十B参数量,普通开发者根本玩不起。希望别只是实验室数据漂亮,实际应用打折扣。

HenryJackson
HenryJackson 14 ноября 2025 г., 15:30:36 GMT+03:00

このモデルの性能、ほかの同サイズのモデルより優れてるの?IDAの手法が効いてるのかな。個人的には倫理的な側面も気になるけど、オープンソースなのはすごく良いと思う👍 実際に使ってみたい!

RoyWhite
RoyWhite 13 августа 2025 г., 12:00:59 GMT+03:00

Deep Cogito's LLMs sound like a game-changer! Outperforming models of similar size with IDA is no small feat. Curious to see how these stack up in real-world tasks. 🚀

PaulThomas
PaulThomas 6 августа 2025 г., 22:01:00 GMT+03:00

Super cool to see Deep Cogito pushing the boundaries with their LLMs! 😎 Those parameter sizes are wild—wonder how they stack up in real-world tasks?

GregoryCarter
GregoryCarter 21 апреля 2025 г., 6:16:16 GMT+03:00

LLM от Deep Cogito впечатляют, но приложение могло бы иметь лучший UI. Навигация по разным размерам моделей немного неуклюжая. Тем не менее, производительность на высшем уровне, особенно с технологией IDA. Обязательно стоит посмотреть, если вы интересуетесь ИИ и хотите увидеть, что возможно с большими языковыми моделями! 🤖💡

EricRoberts
EricRoberts 20 апреля 2025 г., 7:40:17 GMT+03:00

ディープコギトのLLMは印象的ですが、アプリのUIがもう少し改善されると良いですね。モデルサイズをナビゲートするのが少しぎこちないです。それでも、パフォーマンスは最高で、特にIDAテクノロジーとの組み合わせが素晴らしいです。AIに興味があるなら、大規模言語モデルの可能性を見る価値がありますよ!🤖💡

OR