Дом
Ant Group представила Ling-2.6-flash с открытым исходным кодом — новую версию в семействе моделей Baoling
Сегодня серия крупных моделей Baoling от Ant Group получила значительное обновление: модель Ling-2.6-flash теперь официально доступна разработчикам по всему миру. Для обеспечения совместимости с различными аппаратными средами и снижения барьеров для внедрения в этой версии модели также представлены несколько вариантов точности, включая BF16, FP8 и INT4, что предоставляет разработчикам более гибкие возможности для инференса.
Ling-2.6-flash — это модель типа Instruct с общим количеством параметров 104 млрд и 7,4 млрд активированных параметров, которая ранее тестировалась под псевдонимом «Elephant Alpha» на платформе OpenRouter. В ходе двухнедельного испытания команда разработчиков собрала обширные отзывы из реальной практики и провела целенаправленную оптимизацию, в частности, значительно повысив плавность переключения между китайским и английским языками и улучшив совместимость с основными программными фреймворками.

Технические особенности: гибридная архитектура и превосходная эффективность
Основная силаLing-2.6-flash заключается в ее уникальной архитектуре и высокой операционной эффективности:
Гибридная линейная архитектура: благодаря низкоуровневой вычислительной оптимизации модель достигает превосходной скорости инференса. С 4 картами H20 она достигает до 340 токенов/с. По пропускной способности Prefill она превосходит Nemotron-3-Super в 2,2 раза, что значительно сокращает задержку отклика.
Впечатляющий коэффициент эффективности токенов: команда тщательно откалибровала эффективность токенов во время обучения. Данные оценки показывают, что для задач эквивалентного качества Ling-2.6-flash потребляет всего около 15 млн токенов — примерно одну десятую от сопоставимых конкурентов — что значительно снижает коммерческие затраты.
Углубление сценариев: целенаправленное улучшение возможностей агентов
Для сценариев с агентами — одного из наиболее распространенных вариантов использования больших моделей —Ling-2.6-flash был специально усовершенствован. Будь то обработка сложных вызовов инструментов, многоэтапное планирование или выполнение конечных задач, модель работает надежно. В нескольких отраслевых стандартных оценках, таких как BFCL-V4 и SWE-bench, даже по сравнению с моделями с большим количеством активированных параметров Ling-2.6-flash демонстрирует сопоставимую или даже передовую (SOTA) производительность.
Теперь разработчики могут получить доступ к открытым ресурсам модели через Hugging Face и ModelScope (сообщество Moba), что открывает возможности для дальнейшего изучения ее потенциала в различных отраслевых приложениях.
Связанная статья
ByteDance’s Seed запускает глобальную кампанию по набору сотрудников в кампусах, предлагая виртуальные акции для привлечения лучших специалистов по крупным языковым моделям
В условиях конкурентной борьбы крупных языковых моделей привлечение высококвалифицированных специалистов остается самым важным стратегическим активом.1 апреля ByteDance объявил о запуске глобальной программы набора на кампусы Seed, являющейся частью
Suno добавляет водяные знаки на песни в ходе судебных разбирательств
Suno, платформа, позволяющая пользователям создавать музыку с помощью искусственного интеллекта, представила новые функции для маркировки треков, созданных на платформе, ограничения на скачивание и обновления стандартов сообщества для борьбы с несанк
Маск признал, что утечка кода Grok привела к раскрытию пользовательских данных, и пообещал стереть всю историческую информацию.
Илон Маск напрямую отреагировал на скандал с конфиденциальностью вокруг Grok Build, начав с простого «Да», чтобы подтвердить достоверность инцидента. Он пообещал, что все данные пользователей, ранее загруженные в SpaceXAI, будут безвозвратно удалены,
Рекомендации по связанным специальным темам
Комментарии (0)
Сегодня серия крупных моделей Baoling от Ant Group получила значительное обновление:

Технические особенности: гибридная архитектура и превосходная эффективность
Основная сила
Гибридная линейная архитектура: благодаря низкоуровневой вычислительной оптимизации модель достигает превосходной скорости инференса. С 4 картами H20 она достигает до 340 токенов/с. По пропускной способности Prefill она превосходит Nemotron-3-Super в 2,2 раза, что значительно сокращает задержку отклика.
Впечатляющий коэффициент эффективности токенов: команда тщательно откалибровала эффективность токенов во время обучения. Данные оценки показывают, что для задач эквивалентного качества
Углубление сценариев: целенаправленное улучшение возможностей агентов
Для сценариев с агентами — одного из наиболее распространенных вариантов использования больших моделей —
Теперь разработчики могут получить доступ к открытым ресурсам модели через Hugging Face и ModelScope (сообщество Moba), что открывает возможности для дальнейшего изучения ее потенциала в различных отраслевых приложениях.
ByteDance’s Seed запускает глобальную кампанию по набору сотрудников в кампусах, предлагая виртуальные акции для привлечения лучших специалистов по крупным языковым моделям
В условиях конкурентной борьбы крупных языковых моделей привлечение высококвалифицированных специалистов остается самым важным стратегическим активом.1 апреля ByteDance объявил о запуске глобальной программы набора на кампусы Seed, являющейся частью
Suno добавляет водяные знаки на песни в ходе судебных разбирательств
Suno, платформа, позволяющая пользователям создавать музыку с помощью искусственного интеллекта, представила новые функции для маркировки треков, созданных на платформе, ограничения на скачивание и обновления стандартов сообщества для борьбы с несанк
Маск признал, что утечка кода Grok привела к раскрытию пользовательских данных, и пообещал стереть всю историческую информацию.
Илон Маск напрямую отреагировал на скандал с конфиденциальностью вокруг Grok Build, начав с простого «Да», чтобы подтвердить достоверность инцидента. Он пообещал, что все данные пользователей, ранее загруженные в SpaceXAI, будут безвозвратно удалены,











