Дом
Zhipu представляет GLM-5.3-Flash — мультимодальную модель с открытым исходным кодом по цене, составляющей 1/40 от рыночной
Компания Zhipu официально представила и открыла исходный код GLM-5.3-Flash (320B-A18B) — первой нативной мультимодальной модели серии GLM-5, обеспечивающей передовую производительность ИИ при беспрецедентно низкой стоимости.
Обладая ведущими в мире возможностями, модель набрала 57 баллов по индексу Artificial Analysis Intelligence Index, что соответствует результату Claude Opus4.8. По сравнению с более крупной моделью GLM-5.2 она демонстрирует превосходную комплексную производительность и высокий уровень владения кодированием. До своего выпуска она анонимно возглавляла рейтинги использования на OpenCode и OpenRouter под названием «Ox-Alpha».

Экономическая эффективность является ключевым преимуществом. Стоимость GLM-5.3-Flash составляет всего одну десятую от стоимости стандартной версии GLM-5.3 — а во время ограниченных по времени акций даже одну двадцатую — что примерно в сорок раз дешевле, чем Opus4.8, что значительно снижает барьер для доступа к передовым технологиям искусственного интеллекта.
С архитектурной точки зрения модель использует гибридный механизм разреженного и линейного внимания — впервые для передовых моделей с открытым исходным кодом. Усовершенствованная за счет суперсвязей с многомерными ограничениями, она сокращает вычисления внимания в 3,01 раза, а использование кэша KV — в 4,44 раза, оптимизируя баланс между обработкой длинных контекстов и затратами на инференцию. Благодаря встроенной визуальной интеграции модель позволяет независимо выполнять фронтенд-разработку, 3D-моделирование и создание документов, что делает её идеальным решением для таких профессиональных сфер, как финансы и право.

Примечательно, что модель работает исключительно на кластерах отечественных чипов. Используя специальный движок инференса с разделением EPD и усовершенствованными оптимизациями памяти, команда добилась трехкратного увеличения скорости сквозной инференции, что соответствует эффективности использования аппаратных ресурсов основных графических процессоров NVIDIA и подтверждает способность отечественных вычислительных ресурсов справляться с задачами крупномасштабного ИИ.
GLM-5.3-Flash является полностью открытым проектом, предоставляющим доступ к API, онлайн-демо и интеграцию с платформами-агентами, такими как ZCode и AutoClaw. Он также предлагает ежедневные пробные карты, дающие право на десять тысяч использований, доступные разработчикам по всему миру.
Онлайн-тестирование
Z.ai: https://chat.z.ai
Приложение Zhipu Qingyan: https://chatglm.cn
Связанная статья
ByteDance’s Seed запускает глобальную кампанию по набору сотрудников в кампусах, предлагая виртуальные акции для привлечения лучших специалистов по крупным языковым моделям
В условиях конкурентной борьбы крупных языковых моделей привлечение высококвалифицированных специалистов остается самым важным стратегическим активом.1 апреля ByteDance объявил о запуске глобальной программы набора на кампусы Seed, являющейся частью
Suno добавляет водяные знаки на песни в ходе судебных разбирательств
Suno, платформа, позволяющая пользователям создавать музыку с помощью искусственного интеллекта, представила новые функции для маркировки треков, созданных на платформе, ограничения на скачивание и обновления стандартов сообщества для борьбы с несанк
Маск признал, что утечка кода Grok привела к раскрытию пользовательских данных, и пообещал стереть всю историческую информацию.
Илон Маск напрямую отреагировал на скандал с конфиденциальностью вокруг Grok Build, начав с простого «Да», чтобы подтвердить достоверность инцидента. Он пообещал, что все данные пользователей, ранее загруженные в SpaceXAI, будут безвозвратно удалены,
Рекомендации по связанным специальным темам
Комментарии (0)
Компания Zhipu официально представила и открыла исходный код GLM-5.3-Flash (320B-A18B) — первой нативной мультимодальной модели серии GLM-5, обеспечивающей передовую производительность ИИ при беспрецедентно низкой стоимости.
Обладая ведущими в мире возможностями, модель набрала 57 баллов по индексу Artificial Analysis Intelligence Index, что соответствует результату Claude Opus4.8. По сравнению с более крупной моделью GLM-5.2 она демонстрирует превосходную комплексную производительность и высокий уровень владения кодированием. До своего выпуска она анонимно возглавляла рейтинги использования на OpenCode и OpenRouter под названием «Ox-Alpha».

Экономическая эффективность является ключевым преимуществом. Стоимость GLM-5.3-Flash составляет всего одну десятую от стоимости стандартной версии GLM-5.3 — а во время ограниченных по времени акций даже одну двадцатую — что примерно в сорок раз дешевле, чем Opus4.8, что значительно снижает барьер для доступа к передовым технологиям искусственного интеллекта.
С архитектурной точки зрения модель использует гибридный механизм разреженного и линейного внимания — впервые для передовых моделей с открытым исходным кодом. Усовершенствованная за счет суперсвязей с многомерными ограничениями, она сокращает вычисления внимания в 3,01 раза, а использование кэша KV — в 4,44 раза, оптимизируя баланс между обработкой длинных контекстов и затратами на инференцию. Благодаря встроенной визуальной интеграции модель позволяет независимо выполнять фронтенд-разработку, 3D-моделирование и создание документов, что делает её идеальным решением для таких профессиональных сфер, как финансы и право.

Примечательно, что модель работает исключительно на кластерах отечественных чипов. Используя специальный движок инференса с разделением EPD и усовершенствованными оптимизациями памяти, команда добилась трехкратного увеличения скорости сквозной инференции, что соответствует эффективности использования аппаратных ресурсов основных графических процессоров NVIDIA и подтверждает способность отечественных вычислительных ресурсов справляться с задачами крупномасштабного ИИ.
GLM-5.3-Flash является полностью открытым проектом, предоставляющим доступ к API, онлайн-демо и интеграцию с платформами-агентами, такими как ZCode и AutoClaw. Он также предлагает ежедневные пробные карты, дающие право на десять тысяч использований, доступные разработчикам по всему миру.
Онлайн-тестирование
Z.ai: https://chat.z.ai
Приложение Zhipu Qingyan: https://chatglm.cn
ByteDance’s Seed запускает глобальную кампанию по набору сотрудников в кампусах, предлагая виртуальные акции для привлечения лучших специалистов по крупным языковым моделям
В условиях конкурентной борьбы крупных языковых моделей привлечение высококвалифицированных специалистов остается самым важным стратегическим активом.1 апреля ByteDance объявил о запуске глобальной программы набора на кампусы Seed, являющейся частью
Suno добавляет водяные знаки на песни в ходе судебных разбирательств
Suno, платформа, позволяющая пользователям создавать музыку с помощью искусственного интеллекта, представила новые функции для маркировки треков, созданных на платформе, ограничения на скачивание и обновления стандартов сообщества для борьбы с несанк
Маск признал, что утечка кода Grok привела к раскрытию пользовательских данных, и пообещал стереть всю историческую информацию.
Илон Маск напрямую отреагировал на скандал с конфиденциальностью вокруг Grok Build, начав с простого «Да», чтобы подтвердить достоверность инцидента. Он пообещал, что все данные пользователей, ранее загруженные в SpaceXAI, будут безвозвратно удалены,











