Малая модель Qwen 3.5 от Alibaba бросает вызов GPT-4o

Модель с 4 миллиардами параметров доказывает, что «меньше — значит больше», открывая новую эру внедрения локального ИИ в Китае
В сфере ИИ долгое время считалось, что большее количество параметров означает более высокий уровень интеллекта. Однако недавно выпущенная Alibaba серия небольших моделей Qwen 3.5 стала наглядным примером того, что «малое побеждает большое». В реальных тестах модель Qwen 3.5-4B, имеющая всего 4 миллиарда параметров, сошлась в прямом противостоянии с моделью GPT-4o, которая, по слухам, имеет более 100 миллиардов параметров, и не только не уступила, но даже немного опередила соперника.
Этот межуровневый конкурс был организован сторонней организацией N8 Programs. Тестировщики случайным образом отобрали 1000 реальных вопросов из набора данных WildChat, поставив Qwen 3.5-4B и GPT-4o на одну арену, а Opus 4.6 — в настоящее время признанный самым мощным судьей — наблюдал за соревнованием. Результаты оказались неожиданными: в ходе этой серии из 1000 раундов вопросов и ответов Qwen 3.5-4B одержал 499 побед, потерпел 431 поражение и сыграл 70 ничьих, в итоге превзойдя GPT-4o.
Самым поразительным является то, что, по предположениям, GPT-4o обладает до 200 миллиардов параметров, в то время как у Qwen 3.5-4B их всего 2%. Это демонстрирует достижение Alibaba в области логического мышления высшего уровня при минимальных затратах ресурсов.
Помимо впечатляющей производительности, основная привлекательность серии Qwen 3.5 заключается в ее исключительной пригодности для локального развертывания. Официальный релиз включает четыре варианта — 0,8B, 2B, 4B и 9B — охватывающие сценарии от периферийных устройств IoT до серверов. Особого внимания заслуживает версия 4B, для работы которой теоретически требуется всего 8 ГБ VRAM, при этом для плавной работы рекомендуется 16 ГБ.
Для обычных пользователей и разработчиков это представляет собой своего рода «освобождение вычислительной мощности». Больше нет необходимости в профессиональных вычислительных картах, стоимостью в десятки тысяч; теперь вы можете иметь «личный помощник» с производительностью, соперничающей с топовыми крупными моделями, прямо на своем собственном компьютере — или даже смартфоне.
Как продемонстрировала команда Qwen : больше не всегда значит лучше. ИИ, способный работать на собственных устройствах пользователей, — это настоящий прорыв для будущей производительности. Поскольку версия 9B напрямую конкурирует по производительности с крупными моделями класса 120B, китайские крупные модели демонстрируют уникальные инновационные возможности Китая благодаря этому подходу «оптимизации», раскрывая глобальному сообществу разработчиков силу ИИ «Made-in-China».
Связанная статья
Акции США достигли исторической отметки, поскольку гиганты искусственного интеллекта и аэрокосмической отрасли готовятся к дебюту с оценкой в триллион долларов
Илон Маск, Сэм Алтман и Дарио Амодэй, три титана технологического сектора, продвигаются к первичным публичным предложениям акций своих respective компаний. Благодаря SpaceX, OpenAI и Anthropic — трем отраслевым гигантам, чья оценка приближается к три
Шведский стартап в области искусственного интеллекта Lovable Eyes достиг оценки в 13,2 миллиарда долларов после крупного раунда финансирования
По мере того как инструменты для программирования на основе искусственного интеллекта набирают популярность, шведский стартап Lovable привлек крупный раунд финансирования. Компания нацелена на привлечение $3 млрд, что потенциально может увеличить её
Google тестирует агента Remy AI для Gemini по мере смещения фокуса на управление пользователями
Согласно Business Insider, Google тестирует Remy, нового ИИ-персонального агента для Gemini. Этот инструмент предназначен для выполнения задач от имени пользователей, упрощая как профессиональные рабочие процессы, так и повседневные рутины.В настоящ
Рекомендации по связанным специальным темам
Комментарии (2)
Alibaba's Qwen 3.5 with just 4B params taking on GPT-4o? That's hilarious — reminds me of David vs Goliath but with neural nets. "Less is more" might be true for local deployment, but I bet real benchmarks will tell a different story. Still, props for challenging the parameter arms race. 🍵

Модель с 4 миллиардами параметров доказывает, что «меньше — значит больше», открывая новую эру внедрения локального ИИ в Китае
В сфере ИИ долгое время считалось, что большее количество параметров означает более высокий уровень интеллекта. Однако недавно выпущенная Alibaba серия небольших моделей
Этот межуровневый конкурс был организован сторонней организацией N8 Programs. Тестировщики случайным образом отобрали 1000 реальных вопросов из набора данных WildChat, поставив Qwen 3.5-4B и GPT-4o на одну арену, а Opus 4.6 — в настоящее время признанный самым мощным судьей — наблюдал за соревнованием. Результаты оказались неожиданными: в ходе этой серии из 1000 раундов вопросов и ответов Qwen 3.5-4B одержал 499 побед, потерпел 431 поражение и сыграл 70 ничьих, в итоге превзойдя GPT-4o.
Самым поразительным является то, что, по предположениям, GPT-4o обладает до 200 миллиардов параметров, в то время как у Qwen 3.5-4B их всего 2%. Это демонстрирует достижение Alibaba в области логического мышления высшего уровня при минимальных затратах ресурсов.
Помимо впечатляющей производительности, основная привлекательность серии Qwen 3.5 заключается в ее исключительной пригодности для локального развертывания. Официальный релиз включает четыре варианта — 0,8B, 2B, 4B и 9B — охватывающие сценарии от периферийных устройств IoT до серверов. Особого внимания заслуживает версия 4B, для работы которой теоретически требуется всего 8 ГБ VRAM, при этом для плавной работы рекомендуется 16 ГБ.
Для обычных пользователей и разработчиков это представляет собой своего рода «освобождение вычислительной мощности». Больше нет необходимости в профессиональных вычислительных картах, стоимостью в десятки тысяч; теперь вы можете иметь «личный помощник» с производительностью, соперничающей с топовыми крупными моделями, прямо на своем собственном компьютере — или даже смартфоне.
Как продемонстрировала команда
Акции США достигли исторической отметки, поскольку гиганты искусственного интеллекта и аэрокосмической отрасли готовятся к дебюту с оценкой в триллион долларов
Илон Маск, Сэм Алтман и Дарио Амодэй, три титана технологического сектора, продвигаются к первичным публичным предложениям акций своих respective компаний. Благодаря SpaceX, OpenAI и Anthropic — трем отраслевым гигантам, чья оценка приближается к три
Шведский стартап в области искусственного интеллекта Lovable Eyes достиг оценки в 13,2 миллиарда долларов после крупного раунда финансирования
По мере того как инструменты для программирования на основе искусственного интеллекта набирают популярность, шведский стартап Lovable привлек крупный раунд финансирования. Компания нацелена на привлечение $3 млрд, что потенциально может увеличить её
Alibaba's Qwen 3.5 with just 4B params taking on GPT-4o? That's hilarious — reminds me of David vs Goliath but with neural nets. "Less is more" might be true for local deployment, but I bet real benchmarks will tell a different story. Still, props for challenging the parameter arms race. 🍵





Дом






