Дом
Флагманская модель M3 от MiniMax и её индикатор производят впечатление, но вызывают неоднозначную реакцию
Конкуренция в сфере крупных языковых моделей продолжает обостряться: стартап MiniMax, специализирующийся на искусственном интеллекте, недавно представил свою новую флагманскую модель M3. Согласно результатам тестирования, приведенным в техническом отчете, модель демонстрирует впечатляющую производительность: она набрала 59 % в тестах, имитирующих реальные задачи программной инженерии, превзойдя GPT-5.5 и приблизившись к результатам Opus4.7. Кроме того, она поддерживает обработку контекста объёмом в миллион токенов и обладает встроенными мультимодальными возможностями. Однако, несмотря на эти значительные технические достижения, запуск модели вызвал значительную негативную реакцию со стороны сообщества разработчиков, причём особенно резкая критика прозвучала на китайских интернет-форумах.
Основной причиной скептицизма является методология оценки. Технические детали показывают, что M3 использовала Claude Code — конкурирующую модель — в качестве оценочной платформы для тестирования своих возможностей в области программирования. Хотя использование существующих инструментальных цепочек для оценки агентов является общепринятой практикой, критики утверждают, что MiniMax по сути тестировала свою собственную модель на платформе конкурента и напрямую заявляла о высоких результатах, сравнивая себя с тем же конкурентом в публичных рекламных материалах. Многие разработчики назвали такой подход нечестным, поскольку он затрудняет отделение собственных возможностей модели от улучшений, обеспечиваемых самой средой.

Еще одним предметом спора является искренность обязательств по открытому исходному коду. В отличие от других поставщиков, которые выпускают модели с открытым исходным кодом и полными весами, MiniMax не раскрыла размер модели M3 и не предоставила ее веса. Компания лишь заявила, что сделает модель открытой в течение десяти дней, предоставив на момент запуска только доступ к API. Поскольку воспроизводимость и проверяемость являются ключевыми ценностями сообщества открытого исходного кода, продвижение открытого исходного кода при одновременном утаивании весов — хотя это и понятно с коммерческой точки зрения — оттолкнуло сообщество разработчиков, которое ожидает прозрачности и практичности.

Что больше всего разочаровало активных пользователей, так это внезапное изменение правил тарификации. Ранее MiniMax славилась щедрыми лимитами использования, ограничивая количество запросов без ежемесячного ограничения на токены. С выпуском M3 компания ввела новый тарифный план на основе токенов, в котором оплата взимается по общему объему. Хотя официальная позиция заключается в том, что тарифный план «Plus» предлагает высокую ценность токенов, активные пользователи — особенно те, кто работает с контекстами объемом в миллионы токенов — обнаруживают, что каждый вызов потребляет значительное количество токенов, что быстро исчерпывает квоты пакета. Это привело к массовым жалобам со стороны давних пользователей.
Если отбросить в сторону операционные споры, M3 действительно обладает заметными инновациями на архитектурном уровне. В нём внедрен самостоятельно разработанный механизм разреженного внимания под названием MSA (MiniMax Sparse Attention), который смягчает квадратичный рост вычислительных затрат традиционных трансформеров за счёт применения высокоточного разбиения на блоки и разрежения пар «ключ-значение». На низкоуровневом уровне операторов модель использует новый метод агрегации вычислений, который улучшает непрерывность доступа к памяти, обеспечивая скорость, в четыре раза превышающую скорость открытого исходного кода Flash-Sparse-Attention. В результате M3 увеличивает скорость прямого распространения и декодирования соответственно в 9 и 15 раз при контекстах объёмом в миллион токенов, сокращая вычисления на один токен вдвое по сравнению с предыдущим поколением.
Связанная статья
Акции США достигли исторической отметки, поскольку гиганты искусственного интеллекта и аэрокосмической отрасли готовятся к дебюту с оценкой в триллион долларов
Илон Маск, Сэм Алтман и Дарио Амодэй, три титана технологического сектора, продвигаются к первичным публичным предложениям акций своих respective компаний. Благодаря SpaceX, OpenAI и Anthropic — трем отраслевым гигантам, чья оценка приближается к три
Шведский стартап в области искусственного интеллекта Lovable Eyes достиг оценки в 13,2 миллиарда долларов после крупного раунда финансирования
По мере того как инструменты для программирования на основе искусственного интеллекта набирают популярность, шведский стартап Lovable привлек крупный раунд финансирования. Компания нацелена на привлечение $3 млрд, что потенциально может увеличить её
Google тестирует агента Remy AI для Gemini по мере смещения фокуса на управление пользователями
Согласно Business Insider, Google тестирует Remy, нового ИИ-персонального агента для Gemini. Этот инструмент предназначен для выполнения задач от имени пользователей, упрощая как профессиональные рабочие процессы, так и повседневные рутины.В настоящ
Рекомендации по связанным специальным темам
Комментарии (0)
Конкуренция в сфере крупных языковых моделей продолжает обостряться: стартап MiniMax, специализирующийся на искусственном интеллекте, недавно представил свою новую флагманскую модель M3. Согласно результатам тестирования, приведенным в техническом отчете, модель демонстрирует впечатляющую производительность: она набрала 59 % в тестах, имитирующих реальные задачи программной инженерии, превзойдя GPT-5.5 и приблизившись к результатам Opus4.7. Кроме того, она поддерживает обработку контекста объёмом в миллион токенов и обладает встроенными мультимодальными возможностями. Однако, несмотря на эти значительные технические достижения, запуск модели вызвал значительную негативную реакцию со стороны сообщества разработчиков, причём особенно резкая критика прозвучала на китайских интернет-форумах.
Основной причиной скептицизма является методология оценки. Технические детали показывают, что M3 использовала Claude Code — конкурирующую модель — в качестве оценочной платформы для тестирования своих возможностей в области программирования. Хотя использование существующих инструментальных цепочек для оценки агентов является общепринятой практикой, критики утверждают, что MiniMax по сути тестировала свою собственную модель на платформе конкурента и напрямую заявляла о высоких результатах, сравнивая себя с тем же конкурентом в публичных рекламных материалах. Многие разработчики назвали такой подход нечестным, поскольку он затрудняет отделение собственных возможностей модели от улучшений, обеспечиваемых самой средой.

Еще одним предметом спора является искренность обязательств по открытому исходному коду. В отличие от других поставщиков, которые выпускают модели с открытым исходным кодом и полными весами, MiniMax не раскрыла размер модели M3 и не предоставила ее веса. Компания лишь заявила, что сделает модель открытой в течение десяти дней, предоставив на момент запуска только доступ к API. Поскольку воспроизводимость и проверяемость являются ключевыми ценностями сообщества открытого исходного кода, продвижение открытого исходного кода при одновременном утаивании весов — хотя это и понятно с коммерческой точки зрения — оттолкнуло сообщество разработчиков, которое ожидает прозрачности и практичности.

Что больше всего разочаровало активных пользователей, так это внезапное изменение правил тарификации. Ранее MiniMax славилась щедрыми лимитами использования, ограничивая количество запросов без ежемесячного ограничения на токены. С выпуском M3 компания ввела новый тарифный план на основе токенов, в котором оплата взимается по общему объему. Хотя официальная позиция заключается в том, что тарифный план «Plus» предлагает высокую ценность токенов, активные пользователи — особенно те, кто работает с контекстами объемом в миллионы токенов — обнаруживают, что каждый вызов потребляет значительное количество токенов, что быстро исчерпывает квоты пакета. Это привело к массовым жалобам со стороны давних пользователей.
Если отбросить в сторону операционные споры, M3 действительно обладает заметными инновациями на архитектурном уровне. В нём внедрен самостоятельно разработанный механизм разреженного внимания под названием MSA (MiniMax Sparse Attention), который смягчает квадратичный рост вычислительных затрат традиционных трансформеров за счёт применения высокоточного разбиения на блоки и разрежения пар «ключ-значение». На низкоуровневом уровне операторов модель использует новый метод агрегации вычислений, который улучшает непрерывность доступа к памяти, обеспечивая скорость, в четыре раза превышающую скорость открытого исходного кода Flash-Sparse-Attention. В результате M3 увеличивает скорость прямого распространения и декодирования соответственно в 9 и 15 раз при контекстах объёмом в миллион токенов, сокращая вычисления на один токен вдвое по сравнению с предыдущим поколением.
Акции США достигли исторической отметки, поскольку гиганты искусственного интеллекта и аэрокосмической отрасли готовятся к дебюту с оценкой в триллион долларов
Илон Маск, Сэм Алтман и Дарио Амодэй, три титана технологического сектора, продвигаются к первичным публичным предложениям акций своих respective компаний. Благодаря SpaceX, OpenAI и Anthropic — трем отраслевым гигантам, чья оценка приближается к три
Шведский стартап в области искусственного интеллекта Lovable Eyes достиг оценки в 13,2 миллиарда долларов после крупного раунда финансирования
По мере того как инструменты для программирования на основе искусственного интеллекта набирают популярность, шведский стартап Lovable привлек крупный раунд финансирования. Компания нацелена на привлечение $3 млрд, что потенциально может увеличить её











