Дом
Бывшие сотрудники Qwen Tech: Крупные модели эволюционируют в сущности, ориентированные на действия
Лин Цзюньян, бывший ведущий инженер команды разработки крупной языковой модели Qwen компании Alibaba, выступил со своими первыми публичными заявлениями через несколько недель после ухода из компании 26 марта, представив глубокий анализ дальнейшего развития технологий крупных моделей.
Лин Цзюньян отметил, что отрасль переходит от «мышления, основанного на рассуждениях», к «агентному мышлению (Agentic Thinking)». Он утверждает, что, если в прошлом году основное внимание уделялось увеличению времени «размышлений» моделей, то ключевым аспектом будущего является способность моделей «действовать» и постоянно совершенствовать свои планы посредством взаимодействия с реальным миром.
Размышления над путем развития Qwen: боль от принудительного объединения «рассуждений» и «инструкций»
В своей статье Лин Цзюньян открыто поделился попытками и выводами команды в начале 2025 года. Тогда команда стремилась создать единую систему, способную адаптировать глубину рассуждений в зависимости от сложности вопроса.
Однако практика показала, что значительные различия в распределении данных для рассуждений и инструкций привели к тому, что модель демонстрировала посредственные результаты в обеих областях после принудительной интеграции: она выглядела избыточной и нерешительной при размышлении, а при выполнении инструкций — ненадежной и затратной. Этот вывод объясняет, почему Qwen позже перешла на независимый выпуск версий Instruct и Thinking, предоставив ценные инженерные решения для отрасли.
Новый стандарт «хорошего мышления»: способность поддерживать эффективные действия является ключевой
По словам Лин Цзюньяна, длина цепи рассуждений не эквивалентна напрямую уровню интеллекта модели. Слепое преследование длинных цепей рассуждений часто приводит к расточительному использованию вычислительных мощностей. Он прогнозирует, что будущие исследования и разработки сместятся от обучения исключительно моделей к обучению всей системы агентов, состоящей из «модели + среда».
Связанная статья
Акции США достигли исторической отметки, поскольку гиганты искусственного интеллекта и аэрокосмической отрасли готовятся к дебюту с оценкой в триллион долларов
Илон Маск, Сэм Алтман и Дарио Амодэй, три титана технологического сектора, продвигаются к первичным публичным предложениям акций своих respective компаний. Благодаря SpaceX, OpenAI и Anthropic — трем отраслевым гигантам, чья оценка приближается к три
Шведский стартап в области искусственного интеллекта Lovable Eyes достиг оценки в 13,2 миллиарда долларов после крупного раунда финансирования
По мере того как инструменты для программирования на основе искусственного интеллекта набирают популярность, шведский стартап Lovable привлек крупный раунд финансирования. Компания нацелена на привлечение $3 млрд, что потенциально может увеличить её
Google тестирует агента Remy AI для Gemini по мере смещения фокуса на управление пользователями
Согласно Business Insider, Google тестирует Remy, нового ИИ-персонального агента для Gemini. Этот инструмент предназначен для выполнения задач от имени пользователей, упрощая как профессиональные рабочие процессы, так и повседневные рутины.В настоящ
Рекомендации по связанным специальным темам
Комментарии (0)
Лин Цзюньян, бывший ведущий инженер команды разработки крупной языковой модели Qwen компании Alibaba, выступил со своими первыми публичными заявлениями через несколько недель после ухода из компании 26 марта, представив глубокий анализ дальнейшего развития технологий крупных моделей.
Лин Цзюньян отметил, что отрасль переходит от «мышления, основанного на рассуждениях», к «агентному мышлению (Agentic Thinking)». Он утверждает, что, если в прошлом году основное внимание уделялось увеличению времени «размышлений» моделей, то ключевым аспектом будущего является способность моделей «действовать» и постоянно совершенствовать свои планы посредством взаимодействия с реальным миром.
Размышления над путем развития Qwen: боль от принудительного объединения «рассуждений» и «инструкций»
В своей статье Лин Цзюньян открыто поделился попытками и выводами команды в начале 2025 года. Тогда команда стремилась создать единую систему, способную адаптировать глубину рассуждений в зависимости от сложности вопроса.
Однако практика показала, что значительные различия в распределении данных для рассуждений и инструкций привели к тому, что модель демонстрировала посредственные результаты в обеих областях после принудительной интеграции: она выглядела избыточной и нерешительной при размышлении, а при выполнении инструкций — ненадежной и затратной. Этот вывод объясняет, почему Qwen позже перешла на независимый выпуск версий Instruct и Thinking, предоставив ценные инженерные решения для отрасли.
Новый стандарт «хорошего мышления»: способность поддерживать эффективные действия является ключевой
По словам Лин Цзюньяна, длина цепи рассуждений не эквивалентна напрямую уровню интеллекта модели. Слепое преследование длинных цепей рассуждений часто приводит к расточительному использованию вычислительных мощностей. Он прогнозирует, что будущие исследования и разработки сместятся от обучения исключительно моделей к обучению всей системы агентов, состоящей из «модели + среда».
Акции США достигли исторической отметки, поскольку гиганты искусственного интеллекта и аэрокосмической отрасли готовятся к дебюту с оценкой в триллион долларов
Илон Маск, Сэм Алтман и Дарио Амодэй, три титана технологического сектора, продвигаются к первичным публичным предложениям акций своих respective компаний. Благодаря SpaceX, OpenAI и Anthropic — трем отраслевым гигантам, чья оценка приближается к три
Шведский стартап в области искусственного интеллекта Lovable Eyes достиг оценки в 13,2 миллиарда долларов после крупного раунда финансирования
По мере того как инструменты для программирования на основе искусственного интеллекта набирают популярность, шведский стартап Lovable привлек крупный раунд финансирования. Компания нацелена на привлечение $3 млрд, что потенциально может увеличить её











