вариант
Дом
Новости
Самообучающиеся агенты ИИ для преобразования веб-опыта: Руководство по подготовке

Самообучающиеся агенты ИИ для преобразования веб-опыта: Руководство по подготовке

19 ноября 2025 г.
159

Самообучающиеся агенты ИИ для преобразования веб-опыта: Руководство по подготовке

В своей новой работе известные исследователи искусственного интеллекта Дэвид Сильвер и Ричард Саттон утверждают, что искусственный интеллект вступает в преобразующую "Эру опыта". Они полагают, что системы ИИ будут все больше выходить за рамки зависимости от данных, предоставляемых человеком, а вместо этого будут развиваться за счет прямого взаимодействия с миром и сбора данных из него.

Хотя статья является концептуальной и перспективной, ее выводы имеют непосредственное отношение к предприятиям, планирующим разработку и интеграцию будущих агентов и систем ИИ.

И Сильвер, и Саттон - авторитетные ученые с историей точных прогнозов относительно траектории развития ИИ. Их прозорливость видна в самых передовых современных системах ИИ. В своем влиятельном эссе "Горький урок", опубликованном в 2019 году, пионер технологии обучения с подкреплением Саттон утверждал, что наиболее значительные долгосрочные прорывы в области ИИ неизменно связаны с масштабированием поиска и обучения общего назначения с помощью массивных вычислений, а не с внедрением сложных человеческих знаний.

Дэвид Сильвер, главный научный сотрудник DeepMind, сыграл ведущую роль в разработке AlphaGo, AlphaZero и AlphaStar - основных вех в глубоком обучении с подкреплением. Он также стал соавтором работы 2021 года, в которой утверждалось, что обучение с подкреплением в сочетании с хорошо продуманным сигналом вознаграждения может в конечном итоге привести к созданию высокоразвитого ИИ.

Самые сложные современные большие языковые модели (БЯМ) служат примером этих двух концепций. Волна мощных LLM со времен GPT-3 в основном опиралась на масштабирование вычислительной мощности и данных для поглощения огромных знаний. Более поздние модели рассуждений, такие как DeepSeek-R1, демонстрируют, что обучение с подкреплением и простым сигналом вознаграждения достаточно для приобретения сложных способностей рассуждения.

Что такое "Эра опыта"?

Эра опыта" основывается на концепциях, которые отстаивали Саттон и Сильвер, но теперь они контекстуализированы с учетом последних достижений в области ИИ. Авторы отмечают, что "темпы прогресса, обусловленные исключительно контролируемым обучением на основе человеческих данных, заметно замедляются, что свидетельствует о необходимости нового подхода".

Этот новый подход требует свежего источника данных, генерируемого таким образом, чтобы он постоянно улучшался по мере роста способностей агента. "Этого можно достичь, позволив агентам постоянно учиться на собственном опыте, то есть на данных, которые генерируются агентом, взаимодействующим со своим окружением", - объясняют Саттон и Сильвер. Они утверждают, что со временем "опыт станет доминирующим средством совершенствования и в конечном итоге затмит масштаб человеческих данных, используемых в современных системах".

По мнению авторов, будущие системы ИИ "преодолеют ограничения человеко-ориентированных систем ИИ" не только за счет обучения на основе опытных данных, но и по четырем ключевым параметрам:

  1. Потоки: Вместо того чтобы действовать в изолированных эпизодах, агенты ИИ будут "иметь свой собственный поток опыта, который, как и у людей, развивается в течение длительного времени". Это позволит осуществлять долгосрочное планирование и постепенную адаптацию поведения. Первые признаки этого проявляются в системах ИИ с обширными контекстными окнами и архитектурами памяти, которые постоянно обновляются при взаимодействии с пользователем.
  2. Действия и наблюдения: Выходя за пределы действий и наблюдений, основанных на привилегиях человека, агенты эпохи опыта будут действовать автономно в реальном мире. Мы видим это в агентных системах, которые взаимодействуют с внешними приложениями и ресурсами с помощью таких инструментов, как компьютерное управление и протокол модельного контекста (MCP).
  3. Вознаграждения: В то время как современные системы обучения с подкреплением в значительной степени зависят от разработанных человеком функций вознаграждения, будущие агенты ИИ должны создавать свои собственные динамические функции вознаграждения. Они будут развиваться со временем, согласуя предпочтения пользователя с реальной обратной связью от действий и наблюдений агента. Первые саморазрабатывающиеся системы вознаграждения, такие как DrEureka от Nvidia, дают представление о будущем.
  4. Планирование и рассуждения: Современные модели рассуждений часто разрабатываются для имитации человеческого мышления. Авторы предполагают, что "наверняка существуют более эффективные механизмы мышления, использующие нечеловеческие языки, которые могут, например, использовать символические, распределенные, непрерывные или дифференцируемые вычисления". Агенты ИИ должны взаимодействовать с миром, используя наблюдаемые данные для проверки, уточнения и обновления своих рассуждений при построении внутренней модели мира.

Концепция адаптации агентов ИИ с помощью обучения с подкреплением не нова, но исторически такие агенты были ограничены жестко контролируемыми средами, такими как настольные игры. Теперь агенты, способные ориентироваться в сложных условиях, таких как операционные компьютеры, в сочетании с прогрессом в области обучения с подкреплением, готовы преодолеть эти ограничения, ускорив переход к эре опыта.

Что это значит для предприятия?

Важное замечание в статье Саттона и Сильвера, касающееся реальных приложений, гласит: "Агент может использовать "дружественные человеку" действия и наблюдения, такие как пользовательские интерфейсы, которые естественным образом облегчают общение и сотрудничество с пользователем. Агент также может предпринимать "удобные для машины" действия, которые выполняют код и вызывают API, позволяя агенту действовать автономно для достижения своих целей".

Эра опыта подразумевает, что разработчики должны создавать приложения как для человеческих пользователей, так и для агентов ИИ. Удобные для машин действия требуют безопасных и доступных API, доступных напрямую или через такие интерфейсы, как MCP. Это также предполагает создание агентов, которых можно обнаружить с помощью таких протоколов, как Agent2Agent от Google. Разработка API и агентских интерфейсов, предоставляющих доступ как к действиям, так и к наблюдениям, позволит агентам постепенно рассуждать и учиться на основе взаимодействия с вашим программным обеспечением.

Если концепция Саттона и Сильвера воплотится в жизнь, миллиарды агентов со временем будут работать в Интернете, а затем и в физическом мире, выполняя поставленные задачи. Их поведение и требования будут кардинально отличаться от человеческих пользователей. Создание методов взаимодействия с агентами будет иметь решающее значение для эффективного использования будущих систем ИИ и снижения потенциальных рисков.

"Опираясь на основы RL и адаптируя ее основные принципы к вызовам новой эпохи, мы сможем раскрыть весь потенциал автономного обучения и проложить путь к действительно сверхчеловеческому интеллекту", - заключают Саттон и Сильвер.

Компания DeepMind отказалась предоставить дополнительные комментарии для этой статьи.

Связанная статья
Google тестирует агента Remy AI для Gemini по мере смещения фокуса на управление пользователями Google тестирует агента Remy AI для Gemini по мере смещения фокуса на управление пользователями Согласно Business Insider, Google тестирует Remy, нового ИИ-персонального агента для Gemini. Этот инструмент предназначен для выполнения задач от имени пользователей, упрощая как профессиональные рабочие процессы, так и повседневные рутины.В настоящ
Олли делает ставку на приватность, чтобы выиграть гонку за лидерство в сфере ИИ-помощников Олли делает ставку на приватность, чтобы выиграть гонку за лидерство в сфере ИИ-помощников Чтобы быть по-настоящему полезным, ИИ-помощник должен глубоко понимать своего пользователя. Ollie — личный помощник, разработанный для повседневной жизни, — работает по принципу, согласно которому для
Как на мероприятии AI LIVE: London будут рассматриваться темы искусственного интеллекта и промышленной автоматизации Как на мероприятии AI LIVE: London будут рассматриваться темы искусственного интеллекта и промышленной автоматизации На саммите соберутся руководители высшего звена со всего мира, чтобы обсудить актуальные проблемы мировых отраслей — от радикальных изменений, вызванных искусственным интеллектом, до экономической нес
Рекомендации по связанным специальным темам
Анализ данных Лучшие инструменты ИИ для обнаружения аномалий при мониторинге KPI в командах SaaS и электронной коммерции
Лучшие инструменты ИИ для обнаружения аномалий при мониторинге KPI в командах SaaS и электронной коммерции

2026 г. Лучшие новейшие высокооцененные инструменты ИИ для обнаружения аномалий в мониторинге KPI для команд SaaS и электронной коммерции! XIX.AI подготовила мощную, меняющую правила игры коллекцию на основе строгих реальных тестов и еженедельно обновляемых рейтингов. Вы найдете подробные сравнительные данные по бесплатным и платным решениям, которые помогут вам определить обязательное к использованию решение, повышающее производительность и раскрывающее ваш потенциал в области ИИ. Исследуйте сейчас!

10 инструментов
xix.ai
письмо Лучшие генераторы конспектов на базе ИИ для длинных статей, оптимизированных для SEO
Лучшие генераторы конспектов на базе ИИ для длинных статей, оптимизированных для SEO

2026 год: лучшие и самые высокооцененные генераторы конспектов на базе ИИ для длинных SEO-статей, тщательно отобранные XIX.AI. Эти мощные инструменты обеспечивают революционную помощь в быстром создании высококачественного контента, значительно повышая эффективность написания текстов. Ознакомьтесь со сравнением бесплатных и платных версий, а также с результатами реальных тестов и подробными рейтингами, которые помогут вам найти вариант, который обязательно стоит попробовать и который соответствует вашим потребностям. Изучите их прямо сейчас, чтобы раскрыть весь потенциал ИИ.

8 инструментов
xix.ai
Образование и обучение Инструменты на базе искусственного интеллекта для выполнения домашних заданий и подготовки к экзаменам
Инструменты на базе искусственного интеллекта для выполнения домашних заданий и подготовки к экзаменам

2026: лучшие современные инструменты на базе ИИ для выполнения домашних заданий и подготовки к экзаменам! XIX.AI подготовило рейтинг самых эффективных и революционных инструментов, которые помогают учащимся повысить продуктивность, оптимизировать выполнение домашних заданий и сдавать экзамены на «отлично», проходя проверку в реальных условиях. Получите сравнение бесплатных и платных версий, подробные рейтинги и варианты, которые обязательно стоит попробовать, чтобы раскрыть свой потенциал с помощью ИИ. Узнайте больше прямо сейчас!

10 инструментов
xix.ai
Музыкальная композиция Инструменты для создания вокальных демо на основе ИИ для авторов песен, создания хуков, написания тоpline-мелодий и проведения многоязычных черновых сессий
Инструменты для создания вокальных демо на основе ИИ для авторов песен, создания хуков, написания тоpline-мелодий и проведения многоязычных черновых сессий

2026 г. лучшие инструменты для демо-записи вокала на базе ИИ для авторов песен, создателей хуков и команд, работающих с контентом на нескольких языках! XIX.AI подготовил список высокооцененных мощных инструментов, изменивших правила игры, прошедших строгие реальные тесты. Вы найдёте подробные данные сравнения бесплатных и платных версий, комплексные рейтинги и обязательные к использованию варианты, которые помогут повысить эффективность написания и раскрыть ваш творческий потенциал. Исследуйте сейчас, чтобы найти идеальный инструмент для всех ваших задач по созданию контента!

9 инструментов
xix.ai
Бизнес Лучшие инструменты для анализа конкурентов на основе искусственного интеллекта для малого бизнеса
Лучшие инструменты для анализа конкурентов на основе искусственного интеллекта для малого бизнеса

2026: новейшие, лучшие и самые высокооцененные инструменты для анализа конкурентов на базе ИИ для малого бизнеса! XIX.AI подготовила чрезвычайно мощную подборку, способную кардинально изменить ситуацию на рынке, которая еженедельно обновляется на основе тщательных тестов в реальных условиях и подробных рейтингов. Вы найдете здесь исчерпывающее сравнение бесплатных и платных версий, которое поможет вам определить инструменты, которые обязательно стоит попробовать, чтобы повысить свою продуктивность и получить конкурентное преимущество. Ознакомьтесь с ней прямо сейчас, чтобы найти идеальный инструмент для себя!

9 инструментов
xix.ai
Редактирование изображений Инструменты ИИ-ретуши в Photoshop для электронной коммерции, одежды, очистки кожи и обеспечения цветового единообразия
Инструменты ИИ-ретуши в Photoshop для электронной коммерции, одежды, очистки кожи и обеспечения цветового единообразия

2026 Latest Best Photoshop AI retouch tools for ecommerce apparel, skin cleanup, and color consistency! This top-rated curated list features powerful game-changing solutions that help you boost writing efficiency, streamline content creation, and achieve perfect visual results effortlessly. Each tool has undergone real-world tests through weekly updated rankings, complete with free vs paid comparison details. Backed by XIX.AI, it’s the must-try guide for anyone aiming to unlock your AI edge. Explore now!

10 инструментов
xix.ai
Комментарии (1)
0/500
WillNelson
WillNelson 27 июля 2026 г., 21:00:12 GMT+03:00

So we're moving from data-hungry models to ones that learn from experience? That's a huge shift. But how do we ensure they don't go off the rails without human oversight? 🤔

OR