Дом
Google преодолевает барьер мультимодального переключения, объединяя стандартные операции компьютера в модель Gemini 3.5 Flash.

Команда Google DeepMind объявила о значительном прорыве, позволяющем непосредственно встроить функции работы с компьютером в модель Gemini 3.5 Flash. Теперь разработчики могут создавать ИИ-агентов, способных автономно просматривать содержимое экранов и выполнять действия на них в браузерах, мобильных устройствах и настольных ПК с использованием одной и той же модели.
Ранее такая возможность была доступна только в виде отдельной модели, что требовало от разработчиков решения сложных задач по переключению между различными моделями и передаче контекста. Благодаря нативному интегрированию ИИ больше не нуждается в ручной передаче информации при выполнении длительных задач, работающих на разных платформах, что значительно упрощает процесс разработки.
Устранение потери контекста для повышения надежности агентов
Команда Google считает, что основным барьером для ИИ-агентов является не ограниченность отдельных инструментов, а потеря информации о контексте при переключении между различными инструментами. Объединив поиск, карты и операции с компьютером в единую архитектуру модели, удается обеспечить непрерывный поток контекста, что существенно снижает вероятность сбоев при выполнении сложных задач.
Такой подход к «интеграции нескольких инструментов» аналогичен строительству единого здания с внутренними соединениями, что исключает длительную и ошибочную коммуникацию между отдельными зданиями. Такая архитектурная трансформация способна привести к значительному улучшению надежности и скорости реагирования задач, основанных на использовании агентов.
Фокус на трех ключевых сценариях с многоуровневыми мерами безопасности
Эта нативная функция будет в первую очередь применяться в трех основных сценариях: автоматизированные задачи, требующие непрерывной работы в течение часов или дней, постоянные тесты программного обеспечения для проверки единообразия интерфейса, а также работа, требующая больших знаний и выполняемая в нескольких приложениях. Во всех этих случаях критически важна непрерывность контекста между задачами, что позволяет эффективно заменять людей при выполнении повторяющихся и трудоемких операций.
Что касается безопасности, Google применила многоуровневую стратегию защиты, включающую целенаправленное обучение на противоречивых данных, меры безопасности для конфиденциальных операций и выявление косвенного внедрения команд. Все эти механизмы в совокупности помогают корпоративным пользователям создать относительно полную защиту в открытых и неконтролируемых компьютерных средах.
Связанная статья
Slackbot становится ИИ-агентом
Slackbot, автоматизированный помощник, встроенный в корпоративную платформу обмена сообщениями Salesforce Slack, превращается в ИИ-агента. Технический директор Salesforce Паркер Харрис предполагает, что он достигнет вирусной популярности, сопоставимо
ByteDance усиливает основные стимулы для ИИ, поскольку Doubao растет на 14,6%
Недавно ByteDance провела краткий брифинг по акциям DouBao, чтобы раскрыть новые стимулирующие политики для сотрудников, участвующих в подразделении DouBao. Цена исполнения для акций DouBao была повышена с $14.85 в июне 2026 года до $17.02, что соста
MiniMax представляет программу Team Program с 10-кратным вознаграждением для стимулирования глобальных экспертов в области ИИ
Компания MiniMax (Xiyu Technology), Лаборатория общего искусственного интеллекта, официально запустила инициативу по глобальному сотрудничеству с талантами «Команда 10x». Эта программа направлена на привлечение ведущих экспертов из различных отраслей
Рекомендации по связанным специальным темам
Комментарии (0)

Команда Google DeepMind объявила о значительном прорыве, позволяющем непосредственно встроить функции работы с компьютером в модель Gemini 3.5 Flash. Теперь разработчики могут создавать ИИ-агентов, способных автономно просматривать содержимое экранов и выполнять действия на них в браузерах, мобильных устройствах и настольных ПК с использованием одной и той же модели.
Ранее такая возможность была доступна только в виде отдельной модели, что требовало от разработчиков решения сложных задач по переключению между различными моделями и передаче контекста. Благодаря нативному интегрированию ИИ больше не нуждается в ручной передаче информации при выполнении длительных задач, работающих на разных платформах, что значительно упрощает процесс разработки.
Устранение потери контекста для повышения надежности агентов
Команда Google считает, что основным барьером для ИИ-агентов является не ограниченность отдельных инструментов, а потеря информации о контексте при переключении между различными инструментами. Объединив поиск, карты и операции с компьютером в единую архитектуру модели, удается обеспечить непрерывный поток контекста, что существенно снижает вероятность сбоев при выполнении сложных задач.
Такой подход к «интеграции нескольких инструментов» аналогичен строительству единого здания с внутренними соединениями, что исключает длительную и ошибочную коммуникацию между отдельными зданиями. Такая архитектурная трансформация способна привести к значительному улучшению надежности и скорости реагирования задач, основанных на использовании агентов.
Фокус на трех ключевых сценариях с многоуровневыми мерами безопасности
Эта нативная функция будет в первую очередь применяться в трех основных сценариях: автоматизированные задачи, требующие непрерывной работы в течение часов или дней, постоянные тесты программного обеспечения для проверки единообразия интерфейса, а также работа, требующая больших знаний и выполняемая в нескольких приложениях. Во всех этих случаях критически важна непрерывность контекста между задачами, что позволяет эффективно заменять людей при выполнении повторяющихся и трудоемких операций.
Что касается безопасности, Google применила многоуровневую стратегию защиты, включающую целенаправленное обучение на противоречивых данных, меры безопасности для конфиденциальных операций и выявление косвенного внедрения команд. Все эти механизмы в совокупности помогают корпоративным пользователям создать относительно полную защиту в открытых и неконтролируемых компьютерных средах.
Slackbot становится ИИ-агентом
Slackbot, автоматизированный помощник, встроенный в корпоративную платформу обмена сообщениями Salesforce Slack, превращается в ИИ-агента. Технический директор Salesforce Паркер Харрис предполагает, что он достигнет вирусной популярности, сопоставимо
ByteDance усиливает основные стимулы для ИИ, поскольку Doubao растет на 14,6%
Недавно ByteDance провела краткий брифинг по акциям DouBao, чтобы раскрыть новые стимулирующие политики для сотрудников, участвующих в подразделении DouBao. Цена исполнения для акций DouBao была повышена с $14.85 в июне 2026 года до $17.02, что соста
MiniMax представляет программу Team Program с 10-кратным вознаграждением для стимулирования глобальных экспертов в области ИИ
Компания MiniMax (Xiyu Technology), Лаборатория общего искусственного интеллекта, официально запустила инициативу по глобальному сотрудничеству с талантами «Команда 10x». Эта программа направлена на привлечение ведущих экспертов из различных отраслей











