Новые возможности мобильного браузинга

Google завершила поэтапное развертывание Gemini в Chrome для пользователей Android в США. Теперь через иконку Gemini или меню из трех точек в верхней панели браузера можно не только получать краткие выжимки из длинных статей, но и задавать вопросы по содержимому открытой страницы. ИИ интегрирован с сервисами Google, такими как Calendar и Keep, что позволяет работать с ними без переключения вкладок. Также пользователям доступна генерация и редактирование изображений с помощью Nano Banana.

Автоматизация и контроль действий

Одной из ключевых функций стал режим auto browse, позволяющий ИИ выполнять задачи в интернете. Процесс работает по принципу планирования: сначала Gemini предлагает план действий, который пользователь должен проверить и подтвердить, включая доступ к контексту страницы и личной информации. После подтверждения агент может переходить по сайтам, используя сохраненные учетные данные через Google Password Manager (сами пароли при этом не передаются Gemini). Пользователь может в любой момент перехватить управление, вернуть задачу ИИ или полностью остановить процесс.

Безопасность и ограничения

Для защиты от угроз, таких как непрямая инъекция промптов (indirect prompt injection), Google внедрила многоуровневую систему защиты. Она включает отдельную модель для проверки предлагаемых действий, классификатор инъекций в реальном времени и ограничение области работы агента только релевантными сайтами. Для критических операций — отправки сообщений, заполнения форм, планирования событий или работы с финансовыми и медицинскими данными — система обязана запросить подтверждение пользователя. Несмотря на меры защиты, Google предупреждает, что функция является экспериментальной: ИИ может ошибаться или совершать непредвиденные действия, например, совершить покупку без разрешения.