Дмитрий Анашкин

ИИ-агент в браузере: какие задачи ему поручать, а какие оставить себе

Опубликовано 11 окт. 2026 г.8 мин чтенияНачальный
Ноутбук с открытым браузером и маленьким роботом-помощником на экране, вокруг карточки форм и таблиц без значков. Никаких логотипов, иконок сервисов и названий брендов
Туториал
ИИ-агент в браузере
Дмитрий Анашкин · 8 мин
Чему вы научитесь
  • Что умеет ИИ-агент в браузере и чем расширение отличается от встроенного браузера
  • Какие задачи агенту подходят, а какие лучше оставить себе
  • Где агент спотыкается: формы, капчи, длинные цепочки
  • Почему страница может командовать агентом и как от этого защититься
  • Какие разрешения давать и в каком порядке
Начальный

Коротко

Что умеет ИИ-агент в браузере?

Обычный чат отвечает текстом. ИИ-агент в браузере делает работу руками: открыл кабинет, нашёл раздел, выгрузил отчёт, переложил цифры. Разница примерно как между консультантом по телефону и стажёром, который сел за твой компьютер.

На корпоративном обучении в конце сентября я показывал группе пример, где агент сам открывает систему электронного документооборота и заполняет документ. Это был самый живой момент дня. Реплика из зала - «Он сам открывает» - лучше любого слайда объясняет, почему эта функция цепляет.

Технически есть два способа работы:

  • Встроенный браузер приложения. Чистый браузер внутри ChatGPT или Codex. Удобен для открытых сайтов и проверок, но в нём ты не вошёл в свои сервисы.
  • Расширение в твоём браузере. Агент работает в твоих вкладках и твоём профиле, видит сайты, где ты уже вошёл: почту, CRM, кабинеты. По документации OpenAI расширение работает в Chrome, Edge, Brave, Opera и Vivaldi. Safari в этом списке нет, и на обучении этот вопрос как раз задавали.

Второй способ мощнее и рискованнее одновременно: агент получает доступ ко всему, куда вошёл ты.

Подходящие задачи и те, что лучше оставить себе

ЗадачаПодходит агенту?Почему
Собрать цены и условия с десяти сайтов в таблицудатолько чтение, результат легко проверить
Проверить, что карточки товаров заполнены одинаководаоднотипная проверка, человек смотрит итог
Выгрузить отчёт из кабинета без APIда, под присмотромчтение в рабочей системе
Заполнить форму или документ по данным из таблицыосторожнонужна проверка перед отправкой
Обновить карточку клиента в CRM по заметкам встречиосторожноменяет рабочие данные
Оплатить счёт, оформить покупкунетнеобратимо, агенты такие действия блокируют
Удалить записи, создать аккаунтнетнеобратимо или запрещено политикой агента

Правило, которое я советую на старте: агент читает сам, а пишет только после твоего «да». Что делать, если у площадки нет выгрузки и браузерный обход - единственный путь, подробно разбирал в материале о том, как забрать данные с сайта без API.

Где агент спотыкается?

Расскажу на своём примере.

Я поручил агенту проверить товарный знак для нового бренда по официальной базе Роспатента. Поиск он выполнил: нашёл сотни записей по нужным словам. А вот фильтры по классу и дате подачи не поддались. Поля там нестандартные, и попытка подставить значение напрямую положила «42» в поле даты: фильтр получил 1 января 2042 года.

Руками это закрывается минут за десять. Это хорошо показывает границу: агент отлично ходит, ищет и читает, но формы, сделанные «не как у всех», для него лотерея.

Ещё несколько типичных мест, где агент застревает:

  • Капча и антибот-защита. Агенты не должны её обходить, и у Claude в Chrome это прямо в списке запрещённых действий.
  • Длинные задачи. Чем больше шагов, тем выше шанс, что агент свернёт не туда на середине. Режь задачу на куски по пять-десять шагов.
  • Разные интерфейсы у разных людей. У одного расширение встало, у другого нет. На обучении это видно сразу: у части группы всё работает, у части - нет.
  • Отчёт вместо результата. Агент пишет «готово», а таблица заполнена наполовину. Как ловить такое, разбирал в материале про «готово» без результата.

Почему страница может командовать агентом?

Для чата это почти не проблема: он только отвечает. Для агента в браузере это главный риск, потому что он умеет действовать: переходить, заполнять, отправлять.

OpenAI в документации к расширению прямо пишет: относись к содержимому страниц, выделенному тексту и расшифровкам видео как к недоверенному контексту и проверяй страницу, прежде чем разрешать агенту действовать. У Anthropic в Claude в Chrome работают классификаторы, которые отлавливают такие атаки, а часть действий заблокирована полностью: покупки, создание аккаунтов, обход проверок на ботов, сделки, безвозвратное удаление файлов.

Про то, как вообще решать, давать ли агенту доступ к рабочей почте и серверу, подробно разбирал в отдельной статье про доступ агента к почте и серверу компании.

Какие разрешения давать и в каком порядке?

У ChatGPT по умолчанию агент спрашивает разрешение перед работой с каждым новым сайтом. Варианты ответа: разрешить один раз, разрешить для этого сайта, разрешить для всех сайтов или отказать. Есть списки разрешённых и запрещённых доменов. Доступ к истории браузера агент запрашивает отдельно, и постоянного разрешения на неё нет.

У Claude в Chrome похожая логика: агент составляет план, где перечислены сайты и шаги, ты его утверждаешь, и без нового разрешения агент от плана не отходит. Есть режим «спрашивать перед действием» и режим «действовать без вопросов».

Порядок, который я считаю безопасным:

  1. Первая неделя - подтверждение каждого нового сайта и каждого действия, которое что-то меняет.
  2. Знакомые рабочие сервисы - в список разрешённых.
  3. Банки, госуслуги, платёжные кабинеты - в список запрещённых сразу.
  4. Режим без вопросов - только для повторяющейся задачи на одном-двух сайтах, которую ты уже видел десяток раз.

Логика та же, что и с агентом на компьютере: сначала запреты, потом свобода. Что агент видит на диске и какие запреты ставить заранее, разбирал в материале о том, что агент делает на твоём компьютере.

Первая задача для агента в браузере

  1. Чтение: таблица из открытых страниц

    Например, условия доставки у десяти поставщиков или цены конкурентов. Проверь три строки руками: совпали ли цифры.

  2. Заполнение с проверкой

    Пусть агент заполнит форму или черновик документа по данным из таблицы и остановится перед кнопкой «Отправить». Смотришь, исправляешь, отправляешь сам.

  3. Регулярная задача

    То, что повторяется каждую неделю: выгрузка отчёта, сверка карточек. Её уже можно оформить как автозадачу, которая выполняется по расписанию.

Главное на этом этапе - не скорость, а понимание. После трёх задач ты будешь точно знать, где агент экономит час, а где проще сделать руками.

Частые вопросы

Частые вопросы

Главный вывод

Агент в браузере закрывает разрыв, о который спотыкаются почти все автоматизации: у нужной системы нет API, а руками перекладывать данные надоело. Но он работает в твоих сессиях, и поэтому правила доступа здесь важнее, чем в чате.

Практический шаг на эту неделю: заведи отдельный профиль браузера для агента и дай ему одну задачу на чтение - собрать в таблицу данные с пяти страниц, которые ты обычно открываешь руками.

Какую задачу в браузере ты бы отдал агенту первой?

Источники

Отправь другу или себе в избранное в Telegram, чтобы не потерять.

Поделиться в Telegram
Было полезно?
Автор
Дмитрий Анашкин
Практик-интегратор ИИ в бизнес

Основатель NeuroDA и SMAIPL. Корпоративные воркшопы по ИИ, внедрение AI в бизнес-процессы.

Похожие гайды

Скан, PDF или Word: в каком виде давать документы нейросети

Скан и PDF из Word выглядят одинаково, а нейросеть читает их по-разному: текст получает как есть, картинку распознаёт сама и ошибается в цифрах. Разбираю, что модель делает с PDF, сканом, фото, Word и таблицей, сколько стоит скан в лимитах и как подготовить документы за пять минут.

8 мин

Глубокое исследование нейросетью (Deep Research): как заказать отчёт и проверить его

Глубокое исследование - это заказ аналитики, а не длинный ответ чата. Разбираю на прогонах с воркшопов, когда режим нужен, как писать бриф с разрезами, почему исследование не стартует, сколько ждать, как проверять отчёт и чем отличаются ChatGPT и Gemini.

11 мин

Персональные инструкции ChatGPT: как настроить нейросеть под себя один раз

Роль не нужно писать в каждом промпте: один раз прописанные пользовательские инструкции уходят вместе с каждым запросом. Разбираю, где это в ChatGPT сейчас, как собрать роль по промпту-образцу, зачем чистить память и что вынести в проекты.

10 мин

Свой GPT-ассистент: когда собирать и как написать ему инструкцию

Свой ассистент - это инструкция, образцы и проверка, а не кнопка сервиса. Разбираю на своих ассистентах и кейсах с воркшопов, когда его собирать, как писать инструкцию и базу знаний, как проверять и куда переносить после закрытия GPTs в декабре 2026.

11 мин

Связанные понятия