AI-агенты наконец получили доступ к вашему браузеру — и не сломают его

Tencent выпустила открытый проект BrowserSkill, который решает одну из самых раздражающих проблем AI-автоматизации: ваш браузер хранит логины, сессии и аккаунты, а у агента ничего этого нет — и раньше приходилось либо отдавать агенту пустой браузер без авторизации, либо пускать его в свой настоящий и наблюдать, как он захватывает вкладки. Проект набрал 4 000 звёзд на GitHub всего за 2 дня.


Что такое BrowserSkill и как это работает

BrowserSkill — локальный мост между вашим агентом и браузером. Инструмент состоит из двух частей: CLI-демон bsk и браузерное расширение.

Он подключает агентов — Cursor, Claude Code, Codex, OpenClaw, CodeBuddy, WorkBuddy, Pi, Hermes Agent и DeepSeek Harness — к вашему уже авторизованному браузеру, причём работа ведётся в отдельном окне, так что вы продолжаете работать в своём.

«Раньше приходилось выбирать: отдать агенту пустой браузер или позволить ему захватить ваш рабочий. BrowserSkill отказывается от этой дилеммы.»

ℹ Ключевая идея
Agents могут «брать в аренду» (borrow) конкретную вкладку, выполнять задачу и возвращать управление — не трогая остальные вкладки пользователя.

Главные преимущества

ВозможностьТрадиционная автоматизацияBrowserSkill
АвторизацияНужны тестовые аккаунтыИспользует вашу живую сессию
Влияние на работуЗахватывает фокус, двигает мышьРаботает в отдельном окне
Поддержка агентовЗависит от фреймворкаЛюбой агент с доступом к shell
Обход bot-detectionЧасто блокируетсяРаботает с реальным профилем
Human-in-the-loopОбычно отсутствуетВстроен (капча, подтверждения)

Стандартные фреймворки вроде Playwright или Puppeteer запускают чистые изолированные экземпляры Chromium, которым не хватает активных сессий и человеческих fingerprint’ов — из-за чего антибот-системы вроде Cloudflare или Akamai их легко блокируют.

BrowserSkill позволяет агентам на базе Claude, OpenAI Codex или локальных LLM подключаться напрямую к вашему активному браузеру, не триггеря антифрод-механизмы.


Архитектура: как агент получает браузер


graph LR
    A[AI-агент\nCursor / Claude Code / Codex] -->|shell-команда| B[bsk CLI / daemon]
    B -->|WebSocket| C[Браузерное расширение]
    C -->|borrow tab| D[Ваш Chrome / Edge]
    D -->|результат| C
    C -->|ответ| B
    B -->|данные| A

Принцип работы прост: агент вызывает bsk через командную строку, демон общается с расширением по WebSocket, а расширение управляет вкладками в вашем браузере. Задача выполнена — вкладка возвращается.


Поддерживаемые платформы

Поддерживаются Chrome и Microsoft Edge; другие браузеры на Chromium также должны работать, если поддерживают unpacked-расширения; поддержка Firefox запланирована.

Операционные системы: macOS (Apple Silicon и Intel), Linux (x64 и ARM64), Windows x64.


Быстрый старт

💡 Установка одной командой

Если вы уже используете Cursor, Claude Code или другой агент с доступом к shell — просто отправьте ему эту строку, и он сам всё установит:

Set up browser-skill on this machine by following https://raw.githubusercontent.com/Tencent/BrowserSkill/main/AGENT_INSTALL.md

Для ручной установки на macOS/Linux:

curl -fsSL https://raw.githubusercontent.com/Tencent/BrowserSkill/main/install.sh | sh
export PATH="${BSK_INSTALL_DIR:-$HOME/.local/bin}:$PATH"
bsk --version

Для Windows (PowerShell):

irm https://raw.githubusercontent.com/Tencent/BrowserSkill/main/install.ps1 | iex

После установки CLI нужно поставить расширение из Chrome Web Store или Edge Add-ons, затем выполнить:

bsk install-skill
bsk doctor

bsk doctor проверяет здоровье соединения, bsk status — версии компонентов, а bsk session start --url https://example.com запускает первую сессию.


Безопасность: стоит ли доверять агенту свой браузер?

⚠ Важно учитывать
Подключение автономного LLM к живой сессии с доступом к банку, почте или Web3-кошельку несёт очевидные риски: prompt injection-атаки могут заставить агента выполнить несанкционированные действия в авторизованной сессии.

Рекомендуется применять строгие ограничения выполнения, ручные шлюзы подтверждения для чувствительных событий и rate-limiting при развёртывании BrowserSkill в продакшене.

BrowserSkill имеет встроенный human-in-the-loop: когда агент сталкивается с капчей, диалогом подтверждения или другими «человеческими» шагами — он приостанавливается и передаёт управление пользователю, а затем продолжает задачу.


Контекст и значение для отрасли

По мере того как AI-агенты эволюционируют от простых чат-интерфейсов до автономных исполнителей задач, реальное взаимодействие с вебом остаётся одним из их главных узких мест.

BrowserSkill от Tencent — значительный шаг к context-aware, local-first агентной инфраструктуре. Проект убирает необходимость заново проходить авторизацию на каждом сайте и открывает возможности для полноценной автоматизации рабочих процессов — от работы с корпоративными системами до управления контентом в соцсетях.


Итог

BrowserSkill закрывает реальный пробел, с которым сталкивается каждый разработчик, пробующий AI-автоматизацию: агент умный, но «бездомный» в вашем браузере. Теперь у него есть ключи — с чёткими правилами и возможностью вернуть контроль в любой момент. Если вы работаете с Cursor, Claude Code или любым другим shell-агентом, BrowserSkill стоит попробовать прямо сейчас: установка занимает меньше минуты, а потенциал для автоматизации ежедневных задач огромен.

📝 Попробуйте сами
Проект доступен на GitHub: github.com/Tencent/BrowserSkill. Расширение — в Chrome Web Store и Edge Add-ons. Звёзды на GitHub только растут — сообщество уже оценило идею.