
Задача та же, что у browser-use: пройти чужой сайт, у которого нет программного интерфейса. Заполнить форму, вытащить таблицу, дойти до нужного экрана через три перехода. Ставка - другая, и это самое интересное, что есть в проекте.
browser-use отдаёт задачу агенту целиком: вы описываете цель, агент сам решает, что нажать на каждом шаге. Stagehand четвёртой версии так больше не умеет. И не потому, что не успел, - потому что этот режим из него сознательно вырезали.
Формулировка из руководства по переходу с третьей версии не оставляет места для толкований: agent() больше нет, и ничто в четвёртой версии не заменяет его один в один. Дальше объясняется, почему: agent() был сделан для моделей, которые не могли самостоятельно управлять браузером, поэтому оборачивал три команды в цикл и просил модель выбирать по одному инструменту за шаг. Каждый такой шаг был обращением к модели - неважно, требовалось на нём суждение или нет.
Проект принадлежит Browserbase, лежит под лицензией MIT и живёт с 24 марта 2024 года. На 25 августа 2026 года это 24 043 звезды, 1654 форка и коммит в основную ветку в тот же день. Статья о том, что осталось после удаления агента, как это устроено внутри и где расставлены грабли.
Что стало вместо агента
Взамен предлагаются два подхода, и документация прямо говорит, с какого начинать.
Первый называется code mode: модель работает перед запуском, а не внутри него. Вы просите ассистента написать скрипт на Stagehand, читаете его, правите и дальше запускаете обычный код - воспроизводимый, попадающий в систему контроля версий, без вывода модели на каждом шаге. Когда сайт меняется, вы натравливаете ассистента на сломавшийся кусок. Browserbase рекомендует именно этот путь.
Второй - обычный цикл с вызовом инструментов, который вы пишете сами. Модель остаётся в контуре во время работы, но получает не три широкие команды, а весь интерфейс браузера: переходы, локаторы, клики, ожидания, снимки. Шаг называет конкретную операцию, а не пересказывает её английской фразой.