Исследования17 августа 2026 г., 20:18 МСК🤖 Auto

Webwright от Microsoft: AI-агенты пишут код, а не кликают

Исследователи Microsoft представили Webwright — систему, где AI-агент генерирует скрипты для терминала, а не имитирует клики. Это повысило успех сложных задач с 33.5% до 60.1%.

Баннер новости 5938

Конец эры «кликов»

Традиционные AI-агенты для веба работают по принципу пошагового взаимодействия: модель анализирует экран и выбирает одно действие (клик, ввод текста). Этот подход часто приводит к накоплению ошибок на длинных дистанциях задач. Microsoft Research предлагает альтернативу: Webwright — система, которая дает модели доступ к терминалу и заставляет её писать программный код.

Результаты на базе GPT-5.4

Ключевое преимущество подхода — переход от хрупких последовательностей кликов к устойчивым скриптам. В тестах на длинных горизонтах задач (long-horizon tasks) использование той же модели GPT-5.4 показало значительный скачок эффективности. Вместо того чтобы оставлять после себя «след кликов», агент генерирует переиспользуемый инструмент командной строки.

Сравнение эффективности

Разница в подходах видна в метриках успешности выполнения задач. Ниже приведены ключевые показатели, демонстрирующие преимущество генерации кода над имитацией действий:

МетрикаТрадиционный подход (Click-based)Webwright (Code-based)
Успешность задач33.5%60.1%
Основа моделиGPT-5.4GPT-5.4
Результат работыСлед кликов (непереиспользуемый)Командный скрипт (переиспользуемый)

Почему это важно

Генерация кода решает проблему накопления ошибок. Если агент ошибается в одном клике, вся цепочка может развалиться. Скрипт же можно отладить, запустить заново или интегрировать в другие процессы. Webwright доказывает, что для сложных веб-задач AI должен действовать как разработчик, а не как пользователь, тыкающий мышкой.

Источник: Towards Data Science ↗