Доклад

Инструкция к агенту: что прячется за каждой кнопкой

  • AI

Вы поставили агенту MCP, подключили Playwright, написали пару правил. Работает. А теперь неудобные вопросы.

Почему один вызов скриншота может съесть 232 000 токенов, а авторы Playwright сегодня сами советуют использовать CLI вместо их собственного MCP?

Почему на пятнадцатом шаге агент уверенно кликает кнопку, которой на странице уже нет, и почему это выглядит как flaky, но им не является?

Почему двадцать скиллов стоят дешевле одного MCP-сервера и почему описание скилла важнее того, что внутри него написано?

Почему у коллеги тот же самый инструмент ведет себя иначе и какой командой это выясняется за десять секунд?

Почему выкручивать reasoning на максимум это не оптимизация, а ритуал, и что показал замер?

Разберем на реальных задачах: баг с прода, автотесты на фичу, раскатка на команду, агент в quality gate. Без магии, зато с арифметикой.

Доклады