Modern QA2026Экономика токенов: Почему Skills выигрывают по стоимости
Join

Course01 Agent Skills for Browser Automation

Cutting-edge · Chapter 01

Экономика токенов: Почему Skills выигрывают по стоимости

Updated Jul 2026

Контекстное окно — общий ресурс

Каждый токен в контекстном окне конкурирует за одно и то же ограниченное пространство. Агент, работающий с кодом, обычно нуждается в контексте для:

Потребитель Типичные токены Приоритет
Системный промпт 2 000-5 000 Фиксированный
История разговора 10 000-50 000 Растёт
Содержимое файлов (редактируемый код) 5 000-30 000 Необходимый
Определения инструментов (MCP, встроенные) 2 000-15 000 Фиксированный на инструмент
Рассуждения агента 5 000-20 000 Необходимый
Общий бюджет ~200 000

Когда вы добавляете автоматизацию браузера, вы конкурируете с редактированием кода, анализом тестов и рассуждениями за тот же бюджет.

Стоимость токенов MCP: Налог на схемы инструментов

Каждый MCP-инструмент предоставляет JSON-схему, которая загружается в каждый API-запрос:

{
  "name": "browser_click",
  "description": "Click an element on the page",
  "inputSchema": {
    "type": "object",
    "properties": {
      "selector": {
        "type": "string",
        "description": "CSS selector for the element to click"
      },
      "timeout": {
        "type": "number",
        "description": "Maximum wait time in milliseconds",
        "default": 30000
      },
      "force": {
        "type": "boolean",
        "description": "Force click even if element is not actionable",
        "default": false
      }
    },
    "required": ["selector"]
  }
}

Типичный MCP-сервер Playwright предоставляет 15-25 инструментов. Каждое определение инструмента стоит 200-500 токенов. Это 3 000-12 500 токенов только за схемы инструментов — загружаемых при КАЖДОМ вызове API.

Кроме того, ответы MCP часто включают деревья доступности (структурированные представления DOM):

[role="main"] Main Content
  [role="navigation"] Nav
    [role="link"] "Home" [ref=1]
    [role="link"] "About" [ref=2]
  [role="heading"] "Welcome" [ref=3]
  [role="textbox"] "Search..." [ref=4]
  [role="button"] "Submit" [ref=5]
  ... (сотни элементов)

Один снимок дерева доступности может стоить 2 000-10 000 токенов в зависимости от сложности страницы.

Общая стоимость MCP за шаг

Схемы инструментов:     ~5 000 токенов  (фиксировано, каждый шаг)
Дерево доступности:     ~5 000 токенов  (за взаимодействие со страницей)
Вызов/ответ инструмента: ~200 токенов   (за команду)
─────────────────────────────────────
Итого за взаимодействие: ~10 200 токенов

За 20-шаговый тест:

20 шагов × 10 200 токенов = ~204 000 токенов (может превысить контекстное окно!)

Стоимость токенов Skill: Внедрение Markdown

SKILL.md навыка vibe-check — это ~100 строк, что соответствует примерно 800-1 200 токенам — загружается один раз при вызове навыка, затем сохраняется в контексте.

Общая стоимость Skill за шаг

Внедрение SKILL.md:      ~1 000 токенов  (один раз, не каждый шаг)
Описание навыка:          ~50 токенов     (в списке инструментов, каждый шаг)
Bash-команда:             ~30 токенов     (за команду)
Вывод команды:            ~100 токенов    (за команду, только текст)
─────────────────────────────────────
Итого за взаимодействие:  ~130 токенов    (после начального внедрения)

За 20-шаговый тест:

Начальная загрузка: ~1 050 токенов
20 шагов:           20 × 130 = ~2 600 токенов
Итого:              ~3 650 токенов

Сравнение

Метрика MCP (Playwright) Skill (vibe-check) Соотношение
Фиксированные накладные расходы за шаг ~5 000 токенов ~50 токенов В 100 раз дешевле
За взаимодействие ~10 200 токенов ~130 токенов В 78 раз дешевле
Итого за 20-шаговый тест ~204 000 токенов ~3 650 токенов В 56 раз дешевле
Остаток контекстного окна ~0 (исчерпано) ~196 000 токенов Н/Д

Подход через навыки оставляет 98% контекстного окна доступными для рассуждений, анализа кода и содержимого файлов. Подход через MCP может исчерпать всё контекстное окно только на взаимодействия с браузером.

Почему это важно для автоматизации тестирования

Типичная сессия автоматизации тестирования включает:

  • Чтение тестовых спецификаций
  • Написание тестового кода
  • Выполнение браузерных взаимодействий
  • Анализ результатов
  • Отладку сбоев
  • Генерацию отчётов

Если браузерные взаимодействия потребляют 50-100% вашего бюджета контекста (подход MCP), агент не может эффективно выполнять другие задачи. Он начинает «забывать» ранние части разговора по мере сжатия контекста.

С подходом через навыки браузерные взаимодействия потребляют ~2% бюджета контекста, позволяя агенту:

  • Держать в контексте весь тестовый набор
  • Рассуждать о многостраничных потоках
  • Сравнивать ожидаемые и фактические результаты с полной детализацией
  • Поддерживать историю разговора на протяжении длительных сессий

Признание от команды Playwright

Из официальной документации Playwright (2025/2026):

"Coding agents increasingly favor CLI-based workflows exposed as SKILLs over MCP because CLI invocations are more token-efficient — they avoid loading large tool schemas and verbose accessibility trees into the model context."

Это не стороннее мнение — это от команды, которая сама разрабатывает MCP-сервер.

Когда стоимость токенов MCP оправдана

Более высокая стоимость токенов MCP даёт вам:

  1. Структурированное понимание страницы — Дерево доступности даёт агенту семантические знания о том, что находится на странице (роли, метки, связи)
  2. Итеративное исследование — Агент может многократно запрашивать структуру страницы для поиска элементов
  3. Богатый контекст ошибок — MCP возвращает структурированные ошибки с информацией о состоянии элемента
  4. Непрерывность сессии — MCP поддерживает состояние сессии браузера на стороне сервера

Для исследовательского тестирования, когда вы не знаете, что ищете, это ценно. Для скриптованной автоматизации тестирования, когда вы знаете селекторы и поток, это пустая трата.

Тезис для собеседования

«Когда мы оценивали подходы к автоматизации браузера, экономика токенов стала решающим фактором. Наши тестовые сессии обычно включают 30-50 браузерных команд наряду с анализом кода и написанием тестов. С MCP это потребило бы всё наше контекстное окно в 200K только на браузерные взаимодействия. С подходом через CLI-навыки браузерные команды занимают около 2% нашего бюджета, оставляя 98% для рассуждений о логике тестов, анализа сбоев и поддержания контекста на протяжении всей сессии. Команда Playwright сама признала этот компромисс в своей документации.»