Modern QA2026Как презентовать ваш фреймворк: версии на 5, 15 и 30 минут
Join

Course01 Agent Skills for Browser Automation

Cutting-edge · Chapter 01

Как презентовать ваш фреймворк: версии на 5, 15 и 30 минут

Updated Jul 2026

5-минутная презентация в лифте

Используйте для первичных скринингов, разговоров в коридоре или когда интервьюер говорит «расскажите о вашем подходе».

«Я построил ИИ-дополненный фреймворк автоматизации тестирования, который использует Claude Code с навыком автоматизации браузера Vibium.

Основная идея: Вместо написания хрупких скриптов Selenium мы определяем тесты как шаги на естественном языке и позволяем ИИ-агенту выполнять их через CLI, который управляет Chrome по протоколу WebDriver BiDi.

Почему это работает: Агент может рассуждать о сбоях, находить альтернативные селекторы при изменении UI и адаптироваться к неожиданным состояниям. Традиционные тесты ломаются при изменении ID кнопки. Наши тесты находят кнопку по текстовому содержимому и продолжают работу.

Ключевые цифры: В 29 раз дешевле по стоимости токенов, чем подходы на основе MCP. 100 мс на браузерную команду в режиме daemon. Пять проверок интерактивности выполняются на стороне сервера перед каждым взаимодействием — те же, что в Playwright, но реализованы один раз на Go вместо per-client.

Компромисс: Недетерминированное выполнение, но мы смягчаем это логированием команд, скриншотами при сбоях и трёхуровневой стратегией самовосстановления.»

15-минутный технический обзор

Используйте для технических собеседований или обсуждений архитектуры.

Часть 1: Постановка задачи (2 мин)

«Традиционная автоматизация браузерных тестов имеет три проблемы:

  1. Бремя поддержки — Когда UI меняется, каждый затронутый тест ломается. Команды тратят 40-60% времени на поддержку тестов, а не на написание новых.

  2. Хрупкость — Тесты зависят от точных CSS-селекторов. Простая реструктуризация HTML ломает десятки тестов.

  3. Отсутствие рассуждений — Когда происходит что-то неожиданное (появляется модальное окно, происходит перенаправление, спиннер загрузки крутится дольше), традиционные тесты просто падают. Человек-тестировщик справился бы с этим.

ИИ-агенты решают все три — они могут рассуждать о UI, адаптироваться к изменениям и обрабатывать неожиданные состояния.»

Часть 2: Архитектура (5 мин)

«Три уровня, каждый с чёткой ответственностью:

Определения тестов (YAML):

test: Login with valid credentials
steps:
  - Navigate to the login page
  - Enter valid email and password
  - Click login
  - Verify dashboard loads
selectors:
  email: 'input[name=email]'
  password: 'input[name=password]'
  submit: 'button[type=submit]'

Уровень агента (Claude Code + навык vibe-check):

  • Навык — 100-строчный markdown-файл, обучающий агента 22 браузерным командам
  • Стоимость: ~1 000 токенов на начальную загрузку, ~130 за команду
  • Агент читает тест, выполняет через Bash-команды, верифицирует через извлечение текста

Уровень браузера (Vibium):

  • Go-бинарник (~10 МБ), протокол WebDriver BiDi
  • Режим daemon (100 мс/cmd) или oneshot (2 с/cmd для CI)
  • Пять проверок интерактивности: visible, stable, receives-events, enabled, editable
  • Пользовательские BiDi-команды расширений: vibium:find, vibium:click, vibium:type

Почему CLI Skills, а не MCP:

  • В 29 раз ниже стоимость токенов (3 200 vs 92 000 токенов для 20-шагового теста)
  • 98% контекстного окна остаётся для рассуждений
  • Компонуемость с другими CLI-инструментами
  • Даже документация Playwright признаёт, что CLI+Skills эффективнее по токенам»

Часть 3: Самовосстановление (3 мин)

«Когда селектор не срабатывает:

Уровень 1 — Агент обнаруживает существующие элементы: vibe-check find-all 'button' → сопоставляет по тексту → повторяет. Стоимость: ~500 токенов. Решает 80% сбоев.

Уровень 2 — Агент делает скриншот + читает текст страницы. Ловит проблемы загрузки, перенаправления, модальные окна. Стоимость: ~800 токенов.

Уровень 3 — Резервное переключение на дерево доступности MCP для семантического анализа. Для крупных редизайнов. Стоимость: ~5 500 токенов.

Мы отслеживаем события восстановления. Высокая частота = устаревшие селекторы (обновить тест). Частое восстановление = нестабильный тест (исправить корневую причину).»

Часть 4: CI/CD (3 мин)

«GitHub Actions с матричной стратегией:

  • Headless Chrome, режим oneshot для изоляции
  • 4-5 параллельных групп тестов
  • Артефакты при сбоях: скриншоты, текст страницы, URL, лог команд
  • JUnit XML для интеграции с дашбордами
  • ~$25 за полный запуск набора (500 тестов по $0,05/тест)
  • Docker-образ с предустановленными Chrome + Vibium для единообразных окружений»

Часть 5: Результаты (2 мин)

«Ключевые итоги:

  • Время поддержки тестов сокращено на 60-85% (агент адаптируется вместо того, чтобы ломаться)
  • Надёжность тестов >98% (проверки интерактивности устраняют большинство нестабильности)
  • Новые тесты пишутся на естественном языке, а не на коде
  • Время отладки сбоев сокращено (скриншот + рассуждения агента vs стек-трейсы)»

30-минутное глубокое погружение

Используйте для финальных раундов технических собеседований или заседаний архитектурного совета.

Расширьте 15-минутную версию с:

Дополнительный раздел: Экономика токенов (5 мин)

Разберите реальные цифры из 03-skills-vs-mcp/token-budget-analysis.md. Покажите пошаговое сравнение. Объясните, почему это важно для масштабируемости.

Дополнительный раздел: WebDriver BiDi (5 мин)

Охватите эволюцию протокола (Selenium → WebDriver → CDP → BiDi). Объясните, как работает прокси-архитектура Vibium с командами-расширениями. Покажите диаграмму потока сообщений.

Дополнительный раздел: Конкурентный ландшафт (5 мин)

Сравните Vibium, Playwright MCP, browser-use, agent-browser. Объясните вашу структуру принятия решений при выборе инструментов. Покажите матрицу решений.

Дополнительный раздел: Демонстрация или пошаговый разбор (оставшееся время)

Если возможно, покажите:

  1. Установку навыка: npx skills add https://github.com/VibiumDev/vibium --skill vibe-check
  2. Запуск простого теста: агент переходит, кликает, верифицирует
  3. Показ лога команд
  4. Показ сбоя со скриншотом + восстановлением

Частые уточняющие вопросы (будьте готовы)

Вопрос Ключевой пункт
«А визуальное тестирование?» Скриншоты + модели зрения для сравнения
«Как вы версионируете тесты?» YAML-файлы в git, как и код
«Что если агент ошибётся?» Лог команд для воспроизводимости, CI-ворота на прошёл/не прошёл
«Стоимость в масштабе?» ~$0,05/тест x 500 тестов x 10 запусков/день = $250/день
«Почему не просто Cypress?» Нет способности рассуждать, нет самовосстановления, то же бремя поддержки
«Как обрабатываете всплывающие окна/алерты?» vibe-check eval 'window.confirm = () => true' или агент рассуждает о них
«А мобильное тестирование?» Vibium — для десктопного Chrome. Мобильное через адаптивный режим: vibe-check eval 'window.resizeTo(375, 812)'
«Кто поддерживает тесты?» QA пишет определения на естественном языке, агент выполняет. Поддержка — обновление намерений, а не селекторов.

Советы по языку тела и подаче

  1. Рисуйте диаграммы — Трёхуровневая архитектурная диаграмма продаёт фреймворк лучше слов
  2. Используйте конкретные цифры — «В 29 раз дешевле», «98% надёжности», «100 мс на команду» запоминаются
  3. Упоминайте имена к месту — «Vibium создан автором Selenium и Appium» добавляет доверия
  4. Признавайте компромиссы первыми — «Компромисс — недетерминированность, и вот как мы с этим справляемся» показывает зрелость
  5. Имейте мнение — «Я убеждён, что CLI-навыки станут стандартным интерфейсом для ИИ-агентов, потому что...» — архитекторы уважают убеждённость, подкреплённую аргументами