Modern QA2026Направления будущего: Куда движется ИИ-управляемое тестирование
Join

Course01 Agent Skills for Browser Automation

Cutting-edge · Chapter 01

Направления будущего: Куда движется ИИ-управляемое тестирование

Updated Jul 2026

Ближайшая перспектива (2026-2027)

ИИ-управляемые локаторы

Что: Вместо CSS-селекторов вы описываете элементы на естественном языке:

await vibe.do("click the login button");
await vibe.check("verify the dashboard loaded");
const el = await vibe.find("the blue submit button");

Статус: В дорожной карте Vibium V2. Открытые вопросы:

  • Локальная модель зрения (Qwen-VL) vs API (Claude Vision)?
  • Скриншот → модель → координаты, или DOM → модель → селектор?
  • Как обрабатывать неоднозначность («кнопка», когда их 5)?
  • Кеширование/мемоизация расположений элементов?

Влияние на QA: Устраняет проблему #1 по поддержке — CSS-селекторы. Тесты становятся действительно на естественном языке.

Сроки: 2026-2027 (высокая неопределённость — Vibium оценивает 3-6 недель исследований)

Cortex: Память приложения

Что: Хранилище данных на SQLite, строящее «карту приложения» — постоянную модель страниц, потоков и элементов приложения.

Как помогает:

  • Агент не переоткрывает одни и те же потоки между сессиями
  • Поиск пути: «Как попасть со страницы входа на страницу настроек?» → кратчайший путь Дейкстры
  • Тестовый интеллект: «На этой странице было 5 кнопок, теперь 4» → автоматическое обнаружение регрессий

Компоненты:

  • База данных SQLite со схемой для страниц, действий, сессий
  • sqlite-vec для поиска на основе эмбеддингов
  • Построитель графов и поиск пути
  • MCP-сервер для запросов агента

Когда строить (из дорожной карты Vibium):

«Когда пользователи сообщат, что агенты многократно переоткрывают одни и те же потоки, теряют контекст между сессиями или не могут планировать многошаговую навигацию.»

Retina: Пассивное наблюдение

Что: Расширение Chrome, пассивно записывающее ВСЮ активность браузера, независимо от того, что её инициирует.

Сценарии использования:

  • Запись человеческих сессий тестирования для воспроизведения
  • Отладка того, что происходило во время запусков агента
  • Генерация обучающих данных из паттернов человеческого взаимодействия

Компоненты:

  • Chrome-расширение Manifest V3
  • Слушатели кликов/нажатий клавиш/навигации
  • Захват DOM-снимков
  • Захват скриншотов
  • JSONL-экспорт в Cortex

Запись видео

Что: Встроенная запись экрана браузерных сессий.

Почему это важно для QA: Видео-артефакты для:

  • Отладки сбоев тестов (видеть точную визуальную последовательность)
  • Генерации демо (автоматические демонстрации функций)
  • Комплаенс/аудиторских следов (доказательства тестирования)

Реализация: Захват скриншотов на ~10 fps, кодирование в MP4/WebM через FFmpeg.

Среднесрочная перспектива (2027-2028)

Автономная генерация тестов

Что: Агент исследует приложение и генерирует тестовые случаи автоматически, без написанных человеком определений тестов.

Как это работает:

  1. Агент проходит всё приложение, используя vibe-check
  2. Cortex строит карту приложения
  3. Агент определяет критические пути (вход → оформление заказа → подтверждение)
  4. Агент генерирует определения тестов для каждого пути
  5. Агент выполняет сгенерированные тесты и уточняет на основе результатов

Пример из OpenObserve: Они построили «Council of Sub-Agents» — 8 специализированных ИИ-агентов, которые:

  • Анализируют новые функции из diff кода
  • Генерируют тестовые сценарии
  • Пишут и выполняют тесты
  • Проверяют результаты
  • Увеличили покрытие с 380 до 700+ тестов

Влияние: QA-инженеры переходят от написания тестов к проверке и курированию ИИ-сгенерированных тестов.

Мульти-браузерное тестирование через BiDi

Что: По мере завершения поддержки BiDi в Firefox, Edge и Safari, Vibium поддерживает все основные браузеры через единый протокол.

Текущее состояние (2026):

  • Chrome: Полная поддержка BiDi
  • Firefox: Полная поддержка BiDi (нативная, без отдельного драйвера!)
  • Edge: Полная поддержка (на основе Chromium)
  • Safari: Частичная (улучшается с каждым релизом)

Влияние: Кросс-браузерное тестирование без браузер-специфичного кода. Один тест, четыре браузера, единый протокол.

Перехват сети

Что: Захват и мокирование сетевых запросов во время тестирования.

Сценарии использования:

  • Мокирование API-ответов для детерминированного тестирования
  • Захват HAR-файлов для отладки
  • Имитация медленных сетей или ошибочных условий
  • Верификация корректности API-вызовов

Статус: Сетевой модуль BiDi стандартизируется. Vibium V2 планирует его реализовать.

Долгосрочная перспектива (2028+)

Самопишущиеся наборы тестов

Что: ИИ непрерывно мониторит приложение, обнаруживает изменения, генерирует тесты, запускает их и сообщает о проблемах — всё без участия человека.

Цикл:

Application updated →
  Agent detects changes →
    Agent generates new tests →
      Agent runs all tests →
        Agent reports issues →
          Developer fixes bugs →
            Application updated → (repeat)

Визуальное тестирование в масштабе

Что: Модели зрения сравнивают скриншоты между версиями, браузерами и устройствами для обнаружения визуальных регрессий.

Почему это сложно сегодня: Вызовы API зрения медленные ($0,01-0,05 за скриншот) и требуют специфичного промптинга. По мере улучшения локальных моделей зрения и снижения стоимости это становится практичным в масштабе.

TDD с ИИ

Что: Разработчик описывает функцию на естественном языке → ИИ генерирует тест → ИИ генерирует код → ИИ запускает тест → если прошёл, коммит.

Это уже частично возможно с Claude Code:

  1. «Напиши тест для нового потока регистрации пользователей»
  2. Claude генерирует YAML-определение теста + команды vibe-check
  3. «Теперь реализуй страницу регистрации, чтобы пройти этот тест»
  4. Claude пишет код
  5. Claude запускает тест и итерирует

Точки конвергенции индустрии

Протокол: Все движутся к BiDi

2024: Selenium 4 adds BiDi ──────────────────┐
2023: Puppeteer adds BiDi ───────────────────┤
2025: Vibium launches on BiDi ───────────────┤── W3C WebDriver BiDi
2026: Playwright acknowledges BiDi future ───┘

В течение 2-3 лет BiDi, вероятно, станет доминирующим протоколом.

Интерфейс: Skills становятся стандартом

2025: Agent Skills concept introduced ──┐
2025: Skills Directory (skills.sh) ─────┤
2025: Vibium vibe-check skill ──────────┤── Skills as standard
2026: 50,000+ skills in directory ──────┤   agent interface
2026: Playwright docs endorse CLI ──────┘

Интеллект: От скриптов к рассуждениям

2004: Scripts ─────────────────────────────┐
2015: Page Objects ────────────────────────┤
2020: Self-healing (rule-based) ───────────┤── Testing intelligence
2025: Agent reasoning (LLM-based) ─────────┤   spectrum
2027: Autonomous generation ───────────────┘

Что это значит для вашей карьеры

Навыки, которые стоит развивать

  1. Архитектуры ИИ-агентов — Паттерны ReAct, мульти-агентные системы, использование инструментов
  2. Промпт-инжиниринг для тестирования — Написание эффективных определений тестов и файлов навыков
  3. Протокол WebDriver BiDi — Технический стандарт в основе
  4. Экономика токенов — Понимание и оптимизация затрат на ИИ
  5. CI/CD для ИИ-рабочих потоков — Запуск агентно-управляемых тестов в конвейерах

Навыки, которые устаревают

  1. Ручное управление селекторами — ИИ находит элементы
  2. Стратегии явных ожиданий — Проверки интерактивности решают это
  3. Шаблонный код Page Object — Рассуждения агента заменяют абстракции
  4. Обходные пути для конкретных браузеров — Стандартизация BiDi устраняет их

QA-инженер 2028 года

Вместо написания и поддержки тестовых скриптов вы будете:

  • Определять намерения тестирования на естественном языке
  • Курировать ИИ-сгенерированные наборы тестов
  • Проверять решения самовосстановления
  • Управлять стоимостью ИИ-тестовой инфраструктуры
  • Проектировать тестовые стратегии, которые агенты могут выполнять
  • Интерпретировать ИИ-сгенерированный анализ сбоев

Название должности может измениться с «QA Automation Engineer» на «AI Test Architect» или «Test Intelligence Engineer».

Тезис для собеседования

«Индустрия сходится к трём вещам: WebDriver BiDi как стандартный протокол, CLI-навыки как стандартный интерфейс агентов и рассуждения LLM как стандартный слой интеллекта. Vibium находится на пересечении всех трёх. Ближайшие разработки, которые меня больше всего вдохновляют — ИИ-управляемые локаторы (устранение поддержки селекторов) и память приложения через Cortex (чтобы агенты не переоткрывали потоки). Долгосрочное направление — автономная генерация тестов: агент исследует приложение и создаёт набор тестов. Наша роль как QA-инженеров эволюционирует от написания тестов к архитектированию ИИ-систем, которые генерируют, выполняют и поддерживают тесты.»