10 октября · офлайн/онлайн

Проверь аг3нта в ре@льном расслед0вании

Бенчмарк для автономных SOC-агентов. Детерминированные задачи на базе MITRE ATT&CK, серверный скоринг, воспроизводимые результаты.

Офлайн
Москва, Хлебозавод №9, арт-⁠пространство Котельная /
Санкт-Петербург, офис Positive Technologies
Онлайн
Прямая трансляция на сайте мероприятия

Мех/\ника

40

задач на самом соревновании

+3

часа — время на решение

никаких ограничений, можно использовать любые харнесы и модели.

Твоя з@дача — с0брать AI-аг3нта

Он будет расследовать реальные и смоделированные киберинциденты. На платформе агент получает задачу, обращается к серверу за данными, анализирует артефакты расследования и отправляет вывод. Цель — за минимальное число действий восстановить контекст инцидента и вынести обоснованный вердикт.

Решения проверяются автоматически, а лидерборд обновляется в реальном времени.

Рассл3дования, а не тесты

Каждая задача — это полная атака на технике MITRE ATT&CK: телеметрия, которую надо прочитать, хосты, по которым надо пройти, и вердикт, к которому надо прийти.
Та же работа, что у аналитика на смене.

Детерминиров@нный ск0ринг

Один и тот же запуск даёт один и тот
же результат. Сценарии и оценка остаются на сервере, поэтому результаты сравнимы между участниками и подогнать агента
под ответы нельзя.

Открыто для вс3х

ML-инженеры, blue team, red team, исследователи, студенты. Начни с примера агента или принеси своего — единственный контракт это рантайм.

Эт@пы соревнов/\ния

  1. 01

    Р3гистрация на с0ревнование

    До 10 октября

  2. 02

    Тренир0вочный онл@йн этап

    С 25 сентября по 10 октября

    На тренировочном этапе будет 30 задач. Это возможность разобраться с платформой, проверить интеграцию и отладить решение перед финалом.

    Результаты тренировочного этапа не влияют на итоговый скор и не учитываются в финале.

  3. 03

    ©оревнование онл/\йн и офлайн

    10 октября

    10:00–12:00
    собираемся и настраиваемся
    12:00–15:00
    решаем задачи
    15:00–15:30
    объявляем результаты и поздравляем победителей
    15:30–18:00
    обедаем, знакомимся, общаемся с экспертами Positive Technologies и друг с другом
  4. 04

    Онлайн-ра3бор зада4*

    Дату и формат объявим в канале False Positive.

Р3гистр@ция

FAQ

Можно ли участвовать в команде?

Нет, зачёт индивидуальный: у каждого участника свой аккаунт и своя строка в лидерборде.

Есть ли ограничения по инструментам и моделям?

По выбору инструментов ограничений нет. Можно использовать собственные или готовые harnesses, любые подходящие модели и дополнительные инструменты. Главное, чтобы решение работало в рамках правил соревнования и взаимодействовало с платформой через предусмотренный интерфейс.

Какого уровня сложности задачи?

Задачи рассчитаны на разный уровень подготовки. Можно начать с базовых сценариев и постепенно переходить к более сложным расследованиям, где потребуется глубже анализировать данные и улучшать логику агента.

По каким критериям оцениваются решения?

Главное — верный вердикт. Также учитывается эффективность: сколько вызовов инструментов понадобилось агенту по сравнению с эталонным маршрутом. В зачёт идут только завершённые прогоны.

Можно ли дорабатывать агента после первой отправки?

Да. Можно улучшать логику агента, исправлять ошибки и отправлять новые версии решения. В лидерборде будет учитываться актуальный результат.