Народный

Технологии цензуры

DAITA — Defense Against AI-guided Traffic Analysis

Технология Mullvad (2024), которая выравнивает VPN-трафик до постоянной скорости и случайных размеров пакетов, чтобы лишить ML-классификаторы DPI признаков, по которым они вычисляют тип передаваемого содержимого.

Определение

DAITA — экспериментальная функция Mullvad VPN, запущенная в 2024 году. Добавляет к WireGuard-туннелю constant-rate padding и рандомизацию размеров пакетов, чтобы скрыть от DPI не только тип протокола, но и тип передаваемого контента (видео, текст, голос). Расшифровывается как Defense Against AI-guided Traffic Analysis — оборона против атак машинного обучения на трафик.

Зачем понадобилось

Современные DPI-системы вышли за рамки «найти WG-handshake по 148 байтам». ML-классификаторы (CNN, LSTM, transformer-based) обучены на парах bandwidth × inter-arrival time × packet size и умеют различать «человек смотрит YouTube» от «человек качает торрент» внутри уже зашифрованного VPN-туннеля. Это не теоретическая угроза — академические работы (Bahramali et al., 2020; Sirinam et al., 2018) показывают точность 95%+ для таких задач.

DAITA нацелен именно на этот пласт. Если в VPN-канале всегда летит фиксированный поток (например, 1 MB/s) случайных пакетов размерами в равномерном распределении 64–1400 байт — ML-классификатор не находит признаков. Качаешь видео — поток одинаковый. Сидишь на странице — поток одинаковый. Это constant-rate cover traffic.

Как работает

Технически — несколько слоёв поверх стандартного WireGuard:

  1. Packet size normalisation. Реальные пакеты дополняются padding’ом до фиксированной или случайной длины из дискретного набора (например, 256 / 768 / 1280 байт).
  2. Cover traffic. Когда нет данных пользователя — клиент шлёт мусорные пакеты с той же скоростью, что и при активной работе.
  3. Burst shaping. Группировка пакетов в «всплески» с тщательно подобранным распределением — имитирует обобщённый «средний» сетевой профиль.

Параметры выравнивания подбираются автоматически на основе целевой модели угроз (умеренная / агрессивная), но не публикуются детально — чтобы DPI-вендоры не могли заранее обучить контрмеры.

Trade-off

Overhead огромный. Constant-rate cover traffic = 30–50% мусорного трафика, если канал не утилизирован полностью. На мобильных тарифах с лимитами это критично. На безлимитных Wi-Fi — терпимо.

Latency. Padding и burst shaping добавляют 5–20 мс к каждому пакету. Для гейминга — проблема, для веба — нет.

Не закрывает handshake. DAITA защищает data-фазу. На этапе handshake клиент остаётся обычным WireGuard’ом, и ТСПУ его всё равно блокирует, если не комбинировать с AmneziaWG или Reality-обфускацией.

Доступность

На 2026 год DAITA доступен:

  • В клиенте Mullvad VPN (десктоп, iOS, Android) — флаг в настройках.
  • Только при подключении к специальным DAITA-серверам (~30 локаций).
  • Как opt-in — по умолчанию выключен, чтобы не съедать bandwidth.

Аналоги в других сервисах пока отсутствуют. Идеи DAITA публично описаны, и можно ожидать форков для self-hosted сценариев в 2027.

Связанные термины

Padding — базовая техника. Obfuscation — общий термин. AmneziaWG — handshake-обфускация (комплементарна data-обфускации DAITA).

Источники

  • DAITA introduction, Mullvad blog (2024).
  • Maybenot framework — open-source библиотека защитных распределений, на которой построен DAITA.
  • Bahramali et al. — Practical Traffic Analysis Attacks on Secure Messaging Applications (NDSS 2020).