Технологии цензуры
DAITA — Defense Against AI-guided Traffic Analysis
Технология Mullvad (2024), которая выравнивает VPN-трафик до постоянной скорости и случайных размеров пакетов, чтобы лишить ML-классификаторы DPI признаков, по которым они вычисляют тип передаваемого содержимого.
Определение
DAITA — экспериментальная функция Mullvad VPN, запущенная в 2024 году. Добавляет к WireGuard-туннелю constant-rate padding и рандомизацию размеров пакетов, чтобы скрыть от DPI не только тип протокола, но и тип передаваемого контента (видео, текст, голос). Расшифровывается как Defense Against AI-guided Traffic Analysis — оборона против атак машинного обучения на трафик.
Зачем понадобилось
Современные DPI-системы вышли за рамки «найти WG-handshake по 148 байтам». ML-классификаторы (CNN, LSTM, transformer-based) обучены на парах bandwidth × inter-arrival time × packet size и умеют различать «человек смотрит YouTube» от «человек качает торрент» внутри уже зашифрованного VPN-туннеля. Это не теоретическая угроза — академические работы (Bahramali et al., 2020; Sirinam et al., 2018) показывают точность 95%+ для таких задач.
DAITA нацелен именно на этот пласт. Если в VPN-канале всегда летит фиксированный поток (например, 1 MB/s) случайных пакетов размерами в равномерном распределении 64–1400 байт — ML-классификатор не находит признаков. Качаешь видео — поток одинаковый. Сидишь на странице — поток одинаковый. Это constant-rate cover traffic.
Как работает
Технически — несколько слоёв поверх стандартного WireGuard:
- Packet size normalisation. Реальные пакеты дополняются padding’ом до фиксированной или случайной длины из дискретного набора (например, 256 / 768 / 1280 байт).
- Cover traffic. Когда нет данных пользователя — клиент шлёт мусорные пакеты с той же скоростью, что и при активной работе.
- Burst shaping. Группировка пакетов в «всплески» с тщательно подобранным распределением — имитирует обобщённый «средний» сетевой профиль.
Параметры выравнивания подбираются автоматически на основе целевой модели угроз (умеренная / агрессивная), но не публикуются детально — чтобы DPI-вендоры не могли заранее обучить контрмеры.
Trade-off
Overhead огромный. Constant-rate cover traffic = 30–50% мусорного трафика, если канал не утилизирован полностью. На мобильных тарифах с лимитами это критично. На безлимитных Wi-Fi — терпимо.
Latency. Padding и burst shaping добавляют 5–20 мс к каждому пакету. Для гейминга — проблема, для веба — нет.
Не закрывает handshake. DAITA защищает data-фазу. На этапе handshake клиент остаётся обычным WireGuard’ом, и ТСПУ его всё равно блокирует, если не комбинировать с AmneziaWG или Reality-обфускацией.
Доступность
На 2026 год DAITA доступен:
- В клиенте Mullvad VPN (десктоп, iOS, Android) — флаг в настройках.
- Только при подключении к специальным DAITA-серверам (~30 локаций).
- Как opt-in — по умолчанию выключен, чтобы не съедать bandwidth.
Аналоги в других сервисах пока отсутствуют. Идеи DAITA публично описаны, и можно ожидать форков для self-hosted сценариев в 2027.
Связанные термины
Padding — базовая техника. Obfuscation — общий термин. AmneziaWG — handshake-обфускация (комплементарна data-обфускации DAITA).
Источники
- DAITA introduction, Mullvad blog (2024).
- Maybenot framework — open-source библиотека защитных распределений, на которой построен DAITA.
- Bahramali et al. — Practical Traffic Analysis Attacks on Secure Messaging Applications (NDSS 2020).