От наблюдения к прогнозу: ключевой переход
Существующие статьи описывают, что платформы собирают (AI-профилирование) и как используют (системная карта). Здесь мы сосредоточимся на математике предсказания — как на основе прошлых данных \(\mathbf{x}_{1:t}\) система вычисляет распределение будущих состояний \(P(\mathbf{x}_{t+1:T} \mid \mathbf{x}_{1:t})\).
Модель 1: Марковские цепи состояний сессии
Поведение участника в рамках сессии моделируется как дискретная марковская цепь с конечным числом состояний:
где:
- \(S_1\) — Разведка (малые позиции, переключение между моделями).
- \(S_2\) — Устойчивая активность (стабильный размер \(s\), одна модель).
- \(S_3\) — Эскалация (рост \(s\) более чем на 50% от среднего).
- \(S_4\) — Погоня (резкий рост \(s\) после серии отрицательных результатов).
- \(S_5\) — Завершение (выход из сессии).
Матрица переходов \(\mathbf{P} = [p_{ij}]\) оценивается из исторических данных по частотам:
Пример матрицы переходов
| Из \ В | \(S_1\) | \(S_2\) | \(S_3\) | \(S_4\) | \(S_5\) |
|---|---|---|---|---|---|
| \(S_1\) Разведка | 0,30 | 0,45 | 0,05 | 0,02 | 0,18 |
| \(S_2\) Устойч. | 0,05 | 0,60 | 0,15 | 0,08 | 0,12 |
| \(S_3\) Эскалация | 0,02 | 0,20 | 0,40 | 0,25 | 0,13 |
| \(S_4\) Погоня | 0,01 | 0,08 | 0,15 | 0,50 | 0,26 |
| \(S_5\) Завершение | 0 | 0 | 0 | 0 | 1 |
\(S_5\) — поглощающее состояние. Ключевой прогноз — вероятность попадания в \(S_4\) (погоня) за следующие \(k\) шагов:
Платформа вычисляет эту вероятность в реальном времени и при \([\mathbf{P}^k]_{i,4} > \theta_{\text{alert}}\) может инициировать предупреждение или предложение — до того, как участник фактически перейдёт в состояние эскалации.
Модель 2: Прогноз оттока — модель Кокса
Время до «оттока» (прекращения активности) моделируется через модель пропорциональных рисков:
где \(h_0(t)\) — базовая функция риска, \(\mathbf{x}\) — ковариаты участника:
| Ковариата \(x_i\) | Интерпретация | Типичный \(\beta_i\) |
|---|---|---|
| Средний размер позиции / капитал | Степень «агрессивности» | +0,3…+0,8 |
| Частота сессий (за 7 дней) | Вовлечённость | −0,5…−0,2 |
| Доля сессий с \(S_4\) (погоня) | Индикатор иррациональности | +0,6…+1,2 |
| Дни с момента последней активности | Затухание интереса | +0,1…+0,4 |
| Использование бонусов | Отклик на предложения | −0,3…−0,1 |
Вероятность оттока в ближайшие \(\Delta t\) дней:
При превышении порога \(\theta_{\text{retain}}\) активируется уровень 6 (системная карта): персонализированное предложение, оптимизированное по LTV.
Модель 3: Авторегрессия расходов
Временной ряд суммарного размера позиций за сессию \(y_t\) моделируется через ARIMA или экспоненциальное сглаживание:
Прогноз на следующую сессию:
Если \(\hat{y}_{t+1} > \alpha \cdot \bar{y}\) (где \(\alpha = 2{-}3\), а \(\bar{y}\) — скользящее среднее за 30 дней), система прогнозирует аномальный рост расходов. Это позволяет обнаружить эскалацию за 1–2 сессии до того, как она станет критической.
Прогноз LTV
Совокупная ценность участника за период \(T\):
где \(P(\text{активен в } t)\) — из модели Кокса, \(\hat{y}_t\) — из авторегрессии, \(\text{Edge}\) — математическое преимущество оператора. Платформа оптимизирует вмешательства, максимизируя именно эту величину.
Модель 4: Раннее предупреждение аномалий
Детекция аномального поведения использует последовательный z-score с экспоненциально взвешенным средним:
Параметр \(\lambda \in [0{,}05; 0{,}2]\) управляет «памятью» фильтра. Малые \(\lambda\) → медленная адаптация, чувствительность к резким скачкам. Большие \(\lambda\) → быстрая адаптация, пропуск медленных трендов.
Биометрические индикаторы
Помимо финансовых данных, предиктивные модели используют поведенческую биометрию:
| Признак | Норма | Прогностический сигнал |
|---|---|---|
| Разброс времени реакции \(\sigma_{\Delta t}\) | 100–500 мс | Рост → утомление; снижение < 20 мс → автоматизация |
| Кривизна траектории указателя | 0,3–0,8 (индекс) | Падение → снижение внимания; 0 → скрипт |
| Частота переключений между моделями | 1–3 за сессию | Резкий рост → фрустрация, поиск «удачной» модели |
| Скорость увеличения позиции после убытка | Δs/s < 10% | Δs/s > 50% → переход в состояние \(S_4\) (погоня) |
Детальный анализ биометрической классификации — AI-профилирование.
Модель 5: Петля обратной связи
Критически важное свойство предиктивных систем — замкнутый контур: прогноз изменяет среду, что делает следующий прогноз нетривиальным.
t=1: Прогноз → \(P(S_4), P(\text{уход}), \hat{y}_{t+1}\)
t=2: Вмешательство → предложение \(a^*\) (бонус, предупреждение, ограничение)
t=3: Изменённое поведение → \(\mathbf{x}'\) ≠ \(\mathbf{x}\)
t=4: Новый прогноз → \(P'(S_4 \mid a^*, \mathbf{x}')\)
→ цикл повторяется.
Формализация через банановый бандит
Задача оптимального вмешательства формализуется как контекстуальный многорукий бандит:
где \(r_t\) — вознаграждение (LTV-прирост), \(\mathcal{A}\) — множество вмешательств (предложение возврата, изменение рекомендаций, предупреждение, ограничение). Алгоритм (Thompson Sampling, UCB) балансирует между эксплуатацией (лучшее известное вмешательство) и исследованием (проверка новых).
Проблема контрфактуальности
Ключевая сложность: после вмешательства невозможно наблюдать «что было бы без него»:
где наблюдаем только одно из двух. Платформы используют A/B-тесты (рандомизированный контроль) для оценки среднего эффекта \(\text{ATE} = E[\text{ITE}]\), но индивидуальный эффект остаётся неизвестным — источник систематической ошибки в оптимизации.
Персонализация как производная прогноза
Рекомендательные алгоритмы — не самостоятельная система, а следствие предиктивных моделей:
Участнику с прогнозированным переходом в \(S_3\) (эскалация) рекомендуются модели с более высокой волатильностью (дольше серия до истощения капитала). Участнику в фазе затухания — модели с частыми малыми положительными результатами (низкая волатильность) для поддержания активности.
Критический анализ этой практики — контрстратегии и этика удержания.
Динамическая оптимизация параметров
В юрисдикциях, допускающих вариативность параметров, прогнозы используются для выбора версии модели:
при ограничении \(E[\text{RTP}_{\text{агрегат}}] = \text{RTP}_{\text{декларированный}}\). Подробнее о фиксированной vs динамической архитектуре — Архитектура RTP.
Защита рационального участника
Понимание предиктивных моделей позволяет выстроить контрстратегию:
| Что прогнозирует AI | Что это значит для участника | Контрмера |
|---|---|---|
| Состояние \(S_4\) (погоня) | Система ожидает эскалацию и может не вмешиваться (LTV растёт) | Жёсткий stop-loss до сессии. Не изменять в процессе |
| Высокая вероятность оттока | Персонализированное предложение — не «подарок», а инвестиция в возврат | Рассчитать \(V = B(1 - W(1 - \text{RTP}))\). Отклонить при \(V < 0\) |
| Рост расходов (\(\hat{y}_{t+1} \gg \bar{y}\)) | Система подстроит рекомендации под эскалацию | Фиксированный размер позиции: \(s = K_{\text{session}} / 250\) |
| Снижение активности | Будут предложены «быстрые» модели и уведомления | Внешний таймер, отключение уведомлений |
| Биометрический профиль | Каждое физическое действие — данные для прогноза | Осознание масштаба: 500–2000 признаков. GDPR Art. 15, 17, 21 |
Выводы
- AI не просто наблюдает — он прогнозирует. Марковские цепи предсказывают переходы между состояниями сессии, модель Кокса — вероятность оттока, авторегрессия — будущие расходы.
- Прогноз → вмешательство → изменение — замкнутый контур. Каждое предложение или рекомендация — результат оптимизации \(\text{LTV}\), а не «заботы».
- Персонализация — производная прогноза. Рекомендации калибруются по прогнозированному состоянию: эскалация → высокая волатильность, затухание → частые малые результаты.
- Контрфактуальная проблема ограничивает точность: индивидуальный эффект вмешательства принципиально ненаблюдаем, что создаёт систематические ошибки в оптимизации.
- Контрмеры существуют: фиксированные лимиты до сессии, расчёт реальной ценности предложений, GDPR-запросы на удаление данных. Ни одна не устраняет асимметрию полностью, но в совокупности снижают уязвимость к предиктивным алгоритмам.