Снова релиз от Т-Технологий и снова опенсорс! Т-Технологии выложили в открытый доступ Perseus - фреймворк для обучения
Снова релиз от Т-Технологий и снова опенсорс! Т-Технологии выложили в открытый доступ Perseus - фреймворк для обучения моделей персонализации на историях пользовательских событий. Главная идея: собрать все действия клиента в разных сервисах экосистемы в одну последовательность и построить поверх неё универсальный эмбеддинг пользователя, который переиспользуется в разных задачах. Кстати, в PLATA я успел позаниматься такой же задачей в банковской сфере. И даже доклад прочитал на DataFest (Салават, мы ждем записи!!!) Perseus решает проблему холодного старта и разрозненности данных. Обычно модель учат на данных того сервиса, где она работает, но у новых сервисов истории почти нет, а схемы событий у всех разные. Perseus объединяет домены (транзакции, кэшбэки, шопинг, действия с банковскими продуктами) в единое хранилище и обрабатывает каждый домен своими обучаемыми энкодерами. Архитектурно это выглядит так: берем историю событий, с помощью энкодеров получаем последовательность эмбеддингов, помещаем в миксер backbone, получаем эмбеддинг пользователя. В качестве backbone можно ставить разные sequence-модели — Transformer/BERT, ModernBERT, HSTU, LiGR, DA-Net, Mamba-варианты и свои реализации. Один и тот же пользовательский эмбеддинг используется сразу в четырех типах задач: retrieval, ranking, classification и regression. По словам команды, подход дал прирост бизнес-метрик от 3% до 17%, а на предсказании корзины первого заказа в новом магазине — в среднем +10%, даже если пользователь там ещё ничего не покупал. Сейчас Perseus работает в Шопинге, повышенных кэшбэках и предиктивной поддержке. Код на GitHub: https://github.com/perseus2026/perseus
| Тип | Инструмент |
| Категория | Агент-персоны |
| Язык сайта | en |