Динамическая система, которая анимирует статические портреты в реалистичные говорящие головы, синхронизируя движения лица и головы, управляемые звуком, в интерактивных беседах.
INFP — это продвинутая система, предназначенная для преобразования статических портретных изображений в интерактивные видео с говорящими головами, которые естественным образом чередуют состояния разговора и прослушивания в многоэтапных беседах. В отличие от традиционных методов, требующих ручного назначения ролей, INFP использует аудиовход для динамического управления выражениями лица и движениями головы агента, захватывая вербальные и невербальные сигналы с высокой точностью. Он использует новый двухэтапный процесс, включающий кодирование латентного пространства движения и условные диффузионные трансформеры, подкрепленный масштабным набором данных DyConv реальных диадических бесед. Эта система обеспечивает производительность в реальном времени и сохраняет индивидуальные детали лица и стили речи, что делает ее подходящей для приложений, требующих реалистичных виртуальных аватаров и интерактивных агентов.
| Тип | Инструмент |
| Категория | Изображения / Генератор видео ИИ |
| Цена | бесплатно |
| Платформа | Только веб |
| Системы | web |
| Хостинг | cloud |
| Установка | saas |
| Язык сайта | ru |
| Просмотры | 1 314 |