Динамическая система, которая анимирует статические портреты в реалистичные говорящие головы, синхронизируя движения лица и головы, управляемые звуком, в интерактивных беседах.
INFP — это продвинутая система, предназначенная для преобразования статических портретных изображений в интерактивные видео с говорящими головами, которые естественным образом чередуют состояния разговора и прослушивания в многоэтапных беседах. В отличие от традиционных методов, требующих ручного назначения ролей, INFP использует аудиовход для динамического управления выражениями лица и движениями головы агента, захватывая вербальные и невербальные сигналы с высокой точностью. Он использует новый двухэтапный процесс, включающий кодирование латентного пространства движения и условные диффузионные трансформеры, подкрепленный масштабным набором данных DyConv реальных диадических бесед. Эта система обеспечивает производительность в реальном времени и сохраняет индивидуальные детали лица и стили речи, что делает ее подходящей для приложений, требующих реалистичных виртуальных аватаров и интерактивных агентов.
| Type | Tool |
| Section | Images |
| Pricing | free |
| Platform | Web only |
| Systems | web |
| Hosting | cloud |
| Install | saas |
| Site language | ru |
| Views | 1 314 |