Продвинутая модель синтеза речи, оптимизированная для естественных разговорных сценариев, поддерживает китайский и английский языки и обучена на больших объёмах данных.
ChatTTS — это передовая модель генерации голоса, специально разработанная для разговорных приложений, таких как диалоговые задачи для ассистентов на базе больших языковых моделей, аудиодиалоги и видеоинтро. Обучена примерно на 100 000 часов китайской и английской речи, обеспечивает высококачественный, естественный и выразительный синтез. Модель отлично передаёт тонкие просодические особенности, такие как интонация, паузы и эмоциональные нюансы, делая взаимодействие более живым и естественным. ChatTTS распространяется с открытым исходным кодом; планируется выпуск базовой модели, обученной на 40 000 часов данных, для поддержки дальнейших исследований и разработок в AI-сообществе синтеза речи.
| Тип | Инструмент |
| Категория | Аудио, голос и музыка / Текст в речь |
| Цена | бесплатно |
| Платформа | Командная строка |
| Системы | cli, web |
| Хостинг | cloud |
| Установка | saas |
| Язык сайта | ru |
| Просмотры | 28 371 |