Продвинутая модель синтеза речи, оптимизированная для естественных разговорных сценариев, поддерживает китайский и английский языки и обучена на больших объёмах данных.
ChatTTS — это передовая модель генерации голоса, специально разработанная для разговорных приложений, таких как диалоговые задачи для ассистентов на базе больших языковых моделей, аудиодиалоги и видеоинтро. Обучена примерно на 100 000 часов китайской и английской речи, обеспечивает высококачественный, естественный и выразительный синтез. Модель отлично передаёт тонкие просодические особенности, такие как интонация, паузы и эмоциональные нюансы, делая взаимодействие более живым и естественным. ChatTTS распространяется с открытым исходным кодом; планируется выпуск базовой модели, обученной на 40 000 часов данных, для поддержки дальнейших исследований и разработок в AI-сообществе синтеза речи.
| Type | Tool |
| Section | Audio, voice & music |
| Pricing | free |
| Platform | Command line |
| Systems | cli, web |
| Hosting | cloud |
| Install | saas |
| Site language | ru |
| Views | 28 371 |