FireRedTTS-3 Open-source, SOTA, ттска от китайцев, уже третья версия, это генерация и редактирование речи, по производ
FireRedTTS-3 Open-source, SOTA, ттска от китайцев, уже третья версия, это генерация и редактирование речи, по производительности и качеству приятно удивила, советую попробовать 🔘 Две версии: - FireRedTTS3-Base для zero-shot клонирования голоса - FireRedTTS3-Instruct для управления голосом через естественный язык и редактирования аудио 24 языка + 21 китайский диалект (Arabic · Cantonese · Chinese · Czech · Dutch · English · Finnish · French · German · Greek · Hindi · Indonesian · Italian · Japanese · Korean · Polish · Portuguese · Romanian · Russian · Spanish · Thai · Turkish · Ukrainian · Vietnamese) По качеству это SOTA на бенчах + zero-shot клон войса без дообучения, просто по короткому референсу голоса Semantic + Acoustic editing можно править смысл фразы и акустические характеристики в одной модели Voice design по текстовой инструкции + семантическое и акустическое редактирование речи Для Instruct-версии доступны generate_voice_design (создать голос по описанию) и generate_semantic_edit (переписать смысл сказанного, сохранив голос) Демо-страница с примерами Hugging Face GitHub ModelScope Делаем портативку? - 🔥
| Type | Tool |
| Section | Audio, voice & music |
| Site language | en |