Синтез речиHiggs TTS 3: это модель преобразования текста в речь с 4 млрд параметров, поддерживающая более 100 языков, с клонированием голоса без обучения, выразительным контролем эмоций и встроенными эффектами просодии и звуков для голосовых агентов.
Open-Weights





