GigaTTS: До мурашек естественный голос без диффузий

🔥 GigaTTS — речь, которая дышит эмоциями!
GigaChat 3b + 30 тыс. часов аудио + собственный токенизатор = голос, который смеётся, шепчет и передаёт нюансы как живой. Обходит прошлые модели в 2-4 раза по естественности. Никаких «роботизированных» интонаций — только живой звук с индивидуальностью.

Покажем, как создали голоса операторов колл-центров и клонирование голосов под запрос. Технический обзор с деталями — в следующем посте. 🎤🤖
#AI #VoiceTech

Как это изменит 1–3 года:
В ближайший год: GigaTTS станет стандартом в колл-центрах и голосовых ассистентах, улучшая взаимодействие за счёт эмоциональной естественности и клонирования голосов.
В горизонте 3 лет: Персонализированные голосовые синтезаторы вытеснят традиционных дикторов в медиа и образовании, создавая новые возможности для кастомизации контента.
Кому следить: Предприниматели в сфере B2B-сервисов, разработчики AI-ассистентов и медиапроизводители.

🔗 Читать в источнике

#IT #News #Tech #Future