Gemini 3.8 Flash TTS може да копира гласове и да следва актьорски указания

Google представи Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS. Новите модели могат да създават и репликират гласове, да следват указания за емоции, акценти и актьорска игра и да поддържат постоянен глас при по-дълги записи.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип
Gemini 3.8 Flash TTS
Съдържание

Gemini 3.8 Flash TTS дава на потребителите по-прецизен контрол върху AI генерираната реч, включително глас, акцент, емоции, темпо и начина, по който се изпълнява всяка реплика.

Google представи Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS, два нови модела за преобразуване на текст в реч, насочени към подобряване на начина, по който звучи генерираният от изкуствен интелект говор.

Моделите могат да създават гласове по описание, да следват подробни указания за начина на говорене, да обработват разговори между двама говорители и да запазват последователността на гласовете при по-дълги записи.

За потребителите, които използват Gemini за озвучаване, подкасти, аудиокниги или глас зад кадър във видеа, обновлението дава по-голям контрол върху крайния аудио резултат. Потребителите могат да опишат какъв глас искат и да зададат как да бъде произнесена всяка отделна реплика.

Потребителите могат да задават как да звучи гласът

Gemini 3.8 Flash TTS може да създава глас от описание на естествен език. Потребителите могат да зададат персонаж, акцент и други гласови характеристики или да изберат измежду повече от 2000 съществуващи гласа.

Моделите поддържат над 100 езика и диалекта.

Gemini 3.8 Flash TTS Benchmark

Указания могат да се добавят и в различни части от сценария. Например определена реплика може да бъде прошепната, изговорена по-бавно, произнесена с различна емоция или да включва смях, въздишки, ахване и разговорни реакции като „мхм“ или „да“.

Обновлението позволява и генериране на разговор между двама говорители от един сценарий, като гласовете и темпото могат да останат последователни при по-дълги записи.

Персонализираните гласове могат също да бъдат запазвани и използвани отново в различни проекти. Това трябва да помогне един и същ персонаж или разказвач да запази сходно звучене във времето.

Google планира по-късно да добави и възможност за ремиксиране на гласове. Тя ще позволява съществуващи гласове да бъдат променяни по отношение на височина, темпо, тембър и акцент.

Репликирането на глас има допълнителни ограничения

Gemini може да пресъздаде последователен гласов профил от 30-секунден запис, но не може просто да бъде използвана произволна гласова проба.

Според Google записът трябва да принадлежи на потребителя или той да има права да използва съответния глас. Собственикът на гласа трябва също да предостави отделен запис с устно съгласие, който съответства на говорителя от референтния запис, преди да бъде създадена реплика на гласа.

Генерираните Gemini Audio клипове съдържат и незабележим воден знак SynthID. Google посочва още, че репликирането на глас включва C2PA удостоверения, които да помагат при разпознаването на съдържание, генерирано с изкуствен интелект.

Gemini 3.8 Flash TTS се разпространява чрез Gemini Notebook, Gemini API и Google AI Studio.

По-евтиният модел Gemini 3.8 Flash-Lite TTS ще бъде достъпен в Google Vids и е предназначен за задачи в по-голям мащаб като дублаж, озвучаване и гласови агенти.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип

Още публикации

  • 26.09.2026
  • /
  • Дигитален маркетинг
Много агенции губят клиенти много преди реалните резултати от работата им да станат видими. Анализ на отпадането на клиенти в агенции от Focus Digital за 2026 г. показва, че първите 90 дни са периодът с най-висок риск от churn при всички разгледани модели на агенции. Данните показват също, че агенциите с официални прегледи на 30-ия, […]
  • 25.09.2026
  • /
  • Електронна търговия
Брандовете, които рекламират в Amazon, често срещат трудности да получат пълна картина за ефективността на различните си рекламни тактики. Една от причините е моделът на Amazon за атрибуция към последното взаимодействие, който ограничава видимостта върху влиянието на кампаниите в горната част на маркетинговата фуния, включително дисплейната реклама чрез Amazon DSP. За да реши този проблем, […]
  • 25.09.2026
  • /
  • SEO
Google публикува изследване за система за откриване на спам, наречена SAFE, която имитира начина, по който човек би извършил ръчна проверка. Системата може да открива съдържание, което нарушава не само конкретни правила, но и техния „дух“, както и по-общите насоки на платформата. SAFE е съкращение от Scaled Abuse Forensics Examiner и е разработена специално за […]
  • 24.09.2026
  • /
  • Социални мрежи
YouTube подготвя нови AI функции, които ще дадат на потребителите повече контрол върху препоръчваното съдържание. Сред новостите са персонализирани начални емисии, разговорно сравнение на продукти, музикални препоръки и AI предложения за подкасти. По време на събитието Made on YouTube платформата представи серия от функции с изкуствен интелект, насочени към откриването на съдържание и търсенето на […]
  • 24.09.2026
  • /
  • Социални мрежи
YouTube разширява възможностите на Shorts, като въвежда формат за сериали със сезони и епизоди, последователно възпроизвеждане, гласови коментари и публикации в Общността, оптимизирани за телевизори. Новата функция Shorts Series позволява вертикалните видеа да бъдат организирани като поредици, които зрителите могат да следят в хронологичен ред, вместо да ги гледат само като част от непрекъснат поток […]
  • 24.09.2026
  • /
  • SEO
Google започна внедряването на спам актуализацията за септември 2026 г., която е четвъртата подобна актуализация на компанията от началото на годината. Актуализацията е стартирала на 24 септември в 9:15 ч. PDT, показват данните в Search Status Dashboard на Google. Тя се прилага в глобален мащаб и за всички езици. В съобщението на Google се посочва: […]