Gemini Omni удължава AI видеата до 40 секунди и ги мащабира до 4K

Gemini Omni 1.1 Flash може да използва до 10 секунди от предишен видеоклип като контекст и да удължава сцените до общо 40 секунди. Моделът предлага още генериране между начален и краен кадър, по-бързи 360p визуализации и мащабиране на готовите видеа до 4K.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип
Gemini Omni 1.1 Flash
Съдържание

Gemini Omni 1.1 Flash вече може да удължава AI видеа до общо 40 секунди, като използва повече от предишните кадри за контекст.

Новият генеративен видео модел на Google е насочен към създатели на съдържание и разработчици, които се нуждаят от по-голям контрол върху развитието на сцените. Сред основните подобрения са по-дългата визуална памет, задаването на начален и краен кадър и възможността за използване на съществуващо видео като ориентир.

Моделът предлага и по-бързи 360p визуализации за тестване на идеи, преди крайният клип да бъде генериран в по-висока резолюция.

Gemini Omni използва до 10 секунди от предишния клип

Едно от основните предизвикателства при генеративното видео е запазването на последователност между отделните кадри и сцени. Персонажите, средата и посоката на действието могат да се променят, когато моделът не разполага с достатъчно информация за предходните събития.

Gemini Omni 1.1 Flash може да анализира до 10 секунди от съществуващото видео, когато трябва да продължи дадена сцена. Предишната система е разчитала само на последната секунда от клипа.

Gemini Omni

По-дългият контекст трябва да помогне на модела да запази по-последователно външния вид на героите, обстановката и развитието на действието.

AI видеата могат да достигнат обща продължителност от 40 секунди

Google увеличава и максималната продължителност на генерираните последователности. Потребителите могат да удължават видеото на интервали от по 10 секунди, докато то достигне обща дължина от 40 секунди.

Тази възможност предоставя повече пространство за създаване на свързани поредици от кадри. Вместо самостоятелни кратки клипове, потребителите могат да изградят сцена с по-ясно начало, развитие и завършек.

Начален и краен кадър дават повече контрол върху сцената

Gemini Omni 1.1 Flash позволява на създателите да зададат както първия, така и последния кадър на желаната сцена. След това моделът генерира необходимите междинни кадри, за да свърже двете изображения.

Функцията може да се използва за създаване на движение на камерата около обект, плавно приближаване между две композиции или видеоклип, който се повтаря без ясно забележим преход.

Поддържат се и видео референции с продължителност до три секунди. Те предоставят допълнителен визуален контекст и могат да помогнат за запазването на външния вид на персонажите в различни генерирани сцени.

360p визуализациите са по-бързи и по-евтини

Разработчиците вече могат да генерират предварителни версии с резолюция 360p. По данни на Google те се създават с до 60% по-бързо от стандартния 720p резултат и струват приблизително една трета от неговата цена.

Gemini Omni видео от 720p до 4K

По-ниската резолюция е предназначена за ранно тестване на идеи, редактиране на инструкциите и сравняване на различни версии. Така финалното генериране с по-високо качество може да бъде направено едва след избора на подходящ резултат.

Gemini Omni 1.1 Flash може да създава видео с резолюция 1080p, както и да мащабира завършения клип до 4K. Това означава, че 4K резултатът е получен чрез увеличаване на резолюцията, а не непременно чрез първоначално генериране в 4K.

Къде е достъпен Gemini Omni 1.1 Flash

Моделът вече се предлага на разработчици чрез Gemini API в Google AI Studio. Бизнес потребителите могат да получат достъп до него през корпоративната платформа Agent Platform на Google.

Gemini Omni 1.1 Flash се разпространява глобално и в Google Flow за абонатите на AI Plus, Pro и Ultra.

Функцията за удължаване на сцени предстои да бъде добавена и директно в приложението Gemini за потребителите на същите абонаментни планове.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип

Още публикации

  • 09.09.2026
  • /
  • Изкуствен интелект
ChatGPT Images 2.5 позволява на потребителите да покажат идеята си чрез рисунка, която изкуственият интелект да превърне в завършено изображение, според информацията в предоставения материал. Обновлението включва и подобрения в скоростта, реалистичността и прецизността при редактиране. В текста се посочва, че OpenAI започва разпространението на новата версия на фона на над 3 милиарда изображения, генерирани […]
  • 08.09.2026
  • /
  • Изкуствен интелект
ChatGPT тества функцията Writing Style, която цели да доближи генерираните текстове до начина, по който пише конкретният потребител. Вместо всеки път да получава инструкции за тона или копирани примери от стари имейли, чатботът ще може да използва текстове от свързани приложения. Идеята е да отпадне необходимостта потребителите многократно да обясняват как трябва да звучат отговорите. […]
  • 06.09.2026
  • /
  • SEO
Решението дали да бъдат блокирани AI ботовете е преди всичко бизнес въпрос. След като една компания прецени, че не желае нейното съдържание да бъде обхождано, използвано за обучение или достъпвано от определени AI системи, идва техническият въпрос: кой е най-добрият начин за блокиране? Основните подходи са два. AI ботовете могат да бъдат ограничени чрез файла […]
  • 06.09.2026
  • /
  • Изкуствен интелект
Google добави Lyria 3.5, своя най-усъвършенстван досега модел за генериране на музика, към приложението Gemini. Досега технологията беше достъпна чрез инструмента за създаване на филми с изкуствен интелект Flow. Моделът вече започва да достига до всички потребители на Gemini. Чрез него могат да бъдат генерирани песни, инструментали и саундтраци въз основа на обикновени текстови описания […]
  • 04.09.2026
  • /
  • Дигитален маркетинг
Успешният дизайн на бранд идентичност не започва с творческа идея, а с разбиране на бизнеса, клиента и неговата аудитория. Дълго време добрият дизайнер се свързваше предимно с владеенето на определени умения: типография, цветове, композиция и изграждане на въздействащи визуални системи. Всички тези компетенции остават важни, но сами по себе си не гарантират ефективна бранд идентичност. […]
  • 04.09.2026
  • /
  • Социални мрежи
Гласовите коментари в TikTok са сред четирите нови функции, с които платформата разширява възможностите за взаимодействие под видеата. Потребителите ще могат да публикуват още анкети, карусели със снимки и Live Photos. Новите инструменти надграждат досегашните текстови коментари и отговори с единични изображения. Така коментарните секции ще могат да се превръщат в още по-съществена част от […]