Gemini Omni ще генерира видео, изображения и аудио от различни източници

Gemini Omni е новият мултимодален AI модел на Google, който започва като видео генератор, но ще може да работи и с изображения и аудио. Технологията обещава по-реалистични клипове, редактиране чрез разговор и по-добро разбиране на физиката.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип
Gemini Omni ще генерира видео, изображения и аудио от различни източници
Съдържание

Сред множеството AI анонси от Google I/O 2026 днес една от най-впечатляващите новини е новият мултимодален модел Gemini Omni. Макар първоначално да стартира като генератор на видео, в бъдеще той ще може да включва и изображения, и аудио както от страната на входните данни, така и като краен резултат.

Идеята е потребителите да могат да ремиксират различни аудио файлове, изображения и видеа в напълно нов клип чрез персонализирана текстова заявка. В момента Gemini позволява генериране на видеа от текстови prompts и изображения, но новият модел добавя възможност за комбиниране на аудио клипове и съществуващи видеа при създаването на ново съдържание. Това означава повече източници като вход и краен резултат, който според Google ще бъде по-добър от всякога по отношение на реализъм и точност.

Макар генерирането на изображения и аудио да предстои, възможността за създаване на видео ще бъде въведена първа чрез модел, наречен Gemini Omni Flash. Примерът, който Google дава, е избор на няколко визуални стила от изображения в галерията на телефона и прилагането им върху съществуващо видео. Така например потребителят би могъл да превърне видео на себе си в реалния свят в клип, който изглежда като Pixar анимация.

Gemini Omni ще позволява и редактиране на видеа чрез „разговор“, посочва Google. Този подход вече е познат на потребителите, които използват Gemini за създаване на видеа: достатъчно е да обяснят какво искат да видят, а Omni изпълнява заявката. Чрез последващи prompts могат да се променят конкретни елементи във видеото, като обект или цвят, или да се създадат собствени „повторни заснемания“ на сцената, при които действието се променя.

Моделът ще може да променя и ъгъла на камерата или средата във видеото, например да пренесе потребителя от спалня на плажна сцена. Според Google видеата могат да се доработват в няколко последователни стъпки, като в същото време остава възможност за връщане към оригиналния клип.

Световното знание на Gemini

Gemini Omni

Google твърди, че Gemini Omni използва „интуитивно разбиране на физиката“ заедно със „знанията на Gemini за историята, науката и културния контекст“, за да създава видеа, които са максимално реалистични и последователни. На практика обаче ще бъде нужно реално тестване, за да се види доколко технологията работи толкова добре, колкото твърди компанията.

Omni вече разполага с по-добро разбиране на сили като гравитация, кинетична енергия и динамика на флуидите, което би трябвало да намали типичните странности при AI видеата. Освен че изгражда сцени, Gemini Omni според Google разсъждава и какво логично трябва да се случи след това.

AI видеата често се провалят, защото се опитват да следват модели от огромния брой видеа в обучителните си данни, вместо да се придържат към законите на физиката. Ако човек излезе извън кадър, той не винаги остава там, когато камерата се върне обратно. Google твърди, че Gemini Omni ще показва по-малко подобни проблеми.

За да ограничи риска от deepfake съдържание, Google въвежда определени ограничения върху създаването на видеа. Засега потребителите ще могат да използват само собствения си глас и дигитален аватар, базиран на тях самите, за генериране на резултати. Освен това всички видеа ще съдържат невидимия воден знак SynthID на Google, който показва, че съдържанието е генерирано с AI.

Gemini Omni Flash вече се разпространява в приложението Gemini и в Google Flow за абонати на Google AI Plus, Pro и Ultra. По-късно тази седмица моделът ще бъде достъпен безплатно и в YouTube Shorts и приложението YouTube Create.

Към момента на писане няма информация за лимитите за употреба. В момента потребителите с план Google AI Plus на цена 7,99 долара на месец могат да генерират по две видеа дневно чрез модела Veo 3.1 Lite. Остава да се види колко щедри ще бъдат лимитите за генериране с Gemini Omni, тъй като подобни заявки вероятно изискват значителен AI изчислителен ресурс.

Picture of Екип на MarketingPRO
Екип на MarketingPRO
Редакторски екип

Още публикации

  • 30.07.2026
  • /
  • Дигитална реклама
Правилната стратегия за офериране в Google Ads определя как системата разпределя бюджета и доколко кампанията може да постигне конкретната бизнес цел. През последните години Google Ads се отдалечи от ръчното задаване на оферти за всяка ключова дума. Все по-голяма част от решенията вече се вземат автоматично за всеки отделен рекламен търг въз основа на множество […]
  • 30.07.2026
  • /
  • Изкуствен интелект
Борис Черни, създател и ръководител на Claude Code в Anthropic, смята, че сложното инженерство на промптове постепенно губи значението си. В интервю с Даяна Ху от Y Combinator той заявява, че потребителите често подценяват възможностите на Claude Code и прекалено усложняват инструкциите си. Според него по-важно е моделът да получи трудна, ясно поставена задача и […]
  • 29.07.2026
  • /
  • Изкуствен интелект
M3 Communications Group и AgilePool започват партньорство в PR и AI, насочено към взаимно обучение и обмен на експертиза между двата екипа. Споразумението беше обявено на 29 юли 2026 г. и обединява опита на M3 Communications в стратегическите комуникации с технологичната експертиза на AgilePool в областта на изкуствения интелект и автоматизацията. Какво включва партньорството M3 […]
  • 28.07.2026
  • /
  • Уеб дизайн
Добрите 404 страници на агенции превръщат неработещия адрес в полезна, запомняща се и последователна част от потребителското преживяване. При сърфиране в интернет всеки може да въведе грешен адрес, да последва невалидна връзка или да попадне на съдържание, което вече не е достъпно. Стандартното съобщение „404: Страницата не е намерена“ често оставя посетителя без ясна следваща […]
  • 28.07.2026
  • /
  • Дигитален маркетинг
Ефективният Instagram маркетинг през 2026 г. изисква системно проучване, силно кратко видео и измерване на действията, а не само на видимостта. През септември 2025 г. Meta обяви, че Instagram е достигнал 3 млрд. активни потребители месечно. Това е официално твърдение на компанията, а не независимо измерване, но показва мащаба на платформата. Според Meta значителна част […]
  • 28.07.2026
  • /
  • Изкуствен интелект
Moonshot AI публикува пълните обучени параметри на Kimi K3, което позволява на разработчиците да изтеглят, адаптират и разполагат модела в собствена инфраструктура. Това дава повече контрол върху данните и внедряването, но огромният размер на Kimi K3 ограничава практическото му използване до компании с мащабна изчислителна инфраструктура. Според официалната документация на Moonshot AI моделът има 2,8 […]
AI Assistant