1 мин
6
Google представила Gemini Omni Flash — модель, которая объединяет reasoning Gemini и генеративные медиа. Первый фокус модели — создание и редактирование видео из разных входных данных.
Google представила Gemini Omni — модель, которая соединяет способность Gemini понимать мир и генеративные возможности для создания медиа. Первый представитель семейства, Gemini Omni Flash, начинает с видео: пользователь может комбинировать текст, изображения, аудио и видео как входные данные, а затем получать качественные видеорезультаты. Важная особенность — возможность редактировать видео через естественный язык, постепенно уточняя сцену, действия, объекты и визуальные изменения. Google выводит Omni в Gemini app, Google Flow и YouTube Shorts, а в дальнейшем планирует расширять поддержку других модальностей. Для рынка это очередной шаг к мультимодальным инструментам, где генерация контента становится не отдельным редактором, а диалогом с моделью.
Источник
Google
Похожие новости
AI-агенты
Google подвела итоги майских AI-анонсов
Google собрала ключевые AI-анонсы мая 2026 года: Gemini 3.5, агентные функции, AI Mode в Search, Google Flow Music и новые сценарии применения генеративных моделей.
18
AI-агенты
OpenAI улучшила память ChatGPT с помощью новой архитектуры Dreaming
OpenAI начала разворачивать более масштабируемую систему памяти ChatGPT. Новая архитектура Dreaming помогает ассистенту лучше учитывать свежий контекст, предпочтения пользователя и изменения во времени.
18