Перейти к содержимому

Google I/O 2026: Gemini Omni, Spark и главные анонсы

Что Google показал 19 мая 2026 — и что из этого реально стоит вашего внимания

20 мая 2026 г.8 мин чтенияClipia
Google I/O 2026: Gemini Omni, Spark и главные анонсы

19 мая 2026 Google провёл I/O — и впервые за пару лет это была не «ещё одна модель», а заявка на смену парадигмы. Из тулзы, в которую вводят промпт и ждут ответ, Gemini превращается в систему, которая видит, слышит, генерирует и сама делает работу за вас.

Если коротко: одна модель теперь делает видео из чего угодно (Omni), вторая — живёт у вас в фоне 24/7 и сама закрывает задачи (Spark), а основная Gemini 3.5 Flash в четыре раза быстрее предыдущей фронтирной модели.

Разбираем всё, что показали, без маркетингового тумана — и что из этого реально стоит вашего внимания.

Кстати: Gemini Omni мы уже подключаем к Clipia — без отдельной подписки на Google и без VPN. Подпишитесь на Telegram-канал, чтобы узнать в день запуска. А пока в Clipia уже работают Veo 3.1, Seedance 2.0, Kling 3.0 — тот же класс моделей.


Смотреть keynote самим

Минутная сводка демо с keynote — без слов, только результаты Gemini Omni:

Полная запись Google I/O 2026 keynote (~1ч 50м) и официальный 35-минутный recap — обе доступны на YouTube-канале Google:

Google I/O 2026 keynote — полная версия

Полный keynote (1ч 50м) · Сжатый recap за 35 минут


TL;DR — главное за 60 секунд

  • Gemini Omni — мультимодальная модель «из чего угодно во что угодно». На вход: текст, изображения, аудио, видео. На выход: видео со звуком до 10 секунд. Конверсационное редактирование голосом.
  • Gemini Spark — AI-агент, который работает в фоне 24/7 на Google Cloud, даже если ноут закрыт, а телефон в кармане. Читает почту, копается в документах, заполняет таблицы.
  • Gemini 3.5 Flash — новый фронтир, в 4× быстрее, обгоняет 3.1 Pro в кодинге и мультимодальных бенчмарках.
  • AI Search — поисковая строка принимает изображения, файлы, видео и даже вкладки Chrome как ввод.
  • Smart Glasses — очки от Samsung, Gentle Monster и Warby Parker с Gemini внутри. В США этой осенью.
  • Wear OS 7, Googlebooks, Universal Cart, Neural Expressive — россыпь обновлений по экосистеме.
  • AI Ultra — теперь $100/мес, с топ-тиром $200/мес.

Gemini Omni — главная новость для тех, кто делает контент

Gemini Omni принимает на вход что угодно и выдаёт видео

Это та модель, ради которой стоит смотреть всю презентацию. Google называет её «create anything» — и это не маркетинг. Omni — нативно мультимодальная: она не три модели в одном API, а одна нейросеть, которая на вход берёт смесь форматов и выдаёт видео, понимая контекст всего сразу.

Что подаётся на вход

  • Текст — описание сцены, диалога, действия.
  • Изображения — до 5 референсов: персонаж, фон, реквизит.
  • Аудио — голос, музыка, звуковые эффекты.
  • Видео — готовый клип для ремикса или редактирования.

Что получается на выходе

Видео длиной до 10 секунд с нативно сгенерированным звуком. Не «наложение эффектов», а единая сцена, где модель удерживает физику, континуитет персонажей и логику происходящего.

Демо, которые показали

  • Шарик, катящийся по лабиринту — с реалистичной физикой отскоков и звуком каждого удара. Включая звон колокольчика в точке финиша.
  • Пластилиновое объяснение сворачивания белков — в стиле claymation, с консистентной анимацией и подписями.
  • Профессор у доски — выводит тригонометрическое тождество, объясняет вслух, текст на доске остаётся читаемым.

Вот ключевое демо с keynote — шарик с реалистичной физикой и нативно сгенерированным звуком:

Видео официально опубликовано Google в blog post «Introducing Gemini Omni». Больше демо — в нашем глубоком разборе Omni.

Главная фишка — Conversational Editing

Это не «нажми кнопку и применится фильтр». Это диалог с моделью:

— «Замени персонажа на блондинку». — «Сделай освещение более кинематографичным». — «Подвинь камеру выше». — «Стабилизируй движение».

Omni держит контекст разговора и не ломает сцену между правками. Лица, объекты, освещение остаются согласованными от итерации к итерации.

Безопасность — SynthID на каждом кадре

Каждое видео из Omni помечено невидимым водяным знаком SynthID. Это позволяет потом определить, что контент сгенерирован AI. Бонусом: OpenAI, Kakao и ElevenLabs тоже подписались на эту схему — формируется отраслевой стандарт.

Когда доступно

  • Gemini Omni Flash — уже сейчас, в подписке от AI Plus за $20/мес и выше.
  • YouTube Shorts и YouTube Create — бесплатно, на этой неделе после анонса.
  • Omni Pro — анонсирован, точная дата не названа.

Хочется попробовать AI-видео без подписки на Google? Сравните модели на Clipia →


Gemini Spark — первый агент, который работает, когда вы спите

Gemini Spark работает в фоне, пока пользователь спит

Тот самый «ИИ, который сделает всё за вас, пока ноут закрыт». Звучит как маркетинг, но техника под капотом серьёзная: Spark физически запускается в виртуальных машинах на Google Cloud, а не на вашем устройстве. Поэтому он действительно продолжает работать, когда айфон в кармане, а MacBook закрыт.

Что Spark умеет

  • Читать вашу почту в Gmail.
  • Достраивать таблицы в Sheets из информации, разбросанной по Docs и письмам.
  • Согласовывать встречи через Calendar.
  • Заходить в сторонние сервисы: Canva, OpenTable, Instacart.
  • Получать голосовые задачи и держать несколько в очереди одновременно.

Демо, на котором презентация перевернулась

На сцене Google показал, как Spark в одиночку спланировал и организовал большую вечеринку: собрал список гостей из почты, забронировал столик через OpenTable, сделал постеры в Canva, выставил счёт в Sheets, разослал приглашения. Всё — по одной голосовой задаче.

Daily Brief — утренний дайджест от Spark

Spark включает фичу Daily Brief: пока вы спите, агент перебирает почту, календарь и задачи, и утром выдаёт «что важно сегодня». Это не AI-сводка постфактум — это проактивная триажная работа.

Как это работает

Под капотом — Gemini 3.5 Flash + новый агентский фреймворк Antigravity. Spark проверяет с вами критичные действия (например, перед оплатой), а рутину делает молча.

Доступность

  • Beta — на следующей неделе после I/O.
  • Только AI Ultra-подписчики в США — это $100/мес.
  • iOS и Android — обе платформы сразу.
  • Глобальный релиз и Chrome-интеграция — позже в этом году.

Gemini 3.5 Flash + Antigravity — мотор для всего остального

Не самый громкий анонс, но именно эта модель — фундамент под Omni и Spark.

  • В 4× быстрее предыдущего фронтира по output tokens per second.
  • Обгоняет 3.1 Pro в кодинге, агентских задачах и мультимодальных бенчмарках.
  • Antigravity — обновлённая платформа для разработчиков, которые строят собственных агентов поверх Gemini.
  • Gemini 3.5 Pro в закрытом тестировании, в проде — в следующем месяце.

Для разработчиков это значит одно: бар «как быстро можно построить агента» опустился ещё ниже.


AI Search — поиск, в который кидаешь что угодно

Поисковая строка Google переосмыслена. Теперь это не «введите текст», а интеллектуальный приём ввода:

  • Изображения — спросить «что это» или «откуда это».
  • Файлы — PDF, документы, таблицы.
  • Видео — «найди мне это место в этом ролике».
  • Вкладки Chrome — поиск с учётом открытых страниц.

Подсказки идут дальше autocomplete: система прогнозирует намерение, а не достраивает буквы.

В пару к нему — Universal Cart: общая корзина, в которой Gemini следит за ценами, скидками и наличием по магазинам. Утилитарно, но превращает Google в шопинг-агента, а не просто поиск.


Smart Glasses — Gemini переезжает на лицо

Google и Samsung объявили коллаборации с двумя оптическими брендами:

  • Gentle Monster — премиум-сегмент.
  • Warby Parker — массовая аудитория в США.

Что внутри:

  • Голосовая работа с Gemini.
  • Снимки и видео по команде.
  • Перевод в реальном времени — разговариваете на разных языках, очки показывают перевод.
  • Навигация overlay.

Релиз — осенью 2026, сначала в США. Это не Vision Pro: фокус на лёгкости и повседневной носке.


Wear OS 7, Googlebooks, Neural Expressive — экосистема

Россыпь анонсов поменьше, но из тех, что складываются в общую картину:

  • Wear OS 7 — основа под Gemini на часах + новая фича Create My Widget: голосом описываете виджет, система собирает.
  • Googlebooks — премиум-ноутбуки от Acer, ASUS и Lenovo на Android с Gemini внутри. Появятся осенью.
  • Neural Expressive — новый дизайн-язык приложения Gemini: плавные анимации, насыщенные цвета, тактильный отклик. Эра «строгого корпоративного» — позади.

SynthID становится отраслевым стандартом

Тихая, но важная новость: на SynthID — невидимый водяной знак Google для AI-контента — подписались OpenAI, Kakao и ElevenLabs. Это значит, что больше моделей в мире будут помечать своё видео и аудио единым способом. Для платформ модерации и журналистики — это большой шаг к разметке «что AI, а что нет».


Что это значит для тех, кто делает контент

Главный сигнал из I/O 2026 — это смерть «одного промпта». Раньше пайплайн выглядел так: написал промпт, получил картинку или видео, доделал в редакторе. Теперь:

  • Видео редактируется голосом в чате до состояния «то самое».
  • Агент в фоне сам собирает референсы, расписывает шот-лист, готовит подписи.
  • Поиск принимает скриншот вместо текста.

Это не значит, что нужно срочно мигрировать на Gemini. Это значит, что точка интерфейса с AI смещается с промпта на разговор. И модель, и платформа, которые проиграют этот переход — отстанут.

Кстати, если вы уже работаете с AI-видео, но не хотите завязываться на одну подписку — на Clipia одновременно доступны Seedance 2.0, Kling 3.0, Veo 3.1, Nano Banana 2 и другие модели. Никаких тарифов «или-или»: платите за кредиты, выбирайте под задачу.


Что Clipia делает с этим анонсом

Не будем строить из себя сторонних наблюдателей: I/O 2026 — это анонс, который напрямую касается нас.

Gemini Omni — подключаем. Сейчас Omni доступна только в Google AI Plus за $20/мес. Публичного API ещё нет, но как только Google его откроет — Omni появится в Clipia без отдельной подписки. Параллельно мы дорабатываем инфраструктуру под conversational editing (это новый паттерн UX, требующий долгоживущих сессий).

Что уже работает у нас сейчас:

  • Veo 3.1 — кинематографическая модель от той же команды Google DeepMind, что делала Omni.
  • Seedance 2.0 — до 9 референсов и 2K разрешение.
  • Kling 3.0 — Multi-Shot и Motion Control.
  • Nano Banana 2 — лучший I2I-сетап.

Один аккаунт, кредиты вместо подписок, без VPN.

Узнать первыми, когда Omni запустится: → Telegram-канал Clipia. Мы пишем туда в день запуска любой новой модели.

Глубокий разбор Gemini Omni — в отдельной статье →


Итог: что забрать с I/O 2026 себе в работу

  1. Попробуйте Gemini Omni в AI Plus за $20 — это самая интересная модель для контентмейкеров за последний год. Или подождите её появления в Clipia.
  2. Подождите Spark глобально — пока он только для US и $100/мес, но через 3–6 месяцев это станет новой нормой для всех.
  3. Готовьтесь к conversational interfaces. Кнопки «Применить фильтр» уходят. Останется чат.
  4. Следите за SynthID. Если работаете с заказчиками — скоро это станет требованием прозрачности.

Google не показал «революцию завтра» — он показал, что revolution is shipping. Тихо, в продакшен, по подписке. И это, пожалуй, страшнее любого хайпа.

Подписаться на Telegram Clipia → · Попробовать модели сейчас →


Источники

Попробуйте сами на Clipia

60+ моделей для генерации видео и изображений. Работает из России, оплата картой РФ.

Поделиться

Похожие статьи

Стабильный товарный packshot, управляемая траектория камеры и вертикальная, квадратная и горизонтальная рекламные рамки20 мин
16 авг. 2026 г.

Как превратить фото товара в видеорекламу с AI

Превратите фото товара в видеорекламу с контролируемым AI-движением. Готовые промпты, четыре реальных примера, проверенные цены и чек-лист точности.

Слева карточка с фрагментом промпта, справа сгенерированный портрет в мягком студийном свете — связь текст-в-изображение12 мин
16 авг. 2026 г.

Промпт для нейросети: формула из 5 компонентов (2026)

Хороший промпт для нейросети называет пять вещей: объект, стиль, свет, композицию и технические параметры. Разбираем формулу с готовыми шаблонами по задачам.

Статичный портрет превращается в кинематографичный движущийся кадр, а звуковая волна совпадает с движением героя19 мин
14 авг. 2026 г.

Видео из фото со звуком: как добавить нативное аудио

Превратите одну фотографию в AI-ролик с синхронным звуком. Разбираем, когда генерировать нативное аудио, когда монтировать отдельно и как писать промпт.