Gemini обновил ИИ-генерацию видео на базе Veo 3.1: теперь к промпту можно прикреплять несколько референс-изображений. Об этом сообщили в официальном аккаунте Gemini в X.

Раньше такая возможность была только во Flow и в API Veo 3.1, а в интерфейсе Gemini её не было. Теперь функция появляется в Gemini, но только для подписчиков Pro и Ultra. Обновление раскатывается постепенно. Postium собрал самое важное.

Реклама. Erid 2Vtzqw9oHvr. ООО «Клик.ру». Клик.ру
Реклама. Erid 2Vtzqve9YHx. ООО «Клик.ру». Клик.ру

Читайте также: Как скачать приложение Gemini на телефон

Что это и как работает

Veo 3.1 умеет учитывать до трёх референсов. Модель анализирует изображения вместе с текстовым описанием и использует их как визуальные ориентиры для персонажей, предметов, окружения и стиля.

На Flow это давно было в виде функции «Видео по образцам»: там можно было собрать сцену из нескольких образцов и построить ролик поверх них. Но в Gemini до недавнего времени можно было загрузить только одну картинку, как референс.

Теперь несколько картинок в качестве исходника можно использовать прямо в Gemini — без сторонних инструментов и сервисов.

Главное изменение — нормальный визуальный контроль в пользовательском интерфейсе. Ролики становятся предсказуемее: стабильнее стиль, проще закрепить внешний вид героев.

Как пользоваться

В режиме генерации видео в Gemini нужно ввести текстовый запрос и загрузить несколько изображений. Модель соберёт ролик, учитывая каждый из них.

Почему это важно? Flow давно позволял работать с несколькими образцами, но это был инструмент для продвинутых пользователей. Поддержка нескольких референсов в Gemini делает функцию массовой: теперь она доступна тем, кто генерирует видео через приложение.

Google постепенно переносит продвинутые возможности Veo 3.1 из Flow и API в основной продукт: улучшенное следование промптам, работа с длинными роликами, новые режимы, а теперь — и полноценная работа с несколькими референсами.

Итог: генерация видео по нескольким референсам выходит на более широкую аудиторию — теперь она доступна прямо в интерфейсе Gemini, но пока только для подписчиков Pro и Ultra.

Ранее Google добавил ИИ-модель Nano Banana на платформу Flow.

⭐ Наш Telegram-канал, где мы показываем, как применять ИИ в работе: промты, кейсы, гайды и рабочие схемы. Подписывайтесь → «Промты — и точка».

⭐ Наш Telegram-канал, где мы показываем, как применять ИИ в работе: промты, кейсы, гайды и рабочие схемы. Подписывайтесь → «Промты — и точка».

Комментарии: Veo 3.1 в Gemini теперь позволяет использовать несколько референсов 
⚡ В тренде
Alibaba представила линейку моделей Qwen-Audio-3.0-TTS для синтеза речи. В неё вошли Flash — для озвучки с минимальной задержкой и Plus — с упором на качество генерации. Модели доступны через API Alibaba Cloud Model Studio в регионах Сингапур и Китай (Пекин). Flash стоит $0,15, а Plus — $0,20 за 10 тысяч входных символов. Подробности в материале […]
Instagram* запустил функцию Replace Audio: теперь музыку можно заменить в уже опубликованном посте или карусели. При этом сохраняются лайки, комментарии, репосты и охват. Раньше, чтобы сменить трек, приходилось удалять публикацию и загружать её заново, теряя накопленную вовлечённость. Про обновление рассказывает Postium. Читайте также: Как быстро набрать подписчиков в Instagram* Как поменять трек в опубликованном посте […]
adidas Originals, Эдисон Чен и его бренд CLOT представили новую расцветку кроссовок CLOT Superstar. Модель выпустят в белом, коричневом и оранжевом цветах Unity Orange. Продажи начнутся 25 июля в приложении CONFIRMED, на adidas.com и у отдельных ритейлеров по всему миру. Пара будет стоить $200. Детали в материале Postium. Читайте также: Как работает маркетинг впечатлений? Коллаборация […]
Anthropic добавила в Claude Cowork функцию Record a skill. Она позволяет записать экран во время выполнения задачи и голосом объяснить свои действия — Claude превратит демонстрацию в навык, который можно запускать повторно. Функция доступна в десктопном приложении Claude на тарифах Pro, Max и Team. Запустить её можно из меню «+» в Cowork. Детали в материале […]
Qwen представила Qwen-Image-3.0 — третье поколение модели для генерации и редактирования изображений. Она принимает инструкции объёмом до 4,5 тысячи токенов, создаёт сложные композиции за один запрос и, по заявлению разработчиков, воспроизводит читаемый текст размером от 10 пикселей. Модель доступна в Qwen Studio — в веб-версии, а также в приложениях для iOS, Android, macOS и Windows. […]
Блоги компаний
Новости
Свежие статьи