Google выпустила Nano Banana 2.1 — модель для генерации и редактирования изображений. Она умеет работать с разрешением до 4K и объединять в одном запросе до 14 референсных изображений.
Модель уже появилась в Gemini, Google AI Studio и Gemini API. Google также добавила её в некоторые другие продукты компании, включая Google Search AI Mode, Google Ads, Flow и Stitch. Детали в материале Postium.
Читайте также: 25 нейросетей для генерации изображений
Что умеет нейросеть Nano Banana 2.1
Google улучшила работу модели с текстом внутри изображений, персонажами и объектами. При редактировании Nano Banana 2.1 должна лучше сохранять внешний вид персонажей и предметов между несколькими изменениями.
В одном запросе можно использовать до 14 изображений. Модель поддерживает согласованность до четырёх персонажей и до десяти объектов. Это пригодится, например, когда нужно перенести нескольких героев или предметы из референсов в одну сцену.
Nano Banana 2.1 также умеет использовать поиск Google по веб-страницам и изображениям. Это позволяет учитывать актуальную информацию при выполнении запросов, для которых нужны внешние данные.
Как пользоваться
Зайдите в Gemini, выберите режим «Создание изображений» и модель Gemini 3.6 Flash. Введите запрос и если нужно прикрепите референсы. После нажмите отправить.

Для разработчиков Nano Banana 2.1 доступна через Gemini API под идентификатором gemini-nano-banana-2.1. Модель принимает текст, изображения, видео и PDF, а результатом может быть изображение или текст.
При этом, Google указывает на проблемы с мелким текстом и некоторые ошибки при редактировании. Модель может неправильно сохранить характеристики персонажа или неверно интерпретировать пространственные указания вроде «слева» и «справа».
Итог: Nano Banana 2.1 добавила работу с 14 референсами, генерацию до 4K и более точное редактирование текста, персонажей и объектов.