Nano Banana 2.1 — модель Google для генерации и редактирования изображений

Nano Banana 2.1 создаёт и редактирует изображения по тексту, фото и видео. Поддерживает вывод до 4K, до 14 референсов и последовательные правки.

Nano Banana 2.1 — модель Google для создания и редактирования изображений по тексту, изображениям и видео. Она подходит для задач, где одной генерации мало: можно дать несколько визуальных примеров, получить результат, а затем уточнять его в диалоге. В Google AI Studio модель доступна под идентификатором gemini-nano-banana-2.1.

Google описывает Nano Banana 2.1 как обновление Nano Banana 2 (Gemini 3.1 Flash Image): модель сохраняет высокую скорость семейства Flash и улучшает следование запросу, визуальную точность, работу с надписями и постоянство персонажей между правками. По позиционированию это более быстрый и экономичный вариант, чем Nano Banana Pro; для более лёгких и массовых задач в семействе также есть Nano Banana 2 Lite.

Что умеет Nano Banana 2.1

Модель создаёт изображение с нуля, редактирует загруженную картинку и позволяет продолжать работу в несколько шагов. Вместо повторного описания всей сцены можно попросить изменить фон, одежду, освещение, композицию или отдельный объект, сохранив остальную часть изображения.

Несколько референсов и сохранение деталей

В одном запросе можно использовать до 14 изображений. Это удобно, например, когда нужно объединить товар, персонажа и несколько примеров оформления. Модель рассчитана на сохранение сходства до четырёх персонажей и визуальной точности до десяти объектов в последовательности изображений. Такой режим полезен для раскадровок, рекламных серий и каталогов, где важно, чтобы герой или продукт не менялся от кадра к кадру.

Надписи, схемы и широкие форматы

Google отдельно улучшила генерацию текста и компоновку инфографики. Nano Banana 2.1 может создавать макеты меню, диаграмм, карточек и рекламных изображений с надписями. Текст на готовом изображении всё равно следует вычитать перед публикацией: генератор может ошибиться в буквах, цифрах и мелких деталях.

Доступны изображения размером 1K, 2K и 4K; по умолчанию выбирается 1K. Поддерживаются обычные вертикальные и горизонтальные пропорции, а также вытянутые панорамы вплоть до 1:8 и 8:1. В версии 2.1 Google также заявляет об исправлении плиточных артефактов на широких форматах при выводе в 2K и 4K.

Работа с видео и поиском

Видео можно передать как исходный материал: модель анализирует его визуальный контекст и создаёт на его основе отдельное изображение — например, обложку, постер или инфографику. Nano Banana 2.1 не генерирует видеоролик на выходе.

При включённой привязке к поиску Google модель может использовать веб-поиск и поиск изображений, чтобы учитывать актуальные сведения и визуальные ориентиры. Это помогает создавать изображения, связанные с недавними событиями или меняющейся информацией, но не заменяет проверку фактов перед публикацией.

Где использовать модель

Попробовать Nano Banana 2.1 можно в Google AI Studio. Для приложений и автоматизированных процессов модель вызывается через Gemini API по идентификатору gemini-nano-banana-2.1; она также доступна в Google Cloud Agent Platform. Облачная платформа поддерживает стандартную оплату по использованию и пакетную обработку.

В API можно выбрать уровень вычислительной «проработки» изображения: minimal, medium или high. Средний уровень используется по умолчанию. Более высокий может быть полезен для сложной композиции, а минимальный — когда важнее сократить задержку.

Стоимость через Google Cloud

В стандартном тарифе Google Cloud стоимость выходного изображения составляет примерно $0,034 для 1K, $0,05 для 2K и $0,113 для 4K. Это расчёт только за изображение: текстовые и видеоданные в запросе учитываются отдельно, поэтому итог зависит от состава и объёма входных материалов. Условия доступа и цены в пользовательских продуктах Google могут отличаться от тарифа API.

Для каких задач подойдёт Nano Banana 2.1

  • создание рекламных макетов, обложек, иллюстраций и инфографики;
  • редактирование изображения по коротким уточнениям в диалоге;
  • объединение нескольких референсов в один визуал;
  • подготовка серии изображений с одинаковыми персонажами и предметами;
  • создание иллюстрации или обложки на основе загруженного видео;
  • автоматическая генерация изображений в приложениях через API.

Nano Banana 2.1 выпущена как стабильная модель 6 октября 2026 года. Её главная роль в линейке — сочетать скорость и стоимость Nano Banana 2 с более точным редактированием и улучшенным рендерингом текста. Другие модели Google для изображений собраны на странице Google DeepMind.