Nano Banana 2.1: что умеет новая картиночная модель Google и что она показала в наших тестах

В октябре 2026 Google выложила Nano Banana 2.1 - очередное обновление своей модели генерации изображений. Мы прогнали её через пять практических сценариев: афиша с русским текстом, карточка товара, замена фона с сохранением продукта, правка афиши с сохранением центрального объекта и сверхширокая панорама. Рассказываем, что получилось, а что нет - с картинками и без рекламных обещаний.
Что это за модель
Nano Banana 2.1 - модель Google для генерации изображений и редактирования по текстовым инструкциям. Можно создать картинку с нуля или передать исходное изображение и описать изменения.
Что заявляет Google в документации и карточке модели:
- До 14 референсных изображений на вход - можно показать модели продукт с разных ракурсов, персонажей и объекты, которые надо сохранить
- Одновременное удержание до 4 персонажей и 10 объектов в согласованном виде
- Три разрешения на выходе: 1K, 2K и 4K
- Улучшенный рендеринг текста, включая локализацию на нескольких языках
- Режимы thinking (minimal/medium/high) и поиск - модель может «подумать» над промптом перед генерацией
- Исправление артефактов на панорамных изображениях
Источник характеристик: официальная документация Google. Доступность поиска и уровней thinking зависит от интерфейса; в этих тестах мы их отдельно не проверяли.
Как мы тестировали
Сделали пять генераций 7 октября 2026: три картинки с нуля и две правки с одним референсом. Афиша и товарная карточка созданы в 2K, обе правки и панорама в 1K. Исходники не ретушировали. Это небольшая демонстрация, не статистический бенчмарк: сравнения с предыдущими моделями, теста 4K и длинной цепочки правок здесь нет.
Тест 1. Афиша с русским текстом
Первый сценарий - самый больной для любых генераторов картинок: плакат с надписями на русском. Мы попросили вертикальную афишу вымышленного фестиваля электронной музыки «НЕОНОВА НОЧЬ» с датой, городом, подзаголовком и строкой про билеты.

Что получилось честно. Весь текст сгенерировался читаемым, без иллюзорных букв и кириллического мусора. Даты, город и заданный домен читаются. Событие вымышленное; адрес на афише взят из промпта и не является рекомендацией сайта.
Но. Мы сами заложили в промпт название «НЕОНОВА НОЧЬ» - и модель послушно его вывела, хотя по-русски правильно «неоновая». Это не ошибка модели, а ошибка промпта, и она показательна: генератор не редактор, грамотность текста всё ещё ответственность человека. Плюс модель продублировала дату в двух строках просто потому, что обе были в задании.
Вывод по тесту: русский текст большого кегля - рабочий инструмент. Мелкий текст и вычитку промпта - всё ещё зона вашей ответственности.
Промпт для повторения
A vertical concert poster in a bold neo-brutalist style for a fictional electronic music festival "НЕОНОВА НОЧЬ" happening 14 НОЯБРЯ 2026, Клуб ЗАВОД, Санкт-Петербург. Big headline text "НЕОНОВА НОЧЬ" in a bright neon-glow font, subtitle "электронная музыка • 12 диджеев • одна ночь". Bottom of poster: date and city "14 ноября, 20:00 • Санкт-Петербург" and a small line "билеты: neonova.ru". Visual: a glowing neon banana-shaped synth object floating above crowd silhouettes with lasers, deep dark blue background with magenta and cyan neon accents. All text must be in Russian, spelled exactly as given, crisp and legible.
Тест 2. Карточка товара
Второй сценарий - то, за что B2B и малый бизнес реально платит: продуктовая карточка. Чёрный пакет кофе «КОФЕ ЭФИОПИЯ» с подписями «светлая обжарка • 250 г» и слоганом на белом студийном фоне.

Результат - уровень коммерческого макета. Композиция чистая, свет студийный, зёрна разбросаны естественно. Весь русский текст на этикетке читается: и заголовок, и обжарка, и слоган с длинным текстом внизу. Из придирок - слоган «однообразие вкуса - не про нас» выглядит чуть менее контрастно, чем хотелось бы в реальной печати, но это уже вопрос постобработки, а не генерации.
Для маркетплейсов и лендингов такого качества достаточно, чтобы не покупать фотосессию для черновых гипотез. Финальный бренд-слой всё равно лучше сверстать руками поверх.
Промпт для повторения
Clean e-commerce product hero card for a fictional coffee brand. Center: a matte black bag of coffee beans standing on a light beige studio background with soft shadow. Front label text: "КОФЕ ЭФИОПИЯ" as the large title, below it "светлая обжарка • 250 г" and at the bottom "однообразие вкуса — не про нас". A few roasted coffee beans scattered near the bag. Minimalist premium design, studio lighting. All text in Russian, spelled exactly as given, sharp and legible.
Тест 3. Замена фона с сохранением товара
Дальше - редактирование. Мы взяли картинку из второго теста как референс и попросили заменить студийный фон на утреннюю кухню, не трогая сам продукт.

Продукт остался узнаваемым: чёрный пакет, этикетка и надписи сохранены. Но это не пиксельно точный перенос: пропорции и детали складок отличаются, поэтому перед использованием для реального товара нужна сверка с оригиналом. Фон действительно заменился на кухню с окном, солнечным светом, чашкой и растением. Свет на пакете согласован с новой сценой, тень на столе убедительная, глубина резкости правильная - пакет в фокусе, кухня мягко размыта.
Придраться можно к мелочам: нижняя тень чуть тяжеловесна, контур пакета местами подозрительно чистый. Но в целом это готовый рекламный мокап за одну итерацию. Для A/B-тестов визуалов «продукт в разных окружениях» - ровно тот workflow, под который модель и затачивалась: быстрое получение варианта для дальнейшей проверки.
Промпт для повторения
Using the provided image of the coffee bag as the exact same product: keep the product, its label, colors and text completely unchanged. Replace the plain studio background with a cozy morning kitchen scene softly blurred in the background: a wooden table, a window with morning sunlight, a cup of coffee and a small plant. The bag must stay perfectly sharp and identical, realistic photo composite, natural lighting.
Тест 4. Последовательная правка
Самый интересный тест на консистентность: взять афишу из первого теста и попросить изменить сцену, сохранив героя, заголовок и вёрстку, но заменив подзаголовок.

Что сохранилось: заголовок «НЕОНОВА НОЧЬ» в том же неоновом стиле, тот же гибрид банана и синтезатора в той же позиции, общий макет.
Что изменилось: толпа сменилась рассветным городом и двумя людьми на крыше, подзаголовок обновился ровно на заданную фразу «утро после • музыка всё ещё с нами» - слово в слово.
В этом примере модель сохранила узнаваемость центрального объекта и текстовые блоки, хотя детали синтезатора и его размер немного изменились. Это одна правка по референсу, а не проверка идентичности лица или устойчивости персонажа через много итераций.
Промпт для повторения
Using the provided poster as the base: keep the exact same layout, typography style and the same glowing neon banana-synth hero object in the same position, but change the scene from a concert crowd to a quiet afterparty rooftop at dawn: city skyline in soft pink-orange sunrise, the crowd silhouettes replaced by two friends sitting on the rooftop edge. Update the subtitle text to "утро после • музыка всё ещё с нами", keep the big headline "НЕОНОВА НОЧЬ" unchanged. All text in Russian, spelled exactly.
Тест 5. Сверхширокая панорама
Финальный сценарий - панорама футуристического ночного города в соотношении 21:9: террасные холмы, небоскрёбы, стеклянные мосты, световые трассы транспорта и огромная луна.

Центральная часть безупречна: река, мосты и луна собираются в цельную композицию с глубиной, явных вертикальных швов нет. Но по краям честность заканчивается: архитектура заметно зеркалится - похожие башни и эстакады повторяются слева и справа, кое-где здания обрезаны жёстко, в небе болтаются недорисованные конструкции.
Google заявляет исправление артефактов на форматах 1:4, 4:1, 1:8 и 8:1 в 2K/4K. Наш пример сделан в 21:9 и 1K, поэтому подтвердить или опровергнуть это улучшение он не может. Для обложки результат выглядит пригодным; качество бесшовной 360-градусной панорамы мы не проверяли.
Ограничения нашего теста
- Пять результатов не показывают процент удачных генераций на большой выборке.
- Читаемые надписи на двух макетах не гарантируют правильный мелкий текст в других задачах.
- Узнаваемость товара не означает точного сохранения формы, этикетки и всех деталей.
- Мы не проверяли 14 референсов, 4 персонажей, 10 объектов, поиск, 4K и длинную серию правок.
- Скорость и сравнение с Nano Banana 2/Pro в этом прогоне не измеряли.
Генератор воспроизводит и ошибки задания: название «НЕОНОВА НОЧЬ» было в нашем промпте. Перед генерацией афиши стоит отдельно вычитать весь текст.
Кому и зачем
Сценарии, для которых мы бы попробовали Nano Banana 2.1:
- E-commerce: продуктовые карточки и мокапы «товар в окружении» без фотосессии, с сохранением продукта между итерациями
- Маркетинг и ивенты: черновики афиш, баннеров и креативов с локализованным текстом на нескольких языках
- Дизайн-итерации: точечные правки одной картинки вместо пересборки всей сцены
- Концепт-арт: широкие форматные картинки с сильным центром
Без дополнительной проверки мы бы не использовали результат для точного воспроизведения реального товара и финальной типографики для печати.
Итог
Nano Banana 2.1 - не «нейросеть рисует всё» и не революция. В нашей небольшой выборке модель справилась с тремя задачами: русском тексте крупного кегля, редактировании с сохранением объекта и итеративной правке. Пять наших тестов из пяти дали пригодный для работы результат - с оговорками по панораме и с ответственностью за корректность текста на вашей стороне.
А что у вас ломается чаще всего при генерации картинок - текст, консистентность или руки? Напишите в комментариях, какие сценарии проверить следующими.
Все изображения в статье сгенерированы Nano Banana 2.1 в наших тестах 7 октября 2026, без постобработки. Технические характеристики - по официальной документации Google (Gemini API docs).
Частые вопросы
Можно ли писать текст на русском?
Можно ли менять фон по исходному фото?
Поддерживается ли 4K?
Все нейросети в одном месте: текст, картинки, видео и музыка на русском.