6 октября 2026 года Google официально выпустил Nano Banana 2.1 — обновлённую версию своей главной модели генерации изображений. Релиз подтверждён сразу в трёх официальных источниках: карточкой модели на сайте Google DeepMind, changelog'ом Gemini API и постом самого Google. Модель уже доступна бесплатно в приложении Gemini для всех пользователей и открыта разработчикам через API. Разбираем по пунктам, что именно изменилось, какие цифры Google приводит в бенчмарках — и отвечаем на главный для нашего блога вопрос: когда Nano Banana 2.1 появится в VibeHype AI.
Коротко: что произошло 6 октября
- Состоялся полноценный релиз (GA) — не preview и не утечка. Модель опубликована под идентификатором gemini-nano-banana-2.1.
- Nano Banana 2.1 — это эволюция Nano Banana 2 (внутреннее имя Gemini 3.1 Flash Image), а не отдельный уровень линейки.
- Nano Banana 2 получит дедлайн: 29 октября 2026 модель gemini-3.1-flash-image отключат, и все мигрируют на 2.1.
- Google заявляет значимые улучшения по четырём направлениям: визуальное качество, следование промпту, консистентность персонажей в многоходовом редактировании и отрисовка текста.
Что такое Nano Banana 2.1 внутри
Согласно официальной карточке модели, Nano Banana 2.1 входит в серию Gemini 3 и построена на базе Gemini 3.6 Flash — той же архитектуры, что и текстовые модели линейки. Это нативно мультимодальная модель с рассуждениями (reasoning): она понимает текст и изображения на входе и генерирует изображение вместе с пояснительным текстом. Контекст на входе — до 1 миллиона токенов.
Важно понимать позиционирование: Google называет 2.1 «более эффективным аналогом» Nano Banana Pro, а не его заменой. Nano Banana Pro (Gemini 3 Pro Image) остаётся вершиной линейки для самых сложных материалов — 4K с максимальной детализацией, сложные композиции, требовательная фактура. 2.1 же — про скорость и разумный баланс качества и стоимости, то есть про то, что называют Flash-классом: быстрые итерации, серийная генерация, повседневное редактирование.
Разрешения и форматы: 1K, 2K, 4K и панорамы
Модель генерирует изображения в трёх разрешениях — 1K, 2K и 4K (по умолчанию 1K). Тир 512px (0.5K), который существовал у Nano Banana 2, из линейки уходит: самых дешёвых «миниатюрных» картинок больше не будет, зато базовое качество выросло.
Главная фишка релиза для дизайнеров — 14 соотношений сторон, включая экстремальные широкоформатные и панорамные: 1:4, 4:1, 1:8 и 8:1. Ранее именно на таких пропорциях генерация чаще всего «ломалась»: появлялись швы, тайлинг, повторяющиеся фрагменты — картина распадалась на склеенные куски. Google прямо заявляет, что артефакты тайлинга на 2K и 4K в этих форматах исправлены. Если вы когда-нибудь пытались получить панораму города или узкий вертикальный баннер без видимых стыков — вы понимаете, насколько это практичная правка.
Референсы: до 14 изображений, 4 персонажа, 10 объектов
Nano Banana 2.1 принимает до 14 референсных изображений в одном запросе. Внутри этого лимита модель держит консистентность до четырёх персонажей (лицо, причёска, одежда между разными картинками и итерациями) и до десяти объектов (товары, предметы, декорации).
Для чего это нужно на практике:
- серия сториз и постов с одним героем, который не «плавит» лицо от кадра к кадру;
- товарные карточки: один продукт — десяток сцен, ракурсов и фонов;
- фото-истории, где несколько персонажей взаимодействуют в разных сценах;
- реконструкции сцены с нескольких ракурсов из набора референсов.
Новые типы входа: видео и PDF
Помимо текста и изображений, модель теперь принимает видео и PDF-документы на вход. Видео можно использовать как источник: вытащить кадр, пересобрать сцену, перенести стиль. PDF — как контекст: например, загрузить бриф, техзадание или презентацию, и попросить проиллюстрировать содержимое. По релизным заметкам лимит входа — 131 072 токена, выхода — 32 768.
Thinking-уровни: low, medium и high
У модели три уровня «размышления» перед генерацией: low, medium и high. Средний уровень — новое: у Nano Banana 2 были только low и high. На low модель отвечает почти мгновенно и подходит для серийной генерации; на high — дольше думает, зато точнее следует сложным инструкциям; medium — компромисс по умолчанию. Для задач с многошаговыми инструкциями и точным текстом стоит пробовать high.
Гейтинг на поиске Google
Модель поддерживает grounding через Google Web Search и — новинка этого релиза — Google Image Search. Это значит, что при генерации модель может опираться на актуальные результаты поиска: факты, события, реальный облик объектов. Важная оговорка от Google: при image search grounding нельзя использовать фотографии реальных людей с веба — ограничение, которое стоит знать всем, кто строит продукты вокруг персоналий.
Цифры: бенчмарки из официальной карточки
Google опубликовал в карточке модели Elo-оценки по методике попарных сравнений (SxS human eval). Цифры — оценка самого Google, независимых бенчмарков на день релиза не существует (в визуальном рейтинге Artificial Analysis записи о 2.1 пока нет), поэтому относимся к ним как к заявлению производителя.
- Общее предпочтение (Overall Preference): 1050 у 2.1 в режиме thinking против 990 у Nano Banana 2 и 935 у Nano Banana Pro.
- Инфографика (дизайн): 1048 против 961 у NB 2 и 912 у Pro.
- Инфографика (фактичность): 0.521 против 0.179 у NB 2 и 0.265 у Pro — почти трёхкратный рост точности подписей и цифр в диаграммах.
- Редактирование (общее): 1026 против 938 у NB 2.
- Консистентность нескольких персонажей: 1106 против 978 у NB 2 — самый большой разрыв во всей таблице, именно там, где у предыдущих версий были главные слабости.
- Стилизация: 1062; маска/чернильное редактирование: 1049; мультиреференс: 1066.
Ключевой вывод из цифр: 2.1 в режиме thinking обходит не только свою предшественницу, но и Nano Banana Pro по большинству редакторских сценариев — при этом оставаясь Flash-классом по скорости. Хотя Pro остаётся государем в сложных 4K-сценах.
SynthID и то, чего в модели нет
Каждая сгенерированная картинка несёт невидимый SynthID-водяной знак Google — стандарт маркировки синтетического контента, который не убирается пересжатием.
Чего модель не умеет (прямо из документации): function calling, кэширование контекста, структурированный вывод, URL-контекст и Live API. Зато поддерживается Batch API — для пакетных задач, например массовой генерации карточек или обложек.
Честные ограничения
Карточка модели прямо перечисляет слабости, и это редкая откровенность:
- мелкий текст часто выходит размытым, особенно в 1K-режиме;
- длинные абзацы текста на изображении — слабое место;
- консистентность персонажей между входными и выходными картинками не всегда идеальна;
- в масочном и doodle-редактировании инструкция выполняется частично, а «чернильные» пометки не всегда сохраняются;
- редко, но случается «залипание» позы: выходное изображение наследует позу субъекта из исходника;
- путаница в пространственных ориентирах (лево/право);
- по-прежнему ограничена в мировых знаниях, 3D-рассуждениях и фактической точности;
- изредка — медленный отклик и таймауты.
Что будет с Nano Banana 2: дедлайн 29 октября
Параллельно с релизом Google объявил депрекацию Nano Banana 2: модель gemini-3.1-flash-image будет отключена 29 октября 2026 года. Миграция заявлена как замена идентификатора один-в-один на gemini-nano-banana-2.1. Линейка чистится решительно: gemini-2.5-flash-image закрыт ещё 2 октября, серия Imagen 4 — 17 августа. Все старые идентификаторы теперь указывают на 2.1.
Когда Nano Banana 2.1 появится в VibeHype AI
Скоро. Мы уже работаем над добавлением модели в каталог VibeHype AI. В личном кабинете уже доступны предыдущие версии семейства — Nano Banana, Nano Banana 2 и Nano Banana Pro — все в одном кабинете, без установки программ и с 3 бесплатными кредитами новым пользователям для первых генераций. Как только 2.1 подключим к конвейеру провайдеров и проверим на наших задачах — анонсируем релиз в блоге и в соцсетях; точные цены в кредитах объявим в момент добавления.
Как подготовиться к переходу: короткий чек-лист
- Пересмотрите промпты под новые возможности. Форматы 1:4/8:1 и видео/PDF-входы — это новые кейсы, которых раньше просто не было.
- Переведите сериальные пайплайны на thinking-medium или high, если вам важна точность текста и следование инструкциям; серийную генерацию оставьте на low.
- Проверьте плейсменты, где критичен мелкий текст — он по-прежнему слабое место, особенно в 1K.
- Планируйте миграцию до 29 октября, если вы используете API напрямую: после этой даты старый идентификатор отвечать перестанет.
- Не рассчитывайте на модель там, где нужна гарантированная консистентность лиц в сложных сценах — это по-прежнему территория Nano Banana Pro.
Следите за нашим блогом: как только Nano Banana 2.1 появится в VibeHype AI, расскажем, чем она отличается на практике от Nano Banana 2 и Pro, и покажем на реальных задачах — от карточек товара до панорамных баннеров.