Как писать промпты для Nano Banana
Nano Banana — это четыре модели Google с разными лимитами. Разбор по шагам: что уходит в параметры, как нумеровать референсы и почему текст просят отдельно.

Промпт для Nano Banana начинается не со слов, а с выбора модели: под этим именем у Google живут четыре разные нейросети, и лимит на референсы у них отличается вдвое. Дальше идёт разделение — что модель возьмёт из текста, а что из параметров запроса. Ниже одна задача проходит весь путь: от «сделай открытку» до промпта, который выдаёт предсказуемый кадр.
Это блог RED AI, сервиса доступа к нейросетям за рубли. Собственных прогонов в тексте нет: разобрано то, что написано в документации Google на 15 августа 2026 года, и то, как устроены рабочие промпты в каталоге шаблонов сервиса. Источник указан сноской рядом с каждым правилом.
Шаг нулевой: выбрать, о какой Nano Banana речь
Google пишет прямо: Nano Banana — это название четырёх разных моделей в Gemini API [1]. Промпт, отлично работающий на одной, на другой упрётся в лимит.
| Модель | Цена за картинку | Объектов с высокой точностью | Персонажей | Стилевых референсов |
|---|---|---|---|---|
| Nano Banana 2 Lite | $0,0336 за 1K [2] | до 14 | — | — |
| Nano Banana 2 | $0,045–$0,151 по разрешению [2] | до 10 | до 4 | — |
| Nano Banana Pro | $0,134 за 1K и 2K, $0,24 за 4K [2] | до 6 | до 5 | до 3 |
| Nano Banana (2.5 Flash) | $0,039 [2] | лучше всего до 3 картинок на входе | — | — |
Таблица читается не сверху вниз, а поперёк. Чем модель дороже, тем меньше объектов она держит с высокой точностью — зато появляются персонажи и стили. Лимит в 14 референсов у самой дешёвой Lite — не признак силы: она не оптимизирована ни под несколько референсов, ни под последовательное редактирование в несколько ходов [1]. Про старшую Nano Banana Google советует переходить на Nano Banana 2 Lite ради качества, скорости и цены [1] — то есть легаси-модель проиграла даже бюджетной.
Практический вывод. Портрет с сохранением лица — Nano Banana 2. Сцена с читаемой надписью или тремя стилевыми образцами — Pro. Простой кадр потоком — Lite.
Шаг первый: вынуть из текста то, что задаётся полями
Первый запрос обычно выглядит так: открытка с моим фото и надписью, вертикальная, в хорошем качестве. Две трети этой фразы модель проигнорирует, потому что формат
и разрешение у Nano Banana — поля aspect_ratio и image_size в response_format [1],
а не слова.
Важная тонкость поведения по умолчанию: модель подгоняет размер выхода под размер входной картинки, а без картинки выдаёт квадрат 1:1 [1]. Загрузили горизонтальный снимок, попросили сторис — получите горизонтальный кадр, и промпт тут ни при чём. Это частный случай более общей проблемы — почему нейросеть выдаёт не тот размер картинки, с которой сталкиваются и другие модели.
Набор форматов у поколений разный, и снова не в пользу старшей модели. У Nano Banana 2 их четырнадцать, включая полосы 8:1 и 1:8 — это 3072×384 на 1K и до 12288×1536 на 4K [1]. У Nano Banana Pro таких полос нет вовсе: список кончается на 21:9 [1]. Шапка сайта или длинный баннер одним куском — задача для младшей модели, не для старшей.
Шаг второй: описать замысел, а не только картинку
Второй заход: вертикальная открытка, человек с фото, крупная надпись сверху. Уже
лучше, но Google просит добавлять то, чего в описании кадра нет, — назначение:
«Create a logo for a high-end, minimalist skincare brand» даст результат лучше, чем
просто «Create a logo» [1]. Модель достраивает недосказанное по смыслу задачи, и слово
«печатная открытка» подтягивает поля, кегль и композицию сильнее, чем ещё три
прилагательных.
Для сложных сцен там же советуют разбивать промпт на шаги: сначала фон, потом предмет на переднем плане, потом деталь сверху [1]. Это особенность именно диалоговой модели: она читает инструкцию как инструкцию, а не как облако тегов.
Отдельная возможность, которой нет у большинства конкурентов: Nano Banana умеет сходить в поиск Google и построить картинку по свежим данным [1] — погодная карта, график, вчерашний матч. Тариф на это отдельный: 5000 бесплатных поисковых запросов в месяц на все модели Gemini 3.x, дальше $14 за тысячу [2].
Шаг третий: пронумеровать референсы словами
Загрузить два фото мало — модели надо сказать, где какое. В каталоге RED AI есть шаблон «Полоска вдвоём», собирающий фотобудочную полоску из двух портретов, и его промпт начинается ровно с этого:
Use the two uploaded photos as identity references: the first photo is person one, the second photo is person two.
Дальше в том же промпте стоит фраза, которая закрывает главный брак парных кадров:
never blend the two people into one — не смешивай двух людей в одного. И в конце
exactly two people and no extra person in any frame. Оба требования появились не
из вредности: два похожих лица модель склонна усреднить, а лишнего человека дорисовать
в кадр «для композиции».
Численный предел тут жёсткий. Nano Banana 2 держит сходство до четырёх персонажей и точность до десяти объектов в одном рабочем процессе [1]. Пятое лицо в кадре — уже лотерея, и никакая формулировка это не чинит.
Для правки одной детали при сохранении остального Google даёт готовый каркас, который
он называет семантической маской: «Using the provided image, change only the
[элемент] to [новое]. Keep everything else in the image exactly the same, preserving
the original style, lighting, and composition» [1]. Слово only тут несущее.
Шаг четвёртый: текст в кадре просят отдельно
Здесь у Nano Banana правило, которого нет ни у кого больше, и оно спрятано в разделе ограничений: когда нужен текст на картинке, Gemini работает лучше, если сначала сгенерировать сам текст, а потом просить изображение с этим текстом [1]. То есть буквы — отдельный ход диалога, а не эпитет внутри описания сцены.
Как это выглядит в живом шаблоне. Открытка «Открытка с надписью»
сделана на Nano Banana Pro, и её промпт разбит на именованные блоки — LAYOUT, TEXT,
SCENE AND SECOND LINE. В блоке раскладки заранее выделено место:
the upper third of the card is deliberately kept as clean empty space reserved for the headline
Пустое место под заголовок просят до самого заголовка. А в блоке текста стоит перечисление того, чем ломается кириллица:
sharp correctly formed letters, correct Russian typography, no quotation marks drawn, no extra words, no duplicated or mirrored letters, no Latin characters, no gibberish
Продублированная буква, зеркальная «Я», внезапная латиница в русском слове — это не
случайные глюки, а типовой брак отрисовки текста, и каждый пункт списка закрывает
один его вид. Тот же приём в шаблоне «Разыскивается»:
слово РАЗЫСКИВАЕТСЯ и строка НАГРАДА 500 РУБЛЕЙ заданы дословно, с пометкой
spelled exactly as given.
Практика каталога добавляет к документации ещё одно правило: надпись в кадре — два-четыре коротких слова крупным кеглем. Длинная строка мелким шрифтом разъезжается у всех моделей семейства, и лечится это перегенерацией, а не переписыванием промпта: текст модель рисует заново каждый раз.
Шаг пятый: править диалогом, а не начинать заново
Nano Banana — не однокадровый генератор, и её сильная сторона в том, что кадр можно дожимать. Google описывает и совсем нетривиальный случай — обход персонажа по кругу: чтобы получить виды с разных сторон, в следующие запросы подкладывают уже сгенерированные картинки [1]. Модель опирается на собственный предыдущий результат как на референс.
У Nano Banana Pro к этому добавлен режим размышления: модель строит промежуточные «мысленные» изображения, уточняет композицию и только потом рисует финал; эти черновики не тарифицируются [1]. Отсюда и разница в ощущении: Pro думает дольше, но с длинной многосоставной инструкцией справляется точнее.
Что не работает и о чём стоит знать заранее
Число картинок не гарантировано. В ограничениях сказано прямо: модель не всегда выдаёт ровно столько изображений, сколько попросили [1]. Просьба «сделай 4 варианта» — пожелание, а не параметр.
Русский поддержан, но списком. Google перечисляет языки, на которых модель работает лучше всего, и ru-RU там есть [1] — наравне с английским, японским, хинди и десятком других. Промпты каталога всё равно написаны по-английски, а кириллица оставлена только там, где она должна попасть в кадр буквами.
Поиск не подставит реальных людей. У Nano Banana 2 заземление на поиске не поддерживает использование настоящих фотографий людей из веб-поиска [1]. Запрос «нарисуй с фотографией такого-то политика из интернета» так не решается.
Звук и видео на вход. Аудио не поддерживается вовсе, видео принимает только Gemini 3.1 Flash Image [1].
Водяной знак. Все сгенерированные изображения несут маркировку SynthID [1] — невидимую глазу, но машиночитаемую. Для площадок, где ИИ-контент помечают или ограничивают, это факт, о котором лучше знать до загрузки.
Ограничения интеграции добавляются к ограничениям модели. В студии RED AI у Nano Banana 2 четырнадцать слотов под исходники, у Pro — восемь, и длина промпта тоже разная: 20 000 символов против 10 000. Это предел конкретного подключения, а не самой модели, и на другой площадке он будет другим.
Где посмотреть, как это выглядит целиком
Промпты, разобранные выше, лежат открытыми: в каталоге шаблонов под каждым примером виден полный текст запроса, соотношение сторон и разрешение, с которым он запускался. Смотреть их полезнее, чем читать про структуру: видно, сколько места занимает описание внешности, где стоят ограничения и как оформлены переменные части.
Сама модель — на странице Nano Banana с выбором поколения и режима: там же переключаются Nano Banana 2, Lite и Pro, а формат и разрешение вынесены в отдельные поля — ровно так, как советует документация.
Как собран материал
Правила и ограничения процитированы по документации Gemini API: разделы генерации изображений и промптинга [1] и цен [2], открытые 15 августа 2026 года. Цены Google указаны за изображение в долларах и меняются без предупреждения — перед расчётом бюджета сверьтесь с источником в сноске рядом с числом.
Примеры промптов — фрагменты действующих шаблонов каталога RED AI, приведённые дословно. Утверждений вида «эта формулировка работает лучше той» в тексте нет: такое проверяется серией прогонов с подсчётом брака, а не чтением документации. Черновик готовился с языковой моделью, цитаты сверены по исходному коду страниц.
Источники
- Google, документация Gemini API, раздел «Image generation».
- Google, документация Gemini API, раздел «Pricing».