Блог
Статья30 августа 2026 г.

Как писать промпты для Nano Banana

Nano Banana — это четыре модели Google с разными лимитами. Разбор по шагам: что уходит в параметры, как нумеровать референсы и почему текст просят отдельно.

Как писать промпты для Nano Banana

Промпт для Nano Banana начинается не со слов, а с выбора модели: под этим именем у Google живут четыре разные нейросети, и лимит на референсы у них отличается вдвое. Дальше идёт разделение — что модель возьмёт из текста, а что из параметров запроса. Ниже одна задача проходит весь путь: от «сделай открытку» до промпта, который выдаёт предсказуемый кадр.

Это блог RED AI, сервиса доступа к нейросетям за рубли. Собственных прогонов в тексте нет: разобрано то, что написано в документации Google на 15 августа 2026 года, и то, как устроены рабочие промпты в каталоге шаблонов сервиса. Источник указан сноской рядом с каждым правилом.

Шаг нулевой: выбрать, о какой Nano Banana речь

Google пишет прямо: Nano Banana — это название четырёх разных моделей в Gemini API [1]. Промпт, отлично работающий на одной, на другой упрётся в лимит.

Модель Цена за картинку Объектов с высокой точностью Персонажей Стилевых референсов
Nano Banana 2 Lite $0,0336 за 1K [2] до 14
Nano Banana 2 $0,045–$0,151 по разрешению [2] до 10 до 4
Nano Banana Pro $0,134 за 1K и 2K, $0,24 за 4K [2] до 6 до 5 до 3
Nano Banana (2.5 Flash) $0,039 [2] лучше всего до 3 картинок на входе

Таблица читается не сверху вниз, а поперёк. Чем модель дороже, тем меньше объектов она держит с высокой точностью — зато появляются персонажи и стили. Лимит в 14 референсов у самой дешёвой Lite — не признак силы: она не оптимизирована ни под несколько референсов, ни под последовательное редактирование в несколько ходов [1]. Про старшую Nano Banana Google советует переходить на Nano Banana 2 Lite ради качества, скорости и цены [1] — то есть легаси-модель проиграла даже бюджетной.

Практический вывод. Портрет с сохранением лица — Nano Banana 2. Сцена с читаемой надписью или тремя стилевыми образцами — Pro. Простой кадр потоком — Lite.

Шаг первый: вынуть из текста то, что задаётся полями

Первый запрос обычно выглядит так: открытка с моим фото и надписью, вертикальная, в хорошем качестве. Две трети этой фразы модель проигнорирует, потому что формат и разрешение у Nano Banana — поля aspect_ratio и image_size в response_format [1], а не слова.

Важная тонкость поведения по умолчанию: модель подгоняет размер выхода под размер входной картинки, а без картинки выдаёт квадрат 1:1 [1]. Загрузили горизонтальный снимок, попросили сторис — получите горизонтальный кадр, и промпт тут ни при чём. Это частный случай более общей проблемы — почему нейросеть выдаёт не тот размер картинки, с которой сталкиваются и другие модели.

Набор форматов у поколений разный, и снова не в пользу старшей модели. У Nano Banana 2 их четырнадцать, включая полосы 8:1 и 1:8 — это 3072×384 на 1K и до 12288×1536 на 4K [1]. У Nano Banana Pro таких полос нет вовсе: список кончается на 21:9 [1]. Шапка сайта или длинный баннер одним куском — задача для младшей модели, не для старшей.

Шаг второй: описать замысел, а не только картинку

Второй заход: вертикальная открытка, человек с фото, крупная надпись сверху. Уже лучше, но Google просит добавлять то, чего в описании кадра нет, — назначение: «Create a logo for a high-end, minimalist skincare brand» даст результат лучше, чем просто «Create a logo» [1]. Модель достраивает недосказанное по смыслу задачи, и слово «печатная открытка» подтягивает поля, кегль и композицию сильнее, чем ещё три прилагательных.

Для сложных сцен там же советуют разбивать промпт на шаги: сначала фон, потом предмет на переднем плане, потом деталь сверху [1]. Это особенность именно диалоговой модели: она читает инструкцию как инструкцию, а не как облако тегов.

Отдельная возможность, которой нет у большинства конкурентов: Nano Banana умеет сходить в поиск Google и построить картинку по свежим данным [1] — погодная карта, график, вчерашний матч. Тариф на это отдельный: 5000 бесплатных поисковых запросов в месяц на все модели Gemini 3.x, дальше $14 за тысячу [2].

Шаг третий: пронумеровать референсы словами

Загрузить два фото мало — модели надо сказать, где какое. В каталоге RED AI есть шаблон «Полоска вдвоём», собирающий фотобудочную полоску из двух портретов, и его промпт начинается ровно с этого:

Use the two uploaded photos as identity references: the first photo is person one, the second photo is person two.

Дальше в том же промпте стоит фраза, которая закрывает главный брак парных кадров: never blend the two people into one — не смешивай двух людей в одного. И в конце exactly two people and no extra person in any frame. Оба требования появились не из вредности: два похожих лица модель склонна усреднить, а лишнего человека дорисовать в кадр «для композиции».

Численный предел тут жёсткий. Nano Banana 2 держит сходство до четырёх персонажей и точность до десяти объектов в одном рабочем процессе [1]. Пятое лицо в кадре — уже лотерея, и никакая формулировка это не чинит.

Для правки одной детали при сохранении остального Google даёт готовый каркас, который он называет семантической маской: «Using the provided image, change only the [элемент] to [новое]. Keep everything else in the image exactly the same, preserving the original style, lighting, and composition» [1]. Слово only тут несущее.

Шаг четвёртый: текст в кадре просят отдельно

Здесь у Nano Banana правило, которого нет ни у кого больше, и оно спрятано в разделе ограничений: когда нужен текст на картинке, Gemini работает лучше, если сначала сгенерировать сам текст, а потом просить изображение с этим текстом [1]. То есть буквы — отдельный ход диалога, а не эпитет внутри описания сцены.

Как это выглядит в живом шаблоне. Открытка «Открытка с надписью» сделана на Nano Banana Pro, и её промпт разбит на именованные блоки — LAYOUT, TEXT, SCENE AND SECOND LINE. В блоке раскладки заранее выделено место:

the upper third of the card is deliberately kept as clean empty space reserved for the headline

Пустое место под заголовок просят до самого заголовка. А в блоке текста стоит перечисление того, чем ломается кириллица:

sharp correctly formed letters, correct Russian typography, no quotation marks drawn, no extra words, no duplicated or mirrored letters, no Latin characters, no gibberish

Продублированная буква, зеркальная «Я», внезапная латиница в русском слове — это не случайные глюки, а типовой брак отрисовки текста, и каждый пункт списка закрывает один его вид. Тот же приём в шаблоне «Разыскивается»: слово РАЗЫСКИВАЕТСЯ и строка НАГРАДА 500 РУБЛЕЙ заданы дословно, с пометкой spelled exactly as given.

Практика каталога добавляет к документации ещё одно правило: надпись в кадре — два-четыре коротких слова крупным кеглем. Длинная строка мелким шрифтом разъезжается у всех моделей семейства, и лечится это перегенерацией, а не переписыванием промпта: текст модель рисует заново каждый раз.

Шаг пятый: править диалогом, а не начинать заново

Nano Banana — не однокадровый генератор, и её сильная сторона в том, что кадр можно дожимать. Google описывает и совсем нетривиальный случай — обход персонажа по кругу: чтобы получить виды с разных сторон, в следующие запросы подкладывают уже сгенерированные картинки [1]. Модель опирается на собственный предыдущий результат как на референс.

У Nano Banana Pro к этому добавлен режим размышления: модель строит промежуточные «мысленные» изображения, уточняет композицию и только потом рисует финал; эти черновики не тарифицируются [1]. Отсюда и разница в ощущении: Pro думает дольше, но с длинной многосоставной инструкцией справляется точнее.

Что не работает и о чём стоит знать заранее

Число картинок не гарантировано. В ограничениях сказано прямо: модель не всегда выдаёт ровно столько изображений, сколько попросили [1]. Просьба «сделай 4 варианта» — пожелание, а не параметр.

Русский поддержан, но списком. Google перечисляет языки, на которых модель работает лучше всего, и ru-RU там есть [1] — наравне с английским, японским, хинди и десятком других. Промпты каталога всё равно написаны по-английски, а кириллица оставлена только там, где она должна попасть в кадр буквами.

Поиск не подставит реальных людей. У Nano Banana 2 заземление на поиске не поддерживает использование настоящих фотографий людей из веб-поиска [1]. Запрос «нарисуй с фотографией такого-то политика из интернета» так не решается.

Звук и видео на вход. Аудио не поддерживается вовсе, видео принимает только Gemini 3.1 Flash Image [1].

Водяной знак. Все сгенерированные изображения несут маркировку SynthID [1] — невидимую глазу, но машиночитаемую. Для площадок, где ИИ-контент помечают или ограничивают, это факт, о котором лучше знать до загрузки.

Ограничения интеграции добавляются к ограничениям модели. В студии RED AI у Nano Banana 2 четырнадцать слотов под исходники, у Pro — восемь, и длина промпта тоже разная: 20 000 символов против 10 000. Это предел конкретного подключения, а не самой модели, и на другой площадке он будет другим.

Где посмотреть, как это выглядит целиком

Промпты, разобранные выше, лежат открытыми: в каталоге шаблонов под каждым примером виден полный текст запроса, соотношение сторон и разрешение, с которым он запускался. Смотреть их полезнее, чем читать про структуру: видно, сколько места занимает описание внешности, где стоят ограничения и как оформлены переменные части.

Сама модель — на странице Nano Banana с выбором поколения и режима: там же переключаются Nano Banana 2, Lite и Pro, а формат и разрешение вынесены в отдельные поля — ровно так, как советует документация.

Как собран материал

Правила и ограничения процитированы по документации Gemini API: разделы генерации изображений и промптинга [1] и цен [2], открытые 15 августа 2026 года. Цены Google указаны за изображение в долларах и меняются без предупреждения — перед расчётом бюджета сверьтесь с источником в сноске рядом с числом.

Примеры промптов — фрагменты действующих шаблонов каталога RED AI, приведённые дословно. Утверждений вида «эта формулировка работает лучше той» в тексте нет: такое проверяется серией прогонов с подсчётом брака, а не чтением документации. Черновик готовился с языковой моделью, цитаты сверены по исходному коду страниц.

Источники

  1. Google, документация Gemini API, раздел «Image generation».
  2. Google, документация Gemini API, раздел «Pricing».