Как пользоваться Nano Banana: от текстового описания до готовой картинки

От замены фона до кадра из пяти референсов: разбираем работу с Nano Banana по возрастанию сложности, с расходом токенов на каждом шаге и разбором типичных промахов.

· 8 мин чтения

Освоение генератора изображений упирается не в кнопки, а в умение поставить работу словами. Разбор построен по возрастанию сложности: сначала правка одного параметра на готовом снимке, в конце сборка сложного кадра из нескольких источников с прицелом на конкретную площадку. На каждом уровне указана цена попытки и то, на чём обычно срывается результат.

Что нужно, чтобы сделать первую картинку

Нужны браузер, любое фото и пара минут на регистрацию. Установка программ, зарубежная подписка и обходные каналы не потребуются: платформа работает с российских адресов напрямую, интерфейс русскоязычный, оплата идёт картой российского банка. Новичку зачисляется 100 приветственных токенов, поэтому первые пробы ничего не стоят.

Дальше открывается рабочая форма сервиса, и порядок работы в ней укладывается в пять шагов.

  1. Загрузите исходные снимки: за один заход форма принимает до пяти изображений, и каждое работает отдельным референсом.
  2. Напишите постановку задачи: стандартное поле вмещает 2000 знаков, расширенный режим за 20 токенов поднимает лимит до 5000 знаков и до одиннадцати референсов.
  3. Выберите движок: облегчённая вторая версия подходит для проверки идеи, тяжёлая Nano Banana Pro для финального варианта.
  4. Задайте разрешение и пропорции: доступны 0.5K, 1K, 2K и 4K, а также одиннадцать соотношений сторон.
  5. Запустите генерацию и посмотрите, сколько списалось со счёта, чтобы дальше планировать расход по факту.

Уровень первый: поменять один параметр на готовом снимке

Самое надёжное стартовое упражнение звучит скучно и потому получается: взять фотографию предмета и заменить фон на однотонный. Загружается один файл, в запросе называются три опоры: что за объект, куда он попадает, каким становится освещение. Формулировка "поставь этот флакон на светло-серый бесшовный фон, мягкий рассеянный свет сверху, короткая тень под основанием" отрабатывает предсказуемо, а "сделай красиво и дорого" не отрабатывает никогда: оценочные слова не описывают ни один физический признак сцены.

Тот же уровень проходится и без загруженного файла. Если исходника под неё вообще нет, картинка собирается с нуля по одному тексту, и тогда текст запроса остаётся единственным источником: те же три опоры называются словами, а шаг с загрузкой просто пропускается.

На этом уровне достаточно облегчённой модели: 40 токенов в 0.5K и 60 в 1K. Черновик смотрится в маленьком размере, и если композиция устраивает, та же формулировка перезапускается в 2K.

Что вообще делает эта модель

Nano Banana это модель Google, которая редактирует и создаёт изображения по описанию на естественном языке, удерживая узнаваемость исходного объекта. В отличие от генераторов, рисующих сцену с нуля, он принимает загруженную фотографию как основу и меняет в ней только названное: фон, одежду, свет, ракурс подачи предмета. Поэтому типовой сценарий здесь не "придумай картинку", а "возьми мой снимок и доведи его до нужного вида".

Уровень второй: перенести объект в новую сцену

Задача усложняется, когда фон не убирается, а придумывается. Здесь формулировка разрастается: помимо предмета и освещения появляются материалы поверхности, глубина резкости и точка съёмки. Рабочая структура выглядит так: объект, окружение вокруг него, источник и характер света, ракурс камеры, настроение снимка, технические ограничения вроде "без людей в кадре" и "без текста".

Типичная ошибка здесь, перечисление десяти желаний подряд, вразнобой и вперемешку. Движок распределяет внимание по всему запросу, и чем длиннее список равнозначных требований, тем вероятнее потеря части из них. Надёжнее назвать одно главное свойство сцены и два уточняющих, а остальное добрать вторым проходом по уже полученному результату.

Готовые формулировки такого типа собраны в подборке рабочих описаний, их удобно брать каркасом и подставлять своё.

Уровень третий: собрать кадр из нескольких источников

За один заход форма принимает до пяти файлов, и каждый работает отдельным референсом. Смысл в разделении источников по ролям: с первого файла берётся внешность человека, со второго предмет, с третьего интерьер, с четвёртого характер света. В запросе роли проговариваются явно, иначе движок смешает признаки: "лицо с первого изображения, куртка со второго, помещение с третьего".

Когда пяти источников мало, включается расширенный режим за доплату в 20 единиц баланса: он поднимает лимит до одиннадцати референсов и увеличивает длину описания с 2000 до 5000 знаков. Это режим сложных постановочных кадров, а не повседневных правок, и на простом запросе он только удорожает попытку.

Если своими словами это не формулируется, помогает автоматическая сборка описания: встроенный помощник читает загруженный снимок вместе с пожеланием на русском и превращает их в детальный текст за 10 токенов. Устройство кнопки подробно разобрано в материале про генерацию промтов в один клик.

Уровень четвёртый: кадр под конкретный формат публикации

Финальная сложность не в изображении вообще, а в изображении под площадку. Соотношение сторон выбирается из одиннадцати вариантов, и выбор делается до генерации, а не кадрированием после: вертикаль 9:16 идёт в сторис, квадрат в ленту и карточку товара, 16:9 на обложку статьи, вытянутые 4:1 и 8:1 в шапки и баннеры. Разрешение выбирают по назначению: 0.5K на черновую проверку идеи, 1K и 2K в веб, 4K в печать.

Куда публикуется результатСоотношениеРазрешение
Карточка товара на маркетплейсе3:4 или 1:12K
Сторис и вертикальные ролики9:161K или 2K
Обложка статьи в блоге16:91K
Шапка сайта или письма4:1 или 8:12K
Полиграфия и печать1:1 или 3:24K

Сколько токенов уходит на реальную задачу

Считайте не результаты, а попытки: именно они определяют экономику. Одна генерация в тяжёлой Nano Banana Pro стоит 100 токенов в разрешении 1K и 2K, вдвое дороже в 4K. Облегчённая вторая версия берёт 40 токенов в 0.5K, 60 в 1K, 80 в 2K и 150 в 4K. Баланс пополняется пакетами: тысяча за 490 рублей выходит по 49 рублей за штуку, пакет на 3500 за 1400 рублей опускает цену до 40 рублей, крупные объёмы доходят до 35 рублей. Разбивка по пакетам лежит в таблице стоимости генераций.

Отсюда практический вывод по порядку действий: черновики гоняются в облегчённой модели и низком разрешении, а тяжёлая версия включается один раз, когда формулировка уже проверена. Такой порядок снижает итоговую стоимость втрое по сравнению с привычкой сразу генерировать в 4K.

Где генерация срывается чаще всего

  • Исходник снят в темноте или сильно сжат: движок достраивает недостающие детали и меняет фактуру предмета.
  • В запросе нет ни одного физического признака, только оценки вроде "стильно" и "премиально".
  • Запрошены сразу пять правок в одном проходе, часть из них тихо теряется.
  • Нужен длинный текст внутри изображения, у всех генераторов изображений он рассыпается за пределами короткой надписи.
  • Требуется сильный разворот головы относительно снятого ракурса: точного порога у модели нет, но чем дальше новый ракурс от исходного, тем заметнее плывут черты лица.

Как проверить кадр перед публикацией

Мы смотрим готовый файл не целиком, а по четырём зонам, где генераторы ошибаются чаще всего. Границы предмета: не размылся ли контур там, где предмет встречается с новым фоном. Тени: падают ли они в сторону заявленного источника света, ведь рассогласование теней выдаёт подделку с первого взгляда. Отражения на глянце и стекле: на них часто остаются следы прежнего фона. Мелкие повторяющиеся элементы вроде швов, резьбы и решёток: именно там модель уходит в узор, который не встречается в реальности.

Обход занимает полминуты. Нашли промах в одной зоне, не переделывайте всё: верните снимок в работу исходником и назовите только проблемный участок. Одна попытка, и удачная композиция остаётся на месте.

Что делать с готовым кадром дальше

Результат скачивается сразу и уходит в коммерческое применение, отдельная лицензия не нужна: в карточках, в рекламе, в оформлении сайта. Если статики уже мало, тот же снимок отправляется в видеомодель и получает лёгкое движение, длительность до десяти секунд. Механика показана на странице с видеомоделями платформы, а тарификация там считается по секундам, а не по кадрам.

Проверенная формулировка сохраняется как шаблон: объект в ней подменяется, разрешение и формат переключаются вслед за площадкой. После десятка запусков описание перестаёт быть творчеством и превращается в конструктор из готовых блоков.

Что означают термины в интерфейсе

Референс это исходный файл, из которого движок берёт образец внешности, фактуры или освещения, а не готовую подложку под копирование. Промт это текст задачи на естественном языке, и ограничен он лимитом символов, а не числом требований. Соотношение сторон задаёт геометрию холста до запуска: поменять его потом без повторного прогона нельзя. Бесшовный фон это равномерная поверхность, на которой нет стыков, швов и градиентных переходов, обязательный стандарт предметной съёмки на торговых площадках.

Отдельно стоит апскейл, то есть увеличение готового размера постобработкой. Деталей, которых не было в оригинале, он не добавляет и мягкость краёв не лечит, поэтому типографский макет разумнее сразу просчитывать в максимальном качестве, а не растягивать веб-версию до нужного размера.

Частые вопросы

Как начать работу с сервисом

Регистрация занимает пару минут, после неё на баланс падают приветственные единицы, и первая проба выходит бесплатной. Дальше всё происходит в браузере: загружаете фотографию, словами объясняете, что в ней поменять, запускаете. Устанавливать ничего не нужно. Порядок из пяти шагов расписан выше.

Нужен ли VPN для работы с сервисом

Нет. Платформа развёрнута на серверах внутри страны и открывается с российских адресов напрямую, обходные каналы не нужны ни на одном шаге. Оплата проходит картой российского банка, юридическим лицам доступен безналичный расчёт. Подписки как формата у нас нет, поэтому автосписаний после пробного периода не будет.

Какое разрешение выбрать

Отталкивайтесь от площадки назначения. Минимального размера хватает, чтобы проверить идею и композицию, не тратя баланс впустую. Средние форматы закрывают веб, максимальный нужен для печати и больших экранов и стоит дороже прочих. Соответствие площадки и настроек собрано в таблице выше.

Что делать, если результат не тот

Не начинайте с нуля. Верните полученное в работу исходником и назовите только проблемный участок: контур предмета, направление тени, отражение на стекле. Такая точечная доработка стоит одну попытку и сохраняет удачную композицию. Если промах крупный, сократите запрос до одного главного свойства сцены и двух уточняющих.

Поделиться: ВКонтакте Telegram

Попробуйте сами!

Создайте изображение с помощью AI прямо сейчас — это быстро и просто.

Создать изображение
Создать изображение