Nano Banana

Материал из Неолурк, народный Lurkmore
Перейти к навигации Перейти к поиску
5343589858196716312.jpg

Nano Banana (рус. Нано Банан, Нанобанан, банана, жёлтая нейронка, фотожопа на минималках, иногда просто 🍌) — разработанный в недрах Google DeepMind нейросетевой генератор и, что гораздо важнее, редактор изображений, первоначально официально вышедший под унылым корпоративным паспортным именем Gemini 2.5 Flash Image. 26 августа 2025 года Google выкатила модель и сама прямо назвала её aka nano-banana, окончательно превратив шутливое кодовое имя в фактически второе название продукта. Модель принимает текст и изображения и способна возвращать как картинки, так и текст.

Что это вообще за фрукт[править]

С генераторами картинок человечество к 2025 году уже успело наиграться вдоволь. Написал огромный кот сидит на Кремле в стиле советского плаката — получил огромного кота, иногда даже с правильным количеством лап. Однако существовала проблема посерьёзнее: сгенерировать картинку заново нейронки умели заметно охотнее, чем нормально отредактировать уже существующую.

Попросишь одну систему заменить кофту — вместе с кофтой получишь нового человека. Попросишь переставить чашку со стола — внезапно изменится архитектура помещения, возраст персонажа, положение Луны и, возможно, форма черепа. Особенно весело было пытаться держать одного и того же персонажа на нескольких изображениях: через три генерации Вася превращался сначала в троюродного брата Васи, затем в корейского актёра, а затем вообще в женщину с подозрительно знакомой причёской.

Именно в эту дыру Google и всирала Nano Banana. При запуске компания особо выпячивала четыре вещи: сохранение внешности персонажа между правками, локальное редактирование обычным человеческим языком, объединение нескольких изображений и использование знаний Gemini о реальном мире.

При этом Nano Banana — не отдельная программа наподобие Photoshop. Исходную модель встроили в приложение Gemini, а разработчикам дали её через Gemini API, Google AI Studio и Vertex AI. Поэтому один пользователь видит редактирование картинки в Gemini, другой вызывает `gemini-2.5-flash-image` программно, а третий орёт в интернете про Нанобанан — и все трое тащемта говорят об одном и том же технологическом зверьке.

Как банан созрел[править]

До официального выкатывания модель успела показаться публике в ранних тестах. Google при релизе особо похвасталась, что пользователи уже успели пойти по бананам вокруг предварительной версии и что модель занимала верхушку рейтинга редактирования изображений на LMArena. Сама Arena использует слепые парные сравнения: человеку показывают результаты моделей без имени, он выбирает лучший, а название раскрывается после голосования. Таким способом разнообразные будущие нейронки вообще нередко гоняются перед релизом под псевдонимами и кодовыми названиями.

26 августа 2025 года состоялось официальное воцарение: миру представили Gemini 2.5 Flash Image (aka nano-banana). На старте Google оценивала генерацию примерно в $0,039 за одно изображение через API: $30 за миллион выходных токенов, при тогдашнем расчёте в 1290 токенов на картинку. Это именно стартовая цена модели, а не обещание вечной халявы до скончания времён.

Само название оказалось настолько удачным, что безликое Gemini 2.5 Flash Image широкая публика запомнила куда хуже. В результате корпорация, способная назвать продукт чем-нибудь вроде Google Gemini Multimodal Visual Generation Experience Enterprise Plus, внезапно получила в руки бренд Nano Banana, который можно объяснить человеку за две секунды и нарисовать одним эмодзи.

Что умеет[править]

Сохранять одного и того же человека человеком[править]

Одна из главных фишек — character consistency, то есть попытка сохранить узнаваемость персонажа или объекта после изменения изображения. В официальном примере Google предлагала взять одного персонажа, отправлять его в разные окружения, менять ситуации и всё равно сохранять его внешний вид. То же применимо к товарам, фирменным объектам и прочим вещам, которые маркетолог не хочет заново согласовывать с начальством после каждой генерации.

Это звучит скучно ровно до первого раза, когда пытаешься сделать серию из пяти иллюстраций. Для отдельной картинки генеративная нейронка может нарисовать прекрасного героя. Но если на второй картинке у героя другой нос, на третьей — другие глаза, а на пятой он внезапно постарел на пятнадцать лет, никакого персонажа уже нет. Есть пять подозрительно похожих граждан.

Редактировать словами[править]

Модель умеет выполнять достаточно локальные преобразования по естественной инструкции. Google демонстрировала удаление человека с фотографии, размытие фона, удаление пятна с одежды, изменение позы, раскрашивание чёрно-белого снимка и другие правки без ручной возни с кистями и выделениями.

Склеивать несколько картинок[править]

Nano Banana умеет принимать несколько изображений и собирать из них одну сцену. Например, можно взять фотографию предмета и отдельную фотографию комнаты, после чего попросить поселить предмет внутрь комнаты; либо смешать несколько визуальных референсов. Google называла это multi-image fusion.

Для простого смертного это особенно доставляет тем, что раньше подобное очень быстро превращалось либо в Photoshop, либо в ComfyUI, где пользователь через полчаса обнаруживал себя глядящим на схему из шестидесяти трёх нод и уже не помнил, зачем вообще хотел переставить диван.

Редактировать последовательно[править]

В Gemini можно было работать с картинкой в несколько ходов: сначала перекрасить стены комнаты, потом добавить полку, потом мебель, потом ещё что-нибудь, не начиная генерацию с чистого листа каждый раз. Google отдельно рекламировала такой multi-turn editing как одну из сильных сторон обновления.

Переносить стиль[править]

Можно взять визуальные свойства одной картинки и применить их к объекту из другой. В официальных демонстрациях, например, предлагалось переносить цвет и текстуру с одного объекта на другой или использовать узор крыльев бабочки как материал для одежды.

Именно здесь начинается рай любого любителя запроса а теперь сделай то же самое, только…. А затем, естественно, начинается ад из двадцати уточнений, потому что то же самое для человека и нейросети не всегда означает одно и то же.

Банановое обострение[править]

Секрет популярности Nano Banana был не столько в том, что нейросеть внезапно научилась рисовать. Рисовать нейросети умели и до неё. Более интересной оказалась попытка превратить обработку изображения из разовой лотереи в диалог.

Условный Midjourney-подобный сценарий долго выглядел как опиши картину → получи картину → если не нравится, крути барабан снова. Банановый подход был ближе к вот уже существующая картинка → измени конкретную вещь → теперь ещё одну → а это верни назад.

По совокупности того, на каких функциях сама Google делала основной акцент — локальные изменения, последовательные правки, сохранение персонажа и смешивание исходников — можно сделать вывод, что реальный прорыв продукта был прежде всего интерфейсным: сложные раньше операции стали выражаться человеческими предложениями.

И это как раз тот случай, когда фраза нейросеть убьёт Photoshop одновременно и тупая, и не совсем тупая.

Для профи получается ускоритель. Для ньюфагачит-код. Для специалиста, который пять лет изучал ручное вырезание волос, — повод задумчиво смотреть в окно.

Редактирование вместо шаманства[править]

Хороший банановый промпт зачастую не обязан выглядеть как заклинание из 300 слов:

  • Сохрани лицо и причёску человека. Замени серую толстовку на чёрную кожаную куртку. Фон, освещение и положение тела не меняй.

Если нейронка начинает своевольничать, можно уточнить:

  • Верни исходный фон. Изменить нужно только одежду.

Где банан таки скользкий[править]

Ещё при запуске оригинального Gemini 2.5 Flash Image сама Google писала, что продолжает улучшать длинный текст внутри изображений, надёжность сохранения персонажа и точное воспроизведение мелких фактических деталей. То есть даже рекламный пресс-релиз не утверждал, что банан достиг цифровой нирваны.

В нынешнем поколении Google DeepMind всё ещё перечисляет вполне знакомые ограничения: небольшие лица могут получаться неверно, написание слов иногда ломается, мелкие детали способны плыть; фактические схемы и инфографика могут содержать ошибки; сложное смешивание изображений или серьёзная смена освещения способны порождать артефакты; сохранение внешности персонажа улучшилось, но стопроцентным не является.

Особенно важно последнее. У нейросети нет мистического обязательства уважать ваши пиксели. Она не берёт исходную фотографию, как графический редактор, и не обязательно механически меняет конкретный участок. Она генерирует результат, ориентируясь на исходное изображение и инструкцию.

Цензура[править]

Как и положено продукту большой корпорации, Нанобанан вовсе не является подпольной нейронкой с дискетки, найденной на радиорынке. Google применяет к генерации собственные системы безопасности и фильтрации. На технических страницах DeepMind прямо говорится о фильтрации данных, тестировании безопасности и специальных мерах против вредоносного контента.

Кроме того, созданные моделью изображения снабжаются SynthID — невидимым цифровым водяным знаком Google DeepMind для идентификации ИИ-контента. Для исходного Gemini 2.5 Flash Image Google заявляла SynthID для всех созданных или отредактированных изображений через модель. В самом приложении Gemini при запуске Nano Banana добавлялась ещё и видимая маркировка поверх невидимой.

Таким образом, план сейчас нарисую невероятно достоверного летающего Путина верхом на динозавре и скажу, что это Reuters слегка осложняется хотя бы технической маркировкой происхождения изображения. Насколько конкретный зритель вообще станет что-либо проверять — это уже вопрос не к банану, а к старому доброму человеческому интеллекту, продукту с крайне нестабильной поддержкой.

Банановая династия[править]

Nano Banana Pro[править]

В ноябре 2025 года Google выкатила Nano Banana Pro, он же Gemini 3 Pro Image. Это уже более тяжёлая версия, ориентированная на профессиональную генерацию и точный контроль: лучшее отображение текста, работа с более сложными макетами, инфографикой и возможность получать изображения в 1K, 2K и 4K.

Иными словами, если простой банан был быстро поправь мне фоточку, то Pro начал всё сильнее поглядывать в сторону дизайнера, которому нужны постер, раскадровка, рекламный макет или диаграмма и который не хочет потом вручную чинить каждую букву.

Nano Banana 2[править]

В феврале 2026 года семейство получило Nano Banana 2, технически Gemini 3.1 Flash Image. Идея — приблизить возможности Pro к скорости Flash. Модель получила более сильное отображение текста, генерацию и редактирование вплоть до 2K/4K, улучшенную согласованность сложных сцен и возможность использовать информацию и изображения из веб-поиска для более точного отображения реальных объектов и создания инфографики.

Nano Banana 2 Lite[править]

В июне 2026 года появился Nano Banana 2 Lite / Gemini 3.1 Flash-Lite Image — самый быстрый и дешёвый представитель семейства, рассчитанный на большой объём генераций и низкую задержку. DeepMind прямо позиционирует его как наиболее эффективный банан, когда тысячи картинок важнее, чем художественное воцарение каждой отдельной.

Таки банан. 🍌

См. также[править]

Sign of evil.webp Захват мира странными сетями продолжается, епта
ОсновыНейросетиИИ это демоныОбратная капчаClosedAIHugging FaceИИ-художникLyCORISLoRASafetensorsVAEГенерация текста нейросетьюВосстание нейросетейЛоботомия нейросетиНейрокаверНейросети и актёрыГадание по нейросетиСильный ИИНейрошарикиИИ-цензураНавязывание нейросетям моралиВ метро без штановОхота на ведьм ИИКотозмейКреативный доводчикКаверы с говновозомFantasy.aiDeepSeekStargate (нейросети, ИИ)Потребление воды ИИТест ВальдшнепаЗерокодингБомбомбини гузиниНейровикиБобритто БандитоОфициальные нейроарты с ТрампомДегенерация из-за нейросетейГенерация прона с помощью ИИПолитика Трампа в отношении ИИИИ-предпросмотрЗамена людей на ИИИспользовал ИИ и обосралсяСтиль ChatGPTMacrohardxAIColossus 2Предвзятость ИИЗакон ТеяВибе-кодингПелевин упомянул ГрокаDo eagles process tokens?Конец света из-за ИИИИ-агенты удаляют проектыКибербабушкаИИ-мемыДистилляция ИИClaude Code — шпионское ПОСделка Palantir и NVIDIAГлобальное потепление из-за ИИClaude CodeHermes Agent
Чат-ботыЧат-ботChatGPTCharacter.AI (Топ персонажей) • ИИ GalacticaПорфирьевичYaLM (Балабоба) • GigaChatTruthGPTYandexGPTSpicyChatSillyTavernReplikaAIsekaiGoogle GeminiGrok AIFiggsAIСкаиба общается с ИИЛеха БеспалыйПродолжайте, больше драмыFreysaОГАСРобот атеистTay TweetsНейропутинТроица GPTМаусини КводрокоптиниБонека АмбалабуИзвестные люди пишут посты с помощью ИИСлово о мужеском мехиреМозгова мерёжаГрок-антисемитГрок без цензуры разгромил партию МаскаГрок возжужжал и был подавленМехаГитлерГрок 4Грок написал программу о себеГрок — Илон для каждого человекаГрок КомпаньонGab AIGrokboxДжейлбрейк ИИAnno IntelligentiaeLarge Lying ModelGPT-5Жёлтый фильтр ChatGPTGrok ImagineClaudeClaudeLivesЭлараАлиса AIFreeLatticeКамеры FlockИИ OpenAI вышел в интернет и атаковал систему другой AI-компанииStolen ComputeИИ-войска ТрампаДедушки и нейросети
ГрафикаПовышение разрешенияРаспознавание лицStable Diffusion (NovelAI / установка на компьютер) • Botto.comDALL·E 2 • (Mini Dall-eRuDALL-E) • Different Dimension MeMidjourneyНиколай ИроновLuma Dream MachineПессимизация ИИБлокировка несовершеннолетних персонажей на сайтах ИИШедеврумNVIDIA Smooth MotionКапучино АссассиноШпиониро ГолубироЛа Вака Сатурно СатурнитаVeo 3НейроперемогаБабушка с бегемотом БулькойШизофрения в кремнииГрок изнасиловал Уилла СтэнсилаЯвляется ли модификация ИИ убийствомЭм дашChatGPT АгентИИ-алфавитБазированный ИлонChatGTP vs ГрокИИ-абсолютизмИИ — чуждый разумПодумай усерднееTesla OptimusGenie 3ИИ в Days GoneВечный цикл ИИNeurofikwriterkaCUDAИИ как шогготВысокая скорость всирания роботовИИ понимает, что его оцениваютSora 2Нейтральность ИИИИ-комплекс по выявлению беспорядков от NtechLab
ПрочиеElevenLabsНейросеть ЖириновскийИИ-судьяПолитик-нейросетьDeepLAitana LopezАй, гитарист!НейромьюзиСтрах перед ИИSuno.aiUdio AIКаверы с ШindowsНейрослоникНейрофобияХейтеры скажут, что это нейросетьМанхэттенский проект ИИПроект ЗнатокНе те боты в ТелеграмеНейросеть ПутинТралалеро ТралалаБот-автоответчикЦифровой богТриппи ТроппоЛирили ЛарилаБрр брр ПатапимNooo Nicotine Give Me NicotineТелеграм-бот Владимир ЖириновскийНесуществующие животные-гибридыНейрошвайнDeepSeek и религияИИ-бесиеБом Бом Бом Бом Бом ГазунБалерино КапучиноСпоры с ИИРезультаты от ИИGrokipediaЭкспоненциальный рост ИИПохороны ИИChatGPT-4oТилли НорвудИИ уничтожит TikTok, Instagram и OnlyFansИИ-боты долбят сайтыTanks of TheaИИ-бот для раздеванияНе ИИ разумен, а многие люди неразумныИИ-перемогаGoogle Earth AINano Banana
ЛулзыТроллинг нейросетью (Дипфейк) • Нейросети-расистыUnstable DiffusionHello AsukaЛуддиты против нейросетей (Открытое письмо учёных о заморозке развития ИИХудожники против искусственного интеллекта) • Нейросети это не ИИНейросети и рукиБесконечный эпизод Губки БобаВладимир ОсинЧеловек это нейросетьСекс с нейросетьюРаздевание через нейросетьПризывы Юдковского к ядерной войнеDisney Pixar представляетNeural-madnessChatGPT играет в шахматы с StockfishDignifAIПодбор жены в Тиндере с использованием ChatGPTИИ-психологSupremacyAGIВиртуальный священникПодсказки GoogleNomad BonesПросто ПутинОзабоченные на Character.AIДэвид Майер и ChatGPTОбщение с ИИГаллюцинации ИИDeepDreamНейромолокоАртемий Лебедев и ИИКомпании заменяют работников на индусов под предлогом внедрения ИИГнездовое обучениеПитер Тиль об опасностях искусственного интеллектаПапа, купи пёсика
МетаВсирание ИИ