Google представив своє нове рішення в сфері генерації зображень — модель Nano Banana Pro, яка обіцяє значні поліпшення у порівнянні зі своїм попередником. Завдяки вдосконаленій основі на великій мовній моделі Gemini 3, яка була анонсована раніше цього тижня, нова технологія забезпечує високу деталізацію зображень, точність тексту, а також можливість створення контенту в різних стилях та мовах.
Nano Banana Pro
Однією з ключових нововведень Nano Banana Pro є функція пошуку в Інтернеті, що дозволяє, наприклад, не лише створювати візуальні матеріали, але й шукати рецепти чи генерувати швидкі нотатки. Ця модель рішуче орієнтується на фахівців, надаючи їм більше контролю: користувачі можуть налаштовувати кут зйомки, освітлення, глибину різкості, фокус і кольорове оформлення зображень.
У порівнянні з обмеженням попередньої моделі, яка дозволяла генерувати зображення з роздільною здатністю до 1024 x 1024 пікселів, Nano Banana Pro підтримує створення картинок у 2K та 4K якості — це суттєвий крок вперед для професійних користувачів.
Проте не все так однозначно: висока якість породжує й вищі витрати. Наприклад, вартість генерування зображення в 2K становить $0.139, а в 4K — $0.24, що порівняно чимало в порівнянні з $0.039 за зображення у роздільності 1024 пікселі старої версії.
Ще одна особливість нового продукту — можливість поєднувати до 14 об’єктів в одній картинці та зберігати схожість до п’яти осіб. Компанія вже запустила демонстраційний додаток, де користувачі можуть протестувати ці функції на практиці.
Модель Nano Banana Pro почне поступово інтегруватися в існуючі рішення Google для штучного інтелекту. Зокрема, в додатку Gemini нова модель стане базовою для генерації зображень. Користувачі безкоштовного підписного плану отримають можливість генерувати обмежену кількість картинок, після чого система автоматично переключиться на стару модель.
Передплатники Google AI Plus, Pro та Ultra отримають ще більші можливості у створенні зображень, хоча точні ліміти поки не розкриті. Також користувачі з найвищими тарифами зможуть використовувати цю модель в Google Slides і Vids, а також через API Gemini.
Для виявлення та маркування зображень, створених штучним інтелектом, в Gemini також інтегрується технологія SynthID. Користувачі зможуть завантажувати зображення для перевірки, чи були вони згенеровані новими моделями Google.
У розвитку Nano Banana Pro компанія планує включити підтримку C2PA для верифікації вмісту, що підвищить прозорість та достовірність інформації.