Google вдосконалює свій чат-бот Gemini, представляючи нову модель AI для обробки зображень, що надає користувачам більший контроль над редагуванням фотографій. Це крок, спрямований на те, щоб зрівнятися з популярними інструментами для зображень від OpenAI і залучити користувачів з ChatGPT.
Оновлення, яке носить назву Gemini 2.5 Flash Image, починає розгортатися з вівторка для всіх користувачів в додатку Gemini, а також для розробників через API Gemini, Google AI Studio і платформу Vertex AI.
Нова модель AI для обробки зображень Gemini розроблена для того, щоб забезпечити більш точні редагування зображень — на основі природних мовних запитів від користувачів, зберігаючи цілісність облич, тварин та інших деталей, що є проблемою для більшості конкурентних інструментів. Наприклад, якщо запитати ChatGPT або Grok від xAI змінити колір сорочки в фотографії, результатом може стати спотворене обличчя або зміна фону.
Новий інструмент від Google вже привернув увагу. Останніми тижнями користувачі соціальних мереж захоплювалися вражаючим AI-редактором зображень на платформі LMArena, де модель з’явилась анонімно під псевдонімом «нано-банан».
Google підтвердив, що стоїть за цією моделлю (якщо це не було очевидно з усіх натяків на банани), яку насправді є вбудованою можливістю для зображень в її основній моделі AI Gemini 2.5 Flash. Компанія стверджує, що модель зображення є найсучаснішою в LMArena та інших бенчмарках.