
Google DeepMind представила Nano Banana 2 Lite — найшвидшу модель зображень
Google DeepMind представила Nano Banana 2 Lite, відому також як Gemini 3.1 Flash-Lite Image — за словами компанії, найшвидшу та найдешевшу модель генерації зображень. Вона доступна в застосунку Gemini, AI Studio, Gemini API та корпоративній платформі.
Google DeepMind представила Nano Banana 2 Lite, відому також як Gemini 3.1 Flash-Lite Image. Лабораторія називає її найшвидшою та найефективнішою моделлю зображень Gemini, створеною для швидкої генерації й редагування за найнижчою ціною. Модель доступна в режимі Flash-Lite застосунку Gemini, у Google AI Studio, через Gemini API та на платформі Gemini Enterprise Agent Platform.
Швидкість, ціна та сталість персонажа
Модель будується навколо трьох тверджень: суттєво зменшена затримка для роботи з ідеями, ціна, достатньо низька, щоб генерувати тисячі зображень за частину вартості важчих продакшн-моделей, і якість, яка, за словами компанії, не втрачає контролю — сталість персонажа, точне редагування та знання про реальний світ. Разом із запуском опубліковано картку моделі та графіки Elo для генерації й редагування зображень, затримки на зображення роздільності 1k та ціни за таке зображення.
Перші користувачі та їхні цифри
Latitude, творці голосової телегри, заявили, що модель видає стабільні якісні зображення 1k приблизно у 2,7 раза швидше за Gemini 3.1 Flash Image і через один API обробляє генерацію з тексту, редагування та композицію з кількох зображень. Manus, за словами його співзасновника, тестує модель для генерації зображень у реальному часі всередині автономних робочих процесів і якість наближається до повної Nano Banana 2. Засновник Locket відзначив сталість персонажа та низьку затримку за ціною, що масштабується на мільйони активних користувачів. На сторінці також показано демо: Space Lift для перевтілення кімнат, візуальне полотно Gridscape, Peek-A-Word для перетворення тексту на зображення та Anywhere — 3D-глобус, що створює персоналізовані листівки.
Відомі обмеження та водяний знак
DeepMind прямо перелічує слабкі місця моделі. Їй усе ще важко даються дрібні обличчя, правильне написання слів і тонкі деталі, а знання про реальний світ хоч і широкі, але не безпомилкові. Перекладений чи локалізований текст може мати граматичні та культурні неточності, а складні редагування — масковане редагування, зміна освітлення з дня на ніч чи поєднання кількох зображень — іноді дають неприродні результати. Зображення супроводжує SynthID — інструмент DeepMind, який вбудовує невидимий цифровий водяний знак, щоб згенеровані ШІ зображення можна було розпізнати.
SiTech — веброзробка з підтримкою AI
Створюємо швидкі та сучасні сайти й інтегруємо AI у бізнес-процеси. Маєте проєкт чи запитання? Із задоволенням допоможемо.