21:11:44
Google выпустила Nano Banana 2.1
Google обновила свою модель для генерации и редактирования изображений. Nano Banana 2.1 построена на Gemini 3.6 Flash и сохраняет Flash‑подход: быстрый инференс при заметно более низкой стоимости по сравнению с Pro‑линейкой. Модель уже появилась в Gemini, AI Studio и Gemini API.

Основной апгрейд — работа с редактированием. В анонсе пишут об улучшении консистентности персонажей и объектов, multi‑image editing, масок и эскизов, а также генерации инфографики. Для последней задачи модель может использовать знания Gemini и данные веб‑поиска, что помогает не только рисовать изображение, но и точнее работать с фактическим содержанием.



Самая приятная плюшка, как по мне — большое контекстное окно. Модель принимает текст и изображения с контекстом до 1 млн токенов. На выходе поддерживается до 4K токенов для изображения и до 64K для текста. При этом в Gemini API опубликованы отдельные лимиты: 131 072 входных и 32 768 выходных токенов.

Для multi‑reference сценариев можно передать до 14 изображений. Google заявляет сохранение консистентности до четырёх персонажей и точности до десяти объектов. Есть генерация в 1K, 2K и 4K, включая широкие и панорамные соотношения сторон.

Отдельно появилась настраиваемая глубина Thinking: minimal, medium и high, причём medium используется по умолчанию.
Просмотров: 13 | Добавил: fludpermru
Всего комментариев: 0
avatar