Google пусна Nano Banana 2.1
Google представи новата версия на своя модел за генериране и редактиране на изображения Nano Banana 2.1. Обновлението поставя акцент върху по-прецизното редактиране, запазването на обектите и персонажите и по-реалистичните изображения.
По-прецизно редактиране на изображения
Една от основните новости е възможността да се променя само определена част от изображението, без останалата му част да бъде сериозно засегната. Моделът се стреми да запази текстурите, обектите и цялостната композиция при извършване на промени.
Това е особено полезно при последователно редактиране на едно изображение или при създаване на серия от изображения, в които един и същ човек или предмет трябва да изглежда по един и същи начин.
По-добро разпознаване и изобразяване на текст
Nano Banana 2.1 е подобрен и при поставянето на текст в изображения. Моделът може да създава по-прецизни надписи, инфографики, плакати и други визуални материали, при които правилното изписване на текста е важно.
Google е подобрил и способността на модела да се съобразява с физическите особености на реалния свят, което има за цел да направи генерираните изображения по-естествени.
Поддръжка на 1K, 2K и 4K
За разработчиците Nano Banana 2.1 предлага генериране на изображения в 1K, 2K и 4K резолюция. Моделът е достъпен чрез идентификатора gemini-nano-banana-2.1 и може да бъде интегриран в различни приложения.
Освен текст и изображения системата може да обработва и други видове входни данни, включително видео, което разширява възможностите за създаване на мултимедийни приложения.
Къде може да се използва Nano Banana 2.1?
Новият модел започва да се интегрира в различни услуги на Google. Той е достъпен в Gemini, Google AI Studio, Google Search AI Mode, Flow, Stitch и Google Ads. Достъп е предвиден и за корпоративната платформа Gemini Enterprise.
Разработчиците могат да използват модела и чрез Gemini API, което позволява неговото интегриране в собствени приложения и услуги.
Google засилва конкуренцията при AI изображенията
С Nano Banana 2.1 Google продължава да развива технологиите за генериране и редактиране на изображения. Фокусът вече не е само върху създаването на качествена снимка от текстово описание, а и върху възможността изображението да бъде променяно многократно, без да се губят важни детайли.
Подобряването на постоянството на персонажи и предмети, прецизното редактиране на отделни области и по-доброто изобразяване на текст показват накъде се движи конкуренцията между съвременните AI модели.
Бихте ли използвали Nano Banana 2.1 за създаване и редактиране на изображения или предпочитате друг AI инструмент?