Google lança Nano Banana 2.1 com nova forma de editar imagens por IA

Nova versão amplia os recursos de geração e edição do Gemini, com suporte a imagens de referência e resolução de até 4K

Nano Banana
Crédito: Anton Vierietin/ Getty Images

Lilian Campos 2 minutos de leitura
Favoritar no Google

O Google apresentou o Nano Banana 2.1, novo modelo de inteligência artificial voltado à geração e edição de imagens. 

A tecnologia permite modificar imagens por meio de comandos de texto e amplia o controle sobre elementos como estilo, composição, personagens e objetos.

Segundo o Google, o modelo é uma atualização do Nano Banana 2 e mantém a proposta de alta eficiência, mas chega com melhorias na qualidade visual, fidelidade aos comandos e consistência durante conversas com várias etapas.

Leia também: Google libera remoção de marca d’água em imagens de IA; saiba como fazer

NANO BANANA 2.1 PERMITE EDITAR IMAGENS POR CONVERSA

Uma das principais características do Nano Banana 2.1 é a edição conversacional. O usuário pode fornecer uma imagem e solicitar alterações por texto, permitindo modificar o resultado progressivamente em vez de precisar recriar a imagem do zero.

O modelo também permite fazer alterações específicas sem perder características importantes da imagem original. Dessa forma, o usuário pode orientar diferentes etapas da edição e manter maior consistência entre os resultados.

Outro destaque é o uso de imagens de referência. O Nano Banana 2.1 consegue combinar até 14 imagens para orientar uma criação, mantendo a aparência de até quatro personagens e características de até dez objetos ao longo do resultado.

IA MELHORA TEXTO E IMAGENS EM ALTA RESOLUÇÃO

O Nano Banana 2.1 também recebeu melhorias na renderização de textos dentro das imagens e na precisão de layouts para infográficos. O modelo trabalha com resoluções de 1K, 2K e 4K, sendo 1K a configuração padrão.

Outro recurso é a capacidade de combinar várias imagens de referência para criar uma nova composição. Dessa forma, diferentes elementos podem ser reunidos em uma única imagem mantendo características importantes dos arquivos utilizados.

O modelo ainda oferece níveis de raciocínio configuráveis, com as opções minimal, medium e high. A documentação também informa que ele aceita entradas em texto, imagem, vídeo e PDF e pode gerar imagens e texto.

Leia também: Nano Banana: 3 truques para criar imagens profissionais com a IA

GOOGLE AMPLIA EDIÇÃO DE IMAGENS NO GEMINI

A tecnologia faz parte da estratégia do Google para transformar o Gemini em uma ferramenta de criação e edição visual. 

O usuário pode enviar uma imagem e pedir alterações no fundo, substituição de objetos ou inclusão de novos elementos, preservando características importantes da imagem original.

O Google também utiliza o SynthID, marca d'água digital invisível, para identificar imagens geradas por suas ferramentas de inteligência artificial. A empresa informa ainda que há uma marca d'água visível nos conteúdos gerados pelo Gemini.

O Nano Banana 2.1 está disponível como modelo estável na API do Gemini, com o identificador gemini-nano-banana-2.1. 


SOBRE A AUTORA

Lilian Campos é jornalista colaboradora da Fast Company Brasil. saiba mais