O Google lançou o Nano Banana 2.1 em 6 de outubro como modelo de imagem disponível ao público. Desenvolvedores têm agora um ID estável, controles de saída e preços de API publicados. As comparações de qualidade continuam sendo testes do Google.

As notas de lançamento da Gemini API de 6 de outubro marcam o Nano Banana 2.1 como amplamente disponível e nomeiam gemini-nano-banana-2.1 como seu ID estável na API. A empresa o recomenda para novos projetos no lugar do Nano Banana 2, gemini-3.1-flash-image, que foi descontinuado sem data de encerramento anunciada. Para quem avalia o novo modelo, a mudança prática é um caminho documentado de texto ou imagem de referência até uma imagem 1K, 2K ou 4K, com preço publicado e limites explícitos.

A principal mudança

O que mudou: O Google lançou o Nano Banana 2.1 em 6 de outubro de 2026 como modelo de geração de imagens e edição conversacional disponível ao público. Seu cartão do modelo diz que ele se baseia no Gemini 3.6 Flash e lista o app Gemini, AI Studio, Gemini API, Search AI Mode, Ads, Flow e Stitch entre os canais de distribuição.

Como funciona para quem lê: Na API, o desenvolvedor seleciona gemini-nano-banana-2.1 e fornece texto e, se quiser, uma imagem, recebendo saídas de imagem e texto. O guia de geração de imagens documenta até 14 imagens de referência, controles de tamanho e proporção da saída, grounding de pesquisa opcional e três níveis de raciocínio. Também é possível testar o modelo no Google AI Studio ou em outro produto listado; a lista de canais não garante acesso e controles iguais em todas as contas.

Por que isso importa: O preço pago da API para uma imagem padrão 1K é US$ 0,0336, ante US$ 0,067 para o Nano Banana 2 na página de preços do Google. É uma comparação de preço para a saída especificada, não uma comparação medida de qualidade ou latência. A BIG CHANGE consultou a documentação, mas não executou o modelo.

Escolha uma interface e confira o resultado

Para criar ou revisar imagens sem desenvolver integração, o cartão do Google cita o app Gemini e o Flow entre os canais; a página do modelo para desenvolvedores leva diretamente ao Google AI Studio. Antes de definir um fluxo de trabalho, confira disponibilidade e controles na conta pretendida.

Para aplicações, os exemplos atuais usam a Interactions API com o ID estável do modelo. Um prompt de texto pode retornar dados de imagem; uma solicitação de edição adiciona dados de imagem e uma instrução. A página lista texto, imagens, vídeo e PDF como entradas aceitas, e imagem e texto como saídas. Áudio não é aceito. A resposta padrão inclui imagem e texto, enquanto response_format pode solicitar apenas imagens ou definir proporção e tamanho. O padrão é 1K; 2K e 4K também estão disponíveis. Os limites são 131.072 tokens de entrada e 32.768 de saída. A tabela não oferece cache, chamadas de função, saídas estruturadas ou Live API.

Imagens de referência ajudam na edição e composição. Segundo o Google, um fluxo aceita até 14 referências, semelhança de até quatro personagens e fidelidade de até dez objetos. Esses números descrevem entradas e metas, não garantem que tudo permaneça igual. O Google oferece níveis de raciocínio minimal , medium, high e medium como padrão. O guia mostra grounding pelo Google Web Search e um tipo opcional de Image Search; o app precisa configurar a pesquisa. Essa via não permite imagens da web de pessoas reais, segundo o Google.

Antes de adotar, confira se a conta oferece a interface, use o ID e o tipo de entrada documentados e examine a imagem no tamanho em que será exibida. A BIG CHANGE não concluiu essa geração; o artigo organiza a documentação do Google.

Calcule o custo da solicitação

A tabela de preços do Google não oferece nível gratuito de API. As tarifas padrão são US$ 1,50 por milhão de tokens de entrada de texto, imagem ou vídeo; US$ 7,50 por milhão de tokens de saída de texto e raciocínio; e US$ 30 por milhão de tokens de saída de imagem. O Google equivale a imagem a US$ 0,0336 em 1K, US$ 0,0504 em 2K e US$ 0,113 em 4K. Batch custa metade das tarifas por token, com equivalentes de US$ 0,0168, US$ 0,0252 e US$ 0,0567. Grounding de pesquisa compartilha 5.000 solicitações mensais entre modelos Gemini 3.x; depois custa US$ 14 por 1.000 solicitações. Uma solicitação pode disparar várias consultas cobradas. Confira preços atuais e cobrança antes de implantar em alto volume.

Os resultados do Google e as lacunas restantes

O Google relata melhorias de design visual, edição, renderização de texto e consistência em relação a modelos anteriores. No cartão do modelo de outubro de 2026, descreve avaliações humanas lado a lado e uma avaliação automatizada unilateral de factualidade, combinando benchmarks públicos e dados internos. A pontuação de factualidade de infográficos é 0,521 para Nano Banana 2.1 com raciocínio, ante 0,179 para Nano Banana 2. São resultados do Google sob condições escolhidas por ele. A reportagem de lançamento da Decrypt também apontou a falta de testes independentes no lançamento; ela não verifica as pontuações.

O cartão lista texto pequeno borrado, consistência imperfeita de personagens, seguimento parcial de instruções em edições com máscara, confusão entre esquerda e direita e limitações em factualidade e raciocínio espacial. Também alerta para alucinações e solicitações lentas ou com tempo esgotado. Imagens com grounding ainda precisam de checagem factual; imagens de produção devem ser vistas no tamanho de exibição pretendido. Segundo o guia da API, todas incluem a marca-d’água SynthID do Google.

Há uma divergência documental relevante: o cartão descreve janela de contexto de até um milhão de tokens e saída de texto maior, enquanto a página do modelo da API lista 131.072 tokens de entrada e 32.768 de saída. Aqui usamos a especificação explícita da página. O Google deveria conciliar os números; desenvolvedores devem consultar a documentação atual do endpoint e limites da conta.

Fontes e leituras adicionais