A Google lançou o Nano Banana 2.1 a 6 de outubro como modelo de imagem disponível ao público. Os programadores dispõem agora de um ID de modelo estável, controlos de saída e preços publicados da API. As comparações de qualidade continuam a resultar dos testes da Google.
As notas de lançamento da Gemini API de 6 de outubro assinalam a disponibilidade geral do Nano Banana 2.1 e indicam o ID estável da API: gemini-nano-banana-2.1. A empresa recomenda-o para novos projectos em vez do Nano Banana 2, gemini-3.1-flash-image, que foi descontinuado sem uma data de encerramento anunciada. Para decidir se deve adoptar o novo modelo, a mudança prática é um percurso documentado de texto ou imagem de referência até uma imagem 1K, 2K ou 4K, com preço publicado e limites explícitos.
A principal mudança
O que mudou: A Google lançou o Nano Banana 2.1 a 6 de outubro de 2026 como modelo de geração de imagens e edição conversacional disponível ao público. O seu cartão do modelo diz que se baseia no Gemini 3.6 Flash e indica a aplicação Gemini, o AI Studio, a Gemini API, o Search AI Mode, Ads, Flow e Stitch como canais de distribuição.
Como funciona para quem lê: Na API, o programador selecciona gemini-nano-banana-2.1, fornece texto e, opcionalmente, uma imagem, e recebe resultados de imagem e texto. O guia de geração de imagens documenta até 14 imagens de referência, controlos do tamanho e da proporção de saída, grounding de pesquisa opcional e três níveis de raciocínio. Também é possível experimentar o modelo no Google AI Studio ou noutro produto Google indicado; a lista de canais não demonstra que todas as contas tenham o mesmo acesso ou controlos.
Porque é importante: O preço pago da API de uma imagem de saída padrão 1K é 0,0336 dólares, face a 0,067 dólares para o Nano Banana 2 na página de preços da Google. É uma comparação de preços para a saída de API especificada, não uma comparação medida de qualidade de imagem ou latência. A BIG CHANGE consultou a documentação, mas não executou o modelo.
Escolha uma interface e verifique o resultado
Para criar ou rever imagens sem desenvolver uma integração, o cartão do modelo da Google inclui a aplicação Gemini e o Flow entre os canais; a página do modelo para programadores liga directamente ao Google AI Studio. Confirme a disponibilidade e os controlos do produto na conta pretendida antes de definir um fluxo de trabalho.
Para aplicações, os exemplos actuais do guia da API utilizam a Interactions API com o ID estável do modelo. Um pedido de texto pode devolver dados de imagem; um pedido de edição acrescenta dados de imagem e uma instrução. A página do modelo indica texto, imagens, vídeo e PDF como entradas suportadas, e imagem e texto como saídas. A entrada de áudio não é suportada. Segundo o guia, a resposta predefinida inclui imagem e texto, enquanto response_format pode pedir apenas imagens ou especificar a proporção e o tamanho. O tamanho predefinido é 1K; 2K e 4K também estão disponíveis. A página do modelo para programadores indica limites de 131 072 tokens de entrada e 32 768 de saída. A tabela não suporta cache, chamadas de funções, resultados estruturados nem Live API.
As imagens de referência podem ajudar na edição e composição. Segundo a Google, um fluxo aceita até 14 referências, semelhança para até quatro personagens e fidelidade para até dez objectos. Estes números descrevem entradas suportadas e objectivos de concepção; não garantem que todos os elementos permaneçam inalterados. A Google também oferece níveis de raciocínio minimal, medium e high, sendo medium o predefinido. O guia apresenta grounding do Google Web Search e um tipo opcional de Image Search; a aplicação tem de configurar a ferramenta de pesquisa para o pedir. Segundo a Google, esta via de geração de imagens não suporta a utilização de imagens de pessoas reais obtidas através da pesquisa de imagens na Web.
Antes de adoptar o modelo, confirme se a conta pretendida disponibiliza a interface, use o ID do modelo e o tipo de entrada documentados e inspeccione a imagem devolvida no tamanho em que será apresentada. A BIG CHANGE não concluiu essa geração; este artigo resume a documentação da Google.
Calcule o custo do pedido concreto
A tabela de preços da Google não oferece um nível gratuito da API para este modelo. As tarifas padrão são 1,50 dólares por milhão de tokens de entrada de texto, imagem ou vídeo; 7,50 dólares por milhão de tokens de saída de texto e raciocínio; e 30 dólares por milhão de tokens de saída de imagem. A Google traduz a tarifa de imagem em 0,0336 dólares para 1K, 0,0504 para 2K e 0,113 para 4K. As tarifas Batch correspondem a metade das tarifas de tokens, com equivalentes de imagem de 0,0168, 0,0252 e 0,0567 dólares. Os modelos Gemini 3.x partilham uma franquia mensal de 5 000 pedidos de grounding de pesquisa; depois, são cobrados 14 dólares por cada 1 000 pedidos. A Google alerta que um pedido do utilizador pode desencadear várias consultas de pesquisa cobradas. Consulte os preços actuais e a facturação da conta antes de implementar um fluxo de grande volume.
Resultados da Google e limites ainda existentes
A Google relata melhorias no design visual, edição, apresentação de texto e consistência dos elementos face aos modelos anteriores. No cartão do modelo de Outubro de 2026, a empresa descreve avaliações humanas de preferência lado a lado e uma classificação automatizada unilateral de factualidade, combinando benchmarks públicos com conjuntos internos. Na infografia, a pontuação de factualidade do Nano Banana 2.1 com raciocínio é 0,521, contra 0,179 do Nano Banana 2 com raciocínio. São resultados da Google nas condições escolhidas pela empresa. A notícia de lançamento da Decrypt também assinalou a falta de testes independentes no lançamento; não verifica as pontuações.
O próprio cartão do modelo enumera texto pequeno pouco nítido, consistência imperfeita das personagens, cumprimento parcial de instruções em edições com máscara, confusão entre esquerda e direita e limites ainda existentes na factualidade e no raciocínio espacial. Também alerta para alucinações e pedidos ocasionalmente lentos ou expirados. Por isso, as imagens com grounding de pesquisa continuam a precisar de verificação factual, e as imagens de produção devem ser inspeccionadas no tamanho de apresentação previsto. Segundo o guia da API, todas as imagens geradas incluem a marca de água SynthID da Google.
Há uma divergência documental a considerar na integração: o cartão do modelo descreve uma janela de contexto até um milhão de tokens e uma saída de texto maior, enquanto a página do modelo da API indica 131 072 tokens de entrada e 32 768 de saída. Acima foi usada a página do modelo como especificação explícita da API. A Google deve reconciliar os valores; ao dimensionar pedidos, os programadores devem consultar a documentação actual do endpoint e os limites da conta.
Fontes e leituras adicionais
- Google DeepMind: cartão do modelo Nano Banana 2.1 (publicado em Outubro de 2026; índice actualizado a 6 de Outubro). Descreve a base do modelo, distribuição, avaliação da Google e limites conhecidos. Os valores de tokens diferem da página do modelo para programadores.
- Google AI for Developers: página do modelo Nano Banana 2.1 (actualizada a 6 de Outubro de 2026). Apresenta o ID estável da API, modalidades suportadas, limites de tokens, predefinições e capacidades não suportadas.
- Google AI for Developers: guia de geração de imagens (consultado a 7 de Outubro de 2026). Documenta exemplos actuais da Interactions API, imagens de referência, grounding, controlos de saída e limites. Os exemplos descrevem uma interface; a BIG CHANGE não os executou.
- Google AI for Developers: notas de lançamento (entrada de 6 de Outubro de 2026). Confirma a data de disponibilidade geral e a descontinuação do Nano Banana 2 sem data de encerramento anunciada.
- Google AI for Developers: preços da Gemini Developer API (consultado a 7 de Outubro de 2026). Apresenta preços padrão e Batch actuais, equivalentes de imagem e encargos de grounding de pesquisa. Os preços podem mudar.
- Decrypt: notícia sobre o lançamento do Nano Banana 2.1 (6 de Outubro de 2026). Relato independente do contexto de lançamento que refere a ausência de testes independentes na altura; a análise de desempenho baseia-se nos resultados da Google. O preço de 4K difere da tabela oficial actual e não foi utilizado.



