Resultado nativo em 4K
Renderize diretamente em 4K, em vez de ampliar depois uma imagem mais pequena.
Gere imagens 4K de nível de estúdio com Nano Banana Pro, combinando várias referências e mantendo personagens, produtos e tipografia consistentes.
Abra esta página em um navegador de desktop para começar a criar.
Nano Banana Pro é o modelo de imagem de topo da Google, criado para entregar imagens que resistem ao escrutínio profissional, em vez de apenas impressionarem à primeira vista.
Em vez de reinterpretar o briefing a cada execução, o modelo mantém o que fixou. Os rostos permanecem o mesmo rosto num conjunto, um produto mantém a sua forma exata e as palavras que escreveu aparecem como palavras, em vez de textura com forma de letras. Uma única geração pode recorrer a várias imagens de referência ao mesmo tempo e manter mais de uma pessoa reconhecível na mesma cena.
Use Nano Banana Pro quando a imagem tem de ser entregue. Crie imagens principais de campanha, maquetes de embalagens, conjuntos de personagens, diagramas anotados, imagens editoriais e fotografias de destaque prontas para impressão com a consistência que um prazo de produção exige.

Nano Banana Pro é um modelo de geração de imagens com IA desenvolvido pela Google DeepMind, lançado como Gemini 3 Pro Image. Gera e edita imagens seguindo instruções detalhadas sobre sujeitos, composição, iluminação, posição da câmara, tipografia e a função de cada referência que fornece.
O modelo assenta em três grandes pontos fortes:
Nano Banana Pro gera nativamente nos níveis 1K, 2K e 4K. Combina várias imagens de entrada numa só passagem e mantém vários sujeitos consistentes numa cena, com testes de terceiros a situar a sua precisão de representação de texto em aproximadamente 94 por cento.

Renderize diretamente em 4K, em vez de ampliar depois uma imagem mais pequena.
Combine sujeitos, produtos, ambientes e estilo de várias fontes numa única geração.
Preserve a identidade de mais de uma pessoa numa única cena.
Recortes quadrados, verticais, horizontais ou largos a partir do mesmo briefing escrito.
Represente títulos, rótulos e passagens longas de forma legível, incluindo composições multilingues.
Ajuste uma região, a iluminação, o foco ou a posição da câmara sem gerar novamente o enquadramento.

A tipografia aparece como linguagem, em vez de decoração, funcionando em cartazes, embalagens, maquetes de interface e sinalética. Passagens longas e composições multilingues são suportadas, eliminando o passo habitual de gerar uma composição em branco e sobrepor-lhe texto manualmente.

Combine várias imagens num único briefing e atribua uma função a cada uma. Uma referência define um rosto, outra uma peça de roupa, outra um ambiente ou uma direção de luz, e o modelo leva todas para o resultado, em vez de as diluir numa média.

Mantenha várias pessoas reconhecíveis dentro de uma cena e ao longo de uma série de gerações. É isto que torna práticos os conjuntos de campanha em que o mesmo modelo tem de aparecer em seis cenários diferentes sem se tornar seis pessoas diferentes.

Altere uma única região, volte a iluminar a cena, mude o foco ou mova a posição da câmara, tudo através de instruções escritas. As partes que não mencionou ficam como estavam, sem necessidade de máscaras ou seleção.

O detalhe fino, o texto pequeno e a textura dos materiais mantêm-se em 4K porque a imagem é renderizada nesse tamanho, em vez de ampliada depois.

Como as legendas surgem legíveis, gráficos, cortes transversais anotados e imagens explicativas tornam-se possíveis, uma categoria que a maioria dos modelos de imagem nem consegue tentar.
Este modelo pede mais entradas do que uma caixa de prompt consegue conter. Um conjunto de referências tem de ser reunido e identificado. Um rosto tem de sobreviver a seis gerações, em vez de uma. Um título tem de ser revisto em tamanho real antes de alguém o aprovar. A Virse dá um lugar a esse trabalho. Referências, versões e fotogramas finalizados ficam juntos numa única tela, para que um conjunto construído ao longo de uma tarde continue a ser um conjunto, em vez de uma pasta de exportações sem relação.
Reúna uma vez os rostos, produtos e painéis de estilo e depois execute todas as gerações da campanha com as mesmas entradas, em vez de as voltar a carregar de cada vez.

Abra a renderização em tamanho real na tela e leia aí o título, em vez de descobrir um caráter deformado depois da exportação.

Alterne entre Nano Banana Pro e mais de 30 outros modelos de imagem e vídeo sem sair da tela nem reescrever o briefing.

Entregue um fotograma 4K finalizado diretamente a Seedance 2.0, Kling 3.0 ou Veo 3.1 como plano inicial ou final.


Crie imagens de destaque com tipografia de marca, modelos consistentes e resolução pronta para impressão.

Coloque nomes de produto, descrições e volumes corretos em embalagens plausíveis numa única passagem.

Gere a mesma pessoa em várias cenas, roupas e ângulos de câmara sem desvios.

Componha imagens e tipografia de título em conjunto, em vez de sobrepor uma à outra.

Produza cortes transversais, gráficos e imagens explicativas com legendas que se leem corretamente.

Volte a iluminar, recomponha ou mude o estilo de uma fotografia existente, preservando exatamente o sujeito.
Importe as fotografias, retratos de personagens, imagens de produto ou painéis de estilo a partir dos quais o modelo deve trabalhar.
Indique o que o modelo deve retirar de cada imagem: o rosto de uma, a paleta de outra.
Descreva o sujeito, o cenário e a iluminação e escreva as palavras exatas que devem aparecer no enquadramento.
Escolha 2K para trabalho de ecrã e apresentação, e 4K quando a imagem será impressa em grande formato ou recortada.
Um prompt útil para Nano Banana Pro costuma incluir seis elementos:
Em vez de escrever
Uma fotografia profissional de produto de um saco de café, alta qualidade, 8k, premiada.
Escreva
Um saco de café preto mate na vertical sobre uma superfície clara de betão, fotografado ligeiramente de cima num ângulo de três quartos. Luz suave de janela pela esquerda com uma sombra visível a cair para a direita. O rótulo diz BLACKWOOD ROASTERS num tipo de letra condensado sem serifa, com 'Origem única — Etiópia' por baixo em letras mais pequenas. Pouca profundidade de campo, fundo a ficar desfocado. Retire a forma do saco da Imagem 1 e a paleta de cores da Imagem 2.
Usando a pessoa da Imagem 1, gere um retrato de estúdio sobre um fundo contínuo cinzento médio. Luz principal a 45 graus à esquerda da câmara com preenchimento suave pela direita. O sujeito olha diretamente para a câmara com uma expressão neutra. Mantenha os traços faciais, o cabelo e o detalhe da pele da referência sem alterações. Altere apenas a iluminação, o fundo e o enquadramento. Fotografado a 85 mm, da cintura para cima, pouca profundidade de campo.
Um frasco cilíndrico de produto de cuidado da pele em vidro fosco com tampa de alumínio escovado, centrado numa superfície quente de arenito. O rótulo frontal diz AURELIA ao meio num tipo serifado espaçado, com "Sérum hidratante · 30ml" por baixo em versaletes. Luz superior difusa, sombra suave concentrada diretamente sob o frasco, paleta suave de areia e creme em toda a imagem. Composição quadrada com espaço generoso acima do frasco para texto posterior.
Um diagrama limpo em corte transversal de um mecanismo de relógio mecânico sobre fundo branco. Identifique cinco componentes com linhas-guia finas e texto curto: mola principal, roda de balanço, escape, trem de engrenagens, rotor. Use uma única cor de realce para as linhas-guia e mantenha todas as legendas no mesmo tipo de letra pequeno sem serifa e de tamanho uniforme. Estilo vetorial plano, sem sombreado nem textura.
| Dimensão | Nano Banana 2 | Nano Banana Pro |
|---|---|---|
| Níveis de resolução | 0.5K, 1K, 2K, 4K | 1K, 2K, 4K |
| Imagens de referência | Lida bem com uma única referência | Combina várias fontes numa única geração |
| Consistência de identidade | Bom para sujeitos individuais | Mantém vários sujeitos ao longo de uma série |
| Representação de texto | Funcional para textos curtos | Passagens longas e composições multilingues, ~94% de precisão |
| Controlo de edição | Ajuste ao nível do prompt | Edições localizadas, nova iluminação, transformações de foco e câmara |
| Mais adequado a | Trabalho em volume e exploração | Materiais finais, impressão e trabalho apresentado ao cliente |
Escreva as palavras exatas que devem aparecer na imagem. Descrever a presença de texto sem o fornecer produz texto de enchimento.
Indicar o contributo de cada imagem produz um resultado diferente de carregar várias e esperar pelo melhor. O modelo segue a atribuição quando a faz.
Com várias pessoas no enquadramento, posicione cada uma em relação à sua referência: "a mulher da Imagem 1 à esquerda, o homem da Imagem 2 atrás dela". A identidade mantém-se muito melhor quando o modelo sabe quem fica onde.
Quando um detalhe está errado, volte a carregar o resultado e indique apenas esse detalhe. Uma edição localizada protege tudo o que já foi aprovado; um prompt reescrito gera novamente o enquadramento inteiro.
Reúna as referências, o briefing e as tentativas anteriores numa única tela e deixe Nano Banana Pro tratar da passagem que tem de ficar certa. Combine várias fontes, mantenha as personagens e a tipografia estáveis e exporte em 4K no mesmo espaço de trabalho.