Controlo de composição por caixas delimitadoras
Posicionamento dos elementos aprendido durante o treino, não aproximado durante a renderização.
Um modelo de base de texto para imagem treinado do zero em torno da composição, com posicionamento por caixas delimitadoras, condicionamento de cor hexadecimal e resultado nativo em 2K.
Abra esta página em um navegador de desktop para começar a criar.
Ideogram 4.0 aborda a tipografia no sentido oposto ao da maioria dos modelos de imagem, e a diferença é arquitetural, não estilística.
Foi treinado com caixas delimitadoras associadas a descrições em linguagem simples, o que significa que aprende onde cada objeto, região de texto e elemento de composição pertence antes de renderizar o que quer que seja. Peça um cartaz de concerto a um modelo fotográfico e geralmente recebe uma fotografia com letras por cima. Peça a este e recebe uma composição: letras dimensionadas em função do espaço que ocupam, imagens dispostas de forma a deixar-lhes lugar e uma hierarquia entre título e texto de apoio.
Use Ideogram 4.0 quando a entrega é uma peça de design. Produza cartazes, logótipos tipográficos, frentes de embalagens, criativos publicitários, gráficos para redes sociais e tudo em que as palavras são o design, em vez de uma etiqueta aplicada a ele.

Ideogram 4.0 é um modelo de base de texto para imagem treinado do zero, com um conjunto de funcionalidades orientado para o trabalho de design, em vez de fotografia.
O modelo assenta em três grandes pontos fortes:
O resultado é 2K nativo, pronto para impressão sem uma passagem separada de ampliação. O posicionamento pode ser indicado em linguagem comum — título no topo, sujeito centrado, logótipo no canto inferior direito — ou especificado com exatidão através de caixas delimitadoras num briefing JSON estruturado, a via fiável quando um elemento tem de ficar numa posição precisa.

Posicionamento dos elementos aprendido durante o treino, não aproximado durante a renderização.
Especifique posições e valores exatos, em vez de os descrever.
Indique uma cor de marca pelo seu valor e obtenha essa cor.
Pronto para impressão sem uma etapa separada de ampliação.
Tipografia de destaque e de apoio em mais de um sistema de escrita.
Um modelo de base criado para este fim, em vez de ajustado posteriormente para ele.

Como o treino associou caixas a descrições, a posição é algo que o modelo compreende, em vez de inferir. Um briefing JSON com caixas delimitadoras coloca um elemento onde indicou, o que distingue gerar um cartaz de o desenhar.

O condicionamento hexadecimal elimina a troca de mensagens em que um designer explica que o azul não é o azul certo. Indique o valor e ele aparece, tornando repetíveis resultados fiéis à campanha num conjunto.

Título, subtítulo e texto de apoio surgem com pesos e tamanhos sensatamente diferentes, em vez de três textos de escala semelhante a disputar a mesma atenção.

A exploração de logótipos em volume é uma das utilizações práticas. O resultado é raster, não vetorial, pelo que uma direção escolhida ainda precisa de ser redesenhada para produção, mas encontrar essa direção é a parte dispendiosa.

O 2K nativo significa que o trabalho de cartazes e embalagens sai do modelo num tamanho utilizável, em vez de precisar de uma passagem de ampliação que suaviza as letras.

A tipografia multilingue permite que uma composição de campanha inclua um segundo sistema de escrita sem que a estrutura à sua volta se desfaça.
O trabalho de composição é comparativo. Ninguém escolhe uma direção de cartaz a partir de uma renderização, nem um logótipo tipográfico a partir de menos de uma dúzia. A Virse dispõe o conjunto inteiro de uma vez. Trinta direções de logótipo ficam numa grelha que pode percorrer, e o briefing JSON que as produziu permanece ao lado dos resultados, pelo que alterar um valor e executar novamente é uma pequena edição, em vez de uma reconstrução.
Gere um leque de direções de composição e avalie-as em conjunto, a única forma de este tipo de decisão realmente acontecer.
Coloque o briefing estruturado ao lado das renderizações, para que alterar uma caixa delimitadora ou um valor hexadecimal seja uma edição no mesmo local.
Alterne entre Ideogram 4.0 e mais de 30 outros modelos de imagem e vídeo sem sair da tela nem reescrever o briefing.
Envie um cartaz aprovado para FLUX Kontext para uma alteração específica ou para um modelo de vídeo como fotograma inicial.

Cartazes de concertos, programas de festivais e anúncios de exposições com uma hierarquia funcional.

Dezenas de direções tipográficas entre as quais escolher antes de se comprometer com uma.

Nome de produto, descrição e volume em tamanhos relativos plausíveis.

Anúncios gráficos criados segundo os valores de cor da marca a partir de um único briefing estruturado.

Cartões de citações, anúncios e publicações de campanha com uma linha de texto.

Composições orientadas pelo título em que a tipografia é o principal elemento visual.
Escreva todas as palavras que devem aparecer entre aspas. O modelo compõe o que fornece e inventa o que não fornece.
Diga qual linha é o título e quanto maior deve ser em relação ao resto.
Descreva as posições em linguagem simples ou especifique caixas delimitadoras e valores hexadecimais num briefing JSON.
Gere várias opções e compare, porque as decisões de composição se tomam olhando para alternativas.
Um prompt útil para Ideogram 4.0 costuma incluir quatro elementos:
Em vez de escrever
Um cartaz apelativo para um concerto de jazz com o nome da banda e a data, boa tipografia.
Escreva
Um cartaz de concerto. O título diz MERIDIAN QUARTET num tipo de letra alto, condensado e sem serifa, disposto em duas linhas e a preencher o terço superior. Por baixo, muito mais pequeno, 'Quinta-feira, 14 de novembro · Union Chapel'. No canto inferior esquerdo, ainda mais pequeno, 'Abertura de portas às 19h'. Fundo azul-marinho profundo, uma forma ocre quente por trás do título, sem fotografia. Margens largas nos quatro lados.
Um cartaz de exposição em formato vertical. O título diz ÁGUA LENTA num tipo de letra geométrico sem serifa de traço grosso, todo em maiúsculas, em duas linhas, ocupando o quarto superior. Por baixo, em versaletes com aproximadamente um quinto do tamanho: "Fotografias de Ana Reyes · 3 de março – 12 de abril". Na margem inferior, no tamanho mais pequeno: "Galeria Corran, Edimburgo". Fundo plano cinzento claro com uma faixa horizontal azul-escura por trás do título. Sem imagens. Margens generosas de todos os lados, todo o texto alinhado à esquerda por uma margem comum.
Um logótipo tipográfico para uma torrefação de café chamada NORTHBOUND. Uma única linha, toda em maiúsculas, um tipo serifado de alto contraste com transições acentuadas entre traços grossos e finos e serifas nítidas ligadas por curvas. Espaçamento apertado entre letras. Preto puro sobre branco, nada mais no enquadramento, sem ícone, sem forma envolvente, sem slogan. Centrado, com espaço igual por cima e por baixo.
Uma composição da frente da embalagem de uma lata de chá em folhas soltas, apresentada em plano, em vez de uma renderização de produto. Centrado e no maior tamanho: ASSAM SEGUNDA COLHEITA. Diretamente por baixo, a metade do tamanho: "Chá preto em folhas soltas". Na margem inferior, pequeno: "100g". Fundo em #B4593C, uma linha fina creme a separar o nome do produto da descrição. Ilustração simples de uma folha de chá em traço acima do nome, sem sombreado.
| Dimensão | Ideogram 4.0 | Nano Banana Pro |
|---|---|---|
| Abordagem à tipografia | Compõe a disposição em torno da tipografia | Representa-a dentro de uma imagem |
| Controlo de posicionamento | Caixas delimitadoras e briefings JSON | Descrito no prompt |
| Controlo da cor | Condicionamento por valores hexadecimais | Descrito no prompt |
| Resultado nativo | 2K, pronto para impressão | Até 4K |
| Entrega mais adequada | Cartazes, logótipos tipográficos, composições | Imagens fotográficas que contêm palavras |
| Tratamento de referências | Orientado para composição | Combinação de várias imagens com funções definidas |
O modelo compõe o texto que fornece e inventa o que não fornece. Forneça-o todo, incluindo as letras pequenas.
"Metade do tamanho do título" é executável. "Mais pequeno" é uma estimativa que o modelo tem de fazer por si.
Nomes de tipos de letra específicos não são fiáveis. Descrever a forma das letras — sem serifa condensada, serifada de alto contraste, grotesca geométrica — é fiável.
As margens e o espaço negativo são metade da composição, e um modelo deixado por sua conta irá preenchê-los.
Escreva as palavras, indique os tamanhos, posicione os blocos e o modelo irá compô-los em vez de os adivinhar.