12 idiomas nativos
Tipografia renderizada como linguagem, não como decoração em forma de caracteres.
O Qwen Image 3.0 Pro da Alibaba renderiza a tipografia como linguagem em uma dúzia de sistemas de escrita, mantendo a legibilidade até em dez pixels em layouts densos.
Abra esta página em um navegador de desktop para começar a criar.
Qwen Image 3.0 Pro é o modelo de imagem da Alibaba, e sua capacidade central é o texto, especificamente texto que não está em inglês.
Peça à maioria dos modelos uma placa em chinês, um rótulo de produto em japonês ou texto de embalagem em coreano, e o resultado será decoração em forma de caracteres: convincente à primeira vista, mas sem sentido para quem sabe ler aquele sistema de escrita. O Qwen Image 3.0 renderiza nativamente em doze idiomas e mais de vinte fontes, mantendo a tipografia legível até em dez pixels. É isso que torna viáveis os layouts com muita informação, em vez de apenas decorativos.
Use Qwen Image 3.0 Pro quando o texto importa. Crie embalagens bilíngues, sinalização regional, imagens de campanha localizadas, layouts em estilo de jornal, mockups de interfaces e infográficos cujas legendas precisam resistir à leitura.

Qwen Image 3.0 Pro é um modelo de geração de imagens com IA desenvolvido pela Alibaba e lançado em julho de 2026. Gera imagens a partir de descrições escritas em estilos fotográficos e ilustrativos, destacando-se em sua categoria pela forma como trata a tipografia.
O modelo foi desenvolvido em torno de três pontos fortes:
A Alibaba também cita a simulação realista de interfaces, como páginas web, jogos e sobreposições de transmissões ao vivo, além de detalhes finos que chegam a fios de cabelo individuais. A janela de 4.500 tokens é cerca de quatro vezes e meia a do antecessor, permitindo seguir uma especificação de layout com várias partes em uma única geração.

Tipografia renderizada como linguagem, não como decoração em forma de caracteres.
Variedade tipográfica suficiente para layouts que precisam de mais de uma voz.
Layouts densos continuam legíveis, em vez de virarem textura.
Cerca de 4,5 vezes a capacidade do antecessor, dimensionada para instruções de layout com várias partes.
Páginas web, jogos e sobreposições de transmissões ao vivo reproduzidos de forma convincente.
1K e 2K, selecionados a cada geração.
Os caracteres chineses, japoneses e coreanos aparecem como linguagem. A maioria dos modelos trata CJK como algo secundário e produz formas que parecem corretas apenas para quem não sabe lê-las.
Composições com dois sistemas de escrita ao mesmo tempo são onde a maioria dos modelos mais falha, pois os dois sistemas têm ritmo, peso e espaçamento diferentes. Este modelo lida com ambos no mesmo quadro.
O limite de legibilidade de textos pequenos separa um layout decorativo de um utilizável. Em dez pixels, páginas de jornal, infográficos densos e mockups de interfaces se tornam viáveis, em vez de apenas aproximados.
Cerca de 4.500 tokens bastam para especificar cada bloco de texto, sua posição e seu tamanho relativo sem precisar encurtar a instrução para caber.
Páginas web, interfaces de aplicativos, telas de jogos e sobreposições de transmissões estão explicitamente no escopo, algo incomum e diretamente útil para imagens de marketing de produtos.
Além da tipografia, o modelo resolve texturas finas, até fios de cabelo individuais, para que um layout com um elemento fotográfico não precise abrir mão desse detalhe.
O trabalho de localização se multiplica. Uma imagem principal vira seis versões para diferentes mercados, cada uma com um texto diferente e precisando de alguém que possa revisá-lo. O Virse mantém essa família reunida. O layout base e todas as variantes de idioma ficam lado a lado no mesmo canvas, a única forma prática de perceber que a quarta versão tem uma quebra de linha incorreta.
Veja todas as versões localizadas de uma vez, em vez de abrir seis arquivos para compará-las.
Coloque o texto aprovado ao lado da imagem para revisar com base na fonte, não na memória.
Alterne entre Qwen Image 3.0 Pro e mais de 30 outros modelos de imagem e vídeo sem sair do canvas nem reescrever o briefing.
Reutilize o mesmo briefing de composição e altere apenas o texto, mantendo o conjunto visualmente consistente entre idiomas.
Layouts frontais de embalagens com nomes de produtos tanto em caracteres latinos quanto em CJK.
Cenas de rua e fachadas cujas placas são lidas corretamente por quem é da região.
Uma imagem principal adaptada ao texto de cada mercado sem refazer o design.
Telas de aplicativos, páginas web e sobreposições com tipografia legível.
Páginas em estilo de jornal e infográficos com legendas pequenas e legíveis.
Imagens que combinam detalhes fotográficos refinados com um título sobre a imagem.
Digite no sistema de escrita que deseja renderizar. Transliterações e descrições não produzirão esse resultado.
Indique cada trecho de texto, sua posição e seu tamanho em relação aos demais.
Faça o rascunho no tamanho menor e gere novamente em 2K quando o texto estiver confirmado.
Legível e correto são coisas diferentes. Peça a um falante nativo que leia o resultado.
Um prompt útil para Qwen Image 3.0 Pro costuma incluir quatro elementos:
Em vez de escrever
A fachada de uma casa de ramen japonesa à noite, com uma placa e uma atmosfera marcante.
Escreva
A fachada estreita de uma casa de ramen à noite. Uma cortina noren horizontal sobre a entrada traz 一番ラーメン em branco sobre índigo profundo. À esquerda, uma placa vertical de madeira traz 営業中 em caracteres pretos feitos a pincel. Luz quente saindo do interior e refletida no pavimento molhado. Fotográfico, visto de frente do outro lado da rua.
Uma lata de chá fotografada de frente contra um fundo claro. A frente traz 明前龍井 em caracteres grandes feitos a pincel, centralizados na metade superior, com "Pre-Qingming Longjing" abaixo em uma fonte latina serifada pequena, com aproximadamente um terço do tamanho. Lata em verde-jade suave, uma linha dourada fina entre as duas linhas de texto, sem outros elementos gráficos. Iluminação suave e uniforme, enquadramento quadrado.
Uma tela de aplicativo móvel vista de frente, preenchendo o quadro. O cabeçalho traz 我的订单 com peso médio. Abaixo, três linhas de lista, cada uma com o nome de um produto à esquerda e um preço à direita, usando algarismos tabulares. Barra de navegação inferior com quatro rótulos: 首页, 分类, 购物车, 我的. Interface plana, um único destaque azul, fundo branco, toda a tipografia nítida e legível.
Um cartaz minimalista de evento em formato vertical. O título traz 静水 em uma fonte sans moderna e pesada, centralizado no terço superior. Abaixo, bem menor: "Slow Water · Photographs by Ana Reyes". Fundo liso cor de areia, uma linha horizontal fina abaixo do título, sem imagens. Margens largas nos quatro lados.
| Dimensão | Qwen Image 3.0 Pro | Ideogram 4.0 |
|---|---|---|
| Ponto forte da tipografia | Sistemas de escrita não latinos e layouts bilíngues | Tipografia latina e estrutura de layout |
| Controlo de posicionamento | Descrito no briefing | Caixas delimitadoras e briefings JSON |
| Texto pequeno | Legível até em 10 pixels | Legível em 2K nativo |
| Janela de briefing | Aproximadamente 4.500 tokens | Campos de prompt estruturados |
| Também se destaca em | Detalhes fotográficos, mockups de interfaces | Logos, cartazes, controle de cores da marca |
| Escolha-o quando | O texto não usa o alfabeto latino | O resultado é um layout com escrita latina |
"Uma placa com o texto 営業中" funciona. "Uma placa dizendo aberto em japonês" não funciona.
Placas, nomes de produtos e títulos são a faixa confiável. Parágrafos ultrapassam o que qualquer modelo de imagem atual consegue sustentar.
"Com um terço do tamanho do título" é uma instrução concreta, ao contrário de "menor". Isso importa ainda mais em layouts bilíngues, nos quais dois sistemas de escrita disputam espaço.
Legibilidade e correção são problemas diferentes. Um leitor identifica os erros que parecem certos para você.
Cole o texto no sistema de escrita necessário, mantenha os trechos curtos e peça a alguém que saiba lê-lo para conferir o resultado antes da publicação.