Gerador de Imagens com IA Qwen Image 3

O Qwen Image 3 é o modelo-ferramenta-de-trabalho da Alibaba: menus, cartazes e documentos em que o texto dentro da imagem tem de estar bem escrito.

0 / 2,000
~20 cr

O que é o Qwen Image 3?

O Qwen Image 3 é o nível padrão da família de imagem de 2026 da Alibaba, lançado a 21 de julho de 2026 e apenas por API — ao contrário das versões anteriores do Qwen-Image, não há pesos publicados nem relatório técnico. A Alibaba apresenta-o como ferramenta de trabalho e não como brinquedo artístico, e a força em que os analistas insistem é o texto dentro da imagem: a Eden AI deu 8,5/10 à sua renderização de texto, e os nossos cinco testes de texto abaixo voltaram todos corretamente escritos à primeira tentativa.

Não é o modelo para tudo. O nosso teste de gráfico reproduziu a falha que os testadores independentes encontraram: os números são impressos corretamente, mas o eixo está fora de ordem, as barras não são proporcionais aos seus valores e inventou uma citação para dados que fomos nós a inventar. Os analistas documentaram também palavras escritas com erros em coreano — pelo que a alegação multilingue é na verdade uma alegação sobre CJK e inglês — e erros ocasionais de anatomia nas figuras.

Os detalhes do lançamento e o posicionamento vêm de cobertura independente do lançamento: Unite.AI — Alibaba launches Qwen Image 3 without benchmarks or weights

O que dizem os avaliadores

O modelo consegue escrever texto legível dentro das imagens geradas… pontua 8,5/10 na renderização de texto, superando o DALL-E 3 (7,0) e o SD 3.5 (6,5).
Eden AI — model comparison
A maior melhoria é compreender instruções longas e detalhadas, produzindo ao mesmo tempo imagens muito exatas com texto legível.
Mehul Gupta — Data Science in Your Pocket
Um equivalente abaixo da média face a outros modelos proprietários como o GPT Image 2 e o Nano Banana Pro.
BuildFastWithAI — hands-on review

Todas as imagens abaixo foram geradas nesta página a 19 de agosto de 2026, com o prompt exato indicado — incluindo o teste de gráfico que falhou. Nada foi retocado nem escolhido de um lote.

Menus, cartazes e listas de preços que voltam corretamente escritos

Este é o terreno de eleição do modelo. Demos-lhe um menu impresso de restaurante com três secções e sete preços em corpo pequeno, um cartaz de evento com um título, uma linha de horário e um rodapé pequeno, e um cartaz de livraria com um título vertical em chinês sobre um subtítulo em inglês. Tudo voltou corretamente escrito e corretamente composto — incluindo coisas que nunca pedimos: o menu ganhou um plausível «Est. 1952» e o cartaz uma barra lateral inteira de etiquetas extra, tudo bem escrito, porque a reescrita automática de prompts está ligada por predefinição e enriquece briefings curtos. Se quer apenas o seu texto e mais nada, diga-o no prompt.

Menu — todos os preços corretos
Menu de restaurante do Qwen Image 3 para The Bluebird Diner com secções de pequeno-almoço, almoço e bebidas, todos os preços legíveis e corretos2K · 2:3 · 113s
Inglês — correto
Cartaz de evento Harvest Market do Qwen Image 3 com título, linha de horário e rodapé todos corretamente escritos2K · 3:4 · 105s
Chinês — correto
Cartaz de livraria chinesa do Qwen Image 3 com o título vertical 夜航书局 e o subtítulo em inglês renderizados corretamente2K · 2:3 · 95s

O teste não é o título — títulos são fáceis. É o 7.50 e o 6.80 aguentarem-se no tamanho de item de menu, e as duas escritas aterrarem no mesmo espaço de trabalho. Uma ressalva do mesmo lote: o modelo acrescenta alegremente conteúdo bem escrito que não pediu, por isso dê-lhe um briefing apertado quando o layout é fixo.

Anexe uma foto, mantenha o rótulo, mude o mundo à sua volta

O mesmo modelo edita. Gerámos uma fotografia de produto de uma lata de chá com rótulo, devolvemo-la como referência e pedimos a mesma lata num mercado de inverno ao ar livre, ao anoitecer. A lata, a sua forma, a sua cor e as duas linhas do rótulo sobreviveram à mudança; a iluminação foi reconstruída para a nova cena, até um reflexo quente no metal contra a luz azul e fria da neve. Até 3 imagens de referência por execução — suficiente para trabalho de produto em cena, não para as composições com muitas referências para que os canais Nano Banana foram feitos.

Prompt

Studio product photograph of a matte sage-green tea caddy on pale travertine, its label reading 'KIYOMI' in a fine serif with a smaller line 'ceremonial grade matcha · 40g' beneath, soft directional daylight from the right, one clean specular edge highlight, shallow depth of field, e-commerce hero framing.

Fotografia de produto de estúdio do Qwen Image 3 de uma lata de chá verde-sálvia com o rótulo KIYOMI ceremonial grade matcha 40g
2K · 1:1 · 101s

Keep the same sage-green tea caddy from the reference image exactly as it is — same label text 'KIYOMI', same shape and colour — but place it on a weathered wooden stall at an outdoor winter market at dusk, light snow falling, warm string lights bokeh behind, cold blue ambient light with one warm highlight on the tin.

Resultado editado do Qwen Image 3: a mesma lata de chá numa banca de mercado ao anoitecer com neve a cair, com o rótulo ainda a ler KIYOMI
2K · 1:1 · 79s · 1 imagem de referência

Um reparo honesto do passo 1: o texto do rótulo está correto, mas a hierarquia das linhas mudou — «ceremonial» subiu para junto do nome da marca em vez de encabeçar a segunda linha. A edição preservou depois esse layout fielmente, quebra de linha errada incluída.

A particularidade do preço: 2K custa exatamente o que custa 1K

É aqui que o nível padrão difere genuinamente do seu irmão Pro. No Qwen Image 3 Pro, 2K custa mais do que 1K; aqui têm preço idêntico, por isso esta página assume 2K por predefinição e a única coisa que 1K lhe dá é um ciclo mais rápido. Corremos a mesma macro de máquina de escrever nos dois níveis: 57 segundos em 1K, 84 em 2K, com cerca de quatro vezes mais píxeis em 2K. Itere em 1K se tiver pressa; passe a 2K para tudo o que guardar.

1K
Macro de teclas de máquina de escrever antiga gerada em 1K em 57 segundos1216×832 · 57s
2K
O mesmo prompt de teclas de máquina de escrever gerado em 2K em 84 segundos2496×1664 · 84s

O mesmo prompt, as mesmas definições, só mudou o nível de resolução. O custo é o mesmo de qualquer forma — que é a questão toda deste modelo, e a razão pela qual 2K é a predefinição aqui.

O teste do gráfico — onde deixamos de confiar nele

Testadores independentes relataram que os seus gráficos de dados parecem certos e estão errados, por isso fizemos o nosso: um gráfico de cinco barras com valores fornecidos por nós. Todas as etiquetas e todos os números foram impressos corretamente — e a geometria por baixo deles está partida. O eixo repete um valor e coloca outro fora de ordem, a barra mais alta fica abaixo de onde o valor impresso diz que deveria estar, e o rodapé atribui a fonte a um «Global Coffee Report 2025» que não existe, para dados que inventámos. Trate-o como tipógrafo, não como analista: vai compor o título do seu gráfico lindamente, mas construa gráficos a sério numa ferramenta de gráficos.

Falhou — eixo e proporções errados
Infográfico de colheita de café do Qwen Image 3: os valores 3.7, 1.8, 0.8, 0.7 e 0.5 todos impressos corretamente, mas o eixo y repete 1.5, desordena 2.0 e 2.5, e as alturas das barras não correspondem aos números2K · 3:4 · 118s

Olhe com atenção para o eixo da esquerda: 1.5 aparece duas vezes e 2.0 está acima de 2.5. O prompt pedia barras «estritamente proporcionais» aos seus números; não estão. Uma página que só publicasse os sucessos não lhe diria isto.

O resto do que executámos

Os grupos acima testam alegações específicas; estas quatro são a verificação de amplitude do mesmo lote de 19 de agosto de 2026, cada uma à primeira tentativa com o prompt exato. Nas 14 execuções concluídas, as gerações em 2K demoraram entre 64 e 118 segundos, com uma mediana de 84. Uma submissão falhou no fornecedor a montante antes de gerar; repeti-la sem alterações resultou em 75 segundos — essa imagem repetida é o tabuleiro de pequeno-almoço abaixo.

Panorâmica ultralarga 21:9 do Qwen Image 3 de uma vila piscatória às primeiras luzes, com barcos de pesca e névoa
Prompt2K · 21:9 · 3072×1312 · 93s — acrescentou uma pequena placa no porto que nunca pedimos, corretamente escrita

Ultra-wide cinematic frame: a small harbor town at first light, fishing boats resting on glassy water in the lower third, strings of unlit bulbs sagging between mooring posts, mist rolling off the headland behind, soft peach-and-slate palette, anamorphic depth, fine detail across the full width.

Retrato documental do Qwen Image 3 de um pescador idoso a remendar uma rede verde ao amanhecer, com textura de pele detalhada
Prompt2K · 2:3 · 75s — as mãos e o rosto voltaram corretos nesta execução, ainda que os analistas relatem falhas de anatomia

Documentary portrait of an elderly fisherman mending a green net at dawn, weathered hands and deeply lined face clearly rendered, salt-and-pepper stubble, warm low sun from the left against a cold overcast sea, realistic skin texture without smoothing, shallow depth of field.

Fotografia de cima do Qwen Image 3 de um tabuleiro de pequeno-almoço chinês com congee, youtiao, pickles e leite de soja
Prompt2K · 3:2 · 75s — a execução repetida; a primeira submissão falhou a montante sem gerar

Overhead editorial food photograph of a lacquered tray breakfast: a bowl of congee with scallions and white pepper, a plate of golden youtiao, pickled radish in a small dish and a glass of soy milk, steam rising, warm morning window light, rich texture in the ceramics and wood.

Ilustração isométrica do Qwen Image 3 de uma rua de mercado noturno com bancas iluminadas e fios de lanternas
Prompt2K · 1:1 · 75s

Isometric illustration of a small night market street: glowing food stalls with striped canopies, tiny figures queueing, lanterns strung overhead, steam and smoke drifting up, warm oranges against deep blue night, clean vector-adjacent rendering with soft gradients, no text on any sign.

Para quem é o Qwen Image 3

O nível padrão é o cavalo de batalha para volume do par Qwen. Cada um destes corresponde a algo demonstrado mais acima na página.

  • Cafés, restaurantes e negócios locais

    Menus, quadros de preços e panfletos de eventos em que todos os preços têm de estar certos à primeira tentativa. O nosso teste de menu com sete preços é exatamente este trabalho, e passou.

  • Profissionais de marketing a trabalhar em inglês e chinês

    Um único espaço de trabalho para as duas escritas — o nosso cartaz de livraria compôs um título vertical em chinês e um subtítulo em inglês no mesmo enquadramento, ambos corretos. Reveja qualquer escrita que não saiba ler; os analistas apanharam erros em coreano.

  • Quem itera em volume

    Um preço fixo seja qual for a resolução, por isso explorar dez direções custa o que custa — sem aritmética de níveis. Rascunhe em 1K por velocidade, se quiser, e guarde os finais em 2K sem pagar mais.

  • Equipas de produto que reaproveitam fotografias existentes

    Anexe até 3 referências e mova um produto para uma cena nova com o texto do rótulo intacto, como na nossa edição do mercado de inverno. Para composições com muitas referências, use antes um canal Nano Banana.

  • Não serve para: gráficos com dados reais

    O nosso teste de gráfico imprimiu os números certos sobre geometria partida e inventou uma fonte. Componha dados reais numa ferramenta de gráficos e depois deixe este modelo fazer o cartaz à volta deles.

Qwen Image 3 vs Qwen Image 3 Pro vs GPT Image 2 vs Z Image Turbo

Os três modelos que realisticamente pesaria contra este — mesmo espaço de trabalho, mesma subscrição, um clique para trocar.

Qwen Image 3Qwen Image 3 ProGPT Image 2Z Image Turbo
Créditos por imagem20, fixo — 1K e 2K idênticos30 em 1K · 50 em 2K5 – 560, consoante as definições0 — gratuito
O custo muda com a resoluçãoNãoSim — 2K custa maisSim — 1K/2K/4K × low/medium/highSem níveis de resolução
Resolução máxima2K2K4KPredefinições de classe 1K
Imagens de referênciaAté 3Até 3Até 16Nenhuma — apenas texto-para-imagem
Proporções8, até 21:98, até 21:98 mais automático, até 21:99, até 2:1 e 1:2
Imagens por execução11Até 101
Texto na imagem, os nossos próprios testesMenu, cartazes e título bilingue todos corretos; gráficos pouco fiáveisNão medidoO mais fiável nos nossos testes na sua páginaNão testado
A nossa velocidade medida64–118s em 2K, mediana 84s (13 execuções)Não medido32s baixa · 68s média · 166s alta em 2K (a sua página, execuções únicas)Não medido

Os créditos, os limites de imagens de referência, as resoluções e as contagens de proporções são lidos do nosso próprio registo de modelos a 19 de agosto de 2026 — a contagem de proporções do GPT Image 2 exclui «auto», que é uma definição e não uma proporção. As velocidades são medições nossas, com o tamanho da amostra indicado; as células que não testámos dizem-no em vez de irem buscar um número ao fornecedor.

Explorar mais modelos

Compare o Qwen Image 3 com outros modelos de imagem — mesmo espaço de trabalho, um clique para trocar.

Especificações do Qwen Image 3 na CreateVision AI

Modeloqwen3/text-to-image e qwen3/image-to-image, da equipa Qwen da Alibaba (lançado a 21 de julho de 2026; apenas por API, sem pesos abertos)
ModosTexto-para-imagem e imagem-para-imagem, incluindo edição guiada por referência
Níveis de qualidade1K e 2K — com preço idêntico, por isso 2K é a predefinição aqui
Proporções8 predefinições, de 1:1 a 21:9 ultralarga
Imagens por execuçãoUm
Imagens de referênciaAté 3 por geração
Controlos do promptPrompt negativo, seed e reescrita automática do prompt (ligada por predefinição) — prompts até 5.000 caracteres
Renderização de textoInglês e chinês corretos nos nossos cinco testes de texto; os analistas relatam erros em coreano; layouts de dados em estilo de gráfico pouco fiáveis (ver o nosso teste falhado acima)
Velocidade medida64–118s em 2K, mediana 84s (13 execuções); 57s na nossa única execução em 1K — 19 de agosto de 2026
Fiabilidade13 de 14 primeiras submissões concluíram; uma falhou no fornecedor a montante e teve êxito quando foi repetida sem alterações

Como usar o Qwen Image 3 online

Comece a gerar imagens
  1. Abra o workspace

    Crie uma conta gratuita — sem chave de API, sem configuração. O gerador nesta página já está definido para o Qwen Image 3.

  2. Ponha o seu texto entre aspas

    Escreva entre aspas as palavras exatas que quer renderizadas — títulos, preços, um título em chinês. Se o layout for fixo, diga que só esse texto deve aparecer: a reescrita do prompt está ligada por predefinição e, caso contrário, inventa conteúdo extra, corretamente escrito.

  3. Anexe até 3 referências para editar

    Entregue-lhe uma foto e descreva a alteração. O texto do rótulo na referência sobrevive à edição; a iluminação é reconstruída para a nova cena.

  4. Escolha uma proporção e deixe 2K ligado

    Oito proporções até 21:9. 1K e 2K custam o mesmo, por isso 2K é a predefinição — o custo exato em créditos aparece antes de cada execução.

Leituras relacionadas

Escolha seu plano

Comece grátis com créditos de boas-vindas. Faça upgrade para modelos premium, geração mais rápida e saída 4K.

Gratuito

$0

Perfeito para começar

  • 200 créditos de boas-vindas, até 80/dia
  • Rascunhos do Z Image Turbo a 0 créditos
  • Velocidade de geração padrão
  • Histórico de geração incluído
Começar

Premium

Mais popular
$29/month

Cobrado anualmente · US$ 240/ano

  • 8.000 créditos/mês, sem limites diários
  • Todos os modelos premium — GPT Image 2, Nano Banana, Seedream, Seedance, Veo, Kling
  • Geração 5x mais rápida, fila prioritária
  • Aprimoramento de prompt por IA
Atualizar para Premium

Ultimate

$49/month

Cobrado anualmente · US$ 380/ano

  • 18.000 créditos/mês, sem limites diários
  • Geração em HD até resolução 4K
  • Suporte prioritário
  • Fila mais rápida e acesso antecipado a novos modelos
Atualizar para Ultimate

Perguntas frequentes

1

O Qwen Image 3 é gratuito?

O modelo em si é pago, a uma tarifa fixa baixa por imagem que é idêntica em 1K e 2K — o custo exato em créditos é mostrado antes de cada execução. Todas as contas recebem créditos diários gratuitos, e o Z Image Turbo (0 créditos) está lá para rascunhos descartáveis antes de gastar seja o que for.

2

Qwen Image 3 ou Qwen Image 3 Pro — qual escolher?

Comece aqui. O nível padrão já dá conta de menus, cartazes, títulos bilingues e edições com referências, e o seu preço fixo torna previsível o trabalho em volume. Passe ao Pro quando o trabalho for detalhe fino com o máximo de acabamento — cobra 2K à parte, por isso faz sentido para os enquadramentos que entrega, não para os que explora.

3

O Qwen Image 3 é melhor do que o GPT Image 2?

Para a maior parte do trabalho de texto do dia a dia, leva-o lá a um preço fixo e previsível — os nossos testes de menu, cartaz e bilingue passaram todos à primeira tentativa. O GPT Image 2 continua a ser a escolha mais de confiança quando corpo pequeno e denso ou um briefing complexo com vários elementos têm de sair certos num único enquadramento, a um custo que varia entre 5 e 560 créditos consoante as definições. O volume vem para aqui; o único enquadramento que não pode falhar vai para lá.

4

Consegue renderizar texto em chinês — e noutros idiomas?

O chinês e o inglês são o seu forte: o nosso cartaz de livraria compôs um título vertical em chinês com um subtítulo em inglês, ambos corretos, e compostos como um designer local os comporia. Para lá de CJK e inglês, tenha cuidado — testadores independentes documentaram resultados em coreano com vogais trocadas e palavras escritas com erros. Reveja qualquer escrita que não saiba ler, ou componha esse texto você mesmo.

5

Quanto tempo demora uma geração?

No nosso lote de 19 de agosto de 2026, as execuções em 2K demoraram entre 64 e 118 segundos, com uma mediana de 84; a nossa única execução em 1K demorou 57. A geração é assíncrona — o resultado aterra no seu histórico com o prompt e os parâmetros guardados, por isso uma boa configuração é reproduzível mais tarde.

6

Em que é que o Qwen Image 3 é mau?

Três coisas, das nossas próprias execuções e do registo publicado. Gráficos com dados reais: o nosso imprimiu valores corretos sobre um eixo partido com barras não proporcionais, e inventou uma fonte. Acrescentos não pedidos: a reescrita do prompt está ligada por predefinição e enriquece um briefing curto com conteúdo extra (corretamente escrito) — restrinja-a no prompt quando o layout é fixo. E as figuras: a nossa execução de retrato saiu limpa, mas os analistas relatam membros a mais e olhos inconsistentes com frequência suficiente para justificar uma verificação antes de publicar uma pessoa.

7

Posso usar comercialmente as imagens do Qwen Image 3?

Sim, as imagens que gera podem ser usadas em projetos pessoais e comerciais ao abrigo dos nossos termos de serviço. Continua a ser responsável pelo conteúdo do prompt, pelas marcas registadas e pelos direitos de quaisquer imagens de referência que anexe.

Ponha um menu, um cartaz ou um título bilingue à frente do Qwen Image 3

Comece a gerar imagens

Descubra nossas ferramentas de imagem IA em um clique

Ferramentas de um clique para tudo em volta da geração — polir, mudar o estilo e compartilhar.

Preços e acesso — os fatosQwen Image 3

Modelo
Qwen Image 3
Desenvolvedor
Alibaba
Acesso
Funciona no espaço de trabalho do CreateVision AI via API — faça login e gere. Sem chave de API, sem projeto na nuvem, sem instalação.
Preço por geração
A partir de 20 créditos ≈ $0.07 por imagem no plano Premium ($29/mês por 8,000 créditos). O plano gratuito inclui 80 créditos por dia.
Privacidade
Privado por padrão — nenhum outro usuário pode ver suas gerações, em nenhum plano. Não vendemos nem fazemos mau uso dos dados dos membros. Política de Privacidade