Gestores de redes sociais
O Turbo devolve imagens rápido o bastante para brainstorm ao vivo, e o visual consistente mantém uma semana de posts sob uma única identidade visual.

O Z-Image Turbo é o modelo de imagem destilado em 8 etapas da Alibaba: quadros fotorrealistas e texto nítido em inglês ou chinês em poucos segundos, por um preço fixo de 5 credits por imagem. Rode no seu navegador, sem GPU. Contas novas ganham 20 credits grátis.



GALERIA






Recurso 01
O modelo não apenas desenha as palavras do seu prompt; ele preenche o que essas palavras implicam. O modelo carrega muito conhecimento de mundo, e o próprio pipeline da Tongyi-MAI adiciona um Prompt Enhancer por cima, então um prompt que cita a Grande Pagode do Ganso Selvagem em Xi'an, um estilo de bordado Hanfu ou um terraço de café parisiense na primavera recebe a arquitetura, o detalhe do figurino e a luz corretos sem um parágrafo de descrição. O efeito é menos tentativas repetidas: um prompt curto já chega perto da imagem na sua cabeça. O modelo também mantém correta a pequena lógica do mundo real, como reflexos que correspondem à sua origem e sombras que caem no lado oposto ao da lâmpada.

Recurso 02
O aprendizado por reforço leva o Turbo a uma resposta refinada por prompt. A própria tabela de modelos da Tongyi-MAI classifica a qualidade visual do Turbo como Muito Alta e sua diversidade como Baixa, o que soa como uma fraqueza até você precisar de um conjunto: execute o mesmo prompt dez vezes e a iluminação, a paleta e o estilo permanecem fiéis à marca em vez de variar. Isso torna o Turbo o modelo a escolher quando uma campanha precisa de vinte peças com a mesma aparência, ou quando a descrição de um personagem deve voltar reconhecivelmente igual a cada vez. Quando você quer variedade, mude o prompt, não a seed.

Recurso 03
A renderização precisa de texto bilíngue é uma das três habilidades principais que a Tongyi-MAI lista para ele, ao lado do fotorrealismo e da obediência a instruções. Coloque as palavras entre aspas e o modelo as aplica em placas, pôsteres, embalagens e telas, em inglês, em chinês, ou ambos na mesma imagem. Caracteres chineses complexos são onde muitos modelos de imagem embaralham os traços; este os mantém legíveis. Isso é útil para lojas que vendem para a China e para quem faz um menu bilíngue, um pôster de festival de lanternas ou um rótulo de produto com os dois alfabetos. Os próprios prompts podem ser escritos em qualquer um dos dois idiomas.

Recurso 04
Modelos rápidos costumam pagar a velocidade com obediência. O Turbo fecha essa lacuna com o DMDR, método do Tongyi-MAI que combina destilação por correspondência de distribuição com aprendizado por reforço após o treinamento, visando melhor alinhamento semântico e detalhes mais ricos na geração em poucos passos. Na prática, o Turbo sustenta prompts com várias partes: a mulher de Hanfu vermelho, o adorno de cabeça de fênix, o leque dobrável, a lâmpada neon acima da palma da mão e o pagode atrás dela aparecem onde você pediu. No ranking de preferência humana do Alibaba AI Arena, o Tongyi-MAI reporta o Turbo como o estado da arte entre os modelos de código aberto.

Recurso 05
O fotorrealismo é a primeira capacidade que o Tongyi-MAI mostra para o modelo: textura de pele, trama de tecido e luz natural que passam por foto real. No Ricebowl você escolhe um dos cinco formatos antes de gerar, 1:1 para feeds e marketplaces, 16:9 para banners e miniaturas, 9:16 para stories, e 4:3 ou 3:4 para páginas de produto. Cada imagem custa os mesmos 5 credits, então escolher o formato certo nunca muda o preço. Para trabalhos de impressão que precisam de 4K, mude para o Seedream 5.0 Lite no mesmo seletor de modelos.

EXEMPLOS DE PROMPT
Prompt
Rua de mercado noturno em Taipei, uma barraca de comida com placa pintada à mão escrita "阿明豆花 Ming's Tofu Pudding", vapor subindo das panelas, lâmpadas de tungstênio quentes, profundidade de campo rasa, filmado em filme 35mm.
Referência

Resultado

Prompt
Anúncio minimalista de skincare, um frasco de vidro fosco sobre areia clara, sombra suave da manhã, título "HYDRATE" em sans-serif fina no topo, espaço negativo limpo para texto.
Referência

Resultado

CASOS DE USO
O Turbo devolve imagens rápido o bastante para brainstorm ao vivo, e o visual consistente mantém uma semana de posts sob uma única identidade visual.
A renderização de texto bilíngue coloca inglês e chinês no mesmo banner ou etiqueta, então uma imagem de anúncio funciona em dois marketplaces.
Rascunhos baratos e rápidos a 5 credits fazem dele um motor de mood board. Itere a composição aqui, depois finalize a ideia escolhida em um modelo mais lento.
Quem leu que o Turbo cabe em 16GB de VRAM mas tem um laptop usa o Ricebowl para acessar o mesmo modelo sem instalar nada.
O modelo é Apache 2.0. As equipes testam prompts no Ricebowl primeiro e depois decidem se uma implantação local vale a configuração.
O QUE DIZEM OS USUÁRIOS
01
Oito etapas em vez de dezenas é a primeira coisa que as pessoas mencionam. Os rascunhos chegam antes de você terminar de reler o prompt.
02
Com 6B parâmetros, o Turbo é uma fração do checkpoint FLUX.2 [dev] de 32B, mas retratos e fotos de produtos se sustentam lado a lado.
03
Usuários que criam sinalização bilíngue destacam que os caracteres chineses saem corretos, não como glifos quase certos.
04
O outro lado da consistência: repetir o mesmo prompt gera imagens parecidas. Reescreva o prompt quando quiser algo novo.
QUAL DELES
A Tongyi-MAI distribui o modelo em duas formas principais. O Turbo é o destilado, feito para velocidade; o Z-Image base é o checkpoint não destilado do qual o Turbo foi destilado. O Ricebowl roda o Turbo.
Destilação em 8 etapas sem classifier-free guidance, ajustada com aprendizado por reforço para qualidade visual muito alta. Rápido, consistente e a versão que roda no Ricebowl a 5 credits por imagem.
Cerca de 50 etapas, mais lento, com mais variedade por prompt e suporte a prompts negativos. É o checkpoint destinado ao ajuste fino. A edição fica na variante separada Z-Image-Edit.
O QUE O DESTACA
01
Você não precisa do ComfyUI nem de uma placa de vídeo para usá-lo. Localmente, o modelo exige uma GPU com 16GB de VRAM e uma configuração de diffusers; no Ricebowl, ele roda em uma aba do navegador em qualquer notebook ou celular, e o resultado aparece no seu feed segundos depois.
02
Escolha o Turbo pela velocidade e o FLUX.2 pelo detalhe e edição. É um modelo de 6B que termina em 8 etapas; o checkpoint aberto FLUX.2 [dev] tem 32B. O FLUX.2 Pro no Ricebowl adiciona até 8 imagens de referência e edição de fotos, o que o Turbo não oferece aqui.
03
A Tongyi-MAI lança o Turbo sob a licença Apache 2.0, uma das mais permissivas da IA de código aberto. Os pesos são públicos no Hugging Face e no ModelScope, então tudo o que você aprende aqui vale para sua própria implantação.
NOSSA OPINIÃO
Rascunhos fotorrealistas rápidos e texto bilíngue. Use-o para retratos, fotos de produtos e sinalização em inglês e chinês; essas são as três habilidades que seus criadores destacam. Não o use para edições de fotos no Ricebowl, onde ele é apenas text-to-image.
Z-Image Turbo. Ele executa 8 avaliações de função, e a Tongyi-MAI relata latência abaixo de um segundo em GPUs H800. O FLUX.2 [dev] é mais de cinco vezes maior, com 32B parâmetros, e os próprios exemplos do FLUX.2 Flex usam de 6 a 50 etapas.
Online, a menos que você já tenha uma GPU de 16GB e gere milhares de imagens. A 5 credits por imagem no Ricebowl, o custo de uma placa de vídeo adequada compra um número muito grande de imagens, sem drivers ou atualizações para gerenciar.
COMPARAÇÃO
| Recurso | Z-Image Turbo | FLUX.2 Pro | Qwen Image 3.0 |
|---|---|---|---|
| Criador | Alibaba Tongyi-MAI | Black Forest Labs | Equipe Alibaba Qwen |
| Credits no Ricebowl | 5 por imagem | 5 em 1K, 7 em 2K | 5 por imagem |
| Etapas de amostragem | 8 | Definido pelo provedor | Definido pelo provedor |
| Imagens de referência no Ricebowl | Nenhuma, apenas texto para imagem | Até 8 | Até 3 |
| Edição de fotos no Ricebowl | Não | Sim | Sim |
| Qualidade na renderização de texto | Inglês e chinês | Tipografia complexa | Texto complexo, especialmente em chinês |
| Pesos abertos | Sim, Apache 2.0 (6B) | A família tem FLUX.2 [dev], 32B | Qwen-Image é Apache 2.0 |
| Ideal para | Rascunhos fotorrealistas rápidos | Detalhes e edições com múltiplas referências | Layouts com muito texto e edições |
Nossa escolha: comece com o Z-Image Turbo quando precisar de uma imagem limpa rapidamente a partir de texto. Passe para o FLUX.2 Pro quando o trabalho envolver fotos de referência, e para o Qwen Image quando texto denso em chinês ou edições de texto na imagem forem mais importantes.
Experimente o Z-Image Turbo gratuitamenteCOMO FUNCIONA
01
O gerador no topo desta página já usa o Z-Image Turbo. Crie uma conta gratuita: ela vem com 20 credits, e cada imagem custa 5.
02
Descreva o sujeito, o cenário, a luz e a câmera. Coloque entre aspas qualquer palavra que precise aparecer na imagem, em inglês ou chinês.
03
Escolha 1:1, 16:9, 9:16, 4:3 ou 3:4 e pressione gerar. Sua imagem do Z-Image Turbo aparece no feed abaixo e é baixada com um clique.
AVALIAÇÕES
O que dizem as pessoas que usam o Z-Image Turbo no Ricebowl.
Um banner, título em inglês e em chinês, ambos escritos corretamente. Antes eu corrigia o chinês à mão toda vez.
Vendedor transfronteiriço
Eu penso uma semana de posts em uma única sessão. A 5 credits por imagem, paro de me preocupar com novas tentativas.
Gerente de redes sociais
O Z-Image Turbo é minha máquina de mood boards. Rápido, realista, e o visual se mantém consistente em um conjunto.
Diretor de arte de jogo indie
Meu laptop não tem GPU de verdade. Aqui eu uso o modelo de que todo mundo fala no Reddit sem instalar nada.
Ilustradora em um laptop
Testamos nosso conjunto de prompts no Ricebowl antes de decidir hospedar por conta própria. Isso nos poupou uma semana de configuração.
Engenheiro de ML
Um saldo, todos os modelos. Os créditos valem para os 20 modelos de vídeo — sem marca d'água, sem modelos travados por plano e com uso comercial em todo plano pago.
Pague anualmente e economize 30%
Assinatura mensal flexível.
O menor preço para começar. Todos os modelos, um orçamento mensal para experimentar.
US$ 7,99/mês
Renova mensalmente, cancele a qualquer momento.
200 créditos
≈ 0–10 vídeos, conforme o modelo
≈ 14–66 imagens, conforme o modelo
4.00¢ / crédito
A forma mais barata de começar. Todos os modelos, um pequeno orçamento mensal.
US$ 12,99/mês
Renova mensalmente, cancele a qualquer momento.
400 créditos
≈ 1–20 vídeos, conforme o modelo
≈ 28–133 imagens, conforme o modelo
3.25¢ / crédito
Créditos suficientes para testar todos os modelos e finalizar alguns clipes por mês.
US$ 29,9/mês
Renova mensalmente, cancele a qualquer momento.
1.000 créditos
≈ 3–50 vídeos, conforme o modelo
≈ 71–333 imagens, conforme o modelo
2.99¢ / crédito
2 tarefas em paralelo
Produção constante para criadores solo que estão virando profissionais — todos os modelos, orçamento folgado.
US$ 49,9/mês
Renova mensalmente, cancele a qualquer momento.
2.000 créditos
≈ 6–100 vídeos, conforme o modelo
≈ 142–666 imagens, conforme o modelo
2.50¢ / crédito
3 tarefas em paralelo
Produção em alto volume para criadores prolíficos e equipes pequenas.
US$ 89,9/mês
Renova mensalmente, cancele a qualquer momento.
5.000 créditos
≈ 15–250 vídeos, conforme o modelo
≈ 357–1666 imagens, conforme o modelo
1.80¢ / crédito
5 tarefas em paralelo
Pague anualmente e economize mais.
Créditos suficientes para testar todos os modelos e finalizar alguns clipes por mês.
US$ 19,9/mêsUS$ 29,9
Cobrado anualmente em $238.8. Renova anualmente, cancele a qualquer momento.
Economize $120/ano vs mensal
12.000 créditos
≈ 38–600 vídeos, conforme o modelo
≈ 857–4000 imagens, conforme o modelo
1.99¢ / crédito
2 tarefas em paralelo
Produção constante para criadores solo que estão virando profissionais — todos os modelos, orçamento folgado.
US$ 34,9/mêsUS$ 49,9
Cobrado anualmente em $418.8. Renova anualmente, cancele a qualquer momento.
Economize $180/ano vs mensal
24.000 créditos
≈ 76–1200 vídeos, conforme o modelo
≈ 1714–8000 imagens, conforme o modelo
1.75¢ / crédito
3 tarefas em paralelo
Produção em alto volume para criadores prolíficos e equipes pequenas.
US$ 62,9/mêsUS$ 89,9
Cobrado anualmente em $754.8. Renova anualmente, cancele a qualquer momento.
Economize $324/ano vs mensal
60.000 créditos
≈ 190–3000 vídeos, conforme o modelo
≈ 4285–20000 imagens, conforme o modelo
1.26¢ / crédito
5 tarefas em paralelo
Recarregue créditos válidos por 12 meses.
Recarga única para necessidades ocasionais.
US$ 49,9
Compra única, válida por 12 meses.
1.000 créditos
≈ 3–50 vídeos, conforme o modelo
≈ 71–333 imagens, conforme o modelo
4.99¢ / crédito
Recarga única maior com melhor preço por unidade.
US$ 198
Compra única, válida por 12 meses.
4.800 créditos
≈ 15–240 vídeos, conforme o modelo
≈ 342–1600 imagens, conforme o modelo
4.13¢ / crédito
5 tarefas em paralelo
O que é o Z-Image Turbo, quanto custa e o que ele pode e não pode fazer.
Experimente o Z-Image Turbo gratuitamenteSim. Cadastre-se no Ricebowl e você recebe 20 credits grátis, o suficiente para quatro imagens, sem precisar de cartão. Depois disso, cada imagem custa 5 credits fixos. Os pesos abertos também podem ser baixados gratuitamente sob a licença Apache 2.0, se você tiver sua própria GPU de 16GB.
O Z-Image Turbo é um modelo de texto para imagem com 6 bilhões de parâmetros que gera em 8 etapas. É uma versão destilada do Z-Image, construída sobre um transformer de difusão de fluxo único, e foca no fotorrealismo, em texto bilíngue em inglês e chinês e na obediência a instruções.
A Tongyi-MAI, um laboratório dentro do grupo Tongyi da Alibaba. O nome do projeto em chinês é 造相. O time Qwen da mesma empresa faz o Qwen Image, que também está no Ricebowl.
Sim. A Tongyi-MAI publica os pesos de 6B sob a licença Apache 2.0 no Hugging Face e no ModelScope, então você pode executá-lo localmente com diffusers ou ComfyUI se tiver uma GPU com cerca de 16GB de VRAM. No Ricebowl ele roda no navegador, sem instalação e sem placa de vídeo.
Nenhuma no Ricebowl. O Z-Image Turbo roda aqui apenas como texto para imagem, então toda imagem parte do seu prompt. Para trabalhos guiados por referência, mude para FLUX.2 Pro (até 8 imagens) ou Seedream 5.0 Lite (até 14) no seletor de modelos.
Não no Ricebowl. A Tongyi-MAI lista a edição em checkpoints separados Z-Image-Edit e Z-Image-Omni-Base, não no Turbo. Para editar uma foto aqui, use FLUX.2, Seedream ou Qwen Image.
Cinco no Ricebowl: 1:1, 16:9, 9:16, 4:3 e 3:4. Todas custam os mesmos 5 credits.
O Turbo. É um modelo de 6B rodando 8 etapas, enquanto o checkpoint aberto FLUX.2 [dev] tem 32B. O FLUX.2 vence na edição baseada em referência; o Z-Image Turbo vence no tempo até a primeira imagem.
Para rascunhos, mood boards e gráficos para redes sociais, sim: o texto é legível e o realismo é alto. Para layouts finais de impressão que precisam de 4K ou edições precisas, finalize no Seedream ou no FLUX.2.
Aqui mesmo no Ricebowl. O gerador no topo desta página roda o Z-Image Turbo no seu navegador, sem ComfyUI, sem GPU e sem chave de API, e você pode compará-lo com FLUX.2, Qwen Image e Seedream usando o mesmo prompt.
RELACIONADOS
MAIS MODELOS
Oito etapas, resultados fotorrealistas, texto em inglês e chinês, e nenhuma GPU para comprar.
Experimente o Z-Image Turbo de graça20 CREDITS GRÁTIS AO SE CADASTRAR · 5 CREDITS POR IMAGEM · GERAÇÃO EM 8 ETAPAS · TEXTO BILÍNGUE
Comece a usar o modelo de imagem Z-Image Turbo AI
Experimente o Z-Image Turbo gratuitamente