Social media manager
Turbo restituisce immagini abbastanza velocemente da fare brainstorming in tempo reale, e l'aspetto coerente mantiene una settimana di post su un'unica identità visiva.

Z-Image Turbo è il modello di immagini distillato in 8 passaggi di Alibaba: fotogrammi fotorealistici e testo nitido in inglese o cinese in pochi secondi, a un costo fisso di 5 crediti per immagine. Eseguilo nel browser, senza GPU. I nuovi account ricevono 20 crediti gratuiti.



GALLERIA






Funzionalità 01
Il modello non dipinge solo le parole del prompt; riempie ciò che quelle parole implicano. Il modello possiede molta conoscenza del mondo, e la pipeline di Tongyi-MAI aggiunge un Prompt Enhancer, così un prompt che nomina la Grande Pagoda dell'Oca Selvatica a Xi'an, uno stile di ricamo Hanfu o una terrazza di un caffè parigino in primavera ottiene l'architettura, i dettagli del costume e la luce giusti senza un paragrafo di descrizione. Il risultato sono meno rigenerazioni: un prompt breve si avvicina già all'immagine che hai in mente. Il modello mantiene anche la piccola logica del mondo reale, come riflessi coerenti con la loro fonte e ombre che cadono nella direzione opposta alla lampada.

Funzionalità 02
Il reinforcement learning spinge Turbo verso una risposta rifinita per prompt. La tabella dei modelli di Tongyi-MAI valuta la qualità visiva di Turbo come Very High e la sua diversità come Low, il che sembra un difetto finché non ti serve un set: esegui lo stesso prompt dieci volte e illuminazione, palette e stile restano coerenti con il brand invece di vagare. Questo rende Turbo il modello da scegliere quando una campagna richiede venti elementi con lo stesso look, o quando la descrizione di un personaggio deve tornare riconoscibilmente identica ogni volta. Quando vuoi varietà, cambia il prompt, non il seed.

Funzionalità 03
Il rendering accurato del testo bilingue è una delle tre competenze principali che Tongyi-MAI elenca per questo modello, insieme al fotorealismo e al rispetto delle istruzioni. Metti le parole tra virgolette e il modello le compone su insegne, poster, packaging e schermi, in inglese, in cinese o in entrambi sulla stessa immagine. I caratteri cinesi complessi sono il punto in cui molti modelli di immagini rovinano i tratti; questo li mantiene leggibili. È utile per i negozi che vendono in Cina e per chiunque realizzi un menu bilingue, un poster per il festival delle lanterne o un'etichetta di prodotto con entrambe le scritture. I prompt stessi possono essere scritti in entrambe le lingue.

Funzionalità 04
I modelli veloci di solito pagano la velocità con l'obbedienza. Turbo colma questo divario con DMDR, il metodo di Tongyi-MAI che combina la distillation con distribution matching e il reinforcement learning dopo l'addestramento, puntando a un migliore allineamento semantico e a dettagli più ricchi nella generazione in pochi passaggi. In pratica Turbo mantiene i prompt multi-parte: la donna in Hanfu rosso, il copricapo a fenice, il ventaglio pieghevole, la lampada al neon sopra il palmo e la pagoda dietro di lei appaiono tutti dove li hai chiesti. Nella classifica delle preferenze umane di Alibaba AI Arena, Tongyi-MAI indica Turbo come stato dell'arte tra i modelli open source.

Funzionalità 05
Il fotorealismo è la prima capacità che Tongyi-MAI mostra per il modello: texture della pelle, trama dei tessuti e luce naturale che sembrano una foto reale. Su Ricebowl scegli una delle cinque proporzioni prima di generare, 1:1 per feed e marketplace, 16:9 per banner e miniature, 9:16 per le storie, e 4:3 o 3:4 per le pagine prodotto. Ogni immagine costa gli stessi 5 crediti, quindi scegliere la proporzione giusta non cambia mai il prezzo. Per lavori di stampa che richiedono il 4K, passa a Seedream 5.0 Lite nello stesso selettore di modelli.

ESEMPI DI PROMPT
Prompt
Strada di un mercato notturno a Taipei, una bancarella con un'insegna dipinta a mano che recita "阿明豆花 Ming's Tofu Pudding", vapore che sale dalle pentole, lampadine al tungsteno calde, profondità di campo ridotta, scattato su pellicola 35mm.
Riferimento

Risultato

Prompt
Annuncio minimal per skincare, una bottiglia in vetro smerigliato sulla sabbia chiara, ombra morbida del mattino, titolo "HYDRATE" in sans-serif sottile in alto, spazio negativo pulito per il testo.
Riferimento

Risultato

CASI D'USO
Turbo restituisce immagini abbastanza velocemente da fare brainstorming in tempo reale, e l'aspetto coerente mantiene una settimana di post su un'unica identità visiva.
Il rendering di testo bilingue mette inglese e cinese sullo stesso banner o etichetta, così un'unica immagine di annuncio funziona su due marketplace.
Bozze economiche e rapide a 5 crediti ne fanno un motore per mood board. Itera sulla composizione qui, poi rifinisci l'idea scelta su un modello più lento.
Chi ha letto che Turbo sta in 16GB di VRAM ma possiede un laptop usa Ricebowl per ottenere lo stesso modello senza installazione.
Il modello è Apache 2.0. I team testano i prompt prima su Ricebowl, poi decidono se un deployment locale vale la configurazione.
COSA DICONO GLI UTENTI
01
Otto step invece di decine: è la prima cosa che le persone citano. Le bozze arrivano prima che tu finisca di rileggere il prompt.
02
Con 6B parametri, Turbo è una frazione del checkpoint FLUX.2 [dev] da 32B, eppure ritratti e foto di prodotto reggono il confronto fianco a fianco.
03
Gli utenti che creano insegne bilingui segnalano che i caratteri cinesi tornano corretti, non come glifi quasi giusti.
04
Il rovescio della coerenza: rigenerare lo stesso prompt dà immagini simili. Riscrivi il prompt quando vuoi qualcosa di nuovo.
QUALE
Tongyi-MAI distribuisce il modello in due forme principali. Turbo è quella distillata, costruita per la velocità; la Z-Image base è il checkpoint non distillato da cui Turbo è stato distillato. Ricebowl esegue Turbo.
Distillazione in 8 step senza classifier-free guidance, ottimizzata con reinforcement learning per una qualità visiva molto alta. Veloce, coerente, ed è la versione in esecuzione su Ricebowl a 5 crediti per immagine.
Circa 50 step, più lenta, con più varietà per prompt e supporto ai negative prompt. È il checkpoint pensato per il fine-tuning. L'editing vive nella variante separata Z-Image-Edit.
COSA LO DISTINGUE
01
Non ti servono ComfyUI né una scheda grafica per usarlo. In locale il modello richiede una GPU con 16GB di VRAM e una configurazione diffusers; su Ricebowl gira in una scheda del browser su qualsiasi laptop o telefono, e il risultato è nel tuo feed pochi secondi dopo.
02
Scegli Turbo per la velocità e FLUX.2 per dettaglio ed editing. È un modello da 6B che termina in 8 step; il checkpoint aperto FLUX.2 [dev] è da 32B. FLUX.2 Pro su Ricebowl aggiunge fino a 8 immagini di riferimento e l'editing fotografico, che Turbo qui non offre.
03
Tongyi-MAI rilascia Turbo con licenza Apache 2.0, una delle più permissive nell'AI open source. I pesi sono pubblici su Hugging Face e ModelScope, quindi tutto ciò che impari qui vale anche per il tuo deployment.
IL NOSTRO GIUDIZIO
Bozze fotorealistiche veloci e testo bilingue. Usalo per ritratti, foto di prodotto e insegne in inglese e cinese; sono le tre abilità che i suoi creatori mettono in primo piano. Non usarlo per modifiche fotografiche su Ricebowl, dove è solo text-to-image.
Z-Image Turbo. Esegue 8 function evaluation, e Tongyi-MAI dichiara una latenza sotto il secondo su GPU H800. FLUX.2 [dev] è più di cinque volte più grande, con 32B parametri, e gli esempi di FLUX.2 Flex usano da 6 a 50 step.
Online, a meno che tu non possieda già una GPU da 16GB e generi migliaia di immagini. A 5 crediti per immagine su Ricebowl, il costo di una scheda grafica adeguata compra un numero molto grande di immagini, senza driver o aggiornamenti da gestire.
CONFRONTO
| Funzionalità | Z-Image Turbo | FLUX.2 Pro | Qwen Image 3.0 |
|---|---|---|---|
| Sviluppatore | Alibaba Tongyi-MAI | Black Forest Labs | Alibaba Qwen team |
| Credits su Ricebowl | 5 per immagine | 5 a 1K, 7 a 2K | 5 per immagine |
| Passaggi di campionamento | 8 | Impostati dal provider | Impostati dal provider |
| Immagini di riferimento su Ricebowl | Nessuna, solo text-to-image | Fino a 8 | Fino a 3 |
| Modifica foto su Ricebowl | No | Sì | Sì |
| Resa del testo | Inglese e cinese | Tipografia complessa | Testo complesso, soprattutto in cinese |
| Pesi aperti | Sì, Apache 2.0 (6B) | La famiglia include FLUX.2 [dev], 32B | Qwen-Image è Apache 2.0 |
| Ideale per | Bozze fotorealistiche rapide | Dettaglio e modifiche con più riferimenti | Layout ricchi di testo e modifiche |
La nostra scelta: inizia con Z-Image Turbo quando ti serve un'immagine pulita e rapida partendo solo dal testo. Passa a FLUX.2 Pro quando il lavoro richiede foto di riferimento, e a Qwen Image quando contano soprattutto testi cinesi densi o modifiche al testo nell'immagine.
Prova Z-Image Turbo gratisCOME FUNZIONA
01
Il generatore in cima a questa pagina esegue già Z-Image Turbo. Crea un account gratuito: include 20 credits e ogni immagine costa 5.
02
Descrivi soggetto, ambientazione, luce e inquadratura. Metti tra virgolette le parole che devono apparire sull'immagine, in inglese o in cinese.
03
Scegli 1:1, 16:9, 9:16, 4:3 o 3:4 e premi genera. La tua immagine Z-Image Turbo appare nel feed qui sotto e si scarica con un clic.
RECENSIONI
Cosa dicono di Z-Image Turbo su Ricebowl le persone che lo usano.
Un banner, titolo in inglese e in cinese, entrambi scritti correttamente. Prima correggevo il cinese a mano ogni volta.
Venditore transfrontaliero
Ideo una settimana di post in una sola sessione. A 5 crediti per immagine smetto di preoccuparmi dei tentativi ripetuti.
Responsabile social media
Z-Image Turbo è la mia macchina per le mood board. Veloce, realistico, e lo stile resta coerente in tutta una serie.
Art director di giochi indie
Il mio laptop non ha una vera GPU. Qui ottengo il modello di cui tutti parlano su Reddit senza installare nulla.
Illustratrice su laptop
Abbiamo testato il nostro set di prompt su Ricebowl prima di decidere di ospitarlo noi. Ci ha risparmiato una settimana di configurazione.
Ingegnere ML
Un solo saldo, tutti i modelli. I crediti valgono su tutti i 20 modelli video: nessun watermark, nessun modello riservato a un piano, uso commerciale incluso in ogni piano a pagamento.
Paga annualmente e risparmia il 30%
Abbonamento mensile flessibile.
Il prezzo più basso per iniziare. Tutti i modelli, un budget mensile per provare.
7,99 USD/mese
Si rinnova mensilmente, annulla in qualsiasi momento.
200 crediti
≈ 0–10 video, a seconda del modello
≈ 14–66 immagini, a seconda del modello
4.00¢ / credito
Il modo più economico per iniziare. Tutti i modelli, un piccolo budget mensile.
12,99 USD/mese
Si rinnova mensilmente, annulla in qualsiasi momento.
400 crediti
≈ 1–20 video, a seconda del modello
≈ 28–133 immagini, a seconda del modello
3.25¢ / credito
Crediti sufficienti per provare ogni modello e completare qualche clip al mese.
29,9 USD/mese
Si rinnova mensilmente, annulla in qualsiasi momento.
1000 crediti
≈ 3–50 video, a seconda del modello
≈ 71–333 immagini, a seconda del modello
2.99¢ / credito
2 compiti paralleli
Produzione costante per creator solisti che passano al livello pro: tutti i modelli e un budget comodo.
49,9 USD/mese
Si rinnova mensilmente, annulla in qualsiasi momento.
2000 crediti
≈ 6–100 video, a seconda del modello
≈ 142–666 immagini, a seconda del modello
2.50¢ / credito
3 compiti paralleli
Produzione ad alto volume per creator prolifici e piccoli team.
89,9 USD/mese
Rinnovo mensile, cancellabile in qualsiasi momento.
5000 crediti
≈ 15–250 video, a seconda del modello
≈ 357–1666 immagini, a seconda del modello
1.80¢ / credito
5 compiti paralleli
Paga annualmente e risparmia di più.
Crediti sufficienti per provare ogni modello e completare qualche clip al mese.
19,9 USD/mese29,9 USD
Fatturato annualmente a $238.8. Si rinnova annualmente, annulla in qualsiasi momento.
Risparmia $120/anno rispetto al mensile
12.000 crediti
≈ 38–600 video, a seconda del modello
≈ 857–4000 immagini, a seconda del modello
1.99¢ / credito
2 compiti paralleli
Produzione costante per creator solisti che passano al livello pro: tutti i modelli e un budget comodo.
34,9 USD/mese49,9 USD
Fatturato annualmente a $418.8. Si rinnova annualmente, annullabile in qualsiasi momento.
Risparmia $180/anno rispetto al mensile
24.000 crediti
≈ 76–1200 video, a seconda del modello
≈ 1714–8000 immagini, a seconda del modello
1.75¢ / credito
3 compiti paralleli
Produzione ad alto volume per creator prolifici e piccoli team.
62,9 USD/mese89,9 USD
Fatturato annualmente a $754.8. Si rinnova annualmente, annullabile in qualsiasi momento.
Risparmia $324/anno rispetto al mensile
60.000 crediti
≈ 190–3000 video, a seconda del modello
≈ 4285–20000 immagini, a seconda del modello
1.26¢ / credito
5 compiti paralleli
Ricarica crediti validi per 12 mesi.
Ricarica una tantum per esigenze occasionali.
49,9 USD
Acquisto una tantum, valido 12 mesi.
1000 crediti
≈ 3–50 video, a seconda del modello
≈ 71–333 immagini, a seconda del modello
4.99¢ / credito
Ricarica una tantum più grande con prezzo unitario migliore.
198 USD
Acquisto una tantum, valido 12 mesi.
4800 crediti
≈ 15–240 video, a seconda del modello
≈ 342–1600 immagini, a seconda del modello
4.13¢ / credito
5 compiti paralleli
Cos'è Z-Image Turbo, quanto costa e cosa può e non può fare.
Prova Z-Image Turbo gratisSì. Registrandoti su Ricebowl ottieni 20 crediti gratuiti, sufficienti per quattro immagini, senza carta. Dopodiché ogni immagine costa 5 crediti fissi. I pesi aperti sono anche scaricabili gratuitamente con licenza Apache 2.0 se hai una tua GPU da 16GB.
Z-Image Turbo è un modello text-to-image da 6 miliardi di parametri che genera in 8 step. È una versione distillata di Z-Image, basata su un diffusion transformer a stream singolo, e si concentra sul fotorealismo, sul testo bilingue inglese e cinese e sul rispetto delle istruzioni.
Tongyi-MAI, un laboratorio interno al gruppo Tongyi di Alibaba. Il nome cinese del progetto è 造相. Il team Qwen della stessa azienda realizza Qwen Image, disponibile anch'esso su Ricebowl.
Sì. Tongyi-MAI pubblica i pesi 6B con licenza Apache 2.0 su Hugging Face e ModelScope, quindi puoi eseguirlo in locale con diffusers o ComfyUI se hai una GPU con circa 16GB di VRAM. Su Ricebowl viene eseguito nel browser, senza installazione e senza scheda grafica.
Nessuna su Ricebowl. Z-Image Turbo qui funziona solo come text-to-image, quindi ogni immagine parte dal tuo prompt. Per lavori guidati da riferimenti, passa a FLUX.2 Pro (fino a 8 immagini) o Seedream 5.0 Lite (fino a 14) nel selettore del modello.
Non su Ricebowl. Tongyi-MAI elenca la modifica sotto checkpoint separati Z-Image-Edit e Z-Image-Omni-Base, non sotto Turbo. Per modificare una foto qui, usa FLUX.2, Seedream o Qwen Image.
Cinque su Ricebowl: 1:1, 16:9, 9:16, 4:3 e 3:4. Tutte costano gli stessi 5 credits.
Turbo. È un modello 6B che esegue 8 step, mentre il checkpoint aperto FLUX.2 [dev] è 32B. FLUX.2 vince sulla modifica basata su riferimenti; Z-Image Turbo vince sul tempo alla prima immagine.
Per bozze, mood board e grafiche per i social, sì: il testo è leggibile e il realismo è elevato. Per layout di stampa finali che richiedono 4K o modifiche precise, completa con Seedream o FLUX.2.
Proprio qui su Ricebowl. Il generatore in cima a questa pagina esegue Z-Image Turbo nel tuo browser senza ComfyUI, senza GPU e senza chiave API, e puoi confrontarlo con FLUX.2, Qwen Image e Seedream sullo stesso prompt.
CORRELATI
ALTRI MODELLI
Otto step, risultati fotorealistici, testo in inglese e cinese e nessuna GPU da acquistare.
Prova Z-Image Turbo gratis20 CREDITS GRATIS ALLA REGISTRAZIONE · 5 CREDITS PER IMMAGINE · GENERAZIONE IN 8 STEP · TESTO BILINGUE
Inizia a usare il modello AI di immagini Z-Image Turbo
Prova Z-Image Turbo gratis