Modèle d'image IA Z-Image Turbo

Z-Image Turbo est le modèle d'image distillé en 8 étapes d'Alibaba : des images photoréalistes et un texte clair en anglais ou chinois en quelques secondes, à un tarif fixe de 5 crédits par image. Exécutez-le dans votre navigateur, sans GPU. Les nouveaux comptes reçoivent 20 crédits gratuits.

Crédits estimés —

Make something with Z-Image Turbo

GALERIE

Découvrez les possibilités infinies de Z-Image Turbo

Scène produit, image d'espace réservé
Nature morte en studio, image d'illustration
Photo de produit lifestyle, image d'illustration
Exemple de photo source, image d'illustration
Exemple de photo retouchée, image d'illustration
Photo héroïque d'emballage, image d'illustration

Fonctionnalité 01

Connaissances du monde réel et ancrage du promptIl sait à quoi ressemble le monument

Le modèle ne se contente pas de peindre les mots de votre prompt ; il complète ce que ces mots impliquent. Le modèle possède une vaste connaissance du monde, et le pipeline propre à Tongyi-MAI ajoute un Prompt Enhancer par-dessus. Ainsi, un prompt qui mentionne la Grande Pagode de l'Oie Sauvage à Xi'an, un style de broderie Hanfu, ou une terrasse de café parisienne au printemps obtient la bonne architecture, les bons détails vestimentaires et la bonne lumière sans nécessiter un paragraphe de description. L'effet est un nombre réduit de régénérations : un prompt court donne déjà une image proche de celle que vous avez en tête. Le modèle maintient également la logique du monde réel, comme des reflets qui correspondent à leur source et des ombres qui s'éloignent de la lampe.

  • La connaissance du monde complète ce qu'implique le prompt
  • Reconnaît les lieux, costumes et objets réels par leur nom
  • Les prompts courts donnent une image proche de la scène visée
Rendu basé sur la connaissance du monde, illustration

Fonctionnalité 02

Aspect cohérent dans chaque lotCréez des images Z-Image Turbo en lots rapides

L'apprentissage par renforcement pousse Turbo vers une réponse soignée par prompt. Le tableau de modèles propre à Tongyi-MAI évalue la qualité visuelle de Turbo comme Très élevée et sa diversité comme Faible, ce qui semble être une faiblesse jusqu'à ce que vous ayez besoin d'un ensemble : exécutez le même prompt dix fois et l'éclairage, la palette et le style restent fidèles à la marque au lieu de varier. Cela fait de Turbo le modèle à utiliser lorsqu'une campagne nécessite vigny images dans un même look, ou lorsqu'une description de personnage doit rester reconnaissable à chaque fois. Quand vous voulez de la variété, changez le prompt, pas la graine.

  • Style stable lorsque le prompt est répété
  • Conservez une description écrite de personnage et réutilisez-la
  • Changez le libellé, pas la graine, pour de nouvelles idées
Lot d'images cohérentes, illustration

Fonctionnalité 03

Typographie bilingue et localisationTexte en anglais et en chinois correctement rendu

Le rendu précis de texte bilingue est l'une des trois compétences phares listées par Tongyi-MAI, avec le photoréalisme et le suivi des instructions. Mettez les mots entre guillemets et le modèle les place sur des panneaux, affiches, emballages et écrans, en anglais, en chinois, ou les deux sur une même image. Les caractères chinois complexes sont souvent mal rendus par de nombreux modèles d'image ; celui-ci les garde lisibles. Cela est utile pour les boutiques qui vendent en Chine et pour quiconque crée un menu bilingue, une affiche de fête des lanternes ou une étiquette de produit avec les deux écritures. Les prompts eux-mêmes peuvent être rédigés dans l'une ou l'autre langue.

  • Texte anglais et chinois sur la même image
  • Caractères complexes lisibles sur les panneaux et étiquettes
  • Prompts acceptés en anglais ou en chinois
Affiche bilingue, illustration

Fonctionnalité 04

Suivi des instructions affiné par apprentissage par renforcementMettez cinq détails dans le prompt, obtenez cinq détails en retour

Les modèles rapides paient généralement la vitesse par l'obéissance. Turbo comble cet écart avec DMDR, la méthode de Tongyi-MAI qui combine la distillation par correspondance de distribution avec l'apprentissage par renforcement après l'entraînement, visant un meilleur alignement sémantique et des détails plus riches dans la génération en quelques étapes. En pratique, Turbo tient les prompts en plusieurs parties : la femme en robe hanfu rouge, la coiffe de phénix, l'éventail pliant, la lampe néon au-dessus de sa paume et la pagode derrière elle apparaissent tous là où vous les avez demandés. Sur le classement des préférences humaines d'Alibaba AI Arena, Tongyi-MAI indique que Turbo est l'état de l'art parmi les modèles open-source.

  • Les prompts multi-parties conservent chaque élément demandé
  • Distillation affinée par RL pour l'alignement sémantique
  • Meilleur résultat open-source sur Alibaba AI Arena, selon Tongyi-MAI
Rendu de prompt multi-éléments, placeholder

Fonctionnalité 05

Détail photoréaliste dans cinq rapports d'aspectPrêt pour les fils d'actualité, les bannières et les pages produit

Le photoréalisme est la première capacité que Tongyi-MAI montre pour le modèle : texture de la peau, tissu et lumière naturelle qui passent pour une vraie photo. Sur Ricebowl, vous choisissez l'un des cinq cadres avant de générer : 1:1 pour les fils et les places de marché, 16:9 pour les bannières et les miniatures, 9:16 pour les stories, et 4:3 ou 3:4 pour les pages produit. Chaque image coûte le même nombre de 5 crédits, donc choisir le bon cadre ne change jamais le prix. Pour un travail d'impression nécessitant du 4K, passez à Seedream 5.0 Lite dans le même sélecteur de modèle.

  • Peau, tissu et éclairage photoréalistes
  • Cinq rapports d'aspect : 1:1, 16:9, 9:16, 4:3, 3:4
  • Tarif fixe de 5 crédits par image sur Ricebowl
Portrait photoréaliste, placeholder

EXEMPLES DE PROMPTS

Prompts Z-Image Turbo

Prompt

Rue de marché de nuit à Taipei, un stand de nourriture avec une enseigne peinte à la main "阿明豆花 Ming's Tofu Pudding", vapeur s'élevant des marmottes, ampoules tungstène chaudes, faible profondeur de champ, pris sur film 35 mm.

Référence

Référence

Résultat

Résultat

Prompt

Publicité minimaliste pour soins de la peau, un flacon en verre givré sur du sable pâle, ombre matinale douce, titre "HYDRATE" en sans-serif fin en haut, espace négatif propre pour le texte.

Référence

Référence

Résultat

Résultat

CAS D'UTILISATION

Qui utilise Z-Image Turbo

Community managers

Turbo renvoie des images assez rapidement pour brainstormer en direct, et le style cohérent maintient une semaine de publications sur une seule identité visuelle.

Vendeurs ciblant les acheteurs sinophones

Le rendu de texte bilingue place l'anglais et le chinois sur la même bannière ou étiquette, donc une image de fiche produit fonctionne sur deux places de marché.

Concept artists et directeurs artistiques

Des brouillons bon marché et rapides à 5 crédits en font un moteur de mood-board. Itérez sur la composition ici, puis terminez l'idée choisie sur un modèle plus lent.

Utilisateurs open-source sans gros GPU

Les personnes qui ont lu que Turbo tient dans 16 Go de VRAM mais possèdent un ordinateur portable utilisent Ricebowl pour obtenir le même modèle sans installation.

Développeurs testant avant auto-hébergement

Le modèle est sous licence Apache 2.0. Les équipes testent d'abord les prompts sur Ricebowl, puis décident si un déploiement local vaut la peine d'être mis en place.

CE QUE DISENT LES UTILISATEURS

Ce que les créateurs ne cessent de souligner

01

La vitesse est la raison pour laquelle les gens changent

Huit étapes au lieu de dizaines, c'est la première chose que les gens mentionnent. Les brouillons arrivent avant que vous ayez fini de relire le prompt.

02

Le réalisme dépasse sa taille

Avec 6 milliards de paramètres, Turbo est une fraction du checkpoint FLUX.2 [dev] de 32 milliards, pourtant les portraits et les photos de produits tiennent la comparaison côte à côte.

03

Le texte chinois fonctionne réellement

Les utilisateurs qui créent des signalisations bilingues soulignent que les caractères chinois sont corrects, et non pas des glyphes approximatifs.

04

Moins de variété par prompt

Le revers de la cohérence : relancer le même prompt donne des images similaires. Réécrivez le prompt quand vous voulez du nouveau.

Essayez Z-Image Turbo gratuitement

LEQUEL

Z-Image Turbo vs Z-Image

Tongyi-MAI propose le modèle sous deux formes principales. Turbo est la version distillée conçue pour la vitesse ; le Z-Image de base est le checkpoint non distillé à partir duquel Turbo a été distillé. Ricebowl exécute Turbo.

Turbo

Distillation en 8 étapes sans guidage sans classifieur, optimisé par apprentissage par renforcement pour une qualité visuelle très élevée. Rapide, cohérent, et la version qui tourne sur Ricebowl à 5 crédits par image.

Base

Environ 50 étapes, plus lent, avec plus de variété par prompt et prise en charge des prompts négatifs. C'est le checkpoint destiné au fine-tuning. L'édition réside dans la variante séparée Z-Image-Edit.

CE QUI LE DISTINGUE

Ce qui fait la différence de Z-Image Turbo

01

Exécutez Z-Image Turbo sans GPU

Vous n'avez pas besoin de ComfyUI ou d'une carte graphique pour l'utiliser. Localement, le modèle nécessite un GPU avec 16 Go de VRAM et une configuration diffusers ; sur Ricebowl, il tourne dans un onglet de navigateur sur n'importe quel ordinateur portable ou téléphone, et le résultat est dans votre flux quelques secondes plus tard.

02

Z-Image Turbo vs FLUX.2

Choisissez Turbo pour la vitesse et FLUX.2 pour les détails et l'édition. C'est un modèle de 6 milliards qui termine en 8 étapes ; le checkpoint ouvert FLUX.2 [dev] est de 32 milliards. FLUX.2 Pro sur Ricebowl ajoute jusqu'à 8 images de référence et l'édition photo, ce que Turbo n'offre pas ici.

03

Apache 2.0, ouvert à tous

Tongyi-MAI publie Turbo sous la licence Apache 2.0, l'une des licences les plus permissives du domaine de l'IA open source. Les poids sont publics sur Hugging Face et ModelScope, donc tout ce que vous apprenez ici s'applique à votre propre déploiement.

NOTRE AVIS

Notre verdict sur Z-Image Turbo

Qu'est-ce que Z-Image fait de mieux ?

Des brouillons photoréalistes rapides et du texte bilingue. Utilisez-le pour les portraits, les photos de produits et la signalisation anglais-chinois ; ce sont les trois compétences que ses créateurs mettent en avant. Ne l'utilisez pas pour les retouches photo sur Ricebowl, où il est limité au texte vers image.

Z-Image ou FLUX.2 : lequel est le plus rapide ?

Z-Image Turbo. Il effectue 8 évaluations de fonction, et Tongyi-MAI rapporte une latence inférieure à la seconde sur les GPU H800. FLUX.2 [dev] est plus de cinq fois plus grand avec 32 milliards de paramètres, et les propres exemples de FLUX.2 Flex utilisent de 6 à 50 étapes.

L'exécuter localement ou en ligne ?

En ligne, à moins que vous ne possédiez déjà un GPU de 16 Go et que vous génériez des milliers d'images. À 5 crédits par image sur Ricebowl, le coût d'une carte graphique adaptée permet d'acheter un très grand nombre d'images, sans avoir à gérer de pilotes ni de mises à jour.

COMPARAISON

Z-Image Turbo vs FLUX.2 vs Qwen Image : Tableau de comparaison des performances

FonctionnalitéZ-Image TurboFLUX.2 ProQwen Image 3.0
CréateurAlibaba Tongyi-MAIBlack Forest LabsAlibaba Qwen team
Crédits sur Ricebowl5 par image5 en 1K, 7 en 2K5 par image
Étapes d'échantillonnage8Défini par le fournisseurDéfini par le fournisseur
Images de référence sur RicebowlAucune, texte vers image uniquementJusqu'à 8Jusqu'à 3
Retouche photo sur RicebowlNonOuiOui
Puissance de rendu du texteAnglais et chinoisTypographie complexeTexte complexe, surtout en chinois
Poids ouvertsOui, Apache 2.0 (6B)La famille a FLUX.2 [dev], 32BQwen-Image est Apache 2.0
Idéal pourÉbauches photoréalistes rapidesDétails et modifications multi-référencesMises en page à forte densité de texte et modifications

Notre choix : commencez par Z-Image Turbo lorsque vous avez besoin d'une image propre rapidement à partir du seul texte. Passez à FLUX.2 Pro lorsque le travail implique des photos de référence, et à Qwen Image lorsque le texte chinois dense ou les modifications de texte dans l'image sont primordiaux.

Essayez Z-Image Turbo gratuitement

COMMENT ÇA MARCHE

Comment utiliser gratuitement le modèle d'image IA Z-Image Turbo

Essayez Z-Image Turbo gratuitement

01

Inscrivez-vous et ouvrez le générateur

Le générateur en haut de cette page exécute déjà Z-Image Turbo. Créez un compte gratuit : il est livré avec 20 crédits, et chaque image coûte 5 crédits.

02

Rédigez un prompt clair

Décrivez le sujet, le décor, la lumière et la caméra. Mettez entre guillemets, en anglais ou en chinois, tous les mots qui doivent apparaître sur l'image.

03

Choisissez un cadre et générez

Choisissez 1:1, 16:9, 9:16, 4:3 ou 3:4 et appuyez sur Générer. Votre image Z-Image Turbo apparaît dans le flux ci-dessous et se télécharge en un clic.

AVIS

Choisi par les créateurs et les spécialistes du marketing du monde entier

Ce que disent les personnes qui utilisent Z-Image Turbo sur Ricebowl.

Chen Yu

Une bannière, un titre en anglais et en chinois, tous deux correctement orthographiés. Avant, je devais corriger le chinois à la main à chaque fois.

Vendeur transfrontalier

Laura Fischer

Je trouve les idées d'une semaine de publications en une seule séance. À 5 crédits par image, je ne m'inquiète plus des régénérations.

Gestionnaire de réseaux sociaux

Ryan Mitchell

Z-Image Turbo est ma machine à mood boards. Rapide, réaliste, et le style reste cohérent sur une série.

Directeur artistique de jeux indépendants

Aiko Tanaka

Mon ordinateur portable n'a pas de vrai GPU. Ici, j'obtiens le modèle dont tout le monde parle sur Reddit sans rien installer.

Illustratrice sur ordinateur portable

Samuel Adeyemi

Nous avons testé notre ensemble de prompts sur Ricebowl avant de décider de l'héberger nous-mêmes. Cela nous a évité une semaine de configuration.

Ingénieur en apprentissage automatique

Tarifs du générateur d'images IA

Un seul solde, tous les modèles. Les crédits fonctionnent sur les 20 modèles vidéo – sans filigrane, sans modèle réservé à une formule, usage commercial inclus dans chaque formule payante.

Payez annuellement et économisez 30%

Payez annuellement et économisez davantage.

Mini Mensuel

Le prix le plus bas pour commencer. Tous les modèles, un budget mensuel pour essayer.

7,99 $US/mois

Renouvellement mensuel, annulation à tout moment.

200 crédits

≈ 0 à 10 vidéos, selon le modèle

≈ 14 à 66 images, selon le modèle

4.00¢ / crédit

  • 1080p · Sans filigrane · Usage commercial
  • Les crédits sont réinitialisés chaque mois de facturation
  • Accès à tous les modèles
  • Résultats sans filigrane
  • Acheter un pack de crédits supplémentaire
  • Support standard

Lite Mensuel

La façon la moins chère de commencer. Tous les modèles, un petit budget mensuel.

12,99 $US/mois

Renouvellement mensuel, annulation à tout moment.

400 crédits

≈ 1 à 20 vidéos, selon le modèle

≈ 28 à 133 images, selon le modèle

3.25¢ / crédit

  • 1080p · Sans filigrane · Usage commercial
  • Les crédits sont réinitialisés chaque mois de facturation
  • Accès à tous les modèles
  • Résultats sans filigrane
  • Acheter un pack de crédits supplémentaire
  • Support standard

Starter Mensuel

Recommandé

De quoi essayer chaque modèle et finaliser quelques clips par mois.

29,9 $US/mois

Renouvellement mensuel, annulation à tout moment.

1 000 crédits

≈ 3 à 50 vidéos, selon le modèle

≈ 71 à 333 images, selon le modèle

2.99¢ / crédit

2 tâches parallèles

  • 1080p · Sans filigrane · Usage commercial
  • Les crédits sont réinitialisés chaque mois de facturation
  • Accès à tous les modèles
  • Résultats sans filigrane
  • Acheter un pack de crédits supplémentaire
  • Support standard

Mensuel Standard

Populaire

Une production régulière pour les créateurs solo qui passent au niveau pro — tous les modèles, un budget confortable.

49,9 $US/mois

Renouvellement mensuel, annulation à tout moment.

2 000 crédits

≈ 6 à 100 vidéos, selon le modèle

≈ 142 à 666 images, selon le modèle

2.50¢ / crédit

3 tâches parallèles

  • 1080p · Sans filigrane · Usage commercial
  • Les crédits sont réinitialisés chaque mois de facturation
  • Accès à tous les modèles
  • Résultats sans filigrane
  • Acheter un pack de crédits supplémentaire
  • Support prioritaire

Mensuel Avancé

Recommandé

Production à grand volume pour les créateurs prolifiques et les petites équipes.

89,9 $US/mois

Renouvellement mensuel, annulation à tout moment.

5 000 crédits

≈ 15 à 250 vidéos, selon le modèle

≈ 357 à 1666 images, selon le modèle

1.80¢ / crédit

5 tâches parallèles

  • 1080p · Sans filigrane · Usage commercial
  • Les crédits sont réinitialisés chaque mois de facturation
  • Accès à tous les modèles
  • Résultats sans filigrane
  • Acheter un pack de crédits supplémentaire
  • Support prioritaire

FAQ

Ce qu'est Z-Image Turbo, combien ça coûte, et ce qu'il peut et ne peut pas faire.

Essayez Z-Image Turbo gratuitement
Puis-je utiliser Z-Image Turbo gratuitement ?

Oui. Inscrivez-vous sur Ricebowl et vous recevez 20 crédits gratuits, assez pour quatre images, sans carte bancaire. Ensuite, chaque image coûte 5 crédits fixes. Les poids ouverts sont également gratuits à télécharger sous licence Apache 2.0 si vous avez votre propre GPU de 16 Go.

Qu'est-ce que le modèle d'image Z-Image Turbo ?

Z-Image Turbo est un modèle texte-image de 6 milliards de paramètres qui génère en 8 étapes. C'est une version distillée de Z-Image construite sur un transformateur de diffusion à flux unique, et il se concentre sur le photoréalisme, le texte bilingue anglais et chinois, et le suivi des instructions.

Qui a créé Z-Image ?

Tongyi-MAI, un laboratoire au sein du groupe Tongyi d'Alibaba. Le nom chinois du projet est 造相. L'équipe Qwen de la même entreprise fabrique Qwen Image, qui est également sur Ricebowl.

Z-Image Turbo est-il open source et puis-je l'exécuter localement ?

Oui. Tongyi-MAI publie les poids de 6B sous licence Apache 2.0 sur Hugging Face et ModelScope, vous pouvez donc l'exécuter localement avec diffusers ou ComfyUI si vous disposez d'un GPU avec environ 16 Go de VRAM. Sur Ricebowl, il s'exécute dans le navigateur, sans installation et sans carte graphique.

Combien d'images de référence puis-je utiliser ?

Aucune sur Ricebowl. Z-Image Turbo fonctionne ici uniquement en mode texte-image, donc chaque image part de votre prompt. Pour un travail guidé par référence, passez à FLUX.2 Pro (jusqu'à 8 images) ou Seedream 5.0 Lite (jusqu'à 14) dans le sélecteur de modèle.

Z-Image peut-il modifier des photos ?

Pas sur Ricebowl. Tongyi-MAI répertorie l'édition sous des checkpoints distincts Z-Image-Edit et Z-Image-Omni-Base, et non sous Turbo. Pour modifier une photo ici, utilisez FLUX.2, Seedream ou Qwen Image.

Quels rapports d'aspect prend-il en charge ?

Cinq sur Ricebowl : 1:1, 16:9, 9:16, 4:3 et 3:4. Tous coûtent les mêmes 5 crédits.

Z-Image contre FLUX : lequel est le plus rapide ?

Turbo. C'est un modèle de 6B qui fonctionne en 8 étapes, tandis que le checkpoint ouvert FLUX.2 [dev] est de 32B. FLUX.2 l'emporte sur l'édition basée sur la référence ; Z-Image Turbo l'emporte sur le temps jusqu'à la première image.

Est-il bon pour la conception graphique professionnelle ?

Pour les brouillons, les mood boards et les graphiques sociaux, oui : le texte est lisible et le réalisme est élevé. Pour les mises en page d'impression finales nécessitant 4K ou des modifications précises, terminez sur Seedream ou FLUX.2.

Où puis-je utiliser Z-Image Turbo en ligne ?

Ici même sur Ricebowl. Le générateur en haut de cette page exécute Z-Image Turbo dans votre navigateur sans ComfyUI, sans GPU et sans clé API, et vous pouvez le comparer avec FLUX.2, Qwen Image et Seedream sur le même prompt.

LIÉ

Découvrez les modèles d'images IA d'Alibaba

Commencez à utiliser le modèle d'image IA Z-Image Turbosur Ricebowl dès maintenant !

Huit étapes, résultats photoréalistes, texte anglais et chinois, et aucun GPU à acheter.

Essayez Z-Image Turbo gratuitement

20 CRÉDITS GRATUITS À L'INSCRIPTION · 5 CRÉDITS PAR IMAGE · GÉNÉRATION EN 8 ÉTAPES · TEXTE BILINGUE

Commencez à utiliser le modèle d'image IA Z-Image Turbo

Essayez Z-Image Turbo gratuitement