ソーシャルメディアマネージャー
Turboはライブでブレインストーミングできるほど速く画像を返し、一貫したルックで1週間の投稿を1つのビジュアルアイデンティティに保ちます。

Z-Image TurboはAlibabaの8ステップ蒸留画像モデルです。数秒でフォトリアルなフレームと明瞭な英語または中国語のテキストを生成し、1画像あたりわずか5クレジット。ブラウザ上で動作し、GPUは不要。新規アカウントには20クレジットを無料で提供しています。



ギャラリー






機能01
このモデルは、プロンプト内の単語を描くだけでなく、それらの単語が暗示する内容を補完します。モデルは豊富な世界知識を持ち、Tongyi-MAI独自のパイプラインはさらにプロンプトエンハンサーを追加しているため、西安の大雁塔、漢服の刺繍スタイル、春のパリのカフェテラスなどを指定するプロンプトに対して、詳細な説明なしに正しい建築、衣装の細部、光を生成します。その結果、再生成の回数が減り、短いプロンプトでも頭の中のイメージに近い結果が得られます。また、光源に合った反射やランプから離れる影など、現実世界の小さな論理も正しく保持します。

機能02
強化学習によりTurboは各プロンプトに対して1つの洗練された回答に収束します。Tongyi-MAI独自のモデル評価表では、Turboの画質は「Very High」、多様性は「Low」と評価されています。これは一見欠点に思えますが、セットが必要な場合には強みになります。同じプロンプトを10回実行しても、照明、パレット、スタイリングがブランドから逸脱せず一貫します。そのため、キャンペーンで同じルックの20枚のタイルが必要な場合や、キャラクターの説明を毎回認識可能な形で再現したい場合に、Turboが最適なモデルです。バリエーションが必要な場合は、シードではなくプロンプトを変更してください。

機能03
正確なバイリンガルテキストレンダリングは、Tongyi-MAIがこのモデルの3大特長として挙げるものの1つで(残りはフォトリアリズムと指示追従)、引用符で囲んだ単語を看板、ポスター、パッケージ、画面に英語と中国語、または1枚の画像に両方で配置します。多くの画像モデルは複雑な漢字のストロークを誤って描画しますが、このモデルは判読可能に保ちます。これは中国市場に販売するショップや、バイリンガルメニュー、ランタンフェスティバルのポスター、両方の文字を含む製品ラベルを作成する場合に有用です。プロンプト自体も英語または中国語で記述できます。

機能04
高速モデルは通常、速度と引き換えに従順さを犠牲にします。TurboはDMDRでそのギャップを埋めます。DMDRはTongyi-MAIの手法で、分布マッチング蒸留と強化学習をトレーニング後に組み合わせたもので、少ステップ生成でのセマンティックアライメントの向上と豊かなディテールを目指しています。実際にTurboはマルチパートプロンプトを保持します:赤い漢服の女性、鳳凰の頭飾り、扇子、手のひらの上のネオンランプ、後ろの塔はすべて指定した場所に現れます。Alibaba AI Arenaの人間選好リーダーボードで、Tongyi-MAIはTurboがオープンソースモデルの中で最先端であると報告しています。

機能05
フォトリアリズムはTongyi-MAIがモデルについて示す最初の機能です:本物の写真と見紛う肌の質感、織物の織り目、自然光。Ricebowlでは生成前に5つのフレームから1つを選択します。1:1はフィードやマーケットプレイスに、16:9はバナーやサムネイルに、9:16はストーリーに、4:3または3:4は商品ページに適しています。すべての画像は同じ5クレジットなので、適切なフレームを選んでも価格は変わりません。4Kが必要な印刷物には、同じモデルピッカーでSeedream 5.0 Liteに切り替えてください。

プロンプト例
プロンプト
台北の夜市の通り、手描きの看板に「阿明豆花 Ming's Tofu Pudding」と書かれた屋台、鍋から立ち上る湯気、暖かいタングステン電球、浅い被写界深度、35mmフィルムで撮影。
参考画像

結果

プロンプト
ミニマルなスキンケア広告、淡い砂の上のすりガラスのボトル、柔らかな朝の影、上部に細いサンセリフ体で「HYDRATE」の見出し、コピー用のクリーンなネガティブスペース。
参考画像

結果

ユースケース
Turboはライブでブレインストーミングできるほど速く画像を返し、一貫したルックで1週間の投稿を1つのビジュアルアイデンティティに保ちます。
バイリンガルのテキストレンダリングにより、同じバナーやラベルに英語と中国語を配置できるため、1つのリスティング画像が2つのマーケットプレイスで機能します。
5クレジットで安価かつ迅速に下書きできるため、ムードボードエンジンとして活用できます。ここで構図を反復し、選んだアイデアをより遅いモデルで完成させます。
Turboが16GBのVRAMで動作すると読んだがノートPCしか持っていない人は、インストール不要で同じモデルを利用するためにRicebowlを使用します。
モデルはApache 2.0です。チームはまずRicebowlでプロンプトをテストし、ローカルデプロイのセットアップに値するかどうかを判断します。
利用者の声
01
「手順が数回で済む」と最初に挙げられます。プロンプトを読み終える前にドラフトが届きます。
02
6BパラメータのTurboは32BのFLUX.2 [dev] チェックポイントのごく一部ですが、ポートレートや商品写真は並べても見劣りしません。
03
バイリンガル看板を作るユーザーは、漢字がほぼ正しく表示され、近似グリフにならないと評価しています。
04
一貫性の裏返しです。同じプロンプトで再生成すると似た画像になります。新しいものが欲しいときはプロンプトを書き換えてください。
どちらを選ぶか
Tongyi-MAIはこのモデルを2つの主要な形態で提供しています。Turboは高速性のために蒸留されたもの、ベースのZ-ImageはTurboが蒸留される元となった非蒸留チェックポイントです。RicebowlはTurboを実行します。
8ステップの蒸留で、分類器不要ガイダンスなし、強化学習で非常に高い画質に調整。高速で一貫性があり、Ricebowlで1画像5クレジットで動作するバージョンです。
約50ステップ、低速で、プロンプトあたりの多様性が高く、ネガティブプロンプトに対応。ファインチューニング用のチェックポイントです。編集は別のZ-Image-Editバリアントにあります。
際立つ特徴
01
ComfyUIやグラフィックカードは不要です。ローカルでは16GB VRAM GPUとdiffusers環境が必要ですが、RicebowlではどんなノートPCやスマートフォンのブラウザタブでも動作し、数秒で結果がフィードに表示されます。
02
速度重視ならTurbo、詳細さや編集ならFLUX.2を選んでください。Turboは6Bモデルで8ステップで完了、オープンなFLUX.2 [dev] チェックポイントは32Bです。Ricebowl上のFLUX.2 Proは最大8枚の参照画像と写真編集をサポートしますが、Turboでは提供されません。
03
Tongyi-MAIはTurboをApache 2.0ライセンス(オープンソースAIで最も寛容なライセンスの1つ)でリリースしています。重みはHugging FaceとModelScopeで公開されており、ここで学んだことはすべて独自のデプロイに活かせます。
私たちの評価
高速なフォトリアルなドラフトとバイリンガルテキストです。ポートレート、商品写真、英語+中国語の看板に使用してください。これらは開発者が最も重視する3つのスキルです。Ricebowlではテキストから画像のみなので、写真編集には使わないでください。
Z-Image Turboです。8回の関数評価を実行し、Tongyi-MAIはH800 GPUでサブミリ秒のレイテンシを報告しています。FLUX.2 [dev] は32Bパラメータで5倍以上のサイズがあり、FLUX.2 Flexの例では6〜50ステップを使用します。
16GB GPUを所有していて大量の画像を生成する場合を除き、オンラインをお勧めします。Ricebowlでは1画像5クレジットなので、適切なグラフィックカードのコストで非常に多くの画像を購入でき、ドライバやアップデートの管理も不要です。
比較
| 機能 | Z-Image Turbo | FLUX.2 Pro | Qwen Image 3.0 |
|---|---|---|---|
| メーカー | Alibaba Tongyi-MAI | Black Forest Labs | Alibaba Qwen チーム |
| Ricebowl のクレジット | 画像1枚につき5 | 1Kで5、2Kで7 | 画像1枚につき5 |
| サンプリングステップ | 8 | プロバイダーによる設定 | プロバイダーによる設定 |
| Ricebowl の参照画像 | なし、テキストから画像のみ | 最大8枚 | 最大3枚 |
| Ricebowl での写真編集 | いいえ | はい | はい |
| テキスト描画力 | 英語と中国語 | 複雑なタイポグラフィ | 複雑なテキスト、特に中国語 |
| オープンウェイト | はい、Apache 2.0 (6B) | ファミリーにはFLUX.2 [dev]、32B | Qwen-Image は Apache 2.0 |
| 最適な用途 | 高速なフォトリアルな下書き | 詳細と複数参照画像の編集 | テキストが多いレイアウトと編集 |
おすすめ:テキストだけからクリーンな画像を素早く作成したい場合は、Z-Image Turbo から始めてください。参照写真が必要な場合は FLUX.2 Pro、密集した中国語テキストや画像内テキスト編集が重要な場合は Qwen Image に切り替えてください。
Z-Image Turbo を無料で試す01
このページ上部の生成ツールは既に Z-Image Turbo を実行しています。無料アカウントを作成してください:20クレジットが付与され、画像1枚につき5クレジット消費します。
02
被写体、設定、照明、カメラを説明してください。画像に必ず表示したい単語は、英語または中国語で引用符で囲んでください。
03
1:1、16:9、9:16、4:3、3:4から選択し、生成を押します。Z-Image Turboの画像が下のフィードに表示され、ワンクリックでダウンロードできます。
レビュー
RicebowlでZ-Image Turboを使用している方々の声です。
1つのバナーに英語と中国語の見出し、両方とも正しく綴られている。今までは毎回手動で中国語を修正していました。
クロスボーダーセラー
一度に1週間分の投稿をブレインストーミングできます。画像1枚5クレジットなので、やり直しを心配する必要がありません。
ソーシャルメディアマネージャー
Z-Image Turboは私のムードボードマシンです。速く、リアルで、セット全体で一貫した見た目を保てます。
インディーゲームアートディレクター
私のノートパソコンには本格的なGPUがありません。ここでは、何もインストールせずにRedditで皆が話題にしているモデルを利用できます。
ノートパソコンで働くイラストレーター
セルフホストを決める前に、Ricebowlでプロンプトセットをテストしました。セットアップに1週間かかる手間が省けました。
MLエンジニア
残高は一つ、モデルはすべて。クレジットは20種類すべての動画モデルで使えます。ウォーターマークなし、プランによるモデル制限なし、有料プランはすべて商用利用可。
年払いで30%お得
年間払いでさらに節約。
最も低い価格で始められるプラン。すべてのモデルを、お試しサイズの毎月の枠で。
$7.99/月
毎月更新、いつでもキャンセル可能。
200 クレジット
≈ 0〜10 本(どのモデルを使うかで変わります)
≈ 14〜66 枚(どのモデルを使うかで変わります)
4.00¢ / クレジット
最も安く始められる方法。すべてのモデルを、小さな毎月の枠で。
$12.99/月
毎月更新、いつでもキャンセル可能。
400 クレジット
≈ 1〜20 本(どのモデルを使うかで変わります)
≈ 28〜133 枚(どのモデルを使うかで変わります)
3.25¢ / クレジット
すべてのモデルを一通り試し、毎月数本を仕上げられる分量です。
$29.9/月
毎月更新、いつでもキャンセル可能。
1,000 クレジット
≈ 3〜50 本(どのモデルを使うかで変わります)
≈ 71〜333 枚(どのモデルを使うかで変わります)
2.99¢ / クレジット
同時実行 2 件
プロを目指す個人クリエイター向け。全モデルを余裕のある予算で。
$49.9/月
毎月更新、いつでもキャンセル可能。
2,000 クレジット
≈ 6〜100 本(どのモデルを使うかで変わります)
≈ 142〜666 枚(どのモデルを使うかで変わります)
2.50¢ / クレジット
同時実行 3 件
多作なクリエイターと小規模チームのための大量制作向け。
$89.9/月
毎月更新、いつでもキャンセル可能。
5,000 クレジット
≈ 15〜250 本(どのモデルを使うかで変わります)
≈ 357〜1666 枚(どのモデルを使うかで変わります)
1.80¢ / クレジット
同時実行 5 件
柔軟な月額サブスクリプション。
すべてのモデルを一通り試し、毎月数本を仕上げられる分量です。
$19.9/月$29.9
年間$238.8で請求。毎年更新、いつでもキャンセル可能。
月額払いと比べて年間$120節約
12,000 クレジット
≈ 38〜600 本(どのモデルを使うかで変わります)
≈ 857〜4000 枚(どのモデルを使うかで変わります)
1.99¢ / クレジット
同時実行 2 件
プロを目指す個人クリエイター向け。全モデルを余裕のある予算で。
$34.9/月$49.9
年間$418.8で請求。毎年更新、いつでもキャンセル可能。
月額払いと比べて年間$180節約
24,000 クレジット
≈ 76〜1200 本(どのモデルを使うかで変わります)
≈ 1714〜8000 枚(どのモデルを使うかで変わります)
1.75¢ / クレジット
同時実行 3 件
多作なクリエイターと小規模チームのための大量制作向け。
$62.9/月$89.9
年間$754.8で請求。毎年更新、いつでもキャンセル可能。
月額払いと比べて年間$324節約
60,000 クレジット
≈ 190〜3000 本(どのモデルを使うかで変わります)
≈ 4285〜20000 枚(どのモデルを使うかで変わります)
1.26¢ / クレジット
同時実行 5 件
12ヶ月間有効なクレジットをチャージ。
時折のニーズに対する一回限りのチャージ。
$49.9
一回限りの購入、有効期限12ヶ月。
1,000 クレジット
≈ 3〜50 本(どのモデルを使うかで変わります)
≈ 71〜333 枚(どのモデルを使うかで変わります)
4.99¢ / クレジット
より良い単価での大規模な一回限りのチャージ。
$198
一回限りの購入、有効期限12ヶ月。
4,800 クレジット
≈ 15〜240 本(どのモデルを使うかで変わります)
≈ 342〜1600 枚(どのモデルを使うかで変わります)
4.13¢ / クレジット
同時実行 5 件
はい。Ricebowlにサインアップすると、20の無料クレジットがもらえます(画像4枚分に相当)。クレジットカードは不要です。その後は、画像1枚につき一律5クレジットかかります。オープンウェイトもApache 2.0ライセンスで無料ダウンロード可能ですが、16GBのGPUが必要です。
Z-Image Turbo は、60億パラメータのテキストから画像を生成するモデルで、8ステップで生成します。シングルストリーム拡散トランスフォーマーをベースにした Z-Image の蒸留版であり、写実性、英語と中国語のバイリンガルテキスト、および指示追従に重点を置いています。
アリババの Tongyi グループ内の研究所である Tongyi-MAI です。中国語のプロジェクト名は「造相」です。同じ会社の Qwen チームが Qwen Image を開発しており、これも Ricebowl で利用できます。
はい。Tongyi-MAI は6Bの重みを Apache 2.0 ライセンスで Hugging Face と ModelScope に公開しています。そのため、約16GBのVRAMを持つGPUがあれば、diffusers や ComfyUI を使ってローカルで実行できます。Ricebowl ではブラウザ上で動作するため、インストールもグラフィックカードも不要です。
Ricebowl では使用できません。Z-Image Turbo はここではテキストから画像への生成のみを実行するため、すべての画像はプロンプトから作成されます。参照画像を使ったガイド付き生成が必要な場合は、モデルピッカーで FLUX.2 Pro(最大8枚)または Seedream 5.0 Lite(最大14枚)に切り替えてください。
Ricebowl ではできません。Tongyi-MAI は編集機能を別の Z-Image-Edit および Z-Image-Omni-Base チェックポイントで提供しており、Turbo には含まれていません。ここで写真を編集するには、FLUX.2、Seedream、または Qwen Image を使用してください。
Ricebowl では5種類:1:1、16:9、9:16、4:3、3:4です。すべて同じ5クレジットで生成できます。
Turbo です。6Bモデルで8ステップで動作するのに対し、オープンな FLUX.2 [dev] チェックポイントは32Bです。FLUX.2 は参照ベースの編集に優れており、Z-Image Turbo は最初の画像が生成されるまでの時間で優れています。
ラフ案、ムードボード、ソーシャルグラフィックには適しています。テキストが読みやすく、写実性も高いです。4Kや精密な編集が必要な最終印刷レイアウトには、Seedream または FLUX.2 で仕上げてください。
この Ricebowl 上でご利用いただけます。このページ上部のジェネレーターは、ComfyUI、GPU、APIキーを必要とせず、ブラウザ上で Z-Image Turbo を実行できます。同じプロンプトで FLUX.2、Qwen Image、Seedream と比較することもできます。
8ステップ、写実的な結果、英語と中国語のテキスト、GPUは不要。
Z-Image Turbo を無料で試すサインアップで20クレジット無料 · 画像1枚あたり5クレジット · 8ステップ生成 · バイリンガルテキスト
Z-Image Turbo AI 画像モデルを今すぐ使い始める
Z-Image Turbo を無料で試す