Z-Image Turbo AI画像モデル

Z-Image TurboはAlibabaの8ステップ蒸留画像モデルです。数秒でフォトリアルなフレームと明瞭な英語または中国語のテキストを生成し、1画像あたりわずか5クレジット。ブラウザ上で動作し、GPUは不要。新規アカウントには20クレジットを無料で提供しています。

推定 — クレジット

Make something with Z-Image Turbo

ギャラリー

Z-Image Turboの無限の可能性を発見

商品シーンのプレースホルダー画像
スタジオ静物、プレースホルダー画像
ライフスタイル商品ショット、プレースホルダー画像
元写真の例、プレースホルダー画像
編集済み写真の例、プレースホルダー画像
パッケージのヒーローショット、プレースホルダー画像

機能01

実世界の知識とプロンプトの基底ランドマークの外観を理解しています

このモデルは、プロンプト内の単語を描くだけでなく、それらの単語が暗示する内容を補完します。モデルは豊富な世界知識を持ち、Tongyi-MAI独自のパイプラインはさらにプロンプトエンハンサーを追加しているため、西安の大雁塔、漢服の刺繍スタイル、春のパリのカフェテラスなどを指定するプロンプトに対して、詳細な説明なしに正しい建築、衣装の細部、光を生成します。その結果、再生成の回数が減り、短いプロンプトでも頭の中のイメージに近い結果が得られます。また、光源に合った反射やランプから離れる影など、現実世界の小さな論理も正しく保持します。

  • 世界知識がプロンプトの暗示を補完
  • 実在の場所、衣装、物体を名前で認識
  • 短いプロンプトで意図したシーンに近い結果
世界知識レンダリング、プレースホルダー

機能02

バッチ全体で一貫したルックZ-Image Turbo画像を素早くバッチ生成

強化学習によりTurboは各プロンプトに対して1つの洗練された回答に収束します。Tongyi-MAI独自のモデル評価表では、Turboの画質は「Very High」、多様性は「Low」と評価されています。これは一見欠点に思えますが、セットが必要な場合には強みになります。同じプロンプトを10回実行しても、照明、パレット、スタイリングがブランドから逸脱せず一貫します。そのため、キャンペーンで同じルックの20枚のタイルが必要な場合や、キャラクターの説明を毎回認識可能な形で再現したい場合に、Turboが最適なモデルです。バリエーションが必要な場合は、シードではなくプロンプトを変更してください。

  • プロンプト繰り返し時の安定したスタイリング
  • 記述したキャラクター設定を保持して再利用
  • 新しいアイデアにはシードではなく文言を変更
一致するタイルのバッチ、プレースホルダー

機能03

バイリンガルタイポグラフィとローカライゼーション英語と中国語のテキストを正しく表示

正確なバイリンガルテキストレンダリングは、Tongyi-MAIがこのモデルの3大特長として挙げるものの1つで(残りはフォトリアリズムと指示追従)、引用符で囲んだ単語を看板、ポスター、パッケージ、画面に英語と中国語、または1枚の画像に両方で配置します。多くの画像モデルは複雑な漢字のストロークを誤って描画しますが、このモデルは判読可能に保ちます。これは中国市場に販売するショップや、バイリンガルメニュー、ランタンフェスティバルのポスター、両方の文字を含む製品ラベルを作成する場合に有用です。プロンプト自体も英語または中国語で記述できます。

  • 同じ画像に英語と中国語のテキスト
  • 看板やラベルの複雑な文字が判読可能
  • プロンプトを英語または中国語で入力可能
バイリンガルポスター、プレースホルダー

機能04

強化学習により調整された指示追従プロンプトに5つの詳細を入力すれば、5つの詳細が返ってくる

高速モデルは通常、速度と引き換えに従順さを犠牲にします。TurboはDMDRでそのギャップを埋めます。DMDRはTongyi-MAIの手法で、分布マッチング蒸留と強化学習をトレーニング後に組み合わせたもので、少ステップ生成でのセマンティックアライメントの向上と豊かなディテールを目指しています。実際にTurboはマルチパートプロンプトを保持します:赤い漢服の女性、鳳凰の頭飾り、扇子、手のひらの上のネオンランプ、後ろの塔はすべて指定した場所に現れます。Alibaba AI Arenaの人間選好リーダーボードで、Tongyi-MAIはTurboがオープンソースモデルの中で最先端であると報告しています。

  • マルチパートプロンプトにより、要求されたすべての要素が保持されます
  • セマンティックアライメントのためのRLチューニング蒸留
  • Tongyi-MAIによると、Alibaba AI Arenaでトップのオープンソース結果
マルチエレメントプロンプトレンダリング、プレースホルダー

機能05

5つのアスペクト比でフォトリアリスティックなディテールフィード、バナー、商品ページに最適

フォトリアリズムはTongyi-MAIがモデルについて示す最初の機能です:本物の写真と見紛う肌の質感、織物の織り目、自然光。Ricebowlでは生成前に5つのフレームから1つを選択します。1:1はフィードやマーケットプレイスに、16:9はバナーやサムネイルに、9:16はストーリーに、4:3または3:4は商品ページに適しています。すべての画像は同じ5クレジットなので、適切なフレームを選んでも価格は変わりません。4Kが必要な印刷物には、同じモデルピッカーでSeedream 5.0 Liteに切り替えてください。

  • フォトリアリスティックな肌、布地、照明
  • 5つのアスペクト比:1:1、16:9、9:16、4:3、3:4
  • Ricebowlでは1画像あたり一律5クレジット
フォトリアリスティックなポートレート、プレースホルダー

プロンプト例

Z-Image Turboプロンプト

プロンプト

台北の夜市の通り、手描きの看板に「阿明豆花 Ming's Tofu Pudding」と書かれた屋台、鍋から立ち上る湯気、暖かいタングステン電球、浅い被写界深度、35mmフィルムで撮影。

参考画像

参考画像

結果

結果

プロンプト

ミニマルなスキンケア広告、淡い砂の上のすりガラスのボトル、柔らかな朝の影、上部に細いサンセリフ体で「HYDRATE」の見出し、コピー用のクリーンなネガティブスペース。

参考画像

参考画像

結果

結果

ユースケース

Z-Image Turboの利用者

ソーシャルメディアマネージャー

Turboはライブでブレインストーミングできるほど速く画像を返し、一貫したルックで1週間の投稿を1つのビジュアルアイデンティティに保ちます。

中国語話者のバイヤーをターゲットにする販売者

バイリンガルのテキストレンダリングにより、同じバナーやラベルに英語と中国語を配置できるため、1つのリスティング画像が2つのマーケットプレイスで機能します。

コンセプトアーティストとアートディレクター

5クレジットで安価かつ迅速に下書きできるため、ムードボードエンジンとして活用できます。ここで構図を反復し、選んだアイデアをより遅いモデルで完成させます。

大きなGPUを持たないオープンソースユーザー

Turboが16GBのVRAMで動作すると読んだがノートPCしか持っていない人は、インストール不要で同じモデルを利用するためにRicebowlを使用します。

セルフホスティング前にテストする開発者

モデルはApache 2.0です。チームはまずRicebowlでプロンプトをテストし、ローカルデプロイのセットアップに値するかどうかを判断します。

利用者の声

クリエイターが繰り返し指摘する点

01

速度が乗り換えの理由

「手順が数回で済む」と最初に挙げられます。プロンプトを読み終える前にドラフトが届きます。

02

サイズ以上のリアリズム

6BパラメータのTurboは32BのFLUX.2 [dev] チェックポイントのごく一部ですが、ポートレートや商品写真は並べても見劣りしません。

03

中国語テキストも正確に

バイリンガル看板を作るユーザーは、漢字がほぼ正しく表示され、近似グリフにならないと評価しています。

04

プロンプトごとの多様性は少なめ

一貫性の裏返しです。同じプロンプトで再生成すると似た画像になります。新しいものが欲しいときはプロンプトを書き換えてください。

Z-Image Turbo を無料で試す

どちらを選ぶか

Z-Image Turbo vs Z-Image

Tongyi-MAIはこのモデルを2つの主要な形態で提供しています。Turboは高速性のために蒸留されたもの、ベースのZ-ImageはTurboが蒸留される元となった非蒸留チェックポイントです。RicebowlはTurboを実行します。

Turbo

8ステップの蒸留で、分類器不要ガイダンスなし、強化学習で非常に高い画質に調整。高速で一貫性があり、Ricebowlで1画像5クレジットで動作するバージョンです。

Base

約50ステップ、低速で、プロンプトあたりの多様性が高く、ネガティブプロンプトに対応。ファインチューニング用のチェックポイントです。編集は別のZ-Image-Editバリアントにあります。

際立つ特徴

Z-Image Turboの際立つ点

01

GPU不要でZ-Image Turboを実行

ComfyUIやグラフィックカードは不要です。ローカルでは16GB VRAM GPUとdiffusers環境が必要ですが、RicebowlではどんなノートPCやスマートフォンのブラウザタブでも動作し、数秒で結果がフィードに表示されます。

02

Z-Image Turbo vs FLUX.2

速度重視ならTurbo、詳細さや編集ならFLUX.2を選んでください。Turboは6Bモデルで8ステップで完了、オープンなFLUX.2 [dev] チェックポイントは32Bです。Ricebowl上のFLUX.2 Proは最大8枚の参照画像と写真編集をサポートしますが、Turboでは提供されません。

03

Apache 2.0、誰でもオープン

Tongyi-MAIはTurboをApache 2.0ライセンス(オープンソースAIで最も寛容なライセンスの1つ)でリリースしています。重みはHugging FaceとModelScopeで公開されており、ここで学んだことはすべて独自のデプロイに活かせます。

私たちの評価

Z-Image Turboの評価

Z-Imageが最も得意とするのは?

高速なフォトリアルなドラフトとバイリンガルテキストです。ポートレート、商品写真、英語+中国語の看板に使用してください。これらは開発者が最も重視する3つのスキルです。Ricebowlではテキストから画像のみなので、写真編集には使わないでください。

Z-Image と FLUX.2、どちらが速い?

Z-Image Turboです。8回の関数評価を実行し、Tongyi-MAIはH800 GPUでサブミリ秒のレイテンシを報告しています。FLUX.2 [dev] は32Bパラメータで5倍以上のサイズがあり、FLUX.2 Flexの例では6〜50ステップを使用します。

ローカルで実行するか、オンラインで?

16GB GPUを所有していて大量の画像を生成する場合を除き、オンラインをお勧めします。Ricebowlでは1画像5クレジットなので、適切なグラフィックカードのコストで非常に多くの画像を購入でき、ドライバやアップデートの管理も不要です。

比較

Z-Image Turbo vs FLUX.2 vs Qwen Image:パフォーマンス比較表

機能Z-Image TurboFLUX.2 ProQwen Image 3.0
メーカーAlibaba Tongyi-MAIBlack Forest LabsAlibaba Qwen チーム
Ricebowl のクレジット画像1枚につき51Kで5、2Kで7画像1枚につき5
サンプリングステップ8プロバイダーによる設定プロバイダーによる設定
Ricebowl の参照画像なし、テキストから画像のみ最大8枚最大3枚
Ricebowl での写真編集いいえはいはい
テキスト描画力英語と中国語複雑なタイポグラフィ複雑なテキスト、特に中国語
オープンウェイトはい、Apache 2.0 (6B)ファミリーにはFLUX.2 [dev]、32BQwen-Image は Apache 2.0
最適な用途高速なフォトリアルな下書き詳細と複数参照画像の編集テキストが多いレイアウトと編集

おすすめ:テキストだけからクリーンな画像を素早く作成したい場合は、Z-Image Turbo から始めてください。参照写真が必要な場合は FLUX.2 Pro、密集した中国語テキストや画像内テキスト編集が重要な場合は Qwen Image に切り替えてください。

Z-Image Turbo を無料で試す

使い方

Z-Image Turbo AI 画像モデルを無料で使う方法

Z-Image Turbo を無料で試す

01

サインアップして生成ツールを開く

このページ上部の生成ツールは既に Z-Image Turbo を実行しています。無料アカウントを作成してください:20クレジットが付与され、画像1枚につき5クレジット消費します。

02

明確なプロンプトを書く

被写体、設定、照明、カメラを説明してください。画像に必ず表示したい単語は、英語または中国語で引用符で囲んでください。

03

フレームを選択して生成

1:1、16:9、9:16、4:3、3:4から選択し、生成を押します。Z-Image Turboの画像が下のフィードに表示され、ワンクリックでダウンロードできます。

レビュー

世界中のクリエイターとマーケターに選ばれています

RicebowlでZ-Image Turboを使用している方々の声です。

Chen Yu

1つのバナーに英語と中国語の見出し、両方とも正しく綴られている。今までは毎回手動で中国語を修正していました。

クロスボーダーセラー

Laura Fischer

一度に1週間分の投稿をブレインストーミングできます。画像1枚5クレジットなので、やり直しを心配する必要がありません。

ソーシャルメディアマネージャー

Ryan Mitchell

Z-Image Turboは私のムードボードマシンです。速く、リアルで、セット全体で一貫した見た目を保てます。

インディーゲームアートディレクター

Aiko Tanaka

私のノートパソコンには本格的なGPUがありません。ここでは、何もインストールせずにRedditで皆が話題にしているモデルを利用できます。

ノートパソコンで働くイラストレーター

Samuel Adeyemi

セルフホストを決める前に、Ricebowlでプロンプトセットをテストしました。セットアップに1週間かかる手間が省けました。

MLエンジニア

AI画像生成ツールの料金

残高は一つ、モデルはすべて。クレジットは20種類すべての動画モデルで使えます。ウォーターマークなし、プランによるモデル制限なし、有料プランはすべて商用利用可。

年払いで30%お得

年間払いでさらに節約。

ミニプラン月額

最も低い価格で始められるプラン。すべてのモデルを、お試しサイズの毎月の枠で。

$7.99/月

毎月更新、いつでもキャンセル可能。

200 クレジット

≈ 0〜10 本(どのモデルを使うかで変わります)

≈ 14〜66 枚(どのモデルを使うかで変わります)

4.00¢ / クレジット

  • 1080p · ウォーターマークなし · 商用利用可
  • クレジットは請求月ごとにリセット
  • 全モデルを利用可能
  • ウォーターマークなしの出力
  • 追加クレジットパックを購入可能
  • 標準サポート

ライトプラン月額

最も安く始められる方法。すべてのモデルを、小さな毎月の枠で。

$12.99/月

毎月更新、いつでもキャンセル可能。

400 クレジット

≈ 1〜20 本(どのモデルを使うかで変わります)

≈ 28〜133 枚(どのモデルを使うかで変わります)

3.25¢ / クレジット

  • 1080p · ウォーターマークなし · 商用利用可
  • クレジットは請求月ごとにリセット
  • 全モデルを利用可能
  • ウォーターマークなしの出力
  • 追加クレジットパックを購入可能
  • 標準サポート

スタータープラン月額

おすすめ

すべてのモデルを一通り試し、毎月数本を仕上げられる分量です。

$29.9/月

毎月更新、いつでもキャンセル可能。

1,000 クレジット

≈ 3〜50 本(どのモデルを使うかで変わります)

≈ 71〜333 枚(どのモデルを使うかで変わります)

2.99¢ / クレジット

同時実行 2 件

  • 1080p · ウォーターマークなし · 商用利用可
  • クレジットは請求月ごとにリセット
  • 全モデルを利用可能
  • ウォーターマークなしの出力
  • 追加クレジットパックを購入可能
  • 標準サポート

標準マンスリー

人気

プロを目指す個人クリエイター向け。全モデルを余裕のある予算で。

$49.9/月

毎月更新、いつでもキャンセル可能。

2,000 クレジット

≈ 6〜100 本(どのモデルを使うかで変わります)

≈ 142〜666 枚(どのモデルを使うかで変わります)

2.50¢ / クレジット

同時実行 3 件

  • 1080p · ウォーターマークなし · 商用利用可
  • クレジットは請求月ごとにリセット
  • 全モデルを利用可能
  • ウォーターマークなしの出力
  • 追加クレジットパックを購入可能
  • 優先サポート

高度なマンスリー

おすすめ

多作なクリエイターと小規模チームのための大量制作向け。

$89.9/月

毎月更新、いつでもキャンセル可能。

5,000 クレジット

≈ 15〜250 本(どのモデルを使うかで変わります)

≈ 357〜1666 枚(どのモデルを使うかで変わります)

1.80¢ / クレジット

同時実行 5 件

  • 1080p · ウォーターマークなし · 商用利用可
  • クレジットは請求月ごとにリセット
  • 全モデルを利用可能
  • ウォーターマークなしの出力
  • 追加クレジットパックを購入可能
  • 優先サポート

よくある質問

Z-Image Turboの概要、料金、およびできること・できないことについて。

Z-Image Turbo を無料で試す
Z-Image Turboは無料で使えますか?

はい。Ricebowlにサインアップすると、20の無料クレジットがもらえます(画像4枚分に相当)。クレジットカードは不要です。その後は、画像1枚につき一律5クレジットかかります。オープンウェイトもApache 2.0ライセンスで無料ダウンロード可能ですが、16GBのGPUが必要です。

Z-Image Turbo 画像モデルとは何ですか?

Z-Image Turbo は、60億パラメータのテキストから画像を生成するモデルで、8ステップで生成します。シングルストリーム拡散トランスフォーマーをベースにした Z-Image の蒸留版であり、写実性、英語と中国語のバイリンガルテキスト、および指示追従に重点を置いています。

Z-Image を開発したのは誰ですか?

アリババの Tongyi グループ内の研究所である Tongyi-MAI です。中国語のプロジェクト名は「造相」です。同じ会社の Qwen チームが Qwen Image を開発しており、これも Ricebowl で利用できます。

Z-Image Turbo はオープンソースですか?ローカルで実行できますか?

はい。Tongyi-MAI は6Bの重みを Apache 2.0 ライセンスで Hugging Face と ModelScope に公開しています。そのため、約16GBのVRAMを持つGPUがあれば、diffusers や ComfyUI を使ってローカルで実行できます。Ricebowl ではブラウザ上で動作するため、インストールもグラフィックカードも不要です。

参照画像は何枚まで使用できますか?

Ricebowl では使用できません。Z-Image Turbo はここではテキストから画像への生成のみを実行するため、すべての画像はプロンプトから作成されます。参照画像を使ったガイド付き生成が必要な場合は、モデルピッカーで FLUX.2 Pro(最大8枚)または Seedream 5.0 Lite(最大14枚)に切り替えてください。

Z-Image で写真を編集できますか?

Ricebowl ではできません。Tongyi-MAI は編集機能を別の Z-Image-Edit および Z-Image-Omni-Base チェックポイントで提供しており、Turbo には含まれていません。ここで写真を編集するには、FLUX.2、Seedream、または Qwen Image を使用してください。

対応しているアスペクト比は?

Ricebowl では5種類:1:1、16:9、9:16、4:3、3:4です。すべて同じ5クレジットで生成できます。

Z-Image と FLUX ではどちらが速いですか?

Turbo です。6Bモデルで8ステップで動作するのに対し、オープンな FLUX.2 [dev] チェックポイントは32Bです。FLUX.2 は参照ベースの編集に優れており、Z-Image Turbo は最初の画像が生成されるまでの時間で優れています。

プロのグラフィックデザインに適していますか?

ラフ案、ムードボード、ソーシャルグラフィックには適しています。テキストが読みやすく、写実性も高いです。4Kや精密な編集が必要な最終印刷レイアウトには、Seedream または FLUX.2 で仕上げてください。

Z-Image Turbo をオンラインで利用できる場所は?

この Ricebowl 上でご利用いただけます。このページ上部のジェネレーターは、ComfyUI、GPU、APIキーを必要とせず、ブラウザ上で Z-Image Turbo を実行できます。同じプロンプトで FLUX.2、Qwen Image、Seedream と比較することもできます。

関連

Alibaba AI画像モデルを見る

Z-Image Turbo AI 画像モデルを今すぐ使い始めるRicebowl で!

8ステップ、写実的な結果、英語と中国語のテキスト、GPUは不要。

Z-Image Turbo を無料で試す

サインアップで20クレジット無料 · 画像1枚あたり5クレジット · 8ステップ生成 · バイリンガルテキスト

Z-Image Turbo AI 画像モデルを今すぐ使い始める

Z-Image Turbo を無料で試す