写実的な画像
モデルカードが最初に挙げているのが写実的な画像生成です。ポートレート、街の風景、商品写真のような画に向いています。
Tongyi の Z-Image Turbo をブラウザからそのまま使えます。プロンプトを書けばすぐに画像ができ、1 枚 1 クレジット。登録で無料クレジット付き、インストール不要。
Z-Image Turbo はテキストからの画像生成専用で、出力サイズは 1 種類(約 100 万画素)です。写真の編集や 2K・4K での生成は、通常の画像生成ツールをご利用ください。
Z-Image Turbo は、Alibaba の Tongyi-MAI チームが 2025 年 11 月に Apache 2.0 ライセンスで公開したオープンソースの画像生成モデルです。パラメータ数は 60 億で、チームが Single-Stream Diffusion Transformer と呼ぶアーキテクチャを採用しています。
Turbo は Z-Image の蒸留版です。モデルカードによると 1 枚あたり 8 ステップのサンプリングで済むため、速く、低コストで動きます。ここで 1 枚 1 クレジットで提供できるのもそのためです。
Z-Image Turbo のモデルカードに挙げられている強みです。
モデルカードが最初に挙げているのが写実的な画像生成です。ポートレート、街の風景、商品写真のような画に向いています。
英語と中国語の両方の文字を描けるので、漢字の入った看板やポスター、ラベルも読める形で出力されます。
モデルカードは指示への追従性が堅実だとしています。何をどこに置くかという指定が結果に反映されやすいモデルです。
一般的な数十ステップではなく 8 ステップ。そのため、このページでは通常の画像生成ツールよりずっと速く画像ができます。
どれもこのページで生成したものです。キャプションはモデルに送ったプロンプトの原文です。




モデルの仕組みから言えることをまとめました。
Turbo 版はネガティブプロンプトに対応していません。「人はいらない」ではなく、見たい「誰もいない通り」を描写してください。
画像に必ず入れたい文字は引用符で囲み、どこに置くかも書きます。英語でも中国語でも構いません。
被写体、場面、光、レンズ、スタイル。プロンプトは最大 1,000 文字で、書いた細部はモデルが使ってくれます。
1 枚 1 クレジットで、待ち時間も短めです。良い結果への近道は、何枚か生成しながらプロンプトを調整することです。
1 枚 1 クレジットで、TikTomato のツールの中で最も安い価格です。新規アカウントには無料クレジットが付くので、支払いなしで試せます。
通常の画像生成ツールよりずっと短時間です。正確な時間は混雑状況によって変わり、しばらく利用がなかった後の 1 枚目は長くかかることがあります。
約 100 万画素です。16:9 なら 1280x720 ピクセル、4:3 なら 1152x864 ピクセル。比率は 1:1、4:3、3:4、16:9、9:16 から選べます。もっと大きくしたい場合は、結果を画像高画質化ツールにかけてください。
Z-Image Turbo ではできません。テキストから画像を生成するモデルです。通常の画像生成ツールなら参照画像を最大 4 枚まで追加できます。
Z-Image Turbo は速度とコストを重視した、はるかに小さなモデルです。アイデア出しや下書き、写実的な場面に向いています。複雑な構図、長い文字、写真の編集には、通常の生成ツールの GPT Image のほうが適しています。
モデルは Apache 2.0 ライセンスで公開されており、出力の商用利用は制限されていません。何を作り、どう使うかはご自身の責任となります。
プロンプトと結果は、性的な内容などセンシティブな内容がないかチェックされ、該当したリクエストは拒否されます。プロンプトを言い換えて再度お試しください。拒否または失敗したリクエストのクレジットは返還されます。