写实图片
模型卡把写实图片生成放在第一位:人像、街景、产品照这类画面。
在浏览器里直接运行通义的 Z-Image Turbo。写一句提示词,很快出图,1 积分一张。注册送免费积分,不用安装任何东西。
Z-Image Turbo 只支持文字生成图片,输出尺寸固定(约 100 万像素)。要修改已有照片,或生成 2K、4K 图片,请使用通用图片生成工具。
Z-Image Turbo 是阿里巴巴通义 MAI 团队于 2025 年 11 月开源的图片生成模型,采用 Apache 2.0 许可证。模型有 60 亿参数,架构被团队称为单流扩散 Transformer(Single-Stream Diffusion Transformer)。
Turbo 是 Z-Image 的蒸馏版本:模型卡称它每张图只需要 8 步采样,所以又快又省算力。这也是它在这里只要 1 积分一张的原因。
以下是 Z-Image Turbo 模型卡列出的长处。
模型卡把写实图片生成放在第一位:人像、街景、产品照这类画面。
能同时渲染中文和英文,招牌、海报、标签上的汉字可以清楚认出来。
模型卡称它的指令遵循能力稳健:你要什么、放在哪里,结果里大体都能对上。
8 步采样,而不是常见的几十步。所以这一页出图比通用生成工具快得多。
下面每一张都是在这一页上生成的。图下是发给模型的提示词原文。




根据这个模型的工作方式整理。
Turbo 版本不支持反向提示词。与其写“不要有人”,不如直接描述你想看到的空街道。
必须出现在图上的文字放进引号,并说明放在哪里。中文和英文都可以。
主体、场景、光线、镜头、风格。提示词最多 1000 个字符,你给的细节模型都会用上。
1 积分一张、等得也不久,想要好结果,最快的办法就是多生成几张,边看边改提示词。
1 积分一张,是 TikTomato 上最便宜的工具。新账号送免费积分,不花钱就能试。
比通用生成工具快得多。具体时间随负载波动,一段时间没人用之后的第一张可能会慢一些。
约 100 万像素。16:9 的图是 1280x720 像素,4:3 是 1152x864。比例可选 1:1、4:3、3:4、16:9、9:16。想要更大的图,可以把结果交给我们的高清放大工具。
Z-Image Turbo 不行,它只支持文字生成图片。我们的通用图片生成工具可以添加最多 4 张参考图。
Z-Image Turbo 是一个小得多的模型,为速度和成本而设计,适合快速试想法、出草图和写实场景。构图复杂、文字很多或者要编辑照片时,通用生成工具里的 GPT Image 更合适。
模型采用 Apache 2.0 许可证,不限制输出内容的商业使用。生成什么、怎么用,由你自己负责。
提示词和结果都会做色情等敏感内容检查,被判定违规的请求会被拒绝。可以改一下提示词再试;被拒绝或生成失败的请求,积分会退回。