如果你有一张 8GB NVIDIA 显卡,想在本地跑 AI 生图,却被 ComfyUI 满屏节点劝退,达芬七公开的 Z-Image v1.4.0 一键包解决的是一个很具体的问题:把“装环境、找模型、挂 LoRA、记参数”压缩成“解压、双击、选风格、出图”。
但在看安装步骤之前,先回答最重要的问题:做完以后能得到什么。
先看结果:8GB 显卡实际能出什么图
下面第一张是原作者公开的基准结果:RTX 2080 8GB、标准 FP8、1024 分辨率、没有挂 LoRA。

人物、窗光、皮肤和室内细节已经能组成一张完整的生活感画面。它不是模型官网样片,而是原作者在自己的 8GB 测试机上直接生成的结果。
同一套环境还展示了四个跨度明显的方向:




这些图片足以展示这套环境从写实到插画的风格跨度。原帖没有逐张公开完全一致的提示词、种子和 LoRA 参数,因此不能把它们当成同参数横评,也不能理解成每次都能一键复现同等成品;它们回答的是“这套 8GB 工作流能够把画面带到哪些方向”。
看到结果以后,下面再从电脑条件、分卷解压、模型选择和第一张图开始。
这个 45GB 包里到底有什么
它不是另做了一个生图模型,而是在 Z-Image 和 ComfyUI 之上加了一层更适合新手的操作界面。ComfyUI 仍在后台负责推理,前台只保留普通用户真正需要的选项。
原作者公开的 v1.4.0 包含:
- 三个模型档位:标准 FP8、极低显存 GGUF、高质量 BF16;
- 42 个已经配置好的 LoRA:每个风格都有图卡、对应文件、默认强度和触发词;
- 文生图页面:填写提示词,选择比例、模型和风格后直接生成;
- 图库与参数记录:保留提示词、模型、LoRA、种子和尺寸;
- 一键回填:从图库把上一张图的参数重新带回出图页,继续改词或换种子;
- 运行状态与故障提示:显示真实生成进度,处理旧进程占用端口、停止后释放显存等问题;
- 诊断导出脚本:遇到启动失败、生成报错或 OOM 时,生成一份可交给 AI 编程 Agent 分析的诊断文件。
这里的“未审查生图”,指的是提示词不需要先经过网页平台的输入审核,不代表生成内容不需要承担版权、肖像或合规责任。
开始前先核对电脑
这套包当前只适合下面的环境:
| 项目 | 要求 | | --- | --- | | 显卡 | NVIDIA 独立显卡;文中的 8GB 指显存,不是电脑内存 | | 系统 | Windows 10 或 Windows 11 | | 硬盘 | 完整解压后约 45GB,优先放在本机 SSD | | 不支持 | AMD 显卡、Intel 显卡、只有核显的电脑不能直接运行 | | 启动位置 | 不要在压缩包、网盘同步目录或移动硬盘里直接启动 |
原作者是在英文 Windows 环境下制作和测试的。中文 Windows 属于主要目标环境;其他语言的系统如果出现终端乱码,优先怀疑编码兼容问题。
安装只有四步,但第一步最容易做错
建议从原作者的首条回复进入夸克网盘下载地址,避免使用来历不明的二次打包。
第一步:把所有分卷放进同一个文件夹
下载完整的 .7z.001、.7z.002、.7z.003……分卷,确认它们处在同一个文件夹里。
少一个分卷、文件名被网盘改动,或者把分卷拆到不同目录,都可能导致解压失败。不要逐个解压,也不要从 .002 开始。
第二步:只解压 .7z.001
对 .7z.001 执行一次解压,解压工具会自动读取后面的全部分卷。完成后,把整个文件夹放到本机硬盘,优先 SSD。
不要直接在压缩包预览窗口运行,也不要把程序留在网盘目录里启动。外接机械硬盘理论上可以读取,但第一次加载模型可能慢到失去测试意义。
第三步:双击 启动.bat
启动后不要立刻连续点击。先等页面顶部显示“引擎在线”,这代表后台 ComfyUI 和前台界面已经连通。
第一次运行需要加载模型,通常会比后续生成慢。如果页面能打开但一直没有“引擎在线”,先看后文的端口与诊断排查。
第四步:写提示词、选比例和风格,生成第一张图
第一次不要同时堆多个 LoRA。先选一个风格,把主体、场景和光线说清楚,再开始生成。
例如写实人物可以从这种简短描述开始:
窗边柔光,一位穿深色针织衫的年轻人,半身构图,自然肤质,生活化摄影,轻微胶片颗粒
插画可以从下面这种结构开始:
retro anime character, half body, warm sunset light, clean background, expressive eyes
重点不是把提示词写成长论文,而是先固定一个风格,只改变人物、场景或光线中的一项,观察哪部分真正影响结果。
8GB 显卡先选哪个模型档位
三个档位不是简单的“低、中、高画质”,而是针对不同显存条件的取舍。
标准 FP8:8GB 用户的默认档
原作者建议 8GB 显卡先从标准 FP8 开始。它是主要测试档,LoRA 的表现也相对稳定。第一次跑通流程,不要先改成更重的 BF16。
GGUF:显存更紧时的保底档
如果 FP8 仍然出现显存不足,可以换 GGUF。它的作用是进一步降低显存压力,不保证速度更快,部分 LoRA 的风格强度也可能减弱。
BF16:留给显存更充足的机器
BF16 保留更完整的精度,但需要更多显存。8GB 显卡不建议硬跑;“能启动”也不等于它适合作为日常档位。
42 个 LoRA 是怎样被简化成“看图选风格”的
普通人第一次用 LoRA,最容易卡在四件事:文件放在哪里、有没有挂对、触发词怎么写、强度设多少。
这套界面把四件事绑在了一起:每个风格对应一张固定图卡、一个 LoRA 文件、一组默认强度和触发词。选中图卡后,触发词会自动加入提示词,不需要背模型文件名。
原作者整理的类型包括写实抓拍、杂志人像、电影感、拍立得、水彩、水墨、欧美漫画、二次元、90 年代科幻动画和角色设定表等。选择时可以先这样分:
- 想要自然人像:先试写实抓拍、Aesthetic、拍立得;
- 想要叙事画面:先试电影感或偏 Midjourney 的风格;
- 想做二次元人物:从 Anime Art、复古科幻动画等单一风格开始;
- 想做分镜或设定:优先水彩、水墨、漫画和角色设定表。
原文里的风格图卡是预览,不是同一提示词、同一人物、同一参数下的实验室横评。不同 LoRA 擅长的题材不同,不能只看图卡就判断谁“更强”。
对 8GB 显卡来说,一次稳定运行一个 LoRA通常比同时叠两三个风格更有用,也更不容易随机 OOM。
RTX 2080 8GB 的实际速度参考
原作者的主要测试机是 RTX 2080 8GB、Windows 10、64GB 内存,模型放在本机硬盘。
在这台机器上,使用标准 FP8:
- 生成 720 尺寸图片,常见约 23—40 秒;
- 生成 1024 尺寸图片,常见约 40—60 秒;
- 峰值显存接近 8GB;
- 第一次冷加载会更慢。
这些数字是原作者单机实测,只能用来判断大致体感。显卡代际、驱动、提示词、分辨率和后台是否有其他程序占用显存,都会改变结果。
从第一张图到可复用结果,关键在图库回填
很多一键包只解决“出一张图”,这套工具更值得看的部分是怎样继续沿着上一张图修改。
生成完成后,图库会记录当时的提示词、模型、风格、种子和尺寸。点开图片,再使用“一键回填到文生图”,这些参数会重新回到出图页。
接下来可以只做一个变化:
- 保留种子和风格,只换人物服装;
- 保留人物和提示词,只换构图或尺寸;
- 保留画面方向,只换一个随机种子;
- 找到满意版本后,再交给在线模型放大、修手、补字或处理局部细节;
- 把最终采用的参数和成图一起归档。

这样,本地模型负责大量、便宜、可重复的方向探索,在线模型负责少量、明确的最后精修。8GB 显卡不一定承担最后一张 4K 成品,但可以先筛掉大量不合适的构图和风格。
启动失败、端口占用和 OOM 怎么处理
页面打不开或引擎不上线
先确认程序已经完整解压到本机硬盘,而不是在压缩包、网盘目录或移动硬盘中运行。然后关闭残留的启动窗口,重新运行 启动.bat。
如果前一次异常退出,旧进程可能仍占着端口。先结束旧进程再启动;不确定哪个进程有问题时,不要盲目删除文件,直接导出诊断信息。
生成过程中 OOM
按这个顺序收缩:
- 确认使用标准 FP8,而不是 BF16;
- 一次只启用一个 LoRA;
- 降低输出分辨率;
- 关闭浏览器视频、游戏或其他占用 GPU 的程序;
- 仍然不足时,再切换 GGUF。
GGUF 是省显存档,不是速度加速档。为了“更省显存”而误以为一定“更快”,容易对结果产生错误预期。
不知道报错是什么意思
双击包里的 导出诊断信息.bat,生成诊断 TXT。原作者说明,这份文件会遮挡用户名、电脑名和用户目录等信息。
把诊断 TXT 和报错截图交给能够处理本地文件的 AI 编程 Agent,例如 Codex 或 Claude Code,让它先判断是路径、端口、脚本、配置、驱动、硬件还是文件损坏。
路径、端口、脚本和一部分配置问题通常可以直接定位;驱动、硬件、文件损坏和系统兼容问题不一定一次解决,但至少不再从一句“打不开”开始猜。
这套工具真正做掉的,不只是安装
把 ComfyUI 藏到后台并不难,难的是让包在另一台电脑上继续可用。
原作者在公开说明里提到,实际处理了这些影响日常使用的问题:LoRA 必须挂到正确文件,生成进度不能假死,旧进程占用端口时要给出处理路径,停止生成后要释放显存,图库也不能只留下一张不知道怎样生成的图片。
所以它的实现思路可以概括成一句话:保留 ComfyUI 的推理能力,把新手真正需要操作和排错的部分重新做成一层简单界面。
第一次测试,先只跑通这一条
正式用于商业项目之前,记得核对所选 LoRA 的许可证,并按实际显卡、驱动和系统重新测试速度。本地运行也不改变版权、肖像和内容责任。
如果你的环境符合要求,最有效的测试不是先研究全部 42 个风格,而是:用 FP8、一个 LoRA、一个 720 尺寸提示词,先跑通第一张图;再从图库回填,完成一次可复现修改。
这一步成功,才算真正把 45GB 从“下载收藏”变成了一个可以继续使用的本地工作流。