> For the complete documentation index, see [llms.txt](https://unsloth.ai/docs/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://unsloth.ai/docs/zh/ji-chu/diffusion-image.md).

# 如何使用 Unsloth 在本地运行图像扩散模型

使用 Unsloth，你可以在自己的电脑上使用扩散模型生成和编辑 AI 图像，无需写代码或设置复杂工作流。借助 Unsloth，你可以运行如下模型 **MiniMax-H3**, [**Qwen-Image-2.1**](/docs/zh/mo-xing/qwen-image-2.1.md)**，Z-Image** 和 **FLUX** 可在本地运行，并支持 **GGUF**, **FP8**, **LoRA**、参考图像等更多功能。先从文本提示词或现有图像开始，然后使用每个模型支持的工具和工作流来创建、转换、编辑、扩展、放大或微调图像。

从以下内容中选择 **MiniMax-H3**, [**Qwen-Image-2.1**](/docs/zh/mo-xing/qwen-image-2.1.md)**,** **Z-Image、LTX、FLUX、SDXL 等更多模型**.

要创建你自己的 LoRA，可在你的数据集上微调受支持的模型。参见 <mark style="color:蓝色;">微调图像模型</mark> 以了解更多。

<div data-with-frame="true"><figure><img src="https://2657992854-files.gitbook.io/~/files/v0/b/gitbook-x-prod.appspot.com/o/spaces%2FxhOjnexMCB3dmuQFQ2Zq%2Fuploads%2FmG2HFa4hRVF1LA8AWcZc%2Fimage.png?alt=media&amp;token=250f56c3-ac31-4e7c-a733-8024a4e4fc3f" alt="" width="563"><figcaption></figcaption></figure></div>

### ⚡ 快速入门

{% stepper %}
{% step %}

### **安装或更新**

桌面应用是最简单的入门方式。

<a href="https://unsloth.ai/download" class="button primary" data-icon="down-to-bracket">下载 Unsloth 桌面版</a>

按照安装程序操作，然后从你的应用程序中打开该应用。如果你已经安装了它，请在继续之前确保它已是最新版本。

**命令行**

更喜欢终端？请运行适用于你操作系统的命令。同一条命令也会更新现有安装。

**MacOS、Linux、WSL：**

```bash
curl -fsSL https://unsloth.ai/install.sh | sh
```

**Windows PowerShell：**

```powershell
irm https://unsloth.ai/install.ps1 | iex
```

#### 启动 Unsloth

安装完成后，启动 Unsloth：

```bash
unsloth studio -H 0.0.0.0 -p 8888
```

打开 `http://localhost:8888` 如果它没有自动打开。
{% endstep %}

{% step %}

### 打开图片

选择 **图片** 从侧边栏中。 **创建** 工作流默认会打开。

<div data-with-frame="true"><figure><img src="https://2657992854-files.gitbook.io/~/files/v0/b/gitbook-x-prod.appspot.com/o/spaces%2FxhOjnexMCB3dmuQFQ2Zq%2Fuploads%2FEFCApsTzrL81lOcdd298%2Fimage.png?alt=media&amp;token=07fa0438-55f4-46ec-b055-2f4b6532df96" alt="" width="375"><figcaption></figcaption></figure></div>

现在我们可以进入下一步了。
{% endstep %}

{% step %}

### 选择模型

打开 **选择图像模型** 并从选择器中选择一个模型。

<div data-with-frame="true"><figure><img src="https://2657992854-files.gitbook.io/~/files/v0/b/gitbook-x-prod.appspot.com/o/spaces%2FxhOjnexMCB3dmuQFQ2Zq%2Fuploads%2F9rVVPAiJKVsY01x1oKYL%2Fimage.png?alt=media&amp;token=4d523fdd-7bb3-493f-9377-e12dd989c865" alt="" width="375"><figcaption></figcaption></figure></div>

该 **推荐** 选项卡是一个不错的起点。\
\
对于 GGUF 模型，适合你设备的最佳尺寸也会标记为 **推荐**。运行速度可能较慢或无法容纳的尺寸会标记为 **吃紧** 或 **OOM**.
{% endstep %}

{% step %}

### 输入提示词

描述你想生成的图像。

例如：

> 一张俯视图，展示日式庭院中宁静的锦鲤池，橙色、白色和黑色的锦鲤在清澈的水下游动，周围是长满苔藓的踏脚石和小木桥，水面漂浮着红色枫叶。明亮的正午光线，饱和的色彩，清晰的倒影。异想天开的卡通插画，50mm。

你可以先保留第一张图像的推荐设置。
{% endstep %}

{% step %}

### 生成你的第一张图像

选择 **生成**。第一次生成可能会更久，因为模型需要下载和加载。

你的结果会显示在图库中，你可以查看其设置或下载它。

<div data-with-frame="true"><figure><img src="https://2657992854-files.gitbook.io/~/files/v0/b/gitbook-x-prod.appspot.com/o/spaces%2FxhOjnexMCB3dmuQFQ2Zq%2Fuploads%2FT7kNykpOms4GymzxY4jT%2Fimage.png?alt=media&amp;token=8a2bf1bb-26d2-4f5c-a43f-6f5fec9005dc" alt="" width="563"><figcaption></figcaption></figure></div>
{% endstep %}
{% endstepper %}

### ⭐ 功能

可用的工作流取决于你加载的模型。不支持的工作流会自动隐藏。

#### 创建和编辑图像

* **创建：** 从文本提示词生成图像。
* **变换：** 使用现有图像作为新生成的起点。
* **局部重绘：** 选择并重新生成图像的一部分。
* **扩展：** 生成超出原始画布的内容。
* **放大：** 提高图像分辨率。
* **参考：** 使用一张或多张参考图像引导生成。
* **编辑：** 描述你想对图像进行的更改。

**编辑** 需要兼容的模型，例如 Qwen-Image-Edit 或 FLUX.1 Kontext。

#### LoRA 和 ControlNet

加载兼容的 LoRA，可为你的生成结果添加角色、主体或视觉风格。调整 LoRA 权重可控制它对结果的影响强度。

受支持的模型还可以使用 ControlNet 来引导图像结构。调整其强度可控制结果与引导图像的贴合程度。

#### 图库

生成的图像会保存到本地图库。打开某个结果可查看其提示词和设置，选择 **配方** 可恢复其生成设置或下载图像。

### 受支持的模型和工作流

| 你想做什么   | 可从以下模型开始                       |
| ------- | ------------------------------ |
| 生成或变换图像 | Z-Image、Qwen-Image、FLUX.1、SDXL |
| 使用指令编辑  | Qwen-Image-Edit、FLUX.1 Kontext |
| 使用参考图像  | FLUX.2 klein                   |

模型选择器中还有更多模型。不同模型的格式和工作流各不相同，不支持的工作流会自动隐藏。

### 生成设置

默认设置是一个不错的起点。不过，也可以调整设置以获得最佳结果；以下是你可能想更改的主要参数：

| 设置          | 作用                              |
| ----------- | ------------------------------- |
| **提示词**     | 描述你想创建的图像。在 **编辑**中，这会变成要遵循的指令。 |
| **纵横比和分辨率** | 设置图像的形状和大小。更大的图像会占用更多内存并耗时更长。   |
| **步数**      | 控制模型花费多长时间进行生成。更多步数并不总能改善结果。    |
| **引导**      | 控制提示词对结果的引导强度。某些模型在 `0`.        |
| **种子**      | 有助于复现结果。留空则使用随机种子。              |

<details>

<summary>高级生成设置</summary>

这些控件会改变模型在你的设备上的运行方式。调整它们可以减少内存使用、提高性能或排查生成问题。

| 设置         | 作用                                             |
| ---------- | ---------------------------------------------- |
| **速度**     | 控制编译和性能优化。编译模式在首次生成时可能需要更长时间。                  |
| **精度**     | 更改用于运行模型的数值格式。更低的精度可以减少内存使用。可用选项取决于模型和硬件。      |
| **注意力**    | 选择生成时使用的注意力实现。                                 |
| **内存**     | 在生成速度与 GPU 内存使用之间取得平衡。试试 **低显存** 如果模型接近你的内存上限。 |
| **步缓存**    | 在扩散步骤之间重复使用部分计算，以提高生成速度。                       |
| **CPU 卸载** | 将模型的部分内容移至系统内存。这会减少 GPU 内存使用，但可能让生成更慢。         |

</details>

### ⚠️ 故障排除

<details>

<summary>图片没有显示</summary>

更新到最新版本，然后重启应用。参见 [更新 Unsloth](https://unsloth.ai/docs/get-started/install/updating) 了解操作说明。

</details>

<details>

<summary>模型无法下载或加载</summary>

某些图像模型体积很大，下载需要时间。请检查你是否有足够的可用存储空间以及稳定的互联网连接。

某些模型还要求你先在 Hugging Face 上接受其许可证，并在下载前添加 Hugging Face 令牌。

</details>

<details>

<summary>模型内存不足</summary>

尝试更小的 GGUF 量化版本或该模型的 4 位版本。对于 GGUF 模型，请从标记为 **推荐**.

你还可以：

* 降低图像分辨率。
* 将批量大小保持为 `1`.
* 关闭其他正在使用 GPU 的应用。
* 选择更小的模型。

一个 **吃紧** 模型可能会使用系统内存并运行得更慢。标记为 **OOM** 的模型不太可能装得下。

</details>

<details>

<summary>缺少某个工作流</summary>

可用的工作流取决于已加载的模型。不支持的工作流不会显示。

例如，基于指令的编辑需要像 Qwen-Image-Edit 或 FLUX.1 Kontext 这样的模型。

</details>

### ❓ 常见问题

<details>

<summary>图像生成是在本地运行吗？</summary>

是的。一旦模型下载完成，图像生成就在你的设备上运行。

</details>

<details>

<summary>Transform 和 Edit 有什么区别？</summary>

**变换** 会使用描述完整结果的提示词对现有图像进行重绘。

**编辑** 会遵循诸如更改背景或添加对象之类的指令。它需要兼容的编辑模型。

</details>

<details>

<summary>我可以训练自己的图像 LoRA 吗？</summary>

可以。使用你自己的图像对受支持的模型进行微调，然后将完成的 LoRA 加载到 **创建**.

参见微调图像模型以了解更多。

</details>


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://unsloth.ai/docs/zh/ji-chu/diffusion-image.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
