使用 LoRA 極速四步生成圖片

平時用 Stable Diffusion 生成圖片時很多時間都用於等待,但現在 Latent Consistency Models ( LCM ) 推出了一個可以大幅削減生成時間的 LoRA,克服一般 Latent Diffusion models ( LDM ) 緩慢的生成過程,令好像 Stable Diffusion 這類預訓練的 LDM 實現以超少的步數完成生圖過程。

使用 LoRA 極速四步生成圖片
使用 LoRA 極速四步生成圖片

平時用 Stable Diffusion 生成圖片時很多時間都用於等待,但現在 Latent Consistency Models ( LCM ) 推出了一個可以大幅削減生成時間的 LoRA,克服一般 Latent Diffusion models ( LDM ) 緩慢的生成過程,令好像 Stable Diffusion 這類預訓練的 LDM 實現以超少的步數完成生圖過程。

Latent Consistency Models: Synthesizing High-Resolution Images with Few-step Inference
Latent Consistency Models: Synthesizing High-Resolution Images with Few-step Inference
相比普通方法的生成方式,LCM 速度快上幾倍

如何使用?

最重要是這種技術是已經可以在 Stable Diffusion WebUI 中使用,最簡單的方法就是使用 LoRA 版本,既可以直接使用原本在用的 Checkpoint 及 Extension,也可以達到加速的效果。

首先可以下載 LMC 的 LoRA,有分 1.5 及 SDXL 版本

latent-consistency/lcm-lora-sdv1-5 at main
We’re on a journey to advance and democratize artificial intelligence through open source and open science.

SD 1.5

latent-consistency/lcm-lora-sdxl at main
We’re on a journey to advance and democratize artificial intelligence through open source and open science.

SDXL

由於兩個檔案預設都叫做 pytorch_lora_weights.safetensors 建議改名為 LCM_LoRA_SD15 及 LCM_LoRA_SDXL 容易識別。

檔案下載後放到 models/Lora 再到 LoRA tab refresh 一下就可以見到。

SD 1.5 版本測試

先以官方建議的配置測試一下效果

重點是 Sampling Steps 只有 4 !平是不足以構成圖形的步數,以及超底的 CFP Scale 1.5。

Model
基本設定

加上簡單的 prompt : (masterpiece, best quality), 1girl, solo, long hair, outdoors, school uniform, day, wind, cloud, looking at viewer, short sleeves, parted lips, shirt, cloud, black hair, sunlight, white shirt, serafuku, upper body, brown hair, blue sky, depth of field, smile, global illumination, <lora:LCM_LoRA_SD15:1>

及 netgative prompt : man, animal, lowres, bad anatomy, worst quality, text, username, watermark, signature, jpeg artifacts, blurry

四步成圖

以我的 Macbook Pro M1 32GB 以準,生成四步 512 x 512 的圖只需 4 秒。由於速度很快我就一次成生 12 張看看效果。

隨機生成 12 張也不用一分鐘完成!

雖然不算超精細,但四步來說已經很不錯,那麼跟沒有使用 LoRA 有什麼分別?

有使用 LoRA 
沒有使用 LoRA

在有使用 LCM 的 LoRA 的情況下,第四步人物已經成形,在第十步已經在增加細節。但沒有使用 LoRA 的情況下,第四步時人物依然模糊一片,在第十步才初步成型。

但是聰明的讀者馬上就會發現使用 LoRA 後人物好像整個風格都不對勁。因為 LoRA 權重太高而引起的風格走樣問題,所以我就來測一下不同權重下的分別!

權重由 0 - 1.8 的分別

同樣是四步完成,在不同權重下明顯見到了分別,權重越高風格崩壞越強烈,在 0.4 - 0.6 左右對風格影響比較少同時能增加完成度,看大家可以嘗試在步數與權重之間尋找最合適的平衡點。

Read more

Unity AI Assistant 2.7.0 將不再支援 MCP 連接

Unity AI Assistant 2.7.0 將不再支援 MCP 連接

相信有不少人用 Unity AI MCP 來連接 Claude Code / Codex 等 AI 工具進行開發,近日隨著 Unity AI 進入公測,Unity 官方 Package com.unity.ai.assistant 亦升級到 v2.7.0-pre.2 。這個新版本的 Unity AI Assistant 在 Unity MCP Server 上加上了限制,Connected Clients limit 在 0 個 direct connection(以前是 Unlimited),就是不讓開發者使用其他 AI 工具來支援開發。 官方也有說明可以怎樣做,

Game Engine 的選擇

Game Engine 的選擇

在前陣子在決定寫 game 的期間,我試用了三大主流 Game Engine 來實作 demo,現在比較一下 Unreal,Unity 及 Godot 適合什麼開發者。 自我定位 在開始選擇前,我首先要確定自己是什麼開發者,以什麼角度去選擇 Game Engine。 * 首先我是獨立開發者,就是一個人會負責所有東西,繪圖設計,故事劇情,程式開發,宣傳銷售,後續經營,所以簡單很重要。 * 我使用 Macbook Pro M1 來開發,由於我沒有 desktop,單靠效能有限的主機來開發,所以效能夠不夠對我來說也是很重要。 * 遊戲平台,我的初期目標是 Steam/Andriod/iOS,如果有成果才會推向各大主機,雖然三大 Game Engine 都支持多平台輸出,但實際上調查後發現還是有一些限制,我會在下面解釋。 * 遊戲類型,