Stable Diffusion 主要功能與應用,包含文生圖、圖像修復、多模態與科學研究

← INSIGHTS & PERSPECTIVES | 生成式AI

Stable Diffusion 主要功能與應用全解析:從文生圖到多模態與科學研究

Stable Diffusion 能做什麼?我整理了它的官方平台工具、Civitai 開源社群資源,以及文生圖、圖像修復與編輯、多模態應用、動畫與遊戲開發、醫學與自然科學研究等主要功能與應用場景,幫助你快速掌握這套開源 AI 繪圖模型的完整能力。

Stable Diffusion 是目前最主流的開源文生圖模型之一,能做的遠不只輸入文字生成圖片。這篇筆記我整理了它的官方平台工具與開源社群資源,並依圖像生成、圖像修改與增強、多模態應用、創意應用與科學研究五大方向,記錄我對 Stable Diffusion 主要功能和應用的整理。

Stable Diffusion 的官方網站和開源社群在哪裡?

兩個我最常逛的資源入口:

在 Stability AI 的官方網站上,可以看見現在這個平台所提供的相關工具包括:圖像生成、影像生成、音樂生成、3D 模型生成、文字生成。

而在開源社群 Civitai 上,可以下載許多人自己生成的模型和相關微調模型,還有許多澀澀的(?)圖片。

Stable Diffusion 怎麼根據文本生成圖像?

這是 Stable Diffusion 最核心的能力——描述生成:用戶可以輸入一段文字描述,Stable Diffusion 模型會根據這段描述生成對應的圖像。例如,輸入「日落下的山脈」,模型會生成一幅描繪日落下山脈的圖像。

除了按描述直接生成,我也常用它來輔助創意發想:

  • 藝術創作:藝術家可以使用 Stable Diffusion 生成具有特定風格或主題的圖像,從而激發創意和靈感。
  • 概念設計:設計師可以快速生成概念草圖,用於產品設計或廣告創意。

圖像生成使用哪些模型?SDXL 有什麼提升?

圖像生成使用模型為:SD1.x、SD2.x、SDXL。

SDXL 是目前 Stable Diffusion 系列中最新的模型之一。它在 SD2.x 的基礎上進一步提升了圖像的品質和細節,尤其是在處理複雜的場景和人物時表現更加出色。SDXL 還能夠生成更加多樣化的圖像風格,為用戶提供了更多的創作可能性。

更多資訊可參考這篇安裝教學:Stable Diffusion XL 說明及 SDXL 1.0 安裝教學

Stable Diffusion 可以修復和編輯圖片嗎?

可以,主要分為兩類能力:

圖像修復

  • 缺損修復:模型可以自動填補和修復圖像中缺失或損壞的部分,恢復圖像的完整性。
  • 品質增強:提高低解析度圖像的質量,使其更加清晰和細緻。

圖像編輯

  • 局部修改:用戶可以指定圖像的某個區域進行修改,例如改變圖像中的顏色、形狀或添加新的元素。
  • 風格轉換:將圖像轉換為不同的藝術風格,如將照片變為素描或油畫效果。

要使用 Stable Diffusion 來做到圖像修復或圖像編輯,需要安裝相關的 ADetailer 外掛,以下為一個範例:CSDN 上的 ADetailer 教學。以 web UI 為例,可以安裝 ADetailer 的擴展套件,就可以讀取相關的模型來修復圖片。

Stable Diffusion 有哪些多模態應用?

除了單純生圖,Stable Diffusion 也支援圖像與文本之間的雙向互動:

圖像-文本匹配

  • 圖像標註:根據圖像生成相應的文本描述,適用於自動標註和圖像檢索。
  • 文本生成圖像:根據文本描述生成圖像,用於多模態數據集的構建和應用。

文本-圖像交互

  • 文本驅動的圖像編輯:用戶可以通過文本指令對圖像進行特定修改,例如「將天空變成藍色」或「在圖像中添加一棵樹」。

Stable Diffusion 能用在動畫和遊戲開發上嗎?

動畫生成方面,可以通過生成連續的圖像幀來創建動畫效果,適用於動畫製作和電影特效。相關資源:

模型介紹影片:Stable Video Diffusion 示範(YouTube)

遊戲開發方面,可以根據描述生成遊戲場景,幫助遊戲開發者快速創建豐富的遊戲內容:

Stable Diffusion 在科學研究上有什麼應用?

醫學圖像分析

  • 醫學影像生成:根據描述生成醫學影像,輔助醫學研究和診斷。
  • 圖像合成:生成合成的醫學圖像,用於訓練和測試醫學影像分析模型。

自然科學模擬

  • 氣象模擬:生成氣象圖像,用於天氣預測和氣候研究。
  • 地理模擬:根據描述生成地理景觀圖像,幫助地理研究和模擬。

延伸閱讀

常見問題

QStable Diffusion 是免費的嗎?

模型本身是開源的,可以免費下載並在本地執行。官方平台 stability.ai 也提供線上服務,部分進階功能則可能需要付費。

QSDXL 和 SD1.5 有什麼差別?

SDXL 在 SD2.x 的基礎上進一步提升了圖像品質與細節,處理複雜場景和人物時表現更出色,也能生成更多樣化的圖像風格。

QStable Diffusion 可以修復老舊或損壞的照片嗎?

可以。透過安裝 ADetailer 等外掛,模型能自動填補缺損部分、提升低解析度圖像的品質,也能做局部修改與風格轉換。

QCivitai 是什麼?為什麼要逛?

Civitai 是 Stable Diffusion 的開源模型社群,可以下載許多人自己訓練的模型和微調模型,是找 checkpoint 和 LoRA 的主要管道。

QStable Diffusion 能生成影片嗎?

可以。Stability AI 推出了 Stable Video Diffusion,提供一秒 14 幀與 25 幀的模型,可從圖像生成連續幀動畫。

參考資料

最後更新

2026-08-28(原文發布於 2024-08-06,本文保留原始筆記內容並補上 GEO 結構。)

關於作者 {#author}

Claire Chang | 企業 AI 導入與流程轉型顧問。專注於 AI Agent 架構設計、ERP 系統整合與企業 AI 治理。

首次發布:2024-08-06