教育訓練教材 v1.0

本地 AI 商業圖片生成
完整建置指南

從零開始,不燒點數,在自己的電腦上產出商業等級配圖

🖥 RTX 4060 筆電適用 🎨 零技術背景可學 💰 生成不花錢 🇹🇼 繁體中文教材
▶ 切換簡報版本觀看
Chapter 01

先搞懂幾個基本概念

不需要懂技術,但這幾個名詞要知道,後面才不會迷路。

🧠

模型(Model)

AI 的「大腦」,決定它能畫什麼、畫得多好。不同的模型擅長不同風格,就像不同畫家有不同畫風。

💬

提示詞(Prompt)

你用文字告訴 AI 你想要什麼。寫得越清楚,結果越接近你想要的。這是最重要的技能。

🎛

LoRA

風格外掛。把 LoRA 裝在模型上,可以讓 AI 生成特定風格的圖,例如日系插畫、像素風、水彩風。

🖼

VRAM(顯示記憶體)

顯示卡的工作記憶體。你的 RTX 4060 有 8GB,足夠跑大部分圖像生成任務。

💡
簡單理解:模型是畫家本人,LoRA 是他的畫風設定,Prompt 是你給他的任務描述,VRAM 是他的工作台大小。
Chapter 02

安裝環境(一次搞定)

用 Pinokio 一鍵安裝,不需要打任何指令。整個過程大約 30–60 分鐘,大部分是等待下載。

⚠️
事前確認:硬碟至少要有 50GB 以上空閒空間。模型檔案很大,建議裝在 C 槽以外的硬碟。
1

下載並安裝 Pinokio

Pinokio 是一個 AI 工具的「App 商店」,讓你用點擊的方式安裝複雜的 AI 環境,不需要任何程式知識。

# 前往官網下載
https://pinokio.computer
# 下載 Windows 版本 → 安裝 → 開啟
✅
安裝時如果問你安裝位置,選一個空間大的硬碟,不要裝在 C 槽根目錄。
2

在 Pinokio 安裝 Stable Diffusion WebUI Forge

這是最適合新手的圖像生成介面,比原版更省 VRAM,RTX 4060 跑起來更順。

# 在 Pinokio 操作步驟:
1. 點選左側「Explore」
2. 搜尋「Stable Diffusion WebUI Forge」
3. 點「Download」→「Install」
4. 等待安裝完成(約 15–30 分鐘)
3

下載第一個模型

Forge 裝好後本身沒有模型,要去 Civitai 下載。Civitai 是全球最大的 AI 模型社群,免費使用。

# 前往 Civitai
https://civitai.com
# 搜尋建議(新手首選)
搜尋:「DreamShaper XL」
類型選:SDXL 1.0
點「Download」下載 .safetensors 檔案
📁
下載後把模型檔案放到:
Pinokio 安裝路徑 / sd-forge / models / Stable-diffusion /
4

啟動並確認可以出圖

回到 Pinokio,點「Start」啟動 Forge,瀏覽器會自動開啟操作介面(通常是 localhost:7860)。

# 測試是否成功的方法:
1. 介面右上角選到你剛下載的模型
2. Prompt 欄位輸入:a cup of coffee
3. 點「Generate」按鈕
4. 幾十秒後如果出現圖片 → 成功!
Chapter 03

模型選擇指南

針對 RTX 4060 筆電(8GB VRAM),以下是可以跑、值得用的模型。

穩定首選

DreamShaper XL

萬用型模型,寫實、插畫都能做。新手第一個裝這個,失敗率最低。

檔案大小 6.5GB
8GB VRAM ✓ 可跑
適合 商業配圖、人物、產品
Civitai 搜尋 DreamShaper XL
寫實首選

RealVisXL V5

專注寫實人物和風景,商業攝影感強。做產品底圖、人物配圖效果很好。

檔案大小 6.5GB
8GB VRAM ✓ 可跑
適合 寫實人物、風景、產品攝影感
Civitai 搜尋 RealVisXL V5
新世代

Flux.1 Schnell Q8

新一代技術,細節和提示詞理解力最強。需要量化版(Q8)才能在 8GB 上跑。速度較慢。

檔案大小 8–9GB(量化版)
8GB VRAM ⚠ 勉強可跑
適合 複雜構圖、高細節要求
Civitai 搜尋 Flux Schnell GGUF
插畫專用

AnythingXL

日系動漫插畫風格最強。做社群卡通配圖、吉祥物類型的圖首選。

檔案大小 6.5GB
8GB VRAM ✓ 可跑
適合 卡通、日系插畫、吉祥物
Civitai 搜尋 AnythingXL
📌
建議先裝 2 個:DreamShaper XL(萬用)+ AnythingXL(插畫),這兩個就能應付行銷貼文 80% 的需求。之後再依需要補充其他模型。
Chapter 04

各種風格的對應方式

不同商業用途需要不同風格,每種風格有對應的模型和關鍵詞。

📸

商業寫實攝影感

產品圖、人物配圖、場景底圖

RealVisXL commercial photography product shot studio lighting
🌸

日系卡通插畫

社群貼文、活動配圖、吉祥物

AnythingXL anime illustration cute cartoon chibi style
🏔

風景 / 場景底圖

文章封面、橫幅背景、情境圖

DreamShaper XL landscape scenery wide shot
👾

像素風

遊戲感貼文、復古風行銷圖

任何底模 pixel art 16-bit style retro game
✏️

扁平插畫 / 商業插圖

資訊圖表配圖、說明圖

DreamShaper XL flat illustration vector style minimal
🎨

水彩 / 手繪感

質感文青風、食品飲料配圖

DreamShaper XL watercolor hand drawn painterly
💡
換風格不需要換模型:大部分情況下,在 Prompt 加上風格關鍵詞就可以改變風格。只有在需要非常精準的特定風格時,才需要換對應的專用模型或 LoRA。
Chapter 05

提示詞怎麼寫

這是最重要的技能。一個好的 Prompt 由幾個部分組成,照這個結構寫就不容易出錯。

📐

Prompt 的基本結構

把你的描述分成這幾個區塊,依序填入:

Prompt 結構範例
// 1. 主體描述(最重要) 主體:a young woman holding a coffee cup // 2. 風格設定 風格:commercial photography, studio lighting // 3. 畫面品質 品質:high quality, 8k, sharp focus, professional // 4. 背景 / 環境 環境:white background, clean minimal // 5. 負向提示(告訴 AI 不要什麼) 不要:blurry, ugly, deformed hands, watermark, text

實際範例:日系插畫社群配圖

Positive Prompt
cute anime girl, sitting at desk, working on laptop, cozy room, warm lighting, autumn mood, chibi style, soft colors, high quality illustration, pastel color palette, window with sunlight, potted plants, coffee cup
Negative Prompt(固定用這段,幾乎通用)
blurry, ugly, deformed, extra fingers, bad anatomy, watermark, text, signature, cropped, worst quality, low quality, jpeg artifacts, distorted face

常用品質關鍵詞對照

你想要的效果 加入這些關鍵詞
整體品質高 masterpiece, best quality, high resolution
商業攝影感 commercial photo, studio lighting, product photography
白色乾淨背景 white background, isolated, clean background
溫暖色調 warm lighting, golden hour, cozy atmosphere
清新明亮 bright, airy, soft light, pastel colors
IG 風格 instagram style, lifestyle photo, aesthetic
台灣/亞洲感 asian woman, taiwanese style, east asian
⚠️
重要:Prompt 用英文寫效果最好。可以先用中文想好描述,再貼給 ChatGPT 翻成英文 Prompt 格式,這樣兩個工具都用到了,也不浪費。
Chapter 06

基本參數設定

Forge 介面裡有很多數字,新手只需要注意這幾個。

尺寸

圖片尺寸(Width × Height)

根據社群媒體用途設定,不要一開始就設太大,速度會很慢。

用途建議尺寸說明
IG 方形貼文1024 × 1024最標準
IG 限時動態768 × 13449:16 直式
Facebook 橫幅1344 × 76816:9 橫式
文章封面1216 × 8323:2 橫式
步數

Sampling Steps(取樣步數)

數字越大品質越好,但生成越慢。8GB 筆電的建議設定:

  • 🚀
    快速測試用:20 步——確認構圖和風格,速度快
  • ✅
    正式輸出用:28–35 步——品質好,速度可接受
  • ⚠️
    不需要超過 40 步——效果差異微乎其微,只是浪費時間
CFG

CFG Scale(提示詞服從度)

控制 AI 有多「聽話」。數字太低 = AI 亂發揮;數字太高 = 圖片過度飽和變形。

🎯
建議固定設 7,這是最安全的通用值。等你熟練後再實驗調整。
批次

Batch Count(批次數量)

一次生成幾張圖。建議設定:

  • 🔍
    測試 Prompt 時設 4 張——一次看多種結果,快速找到喜歡的方向
  • 📤
    確認好後設 1 張——精細調整後輸出最終版
Chapter 07

實際工作流程

從「我需要一張圖」到「完成可以用的圖」,照這個流程走最有效率。

1

確認這張圖的用途和風格

先回答這兩個問題再開始:

  • 這張圖要放在哪?(IG / Facebook / 文章封面)
  • 要什麼感覺?(寫實 / 插畫 / 簡約 / 溫暖)
2

選對模型和尺寸

根據上一步的答案,選模型、設定尺寸。插畫選 AnythingXL,寫實選 RealVisXL,不確定就用 DreamShaper XL。

3

寫 Prompt → 先設 4 張批次快速測試

Steps 設 20,Batch 設 4,先看方向對不對。這個階段的目的是確認構圖和風格,不是追求完美。

💡
如果 4 張裡面有 1 張方向大致對了,就把那張的 Seed 數字記下來,鎖定 Seed 再繼續調整。
4

調整 Prompt → 正式輸出

確認方向後,Steps 改 30,Batch 改 1,調整 Prompt 細節,輸出最終版本。

5

後製(選擇性)

輸出的圖如果需要加文字、調色、合成,用 Canva 或 Photoshop 做後製。AI 負責生成畫面,排版文字還是用熟悉的工具比較快。

🎨
Canva 免費版就很夠用,AI 生成底圖 + Canva 排版文字,是很多行銷人的實際工作流。
Chapter 08

本地 vs 線上工具比較

什麼時候用本地,什麼時候用 ChatGPT / 線上工具?兩個都有用就是最聰明的。

比較項目 本地(Forge + SDXL) ChatGPT / DALL-E Midjourney
費用 生成免費(硬體一次投入) 每月訂閱或按張收費 月費制,約 $10–30
大量生成 ✓ 無限量 ✗ 有限額 依方案有限
風格自訂 ✓ 可安裝 LoRA 高度自訂 ✗ 有限 中等
操作難度 需要學習,約 1–2 天 ✓ 最簡單,直接對話 中等
中文理解 ✗ Prompt 需用英文 ✓ 中文可直接用 ✗ 英文為主
商業授權 ✓ 完整擁有(視模型授權) 依 OpenAI 條款 依方案不同
網路需求 ✓ 本地跑,不需網路 ✗ 需要網路 ✗ 需要網路
最佳使用情境 大量生成、固定風格系列圖 偶爾需要、快速出圖 追求藝術質感的單張圖
🧠
建議策略:用 ChatGPT 幫你把中文想法翻成英文 Prompt → 貼到本地 Forge 生成圖片 → Canva 排版加文字。三個工具各司其職,費用最低、效率最高。
Chapter 09

常見問題

新手最常遇到的問題和解法。

Q

生成的圖畫質很差、很模糊怎麼辦?

可能原因和解法:

  • 1Negative Prompt 沒有填 → 加入 blurry, low quality, worst quality
  • 2Steps 太少 → 改成 28–35
  • 3模型和風格不匹配 → 試試換不同模型
Q

人物的手畫得很奇怪、手指數量不對?

這是所有 AI 圖像的通病,手部是最難的部位。解法:

  • ANegative Prompt 加 extra fingers, deformed hands, bad anatomy
  • B構圖上盡量讓手不要是畫面焦點,或讓手持物品遮擋
  • C多生成幾張挑比較好的
Q

顯示卡記憶體不足(CUDA out of memory)?

8GB 的限制,偶爾會遇到。解法:

  • 1縮小圖片尺寸,從 1024 降到 896 或 768
  • 2Batch Count 改成 1(一次只生一張)
  • 3在 Forge 的啟動設定加入 --medvram 參數
  • 4關掉其他佔 VRAM 的程式(瀏覽器開太多分頁等)
Q

每次生成的圖都不一樣,怎麼鎖定喜歡的結果?

每張圖都有一個 Seed 數字,記下這個數字,下次填入同樣的 Seed,在其他條件不變的情況下可以重現相近的結果。

🔒
生成結果下方有顯示 Seed 值,或在 Forge 介面找到「Seed」欄位,把 -1 改成你記下的數字。
Q

可以生成有品牌 Logo 或中文字的圖嗎?

目前的 AI 圖像生成在文字上非常不準確,不要期待 AI 幫你生成精確的文字。正確做法是:

  • ✓AI 負責生成沒有文字的底圖
  • ✓Canva / Photoshop 後製加上文字和 Logo