從零開始,不燒點數,
在自己的電腦上產出商業等級配圖
模型、Prompt、LoRA 是什麼
Pinokio + Forge 一鍵安裝
4款適合 8GB 的模型比較
寫實、插畫、像素風等
結構化 Prompt 範例
尺寸、步數、CFG 建議值
從需求到出圖的五步驟
本地 vs ChatGPT vs Midjourney
新手最常踩的坑和解法
不需要懂技術,
但這幾個名詞要知道
搞懂這四個,後面所有東西都容易理解。
AI 的「大腦」,決定它能畫什麼、畫得多好。不同模型擅長不同風格,就像不同畫家有不同畫風。
用文字告訴 AI 你想要什麼。寫得越清楚,結果越接近你想要的。這是最重要的技能。
風格外掛。裝上 LoRA 可以讓 AI 生成特定風格的圖,例如日系插畫、像素風、水彩風。
顯示卡的工作記憶體。你的 RTX 4060 有 8GB,足夠跑大部分圖像生成任務。
用 Pinokio 一鍵安裝,
不需要打任何指令
整個過程約 30–60 分鐘,大部分是等待下載。硬碟需要至少 50GB 空閒空間。
前往 pinokio.computer 下載 Windows 版本 → 安裝時選空間大的硬碟,不要裝在 C 槽根目錄
點左側「Explore」→ 搜尋「Stable Diffusion WebUI Forge」→ Download → Install → 等待完成
civitai.com → 搜尋「DreamShaper XL」→ 下載 .safetensors 檔案 → 放入 sd-forge / models / Stable-diffusion /
Pinokio 點「Start」→ 瀏覽器開啟介面(localhost:7860)→ Prompt 輸入「a cup of coffee」→ Generate → 出現圖片即成功
針對 RTX 4060(8GB)
可以跑、值得用的模型
先裝前兩個就能應付行銷貼文 80% 的需求,之後依需要補充。
萬用型模型,寫實、插畫都能做。新手第一個裝這個,失敗率最低。6.5GB,8GB VRAM 可跑。
專注寫實人物和風景,商業攝影感強。做產品底圖、人物配圖效果很好。6.5GB。
新一代技術,提示詞理解力最強。需要量化版(Q8)才能在 8GB 上跑,速度較慢。
日系動漫插畫風格最強。做社群卡通配圖、吉祥物類型的圖首選。6.5GB。
不同商業用途需要不同風格,
每種有對應的模型和關鍵詞
在 Prompt 加上對應的關鍵詞就可以改變風格,不一定需要換模型。
產品圖、人物配圖、場景底圖
社群貼文、活動配圖、吉祥物
文章封面、橫幅背景、情境圖
遊戲感貼文、復古風行銷圖
資訊圖表配圖、說明圖
質感文青風、食品飲料配圖
這是最重要的技能,
照這個結構寫就不容易出錯
把你的描述分成這幾個區塊,依序填入
把這兩段直接複製進 Forge 就可以開始測試
依照你想要的效果,把對應的關鍵詞加進 Positive Prompt
| 想要的效果 | 加入這些關鍵詞 |
|---|---|
| 整體品質高 | masterpiece, best quality, high resolution |
| 商業攝影感 | commercial photo, studio lighting, product photography |
| 白色乾淨背景 | white background, isolated, clean background |
| 溫暖色調 | warm lighting, golden hour, cozy atmosphere |
| 清新明亮 | bright, airy, soft light, pastel colors |
| IG 風格 | instagram style, lifestyle photo, aesthetic |
| 亞洲感人物 | asian woman, east asian, taiwanese style |
介面裡有很多數字,
新手只需要注意這幾個
照以下建議值設定,不要亂改其他東西。
IG 方形:1024×1024
IG 限時:768×1344(9:16)
FB 橫幅:1344×768(16:9)
文章封面:1216×832
快速測試:20 步(確認方向)
正式輸出:28–35 步(品質好)
不需要超過 40 步,效果差異極小
建議固定設 7,這是最安全的通用值。太低 AI 亂發揮;太高圖片過度飽和。
測試 Prompt 時:設 4 張,快速看方向
確認方向後:設 1 張,精細輸出
從「我需要一張圖」
到「完成可以用的圖」
照這個順序走,不容易卡關。
這張圖要放在哪?(IG / Facebook / 文章封面)要什麼感覺?(寫實 / 插畫 / 溫暖 / 簡約)
插畫選 AnythingXL,寫實選 RealVisXL,不確定就用 DreamShaper XL。尺寸依據用途設定。
Steps 設 20,Batch 設 4,先看方向對不對。找到喜歡的方向後,記下那張的 Seed 數字。
Steps 改 30,Batch 改 1,鎖定 Seed,微調 Prompt 細節,輸出最終版本。
用 Canva 加文字和 Logo。AI 負責生成畫面,排版文字用熟悉的工具比較快。
什麼時候用哪個,
兩個都有用才是最聰明的
| 比較項目 | 本地(Forge) | ChatGPT / DALL-E | Midjourney |
|---|---|---|---|
| 費用 | 生成免費 | 月費或按張 | 月費 $10–30 |
| 大量生成 | ✓ 無限量 | ✗ 有限額 | 依方案 |
| 風格自訂 | ✓ LoRA 高度自訂 | ✗ 有限 | 中等 |
| 操作難度 | 需學習 1–2 天 | ✓ 最簡單 | 中等 |
| 中文理解 | ✗ Prompt 需英文 | ✓ 中文直接用 | ✗ 英文為主 |
| 離線使用 | ✓ 不需網路 | ✗ 需網路 | ✗ 需網路 |
新手最常踩的坑
和解法
① Negative Prompt 沒填 → 加入 blurry, low quality, worst quality
② Steps 太少 → 改成 28–35
③ 試試換不同模型
① Negative Prompt 加 extra fingers, deformed hands, bad anatomy
② 構圖讓手不是焦點,或讓手持物品遮擋
③ 多生成幾張挑比較好的
① 縮小圖片尺寸從 1024 降到 896 或 768
② Batch Count 改成 1
③ Forge 啟動設定加入 --medvram
④ 關掉其他佔 VRAM 的程式
每張圖都有一個 Seed 數字,記下這個數字,下次填入同樣的 Seed,在其他條件不變的情況下可以重現相近的結果。在 Forge 介面找到「Seed」欄位,把 -1 改成記下的數字。
目前 AI 圖像生成在文字上非常不準確,不要期待 AI 生成精確的文字。正確做法:AI 生成沒有文字的底圖,Canva / Photoshop 後製加上文字和 Logo。
這需要 IP-Adapter 或 角色 LoRA 技術,屬於進階操作。新手先從單張圖練習,熟練後再學角色一致性工作流。
工具裝好了,Prompt 寫好了,
剩下的就是動手做。
安裝 Pinokio + Forge,下載 DreamShaper XL
複製第 12–13 頁的 Prompt 範例,直接跑看看
依照想要的風格修改 Prompt,重複練習