不需要懂技術,但這幾個名詞要知道,後面才不會迷路。
AI 的「大腦」,決定它能畫什麼、畫得多好。不同的模型擅長不同風格,就像不同畫家有不同畫風。
你用文字告訴 AI 你想要什麼。寫得越清楚,結果越接近你想要的。這是最重要的技能。
風格外掛。把 LoRA 裝在模型上,可以讓 AI 生成特定風格的圖,例如日系插畫、像素風、水彩風。
顯示卡的工作記憶體。你的 RTX 4060 有 8GB,足夠跑大部分圖像生成任務。
用 Pinokio 一鍵安裝,不需要打任何指令。整個過程大約 30–60 分鐘,大部分是等待下載。
Pinokio 是一個 AI 工具的「App 商店」,讓你用點擊的方式安裝複雜的 AI 環境,不需要任何程式知識。
這是最適合新手的圖像生成介面,比原版更省 VRAM,RTX 4060 跑起來更順。
Forge 裝好後本身沒有模型,要去 Civitai 下載。Civitai 是全球最大的 AI 模型社群,免費使用。
Pinokio 安裝路徑 / sd-forge / models / Stable-diffusion /回到 Pinokio,點「Start」啟動 Forge,瀏覽器會自動開啟操作介面(通常是 localhost:7860)。
針對 RTX 4060 筆電(8GB VRAM),以下是可以跑、值得用的模型。
萬用型模型,寫實、插畫都能做。新手第一個裝這個,失敗率最低。
專注寫實人物和風景,商業攝影感強。做產品底圖、人物配圖效果很好。
新一代技術,細節和提示詞理解力最強。需要量化版(Q8)才能在 8GB 上跑。速度較慢。
日系動漫插畫風格最強。做社群卡通配圖、吉祥物類型的圖首選。
不同商業用途需要不同風格,每種風格有對應的模型和關鍵詞。
產品圖、人物配圖、場景底圖
RealVisXL commercial photography product shot studio lighting社群貼文、活動配圖、吉祥物
AnythingXL anime illustration cute cartoon chibi style文章封面、橫幅背景、情境圖
DreamShaper XL landscape scenery wide shot遊戲感貼文、復古風行銷圖
任何底模 pixel art 16-bit style retro game資訊圖表配圖、說明圖
DreamShaper XL flat illustration vector style minimal質感文青風、食品飲料配圖
DreamShaper XL watercolor hand drawn painterly這是最重要的技能。一個好的 Prompt 由幾個部分組成,照這個結構寫就不容易出錯。
把你的描述分成這幾個區塊,依序填入:
| 你想要的效果 | 加入這些關鍵詞 |
|---|---|
| 整體品質高 | masterpiece, best quality, high resolution |
| 商業攝影感 | commercial photo, studio lighting, product photography |
| 白色乾淨背景 | white background, isolated, clean background |
| 溫暖色調 | warm lighting, golden hour, cozy atmosphere |
| 清新明亮 | bright, airy, soft light, pastel colors |
| IG 風格 | instagram style, lifestyle photo, aesthetic |
| 台灣/亞洲感 | asian woman, taiwanese style, east asian |
Forge 介面裡有很多數字,新手只需要注意這幾個。
根據社群媒體用途設定,不要一開始就設太大,速度會很慢。
| 用途 | 建議尺寸 | 說明 |
|---|---|---|
| IG 方形貼文 | 1024 × 1024 | 最標準 |
| IG 限時動態 | 768 × 1344 | 9:16 直式 |
| Facebook 橫幅 | 1344 × 768 | 16:9 橫式 |
| 文章封面 | 1216 × 832 | 3:2 橫式 |
數字越大品質越好,但生成越慢。8GB 筆電的建議設定:
控制 AI 有多「聽話」。數字太低 = AI 亂發揮;數字太高 = 圖片過度飽和變形。
一次生成幾張圖。建議設定:
從「我需要一張圖」到「完成可以用的圖」,照這個流程走最有效率。
先回答這兩個問題再開始:
根據上一步的答案,選模型、設定尺寸。插畫選 AnythingXL,寫實選 RealVisXL,不確定就用 DreamShaper XL。
Steps 設 20,Batch 設 4,先看方向對不對。這個階段的目的是確認構圖和風格,不是追求完美。
確認方向後,Steps 改 30,Batch 改 1,調整 Prompt 細節,輸出最終版本。
輸出的圖如果需要加文字、調色、合成,用 Canva 或 Photoshop 做後製。AI 負責生成畫面,排版文字還是用熟悉的工具比較快。
什麼時候用本地,什麼時候用 ChatGPT / 線上工具?兩個都有用就是最聰明的。
| 比較項目 | 本地(Forge + SDXL) | ChatGPT / DALL-E | Midjourney |
|---|---|---|---|
| 費用 | 生成免費(硬體一次投入) | 每月訂閱或按張收費 | 月費制,約 $10–30 |
| 大量生成 | ✓ 無限量 | ✗ 有限額 | 依方案有限 |
| 風格自訂 | ✓ 可安裝 LoRA 高度自訂 | ✗ 有限 | 中等 |
| 操作難度 | 需要學習,約 1–2 天 | ✓ 最簡單,直接對話 | 中等 |
| 中文理解 | ✗ Prompt 需用英文 | ✓ 中文可直接用 | ✗ 英文為主 |
| 商業授權 | ✓ 完整擁有(視模型授權) | 依 OpenAI 條款 | 依方案不同 |
| 網路需求 | ✓ 本地跑,不需網路 | ✗ 需要網路 | ✗ 需要網路 |
| 最佳使用情境 | 大量生成、固定風格系列圖 | 偶爾需要、快速出圖 | 追求藝術質感的單張圖 |
新手最常遇到的問題和解法。
可能原因和解法:
blurry, low quality, worst quality這是所有 AI 圖像的通病,手部是最難的部位。解法:
extra fingers, deformed hands, bad anatomy8GB 的限制,偶爾會遇到。解法:
--medvram 參數每張圖都有一個 Seed 數字,記下這個數字,下次填入同樣的 Seed,在其他條件不變的情況下可以重現相近的結果。
目前的 AI 圖像生成在文字上非常不準確,不要期待 AI 幫你生成精確的文字。正確做法是: