AI 繪圖就是用文字或參考圖,讓模型生成、修改與延伸圖片。新手不必先學一長串英文咒語:先說清楚圖片用途、主體、構圖、風格與尺寸,再用對話逐步修改,通常比一次塞滿形容詞更穩。
如果你只想知道從哪開始:已有 ChatGPT 就先用 ChatGPT Images;常用 Gemini 或要搭配 Google 服務,可先試 Nano Banana;想建立強烈視覺風格與參考圖流程,再考慮 Midjourney。需要本地執行與高度客製化的人,才值得投入開放權重模型與節點式工作流。
2026 AI 繪圖工具怎麼選?
| 工具 | 最適合 | 使用特性 | 先注意 |
|---|---|---|---|
| ChatGPT Images | 新手、社群圖、商品概念與對話式修圖 | 繁中指令方便,可直接要求局部修改 | 方案用量與輸出權利要看最新條款 |
| Midjourney V8.1 | 風格探索、廣告概念、系列視覺 | 支援 Image Prompt、Style Reference 與高解析模式 | 需要理解版本、參數與公開性設定 |
| Gemini Nano Banana | 多模態編修、快速生成、Google 工作流 | 可混合文字與圖片反覆修改 | 不同模型的速度、品質與功能不同 |
| 本地或開放權重工具 | 私有流程、模型客製、批次自動化 | 控制度高,可搭配 ComfyUI 等介面 | 安裝、硬體與各模型授權都要自行確認 |
OpenAI 已推出 ChatGPT Images 2.0。Midjourney 官方則說明 V8.1 已在 2026 年 6 月成為預設版本。Google 目前把 Nano Banana 2列為兼顧能力、成本與速度的通用影像模型。這也是為什麼舊教學仍叫你選 DALL·E 3 或 Midjourney V7 時,已經不適合照單全收。
若想看更多產品,可搭配 AI 圖像工具完整指南與免費 AI 工具整理。
AI 繪圖怎麼用?先做這 5 步
1. 先寫用途與尺寸
「畫一張漂亮的圖」幾乎沒有驗收標準。先決定它是網站首圖、社群貼文、簡報背景、商品概念或角色設定,並指定橫式、直式或方形。
2. 補上主體與動作
寫清楚畫面裡是誰、正在做什麼、最重要的細節是什麼。若人物數量或物件位置重要,直接寫出來。
3. 定義場景、構圖與光線
與其堆疊「超高品質、8K、神作」,不如指定鏡頭距離、視角、背景、光源方向與色彩。例如「45 度俯視、主體置中、左側留白、陰天柔光」。
4. 指定不能出現的內容
可要求不要文字、商標、浮水印、多餘手指或雜亂背景。但負面限制並非每次都能完全遵守,產出後仍要人工檢查。
5. 一次只改一件事
第一版不滿意時,不要整段提示詞重寫。先固定構圖,再調整色彩;固定角色後,再換場景。這樣比較知道是哪個修改造成結果變化。
可直接複製的中文 Prompt
網站文章首圖
用途:AI 工具教學文章首圖,橫式 16:9。
主體:一位台灣上班族在桌面整理研究資料,畫面中有筆記、文件與抽象 AI 連結線。
構圖:人物位於右側三分之一,左側保留乾淨留白供標題使用。
風格:寫實 editorial 攝影,可信、冷靜,不像廣告圖庫。
光線:自然窗光,清楚看見桌面資訊層次。
限制:不要文字、Logo、浮水印、假介面或多餘手指。
商品概念圖
為一款霧面白色保溫杯製作棚拍概念圖。
杯子置於淺灰平台中央,45 度視角,右後方柔光,陰影自然。
背景保持乾淨,只放一片綠色葉子作比例參考。
輸出方形圖片,不要品牌名稱、文字、浮水印或額外商品。
這個結構也能延伸到 Prompt 工程指南。真正有效的是具體限制與可驗收條件,不是固定背一串英文品質詞。
Midjourney 現在還需要 Discord 嗎?
Midjourney 已可直接在官方網站建立圖片,Discord 不再是唯一入口。依官方入門指南,你可以在 Imagine 欄輸入提示詞、上傳參考圖,生成後再做變體、放大與編修。
使用 V8.1 時,先掌握下面幾個判斷。舊教學裡的大量版本參數已不適合直接照抄:
- 要控制畫面內容,可加入 Image Prompt。
- 要延續色彩、材質與視覺氣質,可用 Style Reference。
- 要保留人物或物件特徵,依目前版本使用相應參考功能。
- 想降低 Midjourney 自帶美化,可測試 Raw。
- 橫直比例用
--ar,但不要把參數當成提示詞本身。
Midjourney 官方也提醒,參考圖用來引導新作品,不是精準複製原圖。需要只修改原圖某個局部時,應使用 Editor 類工具並逐項核對。
ChatGPT Images 與 Gemini 適合誰?
ChatGPT Images 的優勢是對話式修改:你可以上傳圖片後說「只換背景,保留人物姿勢、服裝與光線」。這類工作比從頭重抽更適合內容創作者與行銷人員。
Gemini 的 Nano Banana 系列也能用文字與圖片迭代。Google 官方目前區分偏通用效率、專業製作及高流量用途的不同影像模型,所有生成圖片都會加入 SynthID。對一般使用者而言,不必先記模型代號,先看帳號介面提供的品質、速度與編修選項即可。
AI 圖片可以商用嗎?
商用前要分開檢查三件事:平台條款是否允許使用、輸入素材是否有權使用,以及產出是否侵犯他人權利。平台讓你下載或商用,不代表圖片自動取得排他的著作權。
交付或投放前,至少檢查:
- 帳號方案與平台最新使用條款。
- 參考圖、字型、Logo、角色與素材的授權。
- 真實人物的肖像、隱私與冒用風險。
- 圖中是否出現近似商標、錯誤文字或不合理肢體。
- 是否保留提示詞、來源圖、人工修改與審稿紀錄。
Midjourney 的方案說明列有使用權條件;不同平台與模型條款並不相同。本地模型也不是看到「可下載」就等於任何用途都免費,應查看模型授權與素材來源。需要更完整的風險框架,可看 AI 倫理指南。
常見問題
AI 繪圖新手用哪個工具?
已有 ChatGPT 或 Gemini 帳號,就先用其中一個,不必先訂閱多套工具。用同一個中文提示詞生成三次,確認構圖、文字與修改能力是否符合你的工作,再決定要不要改用 Midjourney。
AI 繪圖 Prompt 用中文還是英文?
ChatGPT Images 與 Gemini 可直接從繁中開始。Midjourney 也能理解多種語言,但若結果不穩,可保留中文需求,再把關鍵視覺詞改成英文測試;重點是具體,不是英文一定比較專業。
Midjourney V8.1 和舊版差在哪?
官方說明 V8.1 已是目前預設版本,改善速度、提示詞理解與細節保留,並提供高解析模式。舊版提示詞與參數不一定原樣適用,使用前應查看版本相容功能。
AI 生成圖片可以直接拿去廣告投放嗎?
不建議生成後直接投放。先檢查平台條款、參考素材、人物肖像、商標、錯字與誤導內容,必要時交由設計、法務或品牌人員複核。