📌 本文更新於 2026 年 9 月:原文的實測是 2025 年 5 月用舊模型做的,當時結論是「ChatGPT 完勝」;Google 在 2025 年 8 月推出 Nano Banana、11 月推出 Nano Banana Pro、2026 年 2 月推出 Nano Banana 2 之後,情況已經反轉。本次更新補上 Nano Banana 系列的現況、各方案(免費/Google AI Pro NT$650/月/Ultra)能用到哪一版生圖模型、浮水印的新規則,以及 ChatGPT 端從 DALL·E 換成 GPT Image 系列的變化;原本的實測圖片與對照表保留當歷史參考,結論改寫成「各有勝場,看用途」。
在這波 AI 工具大爆炸的浪潮中,Google Gemini 也終於端出「圖片生成」這道大菜。很多人第一時間會問的就是:那它能不能替代我原本用得順手的 ChatGPT 圖片生成功能?
這篇就用我親自上手測試的實戰心得,帶你看看 Gemini 生成圖片的實際表現,還有它跟 ChatGPT 圖片生成(早期是 DALL·E,現在是 GPT Image 系列)的差異,到底在哪裡。
先說結論(2026 年 9 月更新版):我 2025 年 5 月第一次實測時,Gemini 生成圖片的功力,在插圖的部分完全無法達到 ChatGPT 的水準,只能說勉強可用;但 Nano Banana 系列上線之後,2026 年的情況已經反轉——寫實、中文文字、多張圖一致性這幾項多半是 Gemini 勝出,ChatGPT 則贏在提示遵循、速度和圖表類。現在是各有勝場,看用途。
Gemini可以生成圖嗎?
可以,而且現在已經是原生內建的功能了。我 2025 年 5 月剛測的時候,Gemini App 的生圖是靠串接 Google 另一套圖像模型 Imagen 來做,控制細節的能力有限;但從 2025 年 8 月 26 日的 Nano Banana(正式名稱 Gemini 2.5 Flash Image)開始,生圖改由 Gemini 模型本身的多模態能力直接輸出,之後又有 2025 年 11 月 20 日的 Nano Banana Pro(Gemini 3 Pro Image)和 2026 年 2 月 26 日的 Nano Banana 2(Gemini 3.1 Flash Image,取代初代 Nano Banana)。要看你用的是哪一版:免費版可以用 Nano Banana,但 Nano Banana Pro 要 Google AI Pro(原 Gemini Advanced/Google One AI Premium,NT$650/月)以上才有。
2025 年上半年那段時間,這些功能確實還相對受限:圖像細節控制不夠、風格轉換能力也不如 ChatGPT 靈活,直接輸入「生成吉卜力風格插圖」的成功率偏低,對創作者來說不算真正好用。當時我的簡單結論是:能生圖,但別期待太高,而且圖片會有浮水印。這個結論放到 2026 年 9 月已經不成立了,後面「2026 年 9 月更新」那一段會講現況。
浮水印這件事也要更新一下:現在免費版和 Google AI Pro 生成的圖片仍保留右下角可見的星形浮水印,Google AI Ultra 則已移除;2026 年 8 月 14 日起 Gemini App 新增了「關閉角落浮水印」的設定(法規要求的國家除外)。不過 SynthID 這種肉眼看不見的浮水印,不管哪個方案都會一律保留。
⚠️ 下面這張對照表是 2025 年 5 月用舊模型(當時 Gemini 仍靠串接 Imagen、ChatGPT 為 GPT-4o 原生生圖)實測的結果,僅供歷史參考,不代表 2026 年 9 月的現況。
| 任務(2025 年 5 月實測) | Gemini | ChatGPT |
|---|---|---|
| 生成明確指示風格的插圖 | 敗 🤢 | 勝 ✌️ |
| 生成吉卜力風格 | 敗 🤢 | 勝 ✌️ |
| 生成帶文字的圖片 | 敗 🤢 | 勝 ✌️ |
| 類似 Photoshop 去除圖片內的物件 | 勝 ✌️ | 敗 🤢 |
再提醒一次:上表是 2025 年 5 月舊模型的結果。其中「生成帶文字的圖片」這一項,在 Nano Banana Pro 支援繁體中文文字渲染之後,2026 年的評測多半已經反過來判 Gemini 勝出;插圖與風格這兩項也不再是一面倒。想直接看現況的讀者,可以跳到後面的「2026 年 9 月更新」段落。
Gemini 生成圖片實測環節(2025 年 5 月)
這是我當時給 Gemini 和 ChatGPT 的提示詞(以下實測圖片皆為 2025 年 5 月舊模型的產出,保留作歷史紀錄):
構圖名稱:「悄悄補位的 AI」
構圖設定
場景背景:現代感的簡約辦公空間,桌面乾淨、光線柔和。使用者正處於多工狀態,但畫面流暢有序。
主角人物:一位專注的知識工作者(可為男女不限),正在操作筆電,同時看著手機或平板,身體微微前傾,動作自然。
AI 視覺化設計:在人物後方或桌面上方,有一個抽象的 AI 能量體,形狀可為幾何光球或漂浮能量雲,呈現半透明光感。
AI 正同時釋放三條淡淡的光線,分別連結到:
筆電(顯示自動摘要的圖像介面)
平板(呈現智慧建議流程)
空中漂浮的虛擬信封圖示(象徵處理郵件)
構圖動態:所有浮動元素均為無字圖像介面(例如圖示或流程圖),無任何 UI 字元或語言,僅透過視覺圖形表達功能。
風格建議:黑白灰為主調,少量點綴色;構圖具前後層次,背景留白、元素精簡。人物表情自然、不誇張。

ChatGPT 生成圖片的成果
非常精美而且符合我想要的感覺。這當然有部分可能原因是我跟ChatGPT時常來回調整我想要的感覺,所以能夠精準命中。

Gemini 生成圖片的成果
結果非常平庸,大概就是隨處可見的圖片生成等級。已經要求“無任何語言,僅透過視覺圖形表達功能”,但還是出現文字。之後我再要求他要改成“插畫”風格,線條簡單,他還是無法理解,給我類似的圖。🤮

同場加映:Midjourney生成圖片的結果
提示詞必須要先翻譯成英文才能很好生成。雖然已經明確要求不要有文字但是插圖還是出現了文字。不過風格算是獨特而且好看。
如果要 Gemini 生成圖片成吉卜力風格結果如何?
吉卜力風格可以說是 ChatGPT 最標誌性的生成特色了。這股熱潮是 2025 年 3 月 GPT-4o 原生生圖功能上線後帶起來的(很多人以為那是 DALL·E,其實不是;DALL·E 之後也已經被 GPT Image 系列取代),許多人驚訝於它對吉卜力獨特的光影、筆觸與構圖張力的捕捉程度。
於是我在 2025 年 5 月請它將前面我們生成的圖片轉成吉卜力風格。然而,當我們把同樣的請求交給當時的 Gemini,結果卻⋯⋯嗯,相當有落差。讓我們來看看比較(同樣是舊模型的歷史紀錄):

ChatGPT 生成圖片的成果
完美。只有一個字可以形容,完美。雖然電腦背板的圖示有點奇怪但其實還可以再修改。在背景筆觸、人物臉部都準確抓到精髓。

Gemini 生成圖片的成果
就是一個日本可愛插畫風格,有種早期政府宣傳畫的感覺。這,不是我要的吉卜力。🥹
2026 年 9 月更新:Nano Banana 之後,情況反轉了
上面那些實測都是 2025 年 5 月做的。之後 Google 在生圖這塊連續出了三張牌,把局面整個翻過來:
- 2025 年 8 月 26 日 Nano Banana(Gemini 2.5 Flash Image):Gemini 開始用自己的多模態能力原生生圖,不再是串接 Imagen。
- 2025 年 11 月 20 日 Nano Banana Pro(Gemini 3 Pro Image):支援多語文字渲染(含繁體中文),多張圖之間的角色、產品一致性也明顯變強。要注意的是,圖裡如果放大量文字,仍約有 10% 的錯字率,出圖後還是得逐字檢查。
- 2026 年 2 月 26 日 Nano Banana 2(Gemini 3.1 Flash Image):正式取代初代 Nano Banana,成為新的主力快速生圖模型。
ChatGPT 那邊也早就不是 DALL·E 了。2025 年 3 月起 ChatGPT 改用 GPT-4o 原生生圖(就是掀起吉卜力風潮的那一版),之後獨立成 GPT Image 系列;API 端最新的是 2026 年 9 月 8 日上線的 gpt-image-2/gpt-image-2.5,舊的 gpt-image-1 與 gpt-image-1.5 分別預定在 2026 年 10 月 23 日與 12 月 1 日下線。至於聊天模型本身,GPT-4o 已於 2026 年 2 月 13 日從 ChatGPT 下架,現在 Free 方案預設是 GPT-5.6 Luna,Plus(US$20/月,台灣 NT$690/月)以 GPT-5.6 Sol 為主、可切換 GPT-6 Astra。
那 2026 年到底誰比較強?綜合 2026 年各家評測的結果,寫實照片感、圖片內的中文文字、多張圖的一致性這三項多半判 Nano Banana Pro 勝;提示詞遵循度、出圖速度、圖表與資訊圖類則是 GPT Image 系列(評測時多為 GPT Image 1.5)勝出。gpt-image-2/2.5 才剛上線,表現變化請以 OpenAI 官方公告與你自己的實測為準。整理成一張表:
| 用途(2026 年 9 月) | 建議先用誰 | 備註 |
|---|---|---|
| 寫實照片風格 | Gemini(Nano Banana Pro) | Pro 版要 Google AI Pro 以上 |
| 圖片裡要放中文字 | Gemini(Nano Banana Pro) | 大量文字仍約 10% 錯字,要逐字檢查 |
| 多張圖角色/產品要一致 | Gemini(Nano Banana Pro) | 做系列素材、電商圖適合 |
| 嚴格照提示詞做、要快 | ChatGPT(GPT Image 系列) | 提示遵循與速度是強項 |
| 圖表、資訊圖 | ChatGPT(GPT Image 系列) | 評測多判 GPT Image 勝 |
| 去除物件、局部修圖 | 兩邊都可以 | 我 2025 年實測 Gemini 較貼近原圖,新版請自行再測 |
至於「哪個方案才用得到」,這是最常被問的:
- Gemini 免費版:有 Nano Banana,但沒有 Nano Banana Pro;圖片保留可見星形浮水印。
- Google AI Plus(NT$165/月):用量是免費版 2 倍,但一樣不含 Nano Banana Pro。
- Google AI Pro(NT$650/月,US$19.99/月):含 Nano Banana Pro,用量 4 倍;圖片仍保留可見星形浮水印,但 2026 年 8 月 14 日起 App 有「關閉角落浮水印」設定可以關掉。
- Google AI Ultra(NT$3,300/月或 NT$6,500/月):可見浮水印直接移除。
- 不管哪一檔,SynthID 不可見浮水印一律保留,這是 Google 用來標示 AI 生成的機制,關不掉。
- 2026 年 5 月起所有方案改採「compute-used」用量制:每 5 小時重置、直到週上限。生圖很吃用量,大量出圖的人要留意。
官方說明可參考 Google 的 Nano Banana Pro 公告與 Gemini 訂閱方案頁,以及 OpenAI 的 API 定價頁;價格與模型版本以官方頁面公告為準。
現在加入 AI 峰哥 LINE,私訊關鍵字「白皮書」
免費領取「人資 AI 實戰指南」,了解生成式 AI 在 HR 四大應用策略與 16 個 Prompt 範例
» 更多推薦:
讓品牌成為 AI 唯一答案的診斷工具
讓 AI 把你當成答案的關鍵檢查
其他實測
在遠見的其他實測項目中(同樣是 2025 年、Nano Banana 之前的測試),可以看到如果你對於風格沒有很強的要求,其實它在許多的應用場景有不錯的表現。下面是遠見整理出來的結果:
| 實測項目 | 表現亮點 | 待改進之處 |
|---|---|---|
| 產出含中文字的圖片 | 中文字樣呈現清晰,整體辨識度高 | 偶爾出現錯字或文字缺漏 |
| 在圖片中加入物件 | 新增物件與原圖融合度高,背景過渡自然 | 複雜元件可能出現定位不準或比例不協調 |
| 去除圖片內的物件 | 修補區域視覺流暢,畫面整體協調 | 個別細節如線條或紋理略顯粗糙 |
| 圖片合成處理 | 合成後畫面整體感良好,主體結合得宜 | 小範圍細節(如飾品或文字)容易被忽略 |
| 黑白圖加上色彩 | 配色貼近真實,整體效果具備說服力 | 部分人臉細節(如眼鼻口)處理不夠精確 |
Gemini 生成圖片:在中文字的生成表現如何?
這一段的實測同樣是 2025 年 5 月的舊模型。當時 Gemini 的中文字生成確實不行,但 Nano Banana Pro(2025 年 11 月)之後已支援繁體中文文字渲染,2026 年的評測多半判 Gemini 在圖片中文字這一項勝出,只是大量文字仍約有 10% 錯字率。以下保留當時的結果當對照:
提示詞:請生成一張貓咪脖子上掛著卡片的插圖,上面寫著『我沒有那麼委屈』的圖片。

ChatGPT 生成圖片的成果
很可愛,雖然這次中文字生成成功,但是有時中文字生成會有問題。

Gemini 生成圖片的成果
一樣不能理解我要“插圖”風格,給我的是寫實風格的圖片。一開始會給我英文字,經過要求後,中文字的生成有問題。
Gemini 生圖 vs ChatGPT:去除圖片內的物件實測
提示詞:(給予原圖後)去除車子和文字
提供的原圖


ChatGPT 生成圖片的成果
雖然完美執行了任務,但是ChatGPT的方向都是會全部重新生成圖,所以會有一些差別,比如建築物上的文字很難重現。但是有一個額外優點是畫質大提升。

Gemini 生成圖片的成果
處理得不錯,在這個任務上,我要的結果跟接近 Gemini 的生成結果,但是右下角會有浮水印
補充一下上面提到的浮水印:截至 2026 年 9 月,免費版與 Google AI Pro 生成的圖片右下角仍會有可見的星形浮水印,但 2026 年 8 月 14 日起 Gemini App 已提供「關閉角落浮水印」的設定;Google AI Ultra 則直接不加可見浮水印。SynthID 不可見浮水印則所有方案一律保留。
ChatGPT vs Gemini:圖片生成 UI 誰比較好用?
這一段我 2025 年原本寫的是「ChatGPT 有圖片庫、Gemini 沒有」。不過一年多來兩邊的介面都改了好幾輪,圖片庫、歷史紀錄這類細節我這次沒有重新逐一查證,請以你當下打開的 App 為準。這裡改成講幾個 2026 年 9 月確定的差異,對「實際要用」比較有幫助:
Gemini 這邊:生圖直接在 Gemini App 的對話裡下指令就好,App 的模型選單現在主要是 Fast 與 Pro(另可切換 Thinking level),Nano Banana Pro 要 Google AI Pro 以上才用得到。浮水印可以在 App 設定裡關掉角落的可見星形(2026 年 8 月 14 日起,Ultra 本來就沒有)。另外,Gemini in Chrome 已於 2026 年 4 月 20 日在台灣正式上線,內建 Gemini 3.1 與 Nano Banana 2,桌機、iOS、Android 都有,等於在瀏覽器裡就能順手生圖,不用另開分頁。
ChatGPT 這邊:現在的方案是 Free(US$0)、Go(NT$270/月)、Plus(NT$690/月)、Pro(US$100/月或 US$200/月)。「Projects」功能已對所有方案(含 Free)開放,每個專案可以放檔案:Free 5 個、Go/Plus 25 個、Pro/Business 40 個,並支援只在專案內生效的記憶,對於需要把同一個案子的參考圖、提示詞與產出集中管理、反覆比稿的人來說很實用。記憶設定在 Settings → Personalization → Memory,分「saved memories」與「reference chat history」兩種。
結論:各有勝場,看用途選工具
2025 年 5 月我的結論是「ChatGPT 完勝,毫無懸念」,那時的 Gemini 生圖確實像學生交作業,有交但不會拿高分,尤其你對插畫風格有點追求的話,用起來「沒有靈魂」,更別提要抓住什麼吉卜力神韻。這段話我保留在上面當歷史紀錄,因為那是真實的實測結果。
但到了 2026 年 9 月,我得老實改口:Nano Banana Pro 之後,Gemini 在寫實、中文字、多張圖一致性這幾項已經翻身,甚至多半贏過 ChatGPT;而 ChatGPT 的 GPT Image 系列則在提示遵循、速度和圖表類守住了自己的強項。這已經不是「誰替代誰」的問題,而是「哪個用途該開哪一個」。
所以總結兩句:
要寫實照片感、圖裡要放中文字、多張圖要一致?現在換 Gemini(Nano Banana Pro,Google AI Pro NT$650/月起)比較穩。
要嚴格照提示詞做、要快、要圖表和資訊圖?ChatGPT 的 GPT Image 系列還是強項。
這場圖片生成的對決,已經不是 2025 年那種一面倒了。我的建議是兩邊都留著、依用途切換;至於剛上線的 gpt-image-2/2.5 和 Nano Banana 2 在細節上又進步了多少,請以官方公告和你自己的實測為準,這篇之後有機會我再補新一輪的對照圖。
需要針對“公司產業特性”與“實際流程”設計的 AI 課程嗎?需要 AI 補助課程嗎?
如果需要專業講師針對公司產業特性與實際流程設計課程,或者諮詢企業數位課程補助,
建議直接聯繫 AI 峰哥(黃敬峰老師),他擅長依照你想學的特定主題,為個人或企業團隊量身規劃課程內容,甚至從頭到尾負責課程設計、工具選型、流程建議與實際部署。他不只是工具教學者,更會從策略整合、落地流程等面向出發,協助企業建立客製化培訓方案 。
課程介紹與學員課程評價/心得 👉 https://peaker.com.tw/ai
🦾 AI 峰哥過去累積超過 500 小時教學時數,合作過華碩、台灣理光、南山人壽、裕隆、TOYOTA 等企業,專長涵蓋 AI 工具應用、流程自動化到企業內部導入策略等領域 。他的工作坊教學氛圍強調小組互動與實作對話,能促進團隊成員分享使用 AI 的思維與效率提升方式。











