AI 應用地圖 · 圖像生成
Nano Banana (Gemini)
Google Gemini 原生影像生成,2025/8 以 3D 公仔風格爆紅;Nano Banana Pro 基於 Gemini 3,可做資訊圖與多圖角色一致
- 開發型態No-code + Pro-code
觀念教學
Google 把影像生成直接做進 Gemini — 2025 年 8 月以 3D 公仔風格一夜爆紅的 Nano Banana,強項是用聊天的方式改圖,以及跨圖維持角色一致。
它是什麼
- 開發商:Google,Gemini 模型原生的影像生成能力
- 核心能力:文字生圖與對話式編輯,多張圖之間角色長相穩定一致;Nano Banana Pro 基於 Gemini 3,能產出含正確文字的資訊圖
- 同類定位:Midjourney 贏在藝術風格,Nano Banana 贏在編輯與一致性 — 上傳照片、一句話換背景換衣服,人還是同一個人
典型情境
- 上傳自拍,生成一系列姿勢不同、長相一致的 3D 公仔角色圖
- 電商產品照一句話換場景:同一雙鞋從棚拍搬到街拍
- 用 Pro 版把一段資料重點直接變成排版清楚的資訊圖
選型重點
- 要改圖、合成、角色一致 → Nano Banana;要極致藝術風格 → Midjourney;已在 OpenAI 生態 → GPT Image,兩者同屬對話式生圖路線
- 一般使用者從 Gemini 入口即用(No-code),開發者可走 API 整合(Pro-code)
- 生成與編輯真人照片涉及肖像權與深偽疑慮,商用前確認授權與內部規範
💡 一句話記憶:Nano Banana = 會聽話改圖的香蕉,改十次人不走鐘。
iPAS 考點
科目二圖像工具題:判斷關鍵字是原生多模態、對話式編輯、角色一致。題目給「同一角色要出現在多張場景圖」→ 方向是 Nano Banana 這類一致性強的模型;陷阱是把它當獨立生圖網站 — 它是 Gemini 的原生能力,分類上屬「通用模型的影像功能」。