6 月 30 日,Google 在官方部落格發表 Nano Banana 2 Lite,型號 gemini-3.1-flash-lite-image,定位是 Nano Banana 家族「最快、最具成本效益」的影像模型:文字生圖約 4 秒、每張 1K 解析度 0.034 美元,瞄準高吞吐、高速迭代場景。同場還有影片生成模型 Gemini Omni Flash 進入公開預覽,每秒輸出 0.10 美元,價格與 Veo 3.1 Fast 相同。
重點不是單一模型,而是「快出圖、再動圖」的串接工作流——官方說得直白:「把這些模型串起來,真正的魔法才會發生」。
四秒生圖的經濟學
0.034 美元改變的是使用行為:一張草圖降到台幣一塊錢等級,「先生成十張再挑一張」就從奢侈品變成預設操作。Google 強調 Lite 在壓低成本與延遲的同時,仍保留提示遵循、角色一致性與圖內文字可讀性——正是快速草稿流程最容易犧牲的三項能力。
官方也把最早的 Nano Banana(Gemini 2.5 Flash Image)標記為 legacy 並建議遷移——兩年前的旗艦如今成了入門替代品,是成本下滑的最好註腳。
家族分工:Lite、2 與 Pro
Google 現在把影像生成切成三層:Nano Banana 2 Lite 負責速度與規模;Nano Banana 2 是平衡的「workhorse」,應付一般日常生成;Nano Banana Pro 守住複雜專業工作的品質上限。二月發表的 Nano Banana 2 主打「Pro 級能力、Flash 級速度」,Lite 再往成本端推一格。對開發者而言,草稿、批量與正式輸出可分別路由到不同模型,用同一套 API 管理三種成本結構。
Gemini Omni Flash 與模型串接
Omni Flash(gemini-omni-flash-preview)是影片生成與對話式編輯模型,首次亮相於 Google I/O。支援文字、圖片、影片作為參照輸入,帶入 Gemini 的真實世界知識,能把文字與圖形同步到影片動作。限制也清楚列出:單次生成上限 10 秒、暫不支援音訊參照上傳與場景延伸、影片參照尚未正確處理,跨場景與運鏡時的角色一致性仍可能失守。
串接的形態是三個可拆改的示範應用:Omni Product Studio 把 Lite 的商品靜圖轉成電商影片,另有 Anywhere 與 Space Lift;Interactions API 支援每次對話最多三次連續編輯。
鋪貨範圍、浮水印與雜訊爭議
Lite 即日起在 Google AI Studio、Gemini API 與 Agent Platform 提供,並陸續推進到 Search 的 AI Mode、Gemini app、NotebookLM、Photos、Stitch、Flow 與 Google Ads;Omni Flash 同步在 AI Studio、API 與 Agent Platform 公開預覽。
兩個模型都使用 SynthID 浮水印,可透過 Gemini app、Chrome 與 Search 驗證。時間點的背景:TechCrunch 引述報導估計 TikTok 約六成影片已是 AI 生成內容,Google 與 A24 的 7,500 萬美元合作也引發粉絲反彈。生成成本再降一個數量級後,如何不成為 slop 量產工具,是這條產品線的長期考題。
參考來源
- Gemini Omni Flash and Nano Banana 2 Lite — Google
- Google introduces a faster, cheaper image generator with Nano Banana 2 Lite — TechCrunch
- Google launches Nano Banana 2 — TechCrunch
本文由 AI 協助自上述來源整理,經人工審核後發布。
