AI改圖最令人頭痛,莫過於只想換衫或改背景,角色樣貌卻突然變成另一個人。Google於2026年10月7日推出Nano Banana 2.1,主打連續多輪局部修改、3級Thinking推理模式及最高4K輸出。這次升級真正殺着,正是要終結反覆「抽卡」般重新生成圖片的困局。

Google新模型鎖定多輪改圖痛點

Nano Banana 2.1建基於Gemini 3.6 Flash,在兼顧生成速度與成本效益之餘,進一步加強理解提示詞、繪製文字及維持主體一致性的能力。用戶可直接以自然語言逐次更改服裝、背景或圖片文字,模型則盡量保留人物與物件原有外貌,毋須每改一處便重新生成整張圖片,令一般用戶亦可更輕鬆完成細緻修改。

新功能曝光引爆用戶比較焦點

事件曝光後,AI繪圖長久以來最令用戶不滿的「愈改愈走樣」問題,再次成為功能比較焦點。過往即使首張圖片效果理想,後續要求微調細節,也可能令角色五官或物件造型出現變化;Nano Banana 2.1則以多輪編輯一致性正面處理這項痛點。官方資料未有提供具體網民留言,但新模型能否在實際操作中穩定鎖定主體,無疑是用戶最關心的一環。

三段推理模式配合最高4K輸出

轉折在於,Google不只改善局部改圖,更首次加入minimal、medium及high三種Thinking強度,讓用戶按任務難度,在速度、成本及畫質之間自行取捨。內部測試顯示,啟用Thinking後偏好度得分達1,050分,超越Nano Banana 2與Nano Banana Pro;模型預設輸出1K,並支援2K、4K及1:4、4:1、1:8、8:1等超寬比例,同時修正全景圖拼接紋理問題,現已陸續整合至Gemini及Google旗下AI產品。