Google新模型鎖定多輪改圖痛點
Nano Banana 2.1建基於Gemini 3.6 Flash,在兼顧生成速度與成本效益之餘,進一步加強理解提示詞、繪製文字及維持主體一致性的能力。用戶可直接以自然語言逐次更改服裝、背景或圖片文字,模型則盡量保留人物與物件原有外貌,毋須每改一處便重新生成整張圖片,令一般用戶亦可更輕鬆完成細緻修改。
新功能曝光引爆用戶比較焦點
事件曝光後,AI繪圖長久以來最令用戶不滿的「愈改愈走樣」問題,再次成為功能比較焦點。過往即使首張圖片效果理想,後續要求微調細節,也可能令角色五官或物件造型出現變化;Nano Banana 2.1則以多輪編輯一致性正面處理這項痛點。官方資料未有提供具體網民留言,但新模型能否在實際操作中穩定鎖定主體,無疑是用戶最關心的一環。
三段推理模式配合最高4K輸出
轉折在於,Google不只改善局部改圖,更首次加入minimal、medium及high三種Thinking強度,讓用戶按任務難度,在速度、成本及畫質之間自行取捨。內部測試顯示,啟用Thinking後偏好度得分達1,050分,超越Nano Banana 2與Nano Banana Pro;模型預設輸出1K,並支援2K、4K及1:4、4:1、1:8、8:1等超寬比例,同時修正全景圖拼接紋理問題,現已陸續整合至Gemini及Google旗下AI產品。


