周二,Google正式发布其最新版AI图像生成模型Nano Banana 2.1,该模型可将文本描述转化为图像,或对现有图片进行精准编辑。此次更新已逐步上线至Gemini App、Google搜索的AI模式、Google Ads,以及Google AI Studio、Flow和Stitch等开发者平台。
历史背景与市场影响
初代Nano Banana曾推动Gemini应用实现爆发式增长。2025年9月,凭借将用户自拍转化为收藏级手办模型的功能,Gemini一度登顶主流应用商店榜首,终结了ChatGPT近三年的领先优势。同期,Alphabet(Google母公司)市值首次突破3万亿美元。
Nano Banana 2.1的核心技术升级
本次更新聚焦三大关键改进:视觉表现力全面优化,画面质感与细节呈现更具真实感;蒙版编辑功能更精准,用户仅需标记区域即可实现局部修改,操作直观高效;主体一致性显著增强,即使经过多次编辑,人物或物体特征仍能保持稳定,避免形象失真。
性能表现与技术规格
在文本生成图像的偏好测试中,Nano Banana 2.1获得1050 ELO评分,优于前代版本的990分,也大幅领先于Nano Banana Pro的935分。该评分体系以相对质量为基准,数值越高代表生成效果越优,且无上限设定。
技术层面,新模型支持同时处理最多14张参考图像,可追踪最多4名人物与10个物体。输出分辨率最高可达4K,支持高达8:1的宽屏比例,满足专业级视觉创作需求。
开发者能力与成本优化
开发者现可通过API自定义模型“思考”时长,并启用生成前的Google搜索与图片搜索核查机制,实现“先查询,后绘图”的智能流程,有效提升内容准确性。
标准1K分辨率图像的API调用费用为每张0.0336美元,仅为上一代0.067美元的一半;4K图像价格降至0.0756美元,相较原价0.151美元下降约50%。批量任务还可额外享受五折优惠。
以1K分辨率计算,生成千张图像的成本现已降至约33.60美元,较此前的67美元近乎减半。这一显著降本不仅提升了效率,也为商业应用提供了更强的经济可行性。

