一致性爆火的谷歌 nano-banana 模型
谷歌在8月26日推出 Gemini 2.5 Flash Image 模型 [又名 nano-banana] ,这是他们最先进的图像生成和编辑模型。此次更新支持将多幅图像融合成一幅图像,保持角色的一致性以丰富叙事,使用自然语言进行有针对性的转换,并利用 Gemini 的世界知识来生成和编辑图像。
该模型现已通过 Gemini API 和 Google AI Studio(面向开发者)以及 Vertex AI(面向企业)提供。Gemini 2.5 Flash Image 的定价为每 100 万个输出 token 30.00 美元,每张图片包含 1290 个输出 token(每张图片 0.039 美元)。所有其他输入和输出模式均遵循 Gemini 2.5 Flash 定价。

更新的四大亮点
保持角色的一致性
图像生成中的一个根本挑战是如何在多个提示和编辑中保持角色或物体的外观。现在您可以将同一个角色放置在不同的环境中,在新的场景中从多个角度展示同一款产品,或者生成一致的品牌资产且同时保留主体。
他们在 Google AI Studio 中构建了一个模板应用程序 [您可以在其上轻松自定义和编写代码, 地址:https://aistudio.google.com/apps/bundled/past_forward?showPreview=true&showAssistant=true ] 来展示该模型的字符一致性功能。
注意:国内的线路地址不支持,请切换其他线路地址。
除了角色一致性之外,该模型在遵循视觉模板方面也表现出色。已经看到一些开发者探索了诸如房地产房源卡、统一员工徽章或整个产品目录的动态产品模型等领域——所有这些都基于一个设计模板。
基于提示的图像编辑
Gemini 2.5 Flash Image 支持使用自然语言进行有针对性的变换和精准的局部编辑。例如:该模型可以模糊图像背景、去除 T 恤上的污渍、从照片中移除整个人物、改变拍摄对象的姿势、为黑白照片添加颜色,或者任何你只需要简单提示就能实现的功能。
为了实际展示这些功能,他们在 AI Studio 中构建了一个照片编辑模板应用程序,其中包含 UI 和基于提示的控件 [地址:https://aistudio.google.com/apps/bundled/pixshop?showPreview=true&showAssistant=true ]。
本土世界知识
历史上,图像生成模型在图像美感方面表现出色,但缺乏对现实世界的深度语义理解。借助 Gemini 2.5 Flash Image,该模型能够利用 Gemini 的世界知识,从而解锁新的用例。
为了演示这一点,在 Google AI Studio 中构建了一个模板应用,将一个简单的画布变成了一个交互式教育导师。它展示了该模型读取和理解手绘图表、帮助解答实际问题以及一步完成复杂编辑指令的能力 [地址:https://aistudio.google.com/apps/bundled/codrawing?showPreview=true&showAssistant=true ]。
多图像融合
Gemini 2.5 Flash Image 可以理解并合并多幅输入图像。您可以将物体放入场景中,用配色方案或纹理重新设计房间,并只需一个命令即可融合图像。
为了展示多图像融合,在 Google AI Studio 中构建了一个模板应用程序,可让您将产品拖到新场景中,以快速创建新的逼真的融合图像 [地址:https://aistudio.google.com/apps/bundled/home_canvas?showPreview=true&showAssistant=true ]。

如何使用
登录地址:https://aistudio.google.com/prompts/new_chat?model=gemini-2.5-flash-image-preview
上传图片文件
输入提示词







模特换皮商家的福音。
像其他的提示「现在已经没有精准提示一说了,自然语言完全能做到」有很多博主已经发了,这里不再测试,但是要注意:谷歌为了保护版权,禁止用户使用水印移除等命令。
希望今天的文章能帮助到你,请点赞关注转发三连谢谢
声明:本站所有文章,如无特殊说明或标注,均为本站作者原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。本文来自作者自媒体,不代表UIED观点和立场。 如若本站内容侵犯了原著者的合法权益,可联系我们进行处理以减少您的损失。
标签







评论 0
最新评论登录后发布评论并参与互动。
暂无评论,欢迎抢沙发。