过去一个月,AI 图像模型简直像开 春晚 一样扎堆登场。

先有 Google 的 NanoBanana 全球爆火,引发百万级讨论。紧接着,字节跳动推出 Seedream 4.0 又把卷度拉满,迅速占据热榜。

就在大家还在热议这两款模型时,LovartAI 火速接入,并在 9.10–9.20 期间限时 0 积分免费开放体验。

LovartAI 是全球首个设计 Agent,接入了 NanoBanana、Seedream4.0、Veo3、IMG1、可灵、海螺、Vidu、Tripo 等一系列顶尖模型,相当于把最新的 SOTA 全家桶打包到一站,不用切平台就能直接上手。

作为长期混迹 AI 圈的数字游民,我第一时间上手实测,这篇文章就带你看看 NanoBanana 和 Seedream 4.0,谁才是真正的狠角色。

 01  模型测评 

1)写实照片变桌面手办

在 Lovart AI 首页的对话框中,输入提示词即可快速生成内容,如果你想要调用某个模型,也可以在提示词结尾加一句:“使用 Nano banana 模型生成”,比如近期爆火的手办案例提示词。

提示词:将这张照片转换为角色手办。在手办背后放置一个印有该角色图像的包装盒,并在旁边展示一台电脑,屏幕上显示 Blender 建模的制作过程。在包装盒前方放置一个圆形塑料底座,上面站立着角色手办。让 PVC 材质呈现出清晰真实的质感,并尽量将场景设置在室内环境中,2:3尺寸。使用 Nano banana 模型生成。
Image
Lovart AI 具备多模态长窗口能力。首轮生成后,你可以直接输入第二轮指令“使用 Seedream4.0 模型重新生成”,系统会基于首轮的图像和提示词自动切换模型,无需重复操作。
Image
最后我们来看下这两个模型生成的效果:
Image

这两个模型生成的整体效果都没什么问题,但要说有啥很明显的差别,就是分辨率、清晰度了。

Nano banana 锁分辨率,放大看的话是比较模糊的。而 Seedream 4.0 直接给你高清大图,细节非常清晰,我把它俩在 Lovart AI 中生成的界面给大家看看就知道了。
Image
再换张图像生成,提示词用上面那组(生成桌面手办角色的通用提示词),我觉得 Seedream 4.0 生成的材质更像是手办,其次图像的分辨率太“领先”了,Nano banana 一直给我的痛点就是图像的清晰度偏低。

2)草图控制

上个案例,我们是在 Agent 对话框中输入提示词生成图像,这次我们换个方式,用 ChatCanvas 功能。

将人物姿势图和服装套图上传至 Lovart AI 中,框选两张图像后,按键盘上的“Tab”调出提示词输入框。
Image

接着输入提示词,记住这里要加上“使用 xxx 模型生成”的提示词。

提示词:请参考图1的姿势,将图2的服装穿着在一名亚洲女模特身上,户外城市街头背景,身后是灰色混凝土墙或带有涂鸦的墙面,地面为水泥或石砖铺装,阳光从侧面照射营造午后氛围,阴影柔和自然,整体画面高清写实,色调干净简洁,突出人物主体,氛围随性自然,带有街拍感,2:3尺寸。使用 Nano banana 模型生成。
Image
最后,来看下两款模型的效果对比。
Image

再换两张图像和提示词生成,测试发现两款模型均会出现人物姿势与草图不匹配的现象,不是特别稳定。

提示词:请参考图1的姿势,将图2的服装穿着在一名亚洲男性模特身上,场景为开阔的户外广场,背景是蓝天白云与远处的现代建筑,地面为浅灰色石砖,阳光明亮从斜侧方照射,投下清晰的阴影。画面氛围清新通透,整体高清写实,服饰细节清晰,色调明快自然,带有动感与视觉冲击力,2:3尺寸。
Image
Image

3)多图融合

多图编辑的需求,个人认为用 ChatCanvas 功能是最方便的,将下面三张图像上传至 Lovart AI 中。
Image

输入提示词生成,两款模型表现大差不差,当然也有 AI 的通病:随机性......

提示词:请参考图1中的人物,将参考图2中的服装完整准确地穿着在人物身上,参考图3作为背景,保持背景环境真实清晰,人物与场景协调。
Image

4)批量编辑图像

上个高难度,前面我们跑案例是一张张生成,主要是测试两款图像编辑模型。这个案例我顺带测试下 Lovart 的批量处理能力。

上传 5 张图像,1 张模特图+4 张产品图,要求是生成 4 张不同产品、同一模特的图像。

提示词:保持模特的姿势和表情不变,将她手中的饮料罐替换为我提供的产品图,共生成4张图,每张图分别对应一张产品图。要求罐子的角度、比例与原图保持一致,产品标签清晰完整,金属质感和冷凝水珠效果自然,整体画面高清写实,模特与罐子融合自然,2:3尺寸。
Image
我们先来看下 Nano banana 跑出来的效果,没得说,效果牛的一批......
Image
再来看下 Seedream 4.0 批次生成的效果,对比 Nano banana 生成的效果而言,稳定性差了些(产品大小、模特角度细微变化等),但产品的样式依旧是清晰可见的。
Image
最后看看 Lovart AI 在批次生成时,于我而言觉得它聪明的地方。在模型生成图片有错误时,Lovart AI 会自主检测并调用其它模型来修复错误。
Image

完活~两款模型的测试就先到这,总体而言,它们各有优缺点。Nano banana 模型编辑图像时相对稳定,大大降低了抽卡次数,Seedream 4.0 在图像分辨率上一骑绝尘,望各位看官灵活选择。

下面我用 Lovart AI 跑了两个案例,希望对大家正确使用 Lovart AI 提供些许帮助。

 02  应用案例 

两个场景:短片生成和品牌 VIS 设计延展。目的是测试 Lovart AI 任务拆解、批量生成和模型/工具调用能力。

1)AI 短片生成

准备一张分镜图,让 Lovart AI 基于这张图自动生成多张人物/风格一致性的分镜图。

提示词:基于参考图,保持少年角色外貌与写实魔法世界风格一致,生成用于短片的6张连续分镜图,具有电影感和连贯的叙事氛围,16:9尺寸。
Image
图像生成模型我选择用 Seedream 4.0,可以在输入框底部设置,只勾选 Seedream 4.0 即可稳定调用。
Image
批次生成的分镜图效果如下,Seedream 4.0 对人物、场景的一致性做得也非常好。
Image
Lovart AI 在图像生成结束后,会告诉你它设计的故事情节,如果你觉得不满意可以随时让它帮你修改,这种只用下需求不用干活的感觉太绝了......
Image

接着,就是需要将这些分镜图转换为视频,我选择使用可灵 2.1 模型的首尾帧功能,你可以直接在对话框中输入提示词指令,让它来做执行,甚至是直接给你剪辑成一个完整的视频,提示词这样写:

提示词:将这 6 张分镜图用Kling 2.1 视频模型的首尾帧功能生成视频,制作成 AI 短片。其中第一帧和第二帧作为第一个视频片段,第二帧和第三帧作为第二个视频片段,依次往下推... 最后再帮我剪辑成一条完整的 AI 短片视频。

给大家看看它的执行过程,对用户提出的任务需求理解的非常正确。
Image

最后看看它给我剪辑出来的完整视频:,时长00:25

在短片中有两个片段生成的效果有错误,这是因为 Lovart AI 在调用模型生成时,每段视频只会生成 1 次。

而玩过视频生成的朋友都知道,要想得到一条满意的视频效果,往往需要我们多轮抽卡。

随着日后视频模型越来越稳定,Agent 能力越来越强(能自动检查错误片段重新生成),创作的门槛会越来越低,技术将在 AI 时代下彻底平权。

这条短片,我仅仅下达了两句提示词,甚至准确点说应该是下达指令,它在几分钟内就给了我完整视频。

2)品牌 VIS 设计

从一张 LOGO 图,做成一整套 VIS 物料,给 Lovart AI 的图片如下:
Image

写了一段很长很长的提示词,注意,这组提示词其实就是生成单张图片的提示词合集,只不过一次性给 Lovart AI 批量生成,毕竟它具备这种能力。

提示词:基于我提供的LOGO图,生成一整套品牌延展物料,包含以下部分:

1. 品牌VI设计展示图

- LOGO在标准色背景、深色背景、浅色背景下的展示方案

- 包含标准色版本、反白版本、线框版本等多种展示形式

- 展示LOGO在不同应用场景中的规范用法,整体高清、整洁、专业

2. 品牌图形设计

- 将LOGO拆解为独立的图形元素(如文字部分与符号部分分开展示)

- 输出LOGO的核心图形造型(如独立的图标图形)

- 保持简洁的扁平风格,便于后续品牌应用

3. 标准制图

- 为LOGO绘制线框网格,展示LOGO字母的比例与构造关系

- 使用规范的标注方式(例如X高度、间距比例、角度标注等)

- 输出LOGO标准制图效果,体现专业的品牌设计规范

整体要求:保持与提供LOGO一致的风格,高清写实,版式简洁专业,适合作为完整的品牌设计规范物料。

使用的模型依旧是 Seedream 4.0,在生成结束后会给你返回对应的说明。
Image
生成的 VIS 图如下:
Image

接着,我再给它一组提示词,生成该品牌的场景应用展示,提示词如下:

提示词:基于我提供的LOGO图,生成一整套品牌VIS应用场景效果,包含以下内容:

  1. 场景应用展示
  • 名片、手提袋、T恤、随行杯、礼盒包装、办公前台背景墙
  • LOGO在不同材质和背景下的应用,包含标准色、深色、浅色背景
  • 保持整体风格轻快、现代、简洁大方,真实写实的应用场景效果
  1. 平面物料展示
  • 展示信封、文件夹、文本文档等办公文具
  • LOGO清晰规范展示,色彩搭配统一,整体排版专业简洁
  1. 物料展示
  • 水杯单品展示,多个规格(大杯、中杯、小杯)放入透明展示柜
  • LOGO清晰呈现,体现品牌一致性
  1. 平面尺寸图
  • 水杯展开图,带有灰色辅助线条,标注杯子、杯底、杯口的尺寸
  • 展开图上清晰展示LOGO和实际标注数据,采用扁平风格
  1. 大场景组合展示
  • 将名片、文件夹、手提袋、水杯、包装盒、T恤等物料放置在同一画面
  • 模拟真实品牌发布会或展示空间效果,高清写实,整体美观
  1. 真人展示应用
  • 一位中国年轻女性模特,甜美笑容,身穿品牌T恤,左手提着手提袋,右手拿着随行杯,白色背景
  • 一位中国年轻男性模特,阳光笑容,身穿品牌T恤,左手拿着礼盒包装,右手递出一张名片,白色背景
整体要求:高清、写实风格,排版整洁统一,充分体现LOGO在各类应用场景中的规范化与延展性,适合作为完整的品牌VIS展示。
Image

当然,你是可以将这个案例的两组提示词写成一组,在文章中放的话实在太长了,所以我拆开成两段生成。

好了,以上就是本篇文章的全部内容。

最后,强烈推荐大家去 Lovart AI 上玩玩,9.10–9.20 期间限时 0 积分免费使用 Nona banana 和 Seedream 4.0 模型,地址在这:https://www.lovart.ai/zh/home

如果你是Pro+ 会员,9.20 前无限畅用 可灵 & 海螺。并且并且,官方还说了,如果是在 9.20 前开通 Basic 及以上会员,Nona banana 和 Seedream 4.0 模型全年 0 积分免费生成......太有实力了。

AI 模型的迭代速度,已经快到让人还没玩透就被下一代取代。

那么问题来了:如果只能选一个模型陪你长期创作,你会押注谁?