推荐Lovart 中文版 - 一站式 AI 设计平台推荐一人企业Vibe Coding社区!热门AI设计工具新品免费AI编程工具 Trae - 智能编码助手Seedance2.5已上线新用户注册即领免费算力
UIED.CN今天偷学哪一招,朋友

Stable Diffusion | 图生图界面介绍

图生图模式,就是通过预处理现有图片生成新的图片,首先需要上传图片,将图片进行处理,处理方法包括生成线稿,蒙版涂鸦等,然后配合填入相关的提示词,调整参数等,SD将会在原图信息的基础上,结合提示词参数等生成新的图片,目前用途有,线稿上色,草图细化,风格转换,图片放大等。

一、图生图与文生图的界面区别

图生图界面和文生图界面多了两个板块,主要是用来处理源图片,转换为SD软件能理解的文字语言,然后进入文生图运作进程,

  • 增加的第1个板块是反推板块:CLIP反推和DeepBooru反推,即根据图片反推出提示词,需要另外安装插件。

    以下是文生图和图生图界面对比

它们有什么区别呢?用下面的图反推一下看看区别

CLIP反推:

a woman in a dress standing on a balcony with a castle in the background and a sky background with clouds, Ai-Mitsu, city background, a detailed painting, fantasy art

一个穿着裙子的女人站在阳台上,背景是城堡,天空背景是云,爱光,城市背景,详细的绘画,幻想艺术

DeepBooru反推:

building, city, cityscape, cloud, skyscraper, castle, 1girl, skyline, tower, architecture, town, navel, navel_cutout, bridge, railing, sky, cloudy_sky, solo, long_hair, sunset, east_asian_architecture, clock_tower, rooftop, ruins, outdoors, blue_eyes, clothing_cutout, pagoda, smile, looking_at_viewer, scenery, black_hair, dress, mountain, breasts, twilight

建筑、城市、城市景观、云、摩天大楼、城堡、女孩、天际线、塔、建筑、城镇、肚脐、剪影、桥梁、栏杆、天空、云天、独奏、长发、日落、东亚建筑、钟楼、屋顶、废墟、户外、蓝眼睛、衣服剪影、宝塔、微笑、观赏者、风景、黑发、衣服、山、乳房、黄昏

CLIP注重画面内的联系,生成的自然语言描述。

DeepBooru对二次元图片生成标签,对二次元的各种元素把握更好。

  • 增加的第2个板块是图片预处理板块:用来上传并处理图片,粘贴,拖拽以及上面都可以。

二、图生图一般工作流程

1.上传图片;

2.填入提示词(描述源图片画面内容);

3.选择模型;

4.设置相关参数(宽高根据源图片调整);

5.生成样图;

6.根据样图调整参数,模型和提示词;

7.多次调试,达到满意的效果。

三、图片预处理窗口介绍

>>导入图片

  • 图片上传的4种方式
  1. 鼠标拖拽上传
  2. 复制粘贴
  3. 文生图发送
  4. 图片信息发送至
  • 导入窗左上角图标
  • 铅笔:裁切上传图片;
  • 号:清除图片。

>>导入图片

1.仅调整大小/拉伸

通过压扁拉伸源图片修改尺寸。

2.比例裁剪后缩放/裁剪

按设置尺寸截取图片中心区域。

3.缩放后填充空白/填充

相当于PS内容填充,根据源图片边缘区域的内容填充其余尺寸区域,需要把重绘幅度调高。

4.调整大小 (潜空间放大)

三、图生图功能六大类:


>>图生图 / img2img

根据你上传的图片生成一张在原图基础上创作的新图片可以通过修改 Prompt去自定义想要的结果。

>>涂鸦绘制 / sketch

在原图基础上涂鸦后,进行二次创作,也可以进行线稿的上色,选择合适的模型,如果想要生成二次元的,就选择二次元模型。

>>局部绘制 / inpaint

在局部绘制中,我们只需要将需要重绘的地方圈出来,然后加上 Prompt提示词即可其中蒙版的黑色画笔并不是一种真的颜色,它是一片代表透明(不可见)属性的区域比如,将图片中的女生头发换成一头白发,只需要将图片上的头发区域涂上蒙版,然后在 Prompt中输入 white hair提示词即可,如果想要更好的效果,自己设置更多的 Prompt进行描述,除了头发,其他任何区域都可以进行重绘。

>>涂鸦蒙版 / inpaint sketch

相比于局部重绘,多了一个蒙版透明度的配置,但这个蒙版是可以自定义颜色的,在局部绘制中画笔只有黑色,而在涂鸦蒙版中蒙版的颜色会影响到原图,选择什么颜色最终重绘都会往这个颜色上靠,蒙版透明度按照需要颜色的程度调节,最好不要超过40,比如将动漫女生衣服换成红色的旗袍,只需要将衣服用红色的画笔涂抹,然后在 Prompt中输入中国旗袍的英文解释即可,因为涂鸦蒙版的颜色是会影响到原图的,所以如果是用蓝色涂抹衣服,最终将会生成蓝色的旗袍。

>>上传重绘蒙版 / inpaint upload

跟涂鸦蒙版其实差不多,只是上传的蒙版需要借助其他工具,如PS的处理,相比直接手涂更精确,上传蒙版的蒙版在制作时可以设置部分透明的效果(不同程度的灰),还有边缘的羽化等等。使用需要注意的一点是,在上传蒙版中,白色代表重绘,黑色代表不处理。也不用细分,如果弄错了,在蒙版模式中选择重绘非蒙版就可以。

>>批量处理 / batch

批量处理功能用的不多,只要输入图片所在目录路径、图片处理后保存的路径以及蒙版路径即可批量处理。

三、图生图参数介绍:

>>Resize mode:缩放模式

缩放模式指的是当原图和要生成的图的宽和高不一致的时候,选择的缩放模式,一般选择裁剪,如果原图和生成图的宽高一致的时候,选择任意均可,所以在生图之前建议调整目标图片宽高尽可能和原图一致。

  • 仅调整大小/Just resize:通过压扁拉伸源图片修改尺寸。
  • 裁剪后缩放/crop and resize:按设置尺寸截取图片中心区域。
  • 缩放后填充空白/resize and fill:相当于PS内容填充,根据源图片边缘区域的内容填充其余尺寸区域,需要把重绘幅度调高。
  • 调整大小(潜空间放大)/just resize (latentipscale)

>>Mask blur:蒙版模糊度

相当于PS里面的边缘羽化,我们可以在0到64之间调节数值。会使我们涂抹的区域从边缘向中间逐渐透明。如果数值较小,边缘会更加清晰锐利。因此,选择一个适当的数值可以让图片看起来更加真实。通常情况下,使用默认数值即可获得理想效果。

>>Masked content:蒙版区域内容处理

包括:填充/fill、原图/original、潜空间噪声/latent noise、无潜在空间/latent nothing。这是预处理的一个步骤,其中填充是使用蒙版边缘图像的颜色进行填充,但颜色已经被高度模糊处理;原图则完全保留了原来的细节;潜在噪声则使用噪点进行填充;而无潜在空间是指噪点值为0的状态。只有原图选项能保留画面的原貌,所以通常选择原图即可。

>>Mask transparency:蒙版的透明度

一般默认为0,即不透明,因为透明度越高,AI发挥的空间越小,基本上当透明度大于60,预处理就会失去作用。

>>Mask mode:蒙版模式

包括绘制蒙版内容/inpaint masked、绘制非蒙版内容/inpaint not masked,这个很好理解,选择第一个就是只在蒙版区域重绘,另一种则相反,正常一般默认第一个即可。

>>Inpaint area:重绘区域

包括全图/whole picture、仅蒙版/only masked。全图重绘是在原图的尺寸下重新绘制蒙版区域,优点是内容与原图更好地融合,但缺点是细节不够突出。而蒙版重绘是将蒙版区域放大到原图尺寸,进行绘制后再缩小到相应位置,优点是细节更加清晰,但缺点是细节过多,与原图的融合效果不够理想。

>>Denoising strength:重绘强度

"重绘幅度"指的是对于一个图像或图形进行重新绘制的程度或范围。数值越小越接近原图,一般默认0.75左右,数值越大,越自由发挥,与原图相关性越来越低。低强度就是基本不重绘,越高重绘越强,融合越不好,所以默认即可虽然图生图的参数比较多,但大多数的时候,我们选择默认即可,因为很多时候,只需要正确的选择而非过多的选择,个人也仅仅设置一下缩放模式、采样器、采样步骤和宽高进行出图。

文章声明

声明:本站所有文章,如无特殊说明或标注,均为本站作者原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。本文来自作者自媒体,不代表UIED观点和立场。 如若本站内容侵犯了原著者的合法权益,可联系我们进行处理以减少您的损失。

标签

评论 0

最新评论

登录后发布评论并参与互动。

暂无评论,欢迎抢沙发。

推荐阅读

查看更多