|
|
马上注册,结交更多好友,享用更多功能,让你轻松玩转社区。
您需要 登录 才可以下载或查看,没有帐号?免费注册
x
本帖最后由 wulesoicq 于 2026-3-7 18:07 编辑
郑重声明
所有模型权重均来自网络。不对您生成的内容主张任何权利,赋予您自由使用的权利,同时确保您的使用符合本许可的规定。您需完全负责对模型的使用,不得分享任何对个人或群体造成伤害、传播旨在伤害的个人信息、散布错误信息或针对弱势群体的内容。有关限制的完整列表及您的权利详情,请参阅许可证全文
本文所有图片资料均为AI生成,旨在学习分享人工智能前沿技术和现实人物无任何联系!!!
*************************************************************************
以后图像生成的工作流分享和新模型的更新都会放在这个贴子里,先从最基础的开始。
为了方便想入门的萌新小伙伴过渡使用,特别做了个基础版的comfyui整合包,基础的工作流都能用。但是想玩好comfyui还是要学会自己部署环境。
整合包版本
Python version: 3.12.10
pytorch version: 2.8.0+cu128
ComfyUI version: 0.3.64
ComfyUI frontend version: 1.27.10
请更新显卡驱动,要支持cuda12.8
comfyui 纯新手教学 第一期 (comfyui环境部署)
comfyui 纯新手教学 第二期 (comfyui插件安装)
现在主流的AI图像生成模型有黑森林工作室的FLUX系列模型和阿里巴巴的Qwen-Image系列模型(包括传统模型以及编辑模型),它们各有优缺点。
FLUX模型细节更加丰富,开源时间比较早社区生态支持比较完善。但构图的精确性和对提示词遵循能力有所欠缺。人物皮肤过于油腻有明显的塑料感,黑森林官方微调的krea模型在这方面有了很大的改善,而且光影色彩方面也有了很大的提升,更接近摄影作品可以说是目前人像摄影真实性及美学特征最好的模型。
Qwen_Image模型在构图和对提示词遵循能力有明显的加强。有很强的中文图文编辑能力。但在诸如人物面部及肌肉线条,光影色彩等很多细节方面都有所不足,这可能和Qwen_Image训练时使用的素材中,AI生成的图片太多真实的摄影作品不足的原因有关。
我们来看看这些模型对简单的成人内容提示词出图效果
- 一位年轻的东亚女性表情平静的直视镜头,仅穿着一件紧贴其丰满胸部的时尚露脐上衣,下半身赤裸。
- 她坐在一张简约的淡蓝色沙发上,双腿大大张开,露出阴道。
复制代码
FLUX DEV
我们可以看到FLUX dev模型生成的图明显小腿到脚的部位的解剖结构有明显的问题。
FLUX KREA
FLUX krea模型双腿没有分开,而其穿着内裤。说明krea模型对露出阴道不理解。
Qwen_Image
Qwen_Image基本遵循了提示词,也露出了阴道,只是阴道的细节错误,这说明模型训练的时候阴道的具体外观是应该是做了处理的。所以模型理解了露出阴道这个提示词,但在出图的时候无法绘制阴道的详细外观细节。
这段提示词的前半段,3个模型理解和表现的都不错
关键是
这段提示词模型的理解和表达出了问题。所以我们就需要一个学习过“双腿大大张开,露出阴道”这一概念的微调Lora模型。
我们就那Real PS 这个lora来尝试,这个lora的训练数据集包含 13,000 张图片(3,000 张来自世界各地顶尖摄影师的时尚照片、10000 张色情照片)。
FLUX DEV
FLUX KREA
Qwen_Image
可以看出使用了这个Lora有所改善
举这些例子的目的是我想说明Lora的基本作用就是新增或优化模型的某些性能。
比如性爱的姿势,特殊的服装,或者是某些自己喜欢的角色。就像是游戏的MOD。这类模型在开源社区非常多,自己训练也不困难。
没有哪个Lora是万能的,如果你有耐心可以尝试搭配多个Lora,并调整Lora的强调,获得一个不错的组合。
而不是去使用那种融合很多Lora的所谓NSFW模型,那种模型往往是把很多Lora调整到一个较低的强度然后融合起来。
生图的风格和人物外貌等都和模型有密切关联,所以挑选或是制作自己喜欢的Lora,才能创作出符合自己审美的作品。
好了我们简单的解释了几个主流模型的优缺点,和Lora的作用接下来我们将具体的介绍模型时如何在Comfyui中通过工作流来实现各种不同的效果的。
在Comfyui中扩散模型生图的流程其实可以简化为三步,各种模型和工作流都大同小异。
无非是模型选择和加载,文本和图像嵌入,采样降噪出图。
模型选择和加载
comfyui适用的模型格式主要有safetensors格式 或者是llama.cpp的gguf 格式
一般我们娱乐显卡会使用fp8.safetensors或者GGUF 8bit 量化的Q8_O模型。
我们来看下一般FLUX生图需要的模型,我比较喜欢写实摄影风格所以我就选择了flux1-krea-dev-Q8_0.gguf官方原版的主模型,和Real PS这个Lora 来作示范。
如果喜欢网红脸又懒的找角色Lora可以尝试下flux1-dev-fp8-麦橘超然_v.1.0.safetensors,这模型可以当做一个大号的角色Lora来用。
ComfyUI/
├─── models/
│ ├─── unet/
│ │ └─── FLUX/
│ │ └─── flux1-krea-dev-Q8_0.gguf(扩散模型:用来采样降噪,各种FLUX的扩散模型都要放在这里)
│ ├─── text_encoders/
│ │ └─── FLUX/
│ │ ├─── clip_l.safetensors
│ │ └─── t5xxl_fp16.safetensors(文本嵌入模型:将文本转换成高维向量嵌入到模型降噪中)
│ ├─── vae/
│ │ └─── FLUX/
│ │ └─── vae_FULX.safetensors(vae模型:将像素图像压缩成潜空间图片,或者将潜空间图片解压到像素图片)
│ ├─── upscale_models/
│ │ └─── 4xNomos8kSCHAT-S.safetensors(图像放大模型:放大图像,有很多可以选择这只是举个例子)
│ ├─── controlnet/
│ │ └─── FLUX/
│ │ └─── FLUX.1-dev-ControlNet-Union-Pro-2.0-fp8.safetensors(控制模型)
│ ├─── loras/
│ │ └─── FLUX/
│ │ └─── 加速/
│ │ └─── FLUX_Hyper--dev-8steps-lora(0.125).safetensors
│ │ └─── 各种Lora.safetensors
扩散模型有很多微调版本都是通用的,可以根据自己的需要选择。
为了方便低显存的小伙伴,模型加载我没有用官方的模型加载节点而是使用了MultiGPU插件。请根据自己显存的容量设置相应的virtual_vram_gb的值。
打开工作流
*************************************************************************
FLUX模型生图
节点组选择,停用FLUX控制文生图节点组,图像加载节点组
在FLUX模型加载节点组中选择好需要的模型
在文本嵌入节点组中输入提示词
- A young Asian woman with soft black hair and fair skin stands in a sea of golden wheat.
- The setting sun cast its light on her face from the side.
- Her almond-shaped eyes gazed softly at the camera, her expression quiet and contemplative.
- She is completely naked, exposing her breasts. Her legs are slender, revealing her vagina.
- The background blurs into a dreamy haze, with swaying stalks bathed in the sunset glow and distant hills silhouetted against the horizon. Cinematic quality, realistic style.
复制代码 在图像嵌入节点组中输入图像尺寸
调整K采样器参数
主要参数:
步数:FLUX模型文生图我们一般选择20-30步的采样步数,图生图我们一般选择10-15步的采样步数
CFG:FLUX模型CFG为1.0。
采样器:采样器和调度器的搭配有很多选择,而且新的试验性质的采样器也层出不穷,有些搭配组合在特定的内容上会有不错的表现但也会有一定的局限性。对于新手小伙伴来说可以选择比较安全的采样器euler。
调度器:simple或beta调度器和euler 采样器搭配是一种比较安全的选择。
*************************************************************************
控制文生图
根据已有的图像的构图创作新的图像,虽然现在有了很好用的编辑模型,但这种通过控制网生图的方式还是有一定用武之地。
有的时候我们没有创作思路的时候我们可以借鉴现有的图像。
比如这张图
这张图描述的主要内容(可以通过视觉模型,反推图片的内容)
- A young woman with dark short hair and bangs.
- She stands in front of a wooden door, her body slightly turned to the side.
- The woman is wearing a thong tied at the chest with a cord, the light-colored cord wrapped around her neck and shoulders.
- She has a serious expression, looking directly at the camera. The background is dark and blurred.
- 一位留着深色头发的年轻女子。
- 她站在一扇木门前,身体微微侧转。
- 女子身着用绳索系于胸前的丁字裤,那根浅色材质的绳索缠绕在她的颈部和肩头。
- 她神情严肃,直视镜头。背景昏暗且虚化。
复制代码
我们如果用提示词直接生图
我们会发现很难精确描述绳子的捆缚形态,而模型也可能没有这方面的训练,所以我们得到图很不理想。
这种情况下我们就需要使用控制网
用深度控制
用线条控制
首先我们用图像预处理工作流对图像进行预处理
⚠️图像预处理模型又多又杂,我统一打包成ckpts.7z,注意解压后要放在插件文件中的comfyui_controlnet_aux文件夹内,而不是model文件夹,文件路径如下:
ComfyUI/
├─── custom_nodes/
│ ├─── comfyui_controlnet_aux/
│ │ └─── ckpts/
│ │ ├─── bdsqlsz/
│ │ ├─── depth-anything/
│ │ ├─── hr16/
│ │ .
│ │ .
│ │ .
我们上传图片,然后运行工作流就会在
ComfyUI/
├─── output/
│ ├─── 图像预处理/
文件夹内得到预处理图像(我在工作流里只添加了三种预处理方案,小伙伴也可以尝试其它的预处理方案)
深度控制图
线条控制图
姿势控制图
在打开FLUX文生图工作流
模型选择和基础文生图一样
停用FLUX生图节点组
控制图上传
在图像嵌入节点组中输入图像尺寸
K采样器参数和文生图一样
如果对生图不满意就点击种子重新生图
如果我们用不同的模型就其它设置都保持相同就会得到完全不同风格的图像
flux1-dev-fp8-麦橘超然_v.1.0.safetensors出图效果
*************************************************************************
Qwen_Image模型生图
Qwen_Image模型的优缺点都很明显,而且我认为Qwen_Image的位置很尴尬,虽然它对提示词的理解对比FLUX有了明显的提升,但扩散模型在世界知识的学习上相较自回归模型有着先天缺陷,特别是在混元3.0开源后我们发现自回归模型在构图的精确性和对提示词的理解上对扩散模型的碾压优势。我个人觉得阿里应该不会继续扩散模型的路线,这意味着Qwen_Image官方将不会有新的迭代版本,去改善保守诟病的缺陷。这样一个20B参数的模型进行全局微调,对个人玩家来说成本太高,所以估计在Qwen_Image模型很长的时间都不会有改善。而且如果没有颠覆性的技术出现,我们将在不久的将来看到全系的扩散模型都将走入历史,包括wan系列的视频模型,flux,Qwen_Image系列的图像模型,都将是最后的绝唱!
Qwen_Image的构图能力比较强
- 一位年轻东亚女性芭蕾舞演员优雅地摆姿势。
- 她全身裸体露出小巧的乳房,和阴道。
- 她只穿着白色纯棉短袜。这位女士留着黑色头发,在脑后扎成一个整洁的发髻。
- 她的右腿笔直向上伸展,几乎垂直于地面,而左脚则放在地上支撑自己。
- 她的左手轻轻扶住抬起的腿部,右手向侧面伸出,手指微微弯曲。她面容平静,直视镜头。
- 背景非常简洁干净。光线柔和自然,投射出微妙的阴影,增强了图像的整体深度和立体感。
复制代码
如果是FLUX用同样的提示词直接文生图出图就大概率会崩坏
而且Qwen_Image有一定的中文编辑能力
- 一位皮肤白皙、长着黑色色长发的东亚年轻裸体女子坐在户外的水泥地面上,平静的直视镜头。
- 她的腹部用红色的水彩笔写着“肉便器”。她双手举着一张褶皱的纸,纸上用毛笔写着“上老王论坛当老王”。
- 她的胸部中等大小,乳头呈粉红色。她身材苗条,面容清秀。
- 背景是一面深色工业风格的墙壁。背景模糊。
复制代码
Qwen_Image的控制出图能力也不错- 一位年轻的东亚女性,她全身赤裸地跪在木质地板上,面容平静直视镜头。
- 她的皮肤白皙。
- 她的头发是黑色的,中等长度,自然垂落在肩膀和背部。
- 她的身体被粗实、天然纤维绳索紧紧捆绑在一起。这些绳子缠绕并固定了她的乳房,使其突出且可见。此外,还有一条绳索环绕着她的腰部,并向下延伸到大腿区域,将双腿绑在一起。
- 这种束缚方式强调了身体曲线,特别是胸部轮廓。
- 背景包括一个木制门框或柱子,背景模糊。
复制代码 参考图
深度预处理
控制出图
Qwen_Image缺点也很明显,说直白点就是Qwen_Image出的图一眼看去就是美颜,磨皮,调色过渡的便宜货。
特别是人物特写的时候尤其明显。
我们可以通过使用其它模型对Qwen_Image的出图做低强度的重绘,比如wan2.2的低噪模型或者FLUX模型(wan2.2重绘强调不要超过0.25,FLUX重绘强度可以高点)。
wan2.2重绘
FLUX重绘
工作流使用
按照路径下载保存好相应的模型
ComfyUI/
├─── models/
│ ├─── unet/
│ │ └─── Qwen_Image/
│ │ └─── qwen-image-Q8_0.gguf
│ ├─── text_encoders/
│ │ └─── Qwen_Image/
│ │ └─── qwen_2.5_vl_7b.safetensors
│ ├─── vae/
│ │ └─── Qwen_Image/
│ │ └─── qwen_image_vae.safetensors
│ ├─── upscale_models/
│ │ └─── 4xNomos8kSCHAT-S.safetensors
│ ├─── controlnet/
│ │ └─── Qwen_Image/
│ │ └─── Qwen-Image-InstantX-ControlNet-Union.safetensors
│ ├─── loras/
│ │ └─── Qwen_Image/
│ │ └─── 加速/
│ │ └─── Qwen-Image-Lightning-8steps-V2.0.safetensors
特别介绍下“virtual_vram_gb=虚拟显存容量”这个参数
如果你是小内存特别是在使用控制网生图的时候这个插件会有帮助
参数粗略可以如下计算
扩散模型容量-(你的显存X0.9-控制模型容量-采样降噪最少需要的显存)
假设你的显存是16G
使用的是扩散模型qwen-image-Q8_0.gguf大约20G
控制模型Qwen-Image-InstantX-ControlNet-Union.safetensors大约3G
1920X1080像素的图片采样降噪大约最少需要3G
最后算出来大概需要虚拟显存容量12G左右
也就是说把12G的扩散模型加载到内存中,只把8G加载到显存中
如果不使用控制生图,只是普通的文生图,那么就可以把9G的扩散模型加载到内存中,把11G加载到显存中
出图尺寸100-200万像素之间都可以
例如出图宽高比是9:16,那么720X1280到1080X1920都可以
wan2.2细化图(FLUX细化也是一样)
*************************************************************************
Qwen-Image-Edit编辑模型出图
模型选择
ComfyUI/
├─── models/
│ ├─── unet/
│ │ └─── Qwen_Image_Edit/
│ │ └─── Qwen-Image-Edit-2509-Q8_0.gguf
│ ├─── text_encoders/
│ │ └─── Qwen_Image/
│ │ └─── qwen_2.5_vl_7b.safetensors
│ ├─── vae/
│ │ └─── Qwen_Image/
│ │ └─── qwen_image_vae.safetensors
│ ├─── upscale_models/
│ │ └─── 4xNomos8kSCHAT-S.safetensors
│ ├─── controlnet/
│ │ └─── Qwen_Image/
│ │ └─── Qwen-Image-InstantX-ControlNet-Union.safetensors
│ ├─── loras/
│ │ └─── Qwen_Image_Edit/
│ │ └─── 加速/
│ │ └─── Qwen-Image-Edit-2509-Lightning-8steps-V1.0-fp32.safetensors
只是unet模型和加速Lora需要用Qwen-Image-Edit的,其它模型和Qwen-Image一样
出图尺寸
Qwen-Image-Edit尽量出图控制在100万像素左右,不然效果不很好,如果觉的出图太小,后期可以用其它模型二次重绘。
参考图上传
qwen_image_edit 支持3张参考图,根据需要上传
如果不需要三张,要把不需要的上传节点禁用
一张参考图
参考图
Lora
1、真正的PS_V1.83K,强度0.8
2、性爱、裸体、其他有趣的东西,强度1.0
成人Lora可以和Qwen-Image通用
提示词
- 图1的女性和男人发生性关系的照片。
- 图1的女性坐在沙发上的男人身上,男人的阴茎插入她的阴道。
- 图1的女性看着镜头。
复制代码
一张参考图+控制图
参考图
控制图
提示词
如果姿势和原图差别比较大,脸的角度比较大,那么人物一致性就会低些
控制图
控制图
二张参考图互动
参考图
服装
服装
提示词
也可以试试这种奇怪的玩法
参考图
服装(把裸体作为服装)
提示词
不是每次都能成功,多换几个种子试试吧
还可以和道具图互动
狼牙棒
提示词
- 图1的女性坐在沙发上,拿着图3的棒子插入自己的阴道
复制代码
三角木马(没找到图片,讲究着自己画了个怪怪的)
提示词
其它的玩法还可以看说明书
*************************************************************************
FLUX_kontext模型生图
(工作流删了没必要的节点,更加简洁了,已更新到网盘了)
FLUX_kontext模型图片对齐比较好,但是多图融合要比Qwen_Image_Edit
FLUX_kontext模型不像Qwen_Image_Edit内置了控制网,所以 FLUX_kontext控制要单独使用第三方的ControlNet模型,而其效果不理想。
所以我用只用FLUX_kontext做单图编辑。
模型选择
注意“virtual_vram_gb=虚拟显存容量”这个参数一定要根据自己的显存修改
图像尺寸
修改背景
参考图
提示词
- Change the background to pure black, keep the subject in the exact same position and pose
复制代码
移去服装(要使用RedCraft.safetensors)
参考图
移去水印
参考图
- Remove the watermark from the picture
复制代码
可以看的出FLUX_kontext编辑更像PS主体就好像完全剪切下来的,基本没有任何变化,这有好处也有坏处。
FLUX_kontex模型的Lora也很多,可以提供很多稀奇古怪的功能,可以去C站找。如果你想学习Lora训练,强烈建议你从训练FLUX_kontex的Lora开始,会很有趣。
*************************************************************************
本地大语言模型部署和调用
(所需要的软件我都放在网盘“本地大语言模型部署和调用”文件夹中)
很多小伙伴都为文生图和文生视频的提示词感到困扰,我们完全可以通过大语言模型来帮我们生成提示词。
模型API调用客户端
你可以把它看成一个UI,提供可视化的方式完成大语言模型对话。
推荐一款开源ai调用客户端Cherry Studio,国人开发全中文界面,对萌新小伙伴非常友好,功能也非常强调,自持mcp服务调用。
萌新小伙伴可以使用便携伴,不用安装,删除也方便。
如果我们平时工作,学习就可以直接调用各大厂商的api
比如我们要用阿里的模型
但是我们要生成成人内容,比如成人提示词和小说的润色扩写等等,那官方api就不行了,所以我们就需要本地部署开源的经过微调的大模型
推荐两个适合个人使用的本地大模型服务部署框架,llama.cpp和ollama。
这两个框架其实师出同源,GGUF格式就是llama.cpp研发的特别适合消费级计算机硬件。
我们就用这两款框架分别部署qwen3和qwen3 vl(视觉模型,用于图片内容反推)给大家做个示范。
用ollama部署qwen3大语言模型
ollama官网没有被墙,而且拉取模型速度非常快,所以模型我就没有搬运
安装完ollama软件后我们需要修改一下模型存放位置,因为ollama拉取的模型会默认存储在C盘
所以我们要新建环境变量来修改模型存储位置,和服务监听端口
在 Windows 搜索栏中输入并打开 “编辑系统环境变量”。
点击 “环境变量” 按钮。
在 “用户变量”下,点击 “新建”,
输入 变量名“OLLAMA_MODELS”和 变量值“D:\Ollama_models”
输入 变量名“OLLAMA_HOST”和 变量值“0.0.0.0:11434”
新建环境变量后,我们要重启Ollama
在屏幕又下角找到ollama图标点击退出就可以了
打开ollama官网,搜索qwen3-abliterated,找到相关模型,我推荐huihui_ai发布的模型
打开CMD 输入刚才复制的命令
8b模型
- ollama run huihui_ai/qwen3-abliterated:8b
复制代码
16b模型
- ollama run huihui_ai/qwen3-abliterated:16b
复制代码
32b模型
- ollama run huihui_ai/qwen3-abliterated:32b
复制代码
速度挺快的
如果下到快结束的时候 速度下降,“ctrl+c” 中断,然后重新输入命令,支持断点续传。
模型下载完成后会自动运行就可以对话了,但在CMD里面对话不方便也不美观,所以我们要用Cherry Studio等客户端调用。
关闭CMD窗口,并在屏幕又下角找到ollama图标点击退出
重新打开CMD
输入命令,启动ollama serve
然后打开Cherry Studio客户端
在设置中找到ollama
完成ollama api 的设置
然后再创建文生图助手
好了都完成了 我们就可以润色提示词了
输入
润色后的提示词
- A young, athletic woman with sun-kissed skin, long raven-black hair flowing in rhythmic waves, and piercing amber eyes brimming with joyful abandon, dances barefoot in a mist-laden forest clearing at dawn. Her supple, unadorned body is crowned with a crown of wildflowers and intertwined with gossamer vines, their tips glistening with dew that catches the golden light filtering through towering pines above. Behind her, a cascading waterfall tumbles down mossy boulders, its mist giving rise to a spectral rainbow arching across the scene; the water’s sparkle mirrors the faint, ethereal glow radiating from her upraised palms, hinting at an unseen magical force awakening with her motion. The atmosphere blends primal freedom and mystical reverence, captured in a dynamic, low-angle shot that emphasizes her fluid, almost weightless movements and the intricate textures of her environment, rendered in a photorealist style infused with fantasy-inspired luminescence and soft, golden-hour pastel hues.
- 一位年轻健美的女子,肌肤沐浴着阳光的暖意,乌黑长发如波浪般有节奏地飘动,琥珀色的眼眸锐利而充满无拘无束的欢愉。她在黎明时分薄雾缭绕的林间空地上赤足起舞,柔韧的身体未加任何修饰,头戴野花编织的花冠,缠绕着蛛丝般纤细的藤蔓,藤尖挂着晶莹露珠,捕捉着从高耸松林间滤下的金色光芒。她身后,瀑布奔泻而下,冲刷着长满青苔的巨石,水雾升腾形成一道横跨景色的幽灵般彩虹;水面的闪烁与她高举手掌散发出的缥缈微光交相辉映,暗示着随她动作苏醒的隐秘魔力。整个场景融合了原始的自由与神秘的崇敬,通过动态低角度镜头捕捉,突显她流畅近乎失重的舞姿与环境中错综复杂的质感,以写实主义风格呈现,并融入奇幻灵感的辉光及柔和的金色时刻粉彩色调。
复制代码 *************************************************************************
用llama.cpp来部署qwen3-vl
llama.cpp 更新非常频繁,有的时候几个小时就发布一个新版本。
但部署却非常简单,就是模型要去huggingface下载。我已经传到网盘了
我就用这个qwen3-vl专用版来示范下
解压后,在llama-qwen3-vl-3-win-cuda-12.8-x64文件夹下进入CMD
然后输入命令
- llama-server.exe ^
- --model D:\llama\Qwen3-VL-30B-A3B-NSFW\Qwen3-VL-30B-A3B-NSFW-q8_0.gguf ^
- --mmproj D:\llama\Qwen3-VL-30B-A3B-NSFW\Qwen3-VL-30B-A3B-NSFW-mmproj-f16.gguf ^
- --host 0.0.0.0 ^
- --port 8000 ^
- --n_gpu_layers 0
复制代码
--model: 指定要加载的模型文件路径。
--mmproj: 指定多模态投影文件(用于视觉功能)的路径。(因为qwen3 vl 需要读取图片,所以需要。语言模型就不需要)
--host 0.0.0.0: 将服务器绑定到所有可用网络接口,使其可以从外部访问。
--port 8000: 指定服务器监听的端口号。
--n_gpu_layers 0: 类似我经常说的virtual_vram_gb这个参数,把部分模型加载到内存中,比如Qwen3-VL-30B-A3B-NSFW-q8_0这模型有30G左右,这模型有48层,那么大概每层大概0.625G。
如果你是12G显卡,那么扣除运行模型所需的4G,还有8g可以装模型,那么大概装12层模型,就填12。我这里填的0是显存消耗最小,把所有模型都加载到内存上了,速度也是最慢的。
启动成功了
然后还是打开Cherry Studio 在设置没有llama.cpp的供应商模版
所以要自己添加
好了模型设置好了
和刚才一样添加个图片反推助手
好了 可以上传图片了
- 这是一张描绘女性的图片,其风格为绳缚(Shibari)艺术。
- 图中,一位年轻女性以跪姿被绳索捆绑。她的身体上覆盖着一层油亮的光泽,使其皮肤看起来湿润而富有质感。她的双手被绳子反绑在背后,身体微微前倾。
- 她的身体被多股棕褐色的粗绳紧密地缠绕着。绳子从她的双臂上方穿过,交叉捆住上半身,将她的胸部和腹部牢牢固定。她的头发是棕色的,带有刘海。
- 整体背景简洁,为深色,突出了人物和她被捆绑的身体。图片的左上角有白色的艺术字体水印。
复制代码
*************************************************************************
综合示例
每个小伙伴都有自己的性癖,有些比较特殊的体型,画面构图,和人物姿势,光靠提示词表达,模型不能很好的理解,所以我们可以借助可以捏人的H游戏,诸如Virt A Mate,DAZ Studio,甜心选择2,恋活2,等都是不错的选择。
用这些游戏的捏人和场景布设的功能,制作出示意图然后,用模型的控制生图,来制作一些自己喜欢的图像作品。
比如巨乳
Virt A Mate乳房形状的滑块有很多,觉的形状不自然的可以自己调整形状。
Virt A Mate用的人体模型就是DAZ Studio的G2模型,如果喜欢更自然点的可以玩下DAZ Studio的G8模型。
我个人喜欢骨感型的就不去捏乳房了。
用细条预处理(可以根据自己的需要灵活选择预处理的方式)
Qwen_Image_控制文生图
明显皮肤细节和肌肉线条过于简单,画面过于干净。我们在用wan2.2低噪模型进行细化。
我比较喜欢骨感的。
我们还可以使用Qwen_Image_Edit对图片进行编辑
我们可以灵活使用各种模型和其它的工具,充分发挥各模型的优点。现阶段还没有能解决所有问题的模型或者工作流。
而其各种参数如降噪强度,采样步数,采样器,调度器的选择都不是一成不变的,可以更具需要进行调整。这也是玩AI的乐趣之一。
*************************************************************************z_image_turbo模型生图(11.27更新)
阿里11.27开源的人物照片特化模型,只有6B的参数,但在人物照片方面的表现非常优异,而且训练非常大胆,明星照片和成人内容都没有脱敏,所以在成人内容生成方面表现优异,能在不使用Lora的情况下生成很多成人内容。
随着开源社区的后续支持,期待后续会有更好的表现。
ComfyUI/
├─── models/
│ ├─── unet/
│ │ └─── z_image_turbo/
│ │ └─── z_image_turbo_bf16.safetensors
│ ├─── text_encoders/
│ │ └─── z_image_turbo/
│ │ └─── qwen_3_4b.safetensors
│ ├─── vae/
│ │ └─── FLUX/
│ │ └─── vae_FULX.safetensors
vae模型和FLUX的vae模型相同
注意根据自己显存大小调整虚拟显存
生成图像尺寸200万像素表现不错
生图示例
简单的提示词
提示词
提示词
提示词
提示词
对复杂提示词也有不错的表现
提示词
- **姿态、动作**:
- 角色呈跪姿,臀部高高翘起,身体被棕色绳索呈交叉状捆绑,双臂自然摆放,左手轻触臀部,头部微微后仰,面部表情略显惊讶(张嘴、睁大眼睛),整体姿态展现出被束缚的动态感。
- **发型、妆容**:
- 头发为浅蓝色短发,发梢微卷且蓬松,妆容精致,蓝紫色大眼睛明亮有神,眼妆带有高光,脸颊晕染着自然的粉色腮红,
- **服装、饰品**:
- 仅穿着一条深蓝色内裤(腰带处有金属扣装饰),颈部系着同色系深蓝色领带作为装饰;身体被多根棕色绳索交叉捆绑,绳索在身体上形成规则的缠绕图案,同时可见黑色绑带装饰于腿部,整体服饰以裸露为主,通过绳索和配饰点缀。脚穿白色短棉袜。
- **场景环境**:
- 背景为简约的室内场景,浅灰色墙面作为底色,整体环境简洁,突出人物主体,营造出私密的氛围。
- **风格,光影**:
- 高清摄影写真;光影处理柔和且富有层次感,通过明暗对比凸显身体曲线(如乳房、臀部的凹凸感),暖色调的光线聚焦于角色皮肤,增强肌肤的质感与立体感,营造出细腻温馨的视觉效果。
复制代码
*************************************************************************
FLUX2模型生图(12.04更新)
FLUX2模型拥有32B参数,具备丰富的世界知识,除了生图以为还拥有类似FLUX_kontext模型的图像编辑能力。
但硬件要求比较高,采样速度慢。并且在数据集的成人内容审查方面比较严格,在生成成人内容方面还需要开源社区的支持。
FLUX2模型和z_image正好形成高低搭配互补。
模型目录结构树
ComfyUI/
├─── models/
│ ├─── unet/
│ │ └─── FLUX2/
│ │ ├─── flux2_dev_fp8.safetensors
│ │ └─── flux2-dev-Q8_0.gguf(gguf格式、safetensors格式根据自己喜欢下载一个就可以了)
│ ├─── text_encoders/
│ │ └─── FLUX2/
│ │ └─── mistral_3_small_flux2_fp8.safetensors
│ ├─── vae/
│ │ └─── FLUX2/
│ │ └─── flux2-vae.safetensors
模型加载
flux2_dev_fp8.safetensors模型速度要快一些,也是comfyui官方推荐的格式。
flux2-dev-Q8_0.gguf理论上生成质量更接近BF16,但我测试下来感觉不明显,有兴趣的小伙伴可以自己测试下。
参考图上传
flux2_dev可以支持更多的参考图,但是我个人推荐参考图不要超过2张,因为每增加一张参考图都会增加采样时间。而其参考图像素也不要超过100万像素。
图像尺寸
200万像素左右比较合适,但是姿势参考时最好设置100万像素,尺寸大了容易动作容易变形。
基础文生图
提示词
- 一位年轻的东亚女性的面部特写。
- 她的面容柔和而精致,深褐色眼眸。
- 柔和光从一侧洒落,在她脸上投下细腻的光影,突出了颧骨的柔和曲线和下颌的线条。
- 她的肌肤细节纹理精致。
- 每个毛孔、每根睫毛以及她嘴唇的细微纹理都清晰可见。
- 几缕黑色丝滑的发丝拂过她的前额。
- 色调温暖而浓郁,以金色和琥珀色为主。
复制代码 示例图
可以看的无论细节光影出相较FLUX和Qwen_Image都有了提升,但和特化的人物肖像模型z_image相比孰优孰劣,就看各位小伙伴的喜好了。
FLUX2的强项其实是丰富的世界知识,但这些在成人内容生成方面帮助不大,这里就不展开了。
成人内容文生图
提示词
- 年轻的东亚女性的写实摄影作品
- **姿态、动作**:角色呈站立姿态,身体直立,双臂自然垂放于身体两侧,双腿分开,保持静态静止状态。
- **发型、妆容**:发型为垂至腰部的银白色长直发,发丝柔顺且带有层次感;妆容精致,细腻眼妆,唇色为淡粉色,整体风格清新柔美。
- **服装、饰品**:角色主体裸露,肌肤上布满日文及英文文字(如大腿处的“fuck me”等);下着浅灰色过膝长袜,袜口处装饰有白色蕾丝边及粉色细节,腿部有粉色装饰带,整体搭配凸显简约与个性。
- **场景环境**:背景为纯黑色,无其他物体或装饰,使角色成为视觉焦点。
- **风格,光影**:光影采用正面主光源,均匀照亮角色,营造出柔和的明暗层次。
复制代码 示例图
可以看的出FLUX2在成人内容审查方面是比较严格,后续要看开源社区的支持了,但是32B的参数在Lora训练硬件上是不小的挑战。
消费娱乐级显卡中估计也只有4090魔改的48G显存可以勉强一试了。
图像编辑
客观的说FLUX2的图像编辑功能是要优于FLUX_kontext和Qwen-Image-Edit-2509的,特别是在多图编辑和融合方面。
图像的纹理细节保持的都不错,人物一致性不能说完美但也优于其它开源模型。
单图编辑
参考图1
提示词
示例图
参考图1
提示词
示例图
FLUX2数据集审查还严格的没有乳头和性器官。
风格转绘
参考图1
提示词
- convert the picture to Ghibli Style
复制代码 示例图
基本上其它模型有的风格FLUX2都有,提示词可以参考我在FLUX_kontext工作流里的注释。
人物姿势编辑
参考图1
参考图2
提示词
- 图1中的女性采用了图像2的姿势。保持图1中的女性服装、体型和面部特征不变
复制代码 示例图
参考图2
提示词
- 图1中的女性采用了图像2的姿势。保持图1中的女性服装、体型和面部特征不变
复制代码 示例图
人物换装
参考图1
参考图2
提示词
示例图
参考图2
提示词
示例图
换装个人感觉FLUX2换装是所有开源模型最优秀的
面部迁移
我在C在上看到一位老哥特别喜欢训练面部迁移Lora,我们就测试下她的Lora
参考图1
参考图2
提示词
- {
- "task": "head_swap",
- "base_image": {
- "source": "Image 1",
- "preserve": [
- "complete_body",
- "lighting",
- "environment",
- "background",
- "clothing",
- "scene_context"
- ],
- "extract_expression_and_angle": [
- "current_facial_expression",
- "current_head_pose",
- "current_head_angle"
- ]
- },
- "replacement": {
- "source": "Image 2",
- "extract": "complete_head_identity",
- "must_preserve_from_image2": [
- "all_facial_features",
- "face_shape_and_structure",
- "complete_hair",
- "skin_characteristics",
- "personal_identity"
- ],
- "apply_from_image1": [
- "match_expression",
- "match_head_angle"
- ]
- },
- "blending_requirements": {
- "identity_preservation": {
- "priority": "critical",
- "instruction": "maintain complete identity from Image 2 including all facial features and characteristics"
- },
- "expression_matching": {
- "priority": "high",
- "instruction": "reproduce the facial expression from Image 1 on the face from Image 2"
- },
- "angle_matching": {
- "priority": "high",
- "instruction": "position head from Image 2 at same angle as Image 1"
- },
- "seamless_integration": {
- "lighting_match": "adaptive",
- "shadow_consistency": "automatic",
- "edge_blending": "smooth",
- "color_matching": "natural"
- }
- },
- "output": {
- "description": "head from Image 2 seamlessly integrated onto body from Image 1, matching the original expression and head angle",
- "maintain_realism": "photorealistic_quality"
- }
- }
复制代码 作者给的提示词是JSON结构,不用管直接复制就行了
示例图
和Qwen-Image-Edit-2509相比如何,小伙伴们自行评价吧,但作者说这只是测试版,以后估计还会继续训练。
人物和物品互动
参考图1
参考图2
提示词
示例图
多图融合
参考图1
参考图2
参考图3
提示词
示例图
可以看的出人物服装保持的很不错,但人物面部的一致性还是不够好还要用其它面部迁移的工作流进行修复。
注意了使用参考图越多,采样速度越慢,不知道以后Comfyui官方会不会进行优化。
我这里只是抛砖引玉,其它的玩法小伙伴还可以自行开发。
*************************************************************************
局部重绘
局部重绘的范围很广,重绘手脚,乳头,性器官,和面部重绘,面部迁移,服装迁移,布景物品的增减,扩图等 都是局部重绘的范畴。
wan2.2模型的手部重绘
面部和手部结构相对复杂,特别是在绘制全身远景图时,应为像素过小模型分配的注意力不够,往往会出现结构崩坏的情况,所以手部和面部的重绘是我们会经常用到。
模型加载
wan2.2模型的人体结构比较好,所以用来修手比较好,flux模型则可以用来修脸、乳头和阴道。
提示词
简单点就可以了
重要的参数
bbox剪裁系数
2.0剪裁系数
4.0剪裁系数
我们可以看到2.0剪裁系数,bbox占的区域比例较大,这就可以给模型重绘提供更多的注意力,重绘的会更加准确。
而4.0剪裁系数,虽然重绘的区域注意力少了,但是重绘区域外的注意力相应增加,可以提高重绘的内容和整体的融合程度。
wan2.2的能力很强只要很小的注意力就能画出不错的手,所以剪裁系数可以给的大点,以获得更好的整体的融合程度。
最大尺寸
就是将裁剪的图像的最大边,缩放到这一尺寸。
如这张图的左右手在最终降噪的时候使用的是以下尺寸
(387, 693) x 1.8470818996429443 -> (714, 1280)
(360, 756) x 1.6931853294372559 -> (609, 1280)
会影响出图速度
sam膨胀
就是在sam生成的遮罩基础上进行扩张
降噪
重绘的幅度,没有固定的值,可以根据实际情况多次尝试,我一般wan2.2模型降噪会在0.3左右调整,FLUX会在0.5左右调整。
修复前
修复后
误区
很多小伙可能会以为,局部重绘的过程不是有把图片裁切放大的步骤,那么局部重绘后图像面部或手部不是会变的更加清晰吗?
局部重绘是为了让模型重绘结构错误,或者需要调整的区域,而不是提升区域的清晰度。
我们以后会提到图像放大的方法如SD,TTP等,扩散模型都不是启的放大作用,而是对经过放大模型处理过的图像,进行重绘。
*************************************************************************
FLUX模型的阴道重绘
模型加载
Lora不仅可以用于局部重绘,也可以用于FLUX文生图
手动遮罩
因为没有模型检测阴部和乳头,所以只能手动遮罩
提示词
作者给的,有条件的小伙伴可以去C站给作者点个赞
修复阴道
- bush pussy
- 灌木阴户 - 顶部留有毛发
- butterfly pussy
- 蝴蝶阴户 - 具有厚实阴唇的阴户
- hairy pussy
- 多毛阴户 - 长有毛发的阴户
- shaved pussy
- 剃毛阴户 - 采用骆驼趾(内嵌式)造型的剃毛阴户
- asian pussy
- 亚洲女性私处 - 白皮肤女性深色阴唇的阴道
- pink pussy
- 粉嫩私处 - 粉红色娇嫩阴道
复制代码 修复乳头
- big areolas
- 大乳晕-中到大圆形乳晕
- dark nipples
- 深色乳头-深色乳头与自然皮肤的对比更明显
- ghost nipples
- 幽灵乳头-乳头颜色略显苍白
- long nipples
- 长乳头-可以轻松咬到的乳头
- puffy nipples
- 乳头肿胀-乳房较小,但乳头顶端覆盖着致密的乳头
- saggy breasts
- 乳房下垂——由于重力作用,乳房有点下垂
- small areolas
- 小乳晕-乳晕半径较小
- veiny areolas
- 乳晕静脉-皮肤下出现的静脉
复制代码 重要的参数
修复前
修复后
还是有明显的改善了,其实阴道,和阴茎在外形上算是人体比较复杂的器官了
*************************************************************************
面部迁移
面部迁移在comfyui实现现在流行的有2种技术路径,
用Qwen_Image_Edit或FLUX_kontext等图像编辑模型,在潜空间对图像编辑,然后在根据提示词扩散降噪。
这种方法脸部素材和需要被替换的脸部,关键点越匹配,那么根据提示词扩散降噪的编辑程度就会越低。
那么一致性就会越强,但是光照、肤色、阴影、头部姿态以及边缘融合却会越差。
反之关键点相差越远,一致性就会变差,但光照、肤色、阴影、头部姿态以及边缘融合反而会变强。
另一种就是用ipadapter和pulid等方式根据一张参考图捕捉面部特征,微调模型。这类技术路径泛化性强。比起Lora训练方便。
但因为只根据一张图微调模型,所以如果面部角度相差过大,一致性保持就会变差。
Qwen_Image_Edit2509面部迁移
模型
和Qwen_Image_Edit2509生图使用的模型完全一样
需重绘脸部
面部素材
上传图片手动编辑遮罩
尽量把整个头都遮罩起来
执行图像预处理节点组
对上传的图片进行预处理,目的是让素材脸和需要修改的脸的大小,位置尽可能的对齐。
如果熟悉PS等图像处理软件,完全可以用其它工具进行类似的图像预处理。
处理后面部素材
处理后需重绘脸部
面部重绘后
*************************************************************************
instantID面部迁移
模型
ComfyUI/
├───models/
│ ├───checkpoints/
│ │ └───sdxl/
│ │ └─── juggernautXL_ragnarokBy.safetensors
│ ├───ipadapter/
│ │ └─── ip-adapter-plus-face_sdxl_vit-h.safetensors
│ ├───instantid/
│ │ └─── InstantID.bin
│ ├───controlnet/
│ │ └───InstantID/
│ │ └─── InstantID.safetensors
│ ├───insightface/
│ │ └───models/
│ │ ├───antelopev2/
│ │ │ ├─── 1k3d68.onnx
│ │ │ ├─── 2d106det.onnx
│ │ │ ├─── genderage.onnx
│ │ │ ├─── glintr100.onnx
│ │ │ └─── scrfd_10g_bnkps.onnx
│ │ └───buffalo_l/
│ │ ├─── 1k3d68.onnx
│ │ ├─── 2d106det.onnx
│ │ ├─── det_10g.onnx
│ │ ├─── genderage.onnx
│ │ └─── w600k_r50.onnx
│ ├───clip_vision/
│ │ └─── SDXL风格视觉(CLIP-ViT-H-14-laion2B-s32B-b79K).safetensors
│ ├───RMBG/
│ │ └───body_segment
│ │ └─── deeplabv3p-resnet50-human.onnx
模型比较多,要仔细检查。
instantID面部素材预处理
如果素材和需重绘脸部色彩,亮度相差较大,可以简单的调色。
“不透明度”设置为0,则不调色。
instantID需重绘面部预处理
重要参数
参数可以根据实际情况反复调整,以得到最好的效果。
面部重绘后
*************************************************************************
pulid面部迁移
模型
ComfyUI/
├───models/
│ ├───unet/
│ │ └───FLUX/
│ │ └─── flux1-dev-Q8_0.gguf
│ ├───vae/
│ │ └───FLUX/
│ │ └─── vae_FULX.safetensors
│ ├───text_encoders/
│ │ └───FLUX/
│ │ ├─── clip_l.safetensors
│ │ └─── t5xxl_fp16.safetensors
│ ├───controlnet/
│ │ └───FLUX/
│ │ └─── FLUX.1-dev-ControlNet-Union-Pro-2.0-fp8.safetensors
│ ├───insightface/
│ │ └───models/
│ │ ├───antelopev2/
│ │ │ ├─── 1k3d68.onnx
│ │ │ ├─── 2d106det.onnx
│ │ │ ├─── genderage.onnx
│ │ │ ├─── glintr100.onnx
│ │ │ └─── scrfd_10g_bnkps.onnx
│ │ └───buffalo_l/
│ │ ├─── 1k3d68.onnx
│ │ ├─── 2d106det.onnx
│ │ ├─── det_10g.onnx
│ │ ├─── genderage.onnx
│ │ └─── w600k_r50.onnx
│ ├───pulid/
│ │ └─── pulid_flux_v0.9.1.safetensors
│ ├───RMBG/
│ │ └───body_segment
│ │ └─── deeplabv3p-resnet50-human.onnx
│ ├───facexlib/
│ │ ├─── detection_Resnet50_Final.pth
│ │ ├─── parsing_bisenet.pth
│ │ └─── parsing_parsenet.pth
│ ├───clip/
│ │ └─── EVA02_CLIP_L_336_psz14_s6B.pt
面部素材预处理、需重绘面部预处理和instantID设置完全一样
面部重绘后
*************************************************************************
内补条件生图(2026.01.01更新)
小伙伴们好久不见,最近年底工作有点忙,所以很久没有更新了,元旦放假正好宅在家里,祝小伙伴们元旦快乐。
正好前几天阿里更新了qwen-image-edit-2511编辑模型,我们就结合qwen-image-edit-2511模型,给大家举几个内补条件生图的例子。
其实我们以前的局部重绘就是内补条件的一种表现形式,但借助了一些第三方的节点。这次我们就用comfyui原生的内补模型条件节点来实现。
模型目录结构
├───models/
│ ├───unet/
│ │ └───Qwen_Image_Edit/
│ │ └───qwen-image-edit-2511-Q8_0.gguf
│ ├───text_encoders/
│ │ └───Qwen_Image/
│ │ └───qwen_2.5_vl_7b.safetensors
│ ├───vae/
│ │ └───Qwen_Image/
│ │ └───qwen_image_vae.safetensors
│ ├───loras/
│ │ └───Qwen_Image_Edit/
│ │ └───加速/
│ │ └───Qwen-Image-Edit-2511-Lightning-4steps-V1.0-fp32.safetensors
模型加载
comfyui新更新的子图模式很好用,有空的话我会把有用的工作流都重新改一下,把复杂的节点都封装到子图里,这样看起来会简单点。
模型选择
一定要选对模型,我看到的小伙伴的报错信息绝大部分都是没有找到模型而造成的。
示例
我们只想移除这张图中女孩的裙子,如果我们直接用以前的方法,我们可能会将上衣和裙子一起移除,所以我们就需要遮罩裙子区域。
遮罩范围可以大一些,如果需要还可以在遮罩边缘加点羽化。
模式选择
提示词
出图效果
我们再来试试面部重绘,正好我们测试一下C站上一位老哥的换头Lora
上传图片
遮罩头部
用同样的办法给需要重绘的区域添加遮罩
Lora选择
提示词
作者给的,直接复制就可以
- head_swap: start with Picture 1 as the base image, keeping its lighting, environment, and background. remove the head from Picture 1 completely and replace it with the head from Picture 2. ensure the head and body have correct anatomical proportions, and blend the skin tones, shadows, and lighting naturally so the final result appears as one coherent, realistic person.
复制代码
出图效果
虽然Lora是在2509上训练的,但在2511上的表现也还不错
内补条件生图用起来很简单,但是用处还是挺多的,小伙伴们可以自己研究一些新的玩法,我这里只是抛砖引玉。
顺便说下qwen-image-edit-2511在角色一致性等方面还是有不少提升的,用来制作套图效果很不错,方法和qwen-image-edit一模一样
示例图1
示例图2
示例图3
示例图4
示例图5
示例图6
*************************************************************************Qwen_Image_Edit进阶工作流(2026.03.07更新)
开年了,又要开始辛苦搬砖了,年初不忙继续更新帖子。
看到有小伙伴留言说想玩一下Qwen-Rapid-AIO-NSFW这类的模型。
Qwen-Rapid-AIO-NSFW其实一个融合模型,就是将各种成人Lora调整了权重,然后和CLIP、VAE模型打包在了一起。并不是什么新模型。
对萌新小伙伴来说用起来要简单些不需要额外添加LORA,就能生成NSFW内容。但也有缺点就是和其它Lora兼容性比较差。
该模型已经更新迭代了23个版本了,感兴趣的小伙伴可以到huggingface上查看版本说明。
个人感觉V20版本比较好用,就只上传了V20版本到网盘,小伙伴们也可以尝试其它版本。
顺便更新了一下Qwen_Image_Edit的工作流,在官方模版的基础上整合了一些其它的节点,重新比较完整的介绍一下Qwen_Image_Edit模型的功能。
希望能给小伙伴们一点启发。
注意:
Qwen-Rapid-AIO-NSFW要放在models/checkpoints文件夹内,和其它unet模型存放在models/unet文件夹内,
虽然Qwen-Rapid-AIO-NSFW模型打包了CLIP、VAE模型,但我们还是用qwen的方便些。
模型加载:
注意:
如果用Qwen-Rapid-AIO-NSFW模型就不要使用其他Lora,包括加速Lora。
如果使用了原版模型或其它微调模型就要启用加速Lora。
推荐使用Qwen-Image-Lightning-8steps-V2.0-fp32.safetensors,也可以尝试Qwen-Image-Edit-2511-Lightning-8steps-V1.0-fp32.safetensors。
但我个人感觉Qwen-Image的加速Lora效果反而好一些。
参考图加载:
注意:
Qwen_Image_Edit的生图尺寸100-200万像素比较合适。
需要几张参考图就开启几个图像节点,要注意把不需要的图像加载节点框选用Ctrl+B忽略掉。
生图尺寸:
注意:
Qwen_Image_Edit的生图尺寸100-200万像素比较合适。
100万像素往往会有更好的效果。
提示词:
注意:
Qwen_Image_Edit有2个大版本2509,2511。所有微调模型和融合模型都是基于这两个基础模型衍生出的。
比如Qwen-Rapid-AIO-NSFW-V20就是基于2511版本的,而动漫转真实.safetensors这款微调模型是基于2509版本的。
要根据模型的大版本选择。
采样:
注意:
额外添加噪波就是在采样过程中添加一下额外的噪波,让模型采样能生成更多的细节。
如果觉得画面太乱可以不添加。
基础模型生图
面部参考图:
姿势参考图:
服装参考图:
示例:
图像尺寸:
我们让生图尺寸匹配姿势参考图的尺寸,这样生图的位移最小。
提示词:
- 图1的女性,姿势参考图2,服装参考图3,脚穿黑色高跟鞋。
- **姿态、动作、身材**:
- 坐在地上,坐姿,双腿自然分开呈“V”字形,身体微微前倾;右手轻抚胸前,左手随意搭在大腿处
- **场景环境**:
- 画面背景是阳光明媚的户外场景,两侧环绕着茂密的绿色灌木丛与高大树木,远处隐约可见建筑物,整体环境清新自然,充满生机。
复制代码
注意:要选择2511模式
Qwen-Rapid-AIO-NSFW-V20模型生图
这次我们让这个女孩坐在室内的沙发上全身裸体。
面部参考图:
姿势参考图:
因为是要女孩全裸注意把服装参考图禁用。
示例:
提示词:
- 图1的女性,姿势参考图2,
- 女性全身裸体
- **姿态、动作、身材**:
- 坐在沙发上
- **场景环境**:
- 室内空间,浅灰色墙面搭配木质地面,左侧可见大型绿植(似龟背竹),背景有深色门框与台阶,营造温馨现代氛围。
复制代码
我们在来生成一张成人图片
参考图:
这次我们把姿势参考也禁用了
示例:
提示词:
- 图1的女性和男人发生性关系的照片。
- 图1的女性坐在沙发上的男人身上,男人的阴茎插入她的阴道。
- 图1的女性看着镜头。
- 图1的女性全身裸体。
复制代码
*************************************************************************
如果遇到缺少节点可以尽量尝试参考以下帖子自行安装。
comfyui 纯新手教学 第一期 (comfyui环境部署)
comfyui 纯新手教学 第二期 (comfyui插件安装)
如果实在有困难可以在model/工作流文件中下载新的整合包
自行打包证明
|
评分
-
查看全部评分
本帖被以下淘专辑推荐:
- · 典藏|主题: 867, 订阅: 507
- · AI技术|主题: 5, 订阅: 9
- · 高质量资源|主题: 15, 订阅: 5
- · 已购|主题: 21, 订阅: 0
|