测试模型为
依托Qwen3-VL-4b-Heretic-ComfyUI的多模态能力进行提示词反推和一些小小的正则检测拼装,图生图以及图片编辑能力,只是最小可行版本,无论是人物一致性,细节控制还是图片效果效果都令人惊讶


请看下例


一个风格迁移任务,通过提示词反推后进行一些微小的正则提取手段,辅助雷电将军的人物提示词字段进行拼装后就取得了非常不错的风格迁移效果。
以及



通过简单的反推及粘贴手段我做出了以下的图片

这个工作流主要作用是通过模板化提示词反推及提示词提取,进行一些可改造的风格化迁移手段,当然主要目的是在不借助lora增加显卡负担的情况下进行更为可控的图片修正及改造。


还有更可控的细节增加和放大如:


当然还有edit,qwen3vl的能力几乎可以无缝迁移到krea2中


