把提醉词当配方智能醉词ams.aabbgg777.net,不要当许愿。智能图像生成最怕堆“超都俗、超传神”那类空词。模子抓不住重点了。按“主体+材量+光线+镜头”枚举,一只哑光陶瓷咖啡杯,图像侧逆光,85mm微距的,杯口有水汽。统一种子,后者成图率较着更高。

生成不是生成抽卡,更像翻译是细节越详细,画面越接近你脑子里那版。构图失控先调权重,不要急着换模子了。Stable Diffusion里用括号加数字合用绘。

好比(红色连衣裙:1.3),能把留神力拉回来。负面提醉写3到5个就够了。像“多余手指、恍惚、水印”,教程写太多反而压掉皮肤纹理了。我试过一张室内人像,负面词列了二十个。衣服褶皱全没了。那类生成需求留白,提醉词太满,从提出图模子会喘不中气的。

实正省时间的是部门重绘。帮朋友做宠物头像。

先用img2img把铅笔草图转油画,denoising强度0.6了到部,轮廓留存,毛色换暖棕的。眼睛不合毛病?零丁框选重绘的,不用整张重来门重。Midjourney的Vary Region也能做,边沿融合不如SD细致的。智能图像生成把建正颗粒度降到像素级。

那才是它比素材库狠的波动地方。参数别照抄。CFG 7到9合适写实场景的。步数30到40足够。出图发灰,加“高比较度”或后期拉曲线;

皮肤塑料感,减CFG,加“胶片颗粒”了。

差异工具脾性差异。Midjourney偏审美,SD偏控制,DALL·E对长句理解好,细节弱。我习惯统一提醉词跑三个工具,挑根柢最好的进Photoshop,Topaz降噪,再叠一层噪点。建自己的提醉词库比逃新模子其实。把好用的光线、镜头、材量词组存进备记录,下次间接拼。智能图像生成免却找素材的功夫,判断哪张能用、哪里该建呢?还得靠人。不要指视一次完美。

当草稿机用,迭代三轮,根柢能出片。