






















18 rxmt 2025 年 10 月 28 日@iixy 奥奥,我是这么理解的,每个模型都有不同的特性,比如:sd 系列的提示词写法简单说是 1 个词 1 个词的,根据模型本身、lora 触发词等设计,模型对特定词语的遵循性更强(包括正向以及反向),对提示词中的一些细节反而不那么敏感; flux 系列则会更遵循生图的提示词,在训练的时候提示词编写特点就变成了用简短的白话或者词句描述图像内容,素材集特点也会改变,生图的时候对提示词遵循更加严格,而模型本身的规则弱化了一些。我表达的不太专业可能。。 关于干扰因素和花里胡哨,我可能有点不认可,模型本身的性能会限制发挥,还原性或者说角色一致性看能也会差。换新模型,考验的是摸索提示词技巧的能力,性能更好的模型其实一致性能力上限或更高。举个我遇到的问题:我有一段时间想要做一种毛绒绒质感的卡通形象,但是 sd15 ,sdxl 出来的角色边缘效果很糊,一些特点(高矮胖瘦、五官尺寸等等)还原的有偏差。但是尝试性能更好的模型,往往摸索后就能解决。 如果 op 有精力的话可以尝试,细节要求不高或者对这块投入的精力有限还是在 sd15 上做也没太大问题,这种效果评估多少还是比较主观的。 |
此内容由惯性聚合(RSS阅读器)自动聚合整理,仅供阅读参考。 原文来自 — 版权归原作者所有。