انسجام شخصیت با تعریف ویژگیهای ثابت در متن و تثبیت آنها با مراجع بصری حفظ میشود، سپس متغیرهایی مانند نور و زاویه را بهدقت کنترل کنید. این کار را با جدا کردن هویت شخصیت از زمینه صحنه در جریان کاری خود انجام دهید.
مسئله لغزش شخصیت در هوش مصنوعی مولد
مدلهای مولد پرامپتها را بهصورت احتمالاتی تفسیر میکنند. وقتی درخواست یک شخصیت خاص را دارید، مدل از توزیعی از تفسیرهای ممکن نمونهبرداری میکند. بدون قیدها، هر تولید یک تاساندازی جدید است. تغییرات کوچک در ساختار صورت، بافت مو یا جزئیات لباس در طول تصاویر انباشته میشوند. این لغزش رخ میدهد زیرا مدل ترکیببندی کلی و نورپردازی را بر نشانگرهای هویتی خاص اولویت میدهد. اگر خروجی را بهطور فعال محدود نکنید، شخصیت به یک الگوی کلی تبدیل میشود نه یک فرد مشخص.
تعریف ویژگیهای ثابت شخصیت در پرامپتها
باید ویژگیهایی که شخصیت را تعریف میکنند شناسایی کرده و آنها را غیرقابلمذاکره در نظر بگیرید. اینها ویژگیهای ثابت هستند. شامل هندسه خاص صورت، رنگ چشم، شکل مو و آیتمهای لباس منحصربهفرد میشوند. شخصیت را با عبارات مبهم مانند "باحال" یا "مرموز" توصیف نکنید. واقعیت فیزیکی را توصیف کنید. به جای "ظاهری خشن"، مشخص کنید "موی کوتاه قیچیشده، جای زخم بالای ابروی چپ، کت چرمی فرسوده."
- ویژگیهای ثابت را در یک بلوک متنی ثابت فهرست کنید.
- این بلوک را برای هر پرامپت یکسان نگه دارید.
- این بلوک را در ابتدای پرامپت قرار دهید تا وزن بالایی داشته باشد.
- از صفاتی که تفسیرهای چندگانه را القا میکنند پرهیز کنید. از اسمهای عینی و توصیفکنندههای فیزیکی استفاده کنید.
اگر توصیف مو را تغییر دهید، مدل ممکن است توصیف جدید را بهعنوان شخصیتی متفاوت تفسیر کند. پرامپت متنی لنگر اصلی است. اگر متن مبهم باشد، تصویر ناهماهنگ خواهد بود.
استفاده از تصاویر مرجع و لنگرهای سبک
متن بهتنهایی اغلب برای شخصیتهای پیچیده کافی نیست. مراجع بصری یک لنگر مکانی و سبک ارائه میدهند. شما تصویری از شخصیت را برای هدایت تفسیر مدل از هویت آپلود میکنید. اینجاست که ابزارهای خاص در فرآیند جای میگیرند.
- Midjourney را زمانی انتخاب کنید که نیاز دارید به یک تصویر مرجع شخصیت ارجاع دهید تا ویژگیهای چهره و سبک در نسلهای جدید یکسان باقی بمانند.
- Adobe Firefly زمانی استفاده میشود که نیاز دارید تصویر مرجع شخصیت را آپلود کنید تا سبک و هویت تصاویر تولیدشده در اکوسیستم Creative Cloud را هدایت کند.
- Leonardo.Ai زمانی انتخاب میشود که نیاز دارید ویژگیها و زیباییشناسی خاص شخصیت را در چندین نسل تصویر قفل کنید.
- Stable Diffusion برای ایجاد یکپارچگی پیشرفته از طریق آموزش LoRA روی مجموعه دادههای شخصیت یا استفاده از ControlNet برای قفل کردن پوز و ساختار به کار میرود.
- Krea زمانی اعمال میشود که نیاز دارید تصویری را آپلود کنید تا هویت و سبک شخصیت را در تولید بلادرنگ حفظ کنید.
- Runway زمانی به کار گرفته میشود که نیاز دارید هنگام تولید توالیهای ویدیویی یا متحرکسازی طرحهای ثابت شخصیت، یکپارچگی شخصیت را حفظ کنید.
- DALL-E 3 زمانی مورد اتکا قرار میگیرد که نیاز دارید از طریق پرامپتهای متنی دقیق و جزئی و اصلاحات تکراری، یکپارچگی شخصیت را حفظ کنید، زیرا این ابزار فاقد قابلیت بومی ارجاع تصویر است.
هنگام استفاده از این ابزارها، خروجی را بر اساس تطابق ساختار چهره با مرجع ارزیابی کنید. آن را بر اساس خوب به نظر رسیدن صحنه ارزیابی نکنید. اگر چهره نادرست باشد، صحنه بیاهمیت است.
مدیریت تغییرات نورپردازی و زاویه
نورپردازی و زاویه، شایعترین علل ناهمگنی ادراکشده هستند. یک شخصیت در نور روشن روز با همان شخصیت در سایه متفاوت به نظر میرسد. این لغزش نیست؛ این فیزیک است. با این حال، مدلها اغلب تغییرات نورپردازی را به عنوان تغییرات هویت تفسیر میکنند.
- اگر میخواهید شخصیت یکسان به نظر برسد، توضیحات نورپردازی را یکسان نگه دارید.
- اگر زاویه را تغییر میدهید، انتظار داشته باشید که ویژگیهای چهره جابهجا شوند.
- برای ایجاد هویت پایه در برگههای شخصیت، از نورپردازی خنثی استفاده کنید.
- نورپردازی دراماتیک را تنها پس از قفل شدن هویت اعمال کنید.
اگر شخصیتی را در یک کوچه تاریک و سپس در یک استودیوی روشن تولید کنید، مدل ممکن است سایهها را به عنوان ساختارهای چهره متفاوت تفسیر کند. هویت را از محیط جدا کنید. ابتدا شخصیت را در یک زمینه خنثی تولید کنید. سپس برای محیط خاص، ترکیببندی یا پرامپت کنید.
اصلاحات تکراری و پرامپتهای منفی
در بار اول درست نخواهید کرد. اصلاح تکراری، هسته اصلی گردش کار است. چندین نسخه تولید کنید. آن نسخهای را انتخاب کنید که به هویت هدف نزدیکتر است. از آن انتخاب بهعنوان مرجع جدید استفاده کنید. این کار یک حلقه بازخورد ایجاد میکند که انسجام را محکمتر میسازد.
پرامپت منفی ضروری است. باید به مدل بگویید که چه کاری را نباید انجام دهد.
- انحرافات رایج را در پرامپت منفی خود فهرست کنید.
- عباراتی مانند "چهره متفاوت"، "موهای اشتباه" یا "ویژگیهای عمومی" را بگنجانید.
- با مشاهده انواع جدید خطاها، پرامپت منفی را بهروزرسانی کنید.
اگر مدل به شخصیت بینی با شکل متفاوتی میدهد، عبارت «wrong nose shape» را به پرامپت منفی اضافه کنید. این کار بهطور فعال انحراف را مهار میکند.
اشتباهات رایج که یکپارچگی را از بین میبرند
بیشتر موارد ناهماهنگی از اشتباهات در جریان کار ناشی میشود، نه از محدودیتهای ابزار.
- تغییر توصیف شخصیت بین پرامپتها.
- استفاده از صفات مبهم به جای توصیفکنندههای فیزیکی.
- نادیده گرفتن زمینه نورپردازی هنگام ارزیابی هویت.
- عدم استفاده از پرامپت منفی برای سرکوب انحرافات.
- انتظار برای یکپارچگی کامل بدون اصلاح تکراری.
- استفاده از یک تصویر مرجع واحد که کیفیت پایین یا مبهم دارد.
اگر این اشتباهات را مرتکب شوید، هیچ ابزاری شما را نجات نخواهد داد. جریان کاری باید منظم باشد. متن باید دقیق باشد. مراجع باید شفاف باشند. تکرار باید مداوم باشد.
The AI Creative Workflow Guide
The reader will be able to select, integrate, and apply AI tools effectively across creative media and design workflows.
Get it — $29