پرش به محتوای اصلی

حفظ چهره در هوش مصنوعی: آموزش گام‌به‌گام

آموزش هوش مصنوعی
تیم موبولند
۶ دقیقه مطالعه
اشتراک‌گذاری:
آموزش حفظ چهره در هوش مصنوعی با آپلود عکس مرجع

بسیاری از کاربران هنگام کار با ابزارهای تولید تصویر متوجه یک مشکل رایج می‌شوند: هرچقدر هم که ویژگی‌های ظاهری خود را در متن توصیف کنند، خروجی نهایی شبیه آن‌ها نیست. ساختن یک چهره عمومی با متن آسان است، اما وقتی پای چهره‌های واقعی در میان باشد، متن به تنهایی کافی نیست و هوش مصنوعی یک چهره تصادفی خلق می‌کند.

راهکار اصلی برای حفظ چهره در هوش مصنوعی، استفاده از تصاویر مرجع است. در این مقاله یاد می‌گیرید که چگونه با آپلود عکس خودتان و نوشتن یک پرامپت مناسب، چهره‌تان را در هر موقعیت و فضایی که دوست دارید قرار دهید و بدون نیاز به مهارت‌های گرافیکی پیچیده، تصاویر خلاقانه بسازید.

چالش تغییر چهره در تولید تصویر با هوش مصنوعی

مدل‌های تصویری بر اساس الگوهایی که آموزش دیده‌اند، تصاویر را خلق می‌کنند. وقتی شما در پرامپت می‌نویسید «مردی با موهای قهوه‌ای و عینک»، سیستم یک چهره کاملا جدید با این مشخصات می‌سازد. به همین دلیل، هنگام مطالعه آموزش ساخت عکس با هوش مصنوعی: راهنمای کامل فارسی متوجه می‌شوید که توصیف متنی برای ساخت آواتارهای شخصی‌سازی‌شده راهگشا نیست.

برای اینکه خروجی دقیقا چهره شما یا دوستانتان باشد، سیستم باید بداند اجزای صورت شما دقیقا چه تناسبی با هم دارند. اینجاست که قابلیت آپلود عکس مرجع در هوش مصنوعی اهمیت پیدا می‌کند. با این کار، مدل تصویری مختصات چهره را از عکس پایه می‌گیرد و آن را با دقت روی تصویر جدید اعمال می‌کند.

معرفی قابلیت آپلود تصویر مرجع در موبولند

در بخش تولید تصویر پلتفرم موبولند، امکان آپلود عکس مرجع برای کاربران فراهم شده است. شما می‌توانید یک یا چند عکس واضح از چهره خود را آپلود کنید تا هوش مصنوعی از آن‌ها به عنوان پایه استفاده کند. اگر تا به حال از این سیستم استفاده نکرده‌اید، با اولین ورود / ثبت‌نام در MOBO.LAND مبلغ ۵۰ هزار تومان اعتبار هدیه دریافت می‌کنید که برای تست کردن مدل‌های مختلف و ساخت تصاویر شخصی مناسب است.

استفاده از مدل GPT Image 1 برای حفظ چهره

برای تغییر چهره با هوش مصنوعی، انتخاب مدل مناسب شرط اول است. مدل GPT Image 1 یکی از گزینه‌های در دسترس است که می‌تواند جزئیات چهره مرجع را درک کرده و آن را در موقعیت‌های جدید بازسازی کند. این مدل با ترکیب پرامپت متنی شما و عکس آپلود شده، خروجی‌های طبیعی و باکیفیتی تولید می‌کند.

راهنمای گام‌به‌گام ساخت عکس با چهره خودتان

برای اینکه تصویر نهایی بیشترین شباهت را به شما داشته باشد، کافی است این مراحل عملی را دنبال کنید:

  1. ورود به بخش تولید تصویر: به بخش تولید تصویر بروید.
  2. آپلود عکس مرجع: یک عکس واضح، با نور مناسب و بدون سایه‌های تند از چهره خود یا فرد مورد نظر انتخاب و آپلود کنید.
  3. انتخاب مدل: از میان مدل‌های موجود، گزینه‌ای مانند GPT Image 1 را انتخاب کنید که از قابلیت دریافت عکس پشتیبانی می‌کند.
  4. نوشتن پرامپت: در کادر متنی، فضایی که می‌خواهید چهره در آن قرار بگیرد را با جزئیات بنویسید و حتما تاکید کنید که چهره از عکس مرجع برداشته شود.

پرامپت‌نویسی برای حفظ چهره در مدل‌های مختلف

نوشتن متن دقیق به هوش مصنوعی کمک می‌کند تا تمرکز خود را روی محیط، نورپردازی و لباس بگذارد و چهره را دست‌نخورده باقی بگذارد. برای آشنایی با اصول اولیه توصیف صحنه‌ها، مطالعه فرمول نوشتن بهترین پرامپت برای تولید عکس می‌تواند بسیار کمک‌کننده باشد.

در ادامه دو مثال کاربردی برای پرامپت‌نویسی آورده شده است که به خوبی با عکس مرجع ترکیب می‌شوند:

  • مثال پرامپت تک‌نفره: «یک فضانورد در حال قدم زدن روی سطح مریخ با لباس فضایی نارنجی، با حفظ چهره فرد داخل عکس مرجع، نورپردازی سینمایی»
  • مثال پرامپت دونفره: «دو نفر در حال نوشیدن قهوه در یک کافه کلاسیک در پاریس، چهره‌ها دقیقاً مطابق با دو عکس آپلود شده باشد»

لازم به ذکر است که مدل‌هایی مانند dall-e-3 برای تولید تصاویر پایه و خلاقانه از روی متن بسیار قدرتمند هستند، اما زمانی که نیاز به ترکیب چهره واقعی با یک صحنه جدید دارید، باید از مدل‌هایی استفاده کنید که بر پایه دریافت تصویر مرجع کار می‌کنند.

در جدول زیر تفاوت خروجی در دو حالت مختلف تولید تصویر را مشاهده می‌کنید:

روش تولید تصویر ورودی کاربر نتیجه خروجی
فقط پرامپت متنی توصیف متنی رنگ مو، چشم و فرم صورت یک چهره تصادفی و عمومی که شبیه کاربر نیست.
پرامپت متنی + عکس مرجع آپلود عکس واضح + توصیف محیط و لباس قرار گرفتن چهره واقعی کاربر در محیط جدید و دلخواه.

تنظیمات پیشرفته برای ابعاد و استایل تصویر

پس از آپلود عکس و نوشتن پرامپت، می‌توانید خروجی را متناسب با نیاز خود تنظیم کنید. امکان تغییر ابعاد تصویر وجود دارد. اگر عکس را برای پست شبکه‌های اجتماعی می‌خواهید، نسبت مربعی مناسب است. برای استوری‌ها می‌توانید کادر عمودی را انتخاب کنید و برای استفاده در ویدئوها، هدر سایت یا مانیتور، ابعاد افقی کاربرد دارد. تنظیم درست ابعاد پیش از تولید تصویر، شما را از برش زدن‌های بعدی بی‌نیاز می‌کند.

جمع‌بندی

حفظ چهره در هوش مصنوعی با استفاده از ابزارهای امروزی فرایندی ساده و در دسترس است. با استفاده از قابلیت آپلود عکس مرجع در هوش مصنوعی و انتخاب مدل‌های مناسبی مانند GPT Image 1، هر کاربری می‌تواند چهره خود یا دوستانش را در فضاهای جدید قرار دهد. کلید موفقیت در این فرایند، استفاده از یک عکس مرجع واضح (تمام‌رخ با نور مناسب) و نوشتن پرامپت متنی دقیق برای توصیف محیط اطراف است.

سوالات متداول

آیا می‌توانم همزمان چهره دو نفر را در یک عکس حفظ کنم؟

بله، شما می‌توانید دو یا چند عکس مرجع مجزا آپلود کنید و در پرامپت متنی خود به وضوح بنویسید که هر چهره متعلق به کدام کاراکتر در صحنه جدید است تا هوش مصنوعی آن‌ها را در کنار هم قرار دهد.

کدام مدل برای حفظ چهره در موبولند بهتر عمل می‌کند؟

مدل GPT Image 1 یکی از گزینه‌های مناسب برای پردازش عکس‌های مرجع و اعمال چهره روی تصاویر جدید است. البته بسته به نوع تصویر و خروجی مدنظر، می‌توانید مدل‌های دیگر موجود در بخش تولید تصویر را نیز با اعتبار اولیه خود تست کنید.

چرا گاهی چهره خروجی دقیقاً شبیه عکس مرجع نمی‌شود؟

این موضوع معمولاً به کیفیت عکس آپلود شده بستگی دارد. اگر عکس مرجع تار باشد، نورپردازی نامناسبی داشته باشد یا بخشی از صورت با عینک، دست و مو پوشانده شده باشد، هوش مصنوعی در بازسازی دقیق چهره دچار خطا می‌شود. استفاده از عکس‌های واضح، باکیفیت و تمام‌رخ این مشکل را برطرف می‌کند.