آموزش تولید کلیپ آواتار سخنگوی فارسی با هوش مصنوعی
مقدمه: دنیای جدید تولید محتوا با آواتارهای هوش مصنوعی
در دنیای امروز، تولید محتوای ویدیویی دیگر محدود به استودیو، دوربین یا مجری واقعی نیست. با هوش مصنوعی میتوانید تنها با چند کلیک، یک آواتار سخنگو با صدای فارسی طبیعی بسازید که در ویدیو صحبت میکند، چهره دارد و احساسات را منتقل میکند.
این تکنولوژی در حال حاضر توسط برندهای بزرگ و حتی کسبوکارهای کوچک برای تولید محتوای آموزشی، تبلیغاتی و شبکههای اجتماعی استفاده میشود. اما سؤال بسیاری از کاربران این است:
چطور میتوانم خودم ویدیو آواتار سخنگوی فارسی تولید کنم؟
در این آموزش، گامبهگام با شما همراه میشویم تا بدون نیاز به نرمافزارهای پیچیده، تنها با چند ابزار آنلاین رایگان شامل:
-
Nano Banana (برای ساخت عکس آواتار)
-
Google Studio (برای تولید صدای فارسی)
-
HeyGen یا Hedra.ai (برای ساخت آواتار سخنگو)
یک ویدیو کاملاً حرفهای و فارسی تولید کنید.
بخش اول: ساخت چهره آواتار در Nano Banana
مرحله ۱: ورود به سایت Nano Banana
به آدرس https://nanobanana.ai بروید.
Nano Banana یکی از جدیدترین پلتفرمهای ساخت تصویر با هوش مصنوعی است که اجازه میدهد تنها با چند توصیف متنی (Prompt)، یک تصویر واقعگرایانه از چهره دلخواهتان بسازید.
مرحله ۲: نوشتن Prompt (توصیف دقیق)
برای مثال بنویسید:
“A professional young Iranian woman wearing a white hijab, looking at the camera, neutral background, 4k portrait”
اگر میخواهید چهره مردانه داشته باشید:
“A young Iranian man, formal shirt, natural light, smiling, cinematic portrait”
نکته:
میتوانید از ویژگی “Style” برای تغییر نوع تصویر (واقعی، کارتونی، یا سبک سینمایی) استفاده کنید.

نمونه تصویر تولید شده در نانو بنانا
مرحله ۳: دانلود تصویر
پس از تولید تصویر، بهترین خروجی را انتخاب کرده و با فرمت .jpg یا .png دانلود کنید.
این تصویر قرار است در مراحل بعدی به آواتار سخنگو تبدیل شود.
بخش دوم: تولید صدای فارسی با Google Studio (یا Google TTS)
اگرچه بسیاری از ابزارهای ساخت آواتار هنوز از زبان فارسی بهصورت مستقیم پشتیبانی نمیکنند، اما میتوان با تولید صدای فارسی از ابزارهای گوگل، این محدودیت را دور زد.
مرحله ۱: ورود به Google Cloud Text-to-Speech
به آدرس https://cloud.google.com/text-to-speech بروید و وارد حساب گوگل خود شوید.
مرحله ۲: انتخاب زبان فارسی
در قسمت Language، گزینهی Persian (fa-IR) را انتخاب کنید.
در بخش Voice Name، یکی از گزینههای فارسی مثل:
را برگزینید.
مرحله ۳: نوشتن متن گفتار
در کادر متنی بنویسید:
سلام! من آواتار فارسی شما هستم. امروز با هوش مصنوعی یاد میگیریم چطور بدون دوربین، کلیپ بسازیم!
روی گزینهی Synthesize کلیک کنید تا صدا تولید شود. سپس فایل صوتی را با فرمت MP3 یا WAV دانلود کنید.
نکته کاربردی:
برای لحن طبیعیتر میتوانید از علائم نگارشی مثل “!” و “…” استفاده کنید.
مثلاً:
امروز قراره یه آواتار سخنگو بسازیم… با هوش مصنوعی
بخش سوم: ترکیب تصویر و صدا در Hedra.ai (یا HeyGen)
مرحله ۱: ورود به سایت Hedra.ai
به آدرس https://www.hedra.ai بروید.
این سایت یکی از بهترین ابزارهای تبدیل چهره به ویدیوی سخنگو (Talking Avatar) است و اخیراً از زبانهای راستبهچپ مانند فارسی نیز پشتیبانی نسبی دارد.
اگر Hedra در دسترس نبود، از جایگزینهای مشابه مثل https://www.heygen.com استفاده کنید.
مرحله ۲: آپلود عکس و صدا
در داشبورد اصلی گزینهی Create Video یا Talking Photo را انتخاب کنید.
سپس:
-
تصویر تولیدشده در Nano Banana را آپلود کنید.
-
فایل صدای فارسی (تولیدشده در Google TTS) را بارگذاری کنید.
مرحله ۳: هماهنگسازی و خروجی نهایی
ابزار بهصورت خودکار لبها و حالت چهره آواتار را با صدای شما هماهنگ میکند.
پس از اتمام پردازش، میتوانید ویدیوی نهایی را در قالب MP4 دانلود کنید.
نمونه آواتار سخنگوی ایجاد شده با تصویر بالا و صدای موجود در ویدئو در سایت هدرا
پیشنهاد حرفهای:
در تنظیمات Hedra، گزینهی “Emotion sync” یا “Lip sync accuracy” را روی حالت بالا بگذارید تا حرکات لب طبیعیتر شوند.
بخش چهارم: نکات حرفهای برای جذابتر کردن آواتار فارسی
-
نور و پسزمینه را ساده انتخاب کنید تا تمرکز روی چهره و گفتار باشد.
-
اگر صدای گوگل بیش از حد ماشینی است، از سرویسهایی مانند ElevenLabs یا Play.ht برای تولید صدای فارسی طبیعیتر استفاده کنید.
-
برای ویرایش نهایی و افزودن زیرنویس، از نرمافزارهایی مثل CapCut یا DaVinci Resolve استفاده کنید.
-
متن گفتار را کوتاه و با جملات ساده تنظیم کنید تا لبخوانی دقیقتر شود.
مثال واقعی از استفاده در کسبوکارها
-
نمونه ایرانی: یک آکادمی آموزش زبان از آواتار فارسی برای معرفی دورهها استفاده میکند تا نیازی به فیلمبرداری مدرس نباشد.
-
نمونه جهانی: شرکت SaaS جهانی Synthesia.io روزانه هزاران آواتار تجاری تولید میکند که در تبلیغات، آموزش کارمندان و پستهای شبکه اجتماعی استفاده میشوند.
این روش باعث کاهش هزینه تولید و افزایش سرعت انتشار محتوا تا ۷۰٪ شده است.
پرسشهای متداول (FAQ)
❓ آیا سایت Hedra از زبان فارسی پشتیبانی میکند؟
بله، بهصورت غیررسمی از فارسی پشتیبانی میکند. کافی است صدای فارسی را خودتان تولید کرده و در بخش Upload Audio وارد کنید.
❓ آیا ساخت آواتار سخنگو رایگان است؟
بیشتر این ابزارها نسخه رایگان محدودی دارند (مثلاً ۱ یا ۲ کلیپ در ماه). برای پروژههای حرفهای باید اشتراک ماهانه تهیه کنید.
❓ آیا میتوان از چهره خودم استفاده کنم؟
بله. میتوانید تصویر واقعی خودتان را در Nano Banana آپلود کنید و فقط از آن برای متحرکسازی استفاده کنید.
❓ تفاوت Hedra با HeyGen چیست؟
HeyGen امکانات حرفهایتری برای ویدیوهای بلند دارد، اما Hedra برای پروژههای سریع و فارسی گزینه بهتری است.
❓ چه مدت طول میکشد تا ویدیو آماده شود؟
بسته به طول صوت و کیفیت خروجی، بین ۱ تا ۵ دقیقه.
جمعبندی و نتیجهگیری
ساخت یک کلیپ آواتار سخنگوی فارسی با هوش مصنوعی دیگر کار سختی نیست.
فقط با سه ابزار ساده میتوانید در کمتر از یک ساعت، یک ویدیوی کامل و طبیعی تولید کنید:
-
طراحی چهره در Nano Banana
-
تولید صدای فارسی در Google Studio
-
ترکیب نهایی در Hedra.ai
این روش برای مدرسان، دیجیتالمارکترها، تولیدکنندگان محتوا و استارتاپها ایدهآل است؛ چون در زمان کوتاه و بدون نیاز به حضور فیزیکی، میتوانند محتوای ویدیویی حرفهای تولید کنند.
چگونه شروع کنید :
اگر میخواهید اولین ویدیوی آواتار فارسی خود را بسازید، همین حالا وارد سایتهای معرفیشده شوید و مراحل را امتحان کنید.
میتوانید در شبکههای اجتماعی با هشتگ
#آواتار_فارسی #هوش_مصنوعی_سخنگو
همچنین اگر نیاز به تولید محتوا با هوش مصنوعی توسط کافینت اینترنتی آی آر وب را دارید از طریق ارسال پیام به ما درخواست خود را ارسال نمایید .
نتایج خود را به اشتراک بگذارید و از دیگران الهام بگیرید.
دیدگاه خود را ثبت کنید
تمایل دارید در گفتگوها شرکت کنید؟در گفتگو ها شرکت کنید.