خانه
هوش نو
تولیدکننده ویدیو با هوش مصنوعی

ساخت ویدیو با هوش مصنوعی از متن یا تصویر

یک جمله بنویس یا یک عکس بده، مدل مناسب کارت را انتخاب کن و ویدیو تحویل بگیر. هزینه پیش از زدن دکمه به تومان نشانت داده می‌شود، پس چیزی غافلگیرت نمی‌کند.

مدت ویدیو
۴ / ۸ / ۱۲ ثانیه
ابعاد خروجی
۴ نسبت، عمودی و افقی
توضیح ویدیو
تا ۱۰۰۰ کاراکتر
تصویر مرجع
jpg و png
انتخاب مدل

۱۰ خانواده مدل در یک انتخابگر

لازم نیست اسم مدل‌ها را بدانی. کنار هرکدام نوشته شده در چه کاری بهتر است.

  • SO Sora بهترین گزینه برای شبکه‌های اجتماعی
  • VE Veo بهترین گزینه برای داستان‌گویی
  • KL Kling بهترین گزینه برای کنترل حرکت
  • PI Pixverse v5 تولید ویدیو از متن و تصویر
  • GR Grok Imagine ویدیوی هوش مصنوعی از xAI
  • SE Seedance ویدیوی هوش مصنوعی از ByteDance
  • GE Gemini Omni Flash ویدیو به‌همراه صدای همگام
  • MI Minimax سریع و کم‌هزینه
  • حذ حذف پس‌زمینه حذف پس‌زمینه ویدیوها
  • لب لب‌خوانی و آواتار هماهنگی لب با صدای تازه، یا آواتار از یک عکس

ده خانواده مدل، هرکدام برای یک کار

مهم‌ترین تصمیم در ساخت ویدیو انتخاب مدل است، نه نوشتن پرامپت طولانی‌تر. هوش نو ده خانواده مدل را کنار هم گذاشته و برای هرکدام نوشته که در چه کاری بهتر است: Sora برای شبکه‌های اجتماعی، Veo برای داستان‌گویی، Kling برای کنترل حرکت، Minimax وقتی سرعت و هزینه‌ی کمتر مهم‌تر است، و Gemini Omni Flash وقتی ویدیو باید صدای همگام داشته باشد.

کنار این‌ها Pixverse v5، Grok Imagine از xAI و Seedance از ByteDance هم در دسترس‌اند. دو قابلیت دیگر هم در همان انتخابگر مدل نشسته‌اند و ابزار جداگانه ندارند: حذف پس‌زمینه‌ی ویدیو، و لب‌خوانی و آواتار که لب‌های یک ویدیوی موجود را با صدای تازه هماهنگ می‌کند یا از یک عکس، آواتار سخنگو می‌سازد.

انتخابگر مدل سه‌مرحله‌ای است: اول خانواده، بعد نسخه، بعد قابلیت. مثلاً Sora دو نسخه دارد — Sora 2 و Sora 2 Pro. این ساختار باعث می‌شود بدون دانستن نام دقیق مدل‌ها هم بتوانی بر اساس کاری که می‌خواهی انجام دهی انتخاب کنی.

چه چیزی را می‌توانی تنظیم کنی

توضیح ویدیو تا ۱۰۰۰ کاراکتر جا دارد و اگر توضیحت کوتاه یا مبهم باشد، دکمه‌ی «بهبود با هوش مصنوعی» همان‌جا بازنویسی‌اش می‌کند. تصویر مرجع اختیاری است و فرمت jpg و png می‌پذیرد؛ وقتی به کارت می‌آید که بخواهی ظاهر محصول، شخصیت یا ترکیب‌بندی اولیه تا حد ممکن در ویدیو حفظ شود.

مدت ویدیو بین ۴، ۸ و ۱۲ ثانیه انتخاب می‌شود و برای ابعاد چهار گزینه هست: ۷۲۰×۱۲۸۰ و ۱۰۲۴×۱۷۹۲ برای حالت عمودی مناسب استوری و ریلز، و ۱۲۸۰×۷۲۰ و ۱۷۹۲×۱۰۲۴ برای حالت افقی مناسب یوتیوب و وب‌سایت. ابعاد را بر اساس جایی که ویدیو قرار است منتشر شود انتخاب کن، نه بر اساس بزرگ‌تر بودن عدد.

هزینه‌ی تخمینی پیش از زدن دکمه‌ی تولید، به تومان، زیر همان فرم نوشته می‌شود و با تغییر مدل، مدت و ابعاد به‌روز می‌شود. برای نمونه در زمان نگارش این صفحه، Sora 2 با مدت ۴ ثانیه و ابعاد ۷۲۰×۱۲۸۰ حدود ۱۲۳٬۲۰۰ تومان تخمین زده می‌شد. عدد دقیق را همیشه در خود ابزار ببین، چون به مدل و تنظیمات وابسته است.

برای نتیجه بهتر چه چیزی به مدل بدهی؟

کیفیت ویدیو تا حد زیادی به توضیح اولیه بستگی دارد. به‌جای «یک ویدیوی تبلیغاتی بساز»، سوژه، محیط، نور، حرکت دوربین و اتفاقی را که باید در صحنه رخ دهد مشخص کن. اگر تصویر مرجع داده‌ای، توضیح بده چه چیزی در تصویر باید حرکت کند و چه بخش‌هایی نباید تغییر کنند.

در ویدیوی چهار ثانیه‌ای، درخواست چند اتفاق مستقل در یک پرامپت کنترل خروجی را سخت می‌کند. اگر داستان بلندتری داری، بهتر است چند ویدیوی کوتاه بسازی و بعد کنارشان بگذاری تا اینکه همه‌چیز را در یک درخواست جا بدهی.

قبل از انتشار خروجی چه چیزهایی را بررسی کنی؟

ویدیوی هوش مصنوعی را مثل یک نسخه‌ی اولیه ببین، نه فایلی که بدون بازبینی منتشر شود. دست‌ها، نوشته‌های داخل تصویر، جزئیات بسته‌بندی محصول و لوگو بخش‌هایی هستند که ارزش نگاه دوباره دارند. در ویدیوی ساخته‌شده از تصویر مرجع هم ممکن است جزئیات ظریف بین فریم‌ها تغییر کنند.

همه‌ی ساخته‌های قبلی‌ات در همان صفحه بایگانی می‌شوند، با امکان جستجو و فیلتر بر اساس مدل، و هر کدام دکمه‌ی دانلود خودش را دارد. پس اگر خروجی اول آن چیزی نبود که می‌خواستی، نسخه‌های بعدی را بساز و بعد با هم مقایسه کن.

سوالات متداول

چه مدل‌هایی در دسترس است؟

ده خانواده مدل: Sora، Veo، Pixverse v5، Kling، Grok Imagine، Seedance، Gemini Omni Flash و Minimax، به‌علاوه حذف پس‌زمینه‌ی ویدیو و لب‌خوانی و آواتار.

آیا می‌توانم از روی یک عکس ویدیو بسازم؟

بله. تصویر مرجع را با فرمت jpg یا png بارگذاری کن. در مدل‌های سازگار، تصویر به‌عنوان ورودی تولید ویدیو استفاده می‌شود.

حداکثر طول ویدیو چقدر است؟

مدت ویدیو بین ۴، ۸ و ۱۲ ثانیه قابل انتخاب است.

چه ابعادی برای خروجی وجود دارد؟

چهار گزینه: ۷۲۰×۱۲۸۰ و ۱۰۲۴×۱۷۹۲ عمودی، ۱۲۸۰×۷۲۰ و ۱۷۹۲×۱۰۲۴ افقی.

هزینه ساخت هر ویدیو چقدر است؟

به مدل، مدت و ابعاد بستگی دارد و پیش از زدن دکمه‌ی تولید به تومان در همان فرم نمایش داده می‌شود، پس قبل از پرداخت می‌دانی چقدر می‌شود.

آیا ساخت ویدیوی لب‌خوانی هم در همین ابزار است؟

بله. «لب‌خوانی و آواتار» یکی از گزینه‌های همان انتخابگر مدل است و ابزار جداگانه‌ای ندارد.

همین حالا امتحانش کن

رابط کاربری فارسی، پرداخت ریالی، و بدون نیاز به ابزار تغییر آی‌پی.

رفتن به تولیدکننده ویدیو با هوش مصنوعی