ویدیو · Google

Veo 3.1 Fast

تولید ویدیو از متن یا تصویر با کنترل فریم پایان، صدای هماهنگ، مدت، نسبت تصویر و وضوح خروجی.

متن و تصویر به ویدیو تنظیمات پایه و حرفه‌ای نمونه API

نتیجه

نتیجه اینجا نمایش داده می‌شود.

نتیجه اینجا نمایش داده می‌شود.پس از اجرای مدل، وضعیت پردازش و خروجی نهایی در همین بخش قرار می‌گیرد.

تنظیمات مدل

برای شروع گزینه‌های اصلی را تکمیل کنید؛ کنترل‌های تخصصی در بخش پیشرفته قرار دارند.

prompt

سوژه، حرکت، زاویه دوربین، نور، فضا و صدای موردنظر را روشن توضیح دهید.

resolution

وضوح بالاتر معمولاً هزینه بیشتری دارد.

duration

مدت خروجی را انتخاب کنید.

aspect_ratio

نسبت طول به عرض خروجی را انتخاب کنید.

image
بدون تصویر ورودیورودی اختیاری

اختیاری؛ برای کنترل شروع حرکت یا تبدیل تصویر به ویدیو استفاده می‌شود.

تنظیمات پیشرفتهکنترل‌های تخصصی و اختیاری این مدل
negative_prompt

عناصر یا خطاهایی را که نباید در نتیجه باشند بنویسید.

last_frame
بدون تصویر پایانورودی اختیاری

اختیاری؛ برای کنترل پایان حرکت استفاده می‌شود.

seed

برای نتیجه تصادفی خالی بگذارید.

generate_audio

صدای محیط، افکت یا گفت‌وگو همراه ویدیو ساخته شود.

هزینه این تنظیمات۴٬۲۰۰ اعتبار
معرفی مدل

Veo 3.1 Fast

نسخه سریع مدل تولید ویدیوی Veo 3.1 است که از متن یا تصویر، ویدیوهای باکیفیت می‌سازد و در صورت فعال‌بودن صدا، گفت‌وگو، افکت و صدای محیط را هماهنگ با تصویر تولید می‌کند. این نسخه برای آزمایش سریع ایده‌ها و تولید حرفه‌ای با زمان انتظار کمتر طراحی شده است.

چه کارهایی انجام می‌دهد؟

می‌توانید فقط با یک توضیح متنی ویدیو بسازید، یک تصویر ثابت را به ویدیوی متحرک تبدیل کنید یا با تعیین تصویر شروع و فریم پایان، گذار کنترل‌شده‌ای میان دو تصویر ایجاد کنید.

مدل از ویدیوهای افقی و عمودی، خروجی 720p و 1080p و مدت‌های 4، 6 و 8 ثانیه پشتیبانی می‌کند. تمام خروجی‌ها با نرخ 24 فریم در ثانیه تولید می‌شوند.

قابلیت‌های کلیدی

  • تولید صدای هماهنگ: ساخت گفت‌وگوی طبیعی، افکت صوتی، موسیقی و صدای محیط متناسب با محتوای ویدیو.
  • متن به ویدیو: تولید مستقیم صحنه، حرکت دوربین و رویدادها از یک درخواست متنی دقیق.
  • تصویر به ویدیو: تبدیل تصویر شروع به ویدیوی پویا با حفظ بهتر سوژه، سبک و ترکیب‌بندی.
  • فریم به فریم: تعیین تصویر شروع و پایان برای ساخت یک انتقال پیوسته میان دو وضعیت.
  • کنترل خروجی: انتخاب نسبت 16:9 یا 9:16، وضوح 720p یا 1080p و مدت 4، 6 یا 8 ثانیه.
  • Seed اختیاری: استفاده از عدد ثابت برای تکرارپذیری بهتر آزمایش‌ها و مقایسه تنظیمات.

راهنمای نوشتن درخواست حرفه‌ای

  • سوژه اصلی، محیط، زمان روز، نور، رنگ و حال‌وهوای صحنه را روشن مشخص کنید.
  • حرکت سوژه و دوربین را جداگانه توضیح دهید؛ برای مثال نمای تعقیبی، زوم آرام، پن افقی یا دوربین ثابت.
  • برای صدای بهتر، گفت‌وگو، افکت‌ها، موسیقی و صدای محیط را مستقیماً در درخواست بنویسید.
  • اگر ترتیب رخدادها مهم است، آن‌ها را به شکل مرحله‌ای و به ترتیب زمانی توصیف کنید.
  • برای جلوگیری از خروجی‌های ناخواسته، خطاها و عناصر ممنوع را در negative_prompt قرار دهید.

استفاده از تصویر شروع و فریم پایان

  • تصویر ورودی بهتر است واضح، خوش‌نور و دارای سوژه مشخص باشد.
  • برای خروجی افقی از تصویر نزدیک به 1280×720 و برای خروجی عمودی از تصویر نزدیک به 720×1280 استفاده کنید.
  • در حالت تصویر به ویدیو، بیشتر درباره حرکت و اتفاقی که باید رخ دهد بنویسید، نه فقط چیزی که در تصویر دیده می‌شود.
  • فریم پایان فقط همراه تصویر شروع قابل استفاده است و برای ساخت انتقال میان دو تصویر کاربرد دارد.
  • برای حفظ هماهنگی، تصویر شروع و پایان بهتر است نسبت تصویر، سبک و ترکیب‌بندی مشابهی داشته باشند.

صدا و گفت‌وگو

  • برای گفت‌وگو، متن یا مفهوم دیالوگ، تعداد گوینده‌ها و لحن آن‌ها را مشخص کنید.
  • برای افکت صوتی از عبارت‌های روشن مانند صدای باران، قدم‌ها، وزش باد یا عبور خودرو استفاده کنید.
  • در صورت نیاز به موسیقی، سبک، سرعت و حس آن را توصیف کنید؛ برای مثال موسیقی آرام ارکسترال یا ریتم الکترونیک پرانرژی.
  • غیرفعال‌کردن generate_audio هزینه هر ثانیه را کاهش می‌دهد و خروجی بدون صدای تولیدشده تحویل می‌شود.

تنظیمات و هزینه

  • هزینه بر اساس تعداد ثانیه‌های ویدیو و فعال یا غیرفعال بودن تولید صدا محاسبه می‌شود.
  • پیش از شروع، مبلغ دقیق اجرا از کیف پول رزرو می‌شود و در صورت خطای اجرا آزاد خواهد شد.
  • وضوح 1080p جزئیات بیشتری ارائه می‌دهد اما فایل خروجی بزرگ‌تر و زمان انتقال آن بیشتر است.
  • Seed را برای خروجی تصادفی خالی بگذارید یا برای مقایسه تنظیمات یک عدد ثابت وارد کنید.

درباره Veo 3.1

Veo 3.1 نسبت به نسل‌های قبلی در پیروی از دستور، کیفیت دیداری و هماهنگی صدا و تصویر بهبود یافته است؛ این پیشرفت به‌ویژه در حالت تصویر به ویدیو و کنترل حرکت محسوس است.

ویدیوهای تولیدشده با فناوری SynthID علامت‌گذاری می‌شوند تا محتوای ساخته‌شده با هوش مصنوعی قابل شناسایی باشد.

شروع کار

  • درخواست ویدیو را با جزئیات صحنه، حرکت دوربین و صدا بنویسید.
  • نسبت تصویر، مدت، وضوح و وضعیت تولید صدا را انتخاب کنید.
  • در صورت نیاز تصویر شروع و سپس فریم پایان را اضافه کنید.
  • موارد ناخواسته و Seed اختیاری را تنظیم کنید و هزینه نهایی را پیش از اجرا بررسی کنید.
  • پس از پایان، ویدیو را پخش، بزرگ‌نمایی یا دانلود کنید؛ خروجی در تاریخچه حساب نیز باقی می‌ماند.