مدل‌های زبانی · Google

Gemini 3 Pro

مدل استدلالی و چندوجهی پیشرفته برای تحلیل متن، تصویر، ویدیو و صوت و انجام وظایف پیچیده.

ورودی چندوجهی استدلال قابل تنظیم تحلیل صوت نمونه API

پاسخ مدل

پاسخ اینجا نمایش داده می‌شود.

پاسخ اینجا نمایش داده می‌شود.پس از اجرای مدل، وضعیت پردازش و متن نهایی در همین بخش قرار می‌گیرد.

تنظیمات مدل

برای شروع فقط درخواست را بنویسید؛ کنترل‌های تخصصی در بخش پیشرفته قرار دارند.

prompt

هدف، زمینه، محدودیت‌ها و قالب پاسخ موردنظر را روشن بنویسید.

images
بدون تصویر ورودیJPG، PNG، GIF یا WEBP

اختیاری؛ حداکثر ۱۰ تصویر و مجموع فایل‌ها کمتر از ۲۴ مگابایت.

videos
بدون ویدیوی ورودیMP4، WEBM، MOV یا M4V

اختیاری؛ حداکثر ۱۰ ویدیو و مجموع فایل‌ها کمتر از ۲۴ مگابایت.

audio
بدون فایل صوتیMP3، WAV، OGG، M4A، AAC یا FLAC

اختیاری؛ یک فایل صوتی برای پیاده‌سازی، خلاصه‌سازی یا تحلیل اضافه کنید.

تنظیمات پیشرفتهکنترل استدلال، سبک و طول پاسخ
system_instruction

اختیاری؛ نقش، لحن، زبان یا قواعد ثابت پاسخ را مشخص کنید.

thinking_level

برای درخواست‌های پیچیده می‌توانید سطح استدلال را افزایش دهید.

video_fps

اختیاری؛ برای تحلیل ویدیو عددی بین ۰٫۱ و ۶۰ وارد کنید.

temperature

مقدار کمتر پاسخ را پایدارتر و مقدار بیشتر پاسخ را متنوع‌تر می‌کند.

top_p

دامنه انتخاب توکن‌ها را بین صفر و یک کنترل می‌کند.

max_output_tokens

حداکثر مجاز این مدل ۶۵٬۵۳۵ توکن است.

معرفی مدل

Gemini 3 Pro

مدل استدلالی و چندوجهی پیشرفته گوگل برای درک عمیق متن، تصویر، ویدیو و صوت، حل مسائل پیچیده، برنامه‌نویسی و برنامه‌ریزی چندمرحله‌ای است.

کاربردهای پیشنهادی

  • تحلیل چند منبع متنی و چندرسانه‌ای و یافتن ارتباط میان آن‌ها
  • برنامه‌نویسی، بررسی معماری و بازنویسی بخش‌های نرم‌افزار
  • تحلیل فایل صوتی، پیاده‌سازی محتوا و تهیه خلاصه
  • تقسیم هدف‌های پیچیده به مراحل اجرایی و مقایسه گزینه‌ها

قابلیت‌های کلیدی

  • درک یکپارچه متن، تصویر، ویدیو و صوت در یک درخواست
  • زمینه طولانی و قیمت‌گذاری جداگانه برای ورودی‌های بسیار بزرگ
  • سطح استدلال قابل تنظیم برای کنترل سرعت و کیفیت
  • خروجی متنی ساختاریافته و قابل کپی

ورودی و خروجی

  • حداکثر ۱۰ تصویر و ۱۰ ویدیو در سطح مدل
  • یک فایل صوتی برای تحلیل، خلاصه‌سازی یا پیاده‌سازی
  • مجموع فایل‌های هر درخواست در سایت باید کمتر از ۲۴ مگابایت باشد
  • خروجی متنی و اطلاعات مصرف واقعی توکن

تنظیمات تخصصی

  • thinking_level برای انتخاب سطح استدلال
  • video_fps برای کنترل نمونه‌برداری ویدیو
  • temperature و top_p برای کنترل تنوع پاسخ
  • max_output_tokens برای تعیین سقف طول خروجی

نکته استفاده

  • برای مسائل ساده سطح استدلال پایین سریع‌تر و اقتصادی‌تر است.
  • نرخ نمونه‌برداری ویدیو را فقط هنگام نیاز افزایش دهید.
  • هدف، محدودیت‌ها و قالب خروجی را در ابتدای درخواست روشن بنویسید.