اختر الفئة بحسب المرحلة
استكشف على Lite، وحسّن على Fast، واحتفظ بفئة Quality للقطة التي ستُنشر. تنتقل المطالبة نفسها بين الفئات الثلاث، فتغيير الفئة لا يعني إعادة الكتابة.
BestAIVideo
Veo 3.1 هو نموذج الفيديو من Google الذي ينشئ الحوار والمؤثرات والأجواء الصوتية مع الصورة نفسها. ابدأ من مطالبة نصية، أو حرّك إطارًا أول، أو زوّد النموذج بما يصل إلى ثلاث صور مرجعية، ثم اختر فئة Lite أو Fast أو Quality وشاهد التكلفة الدقيقة بنقاط الرصيد قبل أن تنشئ الفيديو.
صُمم Veo 3.1 للمقاطع القصيرة المصقولة التي يأتي معها الصوت جاهزًا. ويعرض المولّد ثلاث فئات حتى توازن بين التكلفة ومرحلة المشروع التي وصلت إليها.
Lite هي الخيار الأقل تكلفة، وFast هي الخيار المتوازن والافتراضي، وQuality مخصصة للمخرجات النهائية. تتيح الفئات الثلاث جميعها الدقة 720p و1080p و4K، وتكون 1080p محددة مسبقًا.
يصل كل مقطع ومعه حوار ومؤثرات صوتية وأجواء محيطة مُنشأة تلقائيًا. لا يوجد مفتاح لتشغيل الصوت أو إيقافه، لذلك اكتب الصوت الذي تريده داخل المطالبة نفسها.
حرّك إطارًا أول، وأضف إطارًا أخيرًا إن شئت، أو استخدم «مرجع شامل» مع صورة إلى ثلاث صور في فئتي Lite وFast للحفاظ على ثبات الشخصية أو المنتج.
اختر 4 أو 6 أو 8 ثوانٍ، والمدة الافتراضية هي 8، ونسبة 16:9 أو 9:16 أو تلقائي للمقاطع العريضة أو العمودية أو القائمة على الإطار.
يقسّم دليل الكتابة الذي نشرته Google لنموذج Veo 3.1 المطالبة الجيدة إلى عناصر. استعمل هذه العناصر قائمةَ تحقق تراجع بها مطالبتك، لا قالبًا تنسخه كما هو.
اجمع بين التصوير السينمائي والموضوع والفعل والسياق والأسلوب والأجواء. وحين تبدأ بنوع اللقطة وحركة الكاميرا يصبح التأطير مقصودًا لا عفويًا.
اكتب الحوار بين علامتي اقتباس وحدّد من يتكلم، كأن تكتب أن امرأة تقول جملة قصيرة. اجعل الجمل المنطوقة قصيرة بما يكفي لتتسع في مقطع مدته بضع ثوانٍ.
أضف إشارات مثل SFX للمؤثر الصوتي وAmbient noise لضجيج الغرفة أو المشهد الطبيعي. وتسمية الصوت منفصلًا عن الحدث تمنع النموذج من إهماله.
يمكن للمطالبة أن تحدد لحظات بعينها، مثل أول ثانيتين ثم الثواني الثلاث التي تليها. وهي نص عادي، لذلك تعمل داخل مربع المطالبة الواحد هذا.
قطة برتقالية مطوية تمشي بخفة على ممر حجري بجوار أشجار ورقية ووردة وسياج خشبي، ومعها أصوات محيطة تناسب المشهد. يُظهر المقطع كيف تستطيع المطالبة أن تحدد خامة العالم كله وأن تطلب مع ذلك حركة طبيعية ذات وزن.
راكب بالأحمر يميل في منعطف بينما يملأ الغبار المتلألئ والأضواء العائمة الكادر. تعطي المطالبات الأسلوبية مثل هذه أفضل نتيجة حين تسمّي موضوعًا واحدًا وحركة واحدة وتترك للبيئة مهمة صنع الاستعراض.
لقطة تتبّع جانبية ترافق راكب خيل بقبعة واسعة وسط عشب متوهج وشمس منخفضة خلفه. المطالبة وراء لقطة كهذه تحدد موضع الكاميرا واتجاه الضوء والأصوات الهادئة في المشهد.
استكشف على Lite، وحسّن على Fast، واحتفظ بفئة Quality للقطة التي ستُنشر. تنتقل المطالبة نفسها بين الفئات الثلاث، فتغيير الفئة لا يعني إعادة الكتابة.
إذا كانت اللقطة تعتمد على منتج أو شخصية ثابتة فاختر Lite أو Fast لاستخدام «مرجع شامل»، لأن فئة Quality لا تتضمن وضع المراجع.
ثماني ثوانٍ وقت قصير. موضوع واحد يفعل شيئًا واحدًا مع حركة كاميرا واحدة يُقرأ أفضل بكثير من قائمة أحداث متلاحقة.
أنتج نسختين 16:9 و9:16 من إعلان قصير من دون مرحلة منفصلة لمعالجة الصوت.
حرّك صورة المنتج من إطار أول، وأضف إطارًا أخيرًا لتنتهي اللقطة على الوضعية التي يحتاجها التصميم.
استعمل من صورة إلى ثلاث صور مرجعية مع فئة Lite أو Fast لنقل الشخصية أو المنتج نفسه عبر عدة مقاطع.
جرّب أفكارك بدقة 720p على Lite مقابل 24 نقطة رصيد، ثم أنشئ الفكرة المختارة بفئة Fast أو Quality.
ارفع الدقة إلى 4K في أي فئة حين يتجه المقطع إلى شاشة كبيرة أو إلى مونتاج نهائي.
اكتب جملة بين علامتي اقتباس مع الأجواء والمؤثرات لتجرّب مشهدًا قبل التصوير أو التسجيل الصوتي.
Veo 3.1 هو نموذج إنشاء الفيديو من Google DeepMind. ينشئ مقاطع قصيرة من النصوص أو الصور أو المراجع، ويُنشئ الصوت في الوقت نفسه الذي تُنشأ فيه الصورة.
Lite هي الأقل تكلفة، وFast هي الفئة المتوازنة والافتراضية، وQuality هي الأعلى تكلفة وتناسب المخرجات النهائية. تذكر Google أن تكلفة Lite أقل من نصف تكلفة Veo 3.1 Fast، وتبلغ تكلفة Quality في هذا الموقع نحو أربعة أضعاف Fast بدقة 720p.
السعر لكل فيديو ولا يتغير بتغير المدة أو النسبة. بدقة 720p يبلغ 24 نقطة رصيد في Lite و48 في Fast و200 في Quality. وبدقة 1080p يبلغ 28 و52 و204، أما 4K فتبدأ من 120 نقطة رصيد في Lite.
يمكنك اختيار 720p أو 1080p أو 4K في كل فئة، ومقاطع مدتها 4 أو 6 أو 8 ثوانٍ. القيمتان الافتراضيتان هما 1080p و8 ثوانٍ.
من نص إلى فيديو، وإنشاء من إطارات مع إطار أول مطلوب وإطار أخير اختياري، ومرجع شامل. يقبل «مرجع شامل» من صورة إلى ثلاث صور وهو متاح في Lite وFast دون Quality.
نعم، دائمًا. يُنشأ الحوار والمؤثرات والأجواء مع الفيديو، وتوجّهها من خلال المطالبة.
ضع الكلمات المنطوقة بين علامتي اقتباس وحدّد من يتكلم. اجعل الجمل قصيرة، لأن مدة المقطع لا تتجاوز بضع ثوانٍ.
تتوفر ثلاث نسب: 16:9 وهي النسبة الافتراضية، و9:16، وتلقائي.
نعم. تُترجم المطالبات إلى الإنجليزية قبل الإنشاء، فيمكنك الكتابة باللغة التي ترتاح إليها. احرص على أن تبقى المصطلحات الأساسية مثل حركات الكاميرا واضحة.
يمكن أن تصل المطالبة إلى 20,000 حرف. وتُقبل صور الإطار الأول والأخير والصور المرجعية بالصيغ الشائعة مثل JPG وPNG وWebP، على ألا يتجاوز حجم كل صورة 30 ميغابايت.
انظر أولًا إلى الموضوع والفعل، ثم إلى حركة الكاميرا والإضاءة. وأخيرًا استمع إلى المقطع وعيناك مغمضتان، فتوقيت الكلام والأجواء يسهل الحكم عليهما حين لا تشاهد الصورة.
اختر فئتك، واكتب المطالبة مع الصوت الذي تريده، وشاهد التكلفة بنقاط الرصيد قبل الإنشاء.