دليل Veo 3.1: كيف تستخدمه وتبني به فيديوهات طويلة (مع التسعير)

Veo 3.1: نموذج جوجل لتوليد الفيديو بالذكاء الاصطناعي
Veo 3.1 هو أحدث نموذج من جوجل لتوليد مقاطع الفيديو من النص أو الصور، أطلق في 15 أكتوبر 2025. ما يميزه أنه لا يصنع صورة متحركة فقط، بل ينتج فيديو واقعيا بصوت متزامن — حوار وأصوات بيئة ومؤثرات — في عملية واحدة. وقد ركزت هذه النسخة على تحسين تحويل الصورة إلى فيديو، والتحكم السينمائي، والحفاظ على ثبات الشخصيات عبر اللقطات.
في هذا الدليل العملي نشرح ما الجديد فيه، ومن أين تستخدمه، وكيف تبني به فيديو طويلا متصلا (وهي النقطة التي يسأل عنها الجميع)، ثم نختم بالتسعير بالتفصيل.
ما الجديد في Veo 3.1؟
إضافة إلى تحسن جودة الصورة والصوت، أضافت هذه النسخة ثلاث قدرات عملية مهمة:
- الصور المرجعية (Ingredients to video): ترفع حتى 3 صور مرجعية لشخصية أو منتج أو مشهد فيلتزم بها النموذج — وهو مفتاح ثبات الشخصية أو هوية المنتج عبر عدة لقطات.
- تمديد المشهد (Scene extension): تولد مقاطع جديدة تتصل بنهاية المقطع السابق (يبني كل مقطع جديد على الثانية الأخيرة مما قبله)، فتحصل على فيديو أطول — دقيقة أو أكثر — مع استمرارية بصرية وصوتية.
- الإطار الأول والأخير (First and last frame): تحدد صورة بداية وصورة نهاية، فيولد النموذج الانتقال بينهما بسلاسة مع الصوت.
من أين تستخدم Veo 3.1؟
يتوفر Veo 3.1 عبر أربعة مسارات، اختر منها حسب حاجتك ومستواك التقني:
- تطبيق Gemini: أسهل طريقة للتجربة — تكتب وصفا فتحصل على مقطع. مناسب للأفراد والتجارب السريعة.
- Flow: أداة جوجل لصناعة الأفلام بالذكاء الاصطناعي، وفيها تبني المشاهد وتديرها وتجمعها في فيديو متكامل (تتطلب اشتراك Google AI Pro أو Ultra). وهي المكان العملي لبناء الفيديوهات الطويلة.
- واجهة Gemini للمطورين (Gemini API عبر Google AI Studio): لربط التوليد ببرامجك ومنتجاتك بالكود.
- Vertex AI: المسار المؤسسي على Google Cloud، للإنتاج بحجم كبير مع ضوابط المؤسسات.
طريقة الاستخدام خطوة بخطوة
الأساس بسيط: تصف ما تريد بدقة فيولد النموذج المقطع. وكلما كان الوصف أدق كانت النتيجة أقرب لما في ذهنك:
- حدد المشهد: الموضوع والمكان والزمن والإضاءة (مثلا: «متجر قهوة حديث وقت الغروب بإضاءة دافئة»).
- صف الحركة وزاوية الكاميرا: «لقطة تقترب ببطء»، «الكاميرا تدور حول المنتج».
- اذكر الأسلوب والصوت: سينمائي، واقعي، مع موسيقى هادئة أو صوت محيط.
- ابدأ من صورة (اختياري): تحويل صورة منتجك إلى فيديو يعطي ثباتا أعلى للهوية.
كيف تبني فيديو طويلا؟
المقطع الواحد قصير عادة (نحو 8 ثوان)، لكن Veo 3.1 يتيح تجاوز ذلك ببناء سلسلة متصلة. والطريقة العملية:
- خطط المشاهد أولا: اكتب نصا قصيرا وقائمة لقطات (Storyboard) قبل التوليد — يوفر وقتا وتكلفة كثيرة.
- ثبت الشخصيات والهوية: استخدم «الصور المرجعية» (حتى 3 صور) ليبقى البطل أو المنتج نفسه في كل لقطة.
- ولد المقطع الأول ثم مدده بـ«تمديد المشهد» لتكمل الحركة بثبات، أو استخدم «الإطار الأخير» للقطة بداية للقطة التالية لانتقال سلس.
- اجمع المشاهد في Flow: رتب اللقطات في تسلسل واحد، واضبط الإيقاع والصوت.
- صدر الفيديو النهائي.
تقنيا عبر الواجهة البرمجية: يمكن تمديد فيديو ولده Veo بمقدار 7 ثوان في كل مرة وحتى 20 مرة، ليصل مجموع الفيديو إلى نحو 141 ثانية. أما داخل Flow فالتجميع أسهل وبصري دون كود.
خطوات عملية داخل Flow: الصور المرجعية والتمديد والتجميع
هذه أكثر ثلاث مزايا يسأل عنها، وكلها داخل أداة Flow. وإليك خطواتها الدقيقة كما وردت في صفحات مساعدة جوجل الرسمية:
1) تثبيت الشخصية أو المنتج (Ingredients):
- افتح مشروعك في Flow، وفي صندوق الكتابة اضغط على اسم النموذج، ثم اختر Video ثم Ingredients.
- أضف صورك المرجعية: بالسحب والإفلات، أو بكتابة @ لاختيار صورة محفوظة في المشروع، أو بزر Add أسفل النص لرفعها من جهازك.
- في النص صف كيف يستخدم العنصر، مثل: «نفس الرجل يمشي في شارع ضبابي». ولأفضل نتيجة اجعل خلفية الصورة بسيطة أو مفرغة.
- طريق أسرع للشخصية المتكررة: عرفها مرة واحدة كـCharacter، ثم استدعها في أي مشهد بكتابة @اسم_الشخصية.
2) تمديد المشهد (Extend) — أين تجده:
- يعمل على مقاطع Veo فقط. افتح المشروع واضغط على المقطع الذي تريد إطالته.
- أسفل المقطع اضغط زر Extend، ثم اكتب كيف تستمر الحركة، ثم اضغط Generate.
- يمكنك تكرار التمديد عدة مرات لإطالة المشهد. ملاحظة: المقطع الممدد لا يقبل تعديلات أخرى مثل الإدراج أو حذف عنصر أو تحريك الكاميرا.
3) تجميع المشاهد في Scenebuilder:
- مرر فوق المقطع الذي تريد إضافته، ثم اضغط More ثم Add to Scene.
- بعد إضافة مقاطعك: رتبها بالسحب، وقص بداية ونهاية كل مقطع من المقابض، وعاين التسلسل كاملا، ثم نزل المشهد النهائي.
- ولإضافة نسخة سابقة من فيديو عدلته، احفظها أولا من لوحة History بزر Save to Project ثم أضفها إلى المشهد.
نصائح لنتائج أفضل
- جرب بالأرخص ثم أنتج بالأغلى: اعصف أفكارك في تطبيق Gemini، ثم نفذ النسخة النهائية في Flow أو الواجهة البرمجية.
- اللقطات القصيرة المتقنة أفضل من لقطة طويلة مهتزة: غالبا ثلاث لقطات بطول 20 ثانية أفضل من «دقيقة» واحدة.
- كن محددا: الوصف الغامض ينتج نتائج عشوائية؛ حدد الإضاءة والمزاج وزاوية الكاميرا.
القيمة ليست في «اكتب جملة فتحصل على فيلم»، بل في التخطيط الجيد ثم بناء مشاهد متصلة بأدوات الثبات والتمديد.
التسعير
يبيع جوجل الوصول إلى Veo 3.1 عبر بابين مختلفين تماما:
1) الاشتراك الشهري (الأسهل وبلا برمجة):
- Google AI Pro: نحو 20 دولارا شهريا، يشمل Veo في تطبيق Gemini والوصول إلى Flow برصيد محدود. مناسب للأفراد والشركات الصغيرة والتجربة الجادة.
- Google AI Ultra: نحو 250 دولارا شهريا، أعلى رصيد في Flow وأوسع وصول، للمحترفين والاستخدام الكثيف.
- (يوجد كذلك اشتراك أدنى «Google AI Plus» أرخص لكنه لا يشمل Flow غالبا.)
2) الدفع بالثانية عبر الواجهة البرمجية / Vertex AI (للمنتجات والإنتاج بحجم كبير):
- Veo 3.1: نحو 0.40 دولار لكل ثانية من الفيديو.
- Veo 3.1 Fast (أسرع وأرخص): نحو 0.15 دولار لكل ثانية.
- مثال: مقطع 8 ثوان يكلف نحو 3.2 دولار بالنموذج العادي، ونحو 1.2 دولار بالسريع.
- تذكر جوجل أن سعر Veo 3.1 هو نفسه سعر Veo 3، وقد تختلف الأسعار مع دقة 4K أو حسب المنطقة.
ملاحظة: الأسعار بالدولار الأمريكي وقد تختلف في السعودية حسب العملة وطريقة الوصول، وتتغير بين حين وآخر — تحقق من صفحات جوجل الرسمية قبل الاعتماد عليها (روابطها في «المصادر»).
استخدامات عملية للشركات
لصاحب العمل، القيمة في خفض كلفة وزمن إنتاج الفيديو: إعلانات قصيرة لمنصات التواصل، عروض منتجات، مقاطع تعريفية، محتوى عقاري، ومواد تدريب — كلها صارت ممكنة بأيام بدل أسابيع وبميزانية أقل بكثير من الإنتاج التقليدي.
دور أوريجامي
نحن في أوريجامي شركة تقنية ندمج نماذج مثل Veo 3.1 في سير عمل شركتك: من إعداد الوصف والهوية البصرية الثابتة، إلى ربط التوليد ببرامجك عبر الواجهة البرمجية وأتمتة إنتاج المحتوى بحجم كبير، مع ضبط التكلفة. الهدف نتائج قابلة للنشر، لا مجرد تجارب.
المصادر
- مدونة مطوري جوجل — إطلاق Veo 3.1: developers.googleblog.com
- توثيق Veo في Gemini API (التمديد والإطارات): ai.google.dev/gemini-api/docs/video
- أسعار Gemini API: ai.google.dev/gemini-api/docs/pricing
- خطط Google AI (Pro / Ultra): one.google.com/about/google-ai-plans
- ملاحظة: الميزات والأسعار تتغير بسرعة؛ المصادر الرسمية أعلاه هي المرجع.
الأسئلة الشائعة
كم تبلغ مدة الفيديو في Veo 3.1؟+
المقطع الواحد قصير عادة (نحو 8 ثوان)، لكن بميزة «تمديد المشهد» يمكن الوصول إلى دقيقة أو أكثر. وعبر الواجهة البرمجية يمكن التمديد 7 ثوان في كل مرة وحتى 20 مرة ليصل المجموع إلى نحو 141 ثانية.
كيف أبني فيديو طويلا ومتصلا؟+
خطط المشاهد، وثبت الشخصيات بالصور المرجعية، ثم ولد المقطع الأول واستخدم «تمديد المشهد» أو «الإطار الأخير» لربط اللقطات، واجمعها في أداة Flow في تسلسل واحد بصوت متسق.
كم تكلفة Veo 3.1؟+
بابان: اشتراك شهري (Google AI Pro نحو 20 دولارا، أو Ultra نحو 250 دولارا) وهو الأسهل بلا برمجة؛ أو الدفع بالثانية عبر الواجهة البرمجية (نحو 0.40 دولار للثانية، و0.15 دولار للنموذج السريع) للإنتاج بحجم كبير. الأسعار قابلة للتغير وقد تختلف حسب المنطقة.
هل ينتج Veo 3.1 صوتا مع الفيديو؟+
نعم، يولد صوتا متزامنا أصليا يشمل الحوار والمؤثرات والأصوات المحيطة ضمن نفس عملية التوليد، وهي من أبرز مزايا هذه النسخة.
قيم هذا المقال
مقالات ذات صلة
- الذكاء الاصطناعيالتقنية خلف حكم الفيديو والتسلل شبه الآلي في كأس العالم 2026: درس في أنظمة القرار اللحظيكيف يحسم كأس العالم قرار التسلل في ثوان؟ نفكك تقنية حكم الفيديو والتسلل شبه الآلي، وما تعلمه لكل شركة سعودية عن بناء أنظمة القرار اللحظي.
- الذكاء الاصطناعيChatGPT Work: وكيل OpenAI الجديد الذي ينفّذ مهام عملك الحقيقية — ماذا يعني لأعمالك؟أطلقت OpenAI في 9 يوليو 2026 وكيل ChatGPT Work الذي ينفّذ مهام متعددة الخطوات عبر Slack وGoogle Drive وSalesforce. إليك ماذا يعني لأعمالك وكيف تتبنّاه بأمان.
- الذكاء الاصطناعيالاستماع الاجتماعي وتحليل المشاعر بالذكاء الاصطناعي: كيف تقرأ حديث الجمهور في كأس العالم 2026؟كيف يحول الاستماع الاجتماعي وتحليل المشاعر بالذكاء الاصطناعي ملايين منشورات كأس العالم 2026 إلى قرارات تسويقية وخدمية لعلامتك؟ دليل عملي للشركات السعودية.
- الذكاء الاصطناعيالترجمة الفورية والذكاء الاصطناعي متعدد اللغات: كيف تخدم منشآت السعودية جماهير كأس العالم 2026كيف تخدم عملاءك بكل اللغات خلال كأس العالم 2026؟ جولة عملية في الترجمة الفورية والمساعدين متعددي اللغات بالذكاء الاصطناعي، ودروسها لمنشآت السعودية قبل 2034.
- الذكاء الاصطناعيكيف يصنع الذكاء الاصطناعي مقاطع كأس العالم 2026 في ثوان؟ ودروس أتمتة المحتوى المرئي لأعمالكبعد ثوان من الهدف يصبح المقطع جاهزا ومترجما على وسائل التواصل دون محرر. كيف يرصد الذكاء الاصطناعي اللحظة ويحررها وينشرها، وكيف تؤتمت شركتك محتواها المرئي.
- الذكاء الاصطناعينماذج OpenAI الجديدة GPT-5.6 (سول وتيرا ولونا): ماذا تعني لأعمالك؟أطلقت OpenAI الجيل الجديد GPT-5.6 في ثلاثة نماذج: سول وتيرا ولونا. إليك ماذا يعني هذا التدرج لتكلفة مشاريعك وقدراتها ولاختيار النموذج المناسب لكل مهمة.
النشرة الأسبوعية
أحدث المقالات التي تهم صاحب العمل، مرة كل أسبوع. بريدك فقط.
تبحث عن حل برمجي لعملك؟
في أوريجامي نبني أنظمة ومواقع ومتاجر مخصصة تناسب طبيعة عملك. تواصل معنا ونوريك كيف نقدر نساعدك.
