
تغيّر الجواب منذ كُتبت هذه المقارنة أول مرة. فقد أعلنت OpenAI في 24 مارس 2026 أنها ستوقف Sora. وأُغلق تطبيق Sora وموقعه في 26 أبريل 2026، ثم أُوقفت نماذج Sora 2 وواجهة Videos API في 24 سبتمبر 2026. لذلك لم يعد السؤال العملي اليوم «Veo 3.1 أم Sora 2؟»، بل «ماذا كان Sora 2 يقدّم، وكم من ذلك يغطيه Veo 3.1؟»
باختصار: يضاهي Veo 3.1 جوهر Sora 2، أي توليد الفيديو والصوت معًا من نص أو صورة، ويقدّم تحكّمًا أكبر في كل لقطة على حدة: إطار بداية، وإطار نهاية اختياري، وما يصل إلى ثلاث صور مرجعية، ومخرجات تصل إلى 4K. أما ما لا يعوّضه فهو مقاطع Sora المنفردة الأطول (من 15 إلى 25 ثانية) وميزة Cameo التي تتيح لك إدخال نفسك في المشهد. للاطلاع على التسلسل الزمني الكامل للإغلاق، راجع إغلاق Sora 2.
Veo 3.1 مقابل Sora 2: المواصفات جنبًا إلى جنب
أرقام Veo 3.1 مأخوذة من وثائق Gemini API من Google؛ وأرقام Sora 2 مأخوذة من صفحات نماذج OpenAI وتحديث المنتج الذي أصدرته في أكتوبر 2025. رُوجعت كلها في 28 سبتمبر 2026.
| Veo 3.1 (Google DeepMind) | Sora 2 (OpenAI) | |
|---|---|---|
| الإصدار | 15 أكتوبر 2025 (حُدّث في يناير 2026) | 30 سبتمبر 2025 |
| الحالة | متاح: تطبيق Gemini و Flow و Gemini API و Vertex AI | أُغلق التطبيق في 26 أبريل 2026؛ وأُغلقت الواجهة البرمجية في 24 سبتمبر 2026 |
| صوت أصلي | نعم: مؤثرات وأجواء وحوار؛ مفعّل دائمًا | نعم: حوار ومؤثرات صوتية |
| طول المقطع | 4 أو 6 أو 8 ثوانٍ | حتى 15 ثانية في التطبيق لجميع المستخدمين؛ 25 ثانية لـ Pro على الويب |
| تسلسلات أطول | التمديد: +7 ثوانٍ في كل خطوة، حتى نحو 148 ثانية بدقة 720p | — (كانت Storyboards لتخطيط اللقطات) |
| الدقة | 720p و 1080p و 4K | 720p (sora-2)؛ حتى 1080p (sora-2-pro) |
| نسب العرض | 16:9 و 9:16 | أفقي وعمودي |
| معدل الإطارات | 24 إطارًا في الثانية | — |
| تحويل الصورة إلى فيديو | نعم | نعم |
| الإطاران الأول والأخير | نعم | غير متاح |
| المراجع | حتى 3 صور مرجعية | Cameos (هيئة مسجّلة) |
| فئات النموذج | Veo 3.1 و Fast و Lite | Sora 2 و Sora 2 Pro |
تصف Google مخرجات Veo 3.1 بدقة 1080p و 4K بأنها مُكبَّرة، لذا من الأفضل التعامل مع 4K على أنها صيغة تسليم، لا دليلًا على تفاصيل إضافية مولَّدة.
الصوت والحوار
كان الصوت العنوان الأبرز للنموذجين. أطلقت OpenAI نموذج Sora 2 مع حوار ومؤثرات صوتية متزامنة؛ وتقول Google إن Veo 3.1 يولّد المؤثرات الصوتية وضوضاء الأجواء والحوار بشكل أصلي، والصوت في Gemini API مفعّل دائمًا.
لم تنشر أيّ من الشركتين مقارنة صوتية متكافئة، لذا تعامل بحذر مع الادعاءات بأن مزامنة الشفاه في أحد النموذجين أفضل بوضوح. أما ما يساعد فعلًا مع Veo 3.1 فهو كتابة الصوت في الوصف: الأجواء، والمؤثر الأساسي، وكل عبارة بين علامتي تنصيص. المقطع الذي مدته 8 ثوانٍ يتّسع لسطر أو سطرين من الحوار.
الواقعية والحركة الفيزيائية
جعلت OpenAI الواقعية الفيزيائية السمة المميزة لـ Sora 2، بأمثلة مثل كرة سلة تخطئ الهدف فترتدّ عن اللوحة بدل أن تقفز فجأة إلى داخل الحلقة. أما ما تقوله Google عن Veo 3.1 فهو «التزام محسّن بالوصف» وملامس أكثر واقعية مما في Veo 3. وكلا الأمرين تموضع تسويقي من الشركة، لا اختبار مضبوط.
بالنسبة إلى عملك، فالاختبار المفيد هو مشهد يهمّك: تلامس جسدي، أو أجسام تسقط، أو سائل، أو شخصان يتفاعلان. ولّده، ثم شاهده بملء الشاشة وابحث عن أيدٍ تخترق الأجسام، أو أقدام تنزلق، أو أشياء يتغيّر حجمها.
طول المقطع والقصص الأطول
كانت هذه أوضح نقاط تفوّق Sora 2. فقد كان بوسع الجميع توليد مقاطع مدتها 15 ثانية في التطبيق، وكان بوسع مستخدمي Pro الوصول إلى 25 ثانية على الويب، مع Storyboards لتخطيط المقطع لقطةً لقطة.
يولّد Veo 3.1 حتى 8 ثوانٍ في المرة الواحدة. ويمكن لواجهة Google البرمجية و Flow تمديد المقطع بخطوات من 7 ثوانٍ (بدقة 720p)، لكن الطريق الأبسط عادةً هو تخطيط سلسلة من اللقطات القصيرة وجمعها في المونتاج. إذا كنت قادمًا من Sora، فأعد كتابة الأوصاف الطويلة على شكل قائمة لقطات، لكل منها حدث رئيسي واحد وحركة كاميرا واحدة.
التحكّم في اللقطة
هنا يمنحك Veo 3.1 أدوات أكثر:
- تحويل الصورة إلى فيديو: ابدأ من صورتك الثابتة لتثبيت التأطير والموضوع والأسلوب.
- الإطاران الأول والأخير: أضف صورة نهاية، وسيبني Veo 3.1 الحركة بين الصورتين.
- الصور المرجعية: ما يصل إلى ثلاث صور لشخصية أو منتج أو مكان للحفاظ على ثباته عبر مقاطع منفصلة.
أما المقابل في Sora 2 فكان Cameos، وكانت تهدف إلى إدخال شخص مسجّل في المشهد، لا إلى تثبيت التكوين. إذا كان عملك في Sora يعتمد على Cameos لنفسك، فلا يوجد ما يقابلها مباشرة في Veo 3.1، كما أن فلاتر الأمان لدى Google تقيّد توليد أشخاص حقيقيين من صورهم.
أيّهما يناسبك الآن؟
بما أن Sora 2 لم يعد متاحًا، فالقرار يتعلق بما تستخدمه بديلًا عنه:
- كنت تصنع مقاطع قصيرة مع صوت للشبكات الاجتماعية في Sora: يغطي Veo 3.1 ذلك مباشرة. استخدم نسبة 9:16 لـ Shorts و Reels و TikTok.
- كنت تعتمد على لقطات منفردة من 15 إلى 25 ثانية: خطّط لها على شكل عدة لقطات من Veo 3.1 مدة كل منها 8 ثوانٍ، أو استخدم نموذجًا يولّد مقاطع أطول دفعة واحدة.
- تحتاج إلى شخصيات أو منتجات ثابتة عبر اللقطات: إطار البداية والصور المرجعية في Veo 3.1 هما الأداة الأفضل.
- كنت تستخدم Cameos لنفسك: لا يوجد بديل مكافئ في Veo 3.1.
تجربة Veo 3.1 هنا
يشغّل Veo Video فئات Veo 3.1 الثلاث. كل عملية توليد تنتج مقطعًا مدته 8 ثوانٍ مع الصوت، بنسبة 16:9 أو 9:16، وبدقة 720p أو 1080p أو 4K، انطلاقًا من نص أو من صورة مع إطار نهاية اختياري؛ ويقبل Veo 3.1 Fast أيضًا ما يصل إلى ثلاث صور مرجعية. أما التمديد والمدد التي تبلغ 4 أو 6 ثوانٍ فغير متاحة هنا.
تحصل الحسابات الجديدة على 30 رصيدًا، تكفي لمقطع واحد من Veo 3.1 Lite بدقة 720p، فتستطيع اختبار أحد أوصافك القديمة من Sora أولًا. واستخدم Veo 3.1 للقطات بالجودة النهائية. وللّقطات المنفردة الأطول، يشغّل مولّد الفيديو بالذكاء الاصطناعي أيضًا MiniMax H3 Max.
مقالات ذات صلة: Veo 3.1 مقابل Grok Imagine و Veo 3.1 مقابل Kling AI.
