الترتيب #1 توليد الفيديو المحلي — بطاقتك الرسومية، كرسي المخرج لك
Alibaba Cloud (Tongyi Lab)

Wan 2.7

نموذج الفيديو المفتوح الذي تعلّم التفكير قبل التصوير. Wan 2.7 هو أكبر قفزة لعلي بابا حتى الآن — نموذج Mixture-of-Experts بـ 27 مليار معامل يُخطط لمشهدك، ويُزامن الصوت بشكل أصلي، ويمنحك التحكم في الإطار الأول والأخير. كل ذلك تحت رخصة Apache 2.0. بلا نجوم تحفّظية.

تم التحديث أبريل 2026 Open WeightApache 2.0Text-to-Video
الأفضل لـ

نموذج الفيديو المفتوح الذي تعلّم التفكير قبل التصوير. Wan 2.7 هو أكبر قفزة لعلي بابا حتى الآن — نموذج Mixture-of-Experts بـ 27 مليار معامل يُخطط لمشهدك، ويُزامن الصوت بشكل أصلي، ويمنحك التحكم في الإطار الأول والأخير. كل ذلك تحت رخصة Apache 2.0. بلا نجوم تحفّظية.

لماذا تفوز

وضع التفكير يُخطط لهيكل المشهد قبل التوليد، مما يُقلل انجراف الحركة بشكل كبير. مزامنة صوتية أصلية في مرور واحد. تحكم في الإطار الأول والأخير لانتقالات دقيقة. حتى 9 مدخلات مرجعية متعددة الوسائط لاتساق الشخصيات. تحرير فيديو قائم على التعليمات. بنية 27B MoE. Apache 2.0.

انتبه إلى

وضع التفكير الذي يجعله مميزاً يجعله أيضاً أبطأ. لا واجهة برمجة سحابية رسمية للتسجيل الفوري. حجم 27 مليار معامل يتطلب أجهزة جادة للنشر المحلي. التوثيق لا يزال يركز على اللغة الصينية.

01

ما هو في الواقع

Wan 2.7 هو ما يحدث حين يسأل علي بابا: ماذا لو فكّر الذكاء الاصطناعي في فيديوك قبل صنعه؟

كل إصدار سابق من سلسلة Wan — ومعظم مولّدات الفيديو بالذكاء الاصطناعي عموماً — تعمل بنفس الطريقة: استقبال المطالبة، توليد الفيديو، الأمل في الأفضل. يكسر Wan 2.7 هذا النمط. وضع التفكير يُفسّر مطالبتك، يُخطط لهيكل المشهد والقوس السردي، ويأخذ في الاعتبار التكوين وديناميكية الحركة — ثم يبدأ التصيير. النتيجة أقل نمطية، أقل انجرافاً، أكثر قصدية. الفرق بين مشغّل كاميرا ومخرج.

الأساس التقني هو بنية Mixture-of-Experts بـ 27 مليار معامل مع Diffusion Transformer وFull Attention — مصمم خصيصاً لمعالجة العلاقات المكانية والزمانية في آنٍ واحد.

التحسينات العملية لا تقل أهمية: تحكم في الإطار الأول والأخير للانتقالات الدقيقة، حتى 9 مدخلات مرجعية متعددة الوسائط لاتساق الشخصيات، صوت أصلي في مرور واحد، تحرير قائم على التعليمات دون إعادة توليد من الصفر.

رخصة Apache 2.0 تبقى التزام سلسلة Wan المُحدِّد. بلا قيود. المجتمع الذي جعل Wan 2.1 معيار ComfyUI يُهاجر بالفعل إلى 2.7. النظام البيئي سيتبع — كما فعل دائماً.

02

نقاط القوة والقيود بصراحة

نقاط القوة الرئيسية

  • وضع التفكير — يُخطط قبل التوليد: ابتكار Wan 2.7 المحدِّد. قبل تصيير إطار واحد، يفسر النموذج المطالبة ويُخطط لتكوين المشهد ويهيكل القوس السردي. النتيجة: تكوينات أقل نمطية بكثير، انجراف حركة أقل، أمانة أعلى للنية.
  • تحكم في الإطار الأول والأخير: حدِّد الإطارات الدقيقة لبداية ونهاية مقطعك الفيديوي. تحكم دقيق في الانتقالات ومواضع الشخصيات واستمرارية المشاهد.
  • مزامنة صوتية أصلية: الصوت يُولَّد مع الفيديو في مرور واحد — لا يُضاف لاحقاً. توقيت الحوار والأصوات المحيطة والموسيقى تنبثق كتكوين موحد مع المرئيات.
  • اتساق المرجع حتى 9 مدخلات: حتى 9 صور مرجعية متعددة الوسائط أو مقاطع فيديو لتثبيت هوية الشخصية والنمط والأدوات عبر المشاهد.
  • تحرير فيديو قائم على التعليمات: صِف التغيير المطلوب بلغة طبيعية؛ يُعدّل Wan 2.7 الفيديو الموجود وفقاً لذلك. التحرير دون إعادة توليد من الصفر.
  • Apache 2.0 — بلا قيود فعلية: الاستخدام التجاري، تعديل الأوزان، بناء المنتجات، بيع الإخراج — كل ذلك مسموح دون سقف للإيرادات ودون نسب يتجاوز ملف الترخيص.

قيود صادقة

  • وضع التفكير يُضيف وقت التوليد: مرحلة التخطيط التي تُحسّن النتائج تجعلها أبطأ. إذا كانت السرعة أولوية، LTX Video لا يزال الخيار الأسرع.
  • لا واجهة برمجة سحابية رسمية فورية: التنفيذ المحلي أو نقاط الوصول التي تستضيفها المجتمع (fal.ai, WaveSpeedAI). عائق حقيقي للمستخدمين غير التقنيين.
  • حجم 27 مليار معامل يتطلب أجهزة جادة: النشر المحلي بالجودة الكاملة يحتاج ذاكرة GPU أعلى بكثير من البطاقات الاستهلاكية.
  • توثيق يهيمن عليه الصينية: وثائق رسمية والعديد من الموارد المجتمعية بالصينية أساساً. الأدلة الإنجليزية تتأخر عن التحديثات.
  • مجتمع أصغر من Wan 2.1: نظام ComfyUI لـ Wan 2.1 ضخم. مسارات عمل Wan 2.7 تنمو لكن ليست بنفس الحجم بعد.
03

لمحة عن المعايير

البنية — 27B MoE (40 مليار معامل نشط)

تصميم Mixture-of-Experts بـ ~753 مليار معامل إجمالي، ~40 ملياراً نشطاً لكل رمز. DiT مع Full Attention للمعالجة المكانية والزمانية.

الدقة — حتى 4K

حتى 1080p و4K من الإخراج حسب المنصة ومستوى الحوسبة. مدد مقاطع من 5 إلى 15 ثانية.

سعة المرجع — حتى 9 مدخلات متعددة الوسائط

مجموعات من الصور ومقاطع الفيديو والصوت ومراجع النمط للحفاظ على اتساق الشخصية والأدوات والجماليات عبر المشاهد.

04

الحكم

Wan 2.7 هو اللحظة التي نضج فيها توليد الفيديو مفتوح الأوزان. وضع التفكير ليس خدعة — بل الفرق بين ذكاء اصطناعي يستجيب لمطالبتك وذكاء اصطناعي يُفسّرها. تحكم في الإطار الأول والأخير، صوت أصلي، حتى 9 مدخلات مرجعية، تحرير قائم على التعليمات: قدرات كانت غائبة أو غير موثوقة في النماذج المفتوحة حتى الآن. وكل ذلك تحت Apache 2.0 — تمتلك ما تبنيه به، بالكامل. المقايضة هي التعقيد والحوسبة. لكن للمبدعين الراغبين في التحكم السينمائي دون رسوم اشتراك، Wan 2.7 هو أقوى نموذج فيديو مفتوح الأوزان على الإطلاق.

05

الأسئلة الشائعة