
Grok Imagine — مولّد فيديو بالذكاء الاصطناعي
أنشئ مقاطع فيديو ذكاء اصطناعي مميزة بمحرك Aurora من xAI داخل Grok Imagine
Grok Imagine هو نموذج توليد الفيديو من xAI، ويعتمد على محرك Aurora ذاتي الانحدار، وقد دُرِّب على حاسوب Colossus العملاق باستخدام 110,000 وحدة NVIDIA GB200. ينشئ مقاطع مدتها 6 أو 10 ثوانٍ بدقة 480p أو 720p مع صوت مدمج، ويدعم تحويل النص والصورة إلى فيديو. كما يوفّر أنماط Fun وNormal وSpicy لتغيير الطابع الإبداعي للموجِّه بنقرة واحدة.
أصبح Grok Imagine 1.0 متاحاً للجميع في 2 فبراير 2026، بعد طرح نسخة معاينة في 2025. يعتمد النموذج على Aurora، وهي معمارية ذاتية الانحدار من xAI تتنبأ بالإطارات بالتتابع، بخلاف النماذج القائمة على الانتشار. جرى التدريب على حاسوب Colossus العملاق باستخدام 110,000 وحدة NVIDIA GB200، وهي من أضخم البنى التي استُخدمت حتى الآن لتدريب نماذج فيديو الذكاء الاصطناعي. وقد أنشأت المنصة العامة أكثر من 1.245 مليار فيديو خلال فترة واحدة مدتها 30 يوماً.
يقدّم LoveGen AI وضعَين للإدخال. يقبل وضع النص إلى فيديو موجّهات يصل طولها إلى 2,000 حرف، ويدعم خمس نسب أبعاد: 16:9 و9:16 و1:1 و3:2 و2:3، لتغطية التنسيقات الأفقية والعمودية والمربعة والتصويرية الكلاسيكية. أما وضع الصورة إلى فيديو فيحرّك صورة مرجعية واحدة (JPG أو JPEG أو PNG أو WebP، حتى 20 ميغابايت) وفقاً للموجّه. يولّد الوضعان الفيديو بمعدل 24 إطاراً في الثانية، ولمدة 6 أو 10 ثوانٍ، وبدقة تصل إلى 720p.
أبرز ما يميّز النموذج هو اختيار الأسلوب. يقدّم Normal نتيجة متوازنة تلتزم بالموجّه، ويفضّل Fun التفسيرات المرحة والمبالغ فيها والإبداعية، بينما يمنح Spicy النتيجة طابعاً أكثر جرأة ودراما. ينشئ Aurora الحوار المتزامن مع حركة الشفاه والموسيقى التصويرية والأصوات المحيطة مع الفيديو في عملية واحدة، من دون حاجة إلى معالجة لاحقة منفصلة. في 2 مارس 2026 أطلقت xAI ميزة Extend from Frame، التي تصل المقاطع باستخدام آخر إطار من أحدها كبداية للمقطع التالي. يستغرق إنشاء مقطع مكتمل مدته 6 أو 10 ثوانٍ نحو 30 ثانية في المتوسط. يعمل التوليد بشكل غير متزامن في LoveGen AI: بعد إرسال المهمة سيظهر الفيديو في معرضك، حيث يمكنك معاينته وتنزيله ومقارنته مباشرةً بنتائج Sora 2 وVeo 3.1 وSeedance 2.0 وHappy Horse 1.0.
كيفية استخدام Grok Imagine
الخطوة 1: اختر نص إلى فيديو أو صورة إلى فيديو
بدِّل بين النص إلى فيديو للتوليد بالموجِّه فقط، أو الصورة إلى فيديو لتحريك صورة مرجعية ترفعها.
الخطوة 2: اختر إعداداتك
حدِّد المدة (6 ث أو 10 ث)، الدقة (480p أو 720p)، نسبة الأبعاد (T2V فقط)، ونمط الأسلوب (Fun أو Normal).
الخطوة 3: التوليد والتنزيل
انقر على «توليد». ينشئ Aurora مقطعاً مكتملاً بصوت مدمج في نحو 30 ثانية. يمكنك بعد ذلك معاينته أو تنزيله أو مقارنته جنباً إلى جنب بنتائج نماذج أخرى في معرضك.
المواصفات التقنية لـ Grok Imagine
| المزوِّد | xAI |
| المحرك | Aurora — تنبؤ ذاتي الانحدار بالإطارات |
| أحدث إصدار | Grok Imagine 1.0 (الإتاحة العامة في 2 فبراير 2026) |
| بنية التدريب | حاسوب Colossus العملاق، 110,000 وحدة NVIDIA GB200 |
| أوضاع الإدخال | نص إلى فيديو، صورة إلى فيديو |
| أنماط الأسلوب | Fun, Normal, Spicy |
| مدة الفيديو | 6 أو 10 ثوانٍ (وتقدّم xAI أيضاً 15 ثانية عبر Extend from Frame) |
| الدقة | 480p, 720p |
| معدل الإطارات | 24 fps |
| نسب الأبعاد (T2V) | 16:9, 9:16, 1:1, 3:2, 2:3 |
| إدخال الصورة (I2V) | صورة واحدة — JPG / JPEG / PNG / WebP، حتى 20 ميغابايت |
| الصوت | مدمج — حوار (مع تزامن الشفاه)، موسيقى تصويرية ومؤثرات صوتية |
| سرعة التوليد | نحو 30 ثانية في المتوسط لكل مقطع |
| صلاحية النتيجة | تظل روابط الفيديو المُولَّد صالحة لمدة 24 ساعة بعد الانتهاء |
لماذا تختار Grok Imagine
محرك Aurora ذاتي الانحدار
يعتمد Grok Imagine على Aurora، نموذج الفيديو ذاتي الانحدار من xAI الذي يعمل إطاراً بإطار ودُرِّب باستخدام 110,000 وحدة NVIDIA GB200. تختلف هذه المقاربة جوهرياً عن النماذج القائمة على الانتشار، وهي من أسباب تميّز الحركة في نتائجه.
ثلاثة أنماط أسلوب جاهزة
Fun وNormal وSpicy تتيح ضبط النبرة الإبداعية دون إعادة كتابة الموجِّه. تقدّم معظم نماذج الفيديو مظهراً واحداً؛ بينما يمنحك Grok Imagine ثلاثة من المدخل نفسه.
صوت مدمج في عملية واحدة
يُنشئ النموذج الحوار المتزامن مع حركة الشفاه والأصوات المحيطة والموسيقى التصويرية مع الفيديو، من دون مرحلة صوت منفصلة أو مشكلات في التزامن.
مقارنة Grok Imagine بمولّدات الفيديو الأخرى بالذكاء الاصطناعي
| Feature | Grok Imagine | Sora 2 | Veo 3.1 | Seedance 2.0 |
|---|---|---|---|---|
| المزوِّد | xAI | OpenAI | Google DeepMind | ByteDance |
| المعمارية | Aurora (توليدي تتابعي) | انتشار | انتشار | انتشار |
| أقصى دقة | 720p | 1080p | 1080p | 1080p |
| خيارات المدة | 6 ث، 10 ث (15 ث عبر Extend) | 4s, 8s, 12s | 4s, 6s, 8s | 4-15s |
| أنماط الأسلوب | Fun, Normal, Spicy | وضع واحد | وضع واحد | وضع واحد |
| إدخال الصورة | صورة 1 (I2V) | صورة 1 + Cameos | حتى 3 صور | 1–2 صور |
| نسب الأبعاد (T2V) | 16:9, 9:16, 1:1, 3:2, 2:3 | 16:9, 9:16, 1:1, 3:2, 2:3 | 16:9, 9:16 | 16:9، 9:16، 1:1، +4 أخرى |
| صوت مدمج | نعم | نعم | نعم | نعم |
| متوسط سرعة التوليد | ~30s | ~60s | ~45s | ~40s |
مثالي للمبدعين والمسوّقين ورواة القصص
مقاطع وسائل التواصل
أنشئ مقاطع قصيرة مدتها 6 أو 10 ثوانٍ بنسبة 9:16 أو 1:1 لمنصات TikTok وReels وShorts. اختر وضع Fun لإنشاء محتوى حيوي يجذب الانتباه في موجز المنشورات، مع صوت مدمج.
تحريك الصور
ارفع صورة فوتوغرافية أو رسماً موجوداً وحوِّله إلى تسلسل متحرك — مثالي لصور المنتجات وفنون الشخصيات ولقطات ما وراء الكواليس.
لوحات الأفكار
أنشئ بسرعة عدة نسخ أسلوبية للمشهد نفسه بدقة 480p، ثبِّت الاتجاه الذي يعجبك، ثم أعد التصيير بدقة 720p — مثالي للعصف الذهني والعروض.
إعلانات وعروض ترويجية
استخدم التنسيق الأفقي 16:9 للمواضع البارزة، والتنسيق العمودي 9:16 للقنوات المخصّصة للهاتف. يتيح لك مفتاح الأسلوب ضبط نبرة العلامة — مرحة أو متزنة — من دون إعادة كتابة الموجِّه.
اللوحات القصصية
صوِّر إيقاعات السيناريو بسرعة كمقاطع 6 ثوانٍ مع حوار متزامن. كرِّر التأطير والحركة قبل الالتزام بنموذج أطول.
المحتوى التعليمي
حوّل الرسوم البيانية والصور والرسوم التوضيحية للمفاهيم إلى مقاطع قصيرة جذابة مع تعليق صوتي مولّد تلقائياً، لتحافظ على انتباه المشاهدين أكثر من الشرائح الثابتة.
استكشف مولّدات فيديو ذكاء اصطناعي ذات صلة

Sora 2
مولِّد فيديو سينمائي من OpenAI بحركة دقيقة فيزيائياً ومدة 20 ثانية.

Veo 3.1
نموذج فيديو 1080p من Google DeepMind مع تحويل الإطارات إلى فيديو وتوليد الصوت.

Seedance 2.0
نموذج فيديو من ByteDance مع تكامل البحث على الويب وصوت متزامن.
Happy Horse 1.0
نموذج Alibaba رقم 1 بجودة حركة سينمائية وتزامن شفاه بسبع لغات.
Kling 2.5 Turbo
مولّد فيديو 1080p سريع من Kuaishou، محسَّن للسرعة وكفاءة التكلفة.

Veo 4
نموذج فيديو الجيل التالي من Google مع رفع دقة 4K وصوت مكاني.
الأسئلة الشائعة حول Grok Imagine
ما هو Grok Imagine؟
Grok Imagine هو نموذج توليد الفيديو من xAI، ويعتمد على محرك Aurora ذاتي الانحدار، وقد دُرِّب على حاسوب Colossus العملاق باستخدام 110,000 وحدة NVIDIA GB200. يدعم تحويل النص والصورة إلى فيديو، ويوفّر أنماط Fun وNormal وSpicy لتغيير الطابع الإبداعي للموجِّه.
متى صدر Grok Imagine؟
أُطلق Grok Imagine كنسخة أولية في 2025، ووصل إلى الإصدار 1.0 بإتاحة عامة في 2 فبراير 2026. تواصل xAI إصدار التحديثات — وآخرها Extend from Frame في 2 مارس 2026، الذي يربط المقاطع لتسلسلات تصل إلى 15 ثانية لكل مقطع مرتبط.
ما المدد والدقات المدعومة؟
يولِّد Grok Imagine مقاطع 6 أو 10 ثوانٍ بدقة 480p أو 720p بمعدل 24 إطاراً/ثانية. متوسط زمن التوليد نحو 30 ثانية لكل مقطع.
ما نسب الأبعاد المتاحة؟
النص إلى فيديو يدعم 16:9 و9:16 و1:1 و3:2 و2:3 — تغطي الأطر الأفقية والعمودية والمربعة وتأطيرات التصوير الكلاسيكية. الصورة إلى فيديو يحافظ على نسبة الأبعاد للصورة المرجعية التي ترفعها.
ما الفرق بين أنماط Fun وNormal وSpicy؟
النمط Normal ينتج نتائج متوازنة ووفية. النمط Fun يميل إلى تفسيرات مرحة ومبالغ فيها وإبداعية. النمط Spicy يفتح إخراجاً أكثر جرأة ودراما. قد يُنتج الموجِّه نفسه في أوضاع مختلفة أجواءً سينمائية متباينة بشكل ملحوظ.
هل يولِّد Grok Imagine صوتاً؟
نعم. ينشئ Aurora الحوار المتزامن مع حركة الشفاه والموسيقى التصويرية والأصوات المحيطة مع الفيديو في عملية توليد واحدة، من دون حاجة إلى معالجة لاحقة منفصلة.