Loading

Grok Imagine — مولّد فيديو بالذكاء الاصطناعي

أنشئ مقاطع فيديو ذكاء اصطناعي مميزة بمحرك Aurora من xAI داخل Grok Imagine

Grok Imagine هو نموذج توليد الفيديو من xAI، ويعتمد على محرك Aurora ذاتي الانحدار، وقد دُرِّب على حاسوب Colossus العملاق باستخدام 110,000 وحدة NVIDIA GB200. ينشئ مقاطع مدتها 6 أو 10 ثوانٍ بدقة 480p أو 720p مع صوت مدمج، ويدعم تحويل النص والصورة إلى فيديو. كما يوفّر أنماط Fun وNormal وSpicy لتغيير الطابع الإبداعي للموجِّه بنقرة واحدة.

أصبح Grok Imagine 1.0 متاحاً للجميع في 2 فبراير 2026، بعد طرح نسخة معاينة في 2025. يعتمد النموذج على Aurora، وهي معمارية ذاتية الانحدار من xAI تتنبأ بالإطارات بالتتابع، بخلاف النماذج القائمة على الانتشار. جرى التدريب على حاسوب Colossus العملاق باستخدام 110,000 وحدة NVIDIA GB200، وهي من أضخم البنى التي استُخدمت حتى الآن لتدريب نماذج فيديو الذكاء الاصطناعي. وقد أنشأت المنصة العامة أكثر من 1.245 مليار فيديو خلال فترة واحدة مدتها 30 يوماً.

يقدّم LoveGen AI وضعَين للإدخال. يقبل وضع النص إلى فيديو موجّهات يصل طولها إلى 2,000 حرف، ويدعم خمس نسب أبعاد: 16:9 و9:16 و1:1 و3:2 و2:3، لتغطية التنسيقات الأفقية والعمودية والمربعة والتصويرية الكلاسيكية. أما وضع الصورة إلى فيديو فيحرّك صورة مرجعية واحدة (JPG أو JPEG أو PNG أو WebP، حتى 20 ميغابايت) وفقاً للموجّه. يولّد الوضعان الفيديو بمعدل 24 إطاراً في الثانية، ولمدة 6 أو 10 ثوانٍ، وبدقة تصل إلى 720p.

أبرز ما يميّز النموذج هو اختيار الأسلوب. يقدّم Normal نتيجة متوازنة تلتزم بالموجّه، ويفضّل Fun التفسيرات المرحة والمبالغ فيها والإبداعية، بينما يمنح Spicy النتيجة طابعاً أكثر جرأة ودراما. ينشئ Aurora الحوار المتزامن مع حركة الشفاه والموسيقى التصويرية والأصوات المحيطة مع الفيديو في عملية واحدة، من دون حاجة إلى معالجة لاحقة منفصلة. في 2 مارس 2026 أطلقت xAI ميزة Extend from Frame، التي تصل المقاطع باستخدام آخر إطار من أحدها كبداية للمقطع التالي. يستغرق إنشاء مقطع مكتمل مدته 6 أو 10 ثوانٍ نحو 30 ثانية في المتوسط. يعمل التوليد بشكل غير متزامن في LoveGen AI: بعد إرسال المهمة سيظهر الفيديو في معرضك، حيث يمكنك معاينته وتنزيله ومقارنته مباشرةً بنتائج Sora 2 وVeo 3.1 وSeedance 2.0 وHappy Horse 1.0.

كيفية استخدام Grok Imagine

01

الخطوة 1: اختر نص إلى فيديو أو صورة إلى فيديو

بدِّل بين النص إلى فيديو للتوليد بالموجِّه فقط، أو الصورة إلى فيديو لتحريك صورة مرجعية ترفعها.

02

الخطوة 2: اختر إعداداتك

حدِّد المدة (6 ث أو 10 ث)، الدقة (480p أو 720p)، نسبة الأبعاد (T2V فقط)، ونمط الأسلوب (Fun أو Normal).

03

الخطوة 3: التوليد والتنزيل

انقر على «توليد». ينشئ Aurora مقطعاً مكتملاً بصوت مدمج في نحو 30 ثانية. يمكنك بعد ذلك معاينته أو تنزيله أو مقارنته جنباً إلى جنب بنتائج نماذج أخرى في معرضك.

المواصفات التقنية لـ Grok Imagine

المزوِّدxAI
المحركAurora — تنبؤ ذاتي الانحدار بالإطارات
أحدث إصدارGrok Imagine 1.0 (الإتاحة العامة في 2 فبراير 2026)
بنية التدريبحاسوب Colossus العملاق، 110,000 وحدة NVIDIA GB200
أوضاع الإدخالنص إلى فيديو، صورة إلى فيديو
أنماط الأسلوبFun, Normal, Spicy
مدة الفيديو6 أو 10 ثوانٍ (وتقدّم xAI أيضاً 15 ثانية عبر Extend from Frame)
الدقة480p, 720p
معدل الإطارات24 fps
نسب الأبعاد (T2V)16:9, 9:16, 1:1, 3:2, 2:3
إدخال الصورة (I2V)صورة واحدة — JPG / JPEG / PNG / WebP، حتى 20 ميغابايت
الصوتمدمج — حوار (مع تزامن الشفاه)، موسيقى تصويرية ومؤثرات صوتية
سرعة التوليدنحو 30 ثانية في المتوسط لكل مقطع
صلاحية النتيجةتظل روابط الفيديو المُولَّد صالحة لمدة 24 ساعة بعد الانتهاء

لماذا تختار Grok Imagine

محرك Aurora ذاتي الانحدار

يعتمد Grok Imagine على Aurora، نموذج الفيديو ذاتي الانحدار من xAI الذي يعمل إطاراً بإطار ودُرِّب باستخدام 110,000 وحدة NVIDIA GB200. تختلف هذه المقاربة جوهرياً عن النماذج القائمة على الانتشار، وهي من أسباب تميّز الحركة في نتائجه.

ثلاثة أنماط أسلوب جاهزة

Fun وNormal وSpicy تتيح ضبط النبرة الإبداعية دون إعادة كتابة الموجِّه. تقدّم معظم نماذج الفيديو مظهراً واحداً؛ بينما يمنحك Grok Imagine ثلاثة من المدخل نفسه.

صوت مدمج في عملية واحدة

يُنشئ النموذج الحوار المتزامن مع حركة الشفاه والأصوات المحيطة والموسيقى التصويرية مع الفيديو، من دون مرحلة صوت منفصلة أو مشكلات في التزامن.

مقارنة Grok Imagine بمولّدات الفيديو الأخرى بالذكاء الاصطناعي

FeatureGrok ImagineSora 2Veo 3.1Seedance 2.0
المزوِّدxAIOpenAIGoogle DeepMindByteDance
المعماريةAurora (توليدي تتابعي)انتشارانتشارانتشار
أقصى دقة720p1080p1080p1080p
خيارات المدة6 ث، 10 ث (15 ث عبر Extend)4s, 8s, 12s4s, 6s, 8s4-15s
أنماط الأسلوبFun, Normal, Spicyوضع واحدوضع واحدوضع واحد
إدخال الصورةصورة 1 (I2V)صورة 1 + Cameosحتى 3 صور1–2 صور
نسب الأبعاد (T2V)16:9, 9:16, 1:1, 3:2, 2:316:9, 9:16, 1:1, 3:2, 2:316:9, 9:1616:9، 9:16، 1:1، +4 أخرى
صوت مدمجنعمنعمنعمنعم
متوسط سرعة التوليد~30s~60s~45s~40s

مثالي للمبدعين والمسوّقين ورواة القصص

01

مقاطع وسائل التواصل

أنشئ مقاطع قصيرة مدتها 6 أو 10 ثوانٍ بنسبة 9:16 أو 1:1 لمنصات TikTok وReels وShorts. اختر وضع Fun لإنشاء محتوى حيوي يجذب الانتباه في موجز المنشورات، مع صوت مدمج.

02

تحريك الصور

ارفع صورة فوتوغرافية أو رسماً موجوداً وحوِّله إلى تسلسل متحرك — مثالي لصور المنتجات وفنون الشخصيات ولقطات ما وراء الكواليس.

03

لوحات الأفكار

أنشئ بسرعة عدة نسخ أسلوبية للمشهد نفسه بدقة 480p، ثبِّت الاتجاه الذي يعجبك، ثم أعد التصيير بدقة 720p — مثالي للعصف الذهني والعروض.

04

إعلانات وعروض ترويجية

استخدم التنسيق الأفقي 16:9 للمواضع البارزة، والتنسيق العمودي 9:16 للقنوات المخصّصة للهاتف. يتيح لك مفتاح الأسلوب ضبط نبرة العلامة — مرحة أو متزنة — من دون إعادة كتابة الموجِّه.

05

اللوحات القصصية

صوِّر إيقاعات السيناريو بسرعة كمقاطع 6 ثوانٍ مع حوار متزامن. كرِّر التأطير والحركة قبل الالتزام بنموذج أطول.

06

المحتوى التعليمي

حوّل الرسوم البيانية والصور والرسوم التوضيحية للمفاهيم إلى مقاطع قصيرة جذابة مع تعليق صوتي مولّد تلقائياً، لتحافظ على انتباه المشاهدين أكثر من الشرائح الثابتة.

استكشف مولّدات فيديو ذكاء اصطناعي ذات صلة

الأسئلة الشائعة حول Grok Imagine

ما هو Grok Imagine؟

Grok Imagine هو نموذج توليد الفيديو من xAI، ويعتمد على محرك Aurora ذاتي الانحدار، وقد دُرِّب على حاسوب Colossus العملاق باستخدام 110,000 وحدة NVIDIA GB200. يدعم تحويل النص والصورة إلى فيديو، ويوفّر أنماط Fun وNormal وSpicy لتغيير الطابع الإبداعي للموجِّه.

متى صدر Grok Imagine؟

أُطلق Grok Imagine كنسخة أولية في 2025، ووصل إلى الإصدار 1.0 بإتاحة عامة في 2 فبراير 2026. تواصل xAI إصدار التحديثات — وآخرها Extend from Frame في 2 مارس 2026، الذي يربط المقاطع لتسلسلات تصل إلى 15 ثانية لكل مقطع مرتبط.

ما المدد والدقات المدعومة؟

يولِّد Grok Imagine مقاطع 6 أو 10 ثوانٍ بدقة 480p أو 720p بمعدل 24 إطاراً/ثانية. متوسط زمن التوليد نحو 30 ثانية لكل مقطع.

ما نسب الأبعاد المتاحة؟

النص إلى فيديو يدعم 16:9 و9:16 و1:1 و3:2 و2:3 — تغطي الأطر الأفقية والعمودية والمربعة وتأطيرات التصوير الكلاسيكية. الصورة إلى فيديو يحافظ على نسبة الأبعاد للصورة المرجعية التي ترفعها.

ما الفرق بين أنماط Fun وNormal وSpicy؟

النمط Normal ينتج نتائج متوازنة ووفية. النمط Fun يميل إلى تفسيرات مرحة ومبالغ فيها وإبداعية. النمط Spicy يفتح إخراجاً أكثر جرأة ودراما. قد يُنتج الموجِّه نفسه في أوضاع مختلفة أجواءً سينمائية متباينة بشكل ملحوظ.

هل يولِّد Grok Imagine صوتاً؟

نعم. ينشئ Aurora الحوار المتزامن مع حركة الشفاه والموسيقى التصويرية والأصوات المحيطة مع الفيديو في عملية توليد واحدة، من دون حاجة إلى معالجة لاحقة منفصلة.