
Grok Imagine AI-Videogenerator
Lav stiliserede AI-videoer med xAI's Aurora-motor i Grok Imagine
Grok Imagine er xAI's videogenereringsmodel, drevet af den autoregressive Aurora-motor og trænet på Colossus-supercomputeren med 110.000 NVIDIA GB200-GPU'er. Den genererer 6- eller 10-sekunders klip i 480p eller 720p med integreret lyd, understøtter tekst-til-video og billede-til-video og tilbyder tre tydelige stiltilstande — Fun, Normal og Spicy — så du kan ændre en prompts kreative udtryk med ét klik.
Grok Imagine 1.0 blev gjort generelt tilgængelig den 2. februar 2026 efter en forhåndsvisning i 2025. Modellen bygger på Aurora, xAI's autoregressive arkitektur til forudsigelse af billeder. I modsætning til diffusionsmodeller opbygger Aurora videosekvensen trin for trin. Træningen blev gennemført på Colossus-supercomputeren med 110.000 NVIDIA GB200-GPU'er — en af de største træningsplatforme til AI-video hidtil. Den offentlige platform har allerede skabt mere end 1,245 milliarder videoer i løbet af en periode på 30 dage.
LoveGen AI tilbyder to inputtilstande. Tekst-til-video tager imod prompts på op til 2.000 tegn og understøtter fem billedformater: 16:9, 9:16, 1:1, 3:2 og 2:3. De dækker liggende, stående, kvadratiske og klassiske fotografiske formater. Billede-til-video animerer ét referencebillede (JPG, JPEG, PNG eller WebP, op til 20 MB) ud fra din prompt. Begge tilstande genererer med 24 fps, en længde på 6 eller 10 sekunder og en opløsning på op til 720p.
Valget af stiltilstand er modellens tydeligste særkende. Normal giver et afbalanceret resultat, der følger prompten tæt. Fun foretrækker legesyge, overdrevne og kreative fortolkninger. Spicy giver et dristigere og mere dramatisk udtryk. Aurora genererer læbesynkroniseret dialog, baggrundsmusik og omgivelseslyde sammen med videoen i én arbejdsgang, så separat efterbehandling ikke er nødvendig. Den 2. marts 2026 udgav xAI Extend from Frame. Funktionen forbinder klip ved at bruge det sidste billede i ét klip som startbillede i det næste. Et færdigt klip på 6 eller 10 sekunder tager i gennemsnit cirka 30 sekunder at generere. Genereringen kører asynkront i LoveGen AI: Når opgaven er sendt, vises videoen i dit galleri, hvor du kan se den, downloade den og sammenligne den direkte med Sora 2, Veo 3.1, Seedance 2.0 og Happy Horse 1.0.
Sådan bruger du Grok Imagine
Trin 1: Vælg Tekst-til-video eller Billede-til-video
Skift mellem tekst-til-video til prompt-baseret generering eller billede-til-video for at animere et uploadet referencebillede.
Trin 2: Vælg dine indstillinger
Vælg længde (6s eller 10s), opløsning (480p eller 720p), billedformat (kun T2V) og stiltilstand (Fun eller Normal).
Trin 3: Generér og download
Klik på »Generér«. Aurora leverer et færdigt klip med integreret lyd på cirka 30 sekunder. Se det, download det, eller sammenlign det side om side med andre modeller i dit galleri.
Grok Imagine tekniske specifikationer
| Udbyder | xAI |
| Motor | Aurora — autoregressiv frame-forudsigelse |
| Seneste version | Grok Imagine 1.0 (generel tilgængelighed 2. februar 2026) |
| Træningsinfrastruktur | Colossus-supercomputer, 110.000 NVIDIA GB200 GPU'er |
| Inputtilstande | Tekst-til-video, Billede-til-video |
| Stiltilstande | Fun, Normal, Spicy |
| Videolængde | 6 eller 10 sekunder (xAI tilbyder også 15s via Extend from Frame) |
| Opløsninger | 480p, 720p |
| Billedhastighed | 24 fps |
| Billedformater (T2V) | 16:9, 9:16, 1:1, 3:2, 2:3 |
| Billedinput (I2V) | 1 billede — JPG / JPEG / PNG / WebP, op til 20 MB |
| Lyd | Integreret — dialog (med læbesynkronisering), baggrundsmusik og lydeffekter |
| Genereringshastighed | ~30 sekunder i gennemsnit pr. klip |
| Resultatets gyldighed | Genererede videolinks forbliver gyldige i 24 timer efter færdiggørelse |
Hvorfor vælge Grok Imagine
Aurora autoregressiv motor
Grok Imagine bygger på Aurora, xAI's autoregressive videomodel, der arbejder billede for billede og er trænet med 110.000 NVIDIA GB200-GPU'er. Tilgangen er grundlæggende anderledes end hos diffusionsbaserede konkurrenter og bidrager til modellens særlige bevægelsesudtryk.
Tre indbyggede stiltilstande
Fun, Normal og Spicy lader dig ændre kreativ tone uden at omskrive prompten. De fleste videomodeller giver ét look; Grok Imagine giver tre fra det samme input.
Integreret lyd i én arbejdsgang
Dialog med læbesynkronisering, omgivelseslyd og baggrundsmusik produceres sammen med videoen — uden en separat lydfase og uden problemer med synkroniseringen.
Grok Imagine sammenlignet med andre AI-videogeneratorer
| Feature | Grok Imagine | Sora 2 | Veo 3.1 | Seedance 2.0 |
|---|---|---|---|---|
| Udbyder | xAI | OpenAI | Google DeepMind | ByteDance |
| Arkitektur | Aurora (autoregressiv) | Diffusion | Diffusion | Diffusion |
| Maks. opløsning | 720p | 1080p | 1080p | 1080p |
| Længdemuligheder | 6s, 10s (15s via Extend) | 4s, 8s, 12s | 4s, 6s, 8s | 4-15s |
| Stiltilstande | Fun, Normal, Spicy | Enkelt tilstand | Enkelt tilstand | Enkelt tilstand |
| Billedinput | 1 billede (I2V) | 1 billede + Cameos | Op til 3 billeder | 1–2 billeder |
| Billedformater (T2V) | 16:9, 9:16, 1:1, 3:2, 2:3 | 16:9, 9:16, 1:1, 3:2, 2:3 | 16:9, 9:16 | 16:9, 9:16, 1:1, +4 flere |
| Integreret lyd | Ja | Ja | Ja | Ja |
| Gns. genereringshastighed | ~30s | ~60s | ~45s | ~40s |
Perfekt til skabere, marketingfolk og fortællere
Sociale medie-klip
Generer korte videoer på 6 eller 10 sekunder i 9:16 eller 1:1 til TikTok, Reels og Shorts. Vælg Fun-tilstanden til energisk indhold, der fanger opmærksomheden i feedet, med integreret lyd.
Billedanimationer
Upload et eksisterende foto eller en illustration og forvandl det til en bevægelig sekvens — perfekt til produktfotos, character art eller behind-the-scenes-billeder.
Konceptboards
Generer hurtigt flere stilistiske versioner af samme scene i 480p, vælg den retning, du foretrækker, og render derefter igen i 720p — ideelt til idéudvikling og præsentationer.
Annoncer og promo'er
Brug liggende 16:9 til fremtrædende placeringer og stående 9:16 til vertikale kanaler. Med stiltilstanden kan du tilpasse udtrykket til brandet — legesygt eller afbalanceret — uden at omskrive prompten.
Storyboarding
Visualiser hurtigt nøglescener fra et manuskript som 6-sekunders klip med synkroniseret dialog. Finjuster kadrering og bevægelse, før du går videre til en model til længere videoer.
Undervisningsindhold
Animer diagrammer, fotos og konceptillustrationer til korte, engagerende klip med automatisk genereret voiceover, der fastholder opmærksomheden bedre end statiske dias.
Udforsk relaterede AI-videogeneratorer

Sora 2
OpenAI's filmiske videogenerator med fysisk præcis bevægelse og 20s varighed.

Veo 3.1
Google DeepMinds 1080p-videomodel med frames-til-video og lydgenerering.

Seedance 2.0
ByteDances videomodel med integreret websøgning og synkroniseret lyd.
Happy Horse 1.0
Alibabas #1-videomodel med filmisk bevægelseskvalitet og læbesynkronisering på 7 sprog.
Kling 2.5 Turbo
Kuaishous hurtige 1080p-videogenerator, optimeret til hastighed og omkostningseffektivitet.

Veo 4
Googles næste generations videomodel med 4K-opskalering og spatial lyd.
Ofte stillede spørgsmål om Grok Imagine
Hvad er Grok Imagine?
Grok Imagine er xAI's videogenererings-model, bygget på den autoregressive Aurora-motor og trænet på Colossus-supercomputeren med 110.000 NVIDIA GB200 GPU'er. Den understøtter tekst-til-video og billede-til-video med tre kreative stiltilstande — Fun, Normal og Spicy — der ændrer tonen i enhver prompt.
Hvornår blev Grok Imagine udgivet?
Grok Imagine startede som preview i 2025 og nåede version 1.0 med generel tilgængelighed den 2. februar 2026. xAI fortsætter med at udgive opdateringer — senest Extend from Frame den 2. marts 2026, der kæder klip sammen til sekvenser på op til 15 sekunder pr. kædet klip.
Hvilke længder og opløsninger understøttes?
Grok Imagine genererer 6 eller 10 sekunders klip i 480p eller 720p, renderet ved 24 fps. Gennemsnitlig genereringstid er omkring 30 sekunder pr. klip.
Hvilke billedformater er tilgængelige?
Tekst-til-video understøtter 16:9, 9:16, 1:1, 3:2 og 2:3 — liggende, stående, kvadratiske og klassiske fotoformater. Billede-til-video bevarer billedformatet på dit uploadede referencebillede.
Hvad er forskellen på Fun, Normal og Spicy?
Normal giver afbalancerede, trofaste resultater. Fun går mod legesyge, overdrevne og kreative fortolkninger. Spicy låser op for dristigere, mere dramatiske resultater. Den samme prompt i forskellige tilstande kan give markant forskellige filmiske stemninger.
Genererer Grok Imagine lyd?
Ja. Aurora genererer læbesynkroniseret dialog, baggrundsmusik og omgivelseslyde sammen med videoen i én arbejdsgang. Der kræves ingen separat efterbehandling.