Beskriv tagningen och välj motorn — tretton modeller bakom en enda promptruta, de flesta genererar ljud tillsammans med bilden. Tre gratisutkast om dagen, inget konto.
Inmatning
En prompt. Valfritt en bildlista
Tillgängliga modeller
13, valbart per jobb
Klippets längd
5–30 s i en enda körning
Maxupplösning
Upp till 4K på Kling 3.0
Ljud
Inbyggt i de flesta modeller
Gratis nivå
3 utkast dagligen, inget konto
Typisk tid
30 s till 3 minuter
Vårt omdöme i en mening: det svåraste AI-video gör, och det roligaste. Skriv som en regissör snarare än en beskrivare, skissa gratis tills tagningen fungerar, spendera sedan krediter en enda gång.
Text till video är verktygets renaste form och den minst förlåtande: utan något foto som förankrar komposition, ljus och motiv uppfinner modellen alla tre utifrån din mening. Två saker löser de flesta nedslående resultat. För det första, skriv prompten som en bildlista — kamera, motiv, handling, ljus, ljud, i den ordningen — eftersom dessa modeller belönar regissörsspråk och ignorerar adjektiv. För det andra, sluta anta att en modell gör allt: en scen med klipp, en trettio sekunder lång obruten tagning och en bild som måste kunna passera som verkligt filmat material kräver tre olika motorer. Tabellen nedan vägleder dig; den kostnadsfria nivån innebär att det inte kostar något att ta reda på det.
Tretton motorer, sex jobb som människor faktiskt kommer med. Var och en kan väljas i generatorn ovan — skapa ett utkast gratis först och ta sedan länken.
Realismens riktmärke som varje sommarflaggskepp mätte sig mot, med atmosfär och talad dialog renderade tillsammans med bilden. Åtta sekunder som tål granskning.
Regissörsläget komponerar upp till sex tagningar — inklusive vinklar och klipp — i en enda generering, upp till 4K. Den enda motorn här som redigerar medan den genererar.
Trettio sekunder i en enda körning, med ett tillhandahållet soundtrack som kan styra tempo och läppsynk. Femtio referensfiler om produktionen har ett asset-kit.
Stop-motion, makro, nostalgiskt, avsiktligt märkligt — det undkommer den glansiga standardlooken och fäster upp till tio nyckelbildrutor så att taktslagen landar där du placerar dem.
Tyngd, momentum, vätskeflöden och kollisioner återges övertygande, med sekvenserad kamerakoreografi och 21:9-inramning. Tyst utdata — planera en ljudgenomgång.
Den enda modellen här som läser en PDF, en presentation eller ett kalkylblad och bygger videon utifrån dess innehåll — trettio sekunder, karaktärer och layouter konsekventa med källan.

Kamera, motiv, handling, ljus, ljud — i den ordningen. 'Halvbild, gyllene timmen: en försäljare skär upp en mango, saften fångar solen. Handhållen kamera, omgivande marknadssorl.' Regi slår beskrivning varje gång.

Kör prompten på gratisnivån först. Du kontrollerar en sak: går tagningen att förstå? Komposition och rörelse syns även i utkastkvalitet, och att iterera här kostar ingenting.

Ta routingtabellen nedan, byt till modellen som passar jobbet och kör samma prompt igen. Samma ord, bättre rendering — promptens språk överförs mellan modeller.
Den högra kolumnen är den del som de flesta verktyg utelämnar. Att känna till fellägena innan du laddar upp sparar mer tid än någon promptguide.
• Inget krävs förutom en idé.
Inget filmmaterial, inget foto, ingen inspelning. Avståndet mellan en tanke och en rörlig bild är en mening och trettio sekunder.
• Regikontroll är verklig.
Kamerarörelser, timing, ljussättning och ljud reagerar verkligen på instruktioner i de starkare modellerna — det här är ingen spelautomat om du promptar som en filmskapare.
• Ljudet kommer med bilden.
De flesta modeller här renderar stämning, effekter och dialog i samma körning, så en genererad tagning är publiceringsklar i stället för att behöva en ljudläggningssession.
• Gratis utkast förändrar ekonomin.
Tre gratisutkast om dagen innebär att den dyra renderingen bara sker en gång, på en tagning som du redan vet fungerar.
• Lägre träffsäkerhet än bild-till-video.
Utan något som förankrar kompositionen misslyckas fler försök. Om du har någon användbar stillbild tar bild-till-video-sidan dig dit snabbare och billigare.
• Text i videon.
Skyltar, etiketter och bildtexter blir opålitliga i de flesta videomodeller — Kling 3.0 är starkast här, men räkna med att lägga till viktig text i din editor.
• Längd och kontinuitet.
Trettio sekunder är det nuvarande taket för en enda obruten tagning. Längre stycken är sammanlänkade klipp, och att matcha dem kräver redaktionell planering.
• Verkliga personer och offentliga personer.
Generera inga igenkännbara verkliga personer, och promptar som namnger offentliga personer avvisas. Fiktiva karaktärer är helt upp till dig.
Bilden som stockbiblioteket inte har, i varumärkets eget visuella språk, genererad samma eftermiddag som den behövs i stället för att planeras som en fotografering.
Blocka en sekvens innan en inspelningsdag med teamet bokas. Director Modes multi-shot-utdata gör en grov scen begriplig för personer som inte läser storyboards.
Historiska scener, vetenskapliga processer, allt som en kamera inte kan nå. Dokumentinmatningen i Wan 3.0 förvandlar en befintlig lektionsplan direkt till filmmaterial.
Skriv prompten som en shotlista — kamera, motiv, handling, ljus, ljud — gör först ett gratis utkast för att kontrollera att tagningen går att förstå, kör den sedan igen i den modell som routingtabellen ovan pekar på. Promptens språk överförs mellan modeller, så den vinnande formuleringen fungerar överallt.
Har du ett foto? Att animera ett ger ett användbart resultat snabbare.
Ändra stil på eller redigera material du redan har.
Varje motor, med en rad var om vad den är bäst på.