NyheterSantoso Foto | Video

Fyra vägar till rörlig bild

Kamera, bildmodell, kod och ramverk löser olika problem. Så väljer jag verktyg efter vad som måste stämma, med en film som Claude skrev i kod som exempel.

8 min läsning

Det har aldrig funnits fler sätt att göra film än nu, och namnen blandas ofta ihop. Sora, Claude, ChatGPT och Runway nämns i samma mening, men de gör helt olika saker. Fel val kostar timmar. Rätt val gör att varje del av filmen görs av det verktyg som är bäst på just den delen.

Tre sorters verktyg

Det viktiga är vad verktyget levererar: färdiga pixlar, text och kod, eller ett arbetssätt.

Pixelmodeller

Modeller som gör bild och film

Tränade på enorma mängder bilder och klipp. Du beskriver vad du vill se och modellen målar fram pixlarna. Ut kommer en färdig fil, inte ett projekt du kan öppna och justera.

  • Sora från OpenAI gör video från text eller en startbild.
  • Veo från Google gör video och kan skapa ljud samtidigt.
  • Kling från Kuaishou gör video från text eller bild.
  • Runway har videomodeller och redigering i webbläsaren.
  • Midjourney, Firefly och GPT Image gör stillbilder. Firefly finns i Photoshop och Premiere, GPT Image gör bilderna i ChatGPT.
Språkmodeller

Modeller som skriver

Tränade på text och kod. De svarar, resonerar och skriver program, men målar inga pixlar själva. Visar de en bild har de lämnat över till en pixelmodell.

  • Claude från Anthropic. Opus är störst, Sonnet och Haiku snabbare och billigare.
  • Claude Code är Claude som arbetar direkt på datorn: läser filer, kör program, renderar och tittar på resultatet.
  • ChatGPT är OpenAIs chattapp. Bilderna den visar kommer från GPT Image.
  • Gemini är Googles motsvarighet, kopplad till Veo.
Skills

Kunskap som Claude läser in

En mapp med instruktioner, ibland med skript, som Claude laddar när uppgiften passar. Den lär ut ett arbetssätt: regler, mallar och beprövade lösningar. Ingen ny modell och ingen ny app.

  • HyperFrames är ett ramverk som gör film av HTML-sidor. Skillsen lär Claude ramverkets regler, och ett kommandoradsverktyg renderar till MP4.
  • Andra skills finns för dokument, design och kodgranskning. Man kan också skriva egna, till exempel för en återkommande filmmall.

Två sätt att få fram pixlar

Väg A · pixlar genereras

En modell målar bilden

Video- och bildmodeller har lärt sig hur verkligheten ser ut och tar fram pixlarna direkt. Det kan se fotografiskt ut, men du kan inte ändra en enskild detalj. Allt genereras om.

Väg B · pixlar räknas fram

Kod beskriver bilden

En språkmodell som Claude skriver kod som beskriver varje bildruta som en funktion av tid. Grafikkortet räknar fram pixlarna och ffmpeg kodar filmen. Allt är exakt och går att ändra värde för värde.

I väg B kommer ingen pixel från språkmodellen. Claude fungerar som programmerare, designer och granskare: den skriver koden, renderar stillbilder, tittar på dem och rättar.

Ett exempel

Filmen nedan är gjord enligt väg B. Claude Opus fick en kort beskrivning av en showreel för rörlig grafik och uttryckligen inget ramverk, varken HyperFrames eller något annat. Allt annat valde den själv.

15 sekunder, 1920×1080 i 60 bilder per sekund. Varje bildruta är kod: WebGL för partiklarna och 3D-formerna, Canvas för typografin och gränssnittet. Musiken är syntad i kod och övergångsljuden kommer ur mitt eget ljudbibliotek.

Ingen bild i filmen är genererad av en bildmodell. Planeten är 131 000 partiklar som räknas fram av grafikkortet, kuben och torusen är matematiska former, och varje rörelse landar på ett slag i 128 BPM eftersom musiken och bilden räknas från samma klocka. En webbläsare utan fönster spelade upp sidan bildruta för bildruta, och ffmpeg satte ihop rutorna till en film. Hela renderingen tog ungefär en och en halv minut.

Det här är det första steget av tre: en prompt och inga kommentarer från mig. Ändå går varje detalj att ändra i efterhand, ett värde i taget, utan att resten av filmen rör sig.

Fyra vägar och vad de är bra på

Kamera + klippprogram

Filma och klipp själv

Kamera, Premiere, DaVinci Resolve och After Effects. Det verkliga ögonblicket, fångat och format av en människa.

Bäst för riktiga människor, platser och händelser. Klippning efter känsla, ljud och färg. Allt som måste vara sant.

Mindre bra för grafik i stor skala, serier med samma mall varje vecka, och sådant som inte går att filma.

Tumregel: en enstaka klippning går snabbast för hand.

Pixelmodeller · väg A

Generera bilden

Sora, Veo, Kling, Runway, Midjourney, Firefly och GPT Image. Fotografiskt utseende utan kamera, ur inlärda mönster.

Bäst för miljöer och stämningar som inte kan filmas, konceptbilder, b-roll, bakgrunder och idéskisser.

Mindre bra för text som måste stavas rätt, exakt varumärke, timing mot musik, och samma resultat två gånger.

Tumregel: använd det till bilden av något, aldrig till informationen.

Kod direkt · väg B utan skill

Språkmodellen skriver grafiken

Claude Code med HTML, Canvas, WebGL, Web Audio och ffmpeg. Claude väljer alla verktyg själv. Filmen ovan är gjord så.

Bäst för kinetisk typografi, 3D-former, partiklar, logotypanimationer, intro och utro. Allt som ska landa exakt på slaget.

Mindre bra för fotorealism och verkliga människor, och längre produktioner med mycket filmat material.

Tumregel: välj det när formen är unik och ingen mall passar.

HyperFrames · väg B med skill

Kodgrafik med skill och ramverk

Samma princip, men skillsen ger Claude ramverkets regler och ramverket sköter förhandsvisning, kontroller och rendering.

Bäst för grafik ovanpå filmat material, titlar och namnskyltar, serier i samma stil och leverans i flera format.

Mindre bra för snabba engångsexperiment, där ramverkets regler mest står i vägen.

Tumregel: välj det för kunduppdrag. Ett godkänt upplägg kan sparas som recept och köras igen.

Styrkor sida vid sida

starktgår, med mödapassar inte

Kamera + klippPixelmodellKod direktHyperFrames
Verkliga människor och platser
det äkta
påhittade
via din film
Fotografiskt utseende
kan avvika
via din film
Text och typografi
manuellt
ofta fel
riktiga typsnitt
riktiga typsnitt
Exakt timing mot musik
för hand
bildrutexakt
bildrutexakt
Ändra en detalj i efterhand
allt görs om
ett värde
ett värde
3D, partiklar, abstrakt grafik
tidskrävande
svårstyrt
Snabbt engångsklipp
Serier i samma stil
varierar
recept

De flesta filmer blandar vägarna

Välj ett uppdrag för att se vilken väg som gör vilken del.

Företagsfilm

Intervjuer och miljöer bär berättelsen. Siffror och namn måste stämma exakt.

  • Grund Kamera och klipp: intervjuer, miljöer, b-roll.
  • Grafik HyperFrames: namnskyltar, nyckeltal, grafer och logotyp.
  • Accent Kod direkt: en unik öppning eller avslutning i kundens stil.

Bröllopsfilm

Allt som syns måste vara äkta. Grafiken ska vara diskret och likadan i varje film.

  • Grund Kamera och klipp: ceremoni, tal, dans och ljud.
  • Grafik HyperFrames: namn, datum och plats som ett återkommande recept.
  • Hoppa över Pixelmodeller. Människorna måste vara de riktiga.

Eventrecap

Snabb leverans i flera format, ofta samma dag. Mallen ska fungera varje gång.

  • Grund Kamera och klipp: höjdpunkterna, klippta på känsla.
  • Grafik HyperFrames: kort med plats och datum, i liggande och stående format.
  • Hoppa över Kod från grunden. Det finns ingen tid att bygga.

Produktlansering

Produkten finns kanske inte att filma än. Budskapet är gränssnitt, siffror och form.

  • Grund Kod direkt eller HyperFrames: gränssnitt, kinetisk typografi, 3D.
  • Miljö Pixelmodell: stämningsbilder och bakgrunder utan text.
  • Ljud Musik i takt med klippen, så att varje rörelse landar på slaget.

Sociala klipp i serie

Samma stil vecka efter vecka. Bara text och material byts ut.

  • Grund HyperFrames med recept: ny text och nytt klipp, samma design.
  • Material Kamera för det egna, pixelmodell för det som inte kan filmas.
  • Leverans Flera bildformat ur samma komposition.

Logotyp och intro

Kort, exakt och helt formstyrt. Rörelsen är budskapet.

  • Grund Kod direkt: fri form, exakt timing, ljud programmerat i takt.
  • Alternativ HyperFrames, om introt ska återanvändas i många filmer.
  • Hoppa över Pixelmodeller. Logotypen måste vara exakt rätt.

Sådant som inte kan filmas

Platser, epoker eller idéer utan kamera. Bilden genereras, informationen skrivs.

  • Bild Pixelmodell: miljöer, stämningar, konceptbilder.
  • Information Kod eller HyperFrames: text, siffror och rubriker ovanpå.
  • Kontroll Granska varje genererad bild. Ingen blir likadan två gånger.

Tre nivåer av regi

Gäller både kod direkt och HyperFrames. Varje nivå behåller allt från den förra.

  1. En prompt En mening, och modellen väljer allt själv. Bra för att testa och för portfolio, men du ser resultatet först när det är klart. Filmen ovan är på den här nivån.
  2. Storyboard Stillbilder av varje scen innan något animeras. Du kommenterar dem, till exempel ”scen 4, mindre text”, och först sedan byggs filmen. Fel styrs bort tidigt.
  3. Regi Kommentarer på den färdiga filmen, låsta till sekund och plats i bilden: ”9,67 sekunder, ta bort statistikscenen.” Det är de sista tio till tjugo procenten av finishen.

Funderar du på vilken väg som passar ditt nästa projekt? Hör av dig, så tar vi reda på det tillsammans.

Läs vidare

Alla texter →