AI-video med presisjon: fra 3D-skisse til nettside

Bedrift: Opplink AS
Ingen stemmer ennå
Stem:

Problemet

Du vet aldri helt hva du får

Du skriver en prompt, venter et minutt og får noe som er nesten riktig. Kameraet går feil vei. Motivet ligger midt i bildet når det skulle ligget til venstre. Du prøver igjen, og igjen. Løsningen er å slutte å beskrive filmen, og heller bygge den først.

Steg 1

Bygg scenen i grove klosser

Du ber Claude bygge en enkel lav-poly modell av scenen i Blender. Ingen teksturer, ingen lys, bare volum og plassering. Det tar minutter og koster ingenting, og det er her du finner ut om ideen i det hele tatt fungerer.

Steg 2

Sett kameraet selv

Nå gjør du den ene jobben ingen AI kan gjette seg til: du bestemmer hvor kameraet starter, hvor det ender og hvor lang tid det bruker. Dra deg gjennom tidslinja til bevegelsen føles riktig, og render en rå forhåndsvisning.

Steg 3

La Claude lese filmen for deg

Du gir klippet til Claude Code og ber om en beskrivelse sekund for sekund. Den henter ut bilderutene med ffmpeg, ser på dem og skriver prompten i det språket videomodellen forstår. Du slipper å finne ordene selv.

Steg 4

La brukeren styre avspillingen

Videoen legges på nettsiden slik at den spiller framover når du ruller nedover, og bakover når du ruller opp. Besøkende føler at de styrer filmen. Det er den effekten du ser på nettsidene alle snakker om.

AI, video og nettsider

AI-video blir presis når du bygger scenen i 3D først og lar Claude skrive prompten. Her er hele arbeidsflyten, fra grov klossmodell til ferdig nettside.

Måten folk lager AI-video på i dag er stort sett å skrive en setning og håpe. Det holder til et stemningsklipp. Det holder dårlig når videoen skal ligge øverst på en nettside, der motivet må stå på riktig side av skjermen og kameraet må bevege seg i takt med at brukeren ruller nedover.

Denne guiden snur problemet. Du bygger scenen i grove klosser først, styrer kameraet selv, og lar en AI oversette den ferdige bevegelsen til en prompt. Du får med hele veien: oppsettet av verktøyene, hvordan du skriver kameraspråket, hvordan den scroll-styrte videoen på nettsiden faktisk virker, og hva du gjør i klippeprogrammet til slutt. Alt som påstås her er belagt med kildene nederst på siden.

Passer dette for deg?

1

Du bygger nettsider

Du vil ha en film øverst som spiller når folk ruller, og som ser ut som den er laget for akkurat den siden.

2

Du selger et produkt

Du trenger en produktfilm før produktet er i hus, eller du vil vise noe som er vanskelig å filme.

3

Du brenner kreditter

Du har prøvd å prompte deg fram til riktig kamerabevegelse, og gitt opp etter tjue forsøk.

4

Du kan ikke 3D

Du har aldri åpnet Blender. Det gjør ingenting. Her er det AI-en som bygger, og du som regisserer.

Hvorfor en god setning ikke er nok

En videomodell gjetter. Den leser setningen din, finner noe som statistisk ligner, og lager ti sekunder ut fra det. Skriver du «kameraet svinger rundt personen», finnes det tusen måter å svinge på: hvor fort, hvor høyt, hvor nær, med eller uten start i profil. Modellen velger én av dem. Sannsynligheten for at den velger din, er liten.

Det du mangler er ikke bedre ord. Det er en referanse. En blokkmodell er nettopp det: en grov 3D-scene med riktige størrelsesforhold og en ekte kamerabane, rendret som et lite klipp. Den viser modellen nøyaktig hvor ting står og hvordan kameraet beveger seg, og da slipper den å gjette på det som betyr mest.

Fagordet er previs, eller blokking. Filmbransjen har gjort dette i tiår, lenge før generativ video fantes. Det nye er at du ikke lenger trenger å kunne 3D for å gjøre det.

Steg 1: bygg scenen i grove klosser

Blender er gratis og har åpen kildekode, og du laster det ned fra blender.org. Du trenger ikke kunne bruke det. Du trenger bare å få en agent koblet til det.

Koblingen skjer med en MCP-server. MCP (Model Context Protocol) er en åpen standard for hvordan en AI-assistent snakker med et program eller en datakilde på maskinen din. Higgsfield leverer en slik bro for Blender, og da kan Claude bygge i den scenen du har åpen, i stedet for å levere en fil du må importere selv.

Slik henger de tre delene sammen:

  1. Blender med Higgsfield sitt tillegg installert. Du drar zip-fila rett inn i et åpent Blender-vindu, eller går via Edit, Preferences, Add-ons og Install. Tillegget krever Blender 5.1 eller nyere på Windows og macOS.
  2. MCP-broen på adressen bridge.higgsfield.ai/mcp, lagt til som en egen tilkobling med navnet Higgsfield Bridge. Du logger inn når den spør.
  3. Claude, som snakker med begge.

I Claude Desktop legger du den til under innstillinger og koblinger, som en egen tilkobling. I Claude Code gjør du det fra terminalen i stedet:

claude mcp add --transport http higgsfield https://bridge.higgsfield.ai/mcp

Når broen står, går resten slik: du beskriver scenen i vanlige ord, og ber eksplisitt om at den skal være grov. En prompt som virker:

«Lag en scene med et privatfly som ser ut over skylinjen i en storby. Hold det lav-poly og enkelt, dette er bare blokking. Ti sekunder. Kameraet skal panorere ut av vinduet og deretter ned mot byen.»

Legg merke til fire ting i den setningen. Hold det enkelt betyr at den ikke skal lage teksturer. Dette er bare blokking gjør at den ikke bruker tid på å få det pent. Ti sekunder setter tidslinja, og uten en lengde får du en scene helt uten animasjon. Og kamerabevegelsen er egentlig det eneste du kjøper her.

Et slikt oppsett tar typisk noen minutter å generere. Resultatet er ekte, redigerbar geometri i Blender, ikke et bilde, så du kan flytte på ting etterpå.

Steg 2: sett kameraet selv

Dette er den eneste delen der du bør bruke litt tid, fordi det er her verdien ligger. Alt annet kan gjøres om igjen billig.

Gå inn i kameravisningen og dra deg gjennom tidslinja. Se etter fire ting:

  • Starter bildet der du vil? Det aller første bildet bestemmer hvordan seksjonen ser ut før brukeren ruller i det hele tatt.
  • Er bevegelsen jevn? En kamerabane som rykker, blir en video som rykker.
  • Ender den på riktig komposisjon? Skal teksten din ligge til venstre, må motivet stå til høyre i siste bilde.
  • Er lengden realistisk? Ti sekunder føles lenge på en nettside. Fem til åtte er ofte nok.

Når bevegelsen sitter, eksporterer du en enkel forhåndsvisning. I Blender ligger den under View og Viewport Render Animation, ofte kalt playblast. Sett oppløsningen til 1080p og formatet til MP4. Du trenger ingen pen render. Grå klosser i bevegelse er nok, for det eneste denne fila skal gjøre er å forklare bevegelsen videre.

Steg 3: la Claude skrive prompten

Nå har du en film som viser nøyaktig hva som skal skje. Problemet er at videomodellen vil ha ord. Det er her en AI gjør en jobb du ellers måtte gjort selv: å se på klippet og oversette det til en presis, teknisk prompt.

Bruk Claude Code til dette, ikke et chatvindu. Grunnen er teknisk og verdt å forstå. Språkmodeller ser ikke video. De ser bilder. Claude Code kan kjøre ffmpeg på maskinen din, hente ut bilderuter fra klippet med jevne mellomrom og se på dem i rekkefølge. Et chatvindu der du laster opp en videofil har ikke den muligheten på samme måte. Forskjellen merkes med én gang på hvor konkret svaret blir.

Begrensningen følger av det samme: alt som skjer mellom to uttrukne bilderuter er usynlig. Et raskt glimt eller en bevegelse på et par ruter forsvinner. For en kamerabane spiller det ingen rolle. For en hurtig klippeovergang gjør det det, og da må du be om tettere uttrekk.

Prompten du gir Claude kan se slik ut:

«Her er en blokkevideo på ti sekunder. Analyser den og gi meg en detaljert prompt til en AI-videomodell, sekund for sekund. Beskriv kamerabevegelse, brennvidde, komposisjon og lys. Scenen skal være et privatfly over en opplyst storby i skumringen, filmatisk. Skriv prompten på engelsk.»

Tre grep som hever kvaliteten på svaret:

  • Be om sekund for sekund. Det tvinger fram en tidsstruktur i stedet for en stemningsbeskrivelse.
  • Si hva scenen forestiller. Blokkmodellen er grå klosser. Claude vet ikke at den grå boksen er et fly før du sier det.
  • Be om engelsk. Videomodellene er trent på engelske beskrivelser, og kameraord som dolly og whip pan har ingen presis norsk ekvivalent.

Les gjennom prompten før du bruker den. Er det noe du vil ha annerledes, si det til Claude i stedet for å rette selv. «Jeg vil heller at kameraet går hele veien rundt personen» er nok til at den skriver om hele beskrivelsen konsistent.

Steg 4: generer videoen

Lim prompten inn i videomodellen. Seedance 2.5 fra ByteDance er den som brukes mest til dette nå, blant annet fordi den tar imot mange referanser samtidig: opptil 50 til sammen, fordelt på inntil 30 bilder, 10 videoer og 10 lydklipp. Den lager klipp fra 4 til 30 sekunder i én operasjon.

Om oppløsning spriker kildene. BytePlus dokumenterer 480p og 720p ved 24 bilder i sekundet på API-et, mens tjenester som Higgsfield tilbyr 1080p gjennom sin egen tilgang. Sjekk hva din konkrete leverandør faktisk leverer før du planlegger en helside i høy oppløsning.

To ting avgjør om resultatet ligner det du planla:

  1. Blokkevideoen som bevegelsesreferanse. Det er den som låser kamerabanen.
  2. Et referansebilde av motivet. Skal produktet ditt være med, legg ved et bilde av det. Uten det finner modellen på sin egen versjon, og den driver fra klipp til klipp.

Forvent å kjøre to eller tre ganger. Det er fortsatt langt fra de tjue forsøkene du bruker når du prompter i blinde, og denne gangen vet du hva du retter på mellom hver runde.

Knepene som gir mest igjen

Dette er rådene som går igjen hos dem som lager mye AI-video, og som gjør størst forskjell tidlig.

Bruk fagordene for kamera. Modellene er trent på filmspråk, og de etablerte ordene treffer bedre enn omskrivinger. Dolly in, pull back, pan, whip pan, tilt, truck, pedestal, orbit, crane, crash zoom, handheld og locked off betyr noe presist. Vær klar over forskjellen på dolly og zoom: en dolly flytter kameraet gjennom rommet, mens en zoom endrer brennvidden uten å flytte kameraet, og presser bakgrunnen flatere inn mot motivet.

Én bevegelse om gangen. To bevegelser samtidig gir rot. Trenger du to, skriv dem som to tydelige faser med en overgang imellom, slik at modellen forstår at det er en rekkefølge.

Si alltid hvor fort. Modellene har ingen standardhastighet. «Slow dolly in» eller «3 sekunder pan mot høyre» gir helt andre resultater enn «pan right».

Sett bevegelsen først i prompten, deretter scene, handling og stil. Hold selve bevegelsesbeskrivelsen kort, rundt fem til ti ord, og hele prompten rundt 30 til 60 ord.

Planlegg sluttbildet. På en nettside er siste bilde ofte viktigere enn det første, fordi det er der teksten din skal legge seg.

Generer uten lyd når videoen skal ligge på en nettside. Den kommer til å spille uten lyd uansett, og lydsporet gjør bare fila større.

Slik settes nettsiden opp

Effekten folk husker fra disse nettsidene er at videoen følger rullehjulet. Du ruller nedover, filmen går framover. Du ruller opp, den går bakover. Det er ikke vanlig avspilling, det er scrubbing, og den tekniske kjernen er enklere enn den ser ut.

Video som styres av rulleposisjonen på en nettside

Et videoelement i nettleseren har en egenskap som heter currentTime, altså hvor i filmen avspillingshodet står. Setter du den verdien, hopper bildet dit. Scroll-styrt video gjør bare to ting: den måler hvor langt ned i seksjonen du har rullet, og setter currentTime til den samme andelen av lengden. Ruller du oppover, blir andelen mindre, og videoen går bakover helt av seg selv. Det trengs ingen egen logikk for revers.

Seksjonen gjøres samtidig festet (sticky): den blir stående i skjermen mens sporet rundt den ruller forbi. Det er dét som gir følelsen av at siden står stille mens filmen går. Når sporet er brukt opp, slipper seksjonen taket og siden ruller videre som normalt. Nøyaktig denne mekanikken er det Fortelling-blokka her på Opplink bruker, bare med bilder i stedet for video.

Rene CSS-varianter finnes også. Med animation-timeline og funksjonene scroll() og view() kan du drive en animasjon av rulleposisjonen uten JavaScript i det hele tatt, og fordi animasjoner av transform og opacity kjøres på kompositor-tråden, blir de like jevne som rullingen selv. Støtten er god i Chrome og Edge fra versjon 115, Firefox fra 132 og Safari fra 18. Selve video-scrubbingen trenger fortsatt litt JavaScript, fordi currentTime ikke kan animeres fra CSS.

Videoen som spiller uansett

Det andre mønsteret er enklere, og det er det du bør begynne med. Videoen øverst på siden spiller av seg selv, i løkke, uten lyd, med et stillbilde under til fila er lastet. I HTML er det attributtene autoplay, muted, loop, playsinline og en poster. Attributtet muted er ikke valgfritt: nettlesere blokkerer automatisk avspilling med lyd.

De to kan gjerne kombineres på samme side. Toppen spiller av seg selv og setter stemningen, og lenger nede overtar en scroll-styrt seksjon der brukeren får kontroll.

Det som avgjør om det føles bra

  • Filstørrelsen er den største fella. En tung fil gir hakking, og hakking ødelegger hele effekten. Komprimer hardt og hold klippene korte.
  • Høyere bilderate scrubber jevnere. 60 bilder i sekundet gir merkbart mykere bevegelse enn 24, mot større fil. Det er avveiningen du har.
  • Legg inn litt demping. Uten utjevning følger videoen rullehjulet altfor bokstavelig, og det føles nervøst.
  • Ha en plan for mobil og for `prefers-reduced-motion`. Vis et stillbilde i stedet. Brukere som har slått av bevegelse i operativsystemet, har gjort det av en grunn.
  • Test på en ekte telefon, ikke bare i et lite nettleservindu på PC.

Siste fase: klipp, tekst og farger

AI-en gir deg klipp. Den gir deg ikke en ferdig film. Siste fase er å sette klippene sammen, legge på tekst og rette fargene, og der er et vanlig klippeprogram fortsatt raskere enn å prompte.

Gratis: DaVinci Resolve. Den frie utgaven har verken vannmerke eller tidsgrense, og den inneholder full klipping, fargekorreksjon, Fusion for effekter og Fairlight for lyd. Den er begrenset til 4K ved 60 bilder i sekundet og mangler en del AI-funksjoner som ligger i Studio-utgaven, men for en nettsidevideo merker du ikke grensene. Studio koster en engangssum, ikke et abonnement.

Betalt: Adobe Premiere. Merk navnet: Adobe droppet «Pro» i versjon 26.0 i januar 2026, så programmet heter nå bare Premiere. Det er verdt prisen hvis du allerede jobber i Adobe sitt økosystem, eller trenger den nye automatiske objektmaskeringen.

Skal du bare legge på undertekst og trimme endene, klarer du deg med CapCut eller Shotcut, som begge er gratis. Ikke installer et stort program for en jobb som tar fem minutter.

Ett råd uansett verktøy: eksporter i samme bilderate som du genererte i. Blander du 24 og 30 bilder i sekundet i samme tidslinje, får du små rykk i bevegelsen som er vanskelige å forklare og lette å unngå.

Det som oftest går galt

Blokkmodellen er for pen

Bruker du tid på teksturer og lys i Blender, har du mistet poenget. Den skal være stygg. Den skal bare vise volum og bevegelse.

Ingen referanse av produktet

Uten et bilde av den ekte tingen finner modellen på sin egen versjon, og den endrer seg mellom klippene. Legg alltid ved produktbildet.

Logoer og tekst i bildet

Generativ video setter gjerne inn merker og skrift som ikke skal være der, og teksten blir nesten alltid feilstavet. Planlegg å fjerne den, eller legg teksten på i klippeprogrammet.

Videoen er for tung

En video øverst på siden som veier flere titalls megabyte ødelegger både lastetid og rulleopplevelse, og den straffes i målingene av nettsiden.

Kom i gang denne uka

  1. Last ned Blender fra blender.org. Det er gratis.
  2. Installer Higgsfield-tillegget ved å dra zip-fila inn i et åpent Blender-vindu.
  3. Koble til MCP-broen bridge.higgsfield.ai/mcp i Claude, som egen tilkobling eller med claude mcp add.
  4. Be om en blokkscene på fem sekunder med én enkel kamerabevegelse. Ikke velg det vanskeligste motivet først.
  5. Juster kameraet til bevegelsen føles riktig, og render en forhåndsvisning.
  6. Gi klippet til Claude Code og be om en prompt sekund for sekund, på engelsk.
  7. Generer videoen med blokkeklippet som bevegelsesreferanse og et bilde av motivet som utseendereferanse.
  8. Legg den øverst på en side som en video som spiller av seg selv, uten lyd, med et stillbilde under. Den scroll-styrte varianten tar du når den første virker.

Regn med at den første gjennomkjøringen tar en ettermiddag, og at den andre tar en time. Det er innlæringen som koster, ikke arbeidet.

Vanlige spørsmål om AI-video til nettsider

Må jeg kunne Blender for å bruke denne arbeidsflyten?+

Nei. Du må kunne åpne programmet og dra deg gjennom tidslinja for å se på kamerabevegelsen. Selve scenen bygges av Claude gjennom MCP-broen. De fleste som bruker dette har aldri modellert noe selv.

Hva er en blokkmodell, og hvorfor skal den være stygg?+

En blokkmodell er en grov 3D-scene med riktige størrelsesforhold og en ekte kamerabane, uten teksturer og lys. Den skal være stygg fordi den bare har én oppgave: å vise videomodellen hvor ting står og hvordan kameraet beveger seg. Alt annet arbeid der er bortkastet.

Hvorfor Claude Code og ikke et vanlig chatvindu til å analysere videoen?+

Fordi språkmodeller ser bilder, ikke video. Claude Code kan kjøre ffmpeg lokalt, hente ut bilderuter fra klippet og se på dem i rekkefølge. Det gir en langt mer konkret beskrivelse enn å laste opp fila i en chat.

Hva er en MCP-server?+

MCP, Model Context Protocol, er en åpen standard for hvordan en AI-assistent kobles til et program eller en datakilde. Her lar den Claude bygge direkte i Blender-scenen du har åpen, i stedet for å levere en fil du må importere selv.

Hvor lang bør en video på en nettside være?+

Fem til åtte sekunder holder for de fleste seksjoner. Ti sekunder føles lenge når noen ruller. Er videoen scroll-styrt, er det rullelengden og ikke sekundene brukeren opplever.

Hvordan får jeg videoen til å spille bakover når folk ruller opp?+

Du gjør ingenting ekstra. Når avspillingsposisjonen settes ut fra hvor langt ned i seksjonen brukeren har rullet, blir den mindre når man ruller opp, og bildet går bakover av seg selv.

Fungerer scroll-styrt video på mobil?+

Det fungerer, men det er tyngre, og enkelte eldre telefoner hakker. Ha alltid en enklere variant i bakhånd: et stillbilde, eller en kort video som spiller av seg selv. Det samme gjelder brukere som har slått av bevegelse i operativsystemet.

Hva koster dette?+

Blender er gratis, og DaVinci Resolve i fri utgave er gratis. Det du betaler for er generering av video hos leverandøren du velger, og prisen avhenger av lengde og oppløsning. Fordelen med denne arbeidsflyten er at du bruker langt færre forsøk per brukbart klipp.

Kan jeg bruke en annen videomodell enn Seedance?+

Ja. Arbeidsflyten er ikke bundet til én bestemt modell. Kravet er at modellen kan ta imot en video som bevegelsesreferanse i tillegg til teksten. Kan den ikke det, får du bare nytte av prompten, og da mister du mesteparten av presisjonen.

Hvorfor blir teksten i videoen feilstavet?+

Generative videomodeller er dårlige på skrift. Ikke be om tekst i bildet. Legg på titler og undertekster i klippeprogrammet etterpå, der du også kan bruke riktig skrifttype.

Vil du ha hjelp til å lage dette?

Nettsider der video og rulling spiller sammen

Skal du ha en film eller en nettside laget slik, legg ut oppdraget gratis på Opplink og få tilbud fra folk som jobber med dette til daglig. Et godt avgrenset oppdrag gir de mest sammenlignbare tilbudene, for eksempel «en video på åtte sekunder øverst på forsiden, scroll-styrt, levert som MP4 og WebM med stillbilde».

Kilder

  1. Higgsfield: installasjon av Blender-tillegget (dra zip-fila inn i vinduet), MCP-broen bridge.higgsfield.ai/mcp og kravet om Blender 5.1 https://higgsfield.ai/blog/higgsfield-blender-plugin
  2. Kildekoden til Higgsfield sin lokale MCP-bro for Blender https://github.com/higgsfield-ai/fnf-local-pluging-bridge-mcp
  3. Model Context Protocol: den åpne standarden som kobler AI-assistenter til programmer og datakilder https://modelcontextprotocol.io/
  4. Anthropic: slik legger du til en MCP-server i Claude Code med claude mcp add https://docs.claude.com/en/docs/claude-code/mcp
  5. Blender: gratis, med åpen kildekode, lastes ned fra blender.org https://www.blender.org/
  6. ByteDance Seed: Seedance, videomodellen som tar imot blokkevideo som bevegelsesreferanse https://seed.bytedance.com/en/seedance
  7. BytePlus ModelArk: dokumentert oppløsning og bilderate for Seedance på API-et https://docs.byteplus.com/en/docs/ModelArk/1520757
  8. Runway: kameraordene som virker i AI-video, og forskjellen på dolly og zoom https://runway.com/resources/ai-camera-prompts
  9. Luma: dolly, pan, orbit og droneskudd forklart som promptspråk https://lumalabs.ai/news/ai-camera-movement-prompts
  10. MDN: scroll-drevne animasjoner i CSS, med scroll() og view() https://developer.mozilla.org/en-US/docs/Web/CSS/CSS_scroll-driven_animations
  11. MDN: animation-timeline, egenskapen som knytter en animasjon til rulleposisjonen https://developer.mozilla.org/en-US/docs/Web/CSS/Reference/Properties/animation-timeline
  12. MDN: currentTime på videoelementet, verdien scroll-styrt video setter https://developer.mozilla.org/en-US/docs/Web/API/HTMLMediaElement/currentTime
  13. MDN: prefers-reduced-motion, slik respekterer du brukere som har slått av bevegelse https://developer.mozilla.org/en-US/docs/Web/CSS/@media/prefers-reduced-motion
  14. Blackmagic Design: DaVinci Resolve i fri utgave, og hva Studio legger til https://www.blackmagicdesign.com/products/davinciresolve
  15. Adobe: nyheter i Premiere, inkludert navneendringen fra Premiere Pro i versjon 26.0 https://helpx.adobe.com/premiere/desktop/whats-new/whats-new.html