Artikel

Google Gemini Omni: Talebaseret AI til videoproduktion

Google præsenterer Gemini Omni, et AI-system der lader brugere skabe og redigere video via tale, tekst eller eksisterende medier. Artiklen gennemgår funktioner, kontinuitet, fremtidige muligheder og tillidsudfordringer som SynthID.

Google Gemini Omni: Talebaseret AI til videoproduktion
Læsetid: 4 Minutter
Følg på Google

Google har et nyt bud på fremtiden for videoproduktion, og det er ikke endnu en tidslinje fyldt med lag, keyframes og kringlede værktøjer. Det er en samtale. På Google I/O 2026 lancerede virksomheden Gemini Omni, et nyt AI-system designet til at omdanne næsten enhver input til video, uanset om udgangsmaterialet er en tekstprompt, et stillbillede, et lydklip eller en eksisterende videofil.

Den første version, kaldet Gemini Omni Flash, er målrettet hurtig og fleksibel videoproduktion. Google ruller den ud i Gemini-appen, Google Flow, YouTube Shorts og YouTube Create, med bredere adgang for udviklere og virksomhedskunder forventet senere. Det alene gør lanceringen bemærkelsesværdig. Dette fremstilles ikke som et nicheforsøg. Google placerer det i produkter, folk allerede bruger.

Hvad der gør Gemini Omni mere ambitiøs end en standard AI-videogenerator, er den måde, Google vil have folk til at arbejde med den på. Virksomheden positionerer værktøjet mindre som software og mere som en kreativ samarbejdspartner. I stedet for at redigere scener manuelt kan brugere bede om ændringer på almindeligt sprog og fortsætte med at finjustere resultatet trin for trin. I Googles vision forsvinder den sædvanlige friktion i videoproduktionen i baggrunden.

Redigering ved at tale, ikke klikke

Her bliver annoncens interessante del. Google siger, at Gemini Omni er designet til at bevare kontinuitet, mens brugerne reviderer et projekt gennem naturlige sprogprompter. Det betyder, at karakterer forventes at forblive visuelt konsistente, scener ikke skal falde fra hinanden mellem redigeringer, og bevægelser skal forblive troværdige i stedet for at starte på mærkelige eller fejlbehæftede måder, hver gang en prompt ændres.

Det er et velkendt problem i generativt indhold. Mange AI-værktøjer kan skabe et iøjnefaldende klip i første forsøg, men går i opløsning, så snart brugeren beder om en anden gennemkørsel. Google forsøger åbenlyst at løse den svaghed. Virksomheden siger, at Gemini Omni har en stærkere forståelse af, hvordan objekter bevæger sig i den virkelige verden, inklusive bevægelse, tyngdekraft og fysisk interaktion. I praksis kan det betyde detaljer som et spejl, der bølger som væske, når det berøres, eller en skulptur, der opfører sig, som om den var lavet af bobler, uden at hele scenen mister sammenhæng.

Det betyder noget, fordi den reelle konkurrence inden for AI-video ikke længere kun handler om rå kapabilitet. Det handler om brugervenlighed. Hvem kan få disse værktøjer til at føles naturlige nok, så almindelige skabere, marketingfolk, små virksomheder og tilfældige brugere rent faktisk vender tilbage og bruger dem igen? Googles svar, i det mindste for nu, er enkelt: lad folk dirigere video, som de taler.

Gemini Omni dukkede ikke op ud af ingenting. Det bygger videre på Googles tidligere arbejde med AI-genererede billeder, især de billedfremskridt, der blev introduceret med Nano Banana i 2025. Den model udvidede Geminis visuelle værktøjskasse og fandt praktiske anvendelser, fra at genskabe gamle familiefotos til at forvandle grove skitser til polerede koncepter. Gemini Omni tager den samme kreative logik og strækker den til bevægelige billeder.

Og Google stopper ikke ved video. Virksomheden siger, at fremtidige versioner af Gemini Omni vil understøtte mere komplekse projekter, der blander fotos, skrevne prompts, musik og referenceoptagelser i en enkelt arbejdsgang. Hvis den køreplan holder, kan værktøjet udvikle sig fra en videogenerator til et bredere AI-medie-studie.

Tillidsproblemet forsvinder ikke

For al den kreative løfte går Google også ind i det samme ubehagelige territorium, som alle store AI-virksomheder står over for: tillid. Jo mere overbevisende syntetisk indhold bliver, jo sværere er det at ignorere risiciene. Google siger, at videoer genereret med Gemini Omni vil inkludere SynthID-vandmærkning, deres system til at mærke AI-skabt indhold. Virksomheden planlægger også at udvide verifikationsværktøjer på tværs af Gemini, Chrome og Search som led i et bredere gennemsigtighedsinitiativ.

Der er også forsigtighed andre steder. Tidlige brugere vil kunne skabe videoavatare baseret på sig selv, inklusive deres egen stemme, men mere avancerede stemmemodifikationsfunktioner vurderes stadig. Den tøven siger meget. Teknologien bevæger sig måske hurtigt, men de sociale og sikkerhedsmæssige spørgsmål bevæger sig med.

Så ja, Gemini Omni handler om kreativitet. Det handler også om kontrol, autenticitet, og om hvorvidt AI-genereret video kan blive nyttig uden at blive urovækkende. Google synes at forstå, at opbygningen af en kraftfuld model kun er halvdelen af arbejdet. At få folk til at have tillid til det, den skaber, og til hvordan det bruges, er den sværere halvdel.

Alligevel er retningen klar. Google vil gøre videoproduktion mindre som at betjene software og mere som at forme en idé i realtid. Hvis Gemini Omni indfrier bare en del af det løfte, forsvinder traditionelle redigeringsværktøjer ikke natten over, men de kan begynde at føles meget mindre uundgåelige.

Anders Larsen

"Gadget-nørd. Jeg tester alt fra hovedtelefoner til droner, så du ved, hvad du skal købe."

Skriv en kommentar

Kommentarer (1)

Tomas

Mega imponerende teknologi, men også lidt skræmmende. Hvordan sikrer Google at det ikke bruges til deepfakes? Tvivler lidt på 'kontinuitet' når folk eksperimenterer vildt, men hvis det virker kan det ændre alt. Hurtigt sagt.