# Gemini Omni 1.1 Flash kan förlänga AI-videor

> Gemini Omni 1.1 Flash förlänger videor, skapar övergångar mellan två bilder och skalar upp till 4K. För svenska användare finns begränsningar.

Publicerad: 2026-08-28  
Skribent: Thomas Karlsson  
Sajt: Aipress.se  
URL: https://aipress.se/nyheter/gemini-omni-flash-video/

Google har släppt den färdiga versionen av Gemini Omni 1.1 Flash, en AI-modell som skapar och redigerar korta videor. Den kan nu förlänga ett klipp, göra en sammanhängande film mellan två bilder och leverera material i upplösningar upp till 4K.

Lanseringen skedde den 27 augusti 2026 och ersätter förhandsversionen Gemini Omni Flash Preview. För svenska användare finns en viktig begränsning: egna uppladdade videor kan för närvarande inte redigeras eller förlängas inom EES. Videor som har skapats med tjänsten kan däremot bearbetas vidare.

Gemini Omni 1.1 Flash finns via Gemini API och i Google AI Studio.

## Vad är Gemini Omni 1.1 Flash?

Gemini Omni 1.1 Flash är byggd för snabb videogenerering och redigering med vanliga textinstruktioner. Den kan skapa film från en beskrivning, animera en bild och använda bilder eller korta videoklipp som referenser.

En central del är den samtalsbaserade redigeringen. Efter att ett klipp har skapats går det att fortsätta med instruktioner som:

> Lägg till en katt i soffan. Behåll allt annat som det är.

Verktyget gör då en ny version med den efterfrågade ändringen. Tidigare resultat kopplas ihop genom Interactions API, så att användaren inte behöver börja om inför varje justering.

Ett vanligt resultat är mellan tre och tio sekunder långt, har 24 bildrutor per sekund och kan göras i liggande eller stående format. Gemini Omni försöker även skapa ett passande ljudspår, som kan styras genom instruktionen.

## Gemini Omni kan förlänga en befintlig scen

Den första stora nyheten är möjligheten att fortsätta en video efter dess sista bildruta. Användaren laddar upp eller hänvisar till ett klipp och beskriver vad som ska hända därefter, exempelvis att kameran ska fortsätta över ett bergslandskap eller att en person ska gå in i rummet.

Gemini Omni analyserar slutet av filmen och skapar en fortsättning på tre till tio sekunder. Rörelser, personer, bildstil och ljud ska hållas samman över övergången. Det går även att lägga till referensbilder om en ny figur eller ett särskilt föremål ska dyka upp i fortsättningen.

När grundmaterialet har skapats med Omni kan det byggas ut i flera omgångar. Enligt [utvecklardokumentationen för Gemini Omni Flash](https://ai.google.dev/gemini-api/docs/omni) går det att lägga till upp till tio sekunder åt gången och nå en sammanlagd längd på 40 sekunder.

Förlängningen fungerar bara i slutet av filmen. Det går inte att lägga till material före början eller skjuta in en ny sekvens mitt i klippet.

![Filmremsa med ett bergslandskap: en korallmarkerad skarv vid sista bildrutan, nya bildrutor fäster bara till höger om den, och spärrmarkeringar vid remsans början och mitt](https://aipress.se/images/posts/gemini-omni-flash-video-forlangning.webp)

## Gemini Omni kan skapa en video mellan två bilder

Den andra nyheten kallas interpolering. Användaren väljer en startbild och en slutbild, varefter Gemini Omni skapar rörelsen mellan dem.

Det kan exempelvis vara ett grönt skogslandskap i den första bilden och platsen täckt av snö i den sista. Textinstruktionen beskriver hur övergången ska se ut, medan AI-systemet försöker skapa en trovärdig väg från det ena motivet till det andra.

Tekniken kan användas för kontrollerade scenbyten, produktpresentationer eller animationer där filmens första och sista bildruta behöver vara bestämda i förväg. Resultatet är inte en enkel övertoning. Nya bildrutor genereras för att få motiv, kamera och omgivning att förändras på ett sammanhängande sätt.

![Två inramade ändbilder, en grön skog i soluppgång och samma vy snötäckt under stjärnhimmel, förbundna av ett sammanhängande panorama som gradvis byter årstid och ljus](https://aipress.se/images/posts/gemini-omni-flash-video-interpolering.webp)

Ett Python-anrop med två bilder kan se ut så här:

```python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-omni-1.1-flash",
    input=[
        {"type": "image", "data": first_frame_b64, "mime_type": "image/jpeg"},
        {"type": "image", "data": last_frame_b64, "mime_type": "image/jpeg"},
        {
            "type": "text",
            "text": "A smooth cinematic transition from a lush green forest at sunrise to a snowy forest under a starry night sky."
        }
    ],
)

with open("interpolation.mp4", "wb") as f:
    f.write(base64.b64decode(interaction.output_video.data))
```

De två bilderna behandlas som filmens första respektive sista bildruta. Gemini Omni kan även använda flera bilder som friare referenser till personer, föremål eller visuell stil.

## Gemini Omni stöder upplösningar från 360p till 4K

Den tredje nyheten är möjligheten att välja utmatningens upplösning. Gemini Omni 1.1 Flash stöder:

- 360p
- 720p
- 1080p
- 4K

720p är standard. Material i 1080p och 4K skapas genom uppskalning, vilket innebär att filmen först genereras i lägre upplösning och därefter förstoras och förbättras. Varje detalj renderas alltså inte direkt i 4K.

Inställningen anges som `resolution` under `response_format`. Ett enkelt Python-anrop kan se ut så här:

```python

from google import genai

client = genai.Client()

resultat = client.interactions.create(
    model="gemini-omni-1.1-flash",
    input="A drone shot of a mountain landscape at sunrise.",
    response_format={
        "type": "video",
        "resolution": "1080p",
    },
)

with open("berg.mp4", "wb") as fil:
    fil.write(base64.b64decode(resultat.output_video.data))
```

För filer större än fyra megabyte rekommenderar Google leverans via en tillfällig webbadress. Det minskar risken för att själva API-svaret blir för stort när högre upplösningar används.

## Sverige omfattas av särskilda EES-begränsningar

Google AI Studio och Gemini API är [tillgängliga i Sverige](https://ai.google.dev/gemini-api/docs/available-regions), men alla delar av Omni fungerar inte här.

Sverige ingår i Europeiska ekonomiska samarbetsområdet, EES. Användare inom EES får för närvarande inte redigera eller förlänga videor som de själva har laddat upp. Begränsningen gäller även i Schweiz och Storbritannien.

Det går fortfarande att:

- skapa en ny film från text eller bilder
- använda en första och sista bildruta
- välja upplösning
- redigera eller förlänga material som Gemini Omni själv har genererat

En svensk användare kan alltså skapa en scen och sedan fortsätta den i flera steg. Däremot går det inte att ladda upp ett eget mobilklipp och låta Omni bygga vidare på det.

Även bildmaterial omfattas av regionala regler. Inom EES stöds inte uppladdning och redigering av bilder som innehåller minderåriga. Bilder av vissa igenkännbara personer kan också blockeras.

## Svenska instruktioner kan fungera, men är inte testade

Engelska är det enda språk som Google uppger är fullständigt utvärderat för Gemini Omni 1.1 Flash. Instruktioner på svenska kan fungera, men kvaliteten och förutsägbarheten kan variera.

För en svensk användare kan det därför vara klokt att börja med engelska beskrivningar, särskilt när kamerarörelser, ljud och händelseförlopp behöver styras noggrant. Dokumentationen rekommenderar också konkreta instruktioner framför allmänna önskemål som ”gör bilden levande”.

Om filmen ska bestå av en obruten scen behöver det anges uttryckligen. Annars kan verktyget lägga in flera kameravinklar eller klipp för att skapa ett mer berättande resultat.

## Är Gemini Omni 1.1 Flash gratis?

Nej, Gemini Omni 1.1 Flash saknar gratisnivå och är endast tillgänglig på den betalda nivån av Gemini API. Den går att välja i Google AI Studio, men ett konto utan kopplad betalande API-nyckel kan inte generera video.

Standardpriset för utmatad video är 17,50 dollar per miljon token. Google räknar 5 792 token för varje sekund film i 720p, vilket motsvarar ungefär 0,10 dollar per sekund. Ett tio sekunder långt klipp kostar därmed omkring en dollar för själva videoutmatningen.

Indata kostar 1,50 dollar per miljon token, oavsett om den består av text, bild, video eller ljud. Den slutliga kostnaden kan påverkas av klippets längd, upplösningen och hur många nya versioner som skapas.

## Förhandsversionen stängs i september

Den stabila modellkoden är:

```text
gemini-omni-1.1-flash
```

Den äldre adressen `gemini-omni-flash-preview` tas ur bruk den 30 september 2026. Utvecklare som redan använder förhandsversionen behöver därför byta modellkod.

Båda utgåvorna har identiskt angivet standardpris, men den nya varianten är avsedd för produktion och innehåller de tre nya funktionerna. Alla filmer som skapas får dessutom en osynlig SynthID-märkning, som kan användas för att kontrollera att materialet är AI-genererat.
