Hoppa till innehållet
Aipress

Varför dyker Googles AI upp överallt?

Thomas Karlsson

Plötsligt finns en ny AI-funktion i mobilen, en app ser annorlunda ut eller en tjänst föreslår något som ingen har bett om. För många är det så mötet med Googles AI börjar. De har inte letat efter tekniken och har heller inte gjort ett aktivt val. Den har byggts in i något de redan använder.

Den här sidan tar avstamp i just den situationen. Var kan Googles AI dyka upp, varför finns den där och vad gör den egentligen? Ibland handlar frågan om nyfikenhet, men lika gärna om irritation. Den reaktionen behöver tas på allvar. Läsaren ska få en rak förklaring, inte mötas av ett försök att sälja in ännu en funktion.

Därför måste innehållet fungera även för den som helst vill slippa Googles AI. När det går att stänga av eller välja bort en funktion ska det framgå. Detsamma gäller begränsningar, kostnader och sådant som inte fungerar särskilt bra. En rättvis genomgång ska hjälpa läsaren oavsett om beslutet blir att fortsätta använda tjänsten eller att avstå.

Google som företag behöver knappast någon längre presentation. Sidan lägger inte heller utrymme på att återigen förklara hur olika modellnamn och generationer fungerar. Den bakgrunden finns på andra delar av Aipress.se. Här är frågan mer konkret: i vilka produkter har AI:n hamnat, och vad innebär det för användaren?

Den kartan kommer att växa. När Google bygger in AI i fler mobiler, appar och tjänster behöver sidan följa efter och visa var tekniken finns. Bevakningen ska också gå djupare. Vad ingår utan extra kostnad? Vad kräver abonnemang? Hur bra är funktionerna när vi testar dem, och hur står de sig mot AI-tjänster som användaren själv måste söka upp och installera?

Målet är att någon ska kunna komma hit en aning irriterad och lämna med tydliga besked: vad funktionen är, varför den dök upp och om den är värd att använda. Om svaret är nej ska även det sägas utan omsvep.

Senaste artiklar

Gemini och Googles växande AI-ekosystem

Gemini började som namnet på Googles nya familj av AI-modeller, men har med tiden blivit något betydligt större. I dag kan ordet syfta på modellerna, chattjänsten, mobilappen och de AI-funktioner som finns inbyggda i andra Google-produkter.

Det är därför lätt att blanda ihop Gemini, Google AI Studio, AI-läget i Google Sök och NotebookLM. De bygger ofta på närbesläktad teknik, men är skapade för olika situationer.

Gemini-appen är den vanliga AI-assistenten för konsumenter. AI-läget förändrar hur Google Sök fungerar. NotebookLM är byggt för arbete med egna källor, medan Google AI Studio och Gemini API riktar sig till utvecklare. Antigravity är ytterligare ett steg bort från den vanliga chatboten: en utvecklingsmiljö där AI-agenter kan arbeta med kod och projekt.

Från sökmotor till personlig assistent

Gemini är Googles motsvarighet till tjänster som ChatGPT och Claude. Användaren kan skriva en fråga, ladda upp en fil, tala med tjänsten eller visa en bild och sedan fortsätta med följdfrågor.

Tjänsten används bland annat för att skriva och redigera texter, sammanfatta dokument, planera resor, lära sig nya ämnen, analysera bilder, programmera och söka aktuell information. Eftersom Gemini ingår i Googles ekosystem kan den även arbeta tillsammans med tjänster som Gmail, Google Dokument, Drive, Maps och Flights, förutsatt att rätt funktioner och behörigheter har aktiverats.

Det är en av de tydligaste skillnaderna mot många konkurrerande AI-assistenter. Gemini är inte bara en fristående chattruta. Google försöker göra tekniken till ett gemensamt lager i produkter som redan används för e-post, dokument, lagring, sökning och mobiltelefoni.

Gemini är däremot inte en version av ChatGPT. De tillhör samma produktkategori men utvecklas av olika företag. Gemini kommer från Google och Google DeepMind, medan ChatGPT utvecklas av OpenAI och bygger på GPT-modeller.

Så fungerar Gemini under ytan

Gemini består av multimodala modeller. Det betyder att de kan bearbeta flera typer av information, inte bara text. Beroende på modell och produkt kan Gemini förstå text, kod, bilder, ljud, video och PDF-filer.

När en användare skickar en fråga analyserar modellen instruktionen och sammanhanget. Svaret skapas sedan stegvis utifrån de samband modellen lärt sig under träningen. Om webbsökning är aktiverad kan Gemini även hämta aktuell information och koppla svaret till resultat från Google Sök.

De nyare modellerna kan använda verktyg, köra kod och dela upp svårare uppgifter i flera steg. Det gör att Gemini kan gå längre än att bara skriva ett svar. I vissa miljöer kan modellerna söka efter information, analysera data eller genomföra delar av ett arbetsflöde med relativt liten vägledning.

Det betyder inte att svaren alltid är korrekta. Google varnar för att Gemini kan lämna felaktig eller olämplig information och rekommenderar att viktiga uppgifter kontrolleras. Tjänsten bör inte användas som ensam källa för medicinska, juridiska, ekonomiska eller andra beslut där ett misstag kan få stora följder.

En kostnadsfri nivå som räcker långt

Gemini kan användas gratis. Den kostnadsfria nivån är inte bara en tidsbegränsad provperiod, utan en löpande del av tjänsten. Användaren får tillgång till de vanliga Gemini-modellerna och kan bland annat chatta, arbeta med filer, söka information och använda vissa kreativa funktioner.

Gratis betyder dock inte obegränsat. Gemini använder beräkningsbaserade gränser som påverkas av hur komplicerad frågan är, vilken modell som används, vilka verktyg som aktiveras och hur lång konversationen har blivit. Gränserna uppdateras var femte timme tills användaren når en sammanlagd veckogräns.

Det går alltså inte att ange ett enda antal kostnadsfria frågor som gäller för alla. En kort textfråga förbrukar mindre kapacitet än en omfattande analys med flera filer, webbsökning och bildgenerering.

Den kostnadsfria versionen har ett kontextfönster på 32 000 tokens. Det kan förenklat beskrivas som hur mycket information modellen kan hålla i minnet under ett och samma arbete. För vanliga frågor och kortare dokument är det ofta tillräckligt, men större filer och längre projekt kan kräva ett betalt abonnemang.

Betalnivåerna runt Gemini

Geminis betalabonnemang säljs genom Google One och innehåller mer än bara själva AI-assistenten. De kombinerar högre Gemini-gränser med molnlagring och funktioner i andra Google-produkter.

Den 10 augusti 2026 kostar Google AI Plus 9,99 dollar per månad på Googles publika prissida. Planen innehåller 2 TB lagring och ger dubbelt så höga gränser i Gemini som den kostnadsfria nivån. Den omfattar också större tillgång till Google Flow, Gemini i Gmail och NotebookLM.

Google AI Pro kostar 19,99 dollar per månad och är den nivå som närmast motsvarar ChatGPT Plus eller Claude Pro. Planen ger fyra gånger högre Gemini-gränser än gratisnivån, tillgång till Pro-modellen och Deep Research samt 5 TB lagringsutrymme. Gemini kan dessutom användas direkt i fler Google-appar, däribland Gmail och Dokument.

För Plus-användare ökar kontextfönstret till 128 000 tokens. Pro och Ultra ger upp till en miljon tokens, vilket gör det möjligt att arbeta med betydligt större dokument, längre konversationer och mer omfattande underlag.

Google AI Ultra är gjort för personer som behöver de högsta gränserna och tidig tillgång till särskilt avancerade funktioner. Det finns varianter som ger fem eller 20 gånger större användningsutrymme än Pro. Priset är betydligt högre och lokaliseras efter land och betalningsplattform. Det aktuella svenska priset visas vid köpet.

Betalnivåerna ger inte obegränsad användning av varje funktion. Bildskapande, videogenerering, Deep Research, Google Flow och Antigravity kan ha egna gränser eller använda särskilda AI-krediter. Google kan också justera nivåerna över tid.

För de flesta privatpersoner räcker gratisnivån eller Google AI Plus. Pro blir relevant när Gemini används regelbundet för arbete, studier, längre dokument och research. Ultra riktar sig främst till personer som använder Googles mest resurskrävande AI-verktyg intensivt.

Modeller för olika typer av arbete

Gemini är inte en enda modell. Google har flera modellklasser som prioriterar olika saker.

Gemini Flash-Lite är byggd för snabb och kostnadseffektiv behandling av stora mängder enklare uppgifter. Gemini Flash ger mer resonemangsförmåga men behåller relativt snabba svarstider. Pro-modellerna är inriktade på komplicerade problem, kreativt arbete och uppgifter som behöver mer analys.

I augusti 2026 är Gemini 3.6 Flash en av Googles viktigaste modeller för generell användning. Den kan ta emot text, bilder, video, ljud och PDF-filer och är särskilt avsedd för programmering, avancerade resonemang, multimodal analys och längre sammanhang. Modellen finns i Gemini-appen, Google AI Studio, Gemini API och Antigravity.

Gemini 3.5 Flash-Lite är det snabbaste och billigaste alternativet i den aktuella Flash-Lite-klassen. Gemini 3.1 Pro är gjord för svårare problemlösning och kreativt arbete, medan Gemini 3.1 Deep Think riktar sig mot avancerade frågor inom vetenskap, forskning och teknik.

Utanför huvudfamiljen finns flera specialiserade modeller. Nano Banana används för att skapa och redigera bilder. Gemini Omni är inriktad på multimodal produktion och video. Gemini Audio och Flash Live används för röstsamtal och ljud, medan Gemini Robotics kombinerar språk, syn och fysisk planering för robotar.

Google utvecklar också Gemma, en familj av öppnare modeller som kan köras och anpassas av utvecklare i egna miljöer. Gemma ska alltså inte blandas ihop med Gemini-appen, även om modellfamiljerna bygger på närliggande forskning.

Styrkan ligger i kombinationen

Hur bra Gemini är beror på uppgiften, men tekniskt hör modellerna till den ledande gruppen av generativa AI-system. Styrkan ligger inte bara i svarskvaliteten. Google kan kombinera modellerna med Sök, Maps, Gmail, Drive, Android, YouTube och sin egen molninfrastruktur.

Gemini passar särskilt bra för multimodala uppgifter där text, bilder, ljud, video eller dokument behöver användas tillsammans. Den långa kontextkapaciteten i Pro och Ultra är också användbar när stora mängder material ska analyseras i samma arbete.

För personer som redan använder Gmail, Google Dokument och Drive kan integrationerna väga tyngre än små skillnader i modellernas testresultat. En rapport kan sammanfattas från Drive, ett utkast kan bearbetas i Dokument och information kan hämtas från e-post eller kalender utan att allt först behöver kopieras till en separat tjänst.

Gemini är också starkt kopplat till Google Sök. När aktuell information behövs kan modellen använda Googles sökverktyg och presentera länkar som går att kontrollera. Det gör den användbar för research, även om källorna fortfarande bör granskas.

Jämförelsen med ChatGPT

Gemini är inte generellt bättre eller sämre än ChatGPT. De två tjänsterna har olika styrkor.

Gemini har en tydlig fördel för användare som arbetar i Googles ekosystem. Integrationen med Gmail, Dokument, Drive, Maps, Flights och Android kan göra vardagsarbetet enklare. Pro-nivåns kontextfönster på en miljon tokens är också värdefullt för stora underlag.

ChatGPT har ett eget brett ekosystem med avancerad röst, bildgenerering, djup research, Work och programmeringsagenten Codex. Tjänsten är ofta ett naturligt alternativ för personer som vill ha en fristående och allsidig arbetsmiljö snarare än en AI som är tätt sammanbyggd med Google-kontot.

Vilken som ger bäst svar varierar mellan skrivande, kodning, research, bildanalys och kreativt arbete. Det kan också förändras när nya modellversioner släpps. En rättvis jämförelse kräver därför att båda tjänsterna får samma instruktion, samma material och samma krav på resultatet.

Claude kan vara ett bättre alternativ än Gemini för vissa text- eller kodintensiva arbetsflöden. ChatGPT kan passa bättre för andra uppgifter, och specialiserade modeller kan slå alla tre inom ett smalt område. Det finns ingen AI som är bättre än Gemini på allt.

AI-läget förändrar själva sökningen

AI-läget i Google Sök är inte samma sak som att öppna Gemini-appen, även om tekniken bygger på Gemini-modeller.

I en vanlig sökning får användaren framför allt en sida med länkar. AI-läget försöker i stället ge ett sammanhängande svar och låter användaren fortsätta med följdfrågor. Frågan delas upp i flera mindre delar som söks parallellt, varefter informationen sätts ihop till en förklaring med relevanta länkar.

AI-läget kan ta emot text, röst, bilder och PDF-filer. Det passar frågor som annars hade krävt flera separata sökningar, exempelvis jämförelser, research eller planering. Google beskriver det som sin mest avancerade AI-baserade sökupplevelse, men varnar samtidigt för att svaren kan innehålla fel eller missa viktig kontext.

Skillnaden mot Gemini-appen ligger främst i utgångspunkten. Gemini är en personlig AI-assistent för många sorters uppgifter. AI-läget är en utveckling av Google Sök och har webbinformation och källänkar som sin kärna.

Gemini som mobilassistent

På mobilen fungerar Gemini både som chattapp och som digital assistent. Användaren kan skriva, tala, ta en bild eller rikta kameran mot något och sedan fråga om det.

På Android kan Gemini hjälpa till med innehållet som visas på skärmen, sammanfatta en webbsida, hitta information i Gmail eller Drive, planera en resa med Maps och Flights, ringa samtal och hantera vissa funktioner på telefonen. Den kan även öppnas med ”Hey Google” när Gemini har valts som primär assistent.

Att Gemini finns förinstallerad på vissa Android-telefoner beror på att Google håller på att göra tjänsten till efterföljare och komplement till Google Assistent. AI:n placeras nära operativsystemet för att kunna hjälpa till med appar, skärminnehåll, meddelanden, alarm och andra vardagsfunktioner.

Det betyder inte att alla Android-telefoner har Gemini förinstallerat eller att tjänsten måste användas. Användaren kan ändra standardassistent, ta bort kopplingen till strömknappen, stänga av ”Hey Google”, byta tillbaka till Google Assistent eller välja att inte ha någon digital assistent alls. På många telefoner går det även att radera själva Gemini-appen.

Bilder, video, musik och röster

Google AI är mycket mer än textgenerering. Företaget har separata modeller för bilder, video, musik och tal, och flera av dem går att använda genom Gemini, Google Flow eller Gemini API.

Bilder kan skapas och redigeras med Geminis inbyggda bildfunktioner och Nano Banana-modellerna. För mer specialiserad bildgenerering finns även Imagen. Google lägger in SynthID-märkning i genererade bilder för att göra det lättare att identifiera AI-skapat material.

Video kan skapas direkt i Gemini med Gemini Omni för användare som har en kvalificerad Google AI-prenumeration. Google Flow är en mer avancerad miljö för att bygga klipp, scener och berättelser. Veo 3.1 är Googles specialiserade videogenereringsmodell och kan skapa korta videor med bild, rörelser, dialog och andra ljud.

Röster kan skapas genom Gemini API:s text-till-tal-funktioner. Utvecklaren kan styra exempelvis röst, tempo, ton och uttalsstil. Det går även att skapa samtal med två talare, vilket passar för poddar, ljudböcker och upplästa dialoger. Funktionen är fortfarande märkt som förhandsversion.

För musik finns Lyria 3, som kan skapa låtar med sång och musik i olika genrer. Användaren kan beskriva tempo, stil, instrument och andra musikaliska egenskaper eller använda en bild som inspiration.

Google AI Studio och vägen till egna appar

Google AI Studio är inte i första hand en vanlig chatbot för konsumenter. Det är en utvecklingsmiljö där man kan prova Gemini-modeller, testa instruktioner och skapa en API-nyckel.

En utvecklare kan välja modell, justera inställningar, slå på webbsökning, kodkörning eller strukturerade svar och sedan se hur modellen reagerar. När resultatet fungerar går det att hämta färdig exempelkod och ansluta modellen till en egen webbplats eller app.

AI Studio har även ett byggläge där användaren beskriver en app i naturligt språk. Gemini skapar då kod, filer och en fungerande förhandsvisning. Det går att bygga fullstack-appar för webben och Android-appar med Kotlin och Jetpack Compose, exportera projektet till GitHub eller publicera det genom Google Cloud Run.

Google AI Studio är kostnadsfritt att använda inom de tillgängliga gratisgränserna. Nya projekt börjar normalt på Gemini API:s kostnadsfria nivå. När en betald API-nyckel kopplas till projektet debiteras användningen efter modell, antal tokens och vilka verktyg som används. Innehåll på gratisnivån kan användas för att förbättra Googles produkter, medan innehåll i den betalda API-nivån inte används för det ändamålet.

Gemini finns alltså som API. Utvecklare kan använda det för att bygga egna chattbotar, analysverktyg, söktjänster, röstassistenter och program som bearbetar text, bilder, video och ljud.

NotebookLM arbetar från dina egna källor

Det som ibland kallas ”Notebook LLM” heter egentligen NotebookLM. Det är en AI-baserad researchassistent som bygger på Gemini men fungerar annorlunda än en vanlig öppen chatt.

Användaren skapar en anteckningsbok och lägger till egna källor, exempelvis PDF-filer, webbplatser, YouTube-videor, ljudfiler, Google Dokument, presentationer eller kalkylblad. NotebookLM svarar sedan främst utifrån detta material och visar källhänvisningar som leder tillbaka till relevanta delar av underlaget.

Det gör tjänsten användbar för studier, forskning, rapportarbete och projekt där svaren behöver förankras i ett bestämt källmaterial. NotebookLM kan skapa sammanfattningar, studieguider, frågekort, quiz, tankekartor, presentationer och informationsgrafik.

En av de mest kända funktionerna är Audio Overviews. NotebookLM omvandlar då källmaterialet till ett AI-genererat samtal där virtuella programledare diskuterar innehållet. Ljudöversikter kan skapas på svenska och många andra språk.

Antigravity tar steget från assistent till agent

Google Antigravity är en agentbaserad utvecklingsplattform. Den riktar sig främst till programmerare och andra som bygger tekniska projekt, inte till den som bara vill ställa frågor till en chatbot.

I en vanlig AI-baserad kodredigerare föreslår modellen kod medan utvecklaren arbetar. Antigravity låter i stället användaren ge ett större uppdrag till en eller flera AI-agenter. Agenterna kan planera arbetet, ändra filer, använda terminalen, öppna webbläsaren, köra kod och kontrollera resultatet.

Antigravity 2.0 fungerar som en central miljö där flera lokala agenter kan hanteras parallellt i olika projekt och arbetsytor. Det finns även en terminalbaserad version och ett utvecklarpaket för den som vill styra agenter programmatiskt.

Namnet kan låta som ännu en Gemini-modell, men Antigravity är själva arbetsmiljön. Gemini-modellerna står för intelligensen, medan Antigravity ger dem tillgång till verktyg och strukturer som behövs för att genomföra längre arbetsuppgifter.

Det sammanfattar också Googles bredare AI-strategi. Gemini är kärnan, men värdet kommer alltmer från hur modellerna kopplas till Sök, Android, Workspace, NotebookLM, Flow, AI Studio och agentbaserade verktyg. För användaren blir valet därför mindre en fråga om vilken enskild chatbot som vinner ett test - och mer en fråga om vilket ekosystem som passar arbetet bäst.