# Gemini 3.8 Flash släpps för längre kodjobb

> Samma pris som 3.7 Flash, 0,75 dollar per miljon token in och 3,75 ut. Men den nya versionen jobbar längre per uppgift, så notan kan ändå bli högre.

Publicerad: 2026-09-02  
Skribent: Thomas Karlsson  
Sajt: Aipress.se  
URL: https://aipress.se/nyheter/gemini-3-8-flash-langre-kodjobb/

Google släpper Gemini 3.8 Flash för programmering, avancerade resonemang och uppgifter där en AI-agent arbetar självständigt i många steg. Den kostar lika mycket per token som 3.7 Flash, men är byggd för att arbeta längre och mer självständigt. Samtidigt kommer säkerhetsvarianten Gemini 3.8 Flash Cyber, som bara blir tillgänglig för utvalda organisationer.

I [lanseringsinlägget](https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/) beskrivs den som det tredje Flash-släppet på sex veckor. Gemini 3.8 Flash kommer tre veckor efter 3.7 Flash, men ersätter inte föregångaren. Den tidigare versionen fortsätter att stödjas för arbetsflöden där låg resursförbrukning väger tyngre än högsta möjliga prestanda.

## Vad gör Gemini 3.8 Flash bättre än 3.7 Flash i kodning?

Många kodtester består av avgränsade problem där en AI ska skriva en funktion eller rätta ett enskilt fel. Verklig systemutveckling kräver ofta betydligt fler steg. AI:n kan behöva läsa flera delar av en kodbas, förstå sambanden, göra ändringar, köra tester, tolka felmeddelanden och försöka igen.

Gemini 3.8 Flash är utvecklad för sådana längre arbetsförlopp. Den ska kunna fortsätta mot ett mål, använda verktyg flera gånger och granska sitt arbete innan uppgiften avslutas.

På DeepSWE v1.1, som mäter långvarigt och självständigt arbete med mjukvaruutveckling, får 3.8 Flash 73,7 procent. Föregångaren når 65,3 procent. Poängen ligger nära Claude Opus 5 på 74,0 procent och något över GPT-5.6 Sol på 72,7 procent i Googles tabell.

I Terminal-bench 2.1, där AI-system löser programmeringsuppgifter genom en terminal, ökar testvärdet från 85,8 till 89,4 procent. Där ligger den nya Flash-versionen marginellt över både Claude Opus 5 och GPT-5.6 Sol.

Det svårare Terminal-bench 4.0 ger en annan bild. Gemini 3.8 Flash får 19,1 procent, jämfört med 11,2 procent för 3.7 Flash. Claude Opus 5 når däremot 51,8 procent och GPT-5.6 Sol 37,3 procent. Förbättringen är tydlig, men Googles nya version är inte ledande i alla typer av agentarbete.

![Ljus grafik med rubriken Bättre resultat i tre kodtester, där tre rader visar Gemini 3.7 Flash till vänster och Gemini 3.8 Flash till höger förbundna med stigande linjer: DeepSWE v1.1 från 65,3 till 73,7 procent, Terminal-bench 2.1 från 85,8 till 89,4 procent och Terminal-bench 4.0 från 11,2 till 19,1 procent](https://aipress.se/images/posts/gemini-3-8-flash-langre-kodjobb-tre-kodtester.webp)

Ett standardiserat test är heller inte samma sak som en verklig kodbas. Projektspecifika krav, äldre system, bristfällig dokumentation och beroenden som saknas i testmiljön kan påverka hur väl AI:n lyckas i praktiken.

Lanseringsinlägget visar också fyra mer konkreta exempel på vad tekniken kan bygga. Tre skapades i utvecklingsmiljön Google Antigravity: ett 3D-spel där spelaren är en trollkarl som utforskar ett slott, en fungerande DOS-version av Google Maps med vägbeskrivningar och Street View samt en topografisk karta med tvärsnitt och vetenskapliga förklaringar, byggd med öppna data från U.S. Geological Survey.

Den fjärde heter Hardware Anatomy och skapades i Google AI Studio. Det är en interaktiv 3D-visare som delar upp hårdvaruprodukter i lager så att användaren kan dra isär delarna och undersöka hur enheten är uppbyggd. Om kartan uppges den ha byggts med en enda instruktion, och om spelet står att det räckte med en enkel instruktion med en upprepande slinga.

## Varför kan Gemini 3.8 Flash bli dyrare trots samma tokenpris?

Prestandaökningen förklaras med att 3.8 Flash arbetar mer när en uppgift är svår. Den genomför fler resonemangssteg, anropar verktyg upprepade gånger och försöker rätta sina misstag. Produktchefen Tulsee Doshi och säkerhetschefen Raluca Ada Popa skriver det rakt ut i lanseringsinlägget:

> These performance gains stem from a core design choice: 3.8 Flash works harder. [...] At times, the model might use more tokens to maximize performance, especially at higher effort levels.

Det betyder att de starkare siffrorna delvis är köpta med extra beräkningar. Taxan står stilla, men ett och samma jobb kan kräva mer av maskinen och därmed landa på en större nota.

Det kan förbättra svaret men också öka tokenförbrukningen. Priset per miljon tokens visar därför inte hela kostnaden. Om AI:n gör fler försök eller använder mer internt resonemang kan ett fullständigt arbetsflöde bli dyrare trots att priset per token är oförändrat.

Utvecklare kan välja en lägre arbetsnivå när snabbhet och kostnad väger tyngre. Google pekar även ut 3.7 Flash som ett fortsatt alternativ när den extra noggrannheten inte behövs.

Skillnaden märks särskilt för AI-agenter. En vanlig chattfråga kan kräva ett enda svar, medan en agent kan behöva planera arbetet, läsa filer, köra kommandon och kontrollera utfallet genom ett stort antal anrop.

![Ljus grafik med rubriken Samma pris per token och underrubriken Agenten arbetar längre, med fem rader märkta Planerar, Läser filer, Kör verktyg, Granskar resultat och Försöker igen, och längst ned raden Fler steg ger högre nota](https://aipress.se/images/posts/gemini-3-8-flash-langre-kodjobb-fler-steg.webp)

## Gemini 3.8 Flash förbättras även utanför programmering

Framstegen omfattar också ekonomi, juridik, dokumentanalys och vetenskapliga ämnen.

I Vals Finance Agent v2, ett test av arbetsuppgifter för finansanalytiker, får Gemini 3.8 Flash 61,4 procent mot 59,0 procent för föregångaren. På Harvey's Legal Agent Benchmark stiger poängen från 8,8 till 10,0 procent. De absoluta nivåerna är låga, men 3.8 Flash placerar sig högst bland alternativen i Googles jämförelse.

På HLE-Verified, som innehåller svåra frågor inom naturvetenskap, humaniora och professionella kunskapsområden, når den nya versionen 54,9 procent. Motsvarande värde för 3.7 Flash är 53,6 procent.

Förmågan att tolka diagram förbättras också något. Gemini 3.8 Flash får 86,2 procent i CharXiv Reasoning utan externa verktyg, jämfört med 84,5 procent för föregångaren. I LVBench, som testar förståelse av långa videor, når den 87,1 procent vid vanlig bearbetning och 87,8 procent när den arbetar som agent.

Den största ökningen inom biovetenskap syns i den svårare delen av BioMysteryBench. Där går testvärdet från 43,5 till 56,5 procent. På LABBench2, som bygger på forskningsuppgifter inom biologi, stiger poängen från 82,1 till 86,2 procent.

Samtidigt hamnar 3.8 Flash efter dyrare konkurrenter i det breda kunskapsprovet GDPVal-AA v2 och i OSWorld-2.0, där en agent ska använda grafiska datorgränssnitt. Styrkorna syns främst inom programmering och vissa specialiserade analysuppgifter, inte i hela testbilden.

## Gemini 3.8 Flash Cyber letar efter sårbarheter

Gemini 3.8 Flash Cyber bygger på samma tekniska grund men är särskilt inriktad på cybersäkerhet. Den ska kunna upptäcka sårbarheter i stora kodbaser och skapa rättningar automatiskt.

På CyberGym, som testar automatisk upptäckt av säkerhetsproblem i C- och C++-kod, får Cyber-versionen 86,2 procent. Gemini 3.5 Flash Cyber når 77,5 procent, medan GPT-5.6 Sol och GPT-5.5-Cyber får 83,6 respektive 85,6 procent i Googles jämförelse.

CyberGym täcker bara en begränsad del av den kod som används i verkliga system. Google har därför också genomfört ett internt prov med komplexa kodbaser på 20 programmeringsspråk och ett brett urval av sårbarheter. Där nådde Gemini 3.8 Flash Cyber en framgångsgrad över 70 procent.

Hela det interna testet är inte publicerat. Siffran går därför inte att kontrollera oberoende, men visar att företaget vill använda tekniken i system där flera programmeringsspråk ingår.

## Gemini 3.8 Flash Cyber prioriterar rättningar

Tyngdpunkten ligger på att rätta säkerhetsfel snarare än på offensiva funktioner för att utnyttja dem.

På CWE-Bench, ett externt test av förmågan att korrigera kända typer av sårbarheter, klarar Gemini 3.8 Flash Cyber 47,2 procent vid första försöket. En ledande toppmodell når 47,8 procent men uppges ha en betydligt högre kostnad.

Chrome-teamet fann enligt Google att Cyber-versionen skapade 2,6 gånger fler korrekta rättningar av sårbarheter i Chrome än de bästa kommersiella AI-systemen, som var betydligt större.

Säkerhetsföretaget Wiz rapporterar 7,5 till 9,7 procent högre recall i sitt interna penetrationstest. Recall anger hur stor andel av de verkliga sårbarheterna som hittas. Kostnaden var samtidigt 2,3 till 5,2 gånger lägre än för andra ledande alternativ. Googles forskare inom molnsäkerhet använde dessutom tekniken för att hitta en kritisk grundläggande sårbarhet på mindre än två timmar, enligt lanseringsmaterialet.

Uppgifterna kommer från Google och dess samarbetspartner. Oberoende utvärderingar behövs för att visa hur Cyber-versionen fungerar i andra organisationers kodbaser, verktyg och säkerhetsprocesser.

## Vem får använda Gemini 3.8 Flash Cyber?

Gemini 3.8 Flash Cyber erbjuds genom Googles nya Fairwind-program i stället för som ett vanligt val i Gemini API.

Programmet riktar sig till betrodda myndigheter, verksamheter inom kritisk infrastruktur och underhållare av viktiga mjukvaruprojekt. Dessa användare får mindre begränsade cyberfunktioner eftersom de behöver kunna undersöka verkliga angreppsmetoder och allvarliga sårbarheter.

Google har inte publicerat något modell-id eller någon separat prislista för denna variant. Företaget har inte heller angett vilka länder Fairwind omfattar eller om svenska myndigheter och organisationer kan ansöka.

Den öppna utgåvan av Gemini 3.8 Flash har fortfarande skydd mot cyberrelaterat missbruk och mot risker inom kemiska, biologiska, radiologiska och nukleära områden.

Båda versionerna ska även ha blivit bättre på att stå emot promptinjektioner, där skadliga instruktioner göms i exempelvis dokument eller webbsidor som en AI-agent får läsa. I Gray Swan IPI mäts andelen lyckade angrepp, vilket innebär att en lägre siffra är bättre. Gemini 3.7 Flash får 9,2 procent, medan Gemini 3.8 Flash hamnar på 5,5 procent och Cyber-versionen på 6,0 procent.

Skyddet är särskilt relevant när en agent får tillgång till filer, terminaler eller externa tjänster. Om den följer instruktioner från fel källa kan den avslöja information eller utföra åtgärder som användaren inte har godkänt.

## Vad kostar Gemini 3.8 Flash?

Enligt [Googles prislista](https://ai.google.dev/gemini-api/docs/pricing) kostar Gemini 3.8 Flash 0,75 dollar per miljon indatatokens och 3,75 dollar per miljon utdatatokens på den vanliga API-nivån. Beloppet för utdata gäller även det som går åt till modellens eget resonemang.

Introduktionspriset gäller till och med den 31 december 2026. Den 1 januari 2027 fördubblas priserna till 1,50 dollar för indata och 7,50 dollar för utdata.

| Användning | Till och med 31 december 2026 | Från 1 januari 2027 |
| --- | ---: | ---: |
| Indata, per miljon tokens | 0,75 dollar | 1,50 dollar |
| Utdata inklusive resonemang, per miljon tokens | 3,75 dollar | 7,50 dollar |
| Cachad kontext, per miljon tokens | 0,075 dollar | 0,15 dollar |
| Lagring av cachad kontext, per miljon tokens och timme | 0,50 dollar | 1,00 dollar |

Batch och Flex kostar hälften av standardnivån under introduktionsperioden: 0,375 dollar för indata och 1,875 dollar för utdata. Priority kostar 1,35 respektive 6,75 dollar.

3.7 Flash står med exakt samma belopp på varje rad och varje nivå. Att byta upp sig är alltså gratis i sig. Notan växer bara om den nya utgåvan väljer att hålla på med ett jobb, vilket är precis vad den är byggd för.

Det finns också en kostnadsfri API-nivå. Där får Google använda innehållet för att förbättra sina produkter. För den betalda nivån anges att kundens data inte används för detta. Företag som hanterar känslig kod eller personuppgifter behöver därför kontrollera datavillkoren och var informationen behandlas innan tjänsten tas i bruk.

Sökunderbyggda svar via Google Search har en separat prismodell. Den betalda nivån omfattar 5 000 kostnadsfria sökningar per månad, gemensamt för Gemini 3.x. Därefter kostar funktionen 14 dollar per 1 000 sökningar.

## Gemini 3.8 Flash är tillgänglig i Sverige

Gemini 3.8 Flash är allmänt tillgänglig i Gemini API med modell-id:t `gemini-3.8-flash`. Utvecklare kan använda den genom Google AI Studio, Android Studio och Google Antigravity.

Sverige finns bland de länder där Gemini API och Google AI Studio stöds. Svenska utvecklare kan därmed använda API-versionen utan någon särskild regional variant.

För privatpersoner gäller den abonnenter på Google AI Pro och Google AI Ultra, på tre ytor: Gemini-appen, AI-läget i Sök och Gemini i Google Kalkylark. Båda abonnemangen säljs i Sverige. Något besked om gratisanvändare finns inte i lanseringsmaterialet.

Företag får tillgång genom Gemini Enterprise. Vertex AI nämns däremot inte i lanseringsmaterialet, och Google har inte lämnat några uppgifter om när Cyber-versionen kan bli tillgänglig för svenska organisationer.

Gemini 3.8 Flash för Googles billigare Flash-serie närmare de stora toppmodellerna i flera kodtester. För utvecklare blir den avgörande frågan om AI:n kan slutföra längre uppgifter med färre manuella ingripanden utan att den högre tokenförbrukningen äter upp prisfördelen.
