GPT-5.6 Luna blir 80 procent billigare
Thomas Karlsson · Publicerad · 5 min
OpenAI har sänkt priset på GPT-5.6 Luna med 80 procent och GPT-5.6 Terra med 20 procent. Samtidigt får den kraftfullare Sol modellen ett snabbare läge för företag som är beredda att betala mer när varje sekund räknas.
För dig som använder AI märks förändringen kanske inte på nästa chattfråga. Men för företag som kör tusentals eller miljontals uppgifter kan den flytta gränsen för vad som faktiskt lönar sig att automatisera.
Luna tar hand om det stora flödet
GPT-5.6 Luna är OpenAI:s snabbaste och billigaste modell i den nya modellfamiljen. Den kan använda verktyg och slutföra arbetsflöden i flera steg, vilket gör att den inte bara behöver svara på en fråga utan också kan utföra en följd av uppgifter.
Det kan liknas vid skillnaden mellan att be någon sortera ett papper och att lämna över hela högen med tydliga instruktioner. När varje genomgång kostar mindre blir det möjligt att arbeta med betydligt större högar.
Luna kostar sedan den 30 juli 0,20 dollar per miljon inmatade token och 1,20 dollar per miljon utmatade token i OpenAI API. Terra kostar 2 dollar respektive 12 dollar för samma mängd.
| Modell | Före (in / ut per miljon token) | Nu (in / ut) | Förändring |
|---|---|---|---|
| Luna | 1,00 / 6,00 dollar | 0,20 / 1,20 dollar | 80 procent lägre |
| Terra | 2,50 / 15,00 dollar | 2,00 / 12,00 dollar | 20 procent lägre |
| Sol | 5,00 / 30,00 dollar | 5,00 / 30,00 dollar | Oförändrat |
OpenAI beskriver Terra som den balanserade modellen för vardagligt arbete. Luna är i stället tänkt för stora volymer där pris och hastighet väger tungt, men där modellen fortfarande behöver kunna följa längre arbetsflöden och använda verktyg.
Skillnaden mellan GPT-5.6 Sol, Terra och Luna är alltså enkel att hålla i huvudet. Sol tar de svåraste uppgifterna, Terra balanserar vardagsarbete och kostnad, och Luna är byggd för fart och stora volymer.
Det betyder att företag inte måste välja sin mest avancerade och dyraste modell till allt. De kan låta en kraftfull modell reda ut det svåra och sedan lämna de tydliga uppgifterna till Luna.
Företagen delar redan upp jobbet
OpenAI ger kodarbete som exempel. Sol kan användas för att lösa osäkerheter och lägga upp planen. Luna kan därefter genomföra tydligt beskrivna ändringar, skriva och köra tester samt kolla resultatet.
Det är en viktig förändring i hur kostnaden för AI arbete kan räknas. Det dyraste alternativet behöver inte följa med genom hela processen bara för att en del av uppgiften är svår.
Notion uppger att Terra gav jämförbar kvalitet med GPT-5.5 i företagets tester, men till halva kostnaden per uppgift och på 60 procent kortare tid. Modellen används för bland annat frågor om innehållet i en arbetsyta och tydligt avgränsade uppgifter där svarstiden spelar roll.
Dust säger att Luna blev 40 procent snabbare och 40 procent billigare än företagets tidigare standardmodell för samma slags agentuppgifter. Cognition har i sin tur lagt in Luna i Devin Fusion för att hantera rutinmässigt kodarbete tillsammans med större modeller.
Blitzy redovisar en mer teknisk men talande skillnad. Företaget uppger att Luna hanterar 2,2 gånger mer sammanhang med 8,5 gånger färre utmatade token än GPT-5.4 mini. Kostnaden ska samtidigt vara 87 procent lägre.
I OpenAI:s egna tester presterar både Terra och Luna bättre än Fable 5 till omkring en sextondel av den uppskattade kostnaden.
Billigare AI handlar alltså inte bara om ett lägre pris på prislistan. Om modellen behöver skriva mindre, återanvänder mer av tidigare information och blir klar snabbare sjunker kostnaden för hela uppgiften.
Fast mode gör Sol snabbare för dubbla priset
OpenAI lanserar också Fast mode, ett snabbläge som ersätter den tidigare tjänsten Priority Processing i API:t. För GPT-5.6 Sol kan läget ge upp till 2,5 gånger högre hastighet än standardbehandling.
Priset är dubbelt så högt, men enligt OpenAI ändras inte modellens intelligens. Du betalar alltså för kortare väntan, inte för ett bättre svar.
GPT-5.6 Sol Ultra har inget separat tokenpris i API:t. Ultra är ett läge i ChatGPT Work för Pro och Enterprise, medan Fast mode är läget i API:t som kostar dubbelt.
Det kan vara rimligt när en kund väntar på hjälp eller när ett viktigt arbetsflöde har stannat. För en bakgrundsuppgift som kan tugga vidare under natten blir standardläget däremot lättare att motivera.
Befintliga API anrop som är märkta med priority ska automatiskt använda Fast mode. Företag behöver därför inte skriva om sina anrop enbart för att OpenAI byter namn och upplägg.
Fast mode motsvarar även /fast i Codex. Priset på Sol är oförändrat.
Effektivare modeller pressar kostnaden
Prisändringen bygger enligt OpenAI på förbättringar i modellerna, systemen som kör dem och kopplingen till verktyg och sammanhang. Bättre styrning av arbetet ska hålla hårdvaran sysselsatt, medan smartare hantering av sammanhang minskar risken att en AI agent gör om sådant som redan är klart.
Sol har dessutom använts i arbetet med att effektivisera OpenAI:s egna system. Inom en process ledd av människor skrev och optimerade modellen produktionskod, genomförde hundratals experiment och övervakade träning.
Arbetet med produktionskoden bidrog enligt OpenAI till att minska den totala kostnaden för att köra modellen med 20 procent. Experimenten ökade samtidigt effektiviteten i genereringen av token med mer än 15 procent.
Här finns en ovanlig rundgång. Modellen hjälper till att göra driften billigare, och den billigare driften gör modellen mer användbar. AI:n bygger inte sig själv på egen hand, men den har börjat bära verktygslådan.
ChatGPT Plus kostar fortfarande 20 dollar
Terra och Luna finns fortsatt i ChatGPT Work, Codex och OpenAI API. Går GPT-5.6 att använda gratis? Jo, användare med Free och Go kan komma åt Terra i Codex, medan Plus, Pro, Business och Enterprise kan välja både Terra och Luna.
Priserna för abonnemangen och deras kvotbudgetar ändras inte. ChatGPT Plus kostar fortfarande 20 dollar i månaden, och användning i API:t debiteras separat.
Däremot räknas användningen av Terra och Luna nu mildare mot betalda abonnemang, vilket innebär att samma budget räcker till mer arbete.
OpenAI uppgav också att prisändringarna skulle börja rullas ut i AWS senare den 30 juli.
Det återstår att se hur snabbt företag flyttar rutinuppgifter från större modeller till Luna och Terra. Men priset är redan fastslaget. Luna tar nu 0,20 dollar per miljon inmatade token, samtidigt som Sol kan köras upp till 2,5 gånger snabbare när väntetiden kostar mer än det dubbla priset.