Presence ska få AI agenter att klara riktiga kundärenden
Thomas Karlsson · Publicerad · 4 min
OpenAI lanserar Presence, ett system som ska hjälpa stora företag att sätta AI agenter i skarp drift. Agenterna kan svara på frågor, använda företagets system, utföra godkända åtgärder och kalla in en människa när det behövs.
Tjänsten finns nu för röst och chatt, men bara för kvalificerade företagskunder i ett begränsat tillgänglighetsprogram. Det här är alltså inte ännu ett AI verktyg som vem som helst kan börja klicka runt i på egen hand.
Det börjar med ett enda jobb
En AI agent i Presence får ett tydligt avgränsat uppdrag. Det kan vara att reda ut fakturafrågor, hjälpa till med försäkringsärenden eller lösa anställdas IT problem.
Agenten får bara den kunskap och åtkomst till system som behövs för just det jobbet. Företaget bestämmer vad den får göra själv, när någon måste godkänna en åtgärd och när en människa ska ta över.
Tänk dig att du ringer från köksbordet om en faktura. Agenten kan förstå frågan, kontrollera vem du är, slå upp kontoinformation, följa företagets regler och genomföra en godkänd åtgärd. Om ärendet går utanför ramarna lämnas det vidare.
Det viktiga är alltså inte bara att AI:n kan formulera ett trevligt svar. Den ska kunna göra rätt sak i rätt system, inom regler som företaget har bestämt.
Vad gör systemet annorlunda?
OpenAI beskriver företagens nya problem så här. Det handlar inte längre främst om att visa att AI agenter fungerar, utan om att göra dem tillräckligt pålitliga för värdefullt arbete i produktion.
Presence samlar därför fler delar än själva AI modellen. Där ingår policyer, standardiserade arbetsrutiner, godkända åtgärder, simuleringar, utvärderingsverktyg och regler för när ett ärende ska lämnas över.
Här finns också guardrails, alltså skyddsregler som kan ingripa om ett samtal rör sig utanför företagets gränser. Före lansering kan teamen testa vanliga frågor, ovanliga situationer och ärenden med högre risk.
Tester och bedömningsverktyg kollar om agenten nådde rätt resultat, följde reglerna, använde verktygen korrekt och bad om hjälp vid rätt tillfälle. För dig som möter agenten betyder det att svaret inte är hela provet. Även vägen fram till svaret kontrolleras.
En vältalig AI är lätt att imponeras av. En användbar AI måste också veta när den ska låta bli.
Codex föreslår förbättringar efter starten
Arbetet fortsätter när agenten har börjat ta riktiga ärenden. Samtal, överlämningar och andra kvalitetssignaler visar var den fungerar och var det finns luckor.
Codex använder ett tillägg för Presence för att undersöka signalerna och föreslå ändringar. Teamet kan sedan testa förslaget mot den version som redan körs och godkänna en kontrollerad utrullning.
Det behövs eftersom produkter, regler och människors beteenden förändras. En agent som fungerade bra vid starten kan annars börja missa när nya frågor dyker upp eller företagets arbetssätt ändras.
Företaget behåller samtidigt kontrollen över vilka ändringar som faktiskt införs. Codex föreslår, men teamet testar och godkänner.
OpenAI visar resultat från sin egen support
Presence driver OpenAI:s engelskspråkiga telefonsupport på numret 1-888-GPT-0090. Där hanterar agenten öppna frågor, verifierar den som ringer, använder kontoinformation och genomför godkända åtgärder.
Enligt OpenAI nådde eller överträffade systemet inom några veckor de riktmärken som bolaget använder för att bedöma kvaliteten hos mänsklig supportpersonal i första linjen. Det löser nu 75 procent av de inkommande ärendena utan mänsklig hjälp, alltså tre av fyra.
OpenAI uppger också att förbättringsprocessen med Codex minskade andelen överlämningar till människor med 15 procentenheter på tio dagar. Det ger en konkret bild av tanken bakom Presence. Agenten ska inte bara lanseras och lämnas åt sitt öde, utan trimmas utifrån vad som händer i riktiga samtal.
Banker och andra stora företag testar grunden
Flera företag arbetar med samma grund. BBVA undersöker AI baserad röstsupport för vanliga bankärenden i Mexiko och är designpartner för Presence.
Daniel Ordaz, chef för AI omställning på BBVA Mexico, säger att banken arbetar nära OpenAI för att forma och förbättra röstupplevelser inom kundservice. Målet är snabbare, smidigare och mer personliga möten med kunder.
SoftBank testar naturliga kundsamtal på japanska. IAG undersöker stöd vid perioder med hög efterfrågan, exempelvis under svåra väderhändelser.
De exemplen visar samtidigt var lanseringen befinner sig. Företagen utforskar och testar olika användningar, medan OpenAI:s egen telefonkanal är det konkreta exemplet med redovisade resultat.
Du kan inte slå på Presence själv ännu
OpenAI arbetar tillsammans med varje kund för att hitta ett värdefullt arbetsflöde, koppla in rätt kunskap och system, sätta behörigheter och regler, testa agenten och ta den i produktion.
Införandet leds av OpenAI Forward Deployed Engineers, ingenjörer som leder driftsättningen, samt utvalda globala systemintegratörer. De kan också fortsätta hjälpa till när användningen växer eller när ett fall går utanför vad produkten stöder i dag.
Presence säljs alltså som en driftsatt produkt, inte som självservice. Organisationer som vill undersöka tjänsten behöver kontakta sitt OpenAI team. Röstkunder kan samtidigt fortsätta få tillgång till OpenAI:s främsta modeller genom företagets API.
Det återstår att se hur resultaten blir i fler företags miljöer och när tillgången breddas. Men en sak är redan konkret: OpenAI har gått från att visa en agent som kan prata till att driva en som enligt bolaget löser tre av fyra inkommande supportärenden utan en människa.