En pilot slutar påfallande ofta med meningen ”det gick bra”. Ingen vet riktigt vad som gick bra, och ingen kan säga vad som hade krävts för att det inte skulle göra det.
Det beror sällan på att tekniken är oklar. Det beror på att piloten lades upp som en demonstration i stället för ett prov. En demonstration har till syfte att visa att något kan fungera, och det lyckas den nästan alltid med. Ett prov har till syfte att ta reda på om det gör det – och det måste därför kunna gå fel.
Två veckor räcker. Det vanligaste misstaget är att lägga tre månader på något som var avgjort efter nio arbetsdagar. Nedan står den ordning som gör de två veckorna till ett beslut i stället för en rekommendation.
1. Skriv ner beslutet innan du skriver samtalet
Första meningen i pilotdokumentet ska inte handla om agenten. Den ska handla om vad ni ska göra den femtonde nästa månad.
”Vi ska avgöra om agenten ska ta alla inkommande tidsbokningar utanför öppettid från den 1 oktober” är ett beslut. ”Vi ska testa voice AI” är det inte.
Skriv sedan ner den svårare halvan: vilket resultat betyder nej. Ett tal, bestämt innan ni har sett några data. Kan ingen formulera vad som skulle få er att avbryta, kommer ni inte att avbryta – oavsett vad de två veckorna visar.
2. Välj en samtalstyp, inte en avdelning
”Kundtjänst” är inte en samtalstyp. Det är tjugo.
Välj en med hög volym, kort livslängd och en tydlig slutpunkt: bekräfta en tid, uppge status på ett ärende, ta emot en avbokning, registrera en felanmälan. Något ni kan räkna före och efter.
Invändningen kommer direkt: de enkla samtalen är väl inte värda att automatisera. Den är fel på två sätt. De enkla är de flesta, och de är de enda som ger ett rent svar på två veckor. En pilot lagd på de svåra samtalen mäter inte agenten. Den mäter eskaleringen.
3. Mät nolläget i fem dagar innan agenten slås på
Nästan ingen gör det, och det är därför nästan ingen pilot bevisar något.
Fem vanliga arbetsdagar, agenten avstängd. Räkna hur många som ringde om den valda samtalstypen, hur många som fick svar, hur länge de väntade, hur många som lade på innan någon tog samtalet – och hur många som ringde igen om samma sak inom ett dygn.
Det sista talet är det viktigaste, och det enda som är lite besvärligt att få ut. Ta det jobbet nu. Om två veckor är det den enda raden ni kommer att diskutera.
4. Kom överens om vägen ut innan ni kommer överens om vägen in
Det som avgör om piloten upplevs som lyckad är inte öppningsrepliken. Det är vad som händer när agenten inte kommer vidare.
Bestäm tre saker före första samtalet: vad som utlöser en överkoppling, vad människan får veta när samtalet kommer, och vad som händer när ingen tar det. Eskaleringen är den del som är dyrast att göra halvvägs, och i en pilot är den också den del alla lägger märke till.
Sätt tröskeln lågt de första dagarna. En agent som kopplar över för tidigt ger er en lista över vad den inte klarade. En agent som håller kvar för länge ger er irriterade kunder och ingen lista.
5. Vecka 1: begränsa volymen, inte ambitionen
Låt inte agenten göra tio procent av jobbet på alla samtal. Låt den göra hela jobbet på tio procent av samtalen.
En agent som löser en ärendetyp fullt ut, på en liten volym, är mätbar. En agent som gör lite av varje på hela volymen är det inte – då sitter ni kvar med ett intryck och inte ett resultat.
Agenten ska upplysa om att den är AI i första repliken. Det är en skyldighet, inte ett verktyg, och den gäller även i en pilot, även när volymen är liten. Det är dessutom en dålig idé att låta bli: en pilot som döljer vad agenten är mäter något ni inte får driva efteråt.
6. Vecka 2: ta bort hjälpen
Under den första veckan är det någon som följer med noga. Någon justerar en formulering på tisdagen, rättar ett fel på onsdagen, sitter bredvid på torsdagen.
Det är rätt i vecka 1 och förödande i vecka 2. Ett system som ändras varje dag går inte att mäta – då mäter ni er egen uppmärksamhet och inte agenten.
Frys konfigurationen måndag morgon i vecka 2. Skriv ner allt ni vill ändra och låt det stå till fredag. Listan blir kortare än ni tror.
7. Lyssna på tjugo samtal ni inte har valt ut
Dra tjugo slumpmässigt. Inte de tjugo kortaste, inte de tjugo leverantören föreslår, inte de tjugo som eskalerades.
Siffrorna berättar hur ofta något hände. De tjugo samtalen berättar vad som hände – och de är den enda källan till de fel som inte har någon räknare bakom sig: agenten som bekräftade fel datum i helt rätt format, kunden som gav upp utan att lägga på, ordet ingen hade tänkt på att folk faktiskt använder om er produkt.
Avsätt två timmar. Låt den som ska sköta det här dagligen sitta med.
8. Avgör på talet från punkt 1
Fredagen i vecka 2 lägger ni nolläget från punkt 3 bredvid de två veckorna och läser den enda rad ni kom överens om i förväg.
Motstå frestelsen att byta tal. Den kommer, och den kommer fint inslagen: den genomsnittliga samtalstiden har gått ner, svarsfrekvensen är högre, agenten hanterade 340 samtal utan att klaga. Det är siffror som smickrar, och de är som regel sanna. De är bara inte det ni frågade efter.
Det två veckor inte kan avgöra
Tio arbetsdagar säger ingenting om drift över tid. Ingenting om vad som händer under mellandagarna, om hur agenten beter sig när en integration ligger nere, eller om vad som händer med uppsättningen när den som byggde den slutar.
Piloten kan avgöra en sak, och den enda saken är värd två veckor: om den här samtalstypen blir bättre eller sämre för kunden när agenten tar den.
Threll.ai bygger röstagenter på svenska, norska och danska. En pilot som inte hade kunnat sluta i nej har inte svarat på något. Den har lagt två veckor på att bekräfta att någon redan hade bestämt sig.




