Setningen kommer i nesten hvert leverandørmøte, og den kommer med god samvittighet: modellene blir bare bedre, og dere får forbedringene automatisk.
Den er stort sett sann. Det er nettopp derfor den er verdt å ta fra hverandre – for i drift betyr «automatisk» ikke det samme som «gratis», og «bedre» ikke det samme som «likt».
Påstanden, presist formulert
Modellen under stemmeagenten deres blir skiftet ut med en nyere og bedre versjon. Dere trenger ikke gjøre noe. Resultatet er en agent som svarer bedre i morgen enn i dag.
Tre ledd. De to første holder. Det tredje er der påstanden slutter å være etterprøvbar.
Hvorfor den høres riktig ut
Fordi tallene faktisk går oppover, og de går oppover fort.
Da xAI presenterte Grok Voice Think Fast 2.0 i slutten av juli, oppgav selskapet at den samlede indeksen for tale-til-tale hos Artificial Analysis gikk fra 75,7 prosent for forgjengeren til 82,9 prosent, at tid til første lyd falt fra 1,25 til 0,70 sekunder, og at transkriberingsnøyaktigheten ble 1,4 ganger bedre enn i 1.0. Selskapet oppgir at gevinsten kommer uten endringer i eksisterende prompter.
Det er reelle forbedringer på tall som betyr noe i en telefonsamtale. En kjøper som hører dette, har ingen grunn til å be om å slippe dem.
Hva som stod lenger ned på den samme siden
Den 5. august flyttet aliaset grok-voice-latest fra grok-voice-think-fast-1.0 til grok-voice-think-fast-2.0. «No action needed to upgrade», skriver xAI. Ville man bli på 1.0, måtte den eksplisitte versjonsstrengen pinnes før den datoen. Prisen på 2.0 er oppgitt til 0,08 dollar per minutt lyd.
Tre uker tidligere, 20. juli, varslet OpenAI utviklerne som brukte de gamle modellfamiliene for lyd, sanntid og transkribering, om at de fjernes fra API-et 20. januar 2027. gpt-realtime erstattes av gpt-realtime-2.1, gpt-audio av gpt-audio-1.5, og slik nedover lista.
Ingenting av dette er kritikkverdig. Det er normal produktdrift, varslet på forhånd, av leverandører som gjør nøyaktig det de har sagt at de gjør. Poenget er at to slike hendelser inntraff i løpet av tre uker, og at ingen av dem krevde en beslutning fra kunden.
Tre ting påstanden lar være å si
Enhetsprisen er en del av oppgraderingen. En ny modell kan koste mer per minutt enn den den erstatter. Da er byttet ikke bare en forbedring, det er også en reforhandling – gjennomført uten møte. Prisen på en stemmeagent er ikke et tall, men en enhet, og en modell som skiftes under enheten, flytter regningen uten å røre avtalen.
«Bedre» er et gjennomsnitt. En modell som løfter en samlet indeks, kan samtidig bli dårligere på det ene dere bruker den til. Kortere svar er en forbedring i de fleste samtaler, og en forverring i den ene der kunden skal få lest tilbake tre opplysninger før noe bekreftes. Det vanskeligste en stemmeagent hører på norsk, er et tall – og hvor godt den hører det, står ikke i noen indeks.
Klokka er ikke deres. Datoen settes av leverandøren. OpenAI oppgir minst seks måneders varsel for allment tilgjengelige modeller, minst tre måneder for spesialiserte varianter, og for modeller merket preview så lite som to uker. Selskapet skriver selv at preview-modeller ikke anbefales for forretningskritiske produksjonslaster med mindre du kan migrere på kort varsel. Det er en advarsel fra leverandøren om leverandørens eget produkt, og den er verdt å lese som nettopp det.
Hva som faktisk er sant
Den korrigerte versjonen er mindre fengende og mer brukbar: modellene blir bedre, og hver forbedring er samtidig en endring i et system dere har testet, godkjent og satt i drift.
Det er ikke et argument for å bli stående på gammel teknologi. En agent som kjører på en modell som fjernes fra API-et om fem måneder, har et større problem enn en som må testes på nytt. Det er et argument for at oppgraderinger skal ha en eier, en dato og en test – og testen finnes allerede, den heter nullpunktsmåling.
Tre spørsmål dekker det meste. Hvilken modellversjon kjører agenten vår i dag, oppgitt som en streng og ikke som «den nyeste»? Når er den varslet fjernet? Og hvem hos oss får beskjed den dagen den flyttes?
Klarer ikke leverandøren å svare på det første, er ikke de to andre besvart heller.
Threll.ai bygger stemmeagenter på norsk, svensk og dansk. At modellen under agenten blir bedre, er den enkleste delen av jobben. Å vite hvilken modell som svarte da kunden ringte i går, er den delen som gjør at noen kan svare for det.




