Waarom uw agent bellers laat wachten
De stilte nadat een beller is uitgepraat, is de optelsom van zes onderdelen. Meet elke beurt, bekijk de traagste en pak het onderdeel aan dat de meeste tijd kost.
Het korte antwoord
Stopt een beller met praten en blijft het stil, dan zit daar zelden één trage oorzaak achter. De stilte is de optelsom van zes onderdelen: Einde beurt, Transcriptie, Modelantwoord, Opzoekactie, Stemstart en Lijn. De Opzoekactie komt alleen voor bij beurten met opzoekactie, waarin de agent iets in een systeem nakijkt, zoals de status van een bestelling. Alle andere beurten zijn gewone beurten.
Die stilte noemen we in deze gids de reactietijd: van het moment dat de beller stopt met praten tot het eerste geluid van de agent, zoals de beller dat hoort. Een gemiddelde reactietijd verbergt juist de beurten die bellers onthouden. Meet daarom elke beurt, houd gewone beurten en beurten met opzoekactie apart, en kijk naar de mediaan en het 90e percentiel.
Zoek daarna in elk van de traagste beurten het grootste onderdeel. Het onderdeel dat het vaakst het grootste is, pakt u als eerste aan. Verander één onderdeel tegelijk en let op de keerzijde: een agent die korter wacht voordat die antwoordt, kan bellers gaan afkappen. Is wachten niet te vermijden, dan geeft een gesproken tussenmelding de beller eerder een eerste geluid. Het antwoord zelf komt daardoor niet eerder.
Neem geen streefwaarde van elders over. Zoek uit bij welke reactietijd uw eigen bellers “Hallo?” in de stilte gaan zeggen. Dat is uw drempel.
Ons artikel over waar bellers ophangen bij AI-gesprekken laat zien in welke fase bellers afhaken. Deze gids gaat een stap dieper: waarom de stilte lang is en welk onderdeel u aanpakt. Alle cijfers hieronder zijn voorbeelden: geen data van DRING en geen branchecijfers.
De zes onderdelen van de reactietijd
Tussen het laatste woord van de beller en het eerste geluid van de agent valt de tijd uiteen in zes onderdelen. Deze gids noemt ze altijd in deze volgorde:
| Onderdeel | Wat er gebeurt | Waardoor het meestal lang duurt | Hoe u het meet |
|---|---|---|---|
| Einde beurt | Het systeem besluit dat de beller klaar is. | Het systeem wacht op een lange stilte voordat het besluit. | Van het laatste woord van de beller op uw opname tot het besluit van het systeem |
| Transcriptie | De tekst uit de spraakherkenning wordt definitief. | De definitieve tekst komt pas als de hele zin is verwerkt. | Van het besluit tot de definitieve tekst |
| Modelantwoord | Het model bepaalt wat er moet gebeuren en schrijft het antwoord. | Een lange eerste zin, een grote prompt, een lange redenering voordat het model spreekt. | Van de definitieve tekst tot het antwoord. Bij een beurt met opzoekactie in twee stukken: tot het verzoek voor de Opzoekactie, en van het resultaat van de Opzoekactie tot het antwoord |
| Opzoekactie | Een controle in een systeem, zoals de status van een bestelling. Alleen bij beurten met opzoekactie. | Een traag systeem, controles die na elkaar lopen, geen tijdslimiet. | Van het verzoek tot het resultaat uit het systeem |
| Stemstart | De stem genereert de eerste audio van het antwoord. | De stem wacht op de volledige antwoordtekst voordat die begint. | Van het moment dat de antwoordtekst bij de stem aankomt tot de eerste audio die uw systeem verlaat |
| Lijn | Telefonie en netwerk brengen de audio heen en terug. | Lange belroutes, verre regio's, zwakke mobiele netwerken. | Testgesprekken vanaf gewone telefoons, opgenomen aan de kant van de beller |
Twee onderdelen bestaan uit twee stukken. Bij een beurt met opzoekactie werkt het model vóór de Opzoekactie, om te bepalen wat er gecontroleerd moet worden, en erna, om het antwoord te formuleren. Beide stukken tellen als Modelantwoord. De Lijn bestaat bij elke beurt uit twee stukken: de stem van de beller die uw systeem bereikt, en de stem van de agent die de beller bereikt. Beide stukken tellen als Lijn.
Zo meet u elke beurt
Meet beurten, geen gesprekken: in het gemiddelde van een gesprek valt één trage beurt met opzoekactie weg tussen zeven snelle. Geef elke beurt één regel met dezelfde velden. De voorbeeldwaarden horen bij de trage beurt die verderop in deze gids staat. Voorbeeld, geen echte data.
| Veld | Wat erin staat | Voorbeeldwaarde |
|---|---|---|
| Gespreks-ID | Eén ID voor de gespreksopname en de systeemlogs | C1047 |
| Beurtnummer | De plaats van het antwoord van de agent in het gesprek | 4 |
| Beurttype | Gewone beurt of beurt met opzoekactie | Beurt met opzoekactie |
| Reactietijd | Van het laatste woord van de beller tot het eerste geluid van de agent, inclusief de Lijn | 3,9 s |
| Einde beurt | Uw opname en de tijdstempels van het systeem | 0,7 s |
| Transcriptie | Tijdstempels van het systeem | 0,2 s |
| Modelantwoord | Tijdstempels van het systeem, bij een beurt met opzoekactie beide stukken | 0,6 s (0,3 s vóór en 0,3 s na de Opzoekactie) |
| Opzoekactie | Tijdstempels van het systeem, leeg bij een gewone beurt | 1,9 s |
| Stemstart | Tijdstempels van het systeem | 0,3 s |
| Lijn | Testgesprekken op de netwerken die uw bellers gebruiken | 0,2 s |
| Onverklaarde tijd | De reactietijd op de opname van uw systeem, min de onderdelen die u logt | 0,0 s |
| Beller verbrak de stilte | Ja, als de beller tijdens de stilte “Hallo?” zei of zichzelf herhaalde | Ja |
| Beller afgekapt | Ja, als de agent begon te antwoorden terwijl de beller nog praatte of alleen even pauzeerde | Nee |
| Taak voltooid | Per gesprek: ja, als de beller kreeg waarvoor hij belde | Ja |
Meet de reactietijd eerst op de gespreksopname van uw eigen systeem. Via het gedeelde gespreks-ID koppelt u elke beurt in de opname aan de tijdstempels van het systeem. Daaruit volgen Einde beurt, Transcriptie, Modelantwoord, Opzoekactie en Stemstart. De Lijn komt er in de volgende stap bij.
De Lijn staat niet op uw opname. Op uw systeem start de klok als de audio van de beller binnenkomt, en stopt die als uw audio vertrekt. Doe daarom testgesprekken vanaf gewone telefoons, op de netwerken die uw bellers gebruiken, en neem ze op aan de kant van de beller. De reactietijd op die opname, min de reactietijd op de opname van uw systeem bij dezelfde beurt, is de Lijn. Tel die op bij de reactietijden van uw echte gesprekken.
Controleer daarna of de som klopt. Onverklaarde tijd is de reactietijd op de opname van uw systeem, min de onderdelen die u logt. Is die groot, dan ontbreekt er een tijdstempel. In de voorbeeldbeurt toont de opname van uw systeem 3,7 seconden en komen de gelogde onderdelen samen ook op 3,7 seconden. De onverklaarde tijd is dus nul. Tel de Lijn van 0,2 seconde erbij op, en de beller hoort 3,9 seconden.
Waarom het gemiddelde het probleem verbergt
Voorbeeld, geen echte data: 400 beurten van de agent uit 50 opgenomen gesprekken op één lijn, 300 gewone beurten en 100 beurten met opzoekactie. Elke reactietijd is inclusief de Lijn: 0,2 seconde, gemeten met testgesprekken.
| Beurttype | Beurten | Mediaan | Gemiddelde | 90e percentiel |
|---|---|---|---|---|
| Gewone beurten | 300 | 1,1 s | 1,2 s | 1,8 s |
| Beurten met opzoekactie | 100 | 2,9 s | 3,2 s | 4,6 s |
| Alle beurten | 400 | 1,3 s | 1,7 s | 3,4 s |
Het gemiddelde over alle beurten, 1,7 seconden, ligt boven de mediaan van 1,3 seconden, omdat de trage beurten het omhoogtrekken. Geen van beide cijfers laat de beurten zien die bellers onthouden. Het 90e percentiel (p90) doet dat wel: dat is de reactietijd die één op de tien beurten bereikt of overschrijdt, hier 3,4 seconden. De beurten op of boven die waarde zijn de traagste beurten.
Maak ook onderscheid naar beurttype. Gewone beurten hebben een mediaan van 1,1 seconden, beurten met opzoekactie van 2,9 seconden. Telt een week meer beurten met opzoekactie, dan stijgen de cijfers voor alle beurten, ook als geen enkel onderdeel trager is geworden.
Verdeel dezelfde 400 beurten nu over vier groepen naar reactietijd: 130 beurten onder 1,0 seconde, 180 van 1,0 tot 2,0 seconden, 50 van 2,0 tot 3,4 seconden en 40 vanaf 3,4 seconden. Markeer daarna de beurten waarin de beller de stilte verbrak: de beller zei “Hallo?” of herhaalde zichzelf. Dat gebeurde in 31 van de 40 traagste beurten, en in 7 van de andere 360: 3 keer in de 310 beurten onder 2,0 seconden en 4 keer in de 50 beurten van 2,0 tot 3,4 seconden.
Op deze lijn verbreken bellers de stilte dus zelden bij een reactietijd onder 2,0 seconden, nog altijd weinig van 2,0 tot 3,4 seconden en vaak vanaf 3,4 seconden. De drempel van deze lijn ligt rond 3,4 seconden, en dat is geen algemene streefwaarde. Zoek de uwe op dezelfde manier: verdeel uw eigen beurten in groepen en kijk waar het verbreken van de stilte omslaat van zeldzaam naar vaak. Met fijnere groepen rond dat punt bepaalt u de drempel nauwkeuriger.
Zoek het grootste onderdeel in de traagste beurten
Het 90e percentiel laat zien hoe traag de traagste beurten zijn, niet waarom. Open daarvoor elke trage beurt en zoek het grootste onderdeel: het onderdeel dat in die beurt de meeste tijd kostte.
Voorbeeld, geen echte data: een van de 40 traagste beurten. De beller vraagt naar de status van een bestelling, dus het is een beurt met opzoekactie. De klok start op het moment dat de beller stopt met praten, zoals dat aan de kant van de beller te horen is.
Per onderdeel: Einde beurt 0,7 seconde, Transcriptie 0,2 seconde, Modelantwoord 0,6 seconde, Opzoekactie 1,9 seconden, Stemstart 0,3 seconde en Lijn 0,2 seconde. Het Modelantwoord bestaat uit twee stukken van 0,3 seconde: één om te besluiten de bestelling na te kijken, één om het antwoord te formuleren. De Lijn is 0,1 seconde in elke richting. Samen vormen de onderdelen een reactietijd van 3,9 seconden. De Opzoekactie is het grootste onderdeel, bijna de helft van de reactietijd.
Alleen binnen één beurt tellen de tijden van de onderdelen zo op. Bij medianen en 90e percentielen werkt dat niet: de medianen van de zes onderdelen samen zijn niet de mediaan van de reactietijd. Zoek dus beurt voor beurt het grootste onderdeel, en tel pas daarna.
Voorbeeld, geen echte data: het grootste onderdeel in elk van de 40 traagste beurten.
| Grootste onderdeel | Traagste beurten |
|---|---|
| Einde beurt | 8 |
| Transcriptie | 0 |
| Modelantwoord | 5 |
| Opzoekactie | 27 |
| Stemstart | 0 |
| Lijn | 0 |
| Totaal | 40 |
De Opzoekactie is het vaakst het grootste onderdeel: in 27 van de 40. Dat past bij de beurttypes: 36 van de traagste beurten zijn beurten met opzoekactie en 4 zijn gewone beurten. Einde beurt is het grootste onderdeel in 8 beurten. In de meeste daarvan pauzeerde de beller tijdens het voorlezen van een nummer, en wachtte het systeem langer voordat het besloot dat de beller klaar was. Het Modelantwoord is het grootste onderdeel in 5 beurten.
De Lijn is hier nooit het grootste onderdeel, omdat die op deze lijn steeds 0,2 seconde is. Op een andere lijn kan dat wel zo zijn. Ons artikel over goede demo's en slechte live gesprekken geeft een snelle test. Stiltes bij elke beurt wijzen op de lijn. Stiltes alleen bij beurten met opzoekactie wijzen op tools.
Pak één onderdeel tegelijk aan en let op de keerzijde
Begin bij het onderdeel dat in uw traagste beurten het vaakst het grootste is, hier de Opzoekactie. Verander één ding en meet daarna dezelfde beurttypes opnieuw. Met twee wijzigingen tegelijk weet u niet welke het 90e percentiel heeft verschoven.
Elke verbetering heeft een prijs. Daarom noemt elke rij ook het signaal waarop u let:
| Onderdeel | Wat u probeert | Waarop u let |
|---|---|---|
| Einde beurt | Een wachttijd die afhangt van wat de beller zegt: korter na korte antwoorden, zoals ja, nee of een naam, en langer terwijl de beller een nummer voorleest of een woord spelt. | Afgekapte bellers |
| Transcriptie | Streaming spraakherkenning, zodat het grootste deel van de tekst klaar is als de beurt eindigt. | Verkeerd verstane woorden en getallen |
| Modelantwoord | Een korte eerste zin. Een eenvoudig antwoordplan voor veelgestelde vragen. | Kwaliteit en volledigheid van het antwoord |
| Opzoekactie | Laat onafhankelijke controles tegelijk lopen. Stel een tijdslimiet in met een terugvaloptie: overdragen aan een medewerker of een terugbelgesprek aanbieden. Geef een gesproken tussenmelding vóór de controle. | Verouderde of onvolledige antwoorden. Gesproken tussenmeldingen die bij elke beurt terugkomen. |
| Stemstart | Laat de stem beginnen bij de eerste zin, terwijl de rest nog wordt geschreven. | Onnatuurlijke pauzes midden in een antwoord |
| Lijn | Testgesprekken vanaf de netwerken die uw bellers gebruiken. Een controle van de route samen met uw telefonieprovider. | Geluidskwaliteit, niet alleen vertraging |
Elke rij noemt opties. Probeer er één, meet en kies dan de volgende.
De prijs van een korter Einde beurt: afgekapte bellers
Bij een afgekapte beller gaat het andersom mis dan bij een lange stilte: de agent begint te antwoorden terwijl de beller nog praat of alleen even pauzeert. Voorbeeld, geen echte data: in dezelfde 400 beurten werd de beller 6 keer afgekapt, 5 keer terwijl die een bestelnummer of telefoonnummer voorlas. Beide fouten hebben met nummers te maken: Einde beurt was het grootste onderdeel in 8 van de traagste beurten, en ook in de meeste daarvan las de beller een nummer voor. Verkort u de wachttijd bij elke beurt, reken dan op meer afgekapte bellers. Daarom staan er in de rij Einde beurt twee wachttijden. Langer wachten tijdens een nummer maakt die 8 trage beurten echter niet sneller. Wat daar helpt, is een signaal dat het nummer compleet is: weet het systeem dat een bestelnummer vijf cijfers heeft, dan kan het de beurt na het vijfde cijfer afsluiten, in plaats van op stilte te wachten.
Als wachten niet te vermijden is: een gesproken tussenmelding
Sommige opzoekacties blijven traag, en het systeem erachter kunt u niet altijd zelf aanpassen. Geef de beller dan een eerste geluid vóór de Opzoekactie: een gesproken tussenmelding, een korte zin vóór een trage stap. In de trage beurt hierboven zou die direct na het eerste stuk van het Modelantwoord komen:
- Beller: “Het gaat om bestelling 4 8 1 7 2.”
- Agent, vóór de Opzoekactie: “Dank u, ik kijk de bestelling even voor u na.”
- Agent, na de Opzoekactie: “Uw bestelling is onderweg en wordt donderdag bezorgd.”
De reactietijd wordt korter, want het eerste geluid komt nu vóór de Opzoekactie. De tijd tot antwoord loopt van het moment dat de beller stopt met praten tot het begin van het eigenlijke antwoord. Die blijft ongeveer gelijk, want het antwoord wacht nog steeds op de Opzoekactie. Log bij deze beurten daarom ook de tijd tot antwoord, zodat een tussenmelding geen Opzoekactie kan verbergen die steeds trager wordt.
Houd gesproken tussenmeldingen kort en gebruik ze alleen vóór een trage stap, nooit in een excuus, een getal of de afsluiting. Ook een tussenmelding bij elke beurt heeft een prijs: bellers horen steeds weer dezelfde zin.
Wat u elke week bijhoudt
Bekijk elke week drie signalen, apart voor gewone beurten en beurten met opzoekactie:
- Reactietijd: de mediaan en het 90e percentiel, en bij beurten met een gesproken tussenmelding ook de tijd tot antwoord.
- Beller verbrak de stilte: het aandeel beurten waarin dat gebeurde.
- Afgekapte bellers: het aantal, en wat de beller op dat moment zei.
Bekijk per gesprek een vierde signaal: of de taak is voltooid. Een kortere reactietijd is weinig waard als de taak in minder gesprekken wordt voltooid. Draait u een pilot, tel een taak dan als voltooid volgens de definitie van een opgelost gesprek op uw pilotkaart.
Vergelijk vóór en na elke wijziging dezelfde beurttypes. Een aandeel dat op een paar honderd beurten is gemeten, kan door toeval verschuiven. Ons artikel over succescriteria voor een voice-AI-pilot laat zien hoe u de foutmarge van een percentage berekent.
Waar DRING helpt
Geselecteerde modellen voor spraakherkenning, spraaksynthese en redeneren, telefonie, en testen en monitoring horen bij de gedeelde basis van elk DRING-pakket. Bij DRING werken drie van de zes onderdelen en de gesproken tussenmelding zo:
- Einde beurt: een apart model regelt het onderbreken (barge-in) en het herkennen van het einde van een beurt, zodat de agent niet door een pauze heen praat of blijft wachten na een afgerond antwoord.
- Transcriptie: het gesprek wordt realtime getranscribeerd, met streaming spraakherkenning.
- Lijn: signalen over geluidskwaliteit en latency worden per nummer bijgehouden, zodat een lijn die achteruitgaat vroeg wordt opgemerkt.
- Gesproken tussenmelding: duurt een tool of model langer, dan houdt een kort, natuurlijk tussenzinnetje uit de goedgekeurde set van DRING de beurt gaande. Dat tussenzinnetje is bij DRING de vorm van de gesproken tussenmelding, en het komt nooit voor in een excuus, een getal of de afsluiting.
Op onze pagina over de Speech Core ziet u hoe spraakherkenning, beurtwisseling en spraaksynthese als één pipeline draaien. Onze pagina over telefonie gaat over de lijnstatus.
Elke DRING-agent doorloopt 1.000 tot 10.000 gesimuleerde gesprekken, gebouwd voor uw bedrijf, vóór het eerste echte gesprek. Simulaties testen de beurtwisseling en de gesproken tussenmeldingen vóór de livegang. De Lijn van live gesprekken meten ze niet. Die komt uit testgesprekken op de netwerken van uw bellers.
Zeggen bellers op uw lijn “Hallo?” in de stilte, vraag dan een terugbelgesprek aan. Houd een paar van die gesprekken klaar, met opnames als uw beleid dat toelaat. Ons team kan de traagste beurten met u doorlopen, onderdeel voor onderdeel.
Vind het onderdeel dat bellers laat wachten
Laat uw nummer achter en DRING belt u binnen twee minuten. Vertel welke lijn lange stiltes heeft, dan neemt ons team daarna contact op om samen met u de traagste beurten te bekijken.