Gesloten tickets, afhandeltijd en een kale klanttevredenheidsscore overleven in rapportages omdat ze er altijd goed uitzien. Dit meet je in plaats daarvan, en zo zie je of een cijfer wordt bespeeld.
De meeste supportdashboards staan vol cijfers die omhooggaan als het goed gaat, omhooggaan als het slecht gaat, en je niet vertellen welk van de twee aan de hand is. Ze overleven omdat niemand ze hoeft te verdedigen: een cijfer dat er altijd acceptabel uitziet, leidt nooit tot een ongemakkelijk gesprek. De prijs is dat je wachtrij een maand lang kan verslechteren zonder dat één grafiek het doorheeft.
De schijncijfers, en wat ze verbergen
Geen van deze getallen is verzonnen. Ze meten allemaal iets echts, en worden vervolgens gebruikt om een vraag te beantwoorden die ze niet kunnen beantwoorden.
Vijf cijfers die er betrouwbaar prima uitzien
Cijfer
Wat het echt meet
Waar het misgaat
Gesloten tickets
Hoe vaak op de knop 'sluiten' is gedrukt
Sluiten is een handeling van je medewerker, geen uitkomst voor je klant. Het stijgt als er strenger wordt afgesloten, als gesprekken worden opgeknipt, en na een slechte week waarin er simpelweg meer te sluiten viel.
Gemiddelde afhandeltijd
Hoelang een medewerker per gesprek bezig is
Een kostenpost die als kwaliteitssignaal wordt gelezen. Omlaag duwen beloont korte antwoorden en gehaaste overdrachten, en de tickets die daardoor terugkomen landen in het volume van volgende week, waar niemand ze nog toerekent.
Opgelost bij eerste contact, zelf aangevinkt
Of iemand een vinkje heeft gezet
Degene die het vinkje zet, wordt erop beoordeeld. Zolang het niet is afgeleid uit de vraag of de klant terugkwam, meet je optimisme.
Gesprekken 'afgehandeld door AI'
Hoe vaak de widget heeft meegepraat
Meepraten is niet helpen. Dit is het cijfer dat indrukwekkende automatiseringspercentages oplevert terwijl je wachtrij niet korter wordt.
Kale klanttevredenheidsscore
De mening van de kleine groep die reageerde
Bij een lage responsratio wordt de score bepaald door de enthousiastelingen en de woedenden. Niet onjuist, maar het gaat over een andere groep dan de klanten die je bedient.
Het aandeel 'afgevangen' gesprekken verdient een aparte vermelding, want dat wordt het vaakst als kwaliteitscijfer gepresenteerd terwijl het een capaciteitscijfer is. Het telt contacten die niet binnenkwamen, en een klant die het opgaf telt precies even zwaar als een klant die geholpen is. Gebruik het om bezetting te plannen, niet om je AI te beoordelen, en laat er nooit een factuur op baseren.
Wat je in plaats daarvan meet
Het opgeloste aandeel op een strenge definitie: opgeloste gesprekken gedeeld door geprobeerde gesprekken, waarbij opgelost betekent dat geen medewerker heeft gereageerd, gesprekken waarin de klant niet meer reageerde niet als succes meetellen, en een oplossing vervalt als het gesprek weer opengaat.
Het heropeningspercentage binnen een genoemde termijn. Die termijn hóórt bij het cijfer: zonder aantal dagen erbij is het met niets vergelijkbaar, ook niet met zichzelf van vorig kwartaal.
De contactratio, per bestelling of per actieve klant. Dit is het enige cijfer in de rij dat om een goede reden kan dalen. Volume groeit met je bedrijf mee; een stijgende contactratio betekent dat je product of je content slechter werd.
De leeftijd van je werkvoorraad als verdeling. Een gemiddelde van negen uur past net zo goed bij elf gesprekken die meteen zijn beantwoord en één dat vier dagen wacht — en dat vierdaagse gesprek schrijft de review.
Kosten per opgelost contact, met de reden van de beweging erbij.
Reactietijden, netjes gemeten
Drie correcties maken van de eerste reactietijd een signaal in plaats van decoratie. Rapporteer de mediaan en het 90e percentiel in plaats van het gemiddelde, want het gemiddelde wordt bepaald door een handvol gesprekken dat een weekend bleef liggen. Meet alleen over openingstijden, anders beoordeel je jezelf op de klok in plaats van op je service. En meet het over gesprekken die een mens hebben bereikt, want directe AI-antwoorden erdoorheen mengen levert een cijfer op dat technisch klopt en operationeel niets zegt.
Het 90e percentiel is het cijfer om week na week te volgen. Een stabiele mediaan met een oplopend 90e percentiel is de klassieke handtekening van een wachtrij waarin het routinewerk prima loopt en het moeilijke werk ligt weg te rotten.
De enige klanttevredenheid die iets zegt
Eén score over een gemengde wachtrij vertelt je bijna niets waar je iets mee kunt. Splits naar hoe het gesprek eindigde — afgerond door de AI, of afgerond door een mens — en precies dezelfde antwoorden beantwoorden ineens echte vragen: houdt automatisering de kwaliteit vast, en welke onderwerpen kun je beter niet automatiseren.
Die splitsing moet in het verzamelen zitten, niet achteraf worden gereconstrueerd. Bij CustomerEagle is een beoordeling een heel getal van 1 tot en met 5, één per gesprek, en wordt hij opgeslagen samen met de vraag of het gesprek door de AI is opgelost, zodat de uitsplitsing er gewoon is. Er zijn twee plekken waar je klant kan beoordelen — de kaart in de widget en de link in de e-mail na afronding — en beide lopen bewust door dezelfde code, zodat de twee kanalen niet uit elkaar kunnen groeien en verschillende dingen gaan meten.
Eén beoordeling per gesprek is een bewuste grens: een tweede inzending wordt geweigerd in plaats van meegemiddeld, zodat een naijler de eerste indruk niet overschrijft. Een lage beoordeling doet bovendien meer dan rapporteren. Bij een gesprek dat als AI-oplossing was geteld, draait een score van 2 of lager die oplossing terug — hij verdwijnt uit je verbruik en wordt gecrediteerd als hij al gefactureerd was, via dezelfde afkoelperiode die op hoe wij AI-oplossingen meten staat beschreven. Een tevredenheidscijfer dat de leverancier geld kan kosten, is een tevredenheidscijfer dat de leverancier eerlijk wil ophalen.
Zet de responsratio er elke keer naast. Een 4,6 uit 6% van je gesprekken en een 4,3 uit 40% zijn niet vergelijkbaar, en die tweede is bruikbaarder.
Rapporteer de twee segmenten los, en publiceer nooit één samengevoegde score zonder beide aantallen eronder.
Kijk naar de richting, niet naar het niveau. Een derde punt eraf in het AI-segment is een contentprobleem met een datum eraan.
Lees de opmerkingen. Dat is het enige deel van je klanttevredenheid dat vertelt wáárom, en meestal het deel zonder eigenaar.
Benoem de vertekening als je het naar boven presenteert: klanten die beoordelen kiezen daar zelf voor, en gesprekken die slecht eindigden bereiken de beoordelingsvraag vaak niet eens.
Kosten per opgelost contact, en waarom ze horen te dalen
Kosten per opgelost contact is het cijfer waar de directie om vraagt en het cijfer dat het makkelijkst de verkeerde kant op verbetert. Het daalt als je afhandeltijd wordt uitgeknepen, als medewerkers sneller afsluiten en als klanten het opgeven — geen van drieën iets wat je wilt. Het hoort te dalen omdat je contactratio daalde: minder mensen hoefden te vragen, omdat het artikel bestond, de track-and-tracepagina duidelijk was, of het product de vraag niet meer opriep.
Rapporteer het dus als paar. Kosten per opgelost contact naast de contactratio, en een beweging in het eerste die niet door het tweede wordt verklaard is een beweging om uit te zoeken, niet om te vieren. Wordt een deel van je kosten per oplossing gefactureerd, dan is de definitie achter die facturatie onderdeel van het cijfer — die vraag staat uitgewerkt in wat is een AI-oplossing.
Het wekelijkse rapport van één pagina
Zeven cijfers, één pagina, elk met een notitie over hoe het eruitziet als er met het cijfer wordt gespeeld. Kun je die laatste kolom niet invullen, dan hoort het cijfer niet op de pagina.
Een weekpagina die je kunt verdedigen
Cijfer
De vraag die het beantwoordt
Zo ziet spelen eruit
Gesprekken, plus contactratio per bestelling of klant
Groeit de vraag harder dan het bedrijf?
Gesprekken samenvoegen of opknippen om het aantal te verschuiven zonder dat het werk verandert.
Opgelost aandeel, nul menselijke reacties
Hoeveel wordt er echt zonder mens afgehandeld?
Gesprekken meetellen waarin een medewerker één bericht stuurde, of stilte als succes boeken.
Heropeningen binnen een genoemde termijn
Hielden die oplossingen stand?
De termijn verkorten, of een nieuw gesprek starten in plaats van het oude heropenen.
Eerste reactie: mediaan en 90e percentiel, openingstijden
Hoelang wacht een mens nu echt?
Een automatische ontvangstbevestiging meetellen als eerste reactie.
Werkvoorraad ouder dan 24 en 72 uur, als aantallen
Ligt er onderin iets te rotten?
Oude gesprekken sluiten om het aantal te drukken, waarna ze terugkomen als heropeningen.
Klanttevredenheid gesplitst naar AI en mens, met responsratio
Houdt de kwaliteit stand waar automatisering groeide?
De vraag alleen versturen na gesprekken die goed gingen.
Belangrijkste overdrachtsredenen, gegroepeerd
Wat schrijven we deze week op?
Een categorie 'overig' die groot genoeg is om het echte antwoord in te verbergen.
Die laatste rij maakt van een rapport werk. Gegroepeerde overdrachtsredenen zijn een contentachterstand op volgorde van belang, en de reden die maandag bovenaan staat is meestal een artikel dat je dinsdag kunt schrijven — de rest van die werkwijze staat in klantenservice automatiseren voor je webshop.
Het meten zelf is het lastige deel
Een cijfer is niet beter dan de gebeurtenis eronder, en de meeste discussies over rapportages gaan in werkelijkheid over die gebeurtenis. Voordat een getal op de pagina komt, heeft het drie dingen nodig: een vastgelegde gebeurtenis met een beschreven trigger, een eigenaar met naam die de definitie mag wijzigen, en een export die je tegen echte gesprekken kunt houden.
Toerekening op de afzender van het bericht, niet op de status van het gesprek. Of er een mens reageerde is een feit over de berichten; alles wat uit een statusveld wordt afgeleid, gaat schuiven.
Een gedateerd definitiebestand. Beweegt een cijfer, dan is de eerste vraag of de definitie bewoog — en dat hoort binnen dertig seconden beantwoord te zijn.
Wekelijks meelezen. Tien gesprekken van begin tot eind zeggen meer over kwaliteit dan welke grafiek ook, en zo ontdek je ook dat een cijfer het verkeerde meet.
Een export met gesprekken erbij, zodat elk getal in het rapport terug te voeren is op de gesprekken die het opleverden.
Hier is geen datateam voor nodig. Wel de keuze welke zeven cijfers je gaat verdedigen, het opschrijven van wat elk cijfer betekent, en de bereidheid om een cijfer te publiceren dat de verkeerde kant op gaat. Waar de rapportage over de AI-kant in het product zit, zie je op het functie-overzicht.
Wat zijn schijnstatistieken in de klantenservice?
Schijnstatistieken zijn cijfers die er betrouwbaar acceptabel uitzien, ongeacht wat je klant heeft ervaren: gesloten tickets, gemiddelde afhandeltijd, zelf aangevinkte oplossing bij eerste contact, gesprekken waarin de AI meepraatte, en een kale tevredenheidsscore bij een lage responsratio. Ze meten allemaal iets echts, maar geen ervan onderscheidt een geholpen klant van een klant die het opgaf.
Welke klantenservice-KPI's zeggen wel iets?
Het opgeloste aandeel op een strenge definitie, het heropeningspercentage binnen een genoemde termijn, de contactratio per bestelling of per actieve klant, de leeftijd van je werkvoorraad als verdeling in plaats van als gemiddelde, reactietijd als mediaan en 90e percentiel over openingstijden, en klanttevredenheid gesplitst naar gesprekken die de AI of een mens afrondde.
Moet ik klanttevredenheid splitsen naar AI en medewerker?
Ja, en het is de enige splitsing die betrouwbaar tot actie leidt. Eén samengevoegde score verbergt of automatisering de kwaliteit vasthoudt of juist uitholt, terwijl de splitsing laat zien welke onderwerpen veilig te automatiseren zijn en welke naar een mens horen. Zet bij elk segment de responsratio, want die verschilt bijna altijd tussen de twee.
Hoe meet je de eerste reactietijd goed?
Als mediaan en 90e percentiel in plaats van als gemiddelde, alleen over openingstijden, en berekend over gesprekken die een mens hebben bereikt in plaats van over alle gesprekken. Directe AI-antwoorden die in hetzelfde gemiddelde meelopen leveren een getal op dat klopt en niets zegt over hoelang een klant op een mens heeft gewacht.
Wat is een goede klanttevredenheidsscore?
Er bestaat geen overdraagbare norm, omdat de score afhangt van je kanalenmix, het moment waarop je de vraag stelt en hoeveel klanten hem beantwoorden. De vergelijking die wél iets betekent is die met je eigen nulmeting: meet nu, noteer de responsratio ernaast, splits naar AI en mens, en volg de richting in plaats van het niveau.
Hoe merk ik dat er met een cijfer wordt gespeeld?
Schrijf bij elk getal op je rapport op hoe het eruit zou zien als iemand op het cijfer zou sturen in plaats van op de uitkomst: gesprekken vroeg sluiten, ze opknippen, de tevredenheidsvraag alleen na goede gesprekken versturen. Kun je dat faalscenario niet beschrijven, dan begrijp je het cijfer nog niet goed genoeg om erop te sturen.
Een proactief bericht is een bericht waar de klant niet om vroeg. Welke signalen het waard zijn, wat er in zo'n bericht hoort te staan om support te zijn in plaats van ruis, en hoe je het effect eerlijk meet.
Klanten vergeven een bot die iets niet weet. Ze vergeven geen bot die je niet laat gaan. Welke doorzetregels je vastlegt, wat er mee moet met het gesprek, en waaraan je een goede overdracht herkent.
De belangrijkste factor voor je AI-oplospercentage is niet het model maar je content. Een praktische gids: één vraag per artikel, het antwoord vooraan, echte waarden in plaats van screenshots, en testen met je eigen tickets.
Los meer tickets automatisch op.
Kijk hoe eerlijk gemeten AI-oplossingen je supportdruk verlagen — begin op het gratis plan, zonder creditcard en zonder verkoopgesprek.