Super Sale WeekClaude Skills — 20% OFF
Tips

Hoe je een CSAT-rapport maakt dat aanzet tot actie

Powerdrill Team·
Hoe je een CSAT-rapport maakt dat aanzet tot actie

Twee teams ondervragen dezelfde klanten op dezelfde dag. Het ene team rapporteert 82%, het andere 4.1.

Beide hebben gelijk. Het ene team gebruikte de percentagemethode en het andere nam het gemiddelde van de scores, en de bron die de metriek definieert, staat beide toe.

Dat is het eerste wat je moet bepalen voordat je het rapport opstelt. De formule is een keuze, geen standaard.

Deze gids behandelt wat het rapport moet bevatten en de twee legitieme formules. Vervolgens bespreken we waarom de schaal en de timing bepalen wat je leert, en hoe je het rapport genereert op basis van een export van de enquête.

Wat een CSAT-rapport moet bevatten

De score is slechts één regel. Het rapport is wat die regel bruikbaar maakt.

Zes dingen horen in hetzelfde overzicht thuis. De score, de gebruikte formule, de schaal, het aantal reacties, de ondervraagde populatie en het triggermoment.

De trigger is het element dat in de meeste rapporten ontbreekt. Een score die direct na een supportgesprek wordt verzameld en een score na 30 dagen bezit zijn verschillende metingen met dezelfde naam.

Voeg ook de distributie toe. Behoud het aantal stemmen voor elk punt op de schaal, want het reduceren tot één enkel getal gooit de verdeling definitief weg.

Het aantal reacties weegt zwaarder dan men verwacht. Bij 40 reacties kan een handvol mensen dat één punt verschuift de score al met meerdere punten doen schommelen.

Twee legitieme formules, twee verschillende getallen

Qualtrics definieert de metriek en de berekening ervan op haar CSAT-pagina, en noemt beide benaderingen.

De percentagemethode is degene die stapsgewijs wordt uitgelegd. Je "gebruikt de reacties van 4 (tevreden) en 5 (zeer tevreden)" en past vervolgens de gepubliceerde formule toe.

De formule luidt als volgt: het aantal tevreden klanten, gedeeld door het aantal reacties op de enquête, vermenigvuldigd met 100.

Er is een duidelijke reden voor deze 'top-two'-regel. De pagina vermeldt dat "het gebruik van de twee hoogste waarden in feedbackenquêtes de meest nauwkeurige voorspeller is van klantbehoud."

De gemiddelde-methode wordt op dezelfde pagina erkend. Resultaten "kunnen worden gemiddeld om een Composite Customer Satisfaction Score te geven," hoewel scores "meestal worden uitgedrukt op een percentageschaal."

Percentagemethode Gemiddelde-methode
Output 0% tot 100% Een getal op je schaal
Behandelt een 3 als Niet tevreden Middelmatig
Gevoelig voor Verschuiving over de grens tussen 3 en 4 Elke verschuiving
Vergelijkbaar met gepubliceerde benchmarks Meestal wel Zelden

Kies er één en vermeld deze op het rapport. De twee zijn niet onderling herleidbaar, en een team dat halverwege het jaar overstapt, verpest zijn eigen trend.

Een gerelateerde metriek volgt een andere regel. NPS sluit de middengroep uit van beide percentages, terwijl CSAT iedereen in de noemer houdt. Onze gids voor het maken van een NPS-rapport behandelt die vergelijking.

Waar de schaalbeslissing impact heeft

Qualtrics presenteert CSAT op een vijfpuntsschaal, lopend van zeer ontevreden tot zeer tevreden.

De standaardformulering van de vraag is ook gepubliceerd. Er wordt gevraagd hoe de klant "je algehele tevredenheid met de ontvangen [goederen/diensten] zou beoordelen."

Veel tools leveren in plaats daarvan standaard een zeven- of tienpuntsschaal. Dat is niet fout, maar het herberekenen verandert wel.

De 'top-two'-regel blijft bij een schaalwijziging niet intact. Twee opties van de vijf is de bovenste 40% van de schaal, terwijl twee opties van de tien de bovenste 20% is.

Dus een enquête met een tienpuntsschaal die wordt gescoord op basis van de bovenste twee opties, zal een lagere CSAT rapporteren dan een enquête met een vijfpuntsschaal bij een identiek sentiment. Dat is een meetartefact, geen signaal van de klant.

Hieruit volgen twee regels, die beide eenvoudig toe te passen zijn. Bevries de schaal en noteer deze naast elke score die je publiceert.

Als je de schaal echt moet veranderen, behandel deze dan als een nieuwe reeks. Noteer de datum van de wijziging en stop met het vergelijken van gegevens van voor en na die datum.

Wanneer je het vraagt, verandert wat je leert

Timing is een ontwerpbeslissing die door dezelfde bron als cruciaal wordt beschouwd.

Qualtrics omschrijft CSAT als een "hier en nu"-metriek die "betrekking heeft op een specifieke ervaring in plaats van op een doorlopende klantrelatie."

Dat bepaalt wanneer de vraag zinvol is. Voor afzonderlijke interacties, zoals een telefoontje naar een contactcenter, adviseert de pagina om dit onmiddellijk te vragen, wanneer het gesprek nog vers in het geheugen ligt.

Voor iets dat over een langere periode wordt gebruikt, geldt het omgekeerde advies. Bij een abonnement of een duurzaam product kan het dagen of weken duren voordat de klant er een oordeel over kan vellen.

Dit heeft twee praktische gevolgen. Eén gecombineerde CSAT voor beide soorten contactmomenten is vrijwel betekenisloos; de oplossing is om te rapporteren per trigger.

De pagina waarschuwt ook voor de frequentie. Een terugkerende klant te vaak om feedback vragen "kan zijn eigen problemen veroorzaken", wat in je gegevens zichtbaar wordt als een dalend responspercentage.

Houd dat percentage in de gaten als een op zichzelf staande metriek. Een score die stijgt terwijl het aantal reacties daalt, is meestal het gevolg van survivorship, niet van verbetering.

Hoe je dit handmatig doet

Optie 1: Twee tellingen en één deling

Tel de reacties met een 4 en 5 met COUNTIFS, en tel vervolgens alle reacties met COUNTA in de beoordelingskolom.

Het is belangrijk om COUNTA te gebruiken op de beoordelingskolom in plaats van op het aantal rijen. Lege beoordelingen zijn geen nullen, en als je ze in de noemer opneemt, trekt dat de score omlaag.

Deel één keer aan het einde en houd beide tellingen zichtbaar. Iedereen zou je getal moeten kunnen herberekenen op basis van de twee cellen erboven.

De beperking is dat je één score krijgt voor één periode, zonder inzicht in welk contactmoment of segment is verschoven.

Optie 2: De volledige distributie

Houd de telling bij voor elk punt op de schaal en leid vervolgens zowel het percentage als het gemiddelde af uit dezelfde tabel.

Het eenmalig tonen van beide is nuttig als sanity check. Als de twee een tegenovergesteld verhaal vertellen, heb je te maken met een bimodale verdeling en zal een enkel cijfer misleidend zijn, welke kant je ook opgaat.

Nu kan het rapport worden gesegmenteerd: per trigger, per product, per kanaal, per medewerker of per klantduur.

Het echte inzicht zit meestal in de segmentatie. Achter een gezonde, gecombineerde score gaat vaak één kanaal schuil dat een heel punt onder de rest scoort.

De grens ligt bij joins en datavolume. Het koppelen van enquêtereacties aan account- of ticketgegevens gaat het punt te buiten waarop formules nog handig werken.

Optie 3: Een tabblad met definities

Leg de formule, de schaal, de formulering van de vraag, de trigger en de populatie vast.

De formulering van de vraag hoort niet zonder reden op die lijst thuis. Een anders geformuleerde vraag levert een andere score op, wat ten onrechte kan worden geïnterpreteerd als een verandering in het sentiment.

Leg ook de uitsluitingen vast. Interne testers, dubbele inzendingen en reacties buiten het geldige bereik hebben elk een vastgestelde verwerking nodig.

De beperking is bekend: het opschrijven van een regel betekent nog niet dat deze wordt toegepast, en de volgende cyclus bouwt iemand gewoon weer dezelfde filters op.

De gezamenlijke beperking. Alle drie de opties gaan ervan uit dat de export een trigger of enquête-ID bevat. Zonder deze kan een gecombineerde score niet opnieuw worden opgesplitst in de ervaringen die deze hebben voortgebracht.

Waar de handmatige methode vertraagt

Het eerste rapport kost een uur. Het vierde kost meer tijd, omdat er inmiddels drie dingen zijn veranderd.

Enquêtetools veranderen de schaal tijdens een herontwerp, en niemand legt het verband tussen de verschuiving in de score en het formulier.

De populatie breidt zich ongemerkt uit. Een enquête die naar alle contacten wordt gestuurd in plaats van alleen naar recente kopers, trekt mensen aan die recentelijk niets hebben meegemaakt om te beoordelen.

Vervolgens worden er benchmarks geciteerd. Qualtrics merkt op dat het benchmarken van CSAT "geen exacte wetenschap is", waarbij ze verwijzen naar de ACSI voor branchecijfers, terwijl ze benadrukken dat elk bedrijf en elk product verschilt.

Hun meest bruikbare advies is eenvoudiger: als je score stijgt, doe je iets goed.

Er is een vierde pijnpunt dat vlak voor de deadline de kop opsteekt. Iemand vraagt of 82% goed is, en om die vraag te beantwoorden heb je de trend, de uitsplitsing per trigger en het aantal reacties nodig die je niet hebt meegenomen.

Wat betreft de tools is er een eigen overzicht in AI-software voor de analyse van enquêtegegevens.

Hoe je dit bouwt met Powerdrill Bloom

Stap 1: Upload de export van je enquête

Upload de export van de reacties rechtstreeks vanuit je enquêtetool. Powerdrill Bloom analyseert de kolommen bij binnenkomst, zodat lege beoordelingen, waarden buiten het bereik en dubbele respondent-ID's aan het licht komen voordat er een score wordt berekend.

Upload een enquête-export om een CSAT-rapport te maken in Powerdrill Bloom

Stap 2: Beschrijf het rapport in natuurlijke taal

Formuleer de regels in plaats van ze te bouwen. Noem de beoordelingskolom, de schaal, de formule, de periode, de populatie en het triggerveld.

Stel vervolgens de vragen die fouten opsporen. Vraag hoeveel reacties leeg zijn of buiten de schaal vallen. Vraag om zowel het percentage als het gemiddelde op basis van dezelfde gegevens. Vraag vervolgens om de score uitgesplitst naar trigger en segment.

Stap 3: Exporteer de grafiek, het rapport of de presentatie

Exporteer de score met de volledige distributie, een trend over verschillende perioden, of dia's die de formule en het aantal reacties naast het getal tonen.

Exporteer het CSAT-rapport met de volledige distributie

Veelgemaakte fouten

De formule niet vermelden. Het percentage en het gemiddelde zijn beide legitiem en niet vergelijkbaar. Geef duidelijk aan welke je hebt gebruikt.

De schaal halverwege de reeks veranderen. Een enquête met een vijfpuntsschaal en een met een tienpuntsschaal leveren verschillende scores op bij een identiek sentiment. Behandel een wijziging als een nieuwe reeks.

Lege velden als nullen tellen. Geen reactie is niet hetzelfde als ontevredenheid. Sluit lege velden uit van zowel de teller als de noemer.

Triggermomenten combineren. Scores direct na een gesprek en scores na 30 dagen meten verschillende dingen. Rapporteer ze afzonderlijk.

De score rapporteren zonder het aantal reacties. Kleine steekproeven schommelen hevig. Zet het aantal reacties altijd naast het cijfer.

Een stijgende score bij een dalend aantal reacties interpreteren als verbetering. Dit patroon is meestal het gevolg van survivorship. Houd daarnaast ook het responspercentage bij.

De benchmark van een andere branche als doel stellen. Benchmarken is hier geen exacte wetenschap. Gebruik je eigen trend als referentiekader.

Conclusie

Kies de formule, bevries de schaal en de formulering, rapporteer per trigger en publiceer de score samen met het aantal reacties en de distributie.

De score is niet het eindproduct. De trigger of het segment dat achterblijft bij de rest, vertelt je waar je volgende maand je aandacht op moet richten.

Als het samenstellen van dat overzicht je elke cyclus een hele week kost, probeer dan Powerdrill Bloom voor je enquête-export. Bekijk ook onze gids voor het omzetten van rommelige enquêtegegevens in duijke grafieken, plus de pagina's voor de voice of customer summarizer en de CSV AI assistant.

Veelgestelde vragen

Hoe wordt CSAT berekend?

De meest gebruikelijke methode deelt het aantal reacties met een 4 en 5 door het totale aantal reacties, en vermenigvuldigt dit vervolgens met 100. Het gemiddelde nemen van de ruwe scores is ook acceptabel en levert een ander getal op.

Waarom worden alleen de bovenste twee reacties gebruikt?

Qualtrics merkt op dat het gebruik van de twee hoogste waarden de meest nauwkeurige voorspeller is van klantbehoud. Bovendien maakt dit het resultaat leesbaar als een percentage.

Welke schaal moet een CSAT-enquête gebruiken?

Een vijfpuntsschaal van zeer ontevreden tot zeer tevreden is de gepubliceerde standaard. Langere schalen werken ook, mits je de schaal consistent houdt en deze vastlegt.

Wanneer moet ik de enquête versturen?

Onmiddellijk na afzonderlijke interacties, en na enkele dagen of weken voor producten die over een langere periode worden gebruikt. CSAT meet een specifieke ervaring in plaats van de algehele relatie.

Is CSAT hetzelfde als NPS?

Nee. CSAT houdt elke respondent in de noemer, terwijl NPS het percentage detractors aftrekt van het percentage promoters en de middengroep uit beide uitsluit.