Terug naar blog
Een geprinte vragenlijst met een zwarte pen erop op een houten tafel, ernaast een waaier van meer vragenformulieren en een cactusje met een rode bloem in een betonnen potje
Enquêteontwerp2 oktober 202610 min lezen

Een enquête herhalen zonder je trend te breken

Een enquête die je elk kwartaal verstuurt, heeft pas waarde als je dit kwartaal met het vorige kunt vergelijken. Dit breekt die vergelijking ongemerkt, en zo pas je een enquête aan zonder je trend kwijt te raken.

Door SurveyLane · Het team achter SurveyLane

Een eenmalige enquête beantwoordt een vraag. Een enquête die je elke maand of elk kwartaal herhaalt, moet een andere vraag beantwoorden: is er iets veranderd? Die tweede vraag is ook makkelijker kapot te maken. Pas één woord aan, wissel een schaal of verhuis de enquête van e-mail naar een pop-up in je product, en de lijn in je grafiek beweegt terwijl niemands mening is veranderd.

Een trend is een vergelijking

Zet je de tevredenheidsscore van dit kwartaal naast die van vorig kwartaal, dan beweer je dat het verschil komt doordat de mensen die je ondervraagt zijn veranderd. Dat klopt alleen als al het andere gelijk bleef: de vraag, de antwoordopties, wat ervoor kwam, de uitnodiging, wie er werd uitgenodigd. Elk van die dingen verschuift antwoorden op eigen kracht. Een trendlijn gaat er stilzwijgend van uit dat geen ervan bewoog.

Vraag dus eerst wat er tussen de metingen veranderde, los van het ding waar je om geeft. Is het eerlijke antwoord "we hebben de vraag herschreven en zijn van tool gewisseld", dan heb je twee aparte enquêtes die toevallig dezelfde grafiek delen.

Bevries het instrument vóór de eerste meting

De nuttigste beslissing voor een trendenquête neem je vóór meting één: welke vragen vormen de vaste kern. Die vragen liggen vast. Zelfde formulering, zelfde opties, zelfde volgorde, zelfde plek, zelfde introductietekst. De rest mag rouleren.

Steek meer tijd in die kern dan nodig lijkt, en test hem. De gids over een enquête vooraf testen laat zien hoe je formuleringsproblemen vindt zolang ze nog gratis te herstellen zijn. Ontdek je hetzelfde probleem in meting vier, dan kost het je een trendbreuk. In een pretest kost het een middag.

Het bekendste voorbeeld komt uit de Amerikaanse General Social Survey, die al tientallen jaren vraagt of de overheid te veel, te weinig of ongeveer genoeg uitgeeft aan een lijst prioriteiten. Eén versie van het item zegt "welfare" (bijstand). Een andere zegt "assistance to the poor" (hulp aan armen). Ruwweg hetzelfde beleidsterrein. Toch verschilt het aandeel dat zegt dat er te weinig wordt uitgegeven tussen die twee jaar na jaar tientallen procentpunten.

"Hoe tevreden ben je over onze support?" vraagt om een oordeel over een afdeling. "Hoe tevreden ben je over de hulp die je kreeg van ons supportteam?" vraagt om een oordeel over het laatste gesprek. Stap je tussen Q2 en Q3 van de ene op de andere over, dan komt een deel van elke beweging in de score door jouw aanpassing. In het artikel over betere enquêtevragen schrijven lees je waarom formulering zoveel gewicht heeft.

De schaal hoort bij de vraag

Verander je de antwoordopties, dan verander je de vraag, ook als de vraagtekst woord voor woord gelijk blijft. Van vijf naar zeven punten gaan verandert de verdeling. Een gelabeld middelpunt toevoegen doet dat ook, net als "Zeer ontevreden" vervangen door "Uiterst ontevreden" of de richting omdraaien zodat het positieve uiteinde eerst komt. Achteraf samenvoegen tot een "top-2-box" maakt dat niet ongedaan.

Meerkeuzelijsten werken net zo. Voeg een nieuwe optie toe aan een lijst met opzegredenen en een deel van de mensen die eerst "anders" of "te duur" kozen, kiest nu de nieuwe. De oude categorieën krimpen en het lijkt alsof het probleem ook kromp. Wil je een schaal waar je jaren mee kunt leven, lees dan de gids over schaalvragen ontwerpen vóór de eerste meting. Na de vijfde is het te laat.

Wat vóór een vraag komt, verandert hem ook

Context hoort bij het instrument. Stel je de algemene tevredenheidsvraag direct na vijf vragen over de storing van vorige week, dan scoort hij lager dan wanneer je hem als eerste stelt. Mensen nemen de storing mee in hun totaaloordeel. Het artikel over vraagvolgorde-effecten legt uit hoe dat werkt en wanneer het ertoe doet.

Voor een trendenquête volgt daar iets eenvoudigs uit. De wisselende module komt na de vaste kern, nooit ervoor. Zet de kern aan het begin, in dezelfde volgorde, elke keer.

Een andere modus geeft andere antwoorden

Hoe een enquête mensen bereikt, is onderdeel van de meting. In 2015 publiceerde Pew Research Center een experiment waarin 3.003 respondenten willekeurig werden toegewezen aan dezelfde vragen, telefonisch met een interviewer of zelfstandig op het web. Over 60 vragen was het gemiddelde verschil tussen de twee modi 5,5 procentpunt, en sommige verschillen waren veel groter. Telefonisch zei 62% zeer tevreden te zijn met het gezinsleven. Op het web was dat 44%.

De richting is consequent. Zonder een interviewer die meeluistert, geven mensen minder sociaal wenselijke antwoorden. Kleinere moduswissels werken op dezelfde manier. Een enquête op een laptop na een uitnodiging per e-mail is een andere situatie dan een vraagje van twee items dat iemand midden in je product onderbreekt. Wissel je van kanaal, reken er dan op dat de cijfers bewegen. Die beweging komt van het kanaal.

Moet een vraag toch anders, bouw dan een brug

Soms is een vraag gewoon slecht en betekent bevriezen dat je voor altijd het verkeerde meet. Je kunt hem aanpassen en toch je geschiedenis houden. De standaardmethode is een brugmeting: verdeel de respondenten voor één meting willekeurig, zodat de helft de oude versie ziet en de helft de nieuwe.

Beide helften zijn aselecte steekproeven uit dezelfde groep, dus het verschil ertussen is het effect van de formulering zelf. Stel dat de oude vraag 68% tevreden oplevert en de nieuwe 61% in dezelfde meting. Dan weet je dat de nieuwe formulering zo'n zeven punten lager uitvalt, en kun je dat in de grafiek aantekenen. Anders denkt de lezer dat de tevredenheid daalde. Plan de brug in een meting met goede respons, want elke helft heeft genoeg respondenten nodig.

Geen ruimte voor een brug? Wees dan eerlijk in de grafiek. Onderbreek de lijn op het moment dat de vraag veranderde, zet er een label bij en trek geen doorlopende trend over die breuk heen.

Houd ook de populatie constant

Bevroren vragen helpen niets als de groep verschuift. Dan breekt je trend alsnog. Ging meting één naar alle klanten en meting drie alleen naar klanten die de afgelopen 30 dagen inlogden, dan is die tweede groep per definitie betrokkener en scoort hij beter. Hetzelfde gebeurt als je een nieuwe markt opent of als HR ineens ook ingehuurde krachten als medewerkers meetelt.

Leg de steekproefregel net zo zorgvuldig vast als de vragen: wie komt in aanmerking, hoe kies je ze, wanneer benader je ze. Houd daarna naast de hoofdscore ook het responspercentage en de samenstelling van elke meting bij. Een stijging in tevredenheid die samenvalt met nieuwe klanten die niet meer reageren, is waarschijnlijk een verandering in wie er antwoordde. Het artikel over steekproefkwaliteit legt uit waarom de mensen die niet reageren je resultaten vormen, en de gids over enquêtedata wegen laat zien hoe je corrigeert voor een bekende verschuiving in samenstelling.

Panels en nieuwe steekproeven beantwoorden verschillende vragen

Je kunt een enquête op twee manieren herhalen. Je trekt elke meting een nieuwe steekproef, of je volgt dezelfde mensen in een panel. Nieuwe steekproeven laten zien hoe de populatie verandert. Een panel laat zien hoe individuen veranderen, en alleen zo zie je dat de klanten die in het voorjaar ontevreden waren dezelfde zijn die in de zomer vertrokken.

Panels brengen twee zorgen mee. De eerste is uitval: mensen haken af, en wie blijft is zelden een willekeurige deelgroep. De tweede is panelconditionering, waarbij het steeds opnieuw ondervraagd worden over een onderwerp verandert hoe mensen zich gedragen of antwoorden. Pew Research Center testte dat in 2021 op zijn eigen American Trends Panel. Het vond geen aanwijzingen dat conditionering de schattingen voor nieuwsconsumptie, praten over politiek, partijvoorkeur of stemmen had vertekend. De enige uitzondering was een lichte toename in registratie als kiezer nadat mensen tot het panel toetraden. Geruststellend voor een groot panel met wisselende onderwerpen, minder voor een klein panel dat elke twee weken over dezelfde productfunctie wordt bevraagd.

Hoe vaak je meet is een ontwerpkeuze

Laat de frequentie afhangen van twee dingen: hoe snel het ding dat je meet echt kan veranderen, en hoe snel jij kunt handelen op wat je leert. Elke week vragen naar het algemene vertrouwen in je bedrijf heeft geen zin: dat verschuift niet zo snel, en de ruis tussen metingen gaat eruitzien als signaal. Eén keer per jaar vragen naar een nieuwe onboarding is te traag, want die heb je tegen die tijd drie keer omgebouwd.

Frequentie kost ook respons. Elke uitnodiging teert op dezelfde welwillendheid, en mensen die vermoeden dat niemand hun antwoorden leest, stoppen met antwoorden. Wie blijft reageren lijkt niet op wie afhaakt, dus je data raakt scheef terwijl hij ook dunner wordt. Houd elke meting kort. Het artikel over enquêtelengte en uitval laat zien hoe snel de antwoordkwaliteit daalt naarmate een enquête groeit.

Echte verandering onderscheiden van ruis

Twee metingen geven bijna nooit hetzelfde getal, ook als er niets veranderde. Elke meting is een steekproef met een foutmarge. En de foutmarge op het verschil tussen twee metingen is groter dan die van elke meting afzonderlijk.

Met 400 respondenten per meting en een uitkomst rond 50% heeft elke meting een foutmarge van ongeveer ±4,9 procentpunt bij 95% betrouwbaarheid. Het verschil tussen twee zulke metingen heeft een foutmarge van ongeveer ±6,9 punt, omdat de onzekerheid van beide steekproeven optelt. Een stap van 52% naar 56% valt daar ruim binnen. In het artikel over hoeveel respondenten je nodig hebt lees je hoe je die getallen voor je eigen enquête uitrekent.

Wacht op drie of meer metingen voordat je een richting benoemt, want één afwijkende meting is veel vaker ruis dan nieuws. En zet het aantal respondenten naast elke score, zodat iedereen die de grafiek leest kan zien wanneer een sprong op een dunne steekproef rust.

Houd een wijzigingslog van je vragenlijst bij

De meest praktische bescherming is een simpel wijzigingslog voor de enquête zelf. Elke meting krijgt een gedateerde regel: de kernvragen, eventuele aanpassingen aan formulering of opties, het kanaal, de steekproefregel, de veldperiode, het aantal responses en wat er rond die tijd speelde, zoals releases, storingen en prijswijzigingen. Daalt de score in maart, dan zoek je het op.

Het helpt ook wie de data daarna analyseert, mens of AI. Bevraag je je resultaten via de MCP-server van SurveyLane, dan kan de assistent metingen vergelijken, maar hij kan niet weten dat de vraag in meting vier veranderde als jij dat niet vertelt. Het wijzigingslog is die context.

Veelgestelde vragen

Kan ik een typfout in een trendvraag verbeteren zonder de trend te breken?

Een pure typfout die mensen hoe dan ook hetzelfde lezen, zoals een ontbrekende letter, kun je veilig verbeteren. Alles wat betekenis, nadruk of leesritme verandert is een formuleringswijziging, hoe klein het ook voelt. Twijfel je, draai dan een brugmeting of markeer de breuk in de grafiek.

Hoeveel respondenten heb ik nodig voor een brugmeting?

Elke helft van de splitsing moet groot genoeg zijn om het verschil tussen oude en nieuwe formulering met bruikbare precisie te schatten. Met een paar honderd respondenten per helft zie je verschillen van rond de tien procentpunt, en kleinere formuleringseffecten vragen om grotere groepen. Is je normale meting klein, spreid de brug dan over twee opeenvolgende metingen.

Moet ik mijn scores vergelijken met benchmarks uit de branche?

Alleen als de benchmark dezelfde vraag, dezelfde schaal, dezelfde modus en een vergelijkbare populatie gebruikte. De meeste benchmarks documenteren die details niet, waardoor het verschil echte prestaties mengt met meetverschillen die je niet uit elkaar kunt halen. Je eigen trend door de tijd is meestal de betrouwbaardere vergelijking.

Is het een probleem om nieuwe vragen aan een trendenquête toe te voegen?

Vragen toevoegen kan prima als ze na de vaste kern komen en de enquête niet zo lang wordt dat voltooiing en antwoordkwaliteit dalen. Vragen vóór de kern veranderen de context ervan, en een langere enquête verandert wie hem afmaakt, dus allebei kunnen de trendscores indirect verschuiven.

Verder lezen