Likeability en stated intent voorspellen geen verkoop. Vier dingen die een goede ad test wél meet, en zes vragen om jouw huidige tool te toetsen.
De meeste reclames werken niet. Dat is geen mening, dat is wat tien jaar aan in-market effectmetingen consistent laat zien. Het merendeel van de campagnes levert geen meetbare lift op in salience, voorkeur of verkoop. En toch wordt bijna elk creatief idee goedgekeurd op gevoel — een bureau presenteert, het team knikt, het budget gaat door.
Ad testing zou dat moeten oplossen. Een goede pretest vertelt je vóór je media-inkoop of de uiting gaat werken, en zo niet, wat je eraan kunt doen. Maar “ad testing” is een breed begrip. Wat de ene tool een test noemt, is in feite een enquête waarin tien mensen wordt gevraagd of ze de reclame leuk vinden. Dat is geen test. Dat is een opiniepeiling met statistische ruis.
Deze gids beschrijft wat een echte ad test zou moeten meten, en waarom de meeste oude metrics een onbetrouwbaar signaal afgeven.
Eerst: waarom intentievragen niet werken
De klassieke pretest vraagt mensen of ze het product zouden kopen na het zien van de reclame. Het probleem: ongeveer 95% van koopbeslissingen wordt onderbewust genomen, gedreven door snelle System 1-processen — geheugenassociaties, emotie, contextherkenning. De vraag “zou u dit product kopen?” activeert System 2: het bewuste, beredeneerde brein.
Wat krijg je terug? Geen voorspelling van gedrag. Een sociaal wenselijk antwoord van een respondent die rustig in een onderzoeksomgeving zit, niet afgeleid wordt door zijn telefoon, en zijn best doet behulpzaam te zijn.
Een goede ad test omzeilt dat probleem. Hij meet niet wat mensen denken dat ze gaan doen. Hij meet de signalen die voorspellen wát ze gaan doen.
De vier dingen die een goede ad test wél meet
1. Emotionele respons — en wanneer hij piekt
Emotie is de motor van geheugenopslag. Reclames die geen emotionele respons oproepen (positief, negatief of beide) worden simpelweg niet onthouden. Dat is geen meningsverschil onder onderzoekers; het is consensus.
Maar de meeste tools meten emotie als één getal aan het eind: “vond u deze reclame prettig?” Dat is veel te grof. Een goede test meet emotie seconde voor seconde. Dat onthult de écht bruikbare informatie: waar piekt de emotie? Waar zakt hij in? En cruciaal: valt de emotionele piek samen met het moment waarop je merk in beeld is?

Behavio’s ad testing-platform — positieve vs. negatieve emotie
Als de piek op seconde 12 zit en je logo verschijnt op seconde 28, heb je een mooie reclame gemaakt voor iets dat niemand zich zal herinneren als jouw merk.
2. Brand recall — en of het stickert
Brand recall is een van de oudste metrics in ad testing, maar wordt zelden goed gemeten. De gangbare aanpak: laat de reclame zien, wacht een dag of een week, en vraag welk merk geadverteerd werd. Dat meet wat mensen onthouden hebben, maar niet waarom.
De betere aanpak: meet brand recall seconde voor seconde, in combinatie met de emotionele curve. Dan zie je niet alleen óf mensen het merk koppelen, maar wáár in de reclame die koppeling ontstaat, of juist niet ontstaat.

Behavio’s ad testing-platform — merkherinnering vs. positieve emotie
Een veelvoorkomende fout heet “sticker branding”: het logo komt vaak in beeld, maar is niet verweven met het verhaal. Mensen onthouden de reclame, niet het merk. Een test die dit ontdekt, vertelt je iets concreets: zet de merkcue eerder neer, integreer hem in de actie, zorg dat het merk de held van de scène is in plaats van een logo in een hoekje.
3. Aandacht — wat mensen daadwerkelijk zien
Tussen “ad geserveerd” en “ad bekeken” zit een enorme kloof. In een digitale feed scrollt iemand in 1,7 seconden door je advertentie als er geen reden is om te stoppen. Aandachtsmeting beantwoordt de vraag: wat ziet iemand daadwerkelijk in die eerste seconden?
Moderne ad testing tools gebruiken AI-modellen die zijn getraind op echte eye-tracking-data om voorspellingen te genereren van wáár het oog naartoe gaat, frame voor frame. Dat levert een hittekaart op die laat zien of je productshot opvalt of in een visueel ruisende achtergrond verdwijnt, of de tekst leesbaar is in de eerste seconde, en of de merkidentiteit überhaupt in het aandachtsveld valt.

Behavio’s ad testing-platform — aandachtsheatmaps
Geen aandacht, geen merk in het geheugen. Het is letterlijk een voorwaarde.
4. Behoefte-koppeling — de stap die bijna iedereen overslaat
Mensen kopen geen merken; ze kopen oplossingen voor behoeften. “Iets snels voor onderweg.” “Iets dat veilig voelt voor mijn gezin.” “Iets dat indruk maakt zonder duur te lijken.”
Een reclame die emotie oproept, het merk goed cuet, en de aandacht vasthoudt, kan nog steeds falen als hij niet duidelijk maakt aan welke behoefte je merk een antwoord biedt. En cruciaal: of die behoefte überhaupt vrij is om te claimen, of al stevig in handen van een concurrent.
Een goede ad test meet of de bedoelde behoefte of koopmoment daadwerkelijk gekoppeld wordt aan het merk in het hoofd van de kijker. Niet via een directe vraag (“waar gaat deze reclame over?”), maar via impliciete tests die de werkelijke associatie meten.
Wat een goede ad test níet hoeft te meten
Een paar metrics die zwaarder wegen in oude tools dan ze verdienen:
Likeability. Of mensen je reclame “leuk” vinden voorspelt geen verkoop. Veel van de meest effectieve reclames in de geschiedenis zijn polariserend. Dove’s Real Beauty was bij lancering controversieel. Likeability meet beleefdheid, niet impact.
Bewust recall na een week. Te traag, te duur, en te zwaar afhankelijk van mediadruk. Tegen de tijd dat je deze data hebt, staat de campagne al twee weken in de lucht. Een pretest zou jou voor de launch al moeten vertellen of recall waarschijnlijk is.
Click-through op een test-bumper. CTR meet of een statisch element triggert binnen een testcontext. Het zegt niets over of de campagne brand equity opbouwt of verkoop genereert op langere termijn.
Praktisch: hoe weet je of jouw ad test goed is?
Stel deze zes vragen aan je huidige tool of leverancier:
- Meet hij emotie seconde voor seconde, of als één gemiddelde? Eén gemiddelde is bijna nutteloos.
- Meet hij brand recall in combinatie met de emotionele curve? Zo niet, weet je niet of de piek werkt voor jouw merk of voor een concurrent.
- Geeft hij een aandachtshittekaart, gebaseerd op gevalideerde eye-tracking-modellen? Vragen “wat viel u op?” is geen aandachtsmeting.
- Test hij of het merk gekoppeld is aan de bedoelde behoefte — impliciet, niet via een directe vraag? Direct vragen activeert System 2 en geeft beleefde antwoorden.
- Geeft hij scene-niveau-aanbevelingen, of alleen een eindcijfer? “Score 72 van de 100” vertelt je niets; “verplaats de merkcue naar seconde 2 en knip de derde scène” wel.
- Levert hij resultaten op tijd om iets te veranderen? Vijf tot zeven dagen is werkbaar. Drie weken is te laat — dan ben je al gelanceerd of het bureau heeft de creatives al ingeleverd.
Moderne ad testing tools zoals Behavio leveren geen losse score, maar een diagnose van precies wat werkt, wat niet, en waar je in moet grijpen voordat het geld de deur uitgaat.
De kern
Een goede ad test voorspelt niet alleen of een reclame “goed” of “slecht” is. Hij vertelt je waaróm — op een niveau dat je creatief team morgen kan gebruiken om hem beter te maken.
Likeability-scores en stated intent zijn comfortabel omdat ze bekend zijn. Maar als je ad test je niet vertelt waar je merkcue te laat staat, waar de emotionele piek wegvalt of welke behoefte ongeclaimd is, dan test je niet. Dan vraag je beleefd om een mening.
Echt testen voor media-inkoop is geen luxe. Het is de goedkoopste verzekeringspolis die er bestaat. De meeste campagnes mislukken stilletjes. Een goede pretest is wat zorgt dat de jouwe daar niet bij hoort.

