Hoe kan ik meer marketingexperimenten uitvoeren met maar één marketeer?

Meer experimenten met één marketeer komen uit een kleiner bouwwerk, niet uit meer campagnes. Houd per periode één groeivraag aan. Test een grote variabele in de kleinste vorm die jouw vraag beantwoordt. Leg vooraf de primaire metric en de stopregel vast. Automatiseer varianten en het rapport. Het oordeel en de belofte blijven bij de marketeer.

Meer tests komen uit een kleinere uitvoering

Meer marketingexperimenten met één marketeer krijg je niet door meer campagnes te openen. Je krijgt ze doordat elke test in uren gebouwd is en de uitkomst nog wel bepaalt wat je volgende week doet.

Een experiment toetst een hypothese. CXL noemt hem pas bruikbaar als een uitkomst hem kan onderuithalen. De nulhypothese is geen verschil: je bewijst de stelling niet, je kijkt of het bewijs daartegen sterk genoeg is. Voor één persoon geldt de kleinste vorm in tools die je al hebt, zonder developer en zonder een nieuw merkverhaal.

GroeivraagTe groot voor deze weekKleinste vorm
Welke zin trekt de koper?Het merk opnieuw positionerenEén advertentie of één landingspagina met die zin
Welk kanaal is het waard?Een kanaal volledig optuigenEén doelgroep, één boodschap, een einddatum
Welk aanbod verlaagt de drempel?Een nieuwe propositie uitrollenEén call to action met een ander aanbod
Welke contenthoek trekt?Een hele contentstrategieEen paar posts met die ene hoek
Welke onderwerpregel opent?Een hele mailreeks bouwenTwee onderwerpregels in dezelfde mail

De variabele is groot, het bouwwerk blijft klein

Klein slaat op de uitvoering, niet op de vraag. Je verandert doelgroep, pijn, propositie, aanbod of kanaal. Een knopkleur levert zelden een inzicht dat je in advertenties, op de site, in mail en in sales hergebruikt.

HubSpot scheidt drie lagen. Hoge leerwaarde zit in: welk type klant het snelst in de pipeline komt, welke belofte activeert, welke actie voorspelt dat iemand blijft. Lage leerwaarde blijft op één element van één pagina. Een personahypothese is het geheel: doelgroep, boodschap, pad en activatie. Eén asset leert dan te weinig.

LaagVraag die de vorm beantwoordt
A/B-testWelke versie presteert beter onder dezelfde omstandigheden?
ConversieoptimalisatieHoe converteert dit pad meer van het verkeer dat het al krijgt?
Growth experimentationWelke verandering geeft een zakelijk effect, voor welk publiek, en schaal je die?

Supermetrics trekt dezelfde grens: een kleine wijziging geeft een kleine beweging, en bij weinig verkeer is de methode minder wetenschappelijk. Je test dan alsnog, met één periodevraag.

Eén metric, opgeschreven voor de start

Elk experiment heeft één verandering, één primaire metric en een stopregel voordat iets live gaat.

CXL laat je hypothese, uitkomst, methode, steekproef, segmenten en looptijd vooraf vastleggen. Achteraf zoeken tot een cijfer significant oogt, is geen analyse.

Een guardrail bewaakt een onbedoeld negatief effect, het onderscheid dat Amplitude maakt. HubSpot waarschuwt dat klikratio en opens kunnen stijgen terwijl de pipeline daalt. Sterke primaire metrics: aanmelding naar activatie, demo naar kans, activatie naar retentie. CXL noemt omzet een trage uitkomst, naast downloads en aanmeldingen. Zet die als guardrail, en kijk of de vroege beweging later nog zichtbaar is: activatie met retentie, aanmeldingen met de kwaliteit van de pipeline.

Tussentijds stoppen omdat het dashboard mooi is, heet peeking en blaast schijnverschillen op (Amplitude). Eerder stoppen mag alleen sequentieel, bij een groter effect (Optimizely). Anders wacht je de einddatum of de steekproef.

De steekproef komt uit de baseline en het kleinste effect dat de beslissing zou veranderen. Bij basic consent mode telt alleen wie statistiekcookies accepteerde. Wie weigert, meet je niet. In Nederland is dat vaak een flinke groep (Monkeyvision). Onder de drempel voor modellering vult niemand die groep aan. Noteer of de steekproef alleen die groep is. Optimizely rekent daarna: benodigd bezoek is de steekproef maal het aantal varianten, de looptijd is dat bezoek gedeeld door het gemiddelde bezoek per dag. De gebruikelijke invoer is 5 procent significantie en 80 procent power. Een kleiner effect vraagt meer waarnemingen, dus één grote test kan meerdere kleine verdringen. Significant en de moeite waard zijn twee oordelen. Meerdere tegelijk vraagt een grotere steekproef (Mailchimp).

Het logboek is het geheugen van de marketeer

Zonder rij herhaal je hypotheses en geef je de uren weg die de volgende test hadden moeten zijn.

Arjan Haring zet zes velden op het Experiment Canvas: feiten, een ontvankelijk publiek, een touchpoint, een trigger, het gewenste gedrag, en de metric. Zijn vorm: als dit publiek via dit touchpoint die trigger krijgt, zie ik dit gedrag in deze data. Zet de omdat-reden erachter, anders scheid je een mislukte test niet van een verkeerde verklaring. In dezelfde rij: de controle en de variant (ongewijzigd tegen de wijziging, Amplitude), de uren, de einddatum en de stopregel. Na afloop vier regels: wat je testte, wat je zag, waarom je stopte, wat je de volgende keer anders doet (HubSpot).

Ideeën zonder feit: contentideeën uit klantgesprekken. De meting zelf: experimenten opzetten en meten. Mailchimp scheidt marktonderzoek, dat ideeën levert, van de test, die één hypothese op een vooraf gekozen effect toetst. Dat het effect gedrag moet zijn en geen mening, is de regel van Haring.

Scoor leerwaarde hoger dan gemak

Geef impact, confidence en ease elk 1 tot 5 en rangschik op het gemiddelde. Supermetrics noemt die drie ICE. Ease duwt de knopkleur omhoog. Leg er de criteria van HubSpot naast: impact, leerwaarde over kanalen, bouwtijd, confidence, en of je de winnaar buiten het asset herhaalt. Supermetrics scheidt isoleren, als je de oorzaak wilt weten, van stapelen, als een troebele oorzaak acceptabel is.

Kies de bewijsvorm bij het verkeer dat je hebt

Een A/B-test is niet de standaard voor een startup met weinig verkeer. Kies de vorm bij het aantal waarnemingen.

VormWanneerConclusie die de vorm toelaat
SplitGenoeg bezoek voor het kleinste effect dat je beslissing verandertWelke variant beter scoorde, niet dat de hypothese waar is
SequentieelDe tool mag tussentijds stoppenEerder stoppen bij een groot effect, niet omdat de grafiek mooi is
Voor en naTe weinig verkeer voor een splitEen signaal naast seizoen en andere campagnes, geen oorzaak
Lift studyOf het kanaal extra resultaat geeftVerschil met wie de uiting niet zag
GeoMeerdere kanalen, of ook offlineEen indicatie per gebied, geen zekerheid als mensen veel reizen
Gesprek of met de handOf de zin kloptWelke formulering mensen herhalen, geen percentage
Knop zonder leveringOf er vraag is voor je bouwtOf mensen de volgende stap willen, niet dat het aanbod daarna werkt

Mailchimp waarschuwt dat eerst de ene groep en daarna de andere geen willekeurige verdeling is: het tijdstip kan meespelen. Verdeel willekeurig. Twee periodes waarin alleen die variabele verandert, laat Mailchimp wel toe. Amplitude zet overlap, een feestdag of een lancering erbij: noteer de storing, of kies een stabiele periode. Efraïm Salari laat het platform bij een lift study de controlegroep toewijzen. Twee platformen kunnen dezelfde persoon in controle en in de test zetten. Geo wijst gebieden toe, ook offline, en lekt waar mensen veel reizen. Attributie sluit niet uit dat de stijging ook zonder campagne kwam.

Frankwatching gaf op 1 juli 2020 klikroutes in Facebook Ads. Die route is geen handleiding voor elk account: volg de actuele help van het advertentieplatform. Wat blijft: één variabele, geen kopie van een lopend publiek, en de kracht vóór de start controleren. Vier dagen en dertig dagen zijn een platformadvies uit 2020, geen steekproef. De looptijd komt uit de steekproef, en Amplitude laat de meeste tests minstens één volle bedrijfscyclus lopen zodat de gewone variatie in het venster zit. Een test die alleen moet tonen dat een zin niet slechter is, vraagt minder waarnemingen dan een test op een kleine verbetering (CXL). Zie dashboards bouwen en campagnes sturen.

Automatiseer de productie, niet de belofte

AI en workflows maken varianten, tagging en het rapport. De marketeer houdt de hypothese, de stopregel en de belofte.

Zodra de rij af is, mag een workflow varianten, een pagina of mail uit een goedgekeurde template, tags en een rapportdraft maken. Intentie die het model verzint, tag je niet. Niets gaat live zonder jouw lezing, de test stopt niet vanzelf, en een reeks die een mens nog niet schreef gaat niet uit.

Zie marketing automatiseren zonder groot team, een marketeer met AI die meer werk verzet en wekelijkse marketingrapportage automatiseren.

Eén blok in de week, de test loopt door

Een vast blok levert meer afgeronde beslissingen op dan een losse experimentdag.

  1. Dertig minuten: het hoogste idee dat deze week af kan. Hypothese, metric, guardrail, stopregel.
  2. Zestig tot negentig minuten: de kleinste vorm. Geen tweede variabele.
  3. Laten lopen tot de einddatum of de steekproef. Kijk of de meting stuk is, niet om te beslissen.
  4. Dertig minuten: de vier regels in het logboek, dan pas een nieuw idee.

Een trage test blijft de lopende test. Voor je op live drukt: de periodevraag, één wijziging, de baseline of waarom een split niet kan, een publiek zonder overlap, en een mens die de belofte heeft gelezen.

Wanneer je geen extra experiment start

Meer tests is de verkeerde beweging als de meting, de belofte of de capaciteit het niet trekt.

Laat de backlog dicht als de metric of de baseline ontbreekt, dezelfde mensen al in een test zitten, de wijziging een developer of een nieuw merkverhaal vraagt, de propositie nog een mening is, een lancering in het venster valt zonder notitie, niemand de belofte heeft gelezen, het dashboard er voor de einddatum goed uitziet, of twee platformen dezelfde persoon aan controle en aan test toewijzen.

Zit de file na de klik, omdat leads binnenkomen en niemand ze pakt, dan is de eerstvolgende stap geen nieuwe advertentie. Zonder verkeer en zonder lijst leveren een paar gesprekken meer op dan een split die nooit volloopt.

De backlog en de eerste test zet ik zelf live

Ik ben Piet Baudoin. Ik werk als eenmanszaak Poldermarketing, remote, in het Nederlands en het Engels. Je huurt één marketeer in voor marketing, AI en automatisering, zonder dat je voor ieder onderdeel een aparte specialist nodig hebt.

Ik zet de backlog, de kleinste test en de workflow die de cijfers ophaalt in jouw accounts, en ik voer ze uit. Het doel is van onzichtbaar naar een gesprek met wie beslist. Ik ben sterk in AI, content, automatisering en het bouwen van workflows. Google Ads en Meta Ads zijn voor mij relatief nieuw. Ik zet ze op en ik kijk ze na. Grote budgetten schalen hoort daar niet bij.

Je kunt me freelance inhuren of een paar dagen per week. Wil je eerst zien hoe de voorpagina overkomt, doe dan de gratis groeiscan. Hoe een traject loopt, staat op werkwijze. De zin die je test, hoort bij positionering.

Veelgestelde vragen

Hoeveel experimenten haal je per maand met één marketeer?

Er is geen vast aantal dat voor elk bedrijf klopt. Eén afgeronde beslissing per week is een ritme dat één persoon volhoudt, mits de test in uren gebouwd is en het verkeer de looptijd bepaalt. Een test die weken data nodig heeft blijft open. Je start dan geen tweede split op dezelfde mensen. Het logboek telt afgeronde beslissingen, niet losse ideeën.

Moet elk marketingexperiment een A/B-test zijn?

Nee. Een split past als je genoeg waarnemingen hebt voor het kleinste effect dat de beslissing zou veranderen. Bij weinig verkeer kies je een vergelijking van voor en na, een gesprek of een knop naar iets dat je nog niet hebt gebouwd. Een lift study kies je pas als het platform een controlegroep kan toewijzen en er genoeg mensen in beide groepen zitten. Noem de uitkomst niet significanter dan de vorm toelaat.

Wat mag AI doen in een experiment, en wat niet?

AI mag varianten, een landingspagina of een rapportdraft maken vanuit de rij in je logboek. Jij kiest welke variant live gaat, welke metric telt en wanneer je stopt. Een model bepaalt niet welke belofte het bedrijf doet, en het stopt de test niet omdat een grafiek groeit. Klantdata hoort niet in een chatvenster zonder afspraak over die tool.

Waarom scoort een knopkleur laag, ook als hij makkelijk is?

Ease telt mee in de score, naast impact en confidence. De kleur wint alleen als hij dezelfde vraag beantwoordt als de zwaardere test. Leg er leerwaarde over kanalen naast: een inzicht dat je niet hergebruikt, telt lager, ook als de test in een uur af is.

Wanneer heeft één marketeer een tweede persoon nodig?

Als de test een developer vraagt, twee vakken tegelijk een oordeel vragen dat jij niet hebt, of de meting zelf het werk is geworden. Een backlog, een template en een dashboard halen dat niet in. Dan is de volgende stap geen extra experiment, maar een specialist op die ene breuk, of eerst de meetketen op orde.