Naar de inhoud
ceeme

Kan je een positie in een AI-antwoord meten?

Nee. Drie onafhankelijke onderzoeken uit 2026 komen tot dezelfde vaststelling: een AI-assistent geeft op dezelfde vraag bijna nooit twee keer dezelfde merkenlijst, en vrijwel nooit in dezelfde volgorde. Een positienummer meet daardoor niet je zichtbaarheid maar de toevalstrekking van dat ene moment. Wat je wél kan meten is hoe vaak je voorkomt over veel herhalingen heen, mét de foutmarge erbij — en die marge bepaalt of een verschuiving iets betekent.

Meet je eigen bedrijf → Liever eerst een gesprek

In het kort

Minder dan 1 op 100
De kans dat dezelfde vraag twee keer dezelfde merkenlijst geeft. In dezelfde volgorde: minder dan 1 op 1.000. (SparkToro, 2.961 runs)
30 punten ruis
Zoveel kan een zichtbaarheidscijfer bij 21 herhalingen schommelen zonder dat er íets veranderd is. (PetraLabs, 7.200 runs op één dag)
19% verkeerd
Zo vaak wijst één enkele meting de andere kant op dan twaalf metingen van dezelfde vraag. Een vijfde van je rapport klopt dus niet. (MaxAEO, 23.040 antwoorden)
Wat dan wel
Breedte verslaat diepte. Bij hetzelfde budget haalt 200 vragen × 3 herhalingen ±5,4 punten, tegenover ±15,4 punten voor 20 vragen × 30 herhalingen.

Wat zegt de studie?

Drie ploegen, drie opzetten, dezelfde uitkomst. SparkToro liet 600 vrijwilligers dezelfde twaalf vragen stellen aan ChatGPT, Claude en Google AI, bijna drieduizend keer: de kans op twee keer dezelfde lijst bleef onder 1 op 100. PetraLabs draaide zes koopvragen 600 keer per engine op één dag, om verschillen tussen dagen uit te sluiten, en mat hoeveel een cijfer schommelt door toeval alleen. MaxAEO verzamelde 23.040 antwoorden over zes engines en keek hoe vaak één meting het oneens is met twaalf.

Wat ze samen aantonen is geen defect maar een eigenschap. Een taalmodel rangschikt geen merken; het put uit een groep namen die het voor die vraag geschikt vindt, en het schudt die groep bij elk antwoord opnieuw. De grootte van die groep en hoe vaak jij erin zit, zijn echte grootheden. De plek waarop je die ene keer stond, is dat niet.

Wat er gemeten isHoeWat de studie niet zegt
SparkToro — 2.961 runs, 600 vrijwilligers, 12 vragen, 3 enginesdezelfde vraag herhaald, uitgelogd, en geteld hoe vaak de lijst terugkeertniet dat zichtbaarheid onmeetbaar is — alleen dat een POSITIE het is
PetraLabs — 7.200 runs, 6 vragen, 2 engines, één dagbootstrap over 10.000 trekkingen om de drempel te bepalen waaronder een verschil toeval isniets over wat er over wéken gebeurt — alles is op één dag gemeten, met opzet
MaxAEO — 23.040 antwoorden, 18 merken, 320 vragen, 6 engines12 herhalingen per vraag over veertien dagen, en één run vergeleken met de meerderheidgemeten op B2B-softwarevragen; bij een lokale vraag met twee bekende namen is er minder diepte nodig — dat schrijft de studie er zelf bij

SparkToro (Fishkin & O'Donnell, 2026) · PetraLabs (Tom Zu, juni 2026) · MaxAEO (Chris Han, juli 2026). Elk cijfer op deze pagina is op 10 augustus 2026 in de brontekst zelf teruggevonden.

Waar kan je dit zelf nakijken?

  • SparkToro — Rand Fishkin & Patrick O'Donnell (Gumshoe.ai) 2026

    600 vrijwilligers, 12 identieke vragen, 2.961 runs op ChatGPT, Claude en Google AI

    De kans dat twee keer dezelfde merkenlijst terugkomt is kleiner dan 1 op 100. In dezelfde volgorde: kleiner dan 1 op 1.000.

    De studie zegt niet dat zichtbaarheid onmeetbaar is — ze zegt dat een POSITIE onmeetbaar is. Aanwezigheid over veel runs blijft statistisch te meten.

  • PetraLabs — Tom Zu juni 2026

    7.200 runs op één dag — 600 herhalingen per vraag per engine, zes koopvragen, ChatGPT en Gemini, uitgelogd

    Bij 21 runs kan de zichtbaarheid tot 30 procentpunten schommelen door toeval alleen. Bij 50 runs wordt een échte verschuiving van 10 punten in maar 17% van de gevallen opgemerkt.

    Alles op één dag gemeten, om verschillen tussen dagen uit te sluiten. Wat over weken gebeurt — een modelupdate — valt dus buiten deze meting.

  • MaxAEO — Chris Han 21 juli 2026

    23.040 antwoorden — 18 merken, 320 vragen, 6 engines, 12 herhalingen per vraag over veertien dagen

    Eén enkele run wijkt in 19% van de gevallen af van het oordeel van twaalf runs. En bij hetzelfde budget haalt 200 vragen × 3 runs een foutmarge van ±5,4 punten, tegenover ±15,4 punten voor 20 vragen × 30 runs.

    Gemeten op B2B-softwarevragen, waar de lijsten lang zijn. Bij een lokale vraag met twee of drie bekende namen liggen de uitkomsten dichter bij 0% of 100% en is er minder diepte nodig — dat schrijft de studie er zelf bij.

Elke link gaat naar de oorspronkelijke publicatie. Wat je hierboven leest, is op 10 augustus 2026 in die tekst zelf teruggevonden — niet overgenomen uit een samenvatting van iemand anders.

Waarom telt dit voor jou?

Omdat het bepaalt of je een factuur kan verdedigen. Krijg je een rapport waarin je van plek vier naar plek twee ging, dan is de eerlijke vraag niet *hoe komt dat* maar *hoeveel keer is er gemeten*. Bij eenentwintig herhalingen kan datzelfde cijfer dertig punten heen en weer zonder dat er iets gebeurd is. Wie zo'n verschuiving als resultaat verkoopt, verkoopt ruis met een verhaal eromheen.

Wat doet ceeme hiermee?

Wij tonen geen positie. Wij tonen of je genoemd, geciteerd of gekozen wordt, over meerdere herhalingen, met het antwoord dat de engine werkelijk gaf ernaast — zodat je zelf kan zien waar het getal vandaan komt. En wij kiezen breedte boven diepte: liever meer échte klantvragen dan dezelfde vraag dertig keer, want dat is bij hetzelfde budget aantoonbaar nauwkeuriger.

Dat kost ons iets, en dat hoort erbij. Een positienummer verkoopt makkelijker dan een bandbreedte, en een dashboard met pijltjes oogt daadkrachtiger dan een dashboard dat zegt *dit verschil is te klein om iets te betekenen*. Wij tonen het tweede, omdat drie onafhankelijke metingen zeggen dat het eerste niet bestaat.

Veelgestelde vragen

Betekent dit dat AI-zichtbaarheid niet te meten is?

Nee, en dat is een belangrijk onderscheid. Onmeetbaar is de POSITIE. Aanwezigheid is prima meetbaar: hoe vaak kom je voor over veel herhalingen, in welke bewoording, en met welke bronnen erbij. Dat is een percentage met een foutmarge, geen ranglijst.

Andere tools tonen wél een positie. Zitten die er dan naast?

Ze tonen iets dat bestaat — in dát antwoord stond je op die plek. De vraag is of het herhaalbaar is, en daar wijzen drie metingen dezelfde kant op. Wij oordelen niet over andermans product; wij zeggen wat wij tonen en waarom, en zetten de bronnen eronder zodat je het zelf kan nakijken.

Hoeveel herhalingen doen jullie dan?

Dat hangt af van je pakket, en het staat op de prijzenpagina in plaats van hier — een aantal dat je koopt, hoort niet in een studie te staan. Wat wel hier hoort is de keuze eronder: bij een vast budget kiezen wij meer vragen boven meer herhalingen, en het cijfer waarop die keuze steunt staat hierboven.

Is er onderzoek dat het tegenspreekt?

Over de wispelturigheid van geciteerde BRONNEN wel — daar lopen de metingen sterk uiteen, en dat is een andere vraag dan deze. Zodra wij die metingen aan de bron hebben nagekeken, komt er een aparte pagina die ze naast elkaar legt, inclusief degene die ons ongelijk geeft. Wat wij niet doen, is de helft tonen die ons uitkomt.

Verder lezen

Gratis, zonder account en zonder kaart.