In het kort
- Vastgepind, nooit "de nieuwste"
- Een naam die "laatste versie" betekent, wisselt onder je meting door zonder dat iets het meldt.
- Elke meting draagt zijn stempel
- Waarop ze draaide staat erbij, dus achteraf is te zien of twee metingen vergelijkbaar zijn.
- Een terugval is niet gratis
- Hij houdt de meting levend en hij begint een nieuwe reeks. Dat staat erbij in plaats van eronder.
Op welke modelversies wordt er vandaag gemeten?
Hieronder, per engine, met de terugval erbij. Die tweede kolom is er omdat een aanbieder een versienummer niet alleen vervangt maar soms ook onbereikbaar maakt: dan geeft de aanroep een foutmelding en meet je niets meer, wat er in een grafiek uitziet als een score van nul.
Eén engine in die tabel heeft geen terugval, en dat staat er als zodanig. Een lege cel zou lezen als "niet van toepassing"; het is een risico dat je hoort te kennen voor je een reeks op die engine start.
| AI-zoekmachine | Waarop we vandaag meten | Als die versie wegvalt |
|---|---|---|
| ChatGPT | gpt-5.6-terra | gpt-5.4-mini |
| Gemini | gemini-3.5-flash | gemini-3.6-flash |
| Perplexity | sonar-pro | sonar |
| Claude | claude-sonnet-5 | claude-sonnet-4-6 |
| Grok | grok-4.5 | geen terugval — de reeks stopt en begint opnieuw |
| Mistral | mistral-medium-latest | mistral-small-latest |
| DeepSeek | deepseek-v4-flash | deepseek-chat |
| Meta AI | Llama-4-Maverick-17B-128E-Instruct-FP8 | geen terugval — de reeks stopt en begint opnieuw |
Wat gebeurt er met mijn reeks als een model uitgezet wordt?
Hij stopt en er begint een nieuwe, en dat wordt gemeld in plaats van doorgemeten. De verleiding om gewoon door te gaan is groot, want de grafiek ziet er dan doorlopend uit — en precies daarom is het de gevaarlijkste van de twee: een doorlopende lijn over twee verschillende modellen ziet eruit als een trend en is er geen.
Waarom merkt niemand dat zoiets gebeurd is?
Omdat er geen foutmelding komt. Een vervangen model antwoordt gewoon, alleen net iets anders: andere bronnen, een andere volgorde, een ander aantal namen in de opsomming. Dat is dezelfde soort fout als geldige structured data die het verkeerde zegt — alles werkt, en de uitkomst klopt niet.
Kan ik dit zelf in de gaten houden zonder tool?
Deels, en het is de moeite. Schrijf per meting op welke vraag je stelde, op welke dag en in welke assistent, en bewaar het antwoord zelf en niet je samenvatting ervan. Dat is met de hand precies wat een reeks doet, en het is genoeg om te zien of een verschuiving van jou komt of van hen.
Wat je met de hand niet doet is het volhouden over vier engines, in twee talen, elke week. Daar zit het verschil, en niet in het idee.
Veelgestelde vragen
Meten jullie op het gratis of het betalende model van een assistent?
Op de versie die in de tabel hierboven staat, en die staat er met zijn nummer zodat je het kan nakijken. Wat een bezoeker in de gratis versie van dezelfde assistent ziet, kan afwijken — dat is een echte beperking en ze staat hier omdat niemand ze publiceert.
Voegen jullie een nieuwe engine toe zodra hij bestaat?
Alleen als hij in jouw markt gebruikt wordt. Een engine erbij zetten die in jouw land nauwelijks bevraagd wordt, verhoogt het aantal metingen en niet de betekenis ervan — en het verwatert je gemiddelde met een publiek dat je niet hebt.
Verder lezen
Gratis, zonder account en zonder kaart.