AI-zichtbaarheid tool kiezen: 8 vragen voor je tekent
Steeds meer tools beloven AI-zichtbaarheid te meten. Acht concrete vragen om het kaf van het koren te scheiden, met een eerlijk kader in plaats van een toplijst.

Het korte antwoord: een AI-zichtbaarheid tool is het geld pas waard als hij echte AI-antwoorden ophaalt (geen eigen index bevraagt), met een bevroren vragenset herhaald meet, en onderscheid maakt tussen een echte concurrent en een toevallige merkvermelding. Ontbreekt een van de drie, dan koop je een rapport dat er professioneel uitziet maar weinig voorspelt. Dit is geen toplijst met sterretjes; het is het kader waarmee je zelf een demo kunt doorprikken.
Waarom dit nu ineens een categorie is
Een jaar geleden bestond "AI-zichtbaarheid meten" nauwelijks als productcategorie. Nu duiken er in veel SERP's voor gerelateerde termen tools op: gespecialiseerde AI-monitoring-tools naast gevestigde SEO-suites die er een AI-module bij hebben gezet. De markt is jong, het aanbod groeit hard, en de kwaliteit loopt uiteen: sommige tools meten daadwerkelijk antwoorden, andere schatten een "potentie" op basis van klassieke SEO-signalen en noemen dat AI-zichtbaarheid. Voor een koper is dat verschil van buitenaf lastig te zien: beide leveren een dashboard met een percentage. Vandaar dit kader in plaats van een productlijstje dat over drie maanden alweer verouderd is.
Het probleem: elk dashboard oogt hetzelfde
Een percentage, een lijn die omhoog of omlaag gaat, een paar concurrentnamen ernaast: dat patroon zie je bij bijna elke tool in dit veld, ongeacht wat er onder de motorkap gebeurt. Dat maakt de vergelijking lastig op het eerste gezicht, en precies daarom loont het om onder de motorkap te kijken voor je tekent. Onderstaande acht vragen zijn de plekken waar het verschil wél zichtbaar wordt, in de demo of in de documentatie.
Vraag 1: haalt hij echte antwoorden op, of bevraagt hij een eigen index?
Dit is de belangrijkste vraag en meteen de makkelijkste om te laten beantwoorden: vraag concreet of de tool bij elke meting een live aanroep doet naar ChatGPT, Claude, Gemini of Perplexity, of dat hij een eigen database van eerder verzamelde antwoorden raadpleegt (let ook op of dat via de officiële API gebeurt of via het scrapen van een chatvenster, want dat laatste botst vaak met de gebruiksvoorwaarden van de aanbieder). Een index kan verouderen; AI-antwoorden kunnen verschuiven bij een modelupdate. OpenAI noemt de output van zijn taalmodellen zelf expliciet niet-deterministisch: dezelfde prompt kan bij een volgende aanroep een andere formulering en soms een ander genoemd merk opleveren (developers.openai.com). Een tool die dat niet elke ronde opnieuw ophaalt, meet het verleden.
Vraag 2: is de vragenset bevroren?
Vraag of jij de vragenset zelf vaststelt en of die vast blijft tussen metingen, of dat de tool "representatieve" vragen per run zelf genereert. Dat laatste is prima voor een gratis, oriënterende scan (zie ons stuk over AI-zichtbaarheid meten), maar ondermijnt een betaald meetinstrument: verschuift de vragenset, dan verschuift ook het percentage, en weet je niet meer of een dalende score aan je zichtbaarheid ligt of aan andere vragen.
Vraag 3: op hoeveel platformen meet hij, en hoe vaak?
Eén assistent is een gok, geen beeld: ChatGPT, Claude, Gemini en Perplexity geven regelmatig andere antwoorden op dezelfde vraag. Vraag ook naar de meetfrequentie. Eenmalig meten is een foto; je hebt herhaling nodig om een patroon van toeval te onderscheiden. Vraag concreet: hoe vaak draait de tool een meetronde, en op hoeveel platformen tegelijk?
Vraag 4: classificeert hij wie een echte concurrent is?
Een AI-antwoord noemt soms een merk als klantvoorbeeld of als los hulpmiddel in een bijzin, niet als aanbevolen concurrent. Telt een tool elke merkvermelding gelijk mee, dan raakt de score opgeblazen door ruis. Vraag hoe de classificatie werkt: automatisch met een controleslag, volledig handmatig, of helemaal niet.
Vraag 5: wat gebeurt er met de concurrenten die genoemd worden?
Een deel van de waarde zit niet in je eigen cijfer, maar in wie er wél genoemd wordt als jij het niet bent. Vraag of de tool die concurrentnamen zichtbaar maakt en of je kunt zien in welke rol ze verschijnen. Zonder dat inzicht heb je een score zonder aanknopingspunt om iets aan te doen.
Vraag 6: claimt hij ranking-garanties of een potentiescore?
Dit is de rode vlag. Niemand kan beloven dat een AI-assistent jou noemt: de antwoorden zijn niet-deterministisch en veranderen met het model en de promptformulering. Een tool die een gegarandeerde plek belooft, verkoopt iets dat technisch niet kan. Wees ook alert op een "potentie"-score: een cijfer dat aangeeft hoe goed je zou kúnnen scoren zonder dat er daadwerkelijk vermeldingen gemeten zijn, is een schatting die zich voordoet als een meting. Vraag altijd: is dit cijfer gebaseerd op echte antwoorden, of op een inschatting?
Vraag 7: is de methode inzichtelijk, of is het een black box?
Vraag naar de exacte vragenset die voor jouw account gebruikt wordt, de platformen, en de classificatieregels. Een leverancier die dat helder kan uitleggen, geeft je ook de mogelijkheid om de score te wantrouwen waar nodig. Een dashboard zonder uitlegbare methode vraagt blind vertrouwen, en dat is precies wat je niet wilt bij een cijfer dat je aan een directie of klant rapporteert.
Vraag 8: wat kost herhaald meten op meerdere platformen echt?
Vier platformen parallel bevragen met een redelijke vragenset is duurder dan één keer een zoekterm intikken. Vraag naar de prijsopbouw: per vraag, per platform, per meetronde? Is een tool opvallend goedkoop voor wat hij belooft, vraag dan expliciet na of hij echt alle vier de platformen bij elke meting bevraagt, en niet minder vaak dan het dashboard suggereert.
Het kader samengevat
| Vraag | Rode vlag | Goed antwoord |
|---|---|---|
| Echte antwoorden of eigen index? | "We hebben een grote database" | Live aanroep per meetronde, per platform |
| Vragenset bevroren? | Vragen wisselen "voor representativiteit" | Jij bepaalt en bevriest de set |
| Hoeveel platformen, hoe vaak? | Eén platform, eenmalig | Meerdere platformen, herhaald over tijd |
| Concurrentclassificatie? | Elke vermelding telt gelijk | Rolonderscheid: concurrent, klant, los hulpmiddel |
| Concurrenten zichtbaar? | Alleen jouw eigen cijfer | Wie genoemd wordt, en in welke rol |
| Ranking-garantie of potentiescore? | "Gegarandeerd hoger" of "92% potentie" | Uitleg dat AI-antwoorden niet-deterministisch zijn |
| Methode inzichtelijk? | Black box | Vragenset, platformen en regels op te vragen |
| Prijsopbouw realistisch? | Opvallend goedkoop voor vier platformen | Transparante kosten per meting/platform |
Een voorbeeld (indicatief)
Stel: je vergelijkt twee tools voor een boekhoudsoftware-merk. Tool A toont een strak dashboard met "AI-zichtbaarheid: 81%", gebaseerd op een eigen index die maandelijks ververst, zonder dat je de onderliggende vragen te zien krijgt. Tool B toont "38% dekking over 20 vragen, 4 platformen, laatste meting 3 dagen geleden", met de vragenlijst en de concurrentnamen erbij. Het hogere getal van Tool A oogt beter, maar zonder zichtbare methode weet je niet wat het meet. Tool B's lagere percentage is minder indrukwekkend om te laten zien, maar wel bruikbaar: je weet precies waar het vandaan komt en kunt het volgende maand opnieuw meten met dezelfde vragen. Dit voorbeeld is illustratief en geen weergave van een specifiek bestaand product.
Wat je zelf kunt zonder tool
De handmatige route kost geen geld, alleen tijd: schrijf tien tot twintig koopvragen op zoals je klant ze zou stellen, stel ze los aan ChatGPT, Claude, Gemini en Perplexity, bij voorkeur niet ingelogd of in een privésessie (gepersonaliseerde antwoorden zijn lastiger te herhalen), en noteer per antwoord of je merk genoemd wordt en in welke rol. Herhaal dat over een paar weken met dezelfde vragen. We beschrijven die aanpak, en waarom hij vanaf een bepaalde schaal onhandig wordt, uitgebreider in AI-zichtbaarheid meten: wat het is en hoe je het vaststelt. Zodra je weet waar je staat, is de vervolgvraag hoe je vaker genoemd wordt; daarover schreven we in aanbevolen worden door ChatGPT.
Waar wij in dit rijtje passen
Met open kaarten: GEO-Crafter is zelf een van de tools waar je dit kader op los kunt laten. We stellen dezelfde koopvragen parallel aan ChatGPT, Gemini, Claude en Perplexity, met een vragenset die jij bevriest zodra je betaalt, en classificeren wie een echte concurrent is voor je de score bepaalt. Geen ranking-garantie, geen potentiescore: een dekkingspercentage op echte antwoorden, herhaalbaar in de tijd. Bekijk de GEO-audit of vergelijk de opties op de prijspagina en stel ons gerust dezelfde acht vragen; als we een antwoord schuldig blijven, wil je dat weten voor je tekent, niet erna.
Veelgestelde vragen
Waar moet een AI-zichtbaarheid tool op basis van echte data staan? Op echte, opgehaalde antwoorden van de AI-assistenten zelf (ChatGPT, Claude, Gemini, Perplexity), niet op een eigen index of zoekvolumedata. Vraag expliciet: haalt de tool live antwoorden op, of schat hij een score op basis van iets anders?
Is een hogere AI-zichtbaarheidsscore altijd beter? Alleen als je weet hoe hij tot stand komt. Twee tools met verschillende vragensets, platformen of classificatieregels geven verschillende scores voor hetzelfde merk. Een score zonder zichtbare methode is niet te vergelijken met een andere score.
Kan een tool garanderen dat ik vaker genoemd word door ChatGPT? Nee, en een tool die dat belooft, verdient extra wantrouwen. AI-antwoorden zijn niet-deterministisch: dezelfde vraag kan een andere uitkomst geven. Een goede tool meet en signaleert trends, het beïnvloedt de AI zelf niet.
Moet ik meteen een tool kopen, of kan ik dit ook handmatig doen? Handmatig kan, en is een goede eerste stap: stel tien tot twintig koopvragen zelf aan de vier grote assistenten en noteer de vermeldingen. Het schaalt alleen slecht zodra je dat herhaald en over meerdere platformen wilt doen; dan wordt een tool de moeite waard.