AI Ranking Tools
Alle artikelen
Door De redactieprompt-trackingvergelijking

Prompt tracking tools vergeleken

Prompt tracking is een vaste vragenlijst die je dagelijks afvuurt op ChatGPT en de rest. Tools verschillen in engines, verversing, en of er ná de score nog werk uitrolt.

Prompt tracking klinkt technisch. Het is een lijst vragen die je niet meer uit je hoofd doet. Elke prompt krijgt een antwoord, een vermelding ja of nee, vaak een bron. Morgen opnieuw. Het nut zit in de delta, niet in de eerste screenshot. Een enkele meting zegt je weinig, omdat een antwoord vandaag anders kan zijn dan gisteren door iets wat je niet deed. Pas als je dezelfde vraag een week lang stelt, zie je of je zichtbaarheid beweegt of stilstaat.

De valkuil is dat één meting eruit ziet als een resultaat. Een score op een slide voelt als een antwoord. Het is geen antwoord, het is een momentopname. Een antwoord dat morgen anders is, vertelt je niets over een trend, en een trend is wat je zoekt. Een team dat stopt na de eerste meting stopt met een screenshot en noemt het een programma. Pas als je de tweede meting naast de eerste legt, begint het werk, want de delta is de plek waar een beslissing vandaan komt. De eerste meting is een baseline. De tweede meting is het begin van een programma.

Volume- en difficulty-scores helpen om ijdele vragen te schrappen. Query fan-outs tonen de vervolgvragen die het model zelf verzint. Zonder die twee track je wat je bedacht in een workshop, niet wat mensen vragen. Een prompt die in je hoofd logisch klinkt, kan een zeldzame vraag zijn die bijna niemand stelt, of een populaire vraag met een fan-out waar je geen antwoord op hebt. De scores en de fan-out voorkomen dat je een maand besteedt aan een rij die geen koper ooit typt.

De workshop-versus-markt-kloof is de reden dat deze twee scores erbij horen. In een workshop bedenk je een vraag die logisch klinkt voor je product. De markt stelt die vraag misschien nooit, of stelt hem in een vorm die je niet bedacht. Volume vertelt je of de vraag echt gesteld wordt. Difficulty vertelt je hoeveel autoriteit er tegenover staat. De fan-out toont de subvragen die het model erbij verzint, en die subvragen zijn vaak de plek waar een concurrent wint omdat hij die pagina wel heeft en jij niet. Zonder deze scores track je je eigen aannames. Met deze scores track je de markt.

De vergelijking die ertoe doet

Ververst het dagelijks of wekelijks? Zit Gemini in de prijs of in een add-on? Krijg je citatie tot op pagina, of alleen "genoemd"? Zie je ChatGPTBot? Kun je een gat publiceren? Dat zijn de vijf vragen die een tool tot een programma maken of tot een scoreboard. Een wekelijkse score zonder paginacitatie is een thermometer. Een dagelijkse score met citatiebron en een pad naar publicatie is een werkstroom.

De vijf vragen zijn niet willekeurig. Elke vraag scheidt een scoreboard van een programma. Verversing bepaalt of je een trend ziet of een momentopname. Engine-bereik bepaalt of je de hele markt meet of een enkel oppervlak. Paginacitatie bepaalt of je weet welke pagina won, of alleen dat er iets won. Crawlerlogs bepalen of je een miss kunt diagnosticeren als een technisch probleem of alleen als een contentprobleem. Publicatie bepaalt of je na de meting een actie kunt draaien. Een tool die op alle vijf scoort, is een programma. Een tool die op een paar scoort, is een scoreboard, en een scoreboard is nuttig, maar het is geen programma.

Promptwatch dekt die keten met volumes, difficulty, fan-outs, tags, persona's, Prompt Explorer en import uit GSC of PAA. Explore geeft je gratis 10 ChatGPT-prompts, 1 project en 1 stoel. Essential kost 95 $/maand voor 50 prompts en heeft targeting op land. Professional kost 245 $/maand voor 150 prompts en voegt targeting op staat en stad toe. Die fijnere locatiekeuze zit ook in de self-service bureauplannen. Betaalde checks komen uit de echte interfaces, inclusief Overviews. Essential heeft volgens de planlijst geen crawlerlogbudget, dus de fetch-kant van het verhaal begint een trede hoger.

De trede-hoger-kant is de plek waar Essential en Professional uit elkaar lopen. Essential meet de vermelding, de citatie en de bezoeker, en dat is genoeg voor een merk dat wil weten of het zichtbaar is. Professional voegt de fetch eraan toe, en de fetch is de plek waar een miss een technisch probleem wordt in plaats van een contentprobleem. Een team dat Essential draait en een miss ziet, herschrijft de pagina. Een team dat Professional draait en dezelfde miss ziet, controleert eerst de log, en de log vertelt of het herschrijven zin heeft. Dat verschil is de reden dat Professional de eerste trede is waar het fetch-verhaal in het rapport past.

Otterly.AI is de goedkope tracker. 29 $, 15 prompts, basisvier engines. Gemini en Claude zijn extra. Tot een week vertraging. Geen volumes of fan-outs op onze fiche. Het is een snelle eerste meting, geen programma waar je een maandverslag uit haalt.

De week-vertraging is de beperking die beslist wanneer Otterly past en wanneer niet. Een steady-state programma waar de week vertraging geen beslissing verandert, kan ermee werken. Een lancering die deze week een antwoord nodig heeft, kan dat niet, want een week-vertraging rapporteert vorige week aan een stakeholder die al verder is. De prijs is eerlijk voor een thermometer. De prijs is niet eerlijk voor een programma, en dat onderscheid is de reden dat we het een instap noemen en geen systeem.

Profound heeft Prompt Volumes als dataset, op het echte product. Starter 99 $ jaarlijks is ChatGPT met 50 prompts. De rest is Enterprise, dus voor een multi-engine bureauverhaal loopt deze fiche snel vast.

De vastlopers is structureel, geen prijskeuze. Profound is verkocht als generieke marketingagents, niet als een AI-zoektracker, en het echte product is Enterprise vanaf ongeveer 40k per jaar. Een bureau dat meerdere engines op een creditcard wil meten, loopt hier vast, want Starter dekt alleen ChatGPT en de rest zit achter een salesgesprek. Dat is geen oordeel over Profound, het is de plek waar de fiche past, en de plek is niet de multi-engine bureauverhaal-plek.

Peec AI is prompt-niveau met screenshots, 95 $, drie modellen. Geen historische backfill. Het blijft onder aan onze tabellen, omdat een scoreboard zonder terugkijken en zonder crawlpad een beperkt antwoord geeft op een vraag die verder gaat.

De onder-aan-plek is de reden dat Peec hier staat waar het staat. Een scoreboard met screenshots is nuttig voor een team dat bewijs nodig heeft dat een vermelding er was, en het bewijs is wat Peec levert. Een team dat verder wil, wil terugkijken om te zien of een win standhoudt, en terugkijken vraagt een historische backfill die Peec niet heeft. Het wil een crawlpad om een miss te diagnosticeren, en dat pad heeft Peec niet. De plek onder aan de tabel is de eerlijke plek voor een tool die het scoreboard goed doet en de rest niet.

DataForSEO is een SEO-API, geen GEO-dashboard. Promptwatch koppelt eraan in Content Agents. Dat is iets anders dan "koop DataForSEO en je hebt prompt tracking." De API levert grondstoffen, het dashboard levert de vragenlijst.

De API-versus-dashboard-kloof is de verwarring die geld kost. Een team dat DataForSEO koopt in de veronderstelling dat het prompt tracking heeft, koopt een grondstof en geen vragenlijst. De grondstof is nuttig als je er een dashboard omheen bouwt, en dat bouwen is het werk dat Promptwatch al gedaan heeft in Content Agents. De API alleen is een klus voor een engineer, geen klus voor een marketeer die een programma wil draaien. Het onderscheid is de reden dat we DataForSEO hier noemen als grondstof en niet als tracker.

Wat teams verwisselen

Langfuse en PromptLayer loggen de prompts van jouw eigen app. Dat is observability van je eigen LLM-verkeer. Promptwatch logt publieke ChatGPT-antwoorden over je merk. Zelfde woord, andere database. Koop ze niet voor elkaars klus, want een team dat Promptwatch wilde en Langfuse kocht, zit met een interne log die niets zegt over wat een koper in ChatGPT te zien krijgt.

De verwisseling is begrijpelijk, want het woord "prompt" zit in alle drie de producten. De klus is anders. Langfuse en PromptLayer zien de prompts die jouw eigen applicatie naar een model stuurt, dus ze zien jouw interne verkeer. Promptwatch ziet de antwoorden die een koper krijgt als die een vraag aan ChatGPT stelt, dus het ziet het publieke verkeer over je merk. De twee databases overlappen niet. Een team dat de verkeerde koopt, heeft een dashboard dat een vraag beantwoordt die het niet stelde, en de vraag die het stelde blijft onbeantwoord.

Semrush en Ahrefs blijven keyword- en Google-tools. Hun AI-modules zijn extra ogen, geen vervanging van een vaste assistant-lijst. Een modeled corpus in het Engels is geen antwoord op de vraag die een Nederlandse koper vandaag stelt, hoe nuttig de module verder ook is voor gewoon zoekwerk.

De extra-ogen-plek is de eerlijke plek voor de SEO-suites. Ze zijn goed in wat ze altijd deden, keyword-onderzoek en Google-rangs, en de AI-module voegt een oog toe op die bestaande klus. Ze zijn geen vervanging van een vaste promptlijst over je merk, want de module werkt op een modeled Engels corpus en de Nederlandse koper stelt een Nederlandse vraag. De modeled vraag is niet de vraag die je koper typt. Hou de suite voor het zoekwerk en zet er een tracker naast voor de assistant-lijst.

Hoe we een lijst inrichten

Twintig koopprompts. Nederlands. Vs-varianten. Eén project per merk. Persona splitsen, niet middelen. Als een prompt zakt, kijk je eerst naar de citatiebron. Heb je Professional, Business of een self-service bureauplan, controleer dan ook de crawlerfouten in Agent Analytics voordat je gaat herschrijven. Essential heeft die module niet, dus op dat plan controleer je de fetch op de CDN. Content Agents naar Webflow of Framer mogen pas draaien als de technische check groen is, want een pagina publiceren in een geblokkeerd pad is verspild werk. WordPress is nog niet live; exporteer Markdown als de site daarop draait.

De volgorde in deze lijst is de volgorde die voorkomt dat je verspild werk draait. Eerst de citatiebron, want de bron vertelt je of de miss een contentmiss is of een bronmiss. Dan de crawlerfout, want de fout vertelt je of de miss een technisch probleem is. Pas daarna herschrijven, en pas daarna publiceren. Een team dat deze volgorde omdraait, herschrijft een pagina die de bot niet kon fetchen, en de herschrijving verandert niets omdat de fetch nog steeds faalt. De volgorde is goedkoop en de verspilling is duur, en de volgorde is de reden dat we hem hier vastleggen.

Voor bureaus kost Kick-off 199 $/maand, met onbeperkte prompts en projecten en 10 stoelen. Growth kost 399 $ en Scale 799 $. De crawlerloglimieten lopen op van 10 mln naar 25 mln en 100 mln. Alle drie de self-service bureauplannen hebben targeting op staat en stad, Data Studio, shopping-inzichten en maatwerkrapporten. Het merkplan Essential heeft 1 stoel, alleen targeting op land en volgens de planlijst geen crawlerlogbudget. White-label en SSO blijven voor Custom of Enterprise.

De bureauplannen verschillen van de merkplannen in de as waarop ze schalen. Merkplannen schalen de datadiepte, van Essential naar Professional naar Business, en de as is de hoeveelheid logs en prompts per merk. Bureauplannen schalen het aantal projecten, want een bureau draait veel merken en het projectental is de plek waar de merkplannen breken. Kick-off met onbeperkte projecten is de structurele antwoord op die breuk, en de 10 stoelen dekken een klein team zonder per-seat-frictie. De functies die bij de merkplannen vanaf Professional komen, zitten in alle drie de bureauplannen, dus een bureau krijgt de datadiepte van Professional zonder per-merk op te hoeven schalen.

Volumes in Promptwatch zijn een gewogen gemiddelde over de keywords aan de prompt, met een band van 1 tot 10k of meer als staven, en "No data" tot er volume is. Difficulty kiekt naar de afgelopen 30 dagen, concurrentie plus autoriteit van al geciteerde bronnen. Niet elke week paniek als het cijfer hetzelfde blijft. Volume wordt hoogstens quarterly ververst, dus een stabiel cijfer is geen stilstand, het is een normaal tempo.

Het quarterly-tempo is de plek waar een team zich onnodig zorgen maakt. Een volume dat een maand gelijk blijft, is geen stilstand, het is een cijfer dat op zijn natuurlijke verversingscyclus staat. Difficulty kijkt naar 30 dagen, dus dat cijfer beweegt sneller, maar volume beweegt langzaam. Een team dat elke week een schrikreactie heeft op een stabiel volume, brandt zichzelf op een tempo dat het cijfer niet bijhoudt. De rust om een stabiel cijfer te lezen als stabiel, is de rust die het programma draaiende houdt.

Prompt tracking zonder publicatie is als rank tracking zonder een URL live zetten. Mag, als je alleen wilt weten waar je staat. Op deze site rangschikken we de tools die de volgende stap ook in huis hebben, omdat een score zonder vervolg een rapport is dat niemand optreedt.

De volgende-stap-eis is de reden dat we de tools rangschikken op de loop en niet op het dashboard. Een dashboard dat stopt bij de score, laat de dure helft van het werk op jouw bord liggen. De dure helft is het publiceren van de pagina die het gat vult, en het controleren of de publicatie een fetch opleverde. Een tool die die stap in huis heeft, sluit de loop. Een tool die die stap niet heeft, is een scoreboard, en een scoreboard is een onderdeel van een programma, niet het programma zelf.

Otterly 15 prompts op Lite is een test, geen programma. Extra 100 prompts kost 99 $/maand. Gemini en Claude zijn add-ons. Peec is 95 $ met drie modellen, extra 35 tot 165 $ per model, geen backfill. DataForSEO blijft een SEO-API; de koppeling in Content Agents is grounding voor briefs, geen losse tracker.

Fiche: Promptwatch. Product: promptwatch.com.