Waar haalt ChatGPT zijn bronnen vandaan?
ChatGPT gebruikt niet één vaste bronnenlijst. Bij webzoekopdrachten kun je citaties controleren, maar trainingsdata en bronselectie vragen om meer nuance.
ChatGPT heeft geen openbare catalogus waarin per vraag staat welke websites het altijd zal gebruiken. Soms toont een antwoord bronkaarten of inline links. Soms verschijnt er helemaal geen bron. En dezelfde vraag kan op een later moment andere verwijzingen opleveren. Wie wil weten waar ChatGPT informatie vandaan haalt, moet daarom eerst onderscheid maken tussen zichtbare webbronnen en kennis zonder zichtbare herkomst.
Bij een antwoord met live webzoekfunctie zijn de getoonde citaties het beste controleerbare spoor. Je kunt de URL openen, lezen welke passage de bewering ondersteunt en vastleggen op welke positie de bron stond. Zonder citatie kun je niet betrouwbaar terugredeneren naar een specifieke trainingspagina. Een bekend feit in het antwoord bewijst niet dat ChatGPT zojuist de website heeft bezocht waarop jij datzelfde feit vond.
Een citatie is een bron bij dit antwoord
De Promptwatch-uitleg over citaties en vermeldingen definieert een citatie als een URL die een AI-model aan een antwoord koppelt. Volgens die productdocumentatie verschijnen citaties bij modellen en modi die daadwerkelijk het web doorzoeken. Antwoorden die uit modelkennis komen, hoeven geen bronnen te tonen.
Dat maakt een citatie concreet, maar niet universeel. Ze vertelt dat deze URL bij dit antwoord als bron is weergegeven. Ze bewijst niet dat het domein voor iedere gebruiker, promptvariant of taal dezelfde rol krijgt. Ook zegt een bronverwijzing niet automatisch dat alle zinnen in het antwoord volledig door die pagina worden gedragen. Lees de bron zelf.
Een merkvermelding is weer iets anders. ChatGPT kan een bedrijf aanbevelen en daarvoor naar een review of nieuwsartikel linken. Het bedrijf krijgt dan de vermelding, terwijl het externe domein de citatie krijgt. Andersom kan een kennisartikel van een bedrijf als bron dienen zonder dat het merk in de tekst wordt genoemd.
Welke soorten websites zie je terug?
In bronlijsten komen eigen websites van organisaties, uitgevers, documentatie, fora, referentiesites, onderzoeksbronnen en videopagina's voor. De verdeling hangt af van de vraag. Een technische configuratievraag kan documentatie opleveren. Een productvergelijking kan putten uit reviews en ervaringen van derden. Een actuele gebeurtenis vraagt eerder om recente publicaties.
Daaruit volgt geen simpel recept zoals "ChatGPT kiest altijd fora" of "een woordenboeksite wint iedere definitievraag". Bronselectie verandert per onderwerp en in de tijd. Bovendien zegt een domeingemiddelde weinig over jouw niche. Een groot domein kan vaak worden geciteerd over duizenden onderwerpen, terwijl voor jouw commerciële prompts een kleine specialistische site belangrijker is.
Promptwatch publiceert een live rapport over veel geciteerde domeinen in ChatGPT. De pagina meldde bij raadpleging op 30 augustus 2026 dat de rangschikking was gebaseerd op meer dan 100 mln citaties over meer dan 3.000 websites en toont trends over 40 dagen. Dit zijn cijfers uit de eigen dataset van Promptwatch, geen onafhankelijk onderzoek. De percentages op de live pagina bewegen, dus gebruik ze met de datum waarop je ze hebt gelezen en niet als blijvende marktverdeling.
Het rapport is nuttig om veranderingen op domeinniveau te ontdekken. Voor contentbeslissingen heb je alsnog je eigen promptset nodig. Een algemeen populaire bron is niet automatisch aanwezig bij de vragen van jouw kopers.
Reddit laat zien hoe snel een patroon kan breken
Een tweede Promptwatch-rapport van 18 augustus 2026 volgde het aandeel van Reddit in ChatGPT-citaties. Volgens de analyse van de Reddit-daling bedroeg dat aandeel gemiddeld 3,83% van 18 juli tot en met 7 augustus 2026. Voor 14 tot en met 17 augustus was het gemiddelde 0,52%. Dat is een relatieve daling van 86,4%.
Die cijfers gelden voor de genoemde perioden en voor de meetmethode op de rapportpagina. De auteurs zeggen nadrukkelijk dat de grafiek het moment van de verandering laat zien, niet de oorzaak. Een wijziging in bronselectie is een mogelijke verklaring, maar een probleem in de dataverzameling kon op 18 augustus niet worden uitgesloten. Het zou dus onjuist zijn om uit deze reeks met zekerheid af te leiden waarom Reddit minder vaak verscheen.
Voor je strategie is vooral de instabiliteit relevant. Een bronsoort die vorige maand veel voorkwam, kan deze maand minder ruimte krijgen. Bouw je hele GEO-programma daarom niet op één extern platform. Bewaar eigen, goed bereikbare pagina's en volg tegelijkertijd welke externe bronnen voor je categorie worden gekozen.
Hoe je bronnen voor jouw prompts onderzoekt
Begin met een vaste lijst echte klantvragen. Leg per antwoord de volledige prompt, het model, de datum en alle zichtbare bron-URL's vast. Groepeer de URL's daarna op domein en bronsoort. Houd je eigen domein apart, want een vermelding van je merk met een externe citatie vraagt ander werk dan een citatie naar je eigen pagina.
Open vervolgens de vaakst terugkerende pagina's. Kijk niet alleen naar hun onderwerp, maar naar de concrete informatie die ze leveren. Beantwoordt de bron de vraag direct? Bevat ze een controleerbare tabel, oorspronkelijke documentatie of een ervaringsverslag? Noteer wat je werkelijk ziet en vermijd een algemene conclusie over wat het algoritme zou "vertrouwen". Daarvoor heb je geen toegang tot de interne rangschikking van ChatGPT.
Controleer daarna je eigen technische bereikbaarheid. Een pagina kan inhoudelijk passend zijn maar een foutstatus teruggeven aan de zoekcrawler of live fetcher. De Promptwatch-documentatie over crawlability onderscheidt trainingscrawlers, zoekindexcrawlers en fetchers die tijdens een antwoord een pagina ophalen. Dit is opnieuw productdocumentatie. Gebruik voor wijzigingen aan robots.txt ook altijd de actuele officiële documentatie van de betreffende AI-aanbieder.
Meet ten slotte trends per model en promptgroep. Een totaal over alle vragen kan verbergen dat je documentatie bij technische prompts goed wordt geciteerd en je vergelijkingspagina's bij koopvragen ontbreken. Verander één duidelijk onderdeel en kijk vervolgens of de relevante bronset beweegt.
Wat je niet uit een bronnenlijst mag concluderen
Een zichtbare link bewijst geen algemene voorkeur voor je hele domein. Geen link bewijst niet dat je content nooit in trainingsdata voorkwam. Een crawlerbezoek bewijst evenmin dat een citatie zal volgen. Het zijn stappen in dezelfde route, maar geen van die stappen garandeert de volgende.
Ook een hoog aantal citaties is niet gelijk aan positief merksentiment of verkeer. De bron kan kritisch zijn. Een gebruiker kan het antwoord lezen zonder te klikken. Daarom horen citaties, merkvermeldingen, crawler logs en bezoekersdata als aparte signalen in het rapport.
Op onze Promptwatch-toolpagina staat hoe het platform die onderdelen samenbrengt. We raden Promptwatch aan als je de zichtbare ChatGPT-bronnen voor je eigen prompts in de tijd wilt volgen en ze naast crawls en bezoeken wilt leggen. Exporteer bij belangrijke analyses ook de datum en het antwoord. Daarmee blijft je conclusie controleerbaar wanneer de live bronverdeling alweer is veranderd.