Waarom is aanwezig zijn op Reddit niet genoeg om geciteerd te worden door AI?
Gepubliceerd op
Omdat een AI die een Reddit-pagina ophaalt, deze bijna nooit citeert. Aanwezig zijn op Reddit zorgt ervoor dat u terechtkomt in wat ChatGPT leest voordat hij antwoordt, niet in de bronnen die hij weergeeft. In onze metingen werden de Reddit-, YouTube- en Wikipedia-pagina's die door de zoekfunctie van ChatGPT werden opgehaald, tussen 0 en 1,5% van de tijd geciteerd, afhankelijk van het corpus, tegenover 10 tot 15% voor de andere pagina's. Een onderzoek van Ahrefs dat in april 2026 is gepubliceerd, vindt dezelfde orde van grootte: 1,93% van de door ChatGPT opgehaalde Reddit-pagina's wordt uiteindelijk geciteerd.
Voor welk type vraag? Alles hangt af van de vraag. Als een gebruiker zijn AI vraagt om Reddit te raadplegen, zal deze antwoorden met Reddit. Maar bij een productvraag of een marktvraag, waarbij de gebruiker geen enkele bron noemt, kiest het model waar het zoekt, en wordt Reddit bijna nooit geciteerd door ChatGPT. Deze pagina gaat over dit tweede geval.
Reddit wordt opgehaald door de zoekfunctie van ChatGPT, niet geciteerd
Wanneer ChatGPT op het web zoekt voordat hij antwoordt, levert zijn zoekopdracht een lijst met pagina's op, waarna het model er een paar kiest om te citeren. We hebben voor elk domein het aandeel gemeten van de opgehaalde pagina's die uiteindelijk worden geciteerd. Voor Reddit, YouTube en Wikipedia samen is dit aandeel 0% voor HVAC in het Frans, 0,2% voor kunstmatige intelligentie in het Engels, 1,5% voor een tiental sectoren in het Frans, 0% voor dezelfde sectoren in het Engels en 0,4% voor het oplossen van softwareproblemen. Voor alle andere opgehaalde pagina's ligt dit tussen 10 en 15%. Binnen de kunstmatige intelligentie, waar Reddit-threads in overvloed aanwezig zijn in de resultaten, werd er geen enkele geciteerd.
De pagina's van deze drie platforms worden dus minstens zeven keer minder geciteerd dan de andere, en dit verschil blijft standhouden in al onze corpussen, zowel in het Frans als in het Engels. Aanwezig zijn op Reddit zorgt ervoor dat een discussie terechtkomt in de resultaten die ChatGPT onderzoekt; het zorgt er niet voor dat deze terechtkomt in de bronnen die hij aan de gebruiker toont. Voor een bedrijf is het verschil doorslaggevend: een citaat toont een link en een naam, een pagina die simpelweg door het model is gelezen, toont niets.
Alles hangt af van de vraag die aan de AI wordt gesteld
Een AI gaat op zoek naar de bronnen die de vraag hem aanwijst. We meten dit bij merken: wanneer een probleemoplossende vraag een softwarenaam noemt, schrijft ChatGPT de merknaam of richt zich op de website in 76% van zijn zoekopdrachten, en de documentatie van dat merk vertegenwoordigt 58% van zijn citaten. Hetzelfde mechanisme geldt voor een platform: als een gebruiker aan zijn AI vraagt wat er over een product op Reddit wordt gezegd, zal deze op Reddit zoeken en antwoorden met Reddit. We hebben die specifieke vraag niet gemeten; het is het directe gevolg van wat we waarnemen wanneer een vraag zijn bron noemt.
Omgekeerd noemt de gebruiker bij een productvraag of een marktvraag, zoals de keuze van software of het oplossen van een probleem, geen enkel platform en beslist het model waar het zoekt. In dat geval wordt Reddit, dat massaal door de zoekfunctie van ChatGPT wordt opgehaald, bijna nooit geciteerd. Voor een bedrijf is de juiste vraag dan ook niet of het op Reddit aanwezig moet zijn, maar in welke context er naar het bedrijf gezocht wordt, en in welke context het moet verschijnen.
Zelfs bij deze vraag gedragen de drie AI's zich anders
Op 15 september 2026 hebben we de vraag van deze pagina zelf aan de drie AI's gesteld, en we hebben deze opnieuw gesteld om te controleren of het resultaat standhield. Bij ChatGPT vertegenwoordigden de Reddit-pagina's 49% en vervolgens 39% van de door de zoekopdrachten opgehaalde resultaten, en geen enkele werd geciteerd. Claude haalde geen enkele Reddit-pagina op. Gemini citeerde Reddit in 36% van zijn bronnen, telkens weer.
Drie modellen, drie tegengestelde gedragingen bij dezelfde vraag, op dezelfde dag. Dit is de reden waarom er geen algemene regel bestaat die geldt 'voor AI's': ChatGPT, Claude en Gemini lezen niet dezelfde pagina's en kiezen hun bronnen niet op dezelfde manier. Een advies dat niet specificeert over welk model het gaat, is onjuist voor minstens één van de drie.
Waarom ChatGPT Reddit ophaalt zonder het te citeren
We zien het resultaat van de sortering door ChatGPT, niet de criteria. Wat we rondom deze sortering waarnemen, is echter constant. ChatGPT schrijft in his eigen zoekopdracht vaak de naam van de bron die hij wil raadplegen: een uitgever, een overheidsinstantie, een medium. En hij citeert bij voorkeur de pagina's die bovenaan zijn resultaten staan, met 23 tot 40% citaten op de eerste drie posities tegenover 1% voorbij de zestiende positie. Wat de vraag op deze pagina betreft, waren zijn zoekopdrachten gericht op officiële aankondigingen van partnerschappen, helpcentra en persartikelen, nooit op Reddit.
Reddit verschijnt dus ongevraagd in de resultaten en blijft buiten de citaten. De pagina's die ChatGPT citeert, zijn de pagina's waarnaar hij op naam is gaan zoeken. Een geciteerd bedrijf is in de eerste plaats een bedrijf waarvan het model de naam goed genoeg kent om deze in zijn zoekopdracht te typen, en die naam wordt opgebouwd door verdiende vermeldingen op bronnen die het model raadpleegt, niet door de loutere aanwezigheid in een discussie.
Wat andere onderzoeken over Reddit en AI meten
Het onderzoek van Ahrefs, gepubliceerd op 15 april 2026, over zoekopdrachten die op een computer aan ChatGPT 5.2 werden gesteld, meet een citatiepercentage van 1,93% voor de opgehaalde Reddit-pagina's en 0,51% voor YouTube-video's, tegenover 88,46% voor de zoekresultaten. De methode verschilt van de onze, aangezien deze de interface observeert en niet de API, maar de conclusie is dezelfde: Reddit wordt gelezen, maar uiterst zelden geciteerd.
De cijfers die de ronde doen over "het aandeel van Reddit in AI" meten vaak iets anders. Promptwatch, geciteerd door Search Engine Land op 19 augustus 2026, stelde vast dat het aandeel van Reddit in de citaten van ChatGPT Search daalde van 3,83% tussen 18 juli en 7 augustus 2026 naar 0,52% van 14 tot 17 augustus, zonder de daling te kunnen verklaren of een probleem met de gegevensverzameling te kunnen uitsluiten. Tegelijkertijd daalde in de AI-antwoorden van Google het aandeel van Reddit langzaam van ongeveer 2,5% naar 2,1%. Een aandeel van de citaten, een aandeel van de antwoorden die minstens één keer naar Reddit verwijzen en een citatiepercentage van de opgehaalde pagina's zijn drie verschillende metingen; ze met elkaar verwarren leidt tot verschillen van één tot honderd.
Waarom Reddit overal aanwezig blijft
Reddit heeft licentieovereenkomsten getekend met de grote spelers op het gebied van AI. Op 22 februari 2024 kondigde Google een toegang aan tot de gegevens-API van Reddit, waarmee Google deze inhoud kan weergeven, erop kan trainen en deze op andere manieren kan gebruiken. Reddit levert zo zowel zoekresultaten als trainingsgegevens voor taalmodellen.
Wat een discussie op Reddit bijdraagt aan wat een model tijdens de training heeft geleerd, meet niemand van buitenaf, en wij ook niet. Het is mogelijk dat een regelmatige aanwezigheid op Reddit ertoe bijdraagt dat een naam vertrouwd raakt voor het model. Dat beweren we niet: wat we meten is wat het model zoekt en citeert op het moment van antwoorden, en op dat vlak vervangt Reddit geen pagina die de vraag beantwoordt.
Wat dit verandert voor een bedrijf
Aanwezig zijn op Reddit is niet nutteloos: Gemini citeert het en de discussie kan een naam bekendheid geven. Maar om te verschijnen in de bronnen die ChatGPT of Claude tonen, zijn er pagina's nodig die de vorm van het antwoord hebben, op websites die deze modellen raadplegen en citeren: een duidelijke vraag in de titel en het adres, een antwoord vanaf de eerste regels, uitgewerkte paragrafen die de woorden overnemen waarmee het model zoekt.
Bij de vragen over het oplossen van softwareproblemen die we hebben gemeten, citeerde ChatGPT geen enkele forumpagina uit de pagina's die zijn zoekopdracht had opgeleverd, hoewel deze pagina's bijna allemaal Reddit-threads waren. Claude citeerde er bijna een derde van, vooral gebruikerscommunities van een merk wanneer de vraag dat merk noemde. Ook hier is het model net zo belangrijk als het platform. Een strategie die op één enkel platform rust, of die zich richt op "AI" zonder onderscheid te maken tussen ChatGPT, Claude en Gemini, laat een deel van de antwoorden buiten beschouwing.
Wat we niet weten
Onze metingen hebben betrekking op de API van de modellen, niet op de interface van ChatGPT, Claude of Gemini. Ze beschrijven wat de modellen ophalen en citeren; ze meten niet het effect van een publicatie op Reddit, noch wat het model heeft geleerd tijdens zijn training.
Bronnen
- Ahrefs, Louise Linehan — "Why ChatGPT cites pages", .
- Search Engine Land, Danny Goodwin — aandeel van Reddit in de citaten van ChatGPT Search, gegevens Promptwatch, .
- Google, Rajan Patel — uitgebreid partnerschap met Reddit, .
- Metingen FaireDuBruit, van 4 tot 16 september 2026 — zie 'Hoe we hebben gemeten'.