Naar de inhoud gaan
AI-zichtbaarheid

Maakt Wikipedia een bedrijf zichtbaar in AI?

Gepubliceerd op

Niet direct, en niet voor de meeste bedrijven. Wikipedia weegt zwaar in wat AI-modellen leren, maar een Wikipedia-pagina van een bedrijf is alleen toegestaan als de onafhankelijke pers er al over heeft geschreven, en het garandeert geen enkele citatie. In onze metingen werden de Wikipedia-pagina's die door de zoekfunctie van ChatGPT werden opgehaald bij vragen over kunstmatige intelligentie, in slechts 1,3% van de gevallen geciteerd. Wikipedia maakt een bedrijf zichtbaar in AI wanneer het al bekend is; het vervangt geen pagina die de vraag van uw klant beantwoordt.

Voor welk type vraag? Alles hangt af van de vraag. Wanneer de gebruiker over Wikipedia spreekt, gaan de AI's Wikipedia lezen: op de vraag van deze pagina citeerde ChatGPT uiteindelijk de regels van de encyclopedie zelf. Bij een productvraag of een marktvraag, waarbij niemand naar Wikipedia verwijst, is de encyclopedie zelden de getoonde bron.

Het gewicht van Wikipedia bij het trainen van AI

Wikipedia maakt deel uit van de trainingsgegevens van grote taalmodellen, en heeft daar een gewicht dat groter is dan de omvang ervan. In het artikel dat in 2020 GPT-3 introduceerde, beschrijft OpenAI de datamix in detail: Wikipedia vertegenwoordigde slechts 3 miljard tokens en 3% van de mix, maar het model doorliep het 3,4 keer tijdens de training, tegenover 0,44 keer voor de gefilterde Common Crawl-dataset, die nochtans honderd keer groter is. De uitgevers publiceren dit detail niet meer voor recente modellen.

AI-spelers betalen ook om toegang te krijgen tot de gegevens van Wikipedia. Op 15 januari 2026 kondigde Wikimedia Enterprise nieuwe partners aan, Amazon, Meta, Microsoft, Mistral AI en Perplexity, die zich aansluiten bij onder andere Google. Wikipedia is dus een kennisbron voor de modellen en een gegevensbron voor de zoekmachines van de AI's. Maar wat het model heeft geleerd en wat het citeert bij het antwoorden zijn twee verschillende dingen.

Wikipedia in citaten: cijfers die niet hetzelfde meten

Het meest geciteerde cijfer is afkomstig van Profound, dat de citaten van ChatGPT, de AI-antwoorden van Google en Perplexity tussen augustus 2024 en juni 2025 heeft geanalyseerd. Wikipedia vertegenwoordigt daarin 7,8% van alle citaten van ChatGPT. Het cijfer van 47,9%, vaak gepresenteerd als "de helft van de citaten van ChatGPT", is in werkelijkheid uitsluitend het aandeel van Wikipedia onder de tien meest geciteerde domeinen.

Semrush, dat de antwoorden van ChatGPT volgde van 14 juli tot 12 oktober 2025, meet iets anders: het aandeel van de antwoorden die Wikipedia minstens één keer citeren. Dit aandeel daalde van ongeveer 55% naar minder dan 20% tussen augustus en september 2025. Een aandeel van alle citaten, een aandeel onder de belangrijkste domeinen en een aandeel van de antwoorden leveren cijfers op die variëren van één tot zeven; ze vergelijken zonder hun eenheid leidt tot onjuiste conclusies.

Wat wij hebben gemeten over Wikipedia

Wij meten voor elk domein het aandeel pagina's dat door de zoekfunctie van een AI wordt opgehaald en uiteindelijk wordt geciteerd. Bij ChatGPT werden, op vragen over kunstmatige intelligentie die hoofdzakelijk in het Engels werden gesteld, de opgehaalde Wikipedia-pagina's in 1,3% van de gevallen geciteerd. Samen met Reddit en YouTube blijven ze onder de 1,5% in al onze corpussen, terwijl de andere opgehaalde pagina's in 10 tot 15% van de gevallen worden geciteerd.

Op de vraag van deze pagina, gesteld op 15 september 2026, vertegenwoordigde Wikipedia 23% en vervolgens 27% van de door ChatGPT opgehaalde resultaten, en 24% en vervolgens 21% bij Claude. ChatGPT citeerde de eerste keer geen enkele Wikipedia-pagina, en citeerde er de tweede keer een in 17% van zijn bronnen: het artikel over de relevantieregels van Wikipedia. Claude citeerde het in 7% van zijn bronnen, voor de criteria voor de toelaatbaarheid van bedrijven. Gemini heeft er geen enkele opgehaald noch geciteerd. Wanneer de vraag over Wikipedia gaat, stijgt de encyclopedie in de citaten; het is de vraag die erom vraagt, niet de bekendheid van het bedrijf.

Kan een bedrijf een eigen Wikipedia-pagina hebben?

De regels zijn streng. Op Wikipedia in het Frans is een artikel over een bedrijf alleen toelaatbaar als er significante, onafhankelijke en gepubliceerde werken over zijn verschenen, met een tussenpoos van minstens twee jaar. Publicaties die voortkomen uit de communicatie van het bedrijf, zoals persberichten, herdrukken van artikelen of advertenties, tellen niet mee. Op Wikipedia in het Engels wordt geen enkel bedrijf automatisch als toelaatbaar beschouwd, ongeacht de omvang ervan.

Het tegen betaling laten schrijven van een eigen pagina is gereguleerd: de betaalde bijdrage moet de identiteit van de klant of de werkgever vermelden, en promotionele bijdragen blijven ten strengste verboden. Voor een mkb-bedrijf zonder onafhankelijke persaandacht verspreid over ten minste twee jaar is een Wikipedia-pagina dus geen beschikbare hefboom: het is een gevolg van bekendheid, niet een middel om deze te verkrijgen.

Wat dit verandert voor een bedrijf

Proberen op Wikipedia te komen om zichtbaar te zijn in AI-systemen pakt het probleem verkeerd om aan. Wat we bij ChatGPT waarnemen, is dat het in zijn zoekopdracht de namen schrijft van de bronnen die het kent en deze bij voorkeur citeert. Een naam wordt opgebouwd door vermeldingen in onafhankelijke bronnen die AI-systemen raadplegen; deze zelfde vermeldingen zijn overigens wat Wikipedia vereist om een bedrijf toe te laten.

De begaanbare weg is dan ook om, op pagina's die AI-systemen lezen en citeren, antwoord te geven op de vragen die uw klanten zich stellen, en vermeld te worden waar deze vragen worden behandeld. Een Wikipedia-pagina kan daarna komen, als de pers volgt; deze gaat niet vooraf aan de zichtbaarheid.

Wat we niet weten

Onze metingen hebben betrekking op de API van de modellen, niet op de interface van ChatGPT, Claude of Gemini. We meten niet het effect, voor een bedrijf, van het hebben van een Wikipedia-pagina op zijn citaten in AI-systemen; geen enkele gepubliceerde studie die we hebben gelezen meet dit overigens.

Bronnen

  1. Brown et al., OpenAI — "Language Models are Few-Shot Learners" (GPT-3), tabel 2.2, .
  2. Wikimedia Enterprise — aangekondigde partners voor het 25-jarig bestaan van Wikipedia, .
  3. Profound, Nick Lafferty — "AI platform citation patterns", .
  4. Semrush, Luke Harsel — meest geciteerde domeinen door AI-systemen, .
  5. Wikipedia — Bekendheid van ondernemingen, bedrijven en producten, .
  6. Wikipedia — Betaalde bijdragen, .
  7. Metingen FaireDuBruit, van 4 tot 16 september 2026 — zie 'Hoe we hebben gemeten'.

Vergelijkbare vragen

Alle vragen over de zichtbaarheid in AI · Ons aanbod