Moet u origineel zijn of zeggen wat iedereen zegt om geciteerd te worden door een AI?
Gepubliceerd op
Eerst zeggen wat betrouwbare bronnen zeggen, en dan toevoegen wat alleen u weet. Bij Claude wordt een pagina waarvan de inhoud overeenkomt met die van de andere gevonden pagina's tot 1,5 keer vaker geciteerd, en een pagina die door meerdere verschillende zoekopdrachten voor hetzelfde antwoord wordt gevonden, wordt in 88 tot 100 % van de gevallen geciteerd (afhankelijk van het corpus), tegenover 50 tot 60 % voor de andere. Originaliteit alleen zorgt er niet voor dat een pagina wordt gekozen. Maar zodra de pagina eenmaal is geselecteerd, onderscheidt deze zich door eigen gegevens, cijfers en geciteerde bronnen.
Voor welk type vraag? Alles hangt af van de vraag. Bij een informatieve of marktgerelateerde vraag zoekt de AI naar de gemeenschappelijke deler van de bronnen. Bij een vraag over u, uw product of uw gegevens, gaat ze op zoek naar uw eigen bron, en dan wordt originaliteit het antwoord.
Wat we hebben gemeten: de consensus wint bij Claude
Voor elke door Claude gevonden pagina hebben we gemeten in welke mate de woordenschat overeenkomt met die van de andere pagina's die voor hetzelfde antwoord zijn opgehaald. De pagina's die het meest redundant zijn met de rest, worden 1,5 keer vaker geciteerd in de HVAC-sector en de kunstmatige intelligentie, en 1,4 keer in een tiental sectoren in het Frans; het effect blijft aanwezig in het Engels, maar is zwakker. Als we pagina's van dezelfde site weglaten, houdt het effect nog steeds stand, van 1,3 tot 1,5 keer. En onder de geciteerde pagina's is het aandeel unieke woordenschat van de pagina kleiner dan bij de uitgesloten pagina's.
Een tweede signaal wijst in dezelfde richting. Wanneer dezelfde pagina door twee verschillende zoekopdrachten voor hetzelfde antwoord wordt opgehaald, citeert Claude deze bijna altijd: 100 % van de gevallen in de HVAC-sector, 93 % in kunstmatige intelligentie, 93 % in de tientallen sectoren in het Frans en 88 % in het Engels, tegenover 50 tot 60 % voor een pagina die slechts één keer is gevonden. Een pagina die antwoord geeft op meerdere facetten van de vraag, met de verwachte woorden, wordt vaker gevonden en vaker geselecteerd.
De woordenschat van het vakgebied in de paragraaf
De consensus is ook te zien op het niveau van de geciteerde passage. Bij Claude wordt een paragraaf die dichtbezet is met woordenschat die specifiek is voor het behandelde vakgebied (de termen die de bronnen over het onderwerp delen), 3 tot 13 keer vaker geciteerd dan een paragraaf die deze niet bevat, afhankelijk van het corpus. De AI kiest de passage die de taal van het onderwerp spreekt.
Dit betekent niet dat u anderen moet kopiëren. Een paragraaf kan de gemeenschappelijke woordenschat van het vakgebied gebruiken en toch iets specifieks, gedateerds of cijfermatigs zeggen. Dit is wat de meest geciteerde pagina's doen: ze sluiten aan bij wat er in het vakgebied wordt gezegd, en voegen daar vervolgens iets aan toe.
Wat het onderzoek zegt over recepten voor originaliteit
Het artikel dat de term GEO lanceerde, gepresenteerd op de KDD-conferentie in 2024, testte inhoudswijzigingen in een gesimuleerde generatieve zoekmachine, gebaseerd op GPT-3.5, op een testomgeving van 10.000 zoekopdrachten. Het toevoegen van citaten, statistieken en bronnen verhoogde de zichtbaarheid met wel 40 %, terwijl het volproppen met zoekwoorden bijna niets opleverde. Op Perplexity was de best gemeten winst in reële omstandigheden 22 %. In dit kader was de pagina al aan de engine geleverd: de studie meet het aandeel van de pagina in het antwoord, niet de kans om te worden gevonden.
Een testomgeving gepubliceerd op NeurIPS in 2025, C-SEO Bench, concludeert daarentegen dat de meeste methoden voor conversationele optimalisatie grotendeels ineffectief zijn en vaak een negatief effect hebben, dat de winst afneemt wanneer meerdere spelers ze toepassen, en dat traditionele SEO-strategieën aanzienlijk effectiever zijn. De twee resultaten spreken elkaar niet noodzakelijkerwijs tegen: het verrijken van een pagina helpt zodra deze gelezen is, maar zorgt er niet voor dat deze gevonden wordt.
Waarom AI de voorkeur geeft aan wat gedeeld wordt
Een AI die antwoordt, zet haar betrouwbaarheid op het spel. Het overnemen van de gemeenschappelijke deler van meerdere bronnen verkleint het risico om fouten te maken, en een geïsoleerde pagina die iets anders beweert dan alle andere vormt een risico. Bij ChatGPT neemt dit gedrag een andere vorm aan: het model noemt in zijn zoektocht de bronnen die het als gevestigd beschouwt, en citeert deze als eerste.
Onderzoekers van de Universiteit van Toronto hebben in september 2025 un systematische bias van AI-zoekmachines gemeten in het voordeel van onafhankelijke en erkende media, ten nadele van merksites en sociale netwerken. Voor een bedrijf is origineel zijn op de eigen site dus minder belangrijk dan consistent zijn met wat externe bronnen zeggen, en door hen genoemd te worden.
Wat Google 'banaal' noemt
Google benadrukt de andere kant. Zijn gids over optimalisatie voor generatieve AI, bijgewerkt op 10 juli 2026, raadt „niet-banale” content aan: hij stelt content gebaseerd op algemene kennis, die van iedereen had kunnen komen en weinig toevoegt, tegenover content die het standpunt van een expert of een praktijkervaring deelt, die het gewone overstijgt. Volgens Google zal content die mensen uniek, overtuigend en nuttig vinden, waarschijnlijk de aanwezigheid van een site in zijn AI-antwoorden beïnvloeden.
Onze metingen en deze aanbeveling spreken elkaar niet tegen. Bij Claude helpt het afstemmen van het vocabulaire van het vakgebied een pagina om te worden gevonden en onthouden; bij Google levert het herhalen van wat iedereen al weet niets op. Een nuttige pagina doet beide: ze spreekt de taal van het onderwerp, en ze brengt wat de anderen niet zeggen.
Wat dit verandert voor een bedrijf
Een pagina die geciteerd wil worden, begint met het behandelen van wat het vakgebied over de kwestie zegt, met het bijbehorende vocabulaire, in uitgewerkte paragrafen. Vervolgens brengt ze wat zij als enige kan brengen: een meting, een gedateerd cijfer, een ervaring, een methode. Originaliteit komt na het fundament, niet in de plaats daarvan.
Deze rubriek volgt deze opbouw: elke pagina presenteert eerst wat andere studies publiceren, ondersteund door bronnen, en vervolgens onze eigen metingen met hun context. De consensus zorgt ervoor dat de pagina wordt gevonden en onthouden; de eigen meting is wat het verdient geciteerd te worden.
Wat we niet weten
De overlap in vocabulaire en de multipliciteit worden gemeten bij Claude, die de volledige pagina's leest; bij ChatGPT hebben we deze metingen niet geformaliseerd. Onze rapporten beschrijven associaties op de API van de modellen, niet het effect van het herschrijven van een pagina.
Bronnen
- Aggarwal et al. — „GEO: Generative Engine Optimization”, KDD 2024, .
- Puerto et al. — „C-SEO Bench: Does Conversational SEO Work?”, NeurIPS 2025, .
- Chen, Wang, Chen, Koudas (Universiteit van Toronto) — „Generative Engine Optimization: How to Dominate AI Search”, .
- Google Search Central — „Optimizing your website for generative AI features on Google Search”, .
- Metingen FaireDuBruit, van 4 tot 16 september 2026 — zie 'Hoe we hebben gemeten'.