Deze week in AI Search News: ChatGPT kiest zijn shortlist voordat het een pagina opent, de fetch bot negeert robots.txt, Franse uitgevers stappen naar de toezichthouder, Anthropic markeert alles wat Claude schrijft, Shopify telt AI-referrals, en nieuwe citatiedata laat zien waar zichtbaarheid wordt opgebouwd.
ChatGPT kiest zijn shortlist voordat het zoekt
Suganthan Mohanadasan analyseerde 57 ChatGPT-gesprekken en 3.554 gelabelde pagina's, gepubliceerd op 14 augustus. Hij meette één moment: welke merken ChatGPT in zijn eigen zoekopdrachten typt, voordat het iets ophaalt.
Merken in die zelfgeschreven queries werden in 68,9% van de gevallen genoemd in het uiteindelijke antwoord. Merken die alleen opdoken in de opgehaalde pagina's werden in 2,1% van de gevallen geciteerd. In de query staan is ongeveer 33 keer zoveel waard als vindbaar zijn.
Het model komt binnen met een shortlist die al vaststaat. Het ophalen bevestigt vooral wat het toch al ging zeggen. Jouw pagina's strijden om de tweede plaats, en de eerste plaats werd bepaald voordat de prompt getypt werd.
Wat onze eigen fanout-data laat zien
Wij meten query fanout, de sub-queries die een model voor zichzelf schrijft. In de 30 dagen tot 17 augustus legden vier klantaccounts 12.326 sub-queries vast op 235 gemonitorde prompts.
ChatGPT breidt bijna elke prompt uit, met 1,4 tot 1,7 sub-queries per antwoord. Perplexity stond in alle vier de accounts op 1,0. Perplexity zoekt de vraag die het krijgt. ChatGPT herschrijft die eerst. Het shortlist-effect is een herschrijfeffect, dus het is vandaag vooral een ChatGPT-probleem.
Wat ChatGPT in die herschrijvingen zet, verschilt sterk per categorie. In een B2B-account voor manufacturing software kwamen prompts zonder merknaam terug met leveranciersnamen die de gebruiker nooit had getypt. "Top supply chain planning tools for multi-plant manufacturers 2026" leverde sub-queries op die Kinaxis, o9, Blue Yonder, SAP IBP, Anaplan, Oracle en PlanetTogether noemden, meerdere met Gartner erbij als autoriteitssignaal. Twee richtten site:-operators rechtstreeks op de domeinen van leveranciers.
In drie andere accounts, een marketplace-softwareleverancier, een Nederlandse kozijnenleverancier en een Nederlandse kliniek, gebeurde dat niet. Prompts zonder merknaam leverden algemene herformuleringen op over kosten, subsidie, materiaal en behandeling. Er werd geen leverancier genoemd. Merknamen kwamen alleen in de fanout terecht als de prompt van de gebruiker ze al bevatte.
De premie van 33 keer geldt dus alleen waar het model al een shortlist heeft. Waar dat niet zo is, bepalen de opgehaalde pagina's nog steeds het antwoord. Dat is de baan die een uitdager kan winnen.
Vergelijkingsprompts zetten de fanout wijd open. In het Nederlandse leveranciersaccount leverden prompts die vier leveranciers in één keer noemden tot 4,6 sub-queries per antwoord op, en 141 unieke sub-queries uit één prompt, tegen ongeveer 1,2 bij een vraag over één onderwerp.
Onze kijk erop: AI-zichtbaarheid wordt buiten je eigen website opgebouwd. Wat het model met jouw categorie associeert, komt uit hoe anderen je beschrijven op het open web. Je eigen pagina's bepalen nog steeds of je de bevestigingsstap overleeft. Zodra ChatGPT een merk vooraf heeft genoemd, gaat het op zoek naar de officiële pagina's van dat merk, soms met een site:-query. De shortlist zorgt dat er naar je gezocht wordt. Je pagina's bepalen wat het vindt.
Je robots.txt houdt de fetch bot van ChatGPT niet tegen
Het State of the Bots-rapport van TollBit over de eerste helft van 2026 werd op 14 augustus behandeld. ChatGPT-User bereikte geblokkeerde pagina's op meer sites dan welke andere bot ook. Op Europese sites die de bot expliciet in robots.txt noemden, kwam hij bij bijna de helft alsnog bij geblokkeerde URL's. Ongeveer 15% van de geïdentificeerde AI page fetchers bereikte geblokkeerde URL's op Europese sites.
De documentatie van OpenAI legt uit waarom. ChatGPT-User haalt een pagina op omdat een gebruiker op dat moment een vraag stelt, dus ziet OpenAI het als een handeling van een persoon en zegt het dat robots.txt mogelijk niet geldt. Claude-User en Perplexity-User worden door minder sites geblokkeerd, dus het patroon is het scherpst rond OpenAI.
Digiday meldde dezelfde dag dat Europese uitgevers harder geraakt worden dan Noord-Amerikaanse: meer scraping, minder referrals, vaker genegeerde robots.txt-regels.
Je robots.txt legt vast wat je gevraagd hebt. Je serverlogs en CDN-records laten zien wat er gebeurd is. Wil je ChatGPT eruit houden, dan moet je ChatGPT-User én OAI-SearchBot blokkeren en het daarna in de logs controleren. De meeste merken die wij auditen hebben het omgekeerde probleem. Ze blokkeren AI-crawlers per ongeluk, controleren het nooit, en vragen zich daarna af waarom ze ontbreken in AI-antwoorden.
Driehonderd Franse kranten stappen naar de toezichthouder over AI Overviews
APIG, de alliantie die bijna 300 Franse kranten vertegenwoordigt, diende op 11 augustus een klacht in bij de Franse mededingingsautoriteit. De uitgevers stellen dat Google AI Overviews in Frankrijk aanzette zonder hun toestemming en daarmee een compensatieovereenkomst uit 2022 schond. De AI-samenvattingen beantwoorden de vraag binnen Search en nemen het verkeer naar de oorspronkelijke artikelen weg. APIG-voorzitter Marc Feuillee zei dat de uitgevers de waarde gedeeld willen zien en het gebruik van hun content vergoed.
Frankrijk legde Google in 2024 een boete van 250 miljoen euro op in hetzelfde dossier rond naburige rechten, en een EU-onderzoek naar het gebruik van uitgeverscontent voor AI loopt nog. Google zegt dat AI Overviews mensen helpen om complexere vragen te stellen en ze alsnog naar nieuwe content brengen.
Onze eigen ronde langs ondernemerscommunities op 2 augustus liet zien dat Frankrijk de enige Europese markt is met levende, vindbare vraag naar hulp bij AI-zichtbaarheid. Nederlandse en Duitse vraag was feitelijk nul over ongeveer 100 sub-specifieke zoekopdrachten. Elke verse Franse klachtenthread dateert van ná de AI Overviews-lancering daar op 22 juli. De klacht van de uitgevers en de reactie van ondernemers zijn twee symptomen van één gebeurtenis, drie weken uit elkaar.
Anthropic markeert alles wat Claude schrijft, en het merk is het zwakst waar het meest verdient
Op 11 augustus begon Anthropic met het inbouwen van machineleesbare watermerken in de tekst van Claude. Het geldt voor Claude, de Claude API, Claude Code, Claude Cowork en Claude Tag. Modellen die op of na 2 augustus uitkwamen dragen het, en Anthropic bouwt het met terugwerkende kracht in oudere modellen. Gegenereerde PNG-, JPG- en SVG-bestanden krijgen daarnaast ondertekende C2PA-provenance-metadata. De belofte komt uit de code of practice van de EU AI Act, maar Anthropic zette het aan overal waar Claude werkt, niet alleen in Europa.
Anthropic maakte het mechanisme op 15 augustus bekend. Er zitten geen verborgen tekens en geen metadata in de tekst. Het model verandert de bron van de willekeur waarmee het het volgende woord kiest. Een geheime sleutel en de voorgaande woorden bepalen welke kandidaten een klein zetje krijgen, waardoor de tekst een statistisch patroon draagt dat alleen met de sleutel leesbaar is. Het is een variant op SynthID-Text van Google DeepMind, gepubliceerd in Nature in 2024. Het kost geen extra tokens en bijna geen snelheid.
Onze collega Felix Koole schreef de helderste uitleg die wij gelezen hebben, op 15 augustus. Hij beschrijft het als een verzwaarde muntworp over de ongeveer 100.000 mogelijke tokens van het model, waarbij de vorige drie tokens bepalen welke een zetje krijgen. Detectie vraagt daarna of die opgetilde tokens door een document blijven terugkomen. Je kunt 40% tot 50% van de tekst met de hand herschrijven, of overstappen naar een model zonder watermerk, maar beide kosten meer dan ze opleveren. "The best option seems to me to just accept it." Hij voegt toe dat het taboe eraf is en dat tekst van mensen het vaak toch beter doet.
De voorbehouden van Anthropic zijn helder. Een watermerk bewijst niet dat Claude de ideeën of de oorspronkelijke tekst schreef, en een ontbrekend watermerk maakt tekst niet menselijk. Search Engine Journal noemde op 14 augustus vijf gewone manieren waarop gemarkeerde tekst schoon terugkomt: een ouder model, zwaar redigeren of parafraseren, een passage onder 200 tokens, metadata die bij een bestandsconversie verdwijnt, en niet-ondersteunde markeringen. Een hit betekent alleen dat Claude de tekst op een moment heeft aangeraakt. Dat kan een vertaling of een correctieronde zijn.
Henning Steier maakte op 11 augustus het scherpste punt. Een watermerk heeft keuze nodig om zich in te verstoppen. In low-entropy output zoals code, tabellen, JSON en korte feitelijke antwoorden heeft het model weinig geldige alternatieven, dus is er weinig ruimte om een patroon in te bouwen. Dat is ook het dichtste deel van de business van Anthropic, met Claude Code op een annualised run rate van 2,5 miljard dollar in februari. Agentic workflows maken het erger, want elke formatter, compiler en refactor-ronde is opnieuw een herschrijving. Het merk is het zwakst waar het product het meest verdient.
Onze kijk erop: behandel dit als een labelstandaard, niet als een detector. Niemand buiten Anthropic kan het nu kalibreren, want de detectietools en de documentatie moeten nog komen. Felix legt de drempel voor verwijdering bij een herschrijving van 40% tot 50%, Anthropic zegt dat alleen een volledige herschrijving hem wist, en dat gat is vandaag niet te controleren. Het is ook precies het getal dat elke AI-detectieleverancier binnenkort zal claimen te kennen. Je risico zit niet in je eigen blog. Het zit in een klant, een journalist of een marketplace die een detector op je content zet en een hit leest als bewijs van auteurschap, of een miss als bewijs van een mens. Beide lezingen zijn fout. Houd je eigen vastlegging bij van hoe een stuk gemaakt is. Dat is bewijs. Een watermerk niet.
AI-referrals converteren goed, en ze zijn nog steeds klein
Shopify publiceerde commerce-data over het tweede kwartaal, gemeld op 13 augustus. AI-referred sessies naar webshops van merchants groeiden met 197% jaar op jaar. Organische search groeide met 12%. Organische search stuurde nog altijd meer verkeer naar Shopify-merchants dan alle gemeten AI-platformen bij elkaar.
In categorieën waar specificaties zwaar wegen, converteerden AI-referred shoppers ongeveer twee keer zo goed als organische bezoekers. Die verdubbeling kwam naar voren wanneer AI-systemen de gestructureerde data uit Shopify Catalog gebruikten. In bredere categorieën bracht AI ongeveer 1,3 keer meer nieuwe klanten binnen.
Digiday publiceerde dezelfde dag het bijpassende probleem: CMO's krijgen AI-zichtbaarheid niet gekoppeld aan omzet. 73% van de marketeers heeft al monitoringtools gekocht, zoals Scrunch en Profound. Die tools schatten in hoe modellen een merk beschrijven. Ze meten geen omzet. Teams trianguleren daarom: zichtbaarheidsscores, conversiedata uit betaalde ChatGPT-campagnes en media mix-modellen door elkaar. Hetzelfde stuk meldt dat B2B-merken hun ChatGPT-referred bezoeken met 303% jaar op jaar zagen stijgen, van 645.000 naar 2,6 miljoen tussen juni 2025 en juni 2026.
Onze kijk erop: neem beide helften mee naar je directie. Het volume is nog een klein deel van je verkeer, en de bezoekers zijn per sessie meer waard dan je gemiddelde organische bezoeker. De ene knop waar je dit kwartaal aan kunt draaien is gestructureerde productdata, want Shopify liet net zien dat die de conversie verdubbelt van het verkeer dat je al binnenkrijgt.
De twee plekken waar AI-zichtbaarheid wordt opgebouwd
Kevin Indig publiceerde op 12 augustus een analyse van ongeveer 35.000 ChatGPT-citaties. Hij meette het aandeel unieke geciteerde domeinen, zonder de domeinen van leveranciers mee te tellen. User-generated content-platformen hebben 17,1% van de geciteerde domeinen. Uitgevers hebben 4,0%. Wikipedia is de grootste losse derde partij, met 10,1 tot 14,0 punten. Reddit is groot maar wisselvallig, en LinkedIn wordt sterker voor personen met naam.
Reviewplatformen bewegen van 7,4% bij discovery naar 13,2% bij evaluatie. UGC blijft over alle vier de fases tussen 15,1% en 18,2%. Indig vat het zo samen: reviewplatformen zijn een betrouwbare knop onderaan de funnel, en UGC is een bodem.
Stanley 1913 deed de andere helft van het werk. Digiday meldde op 12 augustus dat het merk zijn productpagina's herschreef voor AI-antwoorden. Het voegde FAQ's per product toe, onderhoudsinstructies en teksten per gelegenheid, waar het eerder vooral op beeld leunde. Het voegde structured data toe om productfeiten gelijk te houden in search en in chat. Het test Shopify en Google's Universal Commerce Protocol om de catalogus in gesprekken te krijgen. Het houdt bij welke externe bronnen AI-tools als gezaghebbend behandelen. Chief Brand Officer Kate Ridley zei dat het doel is om de eigen merkstem intact te houden binnen natuurlijke antwoorden.
Onze kijk erop: lees dit naast het shortlist-onderzoek aan het begin. Je eigen pagina's bepalen of je de bevestigingsstap overleeft. De communities van anderen bepalen of je de shortlist überhaupt bereikt. Stanley doet beide helften, en de tweede helft is de helft die de meeste merken overslaan.
In de GEO- en marketingcommunities waar wij dagelijks zitten, is de vraag niet hoe je geciteerd wordt. Het is hoe je aantoont dat een fix werkte terwijl er elke week vier dingen live gaan. Groepeer het werk per claim in plaats van per kalenderweek, zodat geen twee wijzigingen in hetzelfde venster hetzelfde feit raken. En controleer je AI-antwoorden vanuit een schone, uitgelogde sessie, want een check vanuit je eigen account leunt op je eigen chatgeschiedenis.
Ook opgevallen
• OpenAI haalt de sources-knop uit de footer van het antwoord en verplaatst hem naar het drie-punts-menu "More actions". Bij dezelfde citatie zullen minder mensen doorklikken naar jou.
• Scrunch volgde van februari tot juni een opt-in panel en vond dat maar 1,1% van de bezoeken aan nieuwsuitgevers een AI-referrer had. Ongeveer 75% van de bezoeken na een AI-gesprek was direct, en grote uitgevers pakten 97% van de doorstroom.
• SE Ranking onderzocht 50.006 prompts en vond dat ChatGPT advertenties toont bij 25,94% van de commerciële queries, waarbij ruim 14% van die advertenties bij het verkeerde onderwerp verschijnt.
• Microsoft Clarity splitst AI-citatiequeries nu in branded en non-branded. Alleen de non-branded helft telt als discovery.
Dat was de week. Wil je weten wat dit betekent voor je eigen AI-zichtbaarheid? Onze deur staat open.