August Vonk
Analyse

ChatGPT gebruikt niet ‘gewoon Bing’. De werkelijkheid is veel interessanter.

August Vonk
Kort antwoordChatGPT Search is geen Bing-wrapper. OpenAI bevestigt zelf dat het zoekopdrachten herschrijft en met externe search providers werkt, en reverse-engineering van de interface wijst op een eigen retrievalindex met verticals, meerdere externe SERP-providers en gespecialiseerde databronnen. Je klassieke ranking is daarmee één route naar zichtbaarheid, naast crawler-toegang voor OAI-SearchBot en aanwezigheid in verticale bronnen.
Schema van ChatGPT Search: één prompt wordt herschreven en opgesplitst in meerdere zoekopdrachten, die parallel gaan naar OpenAI-eigen retrieval, externe zoekdiensten en verticale databronnen, gevolgd door reranking, synthese en citations.Schema van ChatGPT Search: één prompt wordt herschreven en opgesplitst in meerdere zoekopdrachten, die parallel gaan naar OpenAI-eigen retrieval, externe zoekdiensten en verticale databronnen, gevolgd door reranking, synthese en citations.
ChatGPT Search combineert eigen retrieval, externe zoekdiensten en verticale databronnen voordat er één antwoord met bronvermelding uit komt.

Ik hoor hem nog verrassend vaak: “voor ChatGPT hoef je eigenlijk alleen maar goed te ranken in Bing.”

Logisch. Microsoft investeerde miljarden in OpenAI. Bing heeft een enorme zoekindex. ChatGPT Search gebruikt externe zoekproviders. Dus ChatGPT is Bing.

Alleen klopt dat inmiddels niet meer. Of beter gezegd: het is veel te simpel.

Wat OpenAI zelf bevestigt

Laten we eerst het gedeelte nemen dat níét uit reverse-engineering komt. OpenAI zegt officieel dat ChatGPT Search met externe search providers kan samenwerken en zoekopdrachten herschrijft naar één of meerdere gerichte searches. Het systeem kan vervolgens aanvullende searches uitvoeren wanneer meer informatie nodig is.

OpenAI heeft daarnaast zijn eigen crawler: OAI-SearchBot. Openbare websites kunnen in ChatGPT Search verschijnen wanneer deze crawler toegang heeft. OpenAI zegt ook expliciet dat URLs via externe search providers kunnen worden ontdekt.

We weten dus sowieso dat ChatGPT Search geen simpele Bing-wrapper is.

Toen begonnen onderzoekers naar de netwerkdata te kijken

In 2026 werd het interessanter. Onderzoekers analyseerden de Server-Sent Events die de ChatGPT-interface tijdens searches ontving. Tussen mei en juli verscheen daar een veld result_source, waarin vier labels terugkwamen: labrador, bright, oxylabs en serp.

Peec AI reconstrueerde hieruit een veel bredere retrievalarchitectuur. Search Engine Land rapporteerde onafhankelijk vergelijkbaar onderzoek naar dezelfde labels.

Belangrijke disclaimer: OpenAI documenteert deze interne namen niet publiek. We kijken hier dus naar reverse-engineering. Maar wel behoorlijk interessante reverse-engineering.

Labrador lijkt meer te zijn dan één webindex

Peec AI vond meerdere Labrador-verticals, onder andere voor algemene webcontent, PDF’s, YouTube, news, Wikipedia, arXiv, local, finance, legal, medical, shopping en images. Volgens de analyse slaat het systeem onder andere volledige page content, crawl dates en publication dates op.

Dat suggereert iets fundamenteels. ChatGPT hoeft niet voor ieder antwoord een live Google- of Bing-resultaat op te halen. Een deel van de candidate set kan uit eigen opgeslagen retrievaldata komen.

En dan zijn er nog de externe lagen

Dezelfde reverse-engineering vond retrieval via Bright, waarschijnlijk Bright Data, onder andere voor Google-resultaten. Via Oxylabs, een bekende SERP-scrapingprovider. En via een derde kanaal waarvan Peec de precieze provider niet hard kon vaststellen.

Dat laatste is belangrijk. Ik zou dus níét publiceren dat ChatGPT SerpApi gebruikt. Daar is op basis van deze data onvoldoende bewijs voor. Er staat serp. Dat kan verschillende dingen betekenen.

Verder werden gespecialiseerde databronnen en providers aangetroffen voor onder andere local en travel. Peec noemt Yelp, TripAdvisor en Microsoft’s Web IQ.

Vijf stappen van ChatGPT Search: je vraag in natuurlijke taal, query rewriting waarbij meerdere zoekopdrachten worden gemaakt, zoeken in web, nieuws, academische en interne bronnen, het selecteren en rangschikken van de relevantste resultaten, en tot slot een gegenereerd antwoord met bronvermelding.Vijf stappen van ChatGPT Search: je vraag in natuurlijke taal, query rewriting waarbij meerdere zoekopdrachten worden gemaakt, zoeken in web, nieuws, academische en interne bronnen, het selecteren en rangschikken van de relevantste resultaten, en tot slot een gegenereerd antwoord met bronvermelding.
Van prompt naar antwoord in vijf stappen. De architectuur hierboven laat zien wélke bronnen daarbij worden aangesproken.
Bron: Officiële OpenAI-documentatie plus third-party reverse-engineering, 2026. De interne infrastructuur kan veranderen en is niet volledig gepubliceerd.

Dat is iets anders dan “check je Bing rankings”.

Zelfs OpenAI wist dat één externe index niet genoeg was

Er is ook publiek juridisch bewijs dat OpenAI al langere tijd probeert minder afhankelijk te zijn van één zoekprovider. In stukken uit de Amerikaanse antitrustzaak tegen Google staat dat OpenAI in 2023 begon met het grounden van ChatGPT via third-party search results.

In 2024 probeerde OpenAI daarnaast toegang tot Google’s Search API te krijgen. Google wees die samenwerking af. OpenAI-productleider Nick Turley getuigde bovendien over hoe moeilijk het is om een hoogwaardige zoekindex te bouwen.

Dat is belangrijk. Een zoekmachine bouwen is blijkbaar iets ingewikkelder dan npm install search-engine.

De cache maakt het nog vreemder

Live retrieval is duur. Websites zijn traag. Servers vallen uit. Pages veranderen. Daarom is caching vrijwel onvermijdelijk op deze schaal.

Peec testte ChatGPT in omstandigheden waarin live webtoegang beperkt was en zag dat het systeem nog steeds versies van webpagina’s kon terughalen. De onderzoekers observeerden daarnaast agressieve crawling van miljoenen pagina’s.

De versie die ChatGPT kent hoeft niet exact de versie te zijn die vandaag live staat.

Dat kan verklaren waarom oude prijzen blijven terugkomen, verwijderde informatie nog rondhangt, en een bijgewerkte pagina niet direct andere antwoorden oplevert.

Ik zou voorlopig voorzichtig zijn met claims als “ChatGPT bewaart iedere verwijderde pagina zes maanden”. Daar is nog onvoldoende universeel bewijs voor. Maar dat caching en indexstaleness onderdeel van het systeem zijn, lijkt steeds moeilijker te ontkennen.

Waarom dit SEO-technisch interessant wordt

Stel dat je pagina Google positie 28 heeft en Bing positie 17. Maar OAI-SearchBot heeft je pagina gecrawld en je hebt unieke informatie die precies antwoord geeft op één specifieke fan-out. Dan bestaat er een route naar ChatGPT-visibility waarbij je klassieke ranking helemaal niet indrukwekkend hoeft te zijn.

Andersom kan ook. Je staat nummer drie in Google. Maar OAI-SearchBot wordt geblokkeerd, je belangrijke content is client-rendered, ChatGPT heeft een oude cached version, de fan-out zoekt via een andere source provider, of een verticale database geeft betere informatie. En je wordt niet geciteerd.

Dit is waarom GEO niet netjes in een rank tracker past.

Hoe audit je hier dan voor?

Ik zou drie retrievallagen afzonderlijk bekijken.

1. OpenAI accessibility

Controleer OAI-SearchBot, robots.txt, serverlogs, CDN en WAF, de HTML-response, interne links en sitemap discovery. OpenAI zegt zelf dat het toestaan van OAI-SearchBot nodig is als je wilt dat je content goed kan worden ontdekt, samengevat en geciteerd.

2. Klassieke search presence

Blijf kijken naar Google, Bing, indexatie, rankings en snippetkwaliteit. Externe searchproviders blijven duidelijk onderdeel van de infrastructuur. SEO is dus niet weggegooid.

3. Vertical presence

Afhankelijk van je sector. Travel: reviewplatforms, maps, OTA-data, lokale listings. E-commerce: feeds, Shopping Graph, productdata, reviews. Finance: filings, officiële documenten, actuele data. B2B: eigen website, reviewplatforms, vakmedia, onafhankelijke vergelijkingen.

Je optimaliseert niet één index meer. Je probeert aanwezig te zijn in de informatieketen.

De echte conclusie

“ChatGPT gebruikt Bing” was een nuttige shortcut toen we weinig inzicht hadden in het systeem. In 2026 weten we meer. Niet alles. Maar genoeg om te zeggen dat ChatGPT Search informatie uit een veel breder retrieval-ecosysteem haalt.

Google en Microsoft blijven belangrijk. Maar ze zijn niet het hele verhaal. Je eigen crawlability telt. OpenAI’s eigen retrieval lijkt te tellen. Verticaal specifieke databronnen tellen. Externe searchproviders tellen. En uiteindelijk bepaalt een aparte selectie- en syntheselaag wat de gebruiker daadwerkelijk ziet.

De toekomst van SEO wordt daardoor ironisch genoeg minder “waar rank ik?” en steeds meer “in welke databronnen bestaat mijn merk eigenlijk?”.

Dat is een veel lastiger audit. Maar ook een veel interessantere.

Veelgestelde vragen

Gebruikt ChatGPT gewoon Bing?

Nee. OpenAI werkt met externe search providers, maar heeft ook een eigen crawler (OAI-SearchBot) en, volgens reverse-engineering van de ChatGPT-interface, eigen opgeslagen retrievaldata met verticals voor onder andere PDF, Wikipedia, YouTube en news.

Wat moet ik technisch regelen voor ChatGPT?

Blokkeer OAI-SearchBot niet in robots.txt, CDN of WAF, zet cruciale content in de HTML-response en controleer je serverlogs of de crawler daadwerkelijk binnenkomt.

Waarom noemt ChatGPT verouderde informatie over mijn merk?

Caching en indexstaleness. Onderzoekers zagen ChatGPT versies van pagina’s terughalen terwijl live webtoegang beperkt was. De versie die het systeem kent hoeft niet de versie te zijn die vandaag live staat.

Bronnen

  1. Officiële ChatGPT Search-documentatieOpenAI
  2. Publishers & Developers FAQOpenAI
  3. ChatGPT built its own search indexPeec AI
  4. Onderzoek naar ChatGPT retrieval pipelinesSearch Engine Land
  5. Google antitrust remedies documentationU.S. Department of Justice