# Meetopzet en geaggregeerde data — AI-vindbaarheid Nederlandse marketingbureaus

Dossiertype: neutrale tellingen.

Bij /onderzoek/ai-vindbaarheid-marketingbureaus. Meetvenster: 27 juli 2026
18:00 – 28 juli 2026 01:15 CEST, één Nederlands consumenten-IP, met de
detectorversie (v1) die ook live op deze site draait op /ai-vindbaarheid.

Deze pagina bevat uitsluitend meetopzet en geaggregeerde uitkomsten — geen
per-domein of per-bureau rijen (R-082-lijn). Elk cijfer hieronder staat
letterlijk zo op de onderzoekspagina zelf.

## Selectie

Alle gepubliceerde bureauprofielen met een domein, verzameld via de publieke
gepagineerde directory-markdown (`/bureaus/page/[n]/md`, per profiel het
"Bronnen"-domein), gededupliceerd op apex-host (www gestript), platform-
domeinen (LinkedIn e.d.) uitgefilterd. Resultaat: 1.720 unieke domeinen uit
1.820 gepubliceerde bureauprofielen (meerdere vestigingen delen soms één
site).

## Noemers

- **1.720** unieke domeinen in de selectie.
- **1.663** volledig gemeten (96,7%). De overige 57 (3,3%) hadden geen
  afgeronde meting (race-timeout of hangend meetproces) en tellen in geen
  enkel percentage mee.
- **1.426** van de volledig gemeten domeinen slaagden voor de
  bereikbaarheidscheck ("bereikbaar" — binnen 5 seconden een geslaagde
  HTML-response). Checks die homepage-HTML lezen (Schema.org, meta,
  crawlbare tekst, bewijstaal) zijn alleen op deze subset betrouwbaar: bij
  een gefaalde homepage-fetch toetst de detector tegen lege tekst en
  ontstaan gemiste gevallen (false negatives).

## Geaggregeerde uitkomsten (zelfde cijfers als op de pagina)

- **30%** (434 van de 1.426 bereikbare sites) slaagt niet voor de
  Schema.org-check én niet voor de llms.txt-check.
- **29%** (van alle 1.663 volledig gemeten sites) scoort 80 punten of hoger
  op de acht signalen samen; mediaan 65/100.
- **14%** van alle 1.663 volledig gemeten sites haalt de
  bereikbaarheidscheck niet.

| Check | Wat de check toetst | Slaagt (van 1.426 bereikbare sites) |
|---|---|---|
| Schema.org JSON-LD | Homepage bevat een ld+json-scripttag met gestructureerde data | 65% |
| llms.txt | /llms.txt geeft HTTP 2xx met een verwijzende inhoud | 20% |
| Sitemap | /sitemap.xml geeft HTTP 2xx met een urlset of sitemapindex | 68% |
| Meta-description | Homepage bevat een description van minimaal 40 tekens | 68% |
| Crawlbare tekst | Homepage bevat na het strippen van HTML minimaal 1.200 tekens tekst | 88% |
| Bewijstaal | Tekst matcht minimaal 2 patronen voor cases, resultaten, klantcontext of specialismen | 65% |
| Robots.txt | /robots.txt aanwezig en blokkeert niet alle crawlers | 86% |

## Bekende detector-beperkingen (v1)

De llms.txt- en robots-checks kennen geen soft-404-detectie (een
catch-all-server die overal "200 OK" teruggeeft telt als treffer — de echte
llms.txt-adoptie ligt daarmee eerder onder de 20% dan erboven). De
meta-check eist een specifieke attribuutvolgorde (`name` vóór `content`), de
bewijscheck accepteert generieke diensttekst, en de fetch-laag kan op circa
2% van de domeinen blijven hangen. Alle cijfers zijn daarom detector-
uitkomsten ("slaagde niet voor de check"), geen feitelijke afwezigheidsclaims.


## Uitbreiding 1 september 2026 (v2)

De technische meting hierboven is ongewijzigd. Op 1 september 2026 is de
pagina uitgebreid met vier koppelingen; de tellers staan in
/onderzoek-data/ai-vindbaarheid-bewijs-cut.json (bewijs-dossier: alleen
groep×metric-cellen, elke cel n ≥ 10, geen per-bureau rijen).

- **Cases.** De 1.426 bereikbare hosts zijn op domein gekoppeld aan het
  bureauprofiel (één bureau per host); 1.396 konden worden gekoppeld. Cases
  komen uit de nationale case-scraper (stand prod-databank 1 september 2026:
  11.948 cases van 1.447 bureaus, 3.490 met minstens één meetbare uitkomst).
  "Case met cijfer gevonden" = de scraper vond minstens één case met een
  meetbare uitkomst; "geen case gevonden" is een detector-uitkomst (bekende
  beperking), nooit "heeft geen case". Verband, geen oorzaak.
- **Specialismen.** Van het bureauprofiel, alleen specialismen met n ≥ 50;
  een bureau telt in elk specialisme dat het voert (groepen overlappen).
- **Steden.** Vestigingsplaats van het bureau, alleen steden met n ≥ 40.
- **AI-citaties.** Commerciële index van Google AI Overview-antwoorden
  (locatie Nederland, taal Nederlands, opgevraagd 1 september 2026), per
  zoekvraag de tien meest geciteerde brondomeinen, handmatig gelabeld
  (bureau / platform / naslag / social / vakmedia / overig). De pagina noemt
  alleen tellingen per label, geen bureaus. AI-crawlerverkeer op onze eigen
  site: CDN-rapport over zeven dagen, user-agent-matching, gesampled.

## Vragen

Vragen over de meetopzet: info@marketingburos.nl.
