Herkend bedrijfsdata

Betrouwbaarheid

Het onderdeel dat deze server anders maakt dan een API. Geen enkel aggregaat komt kaal terug: elk cijfer draagt zijn noemer, een benchmark en een oordeel over hoe zeker het is.

Waarom dit bestaat

Een dashboard toont “12 fysiopraktijken” en de lezer vult zelf zijn twijfel in. Een taalmodel dat een kaal getal krijgt heeft dat instinct niet: het presenteert 12 als feit. Toen deze MCP nog op een fractie van het register draaide, was de juiste lezing 12 in een steekproef — en niets in het antwoord zei dat.

Inmiddels zit het volledige register erin, dus die 12 is een landelijke telling. De onzekerheid is daarmee niet verdwenen, alleen verhuisd: hoe zeker weten we dat het fysiopraktijken zijn? Ruim de helft van het register is alleen op vrije tekst af te bakenen, en een kwart is nooit langs externe bronnen gehaald. Een cijfer dat daarover zwijgt is nog steeds te stellig.

Dat is precies waarom een MCP fundamenteel anders is dan een API. Een model dat wéét hoe zeker een getal is, geeft een beter antwoord dan een dashboard dat het getal alleen maar toont.

De velden

{
  "aantal": 3,
  "noemer": "vestigingen in branche 'kapper' in Marnixbuurt-Noord
              (BU0363AB01, buurt), exclusief VvE's, holdings,
              inschrijvingen zonder eigen vestiging en records
              zonder bruikbaar adres",
  "genormaliseerd": {
    "per_1000_inwoners": 2.076,
    "landelijk_per_1000": 1.9,
    "afwijking_pct": 9.3
  },
  "dekking": {
    "registerdekking": 1.0,
    "classificatie_methode": "categorie + vrije tekst",
    "classificatie_betrouwbaarheid": "laag",
    "peildatum_bedrijven": "2026-08-15",
    "peildatum_demografie": "2025-01-01"
  },
  "betrouwbaarheid": "laag",
  "kanttekening": "N=3 is te klein om iets over de markt te zeggen;
                   branche-afbakening gebeurt op categorie- en vrije tekst,
                   niet op een gesloten bedrijfsindeling…",
  "bron": ["KVK Handelsregister", "CBS Kerncijfers Wijken en Buurten 2025"]
}
noemer Waarover geteld is. Tellen over het hele register of over de bevraagde vestigingen geeft een ander getal, dus de noemer staat er letterlijk bij.
genormaliseerd Het cijfer per 1000 inwoners of huishoudens, met het landelijke gemiddelde ernaast. Kan dit niet berekend worden, dan staat dát er.
dekking Welk deel van het register deze build bevat — nu 1,0 — en op welke bron de branche-afbakening rust. Dat tweede is wat er nog wél toe doet.
betrouwbaarheid laag, midden of hoog. Neem dit over in je antwoord.
kanttekening Vrije tekst gericht op het model: waarom is dit cijfer niet zekerder.
bron KVK en CBS met peiljaar. Verplicht onder CC BY 4.0.

De regels

Bewust pessimistisch: elke voorwaarde kan het niveau omlaag duwen, niets duwt het omhoog. Een zelfverzekerd verkeerd getal is erger dan een voorzichtig juist getal.

laag
n kleiner dan 5

Een telling onder de vijf zegt meer over toeval dan over de markt.

laag
registerdekking onder 80%

Vuurt nu niet: de dekking is 100%. De regel blijft staan zodat een gedeeltelijke herbouw niet stilletjes hoog gaat rapporteren.

laag
reeksbreuk in de periode

Het cijfer bewoog omdat de definitie bewoog, niet de markt.

laag
gebied kleiner dan de brondata

CBS rondt bedrijfsaantallen af op vijf en onderdrukt kleine cellen.

midden
n tussen 5 en 30

Klein genoeg dat ruis zwaar meeweegt.

midden
demografie ouder dan 24 maanden

Inkomenscijfers lopen structureel twee tot drie jaar achter.

midden
branche op trefwoorden

Wanneer de afbakening op trefwoorden in de vrije tekst leunt in plaats van op de branche-indeling.

hoog
geen van bovenstaande

Bereikbaar sinds het volledige register geladen is — maar nooit op een branchevraag.

Wie doet dit nog meer

Vrijwel niemand. We onderzochten de MCP-documentatie van Stripe, Supabase, Vercel, Linear, Sentry, Neon, Notion, Atlassian, PayPal, Cloudflare, Tavily, Exa en Alpha Vantage. Alleen Exa publiceert een dekkingspagina, en die staat los van de MCP-documentatie. Alpha Vantage — een betaalde datafeed, net als wij — zegt niets over de betrouwbaarheid van zijn cijfers.

Voor een operationele API (jouw facturen, jouw issues) is de vraag ook niet zinnig. Voor een dataproduct wel: wie marktcijfers verkoopt, verkoopt een schatting.