DataCon All articles
Data-ethiek & Regelgeving

Centrale grip of brede toegang: de strategische keuze die uw data-architectuur definieert

DataCon
Centrale grip of brede toegang: de strategische keuze die uw data-architectuur definieert

Photo: NOAA, Public domain, via Wikimedia Commons

Binnen de boardrooms en IT-stuurgroepen van Nederlandse organisaties speelt zich een debat af dat zelden volledig wordt uitgesproken, maar vrijwel altijd aanwezig is: wie heeft de zeggenschap over data? En wie zou dat moeten hebben?

De keuze tussen een gecentraliseerde en een gedecentraliseerde data-architectuur is technisch van aard, maar in de kern gaat zij over macht, vertrouwen en organisatiefilosofie. De manier waarop een organisatie deze vraag beantwoordt, bepaalt niet alleen haar data-infrastructuur, maar ook haar vermogen om te innoveren, te voldoen aan regelgeving en haar medewerkers effectief te laten werken met data.

Twee modellen, twee beloften

Het centralistische model — met een centrale data-afdeling, een enterprise data warehouse of een uniform dataplein als kern — belooft consistentie. Eén versie van de waarheid. Gestandaardiseerde definities. Gecentraliseerd toezicht op kwaliteit, beveiliging en compliance. Voor organisaties in sterk gereguleerde sectoren, zoals financiële dienstverlening of de zorg, heeft dit model duidelijke voordelen. De AVG en aanverwante Europese regelgeving stellen immers eisen aan datakwaliteit, toegangsbeheer en aantoonbare governance — eisen die makkelijker worden nageleefd vanuit een centrale structuur.

Het gedecentraliseerde model — waarvan het zogenoemde 'data mesh'-paradigma de meest uitgewerkte hedendaagse variant is — belooft iets anders: snelheid en domeinrelevantie. In dit model zijn de teams die het dichtst bij de data staan, ook verantwoordelijk voor het beheer en de ontsluiting ervan. Een marketingteam beheert zijn eigen klantdata; een logistiek team zijn eigen operationele data. De centrale data-afdeling faciliteert, maar regeert niet.

De verborgen kosten van centralisatie

Het centralistische model heeft een reputatie van betrouwbaarheid die niet altijd verdiend is. De belofte van één gedeelde waarheid gaat in de praktijk gepaard met aanzienlijke wrijving.

Ten eerste is er het knelpunt van capaciteit. Centrale data-teams worden doorgaans overspoeld met verzoeken vanuit de organisatie. Prioritering wordt een politiek proces. Teams die snel inzichten nodig hebben, wachten weken op een rapport dat zij zelf in een middag hadden kunnen maken — als zij de toegang en vaardigheden hadden gehad.

Ten tweede is er het risico van contextarmoede. Een centraal team dat data beheert voor een breed scala aan domeinen, mist per definitie de diepgaande kennis van elk afzonderlijk domein. Een anomalie in de orderdata van een specifieke productlijn wordt mogelijk pas opgemerkt door iemand die dagelijks met die lijn werkt — niet door een generalist in een centrale afdeling.

Ten derde is er de innovatievertraging. Organisaties die alle data-initiatieven via een centraal kanaal laten lopen, ervaren dat nieuwe ideeën moeizaam van de grond komen. De bureaucratie die nodig is voor consistentie, is dezelfde bureaucratie die experimenteren remt.

De verborgen kosten van decentralisatie

Omgekeerd is het gedecentraliseerde model niet de zorgeloze oplossing die voorstanders soms suggereren.

Het meest pregnante risico is datafragmentatie. Wanneer elk team zijn eigen dataproducten beheert, ontstaan er al snel inconsistenties in definities, methodologieën en kwaliteitsnormen. Wat marketing 'een actieve klant' noemt, kan wezenlijk verschillen van de definitie die sales hanteert. Voor organisaties die rapporteren aan toezichthouders of die strategische beslissingen nemen op basis van geaggregeerde data, is dit geen academisch probleem.

Daarnaast is er het vraagstuk van governance en compliance. De AVG vereist dat organisaties aantoonbaar kunnen maken wie toegang heeft tot persoonsgegevens, op welke grondslag en voor welk doel. In een sterk gedecentraliseerde omgeving, waar tientallen teams hun eigen data-omgevingen beheren, is dit toezicht houden een complexe en kostbare opgave. Nederlandse organisaties die zijn geconfronteerd met een onderzoek van de Autoriteit Persoonsgegevens, weten dat onduidelijke verantwoordelijkheidsstructuren een significante juridische kwetsbaarheid vormen.

Ten slotte is er het capaciteitsvraagstuk. Een data mesh-benadering vereist dat domeinteams beschikken over voldoende data-expertise om hun dataproducten te bouwen en te onderhouden. In de huidige krappe arbeidsmarkt voor data-professionals is dat voor veel Nederlandse organisaties geen realistische veronderstelling.

De Nederlandse praktijk: tussen ideaal en realiteit

In gesprekken met data-verantwoordelijken bij Nederlandse organisaties — van middelgrote industriële bedrijven tot grote retailers — komt een consistent beeld naar voren: de meeste organisaties opereren niet in een van beide uitersten, maar in een hybride model dat meer het gevolg is van historische beslissingen dan van bewuste strategie.

Een logistiek dienstverlener in de Rotterdamse haven heeft zijn operationele data volledig in handen van de operationele teams, terwijl financiële en klantdata centraal worden beheerd. Niet omdat dit de optimale architectuur is, maar omdat het de architectuur is die is gegroeid vanuit de behoeften van het moment.

Dit soort organische hybride modellen heeft zijn eigen uitdagingen: onduidelijke verantwoordelijkheden, inconsistente kwaliteitsnormen en een gebrek aan strategische samenhang. Maar zij weerspiegelen ook een pragmatische waarheid: de meest elegante architectuur op papier is waardeloos als zij niet aansluit bij de capaciteiten en cultuur van de organisatie.

Voorbij de best practice-retoriek

De data-industrie heeft de neiging om architectuurkeuzes te presenteren als technische vraagstukken met objectief correcte antwoorden. Data mesh is 'de toekomst'. Een centraal data warehouse is 'verouderd'. Deze retoriek is begrijpelijk vanuit een marketingperspectief, maar misleidend voor organisaties die een strategische keuze moeten maken.

De relevante vragen zijn niet technisch, maar organisatorisch:

De antwoorden op deze vragen zijn bepalender dan welke architectuurtrend dan ook.

Een bewuste keuze als fundament

Organisaties die de spanning tussen centralisatie en decentralisatie negeren, lopen het risico een architectuur te bouwen die niemand bewust heeft gekozen — en die daardoor niemand volledig ondersteunt. De keuze hoeft niet definitief te zijn; architecturen evolueren mee met organisaties. Maar zij moet bewust worden gemaakt, op basis van een helder begrip van de afwegingen.

Datamonopolie of datademocratisering is geen binaire keuze. Het is een spectrum waarop elke organisatie haar eigen positie moet bepalen — en die positie periodiek moet heroverwegen naarmate de organisatie, de technologie en de regelgeving veranderen.

All Articles

Related Articles

Datavolwassenheid zonder IT-afdeling: een realistisch pad voor het Nederlandse mkb

Datavolwassenheid zonder IT-afdeling: een realistisch pad voor het Nederlandse mkb

De illusie van het nu: wanneer real-time data meer kost dan het oplevert

De illusie van het nu: wanneer real-time data meer kost dan het oplevert

Generatieve AI en uw bedrijfsdata: de vragen die in de boardroom nog niet worden gesteld

Generatieve AI en uw bedrijfsdata: de vragen die in de boardroom nog niet worden gesteld