We hebben het amper over big data, en als we er over spreken denken we dat het om privacy gaat. Maar onze geheime levens zijn een ondergeschikt puntje. Big data vormen een enorme zakelijke en daarmee ook politieke macht.
Tel de winst van het hele Nederlandse bedrijfsleven bij elkaar op en het resultaat is een bedrag van rond de vijftig miljard euro. Netto,
na betaling van belasting en uitkering van dividend. Deel dit bedrag door de helft en het resultaat komt ruwweg overeen met de winst van Google en Facebook.
Data-analyse en toegang bieden tot een miljardenpubliek. Omdat data inmiddels in gigantische hoeveelheden beschikbaar komen, van heel verschillende aard zijn en met ongekende snelheid kunnen worden verwerkt heet dat nu big data, massieve automatische dataverzameling, automatische analyse en automatisch gebruik. De dataficering van de economie gaat veel verder dan het vervangen van werknemers door robots. Door robots gaan er banen verdwijnen – en komen er banen bij. Door data komen er robots bij. Big data bepalen de opkomst en ondergang van bedrijfstakken en leiden tot herschikking van productieketens over de wereld. Daarom is het wenselijk om het debat te voeren over de mogelijke en wenselijke effecten van big data op de maatschappij en de maatschappelijke samenhang.
In dat debat zou het ‘verdienmodel’ van big data een centrale plek moeten innemen. Dat verdienmodel is door de Amerikaanse hoogleraar Shoshana Zuboff treffend omschreven als ‘surveillance capitalism’ – vrij vertaald: de bespiedeconomie.
Het bespieden begint als Google en Facebook (en al die andere bedrijven) bijvoorbeeld ook jouw foto’s gaan bekijken die je ‘gratis’ in hun cloud hebt opgeslagen. Door de snel verbeterende technologie kunnen zij steeds beter gezichten en omgevingen herkennen op die foto’s. Dus kunnen zij zien wie er nog meer en vaker op jouw foto’s staan of bijvoorbeeld of jij als moeder langs de lijn van je kind bij hockey of juist bij tennis staat. Dat is allemaal informatie over jou die ze weer te gelde maken door hockey of juist tennisadvertenties voor te schotelen.
Google en Facebook (enzovoorts) verzamelen niet alleen zelf data, maar kopen ook gegevens over hun gebruikers bij andere dataverzamelaars. Dat leidt ertoe dat Facebook inmiddels 98 kenmerken van een gebruiker zegt te weten. Tot die kenmerken behoren – natuurlijk – basale feiten als leeftijd en geslacht maar ook wat je inkomen is, hoe groot je huis is, of je in verwachting bent, wat je politieke voorkeur is, in welk merk auto je rijdt, naar welke tv-series je het liefst kijkt, wat voor soort mobiele telefoon je hebt, wat je online zoal koopt, in welke restaurants je eet en wat je favoriete vakantiebestemmingen zijn.
Deze vorm en omvang van dataverzameling beginnen dus al behoorlijk op bespieden te lijken. Daar komt nog een andere vorm bij. De data die Google en Facebook hebben, gebruiken ze om advertentieruimte te verkopen aan andere bedrijven. Doordat ze een steeds preciezer beeld hebben van hun klanten kunnen die bedrijven ook steeds gerichter adverteren. Dit adverteren is in hoge mate geautomatiseerd. Google en Facebook bieden, op het moment dat een gebruiker zich aandient, op basis van het profiel van die gebruiker advertentieruimte aan waarop bedrijven kunnen bieden. De hoogste bieder wint. Dit real-time bidding gebeurt in minder dan een oogwenk.
Dus voordat iemand iets op zijn beeldscherm ziet verschijnen is de bij die gebruiker passende advertentieruimte al verkocht en komen passende advertenties op je scherm. Je profiel wordt niet alleen gebruikt om advertenties te verkopen, maar ook om de prijs te bepalen die je betaalt. In de VS bleek de prijs van een en dezelfde online niveautest voor de middelbare school afhankelijk van de plek waar iemand inlogde op de internet.
In een interview met de Amerikaanse nieuwsorganisatie NPR wees Cathy O’Neil op de risico’s van volautomatische besluitvorming. ‘Het is vrij algemeen bekend dat mensen een baan worden geweigerd op basis van hun kredietwaardigheid. Daardoor gaat hun kredietwaardigheid nog verder omlaag.’
De nieuwste dimensie van de bespiedeconomie heeft te maken met het massale bezit van mobiele telefoons. Met het signaal dat een mobiele telefoon voortdurend verstuurt, ook als het gewoon in een tas of broekzak zit, geeft de telefoonbezitter zijn identiteit prijs. Als een klant bijvoorbeeld een autoshowroom binnenstapt kan de verkoper dus direct ‘zien’ of het een rijke of arme klant is en bijvoorbeeld of die klant recentelijk nog prijzen en automerken heeft vergeleken. Die informatie kan de verkoper gebruiken om na te gaan of het een serieuze klant is die binnenstapt met daadwerkelijk het plan om een auto te kopen. Op basis van die informatie kan de verkoper bijvoorbeeld bepalen of en zo ja hoeveel korting hij bereid is te geven. En dat allemaal terwijl de binnenstappende klant van niets weet.
Bij big data gaat het uiteindelijk om marktmacht
Tegenover deze negatieve kanten van big data en internet staan voor de consument ook positieve. We kunnen veel makkelijker de weg vinden, onze sociale netwerken en interactie zijn sterk vergroot en we kunnen veel makkelijker zelf geld verdienen met de verkoop van oude spullen of verhuur van kamers. Ook is informatie over ziektes sneller bekend waardoor ze beter bestreden kunnen worden, krijgen boeren betere informatie over de ontwikkeling van hun gewas waardoor de oogst verbetert, kunnen fabrikanten slijtage aan cruciale apparatuur veel beter in de gaten houden en hierdoor calamiteiten voorkomen en zo zijn er nog veel meer voorbeelden te noemen.
Maar bij big data gaat het uiteindelijk om marktmacht. Een veel genoemd voordeel van internet is dat voor consumenten de markt doorzichtiger wordt en zij dus beter geïnformeerd een weloverwogen koopbesluit kunnen nemen en zo de concurrentie tussen bedrijven toeneemt. Een voorbeeld hiervan is de energiemarkt of de zorgmarkt waarop jaarlijks honderdduizenden mensen van aanbieders wisselen. Dat is nog steeds een kleine minderheid van het totaal maar alleen al de dreiging van wisseling heeft effect op het marktgedrag van de aanbieders van stroom en zorg. Door internet lijkt zo de marktmacht een beetje richting consument te zijn verschoven. Wel kost het een individuele consument behoorlijke inspanningen om alle relevante informatie te verzamelen om een optimale keuze te maken. De aanwezigheid van – onafhankelijke – vergelijkingssites biedt wel enige steun.
Door big data ontwikkelen bedrijven echter een enorme informatievoorsprong ten opzichte van consumenten. Hierdoor dreigen consumenten in snel tempo en omvang marktmacht te verliezen. In een eind vorig jaar gepubliceerd achtergrondrapport waarschuwt de OECD voor verlies aan controle over de eigen data door consumenten, opdringerige advertenties, discriminatie, te hoge prijzen en sterk verminderde mogelijkheden tot overstappen naar andere aanbieders.
Behalve deze omvangrijke verschuiving van marktmarkt die alle consumenten kan gaan treffen, hangt er nog een andere dreiging in de lucht voor specifieke groepen consumenten. Dat zouden voor een deel dezelfde mensen kunnen zijn die door ondoorgrondelijke algoritmes uitgesloten worden van bijvoorbeeld een baan of een lening. Dit risico hangt samen met het uiteenlopende internetgebruik van bepaalde groepen mensen. Nederland staat internationaal bekend als een van de landen waar zo ongeveer iedereen toegang tot internet heeft en waar het aantal smartphones niet veel lager ligt dan het aantal volwassen inwoners.
Hoewel de meeste Nederlanders gelijke toegang hebben tot internet vertoont hun gedrag op internet nog aanzienlijke verschillen. Volgens het CBS heeft bijna een op de vijf Nederlanders met een laag onderwijsniveau – ondanks de mogelijkheid die ze hebben – nog nooit internet gebruikt. Bij de hoog opgeleiden was dat 1&%. De frequentie van gebruik ligt bij lager opgeleiden ook beduidend lager (67&% bijna elke dag) dan bij hoger opgeleiden (96&% bijna elke dag). Als niet het opleidingsniveau maar het inkomensniveau als uitgangspunt wordt genomen ontstaat – niet onverwacht – hetzelfde beeld.
Behalve minder gebruik is er ook sprake van ander gebruik. Mensen met een lage opleiding zijn veel minder actief op sociale media, nemen minder deel aan online discussies, zoeken veel minder informatie op over goederen, diensten of opleidingen, lezen minder de krant via internet en communiceren veel minder digitaal met allerlei overheden. Alleen bij het spelen van games en het afspelen van muziek ligt het gebruik in de buurt van mensen met een hoge opleiding.
Al met al zit er veel meer dan een klein verschil tussen het internetgedrag van lager en hoger opgeleiden. Al dat gedrag produceert data en door het uiteenlopende gedrag ontstaan er dus verschillende datastromen. Door het andere en minder frequente gebruik zijn de datastromen van de lager opgeleiden minder ‘rijk’ dan die van de hoger opgeleiden. Dat maakt die datastromen minder interessant en bestaat het risico dat er (onbedoeld) een vorm van economische discriminatie kan optreden. De economisch zwakkeren komen zwakker te staan. Of zoals de Europese data-toezichthouder het formuleerde: ‘Extensive use of automated decisions and predictive analysis may also lead to broader undesirable changes in the de- velopment of our societies. Importantly, they may lead to discrimination, re-enforcement of existing stereotypes, social and cultural segregation and exclusion.’
Ruim een jaar daarvoor had de OECD al een bredere waarschuwing genoteerd. Big data kunnen niet alleen tot een machtsverschuiving van consumenten naar bedrijven leiden, maar ook een machtsverschuiving van overheden naar big data-bedrijven, van consumenten naar overheden en van achterblijvende economieën naar big data-economieën. In een gezamenlijke notitie van de Duitse en Franse mededingingsautoriteit wordt ook nog gewezen op het risico dat big data de concurrentie tussen bedrijven afzwakt omdat het voor be- drijven die niet beschikken over persoonsdata moeilijk wordt de concurrentie aan te gaan met bedrijven die wel over deze gegevens van hun klanten beschikken. Zonder Google en Facebook bij naam te noemen wijzen beide instanties erop dat nu al bedrijven monopolieposities kunnen opbouwen met alle welvaartsrisico’s van dien.
Het zijn vooral de mededingingsautoriteiten en de privacy-autoriteiten die hun tanden zetten in de economische en maatschappelijke gevolgen van big data. Dat doen ze en hebben ze te doen op basis van een oud ‘wereld- beeld’ waarin er nog geen big data waren en dus met een (mogelijk) verouderd instrumentarium. Hiervan zijn deze instanties zich ook bewust, getuige bijvoorbeeld een verslag van een bijeenkomst eind vorig jaar van het Concurrentie Comité van de OECD.
Als er al aandacht is voor mogelijk economisch en maatschappelijk ontwrichtende gevolgen van big data dan lijkt die zich vooral te richten op de (negatieve) effecten van robotisering op de werkgelegenheid en op de zorg om privacy. En getuige de publicaties van de Duitse en Franse mededingingsautoriteiten en van de OECD komt de nadruk nu steeds meer te liggen op de potentieel economisch ontwrichtende effecten van big data. Alleen door ingrijpen van de mededingingsautoriteiten en de wetgever kan deze balans positief uitvallen.
Data zijn feitelijk infrastructuur, zoals het energienet, waternet, spoornet of wegennet ook infrastructuur zijn
Het inzetten van mededingingsbeleid ligt voor de hand, uitgaande van de gedachte dat data een gewoon product of middel zijn waarmee bedrijven concurrentievoordeel kunnen behalen. Maar data zijn niet zo gewoon. Om de grote betekenis van data voor de economie te duiden wordt vaak de vergelijking met olie gemaakt, nog steeds de brandstof voor de wereldeconomie. Die vergelijking gaat mank, zo noteerde de OECD in 2014.
In de voorbarige eeuw lag de opbouw van infrastructuur aanvankelijk veelal in handen van private partijen, ook in Nederland. In de tweede helft van de negentiende eeuw stapte de overheid echter in met het nationaal belang als belangrijk argument. Zonder overheidsingrijpen zou de opbouw van dergelijke infrastructuur te beperkt blijven (tot de ren- dabele delen) waardoor niet de volledige maatschappelijke welvaartswinst geïncasseerd zou kunnen worden. Inmiddels is het denken over de rol van de overheid verschoven en is (althans deels) dergelijke infrastructuur weer uit de directe greep van de overheid. Dat data infrastructuur zijn is dus ook geen vooraankondiging van nationalisatie van Google. Maar het betekent wel iets voor de rol van de overheid.
Neem de gezondheidszorg, zeker een gebied waar big data inmiddels goed gedijen. In de VS bestaat al tien jaar het bedrijf 23and-Me. Voor $ 99 of $ 199 levert dit bedrijf, op basis van door de klant opgestuurd buisje met speeksel, een beknopt of uitgebreid DNA- profiel met een begeleidende analyse waaruit niet alleen is af te lezen dat de klant aanleg heeft voor zwart haar en bruine ogen maar ook voor bepaalde ziektes. Inmiddels hebben meer dan een miljoen Amerikanen deze test laten doen, te weinig overigens om het bedrijf winstgevend te maken. Om die positie te bereiken heeft 23andMe inmiddels de volgende stap gezet: de verkoop de verzamelde data van de klanten aan geneesmiddelenfabrikanten. Op basis van deze gegevens kunnen zij (mogelijk) betere geneesmiddelen ontwikkelen.
Zet hier tegenover – of naast – het Precision Medicine Initiative dat ex-president Obama begin 2015 lanceerde. Dit initiatief biedt de wetenschap ‘vrije’ toegang (binnen de grenzen van privacy) tot de data van uiteindelijk één miljoen Amerikanen om ook tot betere geneesmiddelen te komen.
Het is kortom tijd voor politiek. Om de eerder gemaakte vergelijking met de snelweg aan te houden: bij big data is het wegennet nu grotendeels in private, buitenlandse, handen, is sprake van onmerkbaar rekeningrijden, en is de overheid sinds kort in staat het nog op te warmen asfalt beschikbaar te stellen voor door anderen aan te leggen wegen. Zeker in een samenleving waarin de overheid een steeds groter beroep doet op de redzaamheid, zelfstandigheid en innovatiekracht van de eigen ingezetenen is dit een minder dan minimalistische opvatting van de eigen rol. Netwerken van burgers en bedrijven nemen, of het nu bijvoorbeeld om stroom, voedsel, vervoer of werkplekken gaat, hun eigen welvaartsgroei ter hand. Het is een onstuitbare beweging die ondersteuning verdient van de overheid en veel verder gaat dan het beschikbaar stellen van big data.
De PvdA heeft, bijvoorbeeld door moties en kamervragen van Mei Li Vos en Gijs van Dijk, wel oog voor de effecten van big data op het wetenschaps- en innovatiebeleid, informatieveiligheid bij de overheid of de arbeidsmarkt. Maar om te beweren dat big data een duidelijke positie in het denken van de PvdA inneemt – nee. Op de landelijke PvdA-site neemt de partij standpunten in over vele thema’s maar er is slechts één standpunt waarin big data voorkomen en die gaat – klassiek – over privacy. Nieuwe technologische én maat- schappelijke ontwikkelingen bijsturen vergt meer. Nationalisering van big data – zoals ooit met trein, telex of stroom is gebeurd – is nog niet de beste oplossing. En om van de ‘wetmatigheid’ big data = big money af te komen is het noodzakelijk de positie van de data-eigenaren – u en ik – veel sterker te maken.
De macht van de markt zal moeten worden teruggedrongen door (georganiseerde) tegenmacht van burgers om de welvaart die big data kan brengen veel gelijkmatiger te verdelen.