Google koopt bedrijfsdata van failliete luchtvaartmaatschappij om AI te trainen

Google koopt voor 10 miljoen dollar veel bedrijfsdata van Spirit Airlines, een Amerikaanse luchtvaartmaatschappij die dit jaar failliet ging. Het gaat bijvoorbeeld om e-mails, documenten en chatberichten, maar niet om klantendata. Google wil de bestanden gebruiken om AI-modellen te trainen.

De data bevat zo'n 100 miljoen e-mails en 500 miljoen Microsoft Teams-chatgesprekken. Voor zover bekend gaat het vooral om interne bedrijfsdata, zoals HR-informatie over de productiviteit van werknemers, of hoeveel Spirit verdiende aan bepaalde vluchten en marketingmateriaal.

Klantendata zit voor zover bekend dus niet bij de data. De data is volgens de verkopende partij ook geanonimiseerd en Google mag ook niet proberen de data alsnog aan mensen te koppelen. De data zou dus niet te herleiden moeten zijn tot specifieke Spirit-werknemers.

Google zegt tegen nieuwssite Axios de data door een derde partij te laten opschonen om ervoor te zorgen dat de informatie volledig geanonimiseerd is. Het bedrijf zegt dat de data 'waardevol kan zijn om ons te helpen bij het verbeteren van onze producten en onze AI-modellen'.

Google deelt dus geen concrete plannen, maar mogelijk geeft de data de AI-modellen een beter beeld van hoe bedrijven of luchtvaartmaatschappijen intern werken. Een Amerikaanse rechter moet de verkoop nog goedkeuren.

Spirit Airlines. Bron: NurPhoto / Getty Images
Spirit Airlines. Bron: NurPhoto / Getty Images

Door Hayte Hugo

Redacteur

18-08-2026 • 12:13

101

Submitter: duvekot

Reacties (101)

Sorteer op:

Weergave:

Het lijkt me dat er in deze data toch behoorlijk wat persoonlijke en privacygevoelige data gaat. Een werknemer of klant maakt wat mij betreft niet uit. Het gaat nog steeds om privacy. Benieuwd hoe hiermee wordt omgegaan, gezien in de USA bedrijven een stuk meer mogen wat betreft schenden van privacy.
Daar schrijft het artikel toch over?
De data is volgens de verkopende partij ook geanonimiseerd en Google mag ook niet proberen de data alsnog aan mensen te koppelen. De data zou dus niet te herleiden moeten zijn tot specifieke Spirit-werknemers.

Google zegt tegen nieuwssite Axios de data door een derde partij te laten opschonen om ervoor te zorgen dat de informatie volledig geanonimiseerd is.
Heel mooi statement van Google, maar ik snap de cynisch houden wel ten aanzien van Google. Als ik lees dat google de data echt anonimiseert dan neem ik dat met een flinke bak zout. Er zijn en waren enorm veel privacy rechtszaken tegen Google omdat zo continue de privacy van hun eigen gebruikers al niet serieus nemen.

Dan bekruipt mij het gevoel dat de privacy van de medewerkers of klanten van een failliet bedrijf al helemaal niet serieus genomen wordt. Inmiddels mogen we er toch wel vanuit gaan dat een bedrijf als Google privacy niet erg hoog in het vaandel hebben.
Er zijn en waren enorm veel privacy rechtszaken tegen Google omdat zo continue de privacy van hun eigen gebruikers al niet serieus nemen.
Dat denken mensen vooral maar ga je daar naar zoeken valt het eigenlijk 'tegen', dat een bedrijf met 100den producten/diensten en 10tallen jaren history eigenlijk maar een handje vol rechtszaken in (bijv) de EU heeft gekregen (mbt privacy) is juist tegenstrijdig dat dit 'continue' is. En wat ik dan vind zijn dan ook nog vrij kleine zaken.

Het streetview verhaal, dat is toch wel het argument wat ik het meeste hoor, is bijv al 15 jaar geleden. En hoewel kwalijk is dat niet eens zo ernstig (diezelfde data verzamelen Android gebruikers oook gewoon vrijwillig voor Google, helemaal legaal).

De privacy waar gebruikers/Tweakers over klagen zijn voornamelijk legaal gebruikte gegevens. Waarvan ik denk: vooral gewoon niet gebruiken als je het er niet mee eens bent.
Het streetview verhaal, dat is toch wel het argument wat ik het meeste hoor, is bijv al 15 jaar geleden. En hoewel kwalijk is dat niet eens zo ernstig
De ernst zit hem er vooral dat Google hardnekking bleef volhouden dat ze de gegevens hadden verwijderd, terwijl dat helemaal niet het geval was. En dat Google bleef volhouden dat het een bug was, terwijl er juist een heel proces was opgezet om die opgevangen data te verwerken. Streetview is om die reden een tijd verboden geweest in Duitsland.
Noem dat maar 'niet zo ernstig'.

Een snelle zoekactie met Chat geeft me al 14 zaken wereldwijd met schadevergoedingen in totaal van ongeveer 2,5 miljard.
2010: Street View Wifi
2012: Safari Tracking
2014: Overtredingen privacyregels rond verwerking persoonsgegevens in Spanje
2015: Onvoldoende informeren over combinatie van persoonsgegevens uit verschillende Google-diensten in Nederland
2017: Schending Europese privacyregels rond transparantie en toestemming
2018: Google+ Data breach
2019: Onvoldoende transparantie en geldige toestemming voor gepersonaliseerde advertenties
2020: Locatiegegevens verzamelen ondanks uitgeschakelde locatiegeschiedenis; Arizona
2022: Misleidende locatie-trackingpraktijken; 40 staten in de VS
2023: Vergelijkbare locatie-trackingzaken; Indiana en Washington DC
2024: Incognito Mode Class Action, Google verzamelde gegevens terwijl gebruikers dachten privé te browsen
2024: Google Location History Litigation, Verzamelen en bewaren van locatiegegevens terwijl "Location History" uit stond
2025: Locatiegegevens, biometrische gegevens en incognito-gerelateerde privacyclaims; Texas
2025: Verzamelen van gegevens ondanks uitgeschakelde "Web & App Activity"

Wat vooral opvalt is dat Google steevast de instellingen van gebruikers negeert en toch data binnenharkt. En die partij moeten wij geloven dat ze data daadwerkelijk anonimiseren als ze dat zeggen?
Leuk dat jij het allemaal 'niet zo ernstig' vindt, maar het is niet heel gek dat andere mensen wel wat wantrouwig zijn richting Google lijkt me.
Nee hoor valt allemaal wel mee met Google, je kunt ze prima vertrouwen...
De privacy waar gebruikers/Tweakers over klagen zijn voornamelijk legaal gebruikte gegevens. Waarvan ik denk: vooral gewoon niet gebruiken als je het er niet mee eens bent.
uhh.. In dit geval gaat het om juist om een bedrijf wat niks met Google te maken heeft, de data in handen komt van Google.

dus dan kun je Google mijden als de pest, alsnog komt je data in het bezit van een bedrijf dat je wilt mijden. Terecht dat men / Tweakers hier over klagen.
..dus dan kun je Google mijden als de pest, alsnog komt je data in het bezit van een bedrijf dat je wilt mijden. Terecht dat men / Tweakers hier over klagen.
Google wil data, dat is hun obsessie. Die bedrijfsdata is te koop: hoe kan dat?
Waarom is dat te koop en niet ergens bewaard als archief?
"Waarom is dat te koop en niet ergens bewaard als archief?"

Uw antwoord; Het is niet bij wet verboden bedrijfsinformatie te verkopen, zeker niet als het formeel geanonimiseerd is. U zegt het immers zelf, data is kapitaal.
De privacy waar gebruikers/Tweakers over klagen zijn voornamelijk legaal gebruikte gegevens. Waarvan ik denk: vooral gewoon niet gebruiken als je het er niet mee eens bent.
Hoe zie je dat voor je? Dan kun je dus nooit meer zaken doen met een bedrijf, want je loopt altijd de kans dat het bedrijf failliet gaat en Google hun data koopt.
maar je moet ook realistisch zijn, bij zulke hoeveelheden van data zal anonimisatie achteraf gewoon niet lukken.
Jij stelt, dan mag je ook onderbouwen. Waarom kan dat niet? Een computer heeft geen harde limiet op een megabyte aan data.
Vanuit mijn werkveld (digitaal forensisch onderzoek) kan je vertellen dat het volledig anonimiseren van dit soort data (echte gebruikersdata, en dat in gigantische hoeveelheden) nagenoeg onmogelijk is.

Sure: je kan de from en de to verwijderen. Maar wat met de inhoud van een mail of chatbericht waarin iemand naar diens leidinggevende stuurt dat die vandaag niet naar werk kan komen omdat <naam partner> een chemo afspraak heeft? Of wat dacht je van gedeelde locaties?
En hoe kom je erachter dat er privacygevoelige gegevens zit in data die niet meteen human readable is? Neem een WhatsApp database: je kan even alle kolommen nagaan en waar je een naam ziet die weghalen, en dan hopen dat de inhoud van de gesprekken geen AVG schendingen bevat (is wel zo)... en dan kom je erachter dat je het telefoonnummer van gebruikers kan afleiden uit hun whatsapp user ID.

Het is echt eindeloos je data schoonschrobben, en met 100 miljoen mails en 500 miljoen berichten zal er altijd wel privacygevoelige data in blijven zitten.

Het echt kwalijke hier is dat je deze AVG schendingen vroeger misschien nog door de vingers kon zien, vanuit een praktisch oogpunt: sure, in je archief zitten persoonlijke gegevens zelfs nadat je echt je verdomde best deed om het te scrubben, maar niemand die dat nog inkijkt en verbanden gaat leggen tussen een chatbericht hier en een email daar om zo te achterhalen wat de identiteit is van een bepaalde gebruiker.
Maar een AI model dat op die data wordt getraind? Diens taak is het net om verbanden te zoeken en het lijkt me dus dat we dan extra voorzichtig moeten zijn.
Vraag me serieus af want men na scrub nog overhoud:
Voor zover bekend gaat het vooral om interne bedrijfsdata, zoals HR-informatie over de productiviteit van werknemers
Klinkt als dat 80% gewoon gescrubd kan worden.
Precies: je kan metadata over zender en ontvanger wel scrubben, maar de inhoud van berichten is nou precies wat Google wil gaan gebruiken om hun AI op te trainen, dat wil je niet aanpassen of wissen.
Vraag me serieus af want men na scrub nog overhoud:
[...]
Klinkt als dat 80% gewoon gescrubd kan worden.
Nou, na 80% scrubben hou je dus 20% persoonsgegevens over, en dat is veel te veel.

Wat jij doet is een beetje als zeggen "In het Odido zaten maar van 20% van de Nederlanders, 80% niet. Best goed!"
Nee zeker niet de hele data set is pii.

Zitten ook gewoon chats tussen als horlaat gaan we luncheniksta al beneden.
Wat ik vooral ergerlijk vind is dat dit ongetwijfeld data betreft wat ontstaan is voordat AI een ding was. Ik ben sinds AI een stuk voorzichtiger met wat ik de wereld in stuur, want het extraheren van informatie uit een grote dataset is nu veel makkelijker.

Waar niemand ooit rekening mee had kunnen houden is dat die gegevens nu een stuk waardevoller zijn geworden, en steeds waardevoller worden vanwege de toenemende hoeveelheid gegenereerde content, waarmee het dus de moeite waard wordt om archieven open te breken.

En als zo'n bedrijf dan failliet is, wie houd je dan verantwoordelijk als je data daarna vanwege dit soort acties toch op straat ligt? Daar kun je als klant of medewerker toch niet redelijkerwijs op anticiperen?
Het gaat niet perfect. E-mail adressen en Teams namen kun je vrij eenvoudig vervangen, maar er staan in berichten ook veel ongeformatteerde persoonsverwijzingen. Aanheffen, afscheidsgroeten, verwijzingen naar personen in de tekst, signatures, BSN nummers, polisnummers, telefoonnummers, relaties tussen personen, enz, enz. Mogelijk ook nog in verbasterde vormen.
Daar zou het een en ander door kunnen slippen.

En als je maar genoeg datapunten hebt kun je zelfs een perfect geanonimiseerde dataset tot een specifiek persoon herleiden.

De vraag is hoeveel er mis kan gaan en of het de moeite is om je druk over te maken.

[Reactie gewijzigd door locke960 op 18 augustus 2026 12:49]

Je kan "AI" gebruiken voor anonymization, vorig jaar nog een demo project (incompleet, don't use) hiervoor gemaakt. Een model als deze had ik toendertijd gebruikt.

Een lastiger punt is dat ook na anonymization je soms kan herleiden na een persoon of individu. Bijvoorbeeld is er iemand die een specifieke combinatie van medicijnen ontvangt over een gegeven periode. Dat is theoretisch te fingerprinten.

[Reactie gewijzigd door ZpAz op 18 augustus 2026 13:05]

Of omdat namen soms gewone woorden zijn, wat in sommige zinnen het moeilijk word of het om een naam of een normaal woord gaat.
Bij mij werkt er bijvoorbeeld een collega met de naam You X (waar de X ook een veelvoorkomend engels woord is), dat kan AI niet zomaar filteren, en zou gezien worden als typfout.

Dan krijg je dingen als
"Hi, I want to let you x and [REDACTED NAAM] know about the latest flight delays"

Is en perfect normale logische zin, maar daar blijft toch een persoonsgegeven inzitten.
Wel weer een geluk bij een ongeluk dat als AI dit soort voorbeelden niet kan opschonen, AI waarschijnlijk ook niet gebruikt kan worden om hier persoonsdata uit te distilleren. En het privacy risico van daadwerkelijke mensen die deze e-mails 1 voor 1 doorspitten lijkt me beperkt (en ook die zullen dit soort dingen nog deels missen/overheen lezen).
en daar betalen ze een gerenomeerd bedrijf voor die een bepaalde garantie af kan geven.

Ik denk dat dat bedrijf toch wel iets beter is in deze opdracht uitvoeren dan de DOJ van de USA laat zien de laatste tijd :).
Google zegt tegen nieuwssite Axios de data door een derde partij te laten opschonen om ervoor te zorgen dat de informatie volledig geanonimiseerd is.

Ik vraag me af welk bedrijf en geen belangen verstrengeling?
Omdat je, met genoeg datapunten het gewoon kan herleiden naar een afdeling/functie/persoon etc. Hoe meer data er in die dataset zit, hoe slechter anonimiseren gaat werken.
Hoe ga je data ín een mail anonimiseren? Mensen geven natuurlijk compleet random gegevens door..
Wanneer is iets een naam en wanneer niet... AI zou daar misschien bij kunnen helpen, maar ...... je snapt me denk ik?? :+
Weet niet precies wat je probeert te suggereen (je zou ook gewoon concreet kunnen zeggen wat het probleem is). Maar AI kan je ook (lokaal) gebruiken zonder dat die data gebruikt wordt voor verdere training.
Als jij vindt dat jouw IT collega dat moet stellen geeft dat veel weer over jouw analytisch vermogen...
Jij stelt, dan mag je ook onderbouwen. Waarom kan dat niet? Een computer heeft geen harde limiet op een megabyte aan data.
Hoe meer data, hoe meer verbanden er zijn te leggen en hoe makkelijker anonimisatie mogelijk terug te draaien is.
Ze hebben AI gebruikt om te anonimiseren :+ /s
"Google zegt tegen nieuwssite Axios de data door een derde partij te laten opschonen om ervoor te zorgen dat de informatie volledig geanonimiseerd is."

Dat suggereert dat de data niet volledig geanonimiseerd is op het moment dat Google het in handen krijgt.

Of het bericht spreekt zichzelf tegen.

Dus het blijft een kwestie van goed vertrouwen wat Google ermee doet als het wel klopt wat er staat.
Nee, dat zegt dat de verkoper een derde partij inschakelt om de data volledig te anonimiseren voordat het Google bereikt.
Nee, het blijft een kwestie van goed vertrouwen. Google heeft de data gekocht en heeft nu een derde partij ingeschakeld voor het anonimiseren maar dat geeft geen enkele garantie dat diezelfde data later alsnog anders gebruikt gaat worden. De data met prive gegevens blijft zo bestaan om in de toekomst gebruikt te kunnen worden, door Google of een andere partij die de data ooit van Google kan krijgen.
Google heeft nog niets gekocht, een rechter moet er nog over beslissen of verkoop doorgang mag vinden of niet. Het zou daarnaast gek zijn als Google eerst de data koopt, maar voordat het de data kan/mag gebruiken, het zelf eerst langs een derde partij haalt die de data anonimiseert.

Het lijkt me dan dus veel logischer als het dus eerst langs de derde partij gaat die data anonimiseert voordat een partij als Google er iets mee kan/mag doen.

[Reactie gewijzigd door CH4OS op 18 augustus 2026 12:52]

Dat klopt. Maar omdat het om veel data gaat en zoals anderen hieronder aangeven, is de kans dat er toch iets doorheen glipt, best realistisch.

Bovendien wordt er een derde partij erbij gehaald om de data te anonimiseren en derde partijen hebben de laatste tijd steeds vaker een rol in grote data lekken.
Als je het artikel ook had gelezen:

Klantendata zit voor zover bekend dus niet bij de data. De data is volgens de verkopende partij ook geanonimiseerd en Google mag ook niet proberen de data alsnog aan mensen te koppelen. De data zou dus niet te herleiden moeten zijn tot specifieke Spirit-werknemers.
Ik heb het artikel goed gelezen.

Ik stel alleen vraagtekens bij de mogelijkheid zoveel data te kunnen anonimiseren. Zoals anderen ook al aangeven hierboven, dat is bijna onmogelijk. Hoe meer data, hoe meer er te fingerprinten is. En Google heeft al een oceaan aan data, die ze maar al te graag gebruiken om jou van hele gerichte reclame te voorzien.
Dan heb je de derde alinea gemist denk ik:
Klantendata zit voor zover bekend dus niet bij de data. De data is volgens de verkopende partij ook geanonimiseerd en Google mag ook niet proberen de data alsnog aan mensen te koppelen. De data zou dus niet te herleiden moeten zijn tot specifieke Spirit-werknemers.
In de tweede alinea staat dan overigens de opmerking dat het vooral over interne bedrijfsdata gaat.

[Reactie gewijzigd door CH4OS op 18 augustus 2026 12:27]

Nee, die las ik goed.

En zoals als schreef, interne bedrijfsdata kent ook privacy. Zeker mails van en aan HR, zoals stat in het artikel. Ik betwijfel of dit te anonimiseren is. Hoe meer data, hoe meer er te fingerprinten is.

En daarom moet een rechter nog bepalen of dit allemaal zomaar mag.
Helemaal 100% geanonimiseerd krijg je het ook gewoon nooit.
Sarcasm om; Als ze de Epstein files mooi zwart kunnen maken, kan dit hier makkelijk lijkt me ;)

De kinderen zijn in mijn ogen belangrijker dan die figuren.
Nee. De rechter moet ernaar kijken omdat het een grote transactie is met activa van een failliete boedel. Er wordt getoetst of dit de belangen van de crediteuren dient.

Misschien neemt hij mee wat je hoopt, maar primair is het niet zijn zorg
De privacy waarborgen gelden in dit specifieke geval voor de consumenten van Spirit en niet voor de voormalige medewerkers. Onderdeel van de deal is ondermeer de overname door Google van +/- 3.4 miljoen loonstrookrecords en 80.000 mailboxen en personeelsdossiers die terug gaan tot 1986.
En dat is juist wat ik raar en krom vind. Het gaat o.a. om berichten tussen HR en werknemers. Daar staat meestal behoorlijk wat privacy gevoelige data in. Als werknemer zou je ook privacy rechten moeten hebben. Zeker als je niet meer werkt voor een bedrijf (omdat het failliet is). En zoals je leest in de diverse reacties hier, is het anonimiseren van zulke grote datasets niet mogelijk. En dat is hopelijk een van de redenen dat deze data overname door een rechter zal moeten worden gekeurd.
Google koopt voor 10 miljoen dollar veel bedrijfsdata van Spirit Airlines
10 miljoen. Een koopje noemen we dat. En waarschijnlijk gaat het veeel meer opleveren
Wat ik me ook wel afvraag, waar gaat deze 10M naartoe dan? Het bedrijf is failliet immers. En ja, meestal als een partij failliet gaat, zijn diens eigendommen vaak een koopje, omdat de gebruikswaarde van de eigendommen niet heel groot meer is.
Hoe het voor Amerika zit weet ik niet precies, maar voor Nederland werkt het bij een faillissement als volgt:

Er wordt een curator aangesteld die het faillissement afwikkeld. Deze wordt aangesteld door de rechter en dient ook verantwoording af te leggen aan de rechter. Hierbij doen ze eigenlijk drie dingen:
1) ze kijken of een eventuele doorstart mogelijk is
2) ze gaan kijken welke waarde in de onderneming zit en hoe ze deze waarde kunnen verzilveren ten behoeve van de boedel
3) ze doet een rechtmatigheidsonderzoek en kijkt of er paulianeuze handelingen, onbehoorlijk bestuur en eventueel bestuursaansprakelijkheid is.

Als we puur even naar punt 2 kijken: stoelen, bureaus computers en eventueel bedrijfsnaam + logo's kunnen nog best veel waarde vertegenwoordigen. Maar denk ook bijvoorbeeld aan bedrijfspanden en -auto's of in SPIRIT haar geval de vliegtuigen zelf. Alles wordt vervolgens verdeelt in een vrij hiërarchisch model.

1) Als eerst wordt de boedelvorderingen betaald. Dit zijn de schulden die ontstaan zijn na de uitspraak van het faillissement. Bijvoorbeeld salaris curator, huur en loon vanaf de dag van faillissement

2) Preferente vorderingen. Daarna komen de preferente schuldeisers. Denk hierbij aan bijvoorbeeld in NL de belastingdienst, UWV (loonvordering) en medewerkers die nog loon krijgen

3) Concurrente vorderingen. Dit zijn alle vorderingen die betaald worden als er nog genoeg geld over is. Denk hierbij aan producten die nog niet betaald zijn, openstaande facturen en leveranciers.

Dit is in het kort hoe het in Nederland werkt. Zelf weet ik niet goed hoe dit in Amerika gaat, maar kan me voorstellen dat faillissementen op een dergelijke manier ook worden afgewikkeld. Daarom zorgt een curator er ook altijd voor dat er nog veel van de bedrijf haar waarde wordt verzilverd om alle vorderingen te kunnen voldoen. Vaak lukt dit niet, dan wordt het dus volgens bovenstaand model betaald.

* in deze uitleg heb ik de vorderingen met pand- en hypotheekrecht en aandeelhouders even buiten beschouwing gehouden. ;-)

Wellicht leuk als je meer wilt weten: op BNR is er een mooie podcast over: Onder Curatoren. Zeker de moeite waard om te luisteren.

[Reactie gewijzigd door johannesberg740 op 18 augustus 2026 13:29]

Vziw neemt een curator in NL per direct het bestuur over van een bedrijf. Soms kan er besloten worden om de zaak nog draaiende te houden om nog zoveel mogelijk omzet nog te draaien met de huidige inventaris. Bijvoorbeeld een webshop die zodoende tenminste nog voorraadige artikelen tegen de volle retail prijs kan verkopen. Ook al voelt dit totaal niet fair voor mensen die bestellen, betalen en uiteindelijk datgene niet geleverd meer kunnen krijgen (of kunnen fluiten naar hun garantie).

In dat daglicht is mijn eerste reactie dat ik het verwerpelijk vind dat een bedrijf na faillisement opeens z'n handelswijze aanpast dat niet past bij hun eerdere core focus. Zou Spirit namelijk deze deal ook gesloten hebben als het bedrijf nog bleef draaien?
Natuurlijk moet een curator zoveel mogelijk omzet/bedrijfsmiddelen veilig stellen en de opbrengst daar van maximaliseren. Maar dat zou een ondernemer ook zelf kunnen doen als bepaalde apparatuur overbodig is. Echter je lopende documentatie van je bedrijfsprocessen worden enkel overbodig na een faillisement.
Of is dit (grofgezegd) het equivalent van een grafroof? Want data data ... en het internet is al "op" waarschijnlijk.

En dan is nog de vraag wat Google hoopt in deze data te vinden.. Ik verwacht namelijk dat gegevens over de vliegtuigen, onderhoud, handleidingen, service bulletins, Airworthiness Directives, enz. met een NDA zijn overeengekomen met Airbus. Ik verwacht niet dat Google zomaar al die informatie kan/mag ontvangen. Tevens bezit een luchtvaartmaatschappij lang niet altijd zelf hun vliegtuigen. Spirit had uit een eerder faillisement al veel geleasede vliegtuigen al "teruggeven". Van sommige vliegtuigen bezitten ze soms ook niet eens de motoren, omdat die verreweg het meest kostbaar zijn.

Maar is al het papierwerk van de administratie/website/planning dan zo interessant? Ik betwijfel dat een beetje eigenlijk.
als een bedrijf failliet is, dan bepaalt de curator wie er als eerste betaald moet worden.

Zij hebben een lijst met schuldeisers. Belastingdienst en banken staan over het algemeen bovenaan. Daarna komen de schuldeisers aan de beurt. Vanuit het oogpunt van de curator is het zeer logisch dat deze dataset wordt verkocht (zoveel mogelijk geld binnen halen voor de schuldeisers).
Yeah, right. Google heeft al zoveel informatie over wereldburgers dat het haast wel mogelijk moet zijn om data te koppelen aan personen. En mail en chat? Daar zit heus ook data van klanten in. Slim van google, maar dit is bijna net zo erg als een database die bij een hack wordt buitgemaakt.
Als ik Google was zouden me de personen geen sodemieter interesseren maar des te meer hoe ik een AI kan aanleren hoe ik een grote, logistieke organisatie in een dynamisch speelveld kan runnen en welke activiteiten welke gevolgen hebben.

Het zal daar ook eerder om gaan dan de vliegbewegingen van Pietje Puk, gegevens die sowieso in tig andere systemen zijn vastgelegd.
hoe ik een AI kan aanleren hoe ik een grote, logistieke organisatie in een dynamisch speelveld kan runnen en welke activiteiten welke gevolgen hebben.
Kan je dan niet beter de data van een bedrijf kopen dat niet failliet is gegaan :P
Waarschijnlijk wel maar ik denk niet dat KLM hierom staat te springen en van fouten kun je leren :)
Waarschijnlijk trainen ze met een NOT om alle data heen, oftewel zo moet je het niet doen :)
Probleem is dat je dat een AI niet kan 'leren' want dat vereist inhoudelijke kennis, redeneren, en strategie. Dingen die fundamenteel niet kunnen met een "AI" (ofwel een taalmodel). Een grootschalig taalmodel draait eigenlijk bijna alleen op patronen en statistiek, en kan die patronen extrapoleren. Het heeft geen flauw idee van waarom bepaalde patronen ontstaan, als je het op taal betrekt, bijvoorbeeld hoe grammatica eigenlijk in elkaar steekt (tenzij je daar expliciet regels voor inprogrammeert). Zo'n model ziet alleen dat in 999 van de 1000 gevallen een persoonsvorm na een onderwerp komt dus zal dat in de rest van de gevallen ook zo zijn.
Het is ook niet gezegd dat er alleen een llm op losgelaten wordt. Google heeft bijvoorbeeld DeepMind die van heel andere AI modellen gebruik maken.
Daarom dat de data voordat het bij Google komt eerst langs een derde partij gaat, die de volledige data set volledig anonimiseert:
Google zegt tegen nieuwssite Axios de data door een derde partij te laten opschonen om ervoor te zorgen dat de informatie volledig geanonimiseerd is.

[Reactie gewijzigd door CH4OS op 18 augustus 2026 12:32]

Hoe groot achten we vervolgens de kans om volgende week een nieuwsbericht te lezen met de titel: "Partij ABC verliest klantdata Spirit Airlines door hack"
Wanneer is de laatste keer dat je gelezen hebt dat een bedrijf wat zaken anonimiseerd is gehackt?

Dit zijn bedrijven die veel meer zorg (moeten) dragen over gegevens omdat ze juist zijn om die data te beschermen. Als ze alles kwijt raken hebben ze ook nog eens de verkoper EN de koper op hun dak met rechtszaken kwant beide zijn dan gedupeerd.

Dus ik acht de kans zeeeeeer klein, maar alles kan dus garantie heb je dan ook nooit.

[Reactie gewijzigd door watercoolertje op 18 augustus 2026 13:19]

Maar las je een naam weg haalt kun je altijd nog de acties koppelen aan en vergelijken met data met naam, zo kun je zien dat het toch over die ene persoon gaat
Klantendata zit voor zover bekend dus niet bij de data. De data is volgens de verkopende partij ook geanonimiseerd en Google mag ook niet proberen de data alsnog aan mensen te koppelen. De data zou dus niet te herleiden moeten zijn tot specifieke Spirit-werknemers.
Serieuze vraag: dit kun je tegenwoordig toch niet meer beweren. Deze ´belofte´ is voldoende om deze data te geven aan het grootste dataslurper ter wereld?!?

[Reactie gewijzigd door Ynst2003 op 18 augustus 2026 12:22]

Zelfs al zou deze data volledig geanonimiseerd zijn, dan hebben de werknemers die deze data hebben gecreëerd geen toestemming gegeven dat dit gebruikt mag worden voor AI doeleinden. Achteraf natuurlijk niet aan te tonen of jouw data is gebruikt (als werknemer) maar nog steeds vind ik het heel vreemd dat zoiets gewoon verhandeld mag worden.
Het is heel normaal dat in je arbeidsovereenkomst staat dat alle output die je levert tijdens je werk eigendom is en blijft van je werkgever.
Ja en nee, die overeenkomst gaat voornamelijk over dingen die jij geproduceerd hebt namens/voor het bedrijf.

De overeenkomst was nooit bedoeld voor het doorverkopen van "persoonlijke data" aan een databoer om AI te trainen. Dit is puur weer een bedrijf dat een maas in de huidige afspraken/wetten probeert te gebruiken om data op te slurpen.

Ja de data is eigendom van het bedrijf, maar het kan niet de bedoeling zijn dat dit verkocht wordt aan een 3e partij met een compleet andere business case.
Deze case is in de Verenigde Staten en ligt dit heel anders: daar geldt als hoofdregel dat de werkgever eigenaar is van vrijwel alle data op zakelijke apparaten en netwerken. Werknemers hebben op de Amerikaanse werkvloer nagenoeg geen recht op privacy als zij gebruikmaken van eigendommen van het bedrijf. In Europa en Nederland ligt dit anders, maar daar gaat deze case niet over.
Dit soort contracten gaan over 'producten' die je oplevert of aan mee werkt, niet over berichten dat je niet naar je werk kan komen omdat je met je partner naar het ziekenhuis moet...
En daar gaat het hier (onder andere) wel om:
Voor zover bekend gaat het vooral om interne bedrijfsdata, zoals HR-informatie over de productiviteit van werknemers...
Daarom dat nu dus een rechter erover beslist of Google de data mag opkopen.
Hoezo? Een derde partij gaat de data eerst anonimiseren voordat het Google bereikt;
Google zegt tegen nieuwssite Axios de data door een derde partij te laten opschonen om ervoor te zorgen dat de informatie volledig geanonimiseerd is.
Dat maakt het al moeilijker voor Google om dit te doen.

[Reactie gewijzigd door CH4OS op 18 augustus 2026 12:34]

Dataset Spirit Airlines

Medewerker X mailt medewerker Y over een klacht die Persoon A heeft over een vlucht HV9234 die 8 uur vertraging had en dus overnachting heeft moet boeken, die niet tevreden is met de standaard vergoeding die Spirit Airlines biedt.


Dataset 1 Google:

Persoon M zoekt wat er te doen in Stad C

Persoon M zoekt hotel in Stad C

Persoon M ontvangt mailtje met bevestiging van vlucht HV9234 (Gmail)

Persoon M zoekt op dag van vertraging vlucht HV9234 een hotel Stad D


Dataset 2 Google:

alle data van alle vliegtuigbewegingen wereldwijd inclusief realtime alle vertragingen


Zou het kunnen dat Persoon A in dataset Spirit Airlines misschien wel Persoon M in Dataset 1 van Google? Percentagewijs?

Voor mij is het zeer lastig om Google op hun blauwe ogen te geloven dat ze al deze datasets niet aan elkaar koppelen. En Google heeft miljoenen datasets/-punten die ze kunnen combineren, zeer krachtige AI en miljarden dollars.. Hoe meer ze combineren, hoe zeker ze ze zijn.

[Reactie gewijzigd door Ynst2003 op 18 augustus 2026 12:49]

Geen idee, daarom dat een derde partij de data anonimiseert. En of dat effectief gaat werken ja of nee, geen idee dus. Bedenk echter wel, dat er ook een rechter over gaat buigen of deze verkoop überhaupt doorgang mag vinden of niet, dus Google heeft op het moment ook nog niets.
dat is mijn punt. hoe veel verder kun je het anonimiseren.

Persoon A heeft een klacht over een vlucht die te laat is en het niet eens is het de vergoeding.

(Geen tijd, geen datum, geen vluchtnummer, geen ´van stad X naar stad Y´)

Als je ze zo ver gaan met anonimiseren, zou het misschien kunnen.
Met dataset 1 en 2 weten ze al heel veel van een persoon. Hoeveel voegt dataset Spirit Airlines nog toe voor Google, als het over de betreffende persoon gaat? Voor de reclame zijn dataset 1 en 2 al voldoende.

En ik weet nog steeds niet welk programma op mijn iPhone standaard toegang heeft tot de microfoon, maar van de week had ik met mijn vrouw een discussie over zweten. En binnen 24 uur komt er in de feed van Youtube shorts een filmpje tussen door over hoe het lichaam afkoelt door zweten, precies waar de discussie over ging.

Ook zonder Spirit weet Google gigantisch veel over ons.
Dat kan in dit geval niet want HV9234 is een vlucht van Transavia. :+
Dat is HV5234, aldus Google.
HV9234 bestaat inderdaad niet, maar alles met HV zijn sowieso Transavia vluchtnummers.
'Een derde partij' == een bedrijf speciaal door Alphabet opgekocht/opgericht om die anonimisatie te doen?
Toch fijn om even een bewust wording te krijgen dat alles wat je ooit via je zakelijke email en teams heb verstuurd door willekeurige derde commerciële partij gebruikt kan worden mocht het raar lopen.
En natuurlijk je volledige dossier wat bij HR inc. hoe hoe je presteert en of je vaak ziek bent.

maar gelukkig is de data geanonimiseerd.
en is er afgesproken dat data niet herleid mag worden.
Net zoals werknemers in het verleden toch wel mochten verwachten dat hun persoonlijke (geanonimiseerde) data niet in bulk aan een mega corp verkocht zou worden.
Net zoals werknemers in het verleden toch wel mochten verwachten dat hun persoonlijke (geanonimiseerde) data niet in bulk aan een mega corp verkocht zou worden.
Dat mag je niet verwachten in de VS, alles wat je doet voor je werkgever is eigendom van de werkgever, van uitvindingen tot chats. En omdat die blijkbaar geld waard zijn, moet de partij die het faillissement afhandelt die data verkopen om schuldeisers te betalen. In deze maatschappij is informatie eenvoudig geld waard en zelfs bijzonder ruwe data zoals in dit geval heeft nog een waarde.

Of dat juist is, moet je zelf beslissen. Ik zou er wel voor zijn om het verkopen van bepaalde data van een failliet bedrijf te verbieden, maar het is moeilijk om grenzen te trekken. Als ik een bedrijf koop, heb ik tenslotte ook toegang tot alle data van dat bedrijf.
Daarom dat ook een rechter hierover zich gaat buigen en bepalen of deze verkoop doorgang mag vinden.
Nu maar hopen dat de AI die ze hier mee trainen niet dezelfde fouten gaat maken wat tot het faillissement van Spirit Airlines heeft geleid }>
Ja precies. Lekker trainen op data van slechte ondernemingen, komt vast een heel capabele AI uit voort 8)7
Van fouten kan je leren. In dit geval de fouten van een ander.
En hoe ga je m laten meenemen dat die 500 miljoen emails of zo een afspiegeling zijn van een groep die verliesgevend bezig was. Lijkt me lastig.
Prompt: Dit was een verlieslatend bedrijf, hou hier rekening mee. Toon mij hoe het zeker NIET moet :p.
Tuurlijk. En al die 500 miljoen emails worden dan negatief geleerd in plaats van positief. Denk dat dat wel gaat werken |:(
De data is volgens de verkopende partij ook geanonimiseerd en Google mag ook niet proberen de data alsnog aan mensen te koppelen

...

Google zegt tegen nieuwssite Axios de data door een derde partij te laten opschonen om ervoor te zorgen dat de informatie volledig geanonimiseerd is.
En wie controleert dat, we vertrouwen Google natuurlijk op hun blauwe ogen, want die hebben op dat gebied een hele goede reputatie...
Of het nou om google of een ander bedrijf gaat. Ik vraag mij af of dit soort data in de verkoop zou moeten staan. De communicatie met HR bijvoorbeeld en wat al niet.

Met alle data die google al heeft kunnen ze waarschijnlijk met hoge zekerheid de data de-anonimiseren als ze willen.
hier in nederland niet. Je hebt hier een behoorlijk stevig recht op privacy op de werkplek.

In amerika echter?
stel je voor: over 10 jaar koopt google oppeens alle data van het bedrijf waar je een paar jaar eerder bent vertrokken, nu weten ze bijna alles over jou, zelfs wat de HR over jou heeft geroddeld en weet ik het wat, allemaal zonder jou toestemming. Ongelofelijk dat dit door de beugel gaat.
Leuk, gaat je bedrijf failliet en mogen ze blijkbaar je Teams gesprekken die je onderling met collega's hebt gevoerd gaan verkopen. Dat is toch gewoon privacy gevoelige info? Dan moet je dus al gaan beginnen met bij een ex werkgever een "vergeet me" request in te dienen :/.

Om te kunnen reageren moet je ingelogd zijn