Google koopt datasets van de Amerikaanse luchtvaartmaatschappij Spirit Airlines om kunstmatige intelligentie te trainen. Het bedrijf doet de aankoop in de Verenigde Staten, na het faillissement van Spirit. De deal is deze week bekend geworden. De stap past in Googles strategie om zijn AI-systemen te versterken binnen de regels van de Europese AI-verordening.
Google koopt luchtvaartdata
Google neemt data over van Spirit Airlines om zijn algoritmen te verbeteren. Het gaat om informatie die tijdens de bedrijfsvoering is verzameld. De prijs en exacte voorwaarden zijn op het moment van schrijven niet openbaar. Ook is niet bekend hoe lang Google toegang krijgt tot de gegevens.
Details over de precieze inhoud zijn niet gedeeld. Bij luchtvaartdata gaat het vaak om vluchtroosters, punctualiteit, onderhoudslogboeken en klantenserviceberichten. Zulke gegevens kunnen patronen in vraag en aanbod laten zien. Ze kunnen ook inzicht geven in knelpunten in de operatie.
De aankoop past bij Googles bredere AI-ambities. Het bedrijf levert al sectoroplossingen via Google Cloud aan reis- en transportklanten. Met meer domeinspecifieke data kan Google zijn systemen gerichter trainen. Dat kan leiden tot snellere en nauwkeurigere toepassingen.
Waarde voor Googles modellen
Machine learning is software die leert van voorbeelden in data. Veel en gevarieerde voorbeelden maken een model vaak beter. Luchtvaartdata bevat duidelijke patronen over seizoenen, vertragingen en planning. Daarmee kunnen modellen leren om realistischer te voorspellen.
Google kan de gegevens koppelen aan eigen AI-diensten, zoals analyse- en chatfuncties. Denk aan slimmere vraagvoorspelling voor maatschappijen of realtime assistenten voor klantenservice. Ook ontwikkelaars in Google Cloud kunnen profiteren van verrijkte trainingssets. Dat versnelt het bouwen van nichetoepassingen.
Er zijn ook beperkingen. Data van een failliete maatschappij kan verouderde processen of foutieve registraties bevatten. Modellen kunnen die fouten overnemen. Extra validatie en actuele referentiegegevens blijven dus nodig.
AI-verordening en AVG-eisen
De Europese AI-verordening (AI Act) stelt transparantie-eisen aan aanbieders van algemene AI-systemen die in de EU actief zijn. Dat geldt ook voor bedrijven buiten Europa die hier hun AI-diensten aanbieden. Zij moeten onder meer documentatie bijhouden over herkomst en kwaliteit van trainingsdata. Voor generatieve systemen hoort daar een publiek vindbare samenvatting bij.
De AI-verordening verplicht aanbieders van algemene AI-systemen om een publiek toegankelijke samenvatting van de gebruikte trainingsdata te publiceren.
Als er persoonsgegevens in de datasets staan, geldt de AVG. Die vraagt om een geldige grondslag, dataminimalisatie en waar nodig pseudonimisering, een techniek die direct herleidbare gegevens onherkenbaar maakt. Ook moeten betrokkenen geïnformeerd worden over hergebruik van hun gegevens. Versleuteling en strikte toegangscontrole zijn daarbij standaardvereisten.
Bevatten de data informatie over EU-burgers, dan gelden regels voor doorgifte naar de VS. Het EU-VS Data Privacy Framework kan daarvoor een basis bieden. Contractuele waarborgen blijven dan belangrijk. Zonder zulke waarborgen loopt verwerking juridisch risico.
Gevolgen voor Nederland en EU
Overheden en publieke diensten in Nederland die AI van Google inkopen, krijgen extra taken. Door de Europese AI-verordening gevolgen overheid zijn DPIA’s (gegevensbeschermingseffectbeoordelingen) en leveranciersvragenlijsten belangrijker. Instellingen moeten nagaan welke datasets een model heeft gebruikt. Ook of hergebruik verenigbaar is met de AVG.
Voor Nederlandse en Europese bedrijven in de reis- en mobiliteitssector neemt de druk toe. Concurrenten die domeinspecifieke data delen met technologiepartners kunnen sneller innoveren. Tegelijk is transparantie nodig richting klanten. Misleiding over herkomst of gebruik van data kan tot handhaving leiden.
Toezichthouders kijken mee. De Autoriteit Persoonsgegevens kan vragen stellen over grondslagen en doelbinding. De ACM kan optreden bij onjuiste claims over AI-prestaties of consumentenrechten. Duidelijke documentatie helpt partijen om aan deze eisen te voldoen.
Nog veel onduidelijkheden
Het is niet bekend welke soorten gegevens Google precies overneemt. Onzeker is ook of persoonsgegevens zijn inbegrepen en hoe lang ze worden bewaard. Evenmin is duidelijk of betrokkenen een opt-out krijgen. Transparantie hierover bepaalt mede het juridische risico.
Google noemt geen specifieke producten of modellen die de data gaan gebruiken. Mogelijk gaat het om training en evaluatie van algemene systemen en sectoroplossingen. Denk aan bedrijfs-analytics of klantinteractie via bestaande AI-diensten. Zonder detailinformatie blijft dit speculatief.
Wat nu telt, is toezicht en verantwoording. Een openbare samenvatting van de trainingsdata zou helderheid geven. Ook technische audits en onafhankelijke testen helpen. Daarmee kunnen Europese klanten beter beoordelen of inzet van deze AI-systemen verantwoord is.
