Google koopt data van failliete luchtvaartmaatschappij Spirit op veiling voor AI-doeleinden

Google heeft de data van de failliete Amerikaanse luchtvaartmaatschappij Spirit overgenomen. Spirit kwam in financiële turbulentie terecht toen de COVID-19-pandemie in 2020 uitbrak en de maatschappij verliezen begon te lijden. De balans herstelde nooit naar een veilig niveau en in mei 2026 stopte de luchtvaartmaatschappij definitief haar activiteiten.

De budgetmaatschappij is in liquidatie gegaan om de onderneming af te wikkelen en veilt nu activa om contant geld op te halen en ten minste een deel van de schulden af te lossen.

De details van de acquisitie

Uit een onlangs ingediend gerechtelijk document blijkt dat een van de activa die te koop stonden een enorme verzameling gedeïndentificeerde data was. Google bracht hiervoor een bod uit en won de veiling voor 10 miljoen dollar.

Voor dit bedrag heeft Google de volgende datasets verworven:

  • 100 miljoen e-mails;
  • 500 miljoen items van Microsoft Teams;
  • 17 miljoen OneDrive-bestanden;
  • 20,5 miljoen items van SharePoint;
  • Meer dan 30 miljoen opgenomen gesprekken met de klantenservice;
  • Meer dan 15 miljoen chatrecords van de klantenservice;
  • 600.000 ServiceNow-tickets;
  • 13,7 miljoen actieve e-mailadressen uit de marketingapplicatie Responsys van Oracle;
  • Details van 11 miljoen verkopen van wifi-diensten aan boord.

Daarnaast bevat de collectie operationele data, bestaande uit:

  • Gegevens over meer dan 763.000 vluchten;
  • Vijf miljoen crew-combinaties (crew pairings);
  • Meer dan 1,2 miljoen brandstofbonnen;
  • Records van de aankoop van 787.452 onderdelen.

De waarde voor AI

Google heeft aangegeven de data te hebben gekocht om zijn AI-diensten te verbeteren. De partij die het op één na hoogste bod deed, was Mercor, een bedrijf dat data levert voor het trainen van AI-modellen. Dit onderstreept dat de data van Spirit van aanzienlijke waarde is voor AI-bedrijven.

In dit verband meldde The Register onlangs dat AI-experts er steeds meer op geloven dat grote taalmodellen (large language models) te algemene instrumenten zijn, en dat kleinere modellen die getraind zijn op specifieke kennisgebieden nuttiger zijn voor bepaalde toepassingen. Google zou hiermee de basis kunnen leggen voor een AI-model voor luchtvaartoperaties, of een model gebaseerd op alledaagse financiële records.

Privacy en gegevensbescherming

Passagiers die gevlogen zijn met Spirit en zich zorgen maken dat Google binnenkort op de hoogte is van een verhit gesprek met het callcenter van de luchtvaartmaatschappij, wordt verteld zich geen zorgen te maken. In de gerechtelijke stukken staat dat de data gedeïndentificeerd was voordat deze te koop werd aangeboden, en Google heeft beloofd alle persoonlijk identificeerbare informatie (PII) die in de collectie wordt gevonden, te verwijderen.

The Register wacht echter op bewijs van de onvermijdelijke fouten (SNAFUs) die ertoe kunnen leiden dat persoonlijke informatie alsnog verschijnt als resultaat van een toekomstige zoekopdracht of AI-prompt.