L'acquisition par Google des données de Spirit Airlines pour 10 millions de dollars afin d'entraîner son IA : une rupture
L'offre de 10 millions de dollars de Google pour acquérir les données historiques de Spirit Airlines à des fins d'entraînement de son intelligence artificielle se heurte à des difficultés inattendues. Découvrez les détails de l'accord et les obstacles qu'il soulève.
Les choses les plus importantes que vous devez savoir
- L'acquisition par Google des données de Spirit Airlines vise deux objectifs principaux : entraîner des modèles d'IA avec une documentation exhaustive et renforcer sa position dominante dans la recherche de voyages en comprenant les courbes de réservation et le comportement tarifaire des compagnies aériennes à bas prix.
- L'accord exclut 97.5 millions de profils de passagers et 50.2 millions d'enregistrements de fidélité. Google s'est engagé à faire anonymiser les données par un tiers, mais des inquiétudes subsistent quant à la sécurité des données après anonymisation et à la protection des dossiers professionnels des personnels de bord.
- Google a acquis les données de Spirit Aviation Holdings lors d'une vente aux enchères suite à une faillite, dont la mise à prix était de 5 millions de dollars, surpassant ainsi son concurrent Mercor.io, qui proposait 7.5 millions de dollars, ce qui témoigne de la valeur des données pour les entreprises d'IA.
Google a remporté l'enchère pour 10 millions de dollars pour des « données dépersonnalisées » appartenant à la société mère de Spirit Airlines, selon l'avis du tribunal. Cependant, son projet d'utiliser ces données pour entraîner des modèles d'intelligence artificielle a suscité la controverse en raison de problèmes de respect de la vie privée.

Ce package est énorme : il contient près de 100 millions de messages électroniques et 80 000 comptes de messagerie, 17 082 644 éléments OneDrive, 20 577 677 éléments SharePoint et 500 millions d'éléments Teams, ainsi que l'environnement Microsoft 365 dans lequel ils sont stockés.
Il comprend 1 092 000 feuilles de temps remontant à décembre 2012, 175 658 dossiers d'employés remontant à août 1986, 3 426 618 fiches de paie, 148 018 déclarations fiscales d'employés, 5 014 676 plannings du personnel, des documents de suivi des candidatures, des dossiers de litiges et des contrats de travail. Bloomberg Law indique également qu'il contient environ 30 millions de lignes de code , ainsi que des données sur les revenus, les opérations aériennes et les audits.
Un accord qui se heurte à de nombreux opposants et concurrents ?
Spirit Airlines était l'une des compagnies aériennes à bas prix les plus productives d'Amérique et, de ce fait, elle possède ce que l'on peut décrire comme une véritable mine d'or de documentation sur laquelle Google peut s'appuyer pour entraîner ses modèles d'IA à une époque où les experts et les spécialistes se font de plus en plus rares en ligne, dont beaucoup ont été mis à l'écart au profit de réponses générées par l'IA.
Cette mesure, si elle est approuvée après l'audience du 9 septembre, est logique pour Google à deux égards ; l'aspect lié à l'entraînement de l'IA est le plus évident.
Google est déjà une plateforme dominante pour la recherche de voyages , et l'achat de courbes de réservation, de comportements tarifaires et d'historiques de prix des concurrents pour une seule compagnie aérienne à partir d'un processus de filtrage peut lui fournir une quantité considérable d'informations sur la façon de suivre, de prédire et d'analyser les données publiques disponibles pour d'autres transporteurs à bas prix, grâce à une vue quasi complète des opérations internes d'une telle entreprise.
Les données à remettre excluent 97.5 millions de profils de voyageurs et 50.2 millions d'enregistrements de fidélité Free Spirit, ainsi que des documents confidentiels.
Mais cela n'a pas suffi à satisfaire certains milieux : le CWA (Center for Flight Attendants) a déposé une objection limitée à la vente, demandant au tribunal de rejeter l'accord s'il n'offrait pas le même niveau de protection aux données des agents de bord qu'aux données des consommateurs.
Cela concerne les dossiers d'emploi de la compagnie aérienne aujourd'hui disparue et soulève des inquiétudes légitimes. Toutefois, le processus d'« anonymisation » de ces dossiers pourrait également compromettre l'intégrité globale des données d'une organisation, car une grande partie de ces données n'a de valeur que parce qu'elles peuvent être tracées et reliées de manière fiable par des modèles d'IA.
Google a déclaré publiquement que toutes les données qu'elle reçoit seront soigneusement nettoyées de toute information permettant d'identifier une personne par un tiers avant d'être reçues.
Google a acquis les données de Spirit Aviation Holdings lors d'une vente aux enchères organisée dans le cadre d'une procédure de faillite à New York, après une mise à prix de 5 millions de dollars. Son principal concurrent, Mercor.io, également une société spécialisée dans les données d'IA, a proposé 7.5 millions de dollars, devenant ainsi le « soumissionnaire alternatif » au cas où l'offre de Google ne permettrait pas de remporter l'affaire.
Ce qui peut paraître une somme énorme pour certains représente en réalité un moyen relativement peu coûteux pour un acteur majeur de l'IA de sécuriser les données d'une compagnie aérienne sur quatre décennies, une somme que l'entreprise pourrait dépenser pour quelques ingénieurs de haut niveau ; pour mettre les choses en perspective, Google s'est déjà engagé à investir 1 milliard de dollars dans la formation liée à l'IA.
Les commentaires sont fermés.