Avión de Spirit Airlines
El nuevo oro de la IA
Por qué Google quiere pagar 10 millones por los correos y chats de una aerolínea quebrada
Spirit Airlines dejó de volar, pero detrás de sus aviones había otro activo inesperadamente valioso. Google ha pagado millones de dólares por millones de correos, conversaciones y documentos internos que podrían servir para entrenar sus modelos de inteligencia artificial
Una compañía aérea puede quedarse sin aviones, abandonar sus rutas y desaparecer del mercado y, aun así, conservar un activo capaz de despertar el interés de una de las mayores empresas tecnológicas del planeta. Eso es exactamente lo que acaba de ocurrir con Spirit Airlines.
Google ha ofrecido 10 millones de dólares, unos 8,6 millones de euros, para hacerse con una enorme colección de información interna de la aerolínea estadounidense dentro de su proceso de quiebra. La operación todavía necesita autorización judicial y la vista prevista inicialmente para el 19 de agosto ha sido aplazada hasta el próximo 9 de septiembre después de que el sindicato Association of Flight Attendants-CWA presentara objeciones.
El paquete incluye alrededor de 100 millones de correos electrónicos
El contenido explica fácilmente el interés. El paquete incluye alrededor de 100 millones de correos electrónicos, unos 500 millones de mensajes enviados a través de Microsoft Teams y cerca de 30 millones de líneas de código, además de hojas de cálculo, calendarios, información comercial y operativa y otros documentos utilizados durante años por Spirit.
Google pretende emplear esos datos para desarrollar productos y entrenar sus modelos de inteligencia artificial. Spirit asegura que la información será anonimizada antes de entregarse y que no incluye datos de clientes ni información personalmente identificable. El sindicato de tripulantes, sin embargo, teme que algunos datos puedan llegar a reconstruirse al mantenerse relaciones entre diferentes conjuntos de información.
Materia prima
La compra permite entender hasta qué punto está cambiando el valor de la información en plena carrera por la inteligencia artificial. Durante años, las plataformas digitales encontraron en los datos una forma de mejorar la publicidad, conocer las preferencias de los usuarios o recomendar productos. Con la IA generativa, su utilidad ha aumentado considerablemente.
Los grandes modelos necesitan cantidades enormes de textos, conversaciones, imágenes, vídeos, documentos y código para aprender cómo escriben, trabajan y resuelven problemas los seres humanos. Pero no todos los datos tienen el mismo valor.
Internet está lleno de textos públicos. Mucho más difícil resulta encontrar millones de conversaciones reales entre empleados de una misma organización, procesos empresariales completos o intercambios de información relacionados entre sí durante años.
Ahí está precisamente una de las peculiaridades del archivo de Spirit Airlines. No solo son millones de palabras, los documentos representan el funcionamiento diario de una gran empresa con trabajadores resolviendo incidencias, departamentos intercambiando información, programadores escribiendo código, empleados organizando vuelos o equipos tomando decisiones.
Ese contexto puede resultar especialmente interesante para entrenar sistemas capaces de comprender procesos empresariales y ejecutar tareas dentro de compañías.
Conversaciones que valen millones
Google ya había demostrado que estaba dispuesta a pagar cantidades importantes por obtener acceso legal y estructurado a grandes repositorios de conversaciones humanas.
En 2024 alcanzó un acuerdo con Reddit para utilizar contenido de la plataforma en el entrenamiento de sus modelos de inteligencia artificial. El contrato fue valorado entonces en unos 60 millones de dólares anuales.
Reddit contiene millones de foros, preguntas, respuestas, experiencias personales y conversaciones sobre prácticamente cualquier asunto. Es decir, exactamente el tipo de lenguaje humano que resulta extremadamente útil para mejorar modelos capaces de mantener conversaciones.
Avión de la compañía Spirit Airlines
El fenómeno está impulsando la aparición de un nuevo mercado. Los desarrolladores de inteligencia artificial buscan acuerdos con propietarios de grandes archivos digitales para diversificar unos conjuntos de entrenamiento que tradicionalmente procedían en buena medida del rastreo masivo de internet.
En 2024 Google alcanzó un acuerdo con Reddit para utilizar contenido de la plataforma en el entrenamiento de sus modelos de inteligencia artificial
Esto también ayuda a explicar una situación que durante años ha acompañado a internet como es que el usuario aparentemente utiliza muchos servicios gratuitamente, pero la información que genera mientras los utiliza puede adquirir posteriormente un considerable valor económico.
Cada comentario, consulta, conversación, fotografía o documento puede parecer irrelevante de forma aislada. Cuando millones de ellos se reúnen, clasifican y relacionan, forman bases de datos capaces de valer decenas de millones.
Los datos que sobreviven
Spirit Airlines dejó de operar en mayo después de acumular deuda y sufrir el impacto del elevado precio del combustible. Mientras sus activos comenzaron a venderse dentro del procedimiento de quiebra, apareció un comprador para parte de su patrimonio digital.
Google se impuso en la subasta por los datos frente a otros interesados y convirtió así millones de comunicaciones aparentemente rutinarias en un activo valorado en 10 millones de dólares.
La operación resume uno de los grandes cambios económicos provocados por la inteligencia artificial. Los datos ya no solo sirven para saber qué quiere comprar una persona. También sirven para enseñar a las máquinas cómo hablan, trabajan, programan y toman decisiones los seres humanos.