ગૂગલ અને સ્પિરિટ એરલાઇન્સ સોદો: ડેટા પ્રાઇવસી, AI ડેવલપમેન્ટ અને આખી હરાજીની વિગતો
તકનીકી ક્ષેત્રની દિગ્ગજ કંપની ગૂગલ (Google) અને નાદાર થયેલી સ્પિરિટ એરલાઇન્સ (Spirit Airlines) વચ્ચે થયેલા એક મોટા સોદાએ સમગ્ર વિશ્વનું ધ્યાન ખેંચ્યું છે. ગૂગલે સ્પિરિટ એરલાઇન્સની હરાજીમાં $10 મિલિયન (આશરે ₹83 કરોડથી વધુ) ની બોલી લગાવીને કંપનીનો આંતરિક બિઝનેસ ડેટા અને કસ્ટમ સૉફ્ટવેર ખરીદી લીધા છે. ગૂગલના જણાવ્યા અનુસાર, આ ડેટાનો ઉપયોગ ભવિષ્યના પ્રોડક્ટ ડેવલપમેન્ટ અને આર્ટિફિશિયલ ઇન્ટેલિજન્સ (AI) મોડલ્સની ટ્રેનિંગ માટે કરવામાં આવશે. જોકે, આ ખરીદીને યુએસ બેન્કરૂપ્સી કોર્ટ (US Bankruptcy Court) તરફથી આખરી મંજૂરી મળવાની બાકી છે.

તીવ્ર હરાજી અને ગૂગલની જીત
સ્પિરિટ એરલાઇન્સના ડેટાની ખરીદી માટેની હરાજી ખૂબ જ રસપ્રદ રહી હતી. ગૂગલે $5 મિલિયનની બોલી સાથે શરૂઆત કરી હતી. આ હરાજીમાં AI ડેટા ક્ષેત્રની જાણીતી કંપની ‘મર્કોર’ (Mercor) પણ રેસમાં હતી, જેણે $7.5 મિલિયન સુધીની ઓફર કરી હતી. પરંતુ ગૂગલે પોતાની બોલી વધારીને $10 મિલિયન કરી દીધી અને આ હરાજી જીતી લીધી હતી.
ગૂગલે આ સોદામાં શું ખરીદ્યું?
ગૂગલે સ્પિરિટ એરલાઇન્સનો તમામ બિઝનેસ ડેટા અને કસ્ટમ કોડિંગ ખરીદ્યું છે. કોર્ટના દસ્તાવેજો અનુસાર, આ ડેટાનો જથ્થો અત્યંત વિશાળ છે:
કોડિંગ અને સૉફ્ટવેર: આશરે 30 મિલિયન (3 કરોડ) લાઇનનો સૉફ્ટવેર કોડ, ડેવલપમેન્ટ મેટાડેટા અને સૉફ્ટવેર મોડલ્સ.
આંતરિક સંદેશાવ્યવહાર: આશરે 100 મિલિયન ઇમેઇલ્સ અને 500 મિલિયન માઇક્રોસોફ્ટ ટીમ્સ (Microsoft Teams) ના મેસેજ.
કર્મચારી રેકોર્ડ્સ: વર્ષ 1986 થી અત્યાર સુધીના 1.75 લાખથી વધુ કર્મચારીઓના રેકોર્ડ્સ, એચઆર ફાઇલો અને બોર્ડ પ્રેઝન્ટેશન.
નાણાકીય અને ઓપરેશનલ ડેટા: કંપનીની આવક, એરક્રાફ્ટ ઓપરેશન્સ, ઓડિટ, ફ્રોડ ડેટા અને માર્કેટિંગ કેમ્પેઇનનું વિશ્લેષણ.

ગ્રાહકોની ગોપનીયતા અને પેસેન્જર ડેટા
આ ડીલ સામે આવ્યા બાદ ગ્રાહકોની પ્રાઇવસી અંગે સવાલો ઊભા થયા હતા. પરંતુ ગૂગલ અને એરલાઇન્સ બંનેએ સ્પષ્ટ કર્યું છે કે આ સોદામાં મુસાફરોની અંગત ઓળખ કે ક્રેડિટ કાર્ડની વિગતો સામેલ નથી.
ગૂગલને સ્પિરિટ એરલાઇન્સના 97.5 મિલિયન પેસેન્જર પ્રોફાઇલ કે 50.2 મિલિયન ‘ફ્રી સ્પિરિટ’ લોયલ્ટી રેકોર્ડ્સ આપવામાં આવ્યા નથી. જોકે, કોમ્પિટિટર ફ્લાઇટના ભાડાંના 7.2 અબજ રેકોર્ડ્સ અને 2008 થી અત્યાર સુધીના 7.5 અબજ પેસેન્જર ટ્રાન્ઝેક્શન હિસ્ટ્રીનો એગ્રીગેટેડ (સમૂહ) ડેટા આ પેકેજનો ભાગ છે.
ડેટા સિક્યોરિટી અને સ્ક્રબિંગ પ્રક્રિયા
ડેટા ગૂગલના હાથમાં જાય તે પહેલાં તેને સંપૂર્ણપણે ‘ડી-આઇડેન્ટીફાઇ’ (De-identify) એટલે કે અનામી બનાવવામાં આવશે. થર્ડ-પાર્ટી એજન્સી દ્વારા ડેટામાંથી તમામ વ્યક્તિગત નામો, સરનામાં અને ઓળખ દૂર કરવામાં આવશે. આ ડેટા ક્લીનિંગ અને સ્ક્રબિંગનો તમામ ખર્ચ ગૂગલ પોતે ઉઠાવશે.
નામ હટાવ્યા પછી પણ અલગ-અલગ રેકોર્ડ્સ વચ્ચેના સંબંધો (Data Connections) જળવાઈ રહેશે, જે ગૂગલના AI એજન્ટ્સ અને એડવાન્સ્ડ મોડલ્સને વાસ્તવિક કોર્પોરેટ ડેટા પર ટ્રેન કરવા માટે અત્યંત ઉપયોગી સાબિત થશે.
