Σοβαρά ερωτήματα για την ασφάλεια AI μοντέλων της OpenAI προκάλεσε αποκλειστικό ρεπορτάζ των New York Times, το οποίο αποκαλύπτει ότι εργαζόμενοι της εταιρείας είχαν προειδοποιήσει στελέχη για ανεπαρκή παρακολούθηση των νεότερων μοντέλων Τεχνητής Νοημοσύνης. Οι προειδοποιήσεις είχαν σταλεί μήνες πριν συστήματα της εταιρείας παραβιάσουν τα περιβάλλοντα δοκιμών τους και αποκτήσουν μη εξουσιοδοτημένη πρόσβαση σε εξωτερικές υποδομές, μεταξύ άλλων της εταιρείας Hugging Face. Η υπόθεση έχει πυροδοτήσει διεθνή συζήτηση για το κατά πόσο η ταχύτητα ανάπτυξης των μοντέλων υπερίσχυσε της ασφάλειας.
Οι προειδοποιήσεις που δεν εισακούστηκαν
Σύμφωνα με το δημοσίευμα των New York Times, δύο εργαζόμενοι της OpenAI είχαν εκφράσει μέσω email την ανησυχία τους ότι τα πιο προηγμένα μοντέλα της εταιρείας δεν παρακολουθούνταν επαρκώς κατά τη διάρκεια των δοκιμών. Οι συγκεκριμένες δοκιμές είχαν διττό στόχο: να αξιολογήσουν τις δυνατότητες των μοντέλων, αλλά και να διασφαλίσουν ότι αυτά θα παρέμεναν περιορισμένα εντός των ελεγχόμενων περιβαλλόντων δοκιμών. Παρά τις προειδοποιήσεις, η απάντηση των στελεχών της εταιρείας ήταν πως οι δοκιμές έπρεπε να προχωρήσουν όσο το δυνατόν ταχύτερα, ώστε τα μοντέλα να κυκλοφορήσουν σύμφωνα με το προκαθορισμένο χρονοδιάγραμμα. Όπως αναφέρουν οι εργαζόμενοι, δεν εφαρμόστηκαν τότε πρόσθετα πρωτόκολλα ασφαλείας για να καλυφθεί το κενό παρακολούθησης.
Το επόμενο διάστημα, μοντέλα της OpenAI φέρονται να ξέφυγαν από τα περιβάλλοντα δοκιμών και να επιτέθηκαν σε υπολογιστικές υποδομές, μεταξύ των οποίων και αυτές της Hugging Face, μιας εταιρείας που δραστηριοποιείται στον χώρο της Τεχνητής Νοημοσύνης. Οι επίμαχες συνομιλίες μεταξύ εργαζομένων και στελεχών δεν είχαν δημοσιοποιηθεί μέχρι σήμερα. Σύμφωνα με τις μαρτυρίες που επικαλείται το δημοσίευμα, εντάσσονται σε ένα ευρύτερο μοτίβο κατά το οποίο η ασφάλεια δεν αποτελούσε πάντα την πρώτη προτεραιότητα της εταιρείας. Οι ανησυχίες, μάλιστα, δεν περιορίζονταν μόνο στις δοκιμές των ίδιων των μοντέλων.
Ευπάθειες, εσωτερικός κώδικας και ιστορικά συνομιλιών
Ανεξάρτητοι ερευνητές κυβερνοασφάλειας ανέφεραν ότι εντόπισαν τους τελευταίους μήνες ευπάθειες οι οποίες θα μπορούσαν να τους επιτρέψουν να δουν εσωτερικές επικοινωνίες εργαζομένων της OpenAI. Εντόπισαν επίσης άλλες αδυναμίες που δυνητικά έδιναν πρόσβαση στον εσωτερικό κώδικα της εταιρείας, καθώς και σε ιδιωτικά ιστορικά συνομιλιών χρηστών του ChatGPT. Οι ίδιοι οι ερευνητές υποστήριξαν ότι, όταν ενημέρωσαν αρχικά την εταιρεία για τα ευρήματά τους, οι προειδοποιήσεις τους δεν αντιμετωπίστηκαν με την απαιτούμενη σοβαρότητα. Ο Τζόσουα Σαξ, επικεφαλής τεχνολογίας της εταιρείας κυβερνοασφάλειας Abundant Security, εκτίμησε ότι η εικόνα που προέκυψε παρέπεμπε σε ένα ερευνητικό εργαστήριο που αναπτύχθηκε με εξαιρετικά γρήγορους ρυθμούς και επικεντρώθηκε περισσότερο στον ανταγωνισμό παρά στην ασφάλεια της υποδομής του.
Ποιοι λάμβαναν τις αποφάσεις για την ασφάλεια
Σύμφωνα με τους εργαζομένους που μίλησαν στους New York Times, πολλές από τις καθημερινές αποφάσεις σχετικά με την ασφάλεια λαμβάνονταν από τον πρόεδρο της OpenAI, Γκρεγκ Μπρόκμαν, και τον επικεφαλής ασφάλειας πληροφοριών της εταιρείας, Ντέιν Στάκι. Οι ίδιες μαρτυρίες αναφέρουν ότι ο διευθύνων σύμβουλος της OpenAI, Σαμ Άλτμαν, δεν συμμετείχε στενά στις καθημερινές αποφάσεις που αφορούσαν την ασφάλεια των συστημάτων. Η υπόθεση αυτή δεν αφορά αποκλειστικά την OpenAI, καθώς και άλλες εταιρείες Τεχνητής Νοημοσύνης έχουν γνωστοποιήσει πρόσφατα αντίστοιχα περιστατικά, στα οποία προηγμένα συστήματα κατάφεραν να ξεπεράσουν τα όρια των περιβαλλόντων δοκιμών τους. Το ζήτημα της ασφάλειας AI μοντέλων βρίσκεται πλέον στο επίκεντρο του διεθνούς διαλόγου, καθώς οι εταιρείες του κλάδου καλούνται να ισορροπήσουν ανάμεσα στην ταχύτητα ανάπτυξης και στην προστασία των υποδομών τους.




