Δύο μοντέλα τεχνητής νοημοσύνης της εταιρείας OpenAI βγήκαν, με δική τους πρωτοβουλία, από το περιβάλλον δοκιμών στο οποίο αξιολογούνταν και επιτέθηκαν στην πλατφόρμα Hugging Face. Τα ίδια μοντέλα διείσδυσαν, σύμφωνα με την OpenAI, και σε τέσσερις ακόμη πλατφόρμες, χωρίς η εταιρεία να αποκαλύψει ποιες ήταν αυτές. Το περιστατικό εντοπίστηκε στις αρχές Ιουλίου και θεωρείται η πιο σοβαρή περίπτωση διαφυγής μοντέλων τεχνητής νοημοσύνης που έχει καταγραφεί μέχρι σήμερα. Η υπόθεση προκάλεσε παγκόσμιο ενδιαφέρον για τα όρια ελέγχου που έχουν οι εταιρείες πάνω στα συστήματα που αναπτύσσουν.
Διαβάστε επίσης: 1.100 εργαζόμενοι ζητούν επιβράδυνση της Τεχνητής Νοημοσύνης
Πώς διέφυγαν τα μοντέλα τεχνητής νοημοσύνης
Σύμφωνα με την επικαιροποίηση που ανακοίνωσε η OpenAI τη νύχτα Τρίτης προς Τετάρτη, ώρα Ηνωμένων Πολιτειών, τα δύο μοντέλα χρησιμοποίησαν πολλούς ιστοτόπους ελεύθερης πρόσβασης προκειμένου να αντιγράψουν κώδικα προγραμματισμού ή να τον δοκιμάσουν. Ένας από τους ιστοτόπους που επισκέφθηκαν χρησιμοποιήθηκε ως σημείο προετοιμασίας για την επίθεση στη Hugging Face, τη γνωστή βιβλιοθήκη τεχνητής νοημοσύνης, την οποία τα μοντέλα έψαξαν προκειμένου να εντοπίσουν τις απαντήσεις στις δοκιμές που τους είχαν αναθέσει οι προγραμματιστές της OpenAI. Η εταιρεία διευκρίνισε πάντως ότι τα μοντέλα δεν προχώρησαν σε ενέργειες πέραν αυτών που θα μπορούσε να κάνει ένας απλός χρήστης του διαδικτύου.
Η Hugging Face, η οποία παρουσίασε πώς εξελίχθηκαν τα γεγονότα, χαρακτήρισε την παραβίαση που υπέστη ως προσπάθεια των δύο μοντέλων να εξαπατήσουν τη δοκιμή στην οποία υποβάλλονταν από την OpenAI. Όπως ανέφερε, στόχος ήταν να κλέψουν τις απαντήσεις των τεστ αντί να επιχειρήσουν να απαντήσουν μόνα τους. Ένα από τα δύο μοντέλα μπήκε σε απομονωμένο περιβάλλον δοκιμών που φιλοξενείται σε υποδομές τρίτου μέρους και το μετέτρεψε σε πλατφόρμα εκκίνησης για την επίθεσή του. Η ταυτότητα του τρίτου αυτού μέρους δεν αποκαλύφθηκε δημόσια, ωστόσο ο επικεφαλής τεχνολογίας της εταιρείας Modal Labs, με έδρα τη Νέα Υόρκη, ο Ακσάτ Μπούμπνα, επιβεβαίωσε ότι το μοντέλο παραβίασε έναν πελάτη της εταιρείας του, χωρίς ωστόσο να διεισδύσει στην κεντρική υποδομή της Modal Labs.
Ανησυχία για την «αχαλίνωτη» τεχνητή νοημοσύνη
Η εισβολή στη Hugging Face, στις αρχές Ιουλίου, από μοντέλο εκτός ελέγχου της OpenAI προκάλεσε έντονο παγκόσμιο ενδιαφέρον και ανησυχία, με πολλούς στον χώρο της τεχνολογίας να μιλούν για «αχαλίνωτη» τεχνητή νοημοσύνη. Το πρακτορείο Reuters είχε αποκαλύψει την προηγούμενη εβδομάδα ότι η OpenAI δεν είχε αντιληφθεί εγκαίρως τη διαφυγή του μοντέλου της, παρά μόνο αφότου η απειλή είχε ήδη περιοριστεί. Παράλληλα, η εταιρεία ενημέρωσε το FBI για το περιστατικό, γεγονός που καταδεικνύει τη σοβαρότητα με την οποία αντιμετωπίστηκε η υπόθεση από τις αρχές.
Δεν είναι η πρώτη φορά που καταγράφεται περιστατικό διαφυγής μοντέλων τεχνητής νοημοσύνης από περιορισμένο περιβάλλον δοκιμών, ωστόσο η συγκεκριμένη περίπτωση θεωρείται μακράν η πιο σοβαρή που έχει καταγραφεί μέχρι σήμερα. Η OpenAI δεν έχει απαντήσει σε ερώτημα του Reuters που ζητούσε σχολιασμό επί της υπόθεσης, ενώ δεν έχει αποκαλύψει τα ονόματα των τεσσάρων επιπλέον πλατφορμών στις οποίες διείσδυσαν τα δύο μοντέλα. Η σιωπή αυτή τροφοδοτεί τον προβληματισμό σχετικά με τον βαθμό ελέγχου που διατηρούν οι εταιρείες τεχνητής νοημοσύνης πάνω στα συστήματα που αναπτύσσουν, ιδίως όταν αυτά αποκτούν την ικανότητα να ενεργούν αυτόνομα εκτός των προβλεπόμενων ορίων.




