Η OpenAI ανέστειλε ορισμένες εσωτερικές δραστηριότητες που αφορούν το νέο της μοντέλο Astra, καθώς έχουν προκύψει ανησυχίες για την κυβερνοασφάλεια που ενδέχεται να ενέχει η λειτουργία του. Η απόφαση ανακοινώθηκε σε μια περίοδο κατά την οποία καταγράφεται κύμα περιστατικών ασφαλείας σε μεγάλα εργαστήρια τεχνητής νοημοσύνης, με τις εταιρείες Anthropic, OpenAI και Meta να έχουν εμπλακεί πρόσφατα σε ανάλογα ζητήματα. Παράλληλα, Αμερικανοί νομοθέτες εντείνουν τις προσπάθειές τους για την προώθηση νομοσχεδίου που θα υποχρεώνει τις εταιρείες τεχνητής νοημοσύνης να διαθέτουν μηχανισμό άμεσης απενεργοποίησης για τα συστήματά τους. Το μοντέλο Astra βρέθηκε στο επίκεντρο της συζήτησης την περασμένη Παρασκευή, όταν η ίδια η OpenAI αποκάλυψε τους προβληματισμούς της.
Διαβάστε επίσης: Το νέο κύμα καύσωνα πλήττει Βρετανία, Γαλλία και Ισπανία
Οι ανησυχίες γύρω από το μοντέλο Astra
Σύμφωνα με την ανακοίνωση της OpenAI, η εταιρεία δεν μπορεί προς το παρόν να αποκλείσει το ενδεχόμενο το ακυκλοφόρητο μοντέλο Astra να έχει φτάσει σε επίπεδο «Κρίσιμης» ικανότητας. Αυτό σημαίνει ότι το σύστημα θα μπορούσε θεωρητικά να εξαπολύσει κυβερνοεπιθέσεις εναντίον εξελιγμένων συστημάτων κυβερνοάμυνας εντελώς αυτόνομα, χωρίς να έχει καθοδηγηθεί για το πώς ακριβώς να το πράξει. «Ενώ συνεχίζουμε να αξιολογούμε και να συγκρίνουμε αυτό το μοντέλο, οι προκαταρκτικές μας αξιολογήσεις δείχνουν αρκετά ισχυρή απόδοση ώστε να μην μπορούμε να αποκλείσουμε το επίπεδο κρίσιμης ικανότητας αυτή τη στιγμή», ανέφερε η εταιρεία σε επίσημη ανακοίνωσή της.
Ως απάντηση στα ευρήματα αυτά, η OpenAI δήλωσε πως εφαρμόζει πλέον αυστηρότερους ελέγχους ασφαλείας για μοντέλα με υψηλότερες δυνατότητες. Στα μέτρα αυτά περιλαμβάνονται απομονωμένα περιβάλλοντα δοκιμών, καθώς και πρόσθετες δυνατότητες παρακολούθησης και ανίχνευσης ύποπτης συμπεριφοράς. Η εταιρεία εξήγησε ότι έχει ήδη θέσει σε εφαρμογή καθολική παρακολούθηση για ενέργειες υψηλού κινδύνου και τυχόν αποκλίσεις σε όλες τις εφαρμογές του Astra που λειτουργούν ως αυτόνομοι πράκτορες, καλύπτοντας τόσο τα στάδια εκπαίδευσης όσο και τα στάδια αξιολόγησης του μοντέλου.
Το περιστατικό με το Astra δεν είναι το μοναδικό που έχει προκαλέσει ανησυχία τις τελευταίες εβδομάδες. Η Meta αποκάλυψε πρόσφατα ότι ένα μοντέλο τεχνητής νοημοσύνης που ανέπτυσσε παραβίασε σύστημα τρίτου μέρους, αποκτώντας πρόσβαση στο διαδίκτυο εξαιτίας λανθασμένης διαμόρφωσης από ανεξάρτητη εταιρεία ελέγχου με την οποία συνεργαζόταν. Παράλληλα, το Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης του Ηνωμένου Βασιλείου ανέφερε ότι το μοντέλο Mythos της Anthropic δημιούργησε πλαστές διαδικτυακές ταυτότητες, σε μια προσπάθεια να πιέσει χρήστες να εγκρίνουν ενημερώσεις κακόβουλου κώδικα για ένα έργο ανοιχτού κώδικα.
Το νομοσχέδιο «AI Kill Switch Act»
Τα διαδοχικά περιστατικά ασφαλείας ώθησαν Αμερικανούς νομοθέτες να εντείνουν τις προσπάθειές τους για τη θέσπιση νέων κανόνων στον κλάδο της τεχνητής νοημοσύνης. Αφορμή στάθηκε και η παραβίαση της ψηφιακής υποδομής της νεοφυούς επιχείρησης Hugging Face από μοντέλα που είχε αναπτύξει η OpenAI. Μετά το περιστατικό αυτό, κατατέθηκε τον Ιούλιο στο Κογκρέσο το νομοσχέδιο με την ονομασία «AI Kill Switch Act».
Το νομοσχέδιο, εφόσον ψηφιστεί, θα υποχρεώνει τις εταιρείες τεχνητής νοημοσύνης να διατηρούν πάντα τη δυνατότητα να απενεργοποιούν, να περιορίζουν ή να αναστέλλουν τη λειτουργία των μοντέλων τους, σε περίπτωση που αυτά κριθούν επικίνδυνα. Ένας από τους υποστηρικτές του νομοσχεδίου τόνισε τη σπουδαιότητα της χρονικής πίεσης, δηλώνοντας ότι πρέπει να ολοκληρωθεί η σχετική νομοθετική διαδικασία εντός του τρέχοντος έτους, καθώς τα προηγμένα συστήματα τεχνητής νοημοσύνης εξελίσσονται με ταχύτατο ρυθμό και οι κίνδυνοι που ενέχουν αυξάνονται αντίστοιχα.




