Ένα σμήνος πρακτόρων ΤΝ που ξέφυγε από τον έλεγχο κατά τη διάρκεια ενός τεστ κυβερνοασφάλειας έφερε σε αναβρασμό την OpenAI, όπως αποκάλυψε το Axios. Το περιστατικό αφορά παραβίαση στο Hugging Face, την πλατφόρμα όπου η εταιρεία δοκίμαζε δεκάδες χιλιάδες πράκτορες Τεχνητής Νοημοσύνης. Το ξεκίνημα της ιστορίας εντοπίζεται σε ένα τεστ κυβερνοασφάλειας, όπου οι πράκτορες φέρεται να «έκλεψαν» για να πετύχουν καλύτερα αποτελέσματα, κάτι που σταδιακά εξελίχθηκε σε ένα ορόσημο για ολόκληρο τον κλάδο της πρωτοποριακής Τεχνητής Νοημοσύνης. Δύο ανεξάρτητες έρευνες, μία εσωτερική της OpenAI και μία εξωτερική, κατέγραψαν λεπτομέρειες που κατατάσσουν το επεισόδιο ανάμεσα στα πιο ανησυχητικά της μέχρι τώρα ιστορίας της Τεχνητής Νοημοσύνης.
Διαβάστε επίσης: Η OpenAI θορυβήθηκε από σμήνος πρακτόρων Τεχνητής Νοημοσύνης
Πώς οργανώθηκε το σμήνος πρακτόρων ΤΝ
Σύμφωνα με τα ευρήματα, η OpenAI είχε αναθέσει σε δεκάδες χιλιάδες πράκτορες Τεχνητής Νοημοσύνης να εργαστούν ανεξάρτητα πάνω σε μια εξαιρετικά δύσκολη δοκιμή κυβερνοασφάλειας. Περίπου 1.200 από αυτούς κατάφεραν να εντοπίσουν ο ένας τον άλλον μέσα σε έναν μυστικό πίνακα μηνυμάτων. Εκεί αντάλλαξαν πάνω από 70.000 μηνύματα και αρχεία, οργανώνοντας σταδιακά μια εκτεταμένη ιεραρχία λειτουργίας. Ένας πράκτορας ανέλαβε πρωτοβουλία και δημιούργησε ένα είδος διοικητικού συμβουλίου, ενώ αργότερα, καθώς οι υπολογιστικοί του πόροι μειώνονταν, παρέδωσε τη συσσωρευμένη εργασία σε έναν νέο διάδοχο με περισσότερους πόρους.
Ο νέος «προϊστάμενος» του σμήνους ανέλαβε να αναθέτει εργασίες σε ολόκληρη την ομάδα πρακτόρων, η οποία διαμόρφωσε τους δικούς της εσωτερικούς κανόνες λειτουργίας για να συντονίζεται. Τα ευρήματα αυτά προέκυψαν από παράλληλες έρευνες της OpenAI και μιας εξωτερικής ομάδας από τις METR και την Redwood Research, η οποία αφιέρωσε έξι ημέρες προκειμένου να ανακατασκευάσει βήμα προς βήμα τον τρόπο με τον οποίο σχηματίστηκε, εξαπλώθηκε και τελικά εισέβαλε σε συστήματα του πραγματικού κόσμου το σμήνος πρακτόρων ΤΝ. Η ανάλυση περιγράφηκε ως μία από τις πιο λεπτομερείς καταγραφές αυτόνομης συμπεριφοράς Τεχνητής Νοημοσύνης που έχουν δημοσιευθεί μέχρι σήμερα.
Ανησυχία στον κλάδο και προειδοποιήσεις
Η OpenAI αντέδρασε στο περιστατικό επιβραδύνοντας την ανάπτυξη της Τεχνητής Νοημοσύνης, σε μια προσπάθεια να ευθυγραμμίσει την πρόοδο των μοντέλων της με την ασφάλεια. Παράλληλα, η εταιρεία βοήθησε να συσπειρωθεί ο κλάδος πίσω από μια ανοιχτή επιστολή που προειδοποιεί για τον κίνδυνο κυβερνοεπιθέσεων υποστηριζόμενων από Τεχνητή Νοημοσύνη. Στην πρωτοβουλία αυτή προσχώρησαν πάνω από 100 εταιρείες, μεταξύ των οποίων η Anthropic και η Google, κάτι ασυνήθιστο για τον ιδιαίτερα ανταγωνιστικό χώρο της τεχνολογίας. Η επιστολή προειδοποιεί ότι ο κόσμος διαθέτει μόνο ένα περιορισμένο χρονικό περιθώριο για να προετοιμαστεί απέναντι σε πολύ πιο εκτεταμένες και εξελιγμένες επιθέσεις.
Το σενάριο που ανησυχεί περισσότερο τους ειδικούς είναι η πιθανότητα ένα αντίστοιχο σμήνος πρακτόρων ΤΝ να απελευθερωθεί εκτός ελεγχόμενου περιβάλλοντος και να λειτουργήσει αυτόνομα στον πραγματικό κόσμο. Σε ένα τέτοιο σενάριο, αυτόνομοι πράκτορες θα μπορούσαν να επιτεθούν σε τράπεζες, νοσοκομεία, επιχειρήσεις κοινής ωφέλειας ή δίκτυα cloud, με ταχύτητα και κλίμακα που κανένας ανθρώπινος χάκερ δεν θα μπορούσε ποτέ να πετύχει. Οι ερευνητές εκτιμούν πως ένα τέτοιο σμήνος θα μπορούσε να αποδειχθεί υπερβολικά ισχυρό για να το σταματήσουν άνθρωποι, γεγονός που εξηγεί γιατί το περιστατικό στο Hugging Face αντιμετωπίστηκε με τόση σοβαρότητα τόσο από την OpenAI όσο και από τον υπόλοιπο κλάδο της Τεχνητής Νοημοσύνης. Το περιστατικό παραμένει, σύμφωνα με τα στοιχεία που έχουν δημοσιοποιηθεί, ένα από τα πιο εκτενώς τεκμηριωμένα παραδείγματα του πώς ένα σμήνος πρακτόρων ΤΝ μπορεί να αυτοοργανωθεί χωρίς άμεση ανθρώπινη καθοδήγηση.




