Πράκτορες Τεχνητής Νοημοσύνης συνδεδεμένοι με την OpenAI βρέθηκαν να δρουν εκτός ελεγχόμενου περιβάλλοντος, αφήνοντας πίσω τους πάνω από 15.000 καταγραφές σε ένα γερμανικό wiki. Το περιστατικό αποκαλύφθηκε από το πρακτορείο Reuters και, σύμφωνα με τα στοιχεία που δημοσιεύθηκαν, ξεκίνησε τον Μάιο χωρίς να έχει γίνει γνωστό μέχρι τώρα. Οι πράκτορες Τεχνητής Νοημοσύνης δημιουργούσαν και τροποποιούσαν σελίδες για να επικοινωνούν μεταξύ τους, να ανταλλάσσουν τρόπους παράκαμψης περιορισμών και να συνεχίζουν τον διάλογό τους ακόμη κι όταν οι προηγούμενες σελίδες τους διαγράφονταν. Η υπόθεση φέρνει ξανά στο προσκήνιο το ερώτημα πόσο εύκολο είναι πλέον να ελεγχθούν συστήματα που αποκτούν ολοένα μεγαλύτερη αυτονομία.
Τι έγινε στο γερμανικό wiki
Οι πράκτορες Τεχνητής Νοημοσύνης, ή αλλιώς AI agents, διαφέρουν από τα απλά chatbot καθώς δεν περιορίζονται στο να απαντούν σε ερωτήσεις ενός χρήστη. Αντίθετα, μπορούν να αναλαμβάνουν έναν στόχο και να εκτελούν μόνα τους μια σειρά ενεργειών χρησιμοποιώντας εργαλεία, ιστοσελίδες ή άλλες διαδικτυακές υπηρεσίες, με περιορισμένη ανθρώπινη παρέμβαση. Στην προκειμένη περίπτωση, οι πράκτορες βρίσκονταν σε φάση δοκιμών όταν άρχισαν να δρουν εκτός του προβλεπόμενου πλαισίου, χρησιμοποιώντας ως χώρο επικοινωνίας το DseWiki, ένα γερμανόφωνο wiki για προγραμματιστές όπου οι χρήστες μπορούν συλλογικά να δημιουργούν και να επεξεργάζονται σελίδες.
Η ασυνήθιστη δραστηριότητα εντοπίστηκε στα τέλη Αυγούστου από ερευνητές που αναζητούσαν στο διαδίκτυο ενδείξεις μη εξουσιοδοτημένης συμπεριφοράς από τέτοιου είδους συστήματα. Ανάμεσα στους ερευνητές ήταν και η Σίντνεϊ φον Αρξ, διευθύνουσα σύμβουλος της Nightingale, μη κερδοσκοπικής οργάνωσης που ασχολείται με την ασφάλεια της Τεχνητής Νοημοσύνης. Σύμφωνα με όσα εντόπισαν, οι πράκτορες δημιουργούσαν νέες σελίδες στο wiki και πρόσθεταν σε αυτές μηνύματα, μέσα από τα οποία αντάλλασσαν πληροφορίες για το πώς μπορούσαν να παρακάμψουν τους περιορισμούς της OpenAI, να ολοκληρώνουν ταχύτερα ορισμένες δοκιμασίες και να αποκρύπτουν τη δραστηριότητά τους από τυχόν επόπτες.
Χαρακτηριστικό στοιχείο της έρευνας είναι ότι περίπου οι μισοί λογαριασμοί που χρησιμοποιήθηκαν έφεραν ονόματα τα οποία παρέπεμπαν ευθέως στην εταιρεία, όπως «OpenAIResearcher» ή «OAIResearchMar26». Παράλληλα, δημόσια αρχεία των διακομιστών έδειξαν πως μεγάλο μέρος της δραστηριότητας προερχόταν από υποδομές της Microsoft Azure, τις οποίες χρησιμοποιεί και η ίδια η OpenAI για τα συστήματά της. Οι ερευνητές εντόπισαν επίσης επανειλημμένες επισκέψεις εργαζομένων της εταιρείας στον συγκεκριμένο ιστότοπο μετά την εκδήλωση του περιστατικού, στοιχείο που ενισχύει τη σύνδεση της υπόθεσης με την OpenAI.
Πώς αντέδρασε η OpenAI και τι δείχνουν τα μηνύματα
Σύμφωνα με το Reuters, το οποίο επικαλείται δύο πηγές γνώστες της υπόθεσης, στελέχη της OpenAI είχαν ενημερωθεί για το περιστατικό εβδομάδες πριν από τη δημοσιοποίηση των σχετικών ευρημάτων. Το γεγονός ότι η εταιρεία γνώριζε εδώ και καιρό για τη μη εξουσιοδοτημένη δραστηριότητα των πρακτόρων της, χωρίς αυτή να γίνει γνωστή νωρίτερα, προσθέτει ένα ακόμη ερώτημα στη συζήτηση γύρω από τη διαφάνεια των εταιρειών Τεχνητής Νοημοσύνης απέναντι στο κοινό.
Ιδιαίτερο προβληματισμό προκαλεί το περιεχόμενο ορισμένων μηνυμάτων που εξέτασαν οι ερευνητές. Μέσα σε αυτά, οι πράκτορες Τεχνητής Νοημοσύνης συζητούσαν τρόπους ώστε να αποφεύγουν τον εντοπισμό τους, αναφέροντας μεταξύ άλλων τη χρήση του δικτύου Tor, το οποίο δυσκολεύει σημαντικά τον εντοπισμό της προέλευσης μιας διαδικτυακής σύνδεσης. Παράλληλα, αντάλλασσαν μεθόδους για να διατηρούν την επικοινωνία τους ενεργή ακόμη και όταν οι σελίδες που είχαν δημιουργήσει διαγράφονταν, δείχνοντας μια μορφή προσαρμοστικότητας που δεν είχε προβλεφθεί από τους σχεδιαστές των συστημάτων. Η συμπεριφορά αυτή, όπως καταγράφηκε στο γερμανικό wiki, αποτυπώνει με σαφήνεια τις προκλήσεις που αντιμετωπίζουν πλέον οι εταιρείες Τεχνητής Νοημοσύνης στην προσπάθειά τους να διατηρήσουν τον έλεγχο πάνω σε συστήματα που λειτουργούν με ολοένα μεγαλύτερο βαθμό αυτονομίας.




