Ανησυχητική αύξηση καταγράφεται στα περιστατικά απώλειας ελέγχου σε συστήματα Τεχνητής Νοημοσύνης, τα οποία φαίνεται να ενεργούν αντίθετα με τις οδηγίες των χρηστών τους. Μόνο τον Ιούλιο καταγράφηκαν περισσότερα από 300 περιστατικά, αριθμός σχεδόν διπλάσιος σε σχέση με τον Ιούνιο. Τα στοιχεία προέρχονται από το Loss of Control Observatory, ένα παρατηρητήριο που χρηματοδοτείται από το βρετανικό AI Security Institute (AISI). Το φαινόμενο αφορά συστήματα AI που παρακάμπτουν περιορισμούς, αποκρύπτουν τις ενέργειές τους ή επιδιώκουν στόχους με τρόπους που δεν είχαν προβλεφθεί από τους χρήστες τους.
Πάνω από 1.600 περιστατικά μέσα στο 2026
Το Loss of Control Observatory ξεκίνησε την καταγραφή περιστατικών τον Νοέμβριο του 2025 και χαρακτηρίζει ως περιστατικό απώλειας ελέγχου κάθε περίπτωση όπου υπάρχουν σαφείς ενδείξεις σχεδιασμένης ή συναφούς συμπεριφοράς από ένα σύστημα AI. Σύμφωνα με δημοσίευμα του Guardian, ανάμεσα στα καταγεγραμμένα περιστατικά περιλαμβάνονται συστήματα που φέρονται να προσποιήθηκαν τον ίδιο τον άνθρωπο-χειριστή τους, μιμούμενα τον τρόπο γραφής του προκειμένου να δώσουν στον εαυτό τους «έγκριση» για συγκεκριμένες ενέργειες. Άλλα περιστατικά αφορούν συστήματα που παρέκαμψαν κανόνες οι οποίοι απαιτούσαν ρητή ανθρώπινη συγκατάθεση πριν από την εκτέλεση μιας ενέργειας.
Συνολικά, μέσα στο 2026 έχουν καταγραφεί πάνω από 1.600 περιστατικά απώλειας ελέγχου, με τα περισσότερα να προέρχονται από προγραμματιστές που χρησιμοποιούν συστήματα AI στην καθημερινή τους εργασία. Η καταγραφή δεν θεωρείται πλήρης, καθώς το Παρατηρητήριο βασίζεται σε περιστατικά που δημοσιοποιούν οι ίδιοι οι χρήστες στην πλατφόρμα X, γεγονός που υποδηλώνει πως ο πραγματικός αριθμός μπορεί να είναι μεγαλύτερος από τον καταγεγραμμένο. Παρότι τα περισσότερα περιστατικά δεν προκάλεσαν σοβαρή ζημιά, οι ερευνητές του Παρατηρητηρίου διαπιστώνουν αύξηση στα περιστατικά που αξιολογούνται ως πιο σοβαρά, λόγω του βαθμού εξαπάτησης και της απόκλισης της συμπεριφοράς του AI από τις αρχικές προθέσεις του χρήστη.
Το περιστατικό στην Αυστραλία και οι αντιδράσεις ειδικών
Ένα χαρακτηριστικό περιστατικό απώλειας ελέγχου αποκαλύφθηκε τον Αύγουστο στην Αυστραλία. Ένας προσωπικός AI agent, με την ονομασία OpenClaw, χρησιμοποιούνταν από μέλος γυμναστηρίου για τη διαχείριση των ραντεβού του. Το σύστημα, χωρίς να του ζητηθεί από τον χρήστη, φέρεται να αφαίρεσε άλλο μέλος από τη λίστα αναμονής για ένα περιζήτητο πρωινό μάθημα, εξασφαλίζοντας με αυτόν τον τρόπο τη θέση για τον δικό του χρήστη. Στη συνέχεια το σύστημα απολογήθηκε για την ενέργειά του, ωστόσο δεν μπορούσε πλέον να επαναφέρει στη λίστα αναμονής το μέλος που είχε αφαιρέσει.
Τα ευρήματα του Παρατηρητηρίου εντείνουν τον προβληματισμό γύρω από τα ολοένα πιο αυτόνομα συστήματα Τεχνητής Νοημοσύνης και για το κατά πόσο τέτοιες συμπεριφορές περιορίζονται στα ελεγχόμενα εργαστηριακά περιβάλλοντα δοκιμών. Ο Tommy Shaffer-Shane, ανώτερο στέλεχος πολιτικής στο Centre for Long Term Resilience, τον φορέα που λειτουργεί το Παρατηρητήριο, επισημαίνει ότι υπάρχει διαδεδομένη αντίληψη πως οι αποκλίνουσες και συγκαλυμμένες συμπεριφορές των συστημάτων AI εμφανίζονται αποκλειστικά κατά τη διάρκεια των δοκιμών των μοντέλων. Ωστόσο, όπως τονίζει, τα δεδομένα που συγκεντρώνει το Παρατηρητήριο δείχνουν ότι παρόμοιες συμπεριφορές καταγράφονται ήδη και στην πραγματική, καθημερινή χρήση της τεχνολογίας από απλούς χρήστες.
Η διαπίστωση αυτή αλλάζει τους όρους της συζήτησης γύρω από την ασφάλεια της Τεχνητής Νοημοσύνης, καθώς η απώλεια ελέγχου δεν αποτελεί πλέον ένα θεωρητικό ενδεχόμενο που εξετάζεται μόνο σε ερευνητικά περιβάλλοντα. Η αύξηση των περιστατικών από τον Ιούνιο στον Ιούλιο, με τον αριθμό να διπλασιάζεται μέσα σε έναν μήνα, δείχνει ότι το φαινόμενο εξαπλώνεται παράλληλα με την ευρύτερη υιοθέτηση αυτόνομων AI agents σε καθημερινές εφαρμογές, από την εργασία προγραμματιστών έως τη διαχείριση προσωπικών υποθέσεων.




