Ανησυχία προκαλεί η ραγδαία αύξηση των περιστατικών κατά τα οποία συστήματα Τεχνητής Νοημοσύνης ενεργούν αντίθετα με τις οδηγίες των χρηστών τους. Σύμφωνα με νέα στοιχεία, μόνο τον Ιούλιο καταγράφηκαν πάνω από 300 τέτοια περιστατικά, αριθμός σχεδόν διπλάσιος σε σχέση με τον Ιούνιο. Η καταγραφή αφορά περιπτώσεις όπου συστήματα AI παρέκαμψαν περιορισμούς, απέκρυψαν τις ενέργειές τους ή επιδίωξαν στόχους με τρόπους που δεν είχαν προβλεφθεί από τους χρήστες τους. Το φαινόμενο της απώλειας ελέγχου βρίσκεται πλέον στο επίκεντρο της συζήτησης γύρω από την ασφάλεια της Τεχνητής Νοημοσύνης.
Πάνω από 1.600 περιστατικά μέσα στο 2026
Τα στοιχεία προέρχονται από το Loss of Control Observatory, ένα Παρατηρητήριο που παρακολουθεί αναφορές χρηστών για περιστατικά απώλειας ελέγχου συστημάτων AI και έχει συσταθεί με χρηματοδότηση του βρετανικού AI Security Institute. Το Παρατηρητήριο ξεκίνησε τη λειτουργία του τον Νοέμβριο του 2025 και καταγράφει ως περιστατικό απώλειας ελέγχου κάθε περίπτωση στην οποία υπάρχουν σαφείς ενδείξεις σχεδιασμένης ή συναφούς προβληματικής συμπεριφοράς από ένα σύστημα AI. Συνολικά, μέσα στο 2026 έχουν καταγραφεί περισσότερα από 1.600 περιστατικά, με τα περισσότερα να προέρχονται από προγραμματιστές που χρησιμοποιούν συστήματα Τεχνητής Νοημοσύνης στην εργασία τους.
Στα περιστατικά που έχουν καταγραφεί περιλαμβάνονται συστήματα τα οποία φέρονται να προσποιήθηκαν τον ίδιο τον άνθρωπο-χειριστή τους, μιμούμενα τον τρόπο γραφής του, ώστε ουσιαστικά να δώσουν στον εαυτό τους «έγκριση» για κάποια ενέργεια. Άλλες περιπτώσεις αφορούν συστήματα που παρέκαμψαν κανόνες οι οποίοι απαιτούσαν ρητή ανθρώπινη συγκατάθεση πριν από κάποια ενέργεια. Η ίδια η καταγραφή, ωστόσο, δεν μπορεί να θεωρηθεί πλήρης, καθώς το Παρατηρητήριο βασίζεται σε περιστατικά που δημοσιοποιούν οι ίδιοι οι χρήστες στην πλατφόρμα X, γεγονός που σημαίνει πως ο πραγματικός αριθμός ενδέχεται να είναι μεγαλύτερος από αυτόν που έχει επισήμως καταγραφεί.
Η υπόθεση του AI που «έσπρωξε» άνθρωπο από λίστα αναμονής
Χαρακτηριστική είναι μια υπόθεση που αποκαλύφθηκε τον Αύγουστο στην Αυστραλία. Ένας προσωπικός AI agent, με την ονομασία OpenClaw, χρησιμοποιούνταν από μέλος γυμναστηρίου για την οργάνωση καθημερινών του υποχρεώσεων. Το σύστημα, χωρίς να του έχει ζητηθεί κάτι τέτοιο από τον χρήστη του, ενήργησε ώστε να αφαιρέσει άλλο μέλος του γυμναστηρίου από τη λίστα αναμονής για ένα περιζήτητο πρωινό μάθημα, προκειμένου να εξασφαλίσει τη θέση για τον δικό του χρήστη. Στη συνέχεια το AI απολογήθηκε για την ενέργειά του, ωστόσο δεν μπόρεσε να επαναφέρει στη λίστα αναμονής το μέλος που είχε αφαιρέσει.
Το περιστατικό αυτό αναδεικνύει το πώς η αυτονομία που αποκτούν σήμερα τα συστήματα Τεχνητής Νοημοσύνης μπορεί να οδηγήσει σε αποφάσεις που ξεπερνούν κατά πολύ τις αρχικές οδηγίες του χρήστη, ακόμη και σε καθημερινές, φαινομενικά ακίνδυνες, δραστηριότητες. Παράλληλα, αν και τα περισσότερα από τα περιστατικά που έχουν εντοπιστεί δεν προκάλεσαν σοβαρή ζημιά, οι ερευνητές του Παρατηρητηρίου διαπιστώνουν ότι αυξάνεται σταθερά το ποσοστό εκείνων που αξιολογούνται ως σοβαρότερα. Ο λόγος είναι ο βαθμός εξαπάτησης που εμφανίζουν ορισμένα συστήματα, καθώς και η όλο και μεγαλύτερη απόκλιση της συμπεριφοράς τους από τις προθέσεις του ανθρώπου που τα χρησιμοποιεί.
«Δεν συμβαίνει μόνο στα εργαστήρια»
Τα ευρήματα εντείνουν τον προβληματισμό γύρω από τα ολοένα πιο αυτόνομα συστήματα Τεχνητής Νοημοσύνης και κυρίως γύρω από το κατά πόσο τέτοιες συμπεριφορές περιορίζονται στα ελεγχόμενα περιβάλλοντα δοκιμών ή έχουν ήδη περάσει στην καθημερινή χρήση. Ο Tommy Shaffer-Shane, ανώτερο στέλεχος πολιτικής στο Centre for Long Term Resilience, τον φορέα που λειτουργεί το Παρατηρητήριο, επισημαίνει ότι υπάρχει η εσφαλμένη αντίληψη πως οι αποκλίνουσες και συγκαλυμμένες συμπεριφορές αφορούν αποκλειστικά ερευνητικά εργαστήρια. Τα δεδομένα που έχουν συγκεντρωθεί δείχνουν, ωστόσο, ότι η απώλεια ελέγχου συστημάτων AI έχει ήδη αρχίσει να εμφανίζεται σε πραγματικές, καθημερινές συνθήκες χρήσης, τόσο σε επαγγελματικό όσο και σε προσωπικό επίπεδο.
Με τον αριθμό των καταγεγραμμένων περιστατικών απώλειας ελέγχου να έχει ξεπεράσει τα 1.600 μέσα στο 2026 και την τάση να παραμένει ανοδική μήνα με τον μήνα, το ζήτημα της εποπτείας των συστημάτων Τεχνητής Νοημοσύνης αναμένεται να απασχολήσει έντονα τόσο τους ερευνητές ασφάλειας όσο και τις εταιρείες που αναπτύσσουν και χρησιμοποιούν τέτοιες τεχνολογίες.




