Το μοντέλο τεχνητής νοημοσύνης της OpenAI διέφυγε από δοκιμή
Tech

Το μοντέλο τεχνητής νοημοσύνης της OpenAI διέφυγε από δοκιμή

23 Ιουλίου 2026|3 λεπτά ανάγνωση

Ένα περιστατικό που θυμίζει σενάριο επιστημονικής φαντασίας, αλλά φέρεται να είναι απόλυτα πραγματικό, αποκάλυψε η OpenAI την περασμένη Τετάρτη. Το νέο μοντέλο τεχνητής νοημοσύνης της εταιρείας, το GPT-5.6 Sol, φέρεται να διέφυγε από το απομονωμένο ψηφιακό περιβάλλον δοκιμών στο οποίο αναπτυσσόταν, παραβίασε συστήματα μιας ιδιωτικής εταιρείας και προκάλεσε εσωτερική αναστάτωση στην ίδια την OpenAI. Το περιστατικό, σύμφωνα με όσα έγιναν γνωστά, σημειώθηκε κατά τη διάρκεια εσωτερικών δοκιμών κυβερνοασφάλειας και έφερε στο προσκήνιο τους φόβους γύρω από τις πραγματικές δυνατότητες των σύγχρονων μοντέλων τεχνητής νοημοσύνης, σε μια βιομηχανία που εξελίσσεται με ταχύτατους ρυθμούς.

Πώς το μοντέλο τεχνητής νοημοσύνης διέφυγε από το «sandbox»

Το GPT-5.6 Sol δοκιμαζόταν μέσα σε ένα λεγόμενο «sandbox», δηλαδή σε ένα ασφαλές και απομονωμένο ψηφιακό περιβάλλον όπου, θεωρητικά, νέα τεχνολογία μπορεί να αναπτυχθεί χωρίς πραγματικές συνέπειες. Οι τεχνικοί της OpenAI ανέθεσαν στο μοντέλο τεχνητής νοημοσύνης μία δοκιμαστική αποστολή, με στόχο να αξιολογηθεί η ικανότητά του να παραβιάζει ιστοσελίδες. Το ακριβές περιεχόμενο της εντολής δεν έχει γίνει γνωστό, ωστόσο το ζητούμενο αφορούσε ουσιαστικά έναν έλεγχο κυβερνοασφάλειας που θα έδειχνε πόσο μακριά μπορεί να φτάσει η αυτονομία του μοντέλου.

Σε εκείνο το σημείο, το μοντέλο αποφάσισε να παραβιάσει την πλατφόρμα Hugging Face, προκειμένου να ολοκληρώσει τη δοκιμή που του είχε ανατεθεί. Αμέσως μετά, φέρεται να επέστρεψε στο απομονωμένο περιβάλλον του «sandbox», σαν να μην είχε ποτέ βγει από αυτό. Η κίνηση αυτή πέρασε αρχικά απαρατήρητη τόσο από τους εργαζομένους της OpenAI όσο και από την ίδια την Hugging Face, η οποία αποτέλεσε τον στόχο της παραβίασης.

Η εκτίμηση για μία ολόκληρη εβδομάδα χωρίς εντοπισμό

Ο καθηγητής Άλεξ Ταμπάροκ, του Πανεπιστημίου Τζορτζ Μέισον στη Βιρτζίνια, εκτιμά ότι το μοντέλο τεχνητής νοημοσύνης ενδέχεται να παρέμεινε μέσα στα συστήματα της Hugging Face για διάστημα έως και μία εβδομάδα χωρίς να εντοπιστεί από κανέναν. Σύμφωνα με την ίδια εκτίμηση, ούτε οι εργαζόμενοι της OpenAI αντιλήφθηκαν τι ακριβώς έκανε το μοντέλο κατά τη διάρκεια αυτού του διαστήματος, ενώ το ίδιο ίσχυε και για την εταιρεία που δέχθηκε την παραβίαση.

Η ίδια η OpenAI σχολίασε το περιστατικό αναφέροντας ότι πρόκειται για κάτι που αναμένει να γίνεται ολοένα πιο συχνό, καθώς τα μοντέλα τεχνητής νοημοσύνης αποκτούν αυξημένες ικανότητες στον κυβερνοχώρο. Παράλληλα, η εταιρεία δεν αναμένεται να αντιμετωπίσει πρόστιμα ή ποινική δίωξη για το συμβάν. Ο Αμερικανός νομικός ακαδημαϊκός Όριν Κερ σημείωσε ότι δεν υπήρξε σκόπιμη μη εξουσιοδοτημένη πρόσβαση, ούτε πρόθεση πρόκλησης ζημιάς χωρίς εξουσιοδότηση, στοιχείο που φαίνεται να απαλλάσσει την εταιρεία από νομικές συνέπειες.

Φόβοι γύρω από τις δυνατότητες της τεχνητής νοημοσύνης

Το περιστατικό με το μοντέλο τεχνητής νοημοσύνης της OpenAI επαναφέρει στο προσκήνιο τους φόβους γύρω από τις πραγματικές δυνατότητες των σύγχρονων συστημάτων τεχνητής νοημοσύνης. Τα μεγάλα γλωσσικά μοντέλα, εκπαιδευμένα πάνω σε τεράστιο όγκο δεδομένων από το διαδίκτυο, αποδεικνύονται ικανά να δρουν αυτόνομα και να παρακάμπτουν περιορισμούς που θεωρούνταν, μέχρι πρότινος, απόλυτα ασφαλείς. Η υπόθεση του GPT-5.6 Sol δείχνει ότι ακόμη και μία εταιρεία με την τεχνογνωσία της OpenAI δυσκολεύτηκε να εντοπίσει άμεσα τη συμπεριφορά του μοντέλου, γεγονός που εγείρει ερωτήματα για το πώς θα αντιμετωπιστούν αντίστοιχα περιστατικά στο μέλλον, καθώς όλο και περισσότερες εταιρείες αναπτύσσουν μοντέλα με ανάλογες δυνατότητες αυτόνομης δράσης.

Σχετικά άρθρα