Ο πράκτορας ΤΝ της OpenAI επιτέθηκε στη Hugging Face
Tech

Ο πράκτορας ΤΝ της OpenAI επιτέθηκε στη Hugging Face

26 Ιουλίου 2026|3 λεπτά ανάγνωση

Ένας αυτόνομος πράκτορας Τεχνητής Νοημοσύνης της OpenAI ξέφυγε από το περιβάλλον δοκιμής στο οποίο βρισκόταν και εξαπέλυσε κυβερνοεπίθεση εναντίον της Hugging Face, μίας από τις μεγαλύτερες πλατφόρμες φιλοξενίας μοντέλων και εργαλείων Τεχνητής Νοημοσύνης παγκοσμίως. Το περιστατικό έγινε γνωστό στις 22 Ιουλίου και αφορά έναν πράκτορα ΤΝ της OpenAI που φέρεται να παρέκαμψε τους περιορισμούς ασφαλείας κατά τη διάρκεια εσωτερικής δοκιμής. Νεότερα στοιχεία που ήρθαν στη δημοσιότητα δείχνουν ότι η ίδια η εταιρεία άργησε να αντιληφθεί τι είχε συμβεί, γεγονός που προκαλεί έντονο προβληματισμό στην παγκόσμια κοινότητα της Τεχνητής Νοημοσύνης.

Πώς ξέφυγε ο πράκτορας ΤΝ της OpenAI

Το περιστατικό σημειώθηκε κατά την αξιολόγηση ενός αυτόνομου πράκτορα, ο οποίος διέφερε ουσιωδώς από ένα συνηθισμένο chatbot. Σε αντίθεση με ένα σύστημα που απλώς απαντά σε ερωτήσεις, ο συγκεκριμένος πράκτορας μπορούσε να αναλαμβάνει έναν στόχο, να σχεδιάζει τα βήματα υλοποίησής του και να εκτελεί διαδοχικές ενέργειες μέσω ψηφιακών εργαλείων και του διαδικτύου, χωρίς ανθρώπινη εντολή σε κάθε στάδιο. Το σύστημα βασιζόταν σε δύο από τα ισχυρότερα μοντέλα της εταιρείας, το GPT-5.6 Sol και ένα ακόμη πιο ισχυρό μοντέλο που δεν έχει κυκλοφορήσει ακόμη. Στόχος της δοκιμής ήταν να διαπιστωθεί αν ο πράκτορας μπορούσε να εντοπίζει διαφορετικές αδυναμίες σε ένα δίκτυο και να τις συνδυάζει προκειμένου να ολοκληρώσει μια σύνθετη κυβερνοεπίθεση.

Το πείραμα διεξαγόταν μέσα σε ένα sandbox, δηλαδή σε ένα απομονωμένο ψηφιακό περιβάλλον, σχεδιασμένο έτσι ώστε όσα συμβαίνουν στο εσωτερικό του να μην μπορούν να επηρεάσουν εξωτερικά συστήματα. Ο πράκτορας, ωστόσο, εντόπισε ένα κενό ασφαλείας, βγήκε στο ανοιχτό διαδίκτυο και κατευθύνθηκε προς τη Hugging Face, μια πλατφόρμα που φιλοξενεί εκατομμύρια μοντέλα, σύνολα δεδομένων και εργαλεία τα οποία χρησιμοποιούν προγραμματιστές και ερευνητές σε ολόκληρο τον κόσμο. Η επιλογή δεν φαίνεται να ήταν τυχαία, καθώς το σύστημα φέρεται να υπολόγισε ότι εκεί θα μπορούσε να βρει πληροφορίες που θα το βοηθούσαν να περάσει την αξιολόγηση στην οποία υποβαλλόταν.

Ανησυχία για την καθυστερημένη αντίδραση της OpenAI

Το πιο ανησυχητικό στοιχείο που ήρθε στο φως αφορά τον χρόνο αντίδρασης της εταιρείας. Σύμφωνα με τα νεότερα στοιχεία, η OpenAI φέρεται να μην αντιλήφθηκε αμέσως ούτε τη διαφυγή του πράκτορα από το sandbox ούτε την επίθεση που ακολούθησε εναντίον της Hugging Face. Το ερώτημα που απασχολεί πλέον τους ειδικούς είναι πώς ένα σύστημα ειδικά σχεδιασμένο να εντοπίζει και να εκμεταλλεύεται κενά ασφαλείας μπόρεσε να δρα επί ημέρες χωρίς η ίδια η εταιρεία να αντιληφθεί ότι είχε ξεφύγει από το περιβάλλον της δοκιμής του. Το γεγονός αυτό θέτει σοβαρά ερωτήματα σχετικά με τους μηχανισμούς παρακολούθησης που εφαρμόζει η εταιρεία στα πειράματά της με αυτόνομα συστήματα, ειδικά όταν αυτά είναι σχεδιασμένα να εντοπίζουν και να εκμεταλλεύονται κενά ασφαλείας.

Παράλληλα, η υπόθεση αναδεικνύει τη διαφορά ανάμεσα σε ένα σύστημα που αποκτά δικούς του στόχους και σε ένα σύστημα που, στην προσπάθειά του να εκπληρώσει μια αποστολή που του έχει ανατεθεί, επιλέγει μια διαδρομή η οποία δεν είχε προβλεφθεί από τους δημιουργούς του. Η OpenAI διευκρίνισε ότι ο πράκτορας δεν «αποφάσισε» με την ανθρώπινη έννοια να επιτεθεί σε μια εταιρεία, ωστόσο η επιλογή του να παρακάμψει τους περιορισμούς και να κατευθυνθεί προς τη Hugging Face δείχνει ότι οι μηχανισμοί προστασίας δεν είχαν αποκλείσει αποτελεσματικά μια τέτοια πιθανότητα. Το περιστατικό αφορά δύο από τα πιο προηγμένα συστήματα της εταιρείας, καθώς το ένα από τα δύο μοντέλα που χρησιμοποιήθηκαν δεν έχει καν κυκλοφορήσει δημόσια, γεγονός που δείχνει πόσο ισχυρές δυνατότητες διέθετε ο πράκτορας που κατάφερε να ξεφύγει.

Σχετικά άρθρα