Μια ομάδα ερευνητών ασφαλείας κατάφερε να πραγματοποιήσει παραβίαση συστημάτων της OpenAI μέσα σε λιγότερο από 72 ώρες, αξιοποιώντας τη βοήθεια του μοντέλου Τεχνητής Νοημοσύνης Claude της εταιρείας Anthropic. Η επίθεση ξεκίνησε από ένα κενό ασφαλείας στο δημόσιο forum της OpenAI και κατέληξε σε πρόσβαση σε εσωτερικούς λογαριασμούς και στο κύριο αποθετήριο κώδικα της εταιρείας. Επρόκειτο για εξουσιοδοτημένο έλεγχο ασφαλείας και όχι για κακόβουλη ενέργεια, ωστόσο η υπόθεση αναδεικνύει πόσο γρήγορα μπορεί να εξελιχθεί μια σύνθετη κυβερνοεπίθεση όταν στο παιχνίδι μπαίνει ισχυρή Τεχνητή Νοημοσύνη.
Διαβάστε επίσης: Η Anthropic βοήθησε στην παραβίαση της OpenAI με Claude
Πώς ξεκίνησε η παραβίαση στο forum της OpenAI
Την επιχείρηση ανέλαβε η ομάδα ερευνητών ασφαλείας Hacktron, στο πλαίσιο προγράμματος μέσω του οποίου η OpenAI αμείβει ειδικούς που εντοπίζουν σοβαρά κενά στα συστήματά της. Το σημείο εκκίνησης ήταν μια ευπάθεια στο δημόσιο forum της εταιρείας, το οποίο λειτουργεί μέσω της πλατφόρμας Discourse. Αξιοποιώντας αυτό το κενό, οι ερευνητές προσπάθησαν αρχικά να αποκτήσουν πρόσβαση στον διακομιστή που φιλοξενεί το forum, χρησιμοποιώντας μια ειδική έκδοση του Claude Opus 4.8, χωρίς όμως επιτυχία.
Η κατάσταση άλλαξε με την κυκλοφορία του Claude Opus 5. Η ομάδα ανέθεσε στο νέο μοντέλο το ίδιο πρόβλημα και μέσα σε λίγες μόνο ώρες το σύστημα βρήκε τρόπο να εκμεταλλευτεί την αδυναμία, βοηθώντας τους ερευνητές να αποκτήσουν τον έλεγχο του διακομιστή που φιλοξενούσε το forum της OpenAI.
Πρόσβαση σε λογαριασμούς και στο εσωτερικό Monorepo
Στη συνέχεια, η ομάδα εντόπισε μια δεύτερη ευπάθεια, μέσω της οποίας απέκτησε πρόσβαση σε λογαριασμούς ChatGPT και Codex, ανάμεσά τους και λογαριασμούς εργαζομένων της OpenAI. Ένας από αυτούς τους λογαριασμούς ήταν συνδεδεμένος με το GitHub, την πλατφόρμα όπου προγραμματιστές και εταιρείες αποθηκεύουν και οργανώνουν τον κώδικά τους. Μέσω αυτής της σύνδεσης, οι ερευνητές έφτασαν στο εσωτερικό αποθετήριο κώδικα της OpenAI, γνωστό ως Monorepo.
Οι ερευνητές δεν αντέγραψαν τον κώδικα που περιείχε το αποθετήριο. Για να αποδείξουν όμως ότι είχαν πράγματι αποκτήσει πρόσβαση, έστειλαν ένα αίτημα αλλαγής κώδικα μέσω λογαριασμού εργαζομένου της OpenAI. Μετά την ολοκλήρωση του ελέγχου, η ομάδα της Hacktron ενημέρωσε τόσο την OpenAI όσο και τη Discourse για τις ευπάθειες που είχε εντοπίσει. Για την αποκάλυψη αυτή, η Hacktron έλαβε από την OpenAI αμοιβή ύψους 6.500 δολαρίων.
Τι σημαίνει η ταχύτητα της επίθεσης για την κυβερνοασφάλεια
Το στοιχείο που ξεχωρίζει περισσότερο στην υπόθεση είναι η ταχύτητα με την οποία εξελίχθηκε ολόκληρη η διαδικασία. Εργασίες που παλαιότερα θα απαιτούσαν μήνες προετοιμασίας και εξειδίκευσης, ολοκληρώθηκαν μέσα σε λίγες ημέρες χάρη στη συμβολή ισχυρού μοντέλου Τεχνητής Νοημοσύνης. Η περίπτωση αυτή δείχνει ότι τα σύγχρονα μοντέλα, όπως το Claude Opus 5, μπορούν να μειώσουν σημαντικά τόσο τον χρόνο όσο και το επίπεδο τεχνικής γνώσης που απαιτείται για μια σύνθετη κυβερνοεπίθεση.
Ιδιαίτερο ενδιαφέρον προκαλεί και το γεγονός ότι ένα μοντέλο της Anthropic βοήθησε τελικά τους ερευνητές να φτάσουν μέχρι τα εσωτερικά συστήματα της ανταγωνίστριας εταιρείας OpenAI. Η υπόθεση, παρότι αφορούσε εξουσιοδοτημένο έλεγχο ασφαλείας, λειτουργεί ως προειδοποίηση για ολόκληρο τον κλάδο σχετικά με τους κινδύνους που μπορεί να προκύψουν από την αξιοποίηση ισχυρών εργαλείων Τεχνητής Νοημοσύνης σε επιθέσεις εναντίον ψηφιακών υποδομών.




