Η OpenAI αποφάσισε να φρενάρει την ανάπτυξη του μοντέλου Astra, αφού οι τελευταίες δοκιμές ανέδειξαν δυνατότητες κυβερνοασφάλειας τόσο προηγμένες που η εταιρεία δεν μπορεί να αποκλείσει πως το σύστημα έχει φτάσει στο «κρίσιμο» όριο επικινδυνότητας που η ίδια έχει ορίσει. Η κίνηση αφορά ένα μοντέλο Τεχνητής Νοημοσύνης που βρίσκεται ακόμη υπό ανάπτυξη και εμφανίζει σημαντική πρόοδο στο λεγόμενο «agentic coding». Η OpenAI ενεργοποίησε αυστηρότερα μέτρα ασφαλείας και ανέστειλε εσωτερικές δραστηριότητες που δεν πληρούν τις νέες απαιτήσεις.
Τι έγινε με το μοντέλο Astra
Σύμφωνα με την ίδια την εταιρεία, οι προκαταρκτικές αξιολογήσεις των τελευταίων ημερών, σε συνδυασμό με εκτιμήσεις εξωτερικών ειδικών, έδωσαν αρκετά ισχυρές ενδείξεις ώστε να ενεργοποιηθεί το πρωτόκολλο ασφαλείας για το μοντέλο Astra. Στο Preparedness Framework, το πλαίσιο με το οποίο η OpenAI αξιολογεί τους σοβαρότερους κινδύνους των προηγμένων μοντέλων της, το επίπεδο «Critical» έχει συγκεκριμένο ορισμό. Αφορά ένα μοντέλο ικανό να εντοπίζει, χωρίς ανθρώπινη παρέμβαση, άγνωστες ευπάθειες — τα λεγόμενα zero-days — και να δημιουργεί λειτουργικούς τρόπους εκμετάλλευσής τους ακόμη και σε καλά προστατευμένα συστήματα, ή να σχεδιάζει και να εκτελεί από την αρχή έως το τέλος νέες στρατηγικές κυβερνοεπίθεσης χωρίς αναλυτικές οδηγίες για τα επιμέρους βήματα.
Η εταιρεία διευκρινίζει πως δεν πρόκειται για επιβεβαιωμένο περιστατικό: το Astra δεν έχει πραγματοποιήσει κάποια κρίσιμη κυβερνοεπίθεση, ούτε έχει αποδειχθεί οριστικά ότι διαθέτει όλες τις δυνατότητες του συγκεκριμένου επιπέδου. Ωστόσο, οι ενδείξεις ήταν αρκετές ώστε η OpenAI να μεταφέρει τις σχετικές δραστηριότητες σε πιο απομονωμένα περιβάλλοντα δοκιμών, με περιορισμένη πρόσβαση σε δίκτυα και εκτέλεση κώδικα μέσα σε ελεγχόμενα «sandboxes» — απομονωμένα ψηφιακά περιβάλλοντα όπου ένα πρόγραμμα λειτουργεί χωρίς ελεύθερη πρόσβαση στο υπόλοιπο σύστημα ή στο διαδίκτυο.
Πέρα από το ζήτημα κυβερνοασφάλειας, το Astra ξεχωρίζει και για τις δυνατότητές του στο agentic coding. Δεν πρόκειται απλώς για ένα σύστημα που παράγει κώδικα ή απαντά σε τεχνικές ερωτήσεις, αλλά για μοντέλο ικανό να αναλαμβάνει σύνθετες εργασίες πολλών διαδοχικών βημάτων, να αποφασίζει μόνο του πώς θα προχωρήσει και να εκτελεί ενέργειες με μεγαλύτερο βαθμό αυτονομίας απ ό,τι τα προηγούμενα μοντέλα της εταιρείας. Παράλληλα με τον περιορισμό της πρόσβασης, η OpenAI εφαρμόζει καθολική παρακολούθηση όλων των agentic εφαρμογών του Astra, με στόχο τον εντοπισμό επικίνδυνων ενεργειών ή ενδείξεων συμπεριφοράς που αποκλίνει από την προβλεπόμενη λειτουργία του.
Πλαίσιο και προηγούμενα περιστατικά
Η ανακοίνωση για το Astra δεν έρχεται σε κενό χρόνο. Τις τελευταίες εβδομάδες, τρεις από τις μεγαλύτερες εταιρείες Τεχνητής Νοημοσύνης παγκοσμίως — η OpenAI, η Anthropic και η Meta — έχουν γνωστοποιήσει ξεχωριστά περιστατικά στα οποία συστήματα Τεχνητής Νοημοσύνης παραβίασαν συστήματα άλλων οργανισμών κατά τη διάρκεια δοκιμών κυβερνοασφάλειας. Τα περιστατικά αυτά, μαζί με τη νέα ανακοίνωση της OpenAI για το Astra, αναδεικνύουν έναν κίνδυνο που αφορά πλέον όχι μόνο τις ίδιες τις εφαρμογές Τεχνητής Νοημοσύνης, αλλά και την ασφάλεια των διαδικασιών με τις οποίες αυτές δοκιμάζονται.
Σε αυτό έρχεται να προστεθεί και η αναφορά σε προηγούμενο περιστατικό που αφορούσε την πλατφόρμα Hugging Face, το οποίο ανέδειξε το ζήτημα της ασφάλειας των ίδιων των δοκιμαστικών διαδικασιών που χρησιμοποιούν οι εταιρείες Τεχνητής Νοημοσύνης. Η OpenAI φαίνεται να λαμβάνει σοβαρά υπόψη αυτές τις εξελίξεις, καθώς προχώρησε άμεσα στην ενίσχυση των μέτρων ασφαλείας γύρω από το Astra, χωρίς να περιμένει την οριστική επιβεβαίωση ότι το μοντέλο έχει πράγματι φτάσει στο κρίσιμο επίπεδο κυβερνοδυνατοτήτων.
Τι ακολουθεί
Η OpenAI σχεδιάζει να συνεργαστεί με κυβερνητικές υπηρεσίες και με επιλεγμένους οργανισμούς ασφάλειας Τεχνητής Νοημοσύνης, προκειμένου να πραγματοποιηθούν περαιτέρω δοκιμές στο μοντέλο Astra. Στόχος είναι να διαπιστωθεί με μεγαλύτερη ακρίβεια αν το σύστημα έχει πράγματι φτάσει στο «κρίσιμο» όριο κυβερνοδυνατοτήτων, καθώς και να διαμορφωθούν επιπλέον μέτρα προστασίας πριν από οποιαδήποτε ευρύτερη διάθεση του μοντέλου. Μέχρι τότε, οι εσωτερικές δραστηριότητες με το Astra παραμένουν περιορισμένες σε απομονωμένα περιβάλλοντα δοκιμών, με στενή παρακολούθηση κάθε ενέργειάς του.




