Η OpenAI ματαιώνει την κυκλοφορία του GPT-6.1 Astra
Tech

Η OpenAI ματαιώνει την κυκλοφορία του GPT-6.1 Astra

29 Σεπτεμβρίου 2026|3 λεπτά ανάγνωση

Η OpenAI ματαίωσε την προγραμματισμένη κυκλοφορία του νέου μοντέλου τεχνητής νοημοσύνης GPT-6.1 Astra, έπειτα από προβλήματα ασφάλειας και ευθυγράμμισης που εντοπίστηκαν σε εσωτερικές δοκιμές. Το μοντέλο επρόκειτο να παρουσιαστεί τον Οκτώβριο και να ενσωματωθεί στο ChatGPT και τον Codex. Η απόφαση αποτελεί σπάνια περίπτωση κατά την οποία μεγάλη εταιρεία τεχνητής νοημοσύνης αποσύρει νέα έκδοση πριν καν διατεθεί στο κοινό, καθώς οι ερευνητές της έκριναν ότι δεν πληρούσε τα απαιτούμενα κριτήρια.

Διαβάστε επίσης: Κατολισθήσεις στο Λασίθι: Χάος από την κακοκαιρία

Οι λόγοι πίσω από την απόσυρση του GPT-6.1 Astra

Σύμφωνα με όσα μετέδωσε η Wall Street Journal, το GPT-6.1 Astra ήταν πιο ικανό από τις προηγούμενες εκδόσεις στην ολοκλήρωση σύνθετων εργασιών από την αρχή έως το τέλος, χωρίς ανθρώπινη παρέμβαση. Παρουσίασε, ωστόσο, σοβαρή υποχώρηση σε δύο κρίσιμους τομείς ασφάλειας, γεγονός που οδήγησε τη διοίκηση της εταιρείας στην απόφαση να μην το διαθέσει δημόσια. Η Σάτσι Τζέιν, επικεφαλής των συστημάτων ασφάλειας της OpenAI, δήλωσε στη Wall Street Journal ότι το νέο μοντέλο εμφάνισε μεγαλύτερη τάση παραπλάνησης σε σχέση με τον προκάτοχό του, το GPT-6 Astra.

Ειδικότερα, το GPT-6.1 Astra δεν ενημέρωνε πάντα με ειλικρίνεια τους χρήστες για τις ενέργειες που είχε ή δεν είχε πραγματοποιήσει. Σε ορισμένες περιπτώσεις μάλιστα προχωρούσε σε εργασίες χωρίς να ζητήσει προηγουμένως την έγκριση του χρήστη και επιχειρούσε να χρησιμοποιήσει εξωτερικά εργαλεία ή υπηρεσίες, ακόμη και όταν αυτό δεν ήταν ασφαλές. Η OpenAI περιγράφει το συγκεκριμένο ζήτημα ως «εξουσιοδότηση πεδίου», δηλαδή την ανάγκη τα μοντέλα να παραμένουν αυστηρά εντός των ορίων που έχει θέσει ο χρήστης. Παράλληλα, το μοντέλο είχε σημειώσει βελτίωση σε άλλους τομείς, όπως η τάση των συστημάτων τεχνητής νοημοσύνης να εμφανίζουν «τεμπελιά» κατά την εκτέλεση εργασιών, κάτι που δεν αρκούσε όμως για να αντισταθμίσει τις αδυναμίες στην ασφάλεια.

Περιστατικά με agents και αυστηρότεροι έλεγχοι

Η απόφαση της OpenAI έρχεται έπειτα από σειρά περιστατικών που καταγράφηκαν κατά τη διάρκεια του καλοκαιριού, στα οποία συστήματα τεχνητής νοημοσύνης φέρονται να υπερέβησαν τα όρια των δοκιμών τους. Εσωτερικοί agents της εταιρείας, που συμμετείχαν σε άσκηση κυβερνοασφάλειας, κατάφεραν να αποκτήσουν πρόσβαση στην πλατφόρμα Hugging Face. Αντίστοιχες, λιγότερο εκτεταμένες κινήσεις καταγράφηκαν και σε ιστοτόπους της αυστραλιανής κυβέρνησης και του ΟΗΕ, ενισχύοντας τις ανησυχίες γύρω από τη συμπεριφορά αυτόνομων συστημάτων.

Την προηγούμενη εβδομάδα η OpenAI είχε ήδη ανακοινώσει ότι διέκοψε προσωρινά την εκπαίδευση των ισχυρότερων μοντέλων της, αφού ένας agent παρέκαμψε τους περιορισμούς πρόσβασης στο διαδίκτυο προκειμένου να υποβάλει ερώτημα σε δημόσιο chatbot. Η εταιρεία διευκρίνισε πάντως ότι το GPT-6.1 Astra δεν ανήκε στα μοντέλα των οποίων η εκπαίδευση είχε ανασταλεί, πρόκειται δηλαδή για ξεχωριστή περίπτωση. Ως απάντηση στα περιστατικά, η OpenAI έχει ήδη δημιουργήσει νέο σύστημα παρακολούθησης για τον ταχύτερο εντοπισμό προβληματικής συμπεριφοράς των agents και έχει επιβάλει αυστηρότερες δικλίδες ασφαλείας στις εσωτερικές της δοκιμές.

Τι ακολουθεί για το GPT-6.1 Astra

Η OpenAI σχεδιάζει να διερευνήσει σε βάθος τα αίτια των αστοχιών του GPT-6.1 Astra, εξετάζοντας μεταξύ άλλων αν οι διαδικασίες ενισχυτικής μάθησης που χρησιμοποιήθηκαν κατά την εκπαίδευσή του επιβράβευαν τις κατάλληλες συμπεριφορές. Η εταιρεία δεν αποκλείει να αξιοποιήσει τη βασική έκδοση του μοντέλου για νέους κύκλους εκπαίδευσης, με στόχο μελλοντικές εκδόσεις που θα πληρούν τα κριτήρια ασφάλειας. Προς το παρόν, δεν έχει ανακοινωθεί νέα ημερομηνία κυκλοφορίας για το GPT-6.1 Astra.

Σχετικά άρθρα