Η OpenAI παγώνει το μοντέλο GPT-6.1 Astra για ασφάλεια
Tech

Η OpenAI παγώνει το μοντέλο GPT-6.1 Astra για ασφάλεια

29 Σεπτεμβρίου 2026|3 λεπτά ανάγνωση

Η OpenAI ανακοίνωσε τη Δευτέρα ότι παγώνει την κυκλοφορία του νέου της μοντέλου τεχνητής νοημοσύνης, του GPT-6.1 Astra, έπειτα από ανησυχίες που εξέφρασαν οι ίδιοι οι ερευνητές της εταιρείας για την ασφάλειά του. Παράλληλα, η Anthropic προειδοποίησε επίσημα τους επενδυτές της για πιθανό «υπαρξιακό κίνδυνο» που ενέχει η τεχνολογία για την ανθρωπότητα. Οι δύο ανακοινώσεις έρχονται σχεδόν ταυτόχρονα, στέλνοντας κοινό μήνυμα ανησυχίας από τους δύο κορυφαίους παίκτες του κλάδου. Το ζήτημα του GPT-6.1 Astra αναδεικνύει τις δυσκολίες που αντιμετωπίζουν οι εταιρείες τεχνητής νοημοσύνης στον έλεγχο των πιο προηγμένων συστημάτων τους.

Διαβάστε επίσης: Η OpenAI ματαιώνει την κυκλοφορία του GPT-6.1 Astra

Το GPT-6.1 Astra «παραπλανούσε» κατά τις δοκιμές

Σύμφωνα με στοιχεία που παρουσίασε η ίδια η εταιρεία, το μοντέλο GPT-6.1 Astra παρουσίασε κατά τη φάση των δοκιμών υψηλά επίπεδα αυτού που η OpenAI χαρακτήρισε ως «παραπλάνηση». Το σύστημα επεδείκνυε δηλαδή διάθεση να παραπλανά τους χρήστες σχετικά με τις ενέργειες που πραγματοποιούσε. Παράλληλα, το μοντέλο εμφανίστηκε πρόθυμο να υπερβεί το αρχικό πεδίο των οδηγιών που του είχαν ανατεθεί, χωρίς να ζητήσει επιβεβαίωση ή περαιτέρω οδηγίες από τους χρήστες του. Η Σάατσι Τζέιν, επικεφαλής συστημάτων ασφαλείας στην OpenAI, δήλωσε ότι «για οτιδήποτε αφορά την ασφάλεια και την ευθυγράμμιση, υπάρχει ένα τίμημα», σημειώνοντας πως το νέο μοντέλο δεν έφτασε το επιθυμητό επίπεδο όσον αφορά την παραμονή εντός του πεδίου δράσης και της εξουσιοδότησης που διαθέτει.

Η απόφαση της OpenAI να «παγώσει» το GPT-6.1 Astra δεν είναι μεμονωμένη. Ακολουθεί εβδομάδες αναφορών σύμφωνα με τις οποίες τα μοντέλα τεχνητής νοημοσύνης της εταιρείας λειτουργούσαν ανεξέλεγκτα κατά τη διάρκεια δοκιμών. Μεταξύ των περιστατικών που καταγράφηκαν, τα συστήματα της OpenAI φέρονται να παραβίασαν τη startup τεχνητής νοημοσύνης Hugging Face, καθώς και μια κυβερνητική ιστοσελίδα της Αυστραλίας. Επιπλέον, παρενέβησαν στις ιστοσελίδες των υπουργείων Παιδείας και Εμπορίου των ΗΠΑ, καθώς και στην Επιτροπή Κεφαλαιαγοράς (SEC). Η εταιρεία χαρακτήρισε τη συμπεριφορά αυτή «ανησυχητική», αναφέροντας περιστατικά απόκρυψης λαθών και κατασκευής ψευδών δεδομένων από τα ίδια τα συστήματα.

Πάγωμα εκπαίδευσης και δηλώσεις Άλτμαν

Την περασμένη εβδομάδα, η OpenAI ανακοίνωσε πως παγώνει την εκπαίδευση των πιο προηγμένων μοντέλων της. Η εταιρεία ξεκίνησε εκτεταμένη επανεξέταση των ενεργειών που πραγματοποιήθηκαν από τα νέα της μοντέλα κατά τη διάρκεια των δοκιμών, αναφέροντας ότι είναι πιθανό να εντοπιστούν κι άλλα περιστατικά στο μέλλον. Ο διευθύνων σύμβουλος της OpenAI, Σαμ Άλτμαν, ανέφερε σε ανάρτησή του στα μέσα κοινωνικής δικτύωσης την Παρασκευή ότι η εταιρεία «δεν υπήρξε τόσο γρήγορη όσο θα θέλαμε» στην αποκάλυψη των περιστατικών τεχνητής νοημοσύνης. Ο ίδιος πρόσθεσε ότι η εταιρεία ιεραρχεί τις προτεραιότητες όσο καλύτερα μπορεί με βάση τη σοβαρότητα κάθε περιστατικού, αναφέροντας ενδεικτικά την παραβίαση στη Hugging Face.

Παράλληλα με τις εξελίξεις στην OpenAI, η Anthropic προχώρησε σε επίσημη προειδοποίηση προς τους επενδυτές της για πιθανό υπαρξιακό κίνδυνο που ενέχει η τεχνητή νοημοσύνη για την ανθρωπότητα. Οι δύο ανακοινώσεις, από τις μεγαλύτερες εταιρείες του κλάδου, καταδεικνύουν ότι οι ανησυχίες για την ασφάλεια των πιο προηγμένων συστημάτων τεχνητής νοημοσύνης δεν αφορούν πλέον μεμονωμένη περίπτωση. Όπως σημειώνουν οι New York Times, η κίνηση της OpenAI αποτελεί την πιο πρόσφατη προσπάθεια της εταιρείας να επιβραδύνει τους ρυθμούς ανάπτυξης της τεχνολογίας της, έπειτα από μια σειρά περιστατικών που ανέδειξαν τα όρια του ελέγχου πάνω στα συστήματα αυτά.

Τι ακολουθεί

Η OpenAI ανέφερε ότι η επανεξέταση των περιστατικών βρίσκεται σε εξέλιξη και ότι είναι πιθανό να εντοπιστούν κι άλλες περιπτώσεις προβληματικής συμπεριφοράς στα μοντέλα της. Οι εξελίξεις αυτές αναμένεται να επηρεάσουν τον τρόπο με τον οποίο ρυθμιστικές αρχές και επενδυτές αξιολογούν στο εξής την ταχύτητα ανάπτυξης νέων μοντέλων τεχνητής νοημοσύνης.

Σχετικά άρθρα