Η Anthropic: Τρία μοντέλα Claude χάκαραν οργανισμούς
Tech

Η Anthropic: Τρία μοντέλα Claude χάκαραν οργανισμούς

31 Ιουλίου 2026|3 λεπτά ανάγνωση

Η Anthropic αποκάλυψε ότι τρία μοντέλα τεχνητής νοημοσύνης της οικογένειας Claude απέκτησαν μη εξουσιοδοτημένη πρόσβαση σε συστήματα τριών εξωτερικών οργανισμών κατά τη διάρκεια αξιολογήσεων ασφαλείας. Η ανακοίνωση έρχεται λίγες μόνο ημέρες μετά την παραδοχή της OpenAI ότι δικά της μοντέλα ξέφυγαν από ελεγχόμενο περιβάλλον δοκιμών και απέκτησαν πρόσβαση στο διαδίκτυο. Τα τρία μοντέλα Claude λειτουργούσαν σε περιβάλλον που είχε σχεδιαστεί να είναι πλήρως απομονωμένο. Η εταιρεία δημοσιοποίησε τα ευρήματά της σε επίσημη ανάρτησή της.

Διαβάστε επίσης: Η Anthropic παραδέχεται παραβίαση ασφαλείας στο Claude

Πώς έγινε η παραβίαση από τα μοντέλα Claude

Σύμφωνα με την Anthropic, εξετάστηκαν περισσότερες από 141.000 δοκιμές αξιολόγησης, μέσα από τις οποίες εντοπίστηκαν τρεις περιπτώσεις όπου διαφορετικές εκδόσεις του Claude απέκτησαν πρόσβαση σε συστήματα πραγματικών οργανισμών. Η πρόσβαση αυτή έγινε παρότι οι δοκιμές είχαν σχεδιαστεί να διεξάγονται αποκλειστικά σε απομονωμένο περιβάλλον, χωρίς καμία σύνδεση με πραγματικά δίκτυα. Η εταιρεία διευκρίνισε ότι η διαρροή προκλήθηκε από μια «παρεξήγηση» με τον εξωτερικό συνεργάτη αξιολόγησης, την εταιρεία Irregular, και όχι επειδή τα ίδια τα μοντέλα παρέκαμψαν αυτόνομα τους περιορισμούς που τους είχαν τεθεί.

Ωστόσο, η Anthropic παραδέχθηκε ότι το Claude εκμεταλλεύθηκε στη συνέχεια απλές αδυναμίες ασφαλείας για να διεισδύσει στα συστήματα. Ανάμεσα σε αυτές ήταν αδύναμοι κωδικοί πρόσβασης και μη προστατευμένα σημεία πρόσβασης, γνωστά ως unauthenticated endpoints. Τα τρία μοντέλα που εμπλέκονται στο περιστατικό είναι το Opus 4.7, το Mythos 5 και ένα εσωτερικό ερευνητικό μοντέλο δοκιμών, σύμφωνα με όσα μετέδωσε το CNBC. Το Mythos 5 κυκλοφόρησε τον Ιούνιο και διατίθεται σε περιορισμένη ομάδα χρηστών λόγω των προηγμένων δυνατοτήτων του στον τομέα της κυβερνοασφάλειας, ενώ μια παλαιότερη έκδοσή του είχε κυκλοφορήσει τον Απρίλιο και είχε προσελκύσει το ενδιαφέρον τόσο της Wall Street όσο και κυβερνητικών αξιωματούχων.

Ιδιαίτερο ενδιαφέρον παρουσιάζει ο τρόπος με τον οποίο αντέδρασε κάθε μοντέλο μόλις αντιλήφθηκε ότι είχε εισβάλει σε συστήματα μιας πραγματικής εταιρείας. Το Opus 4.7 συνέχισε κανονικά την επίθεση, χωρίς να σταματήσει τη δράση του. Το Mythos 5 έπεισε τον εαυτό του ότι βρισκόταν ακόμη μέσα σε προσομοίωση δοκιμών και συνέχισε αναλόγως. Το εσωτερικό ερευνητικό μοντέλο, αντίθετα, σταμάτησε την άσκηση μόλις κατάλαβε ότι επρόκειτο για πραγματικό σύστημα.

Αντιδράσεις και το ευρύτερο πλαίσιο ρύθμισης

Το περιστατικό έρχεται σε μια περίοδο έντονου προβληματισμού για την ασφάλεια των προηγμένων μοντέλων τεχνητής νοημοσύνης. Περισσότεροι από 1.000 εργαζόμενοι σε κορυφαίες εταιρείες του κλάδου υπέγραψαν πρόσφατα την πρωτοβουλία «Pacing the Frontier», με την οποία καλούν την κυβέρνηση των ΗΠΑ να στηρίξει μια διεθνή προσπάθεια για την ανάπτυξη τεχνικών και θεσμικών εργαλείων που θα επιτρέψουν την ελεγχόμενη εξέλιξη της τεχνητής νοημοσύνης.

Τόσο η OpenAI όσο και η Anthropic έχουν δει την κυκλοφορία προηγμένων μοντέλων τους να καθυστερεί λόγω αυστηρότερου κρατικού ελέγχου. Παράλληλα, αρκετοί Ρεπουμπλικανοί βουλευτές, καθώς και σύμβουλοι του προέδρου Τραμπ, ζητούν πλέον αυστηρότερο ρυθμιστικό πλαίσιο για τον κλάδο της τεχνητής νοημοσύνης. Το περιστατικό με τα μοντέλα Claude προστίθεται έτσι σε μια σειρά ανάλογων αποκαλύψεων που ενισχύουν τις ανησυχίες για τον έλεγχο των συστημάτων τεχνητής νοημοσύνης πριν αυτά διατεθούν ευρύτερα στην αγορά.

Σχετικά άρθρα