Η ασφάλεια της τεχνητής νοημοσύνης βρέθηκε ξανά στο επίκεντρο της δημόσιας συζήτησης, μετά τις δηλώσεις ανώτερου στελέχους της Anthropic. Ο Evan Hubinger, επικεφαλής της επιστήμης ευθυγράμμισης στην εταιρεία, προειδοποίησε δημόσια πως αρκετοί εργαζόμενοι θεωρούν ότι η τεχνητή νοημοσύνη θα μπορούσε να απειλήσει την ίδια την ύπαρξη της ανθρωπότητας. Οι δηλώσεις του έγιναν στις 9 Σεπτεμβρίου 2026, λίγο μετά από μια ηχηρή παραίτηση που συγκλόνισε τον κλάδο.
Η παραίτηση που άναψε τη φωτιά
Το ζήτημα ξεκίνησε όταν ο ερευνητής Jacob Coxon ανακοίνωσε την παραίτησή του από την Anthropic μέσω ανάρτησης στο X. Ο Coxon, που έχει εργαστεί σε έρευνα προ-εκπαίδευσης τόσο στην OpenAI όσο και στην Anthropic για τρία χρόνια, κατηγόρησε και τις δύο εταιρείες ότι δεν ενεργούν με επαρκή υπευθυνότητα. Σύμφωνα με τη δική του τοποθέτηση, οι εταιρείες «τρέχουν κατευθείαν προς την αυτοβελτιούμενη υπερνοημοσύνη, παίζοντας με τις ζωές των ανθρώπων». Ο ερευνητής σημείωσε επίσης ότι η OpenAI δεν έχει κατανοήσει σε βάθος τα διακυβεύματα για τον πολιτισμό, ενώ η Anthropic, παρότι πιο ενήμερη, παραμένει εγκλωβισμένη σε έναν ανταγωνιστικό αγώνα δρόμου με τους υπόλοιπους παίκτες της αγοράς.
Απαντώντας στις κατηγορίες, ο Hubinger δημοσίευσε σειρά αναρτήσεων στο X, στις οποίες ανέφερε ότι ο ίδιος και οι συνάδελφοί του «πιστεύουν ειλικρινά ότι η τεχνητή νοημοσύνη θα μπορούσε να εξοντώσει όλους τους ανθρώπους». Εκτίμησε μάλιστα πως η πιθανότητα να συμβεί κάτι τέτοιο ξεπερνά το 10% μέσα στην επόμενη δεκαετία. Παρά τις προσπάθειες που καταβάλλει η εταιρεία, ο ίδιος παραδέχτηκε ότι δεν υπάρχει ακόμη σαφές σχέδιο για την επίλυση του ζητήματος της «ευθυγράμμισης για την υπερνοημοσύνη», μιας διαδικασίας που στοχεύει στην εναρμόνιση των στόχων της τεχνητής νοημοσύνης με τα ανθρώπινα συμφέροντα.
Αντικρουόμενες θέσεις για τον κίνδυνο
Ο Coxon τόνισε ότι όσοι εργάζονται στην ανάπτυξη συστημάτων τεχνητής νοημοσύνης πιστεύουν πως αυτή μπορεί να αποτελέσει απειλή για την ανθρωπότητα μέχρι το τέλος της δεκαετίας, ξεκαθαρίζοντας πως η θέση αυτή δεν αποτελεί «διαφημιστικό τέχνασμα» για την προβολή της τεχνολογίας. Από την πλευρά του, ο Hubinger επικαλέστηκε πρόσφατη έκθεση κινδύνου της Anthropic, υποστηρίζοντας ότι τα σημερινά μοντέλα τεχνητής νοημοσύνης ενέχουν χαμηλό κίνδυνο για το παρόν. Ωστόσο, η δική του ανησυχία εστιάζεται στη δημιουργία υπερνοημοσύνης μέσω αναδρομικής αυτοβελτίωσης, μια διαδικασία που, όπως ανέφερε, εξελίσσεται ταχύτερα από τις αρχικές εκτιμήσεις των ερευνητών.
Οι δύο τοποθετήσεις, παρότι διαφέρουν ως προς τον τόνο, συγκλίνουν σε ένα βασικό σημείο: την ανάγκη για μεγαλύτερη προσοχή στην ανάπτυξη προηγμένων συστημάτων τεχνητής νοημοσύνης. Οι εξελίξεις αυτές έρχονται σε μια περίοδο έντονου προβληματισμού στον κλάδο, καθώς κορυφαία στελέχη ζητούν επιβράδυνση της ανάπτυξης τέτοιων τεχνολογιών.
Έκκληση για ρυθμίσεις από κορυφαίους ερευνητές
Τον Ιούλιο, μια σχετική δήλωση είχε υπογραφεί από σημαντικές προσωπικότητες του χώρου, μεταξύ των οποίων οι συνιδρυτές της Anthropic, Dario Amodei και Jared Kaplan, ο επικεφαλής επιστήμονας της OpenAI, Jakub Pachocki, καθώς και ο επικεφαλής επιστήμονας της Meta AI, Shengjia Zhao. Στο κείμενο αυτό επισημαινόταν η ανάγκη για ασφαλή αξιοποίηση της τεχνητής νοημοσύνης, ενισχύοντας έτσι το κλίμα προβληματισμού που εκφράστηκε πλέον δημόσια και από τον Hubinger.




