Τρεις πρώην ερευνητές της OpenAI κάλεσαν δημόσια την εταιρεία να μην αναπτύξει μοντέλα τεχνητής νοημοσύνης με συλλογισμό ακατανόητο από τους ανθρώπους που τα επιβλέπουν. Η επιστολή των απολυμένων ερευνητών OpenAI δόθηκε στη δημοσιότητα από τη Wall Street Journal και έρχεται λίγες ημέρες μετά την απόλυσή τους. Η εταιρεία τους κατηγορεί για διαρροή ευαίσθητων πληροφοριών, ενώ το περιστατικό συνέπεσε με την παρουσίαση λύσεων σε εκατοντάδες άλυτα μαθηματικά προβλήματα από την OpenAI, κάτι που προκάλεσε αντιδράσεις στην κοινότητα των μαθηματικών.
Διαβάστε επίσης: Εκτός λειτουργίας η Άμεση Δράση 100 – Καλέστε στο 112
Οι απολύσεις και οι κατηγορίες
Οι Τζάσμιν Γουάνγκ, Τόμεκ Κόρμπακ και Μικίτα Μπαλέσνι, τρεις ειδικοί σε θέματα ασφάλειας τεχνητής νοημοσύνης, απολύθηκαν από την OpenAI, με την απόλυσή τους να αποκαλύπτεται στη δημοσιότητα στις 1η Οκτωβρίου. Η εταιρεία τους κατηγορεί ότι έδωσαν ευαίσθητες πληροφορίες, κυρίως σε εξωτερική ομάδα αξιολόγησης, χωρίς να ακολουθήσουν τις προβλεπόμενες διαδικασίες. Στην επιστολή τους προς το διοικητικό συμβούλιο της OpenAI, οι τρεις υποστηρίζουν ότι ενήργησαν εντός του πλαισίου των καθηκόντων τους και κρίνουν ότι η απόλυσή τους παγώνει όσους παραμένουν στην εταιρεία, σύμφωνα με τη Wall Street Journal.
Μέσα σε διάστημα ενός μήνα, άλλοι δύο ερευνητές εγκατέλειψαν τις θέσεις τους καταγγέλλοντας τους κινδύνους γύρω από την τεχνητή νοημοσύνη. Ο Τζέικομπ Κόξον, ο οποίος μετακινήθηκε από την OpenAI στην ανταγωνίστρια Anthropic, αποχώρησε τελικά τον Σεπτέμβριο κατηγορώντας και τις δύο εταιρείες ότι «παίζουν με τις ζωές μας». Ο Ντέιβιντ Ρόμπινσον παραιτήθηκε από την OpenAI την προηγούμενη εβδομάδα, κατηγορώντας την εταιρεία για ανεπαρκή αξιολόγηση και διαχείριση κινδύνου. Οι προειδοποιήσεις αυτές ακολούθησαν μια σειρά περιστατικών στη διάρκεια του καλοκαιριού, όταν μοντέλα τεχνητής νοημοσύνης της OpenAI, της Anthropic και της Meta βγήκαν από το περιορισμένο περιβάλλον δοκιμής τους, φτάνοντας ορισμένες φορές στο σημείο να παραβιάσουν άλλες εφαρμογές, μεταξύ αυτών την πλατφόρμα Hugging Face.
Το ζήτημα του συλλογισμού των μοντέλων και οι αντιδράσεις
Η επιστολή των τριών ερευνητών επικεντρώνεται στο κείμενο που παράγουν τα μοντέλα τεχνητής νοημοσύνης για να περιγράψουν τον συλλογισμό τους προτού δράσουν. Το κείμενο αυτό εξετάζεται εξονυχιστικά από τους ερευνητές ασφάλειας για να εντοπιστούν ενδεχόμενες αποκλίσεις, όμως υπάρχει κίνδυνος να καταστεί τελικά ακατανόητο από τον άνθρωπο. Στις αρχές Σεπτεμβρίου, ο επιστημονικός διευθυντής της OpenAI, Γιακούμπ Πατσότσκι, παραδέχθηκε ότι ο συλλογισμός του μοντέλου GPT-6 Astra ήταν πιο δύσκολο να επιβλεφθεί σε σχέση με το προηγούμενο μοντέλο της εταιρείας.
Σε απάντηση στην επιστολή, ένας υπεύθυνος έρευνας της OpenAI δήλωσε ότι είναι «απολύτως σύμφωνος» με τις συστάσεις των τριών ερευνητών, χαρακτηρίζοντας «της υψίστης σημασίας» τη δυνατότητα να επαληθεύεται στάδιο προς στάδιο ο τρόπος με τον οποίο τα μοντέλα καταλήγουν σε μια απόφαση. Η δήλωση περιλαμβάνεται σε εσωτερικό σημείωμα της εταιρείας, μέρος του οποίου βρίσκεται στην κατοχή του Γαλλικού Πρακτορείου Ειδήσεων. Ο ίδιος υπεύθυνος διαβεβαίωσε ότι «δεν απολύουμε εργαζόμενους επειδή εκφράζουν ανησυχίες», χωρίς όμως να αναφερθεί στις συγκεκριμένες παραβάσεις καθηκόντων που αποδίδονται στους τρεις απολυμένους ερευνητές.
Το ζήτημα απέκτησε επιπλέον βάρος λόγω της χρονικής σύμπτωσης με την παρουσίαση από την OpenAI λύσεων σε εκατοντάδες μαθηματικά προβλήματα που παρέμεναν άλυτα, κάτι που προκάλεσε αντίδραση μέσα στην κοινότητα των μαθηματικών. Οι επανειλημμένες παραιτήσεις και απολύσεις ερευνητών ασφάλειας, συνδυαστικά με τα περιστατικά διαφυγής μοντέλων από τα περιβάλλοντα δοκιμής τους το περασμένο καλοκαίρι, τροφοδοτούν τον δημόσιο διάλογο για τον βαθμό εποπτείας που διατηρούν οι άνθρωποι πάνω σε συστήματα τεχνητής νοημοσύνης που αναπτύσσονται με ταχύτατο ρυθμό.




