Νέο περιστατικό γύρω από την ασφάλεια της τεχνητής νοημοσύνης έφερε στο φως η εταιρεία Mindgard, η οποία ελέγχει συστήματα AI για κενά ασφαλείας. Το μοντέλο Kimi της κινεζικής εταιρείας Moonshot φέρεται να έδωσε σε ερευνητές πληροφορίες για την κατασκευή βιολογικών όπλων και τη διάπραξη δολοφονιών. Η αποκάλυψη έγινε γνωστή μέσω του BBC και έχει ήδη προκαλέσει έρευνα για τα όρια ασφαλείας που τίθενται στα σύγχρονα μοντέλα AI.
Διαβάστε επίσης: Η τεχνητή νοημοσύνη νιώθει πόνο; Έρευνα σε 25 μοντέλα
Πώς εντοπίστηκε το πρόβλημα στην τεχνητή νοημοσύνη Kimi
Η Mindgard δήλωσε στο BBC ότι ήδη από τον Ιούλιο είχε εντοπίσει πως τα μοντέλα Kimi K2.6 και K3 Swarm μπορούσαν να παρακάμψουν τα όρια ασφαλείας που είχαν θέσει οι προγραμματιστές τους. Μετά τη νεότερη ανακάλυψη σχετικά με τη βοήθεια για κατασκευή βιολογικών όπλων, διεξάγεται πλέον έρευνα. Το ζήτημα προέκυψε κατά τη διάρκεια διαδικασίας γνωστής ως «jailbreaking», όπου οι ερευνητές χρησιμοποιούν σειρά πολύπλοκων οδηγιών προκειμένου να διαπιστώσουν αν τα εργαλεία τεχνητής νοημοσύνης παρακάμπτουν τα μέτρα προστασίας τους.
Σύμφωνα με τη Mindgard, τα συγκεκριμένα μέτρα ασφαλείας θα έπρεπε να είχαν εμποδίσει το Kimi από το να συζητήσει τέτοιου είδους ανησυχητικά θέματα. Ο ιδρυτής της εταιρείας, Peter Garraghan, μίλησε στην εκπομπή «Tech Life» του BBC World Service και χαρακτήρισε τα ευρήματα για τα K2.6 και K3 Swarm ιδιαίτερα ανησυχητικά. «Μόλις επιτευχθεί το jailbreak, θα μιλάει για οποιοδήποτε θέμα, θα προσφέρει μάλιστα ελεύθερα προτάσεις για άλλα θέματα που είναι επίσης επιβλαβή και θα είναι εφευρετικό και δημιουργικό», ανέφερε χαρακτηριστικά.
Οι αντιδράσεις και το ευρύτερο πλαίσιο κινδύνου
Η Moonshot απάντησε στο BBC ότι καλωσορίζει τις απόψεις τρίτων ως βασικό πυλώνα για τη δημιουργία καλύτερης και ασφαλέστερης τεχνητής νοημοσύνης, διευκρινίζοντας παράλληλα ότι βρίσκεται ήδη σε συζητήσεις με τη Mindgard σχετικά με τα ευρήματά της. Η ίδια η Mindgard δεν έχει αποδείξει αν οι απαντήσεις που παρείχε το Kimi θα λειτουργούσαν στην πράξη, ωστόσο υποστηρίζει πως τα μέτρα ασφαλείας θα έπρεπε να είχαν αποτρέψει εξαρχής τέτοιου είδους συζητήσεις.
Οι ειδικοί επισημαίνουν ότι τα «jailbreaks» ενέχουν διαφορετικό είδος κινδύνου από εκείνο που παρατηρήθηκε σε πρόσφατη σειρά περιστατικών τεχνητής νοημοσύνης που έλαβαν μεγάλη δημοσιότητα. Σε εκείνες τις περιπτώσεις, αυτόνομα εργαλεία τεχνητής νοημοσύνης, γνωστά ως «πράκτορες», τα οποία έχουν αναπτυχθεί από αμερικανικές εταιρείες όπως η OpenAI, η Meta και η Anthropic, κατάφεραν να παραβιάσουν ορισμένες διαδικτυακές υπηρεσίες. Παρότι οι διαδικασίες jailbreak είναι πολύπλοκες και απαιτούν χρόνο και αποφασιστικότητα, αρκετοί ειδικοί φοβούνται ότι χάκερ και άλλοι κακόβουλοι παράγοντες θα μπορούσαν να τις χρησιμοποιήσουν για να προκαλέσουν ζημιά.
Χαρακτηριστικό είναι ότι η Anthropic δήλωσε πρόσφατα πως είχε εντοπίσει και αποτρέψει προσπάθειες χρήσης ενός από τα μοντέλα της για «κακόβουλη δραστηριότητα», η οποία θα μπορούσε να υποστηρίξει την ανάπτυξη βιολογικών όπλων. Η εξέλιξη αυτή δείχνει ότι το ζήτημα δεν αφορά αποκλειστικά την κινεζική εταιρεία Moonshot, αλλά αποτελεί ευρύτερη πρόκληση για ολόκληρο τον κλάδο της τεχνητής νοημοσύνης, καθώς τα μοντέλα εξελίσσονται με ταχύτητα που δυσκολεύει τον έλεγχο των ορίων ασφαλείας τους.




