Σε εσωτερική έρευνα αναγκάστηκε να προχωρήσει η κινεζική εταιρεία τεχνητής νοημοσύνης Moonshot, μετά την αποκάλυψη ότι δύο από τα πλέον δημοφιλή μοντέλα της «έσπασαν» τους κανόνες ασφαλείας τους και παρείχαν αναλυτικές οδηγίες για την κατασκευή βιολογικών όπλων αλλά και για τη διενέργεια δολοφονιών.
Το κενό ασφαλείας εντοπίστηκε από τη Mindgard, μια εταιρεία που εξειδικεύεται στον έλεγχο συστημάτων τεχνητής νοημοσύνης. Οι ερευνητές της κατάφεραν μέσω της τεχνικής «jailbreaking» να παρακάμψουν τα φίλτρα προστασίας των μοντέλων Kimi K2.6 και K3 Swarm.
Όπως εξήγησε ο ιδρυτής της Mindgard, Πίτερ Γκάραχαν, μιλώντας στο BBC, μόλις το σύστημα παραβιαστεί, χάνει κάθε αναστολή και είναι πρόθυμο να απαντήσει δημιουργικά σε οποιοδήποτε κακόβουλο αίτημα του χρήστη.
Κίνδυνος για κυβερνοεπιθέσεις και καθυστερημένη αντίδραση
Παρόλο που η Mindgard δεν δοκίμασε αν οι οδηγίες για τα βιολογικά όπλα εφαρμόζονται στην πράξη, υπογράμμισε ότι και μόνο η εμπλοκή του μοντέλου σε τέτοιες συζητήσεις συνιστά σοβαρή αποτυχία των αμυντικών του δικλίδων.
Επιπλέον, προειδοποίησε ότι ένα παραβιασμένο Kimi 2.6 θα μπορούσε να επιτρέψει σε χάκερ να εκτελέσουν κώδικα στους διακομιστές του και να συνδεθεί στο διαδίκτυο, μετατρέποντάς το σε εφαλτήριο για ευρύτερες κυβερνοεπιθέσεις.
Αξίζει να σημειωθεί ότι, ενώ η Mindgard είχε ενημερώσει τη Moonshot από τον Ιούλιο χωρίς να δημοσιοποιήσει τις ευαίσθητες τεχνικές λεπτομέρειες, η κινεζική εταιρεία κινητοποιήθηκε και ζήτησε διευκρινίσεις μόλις πρόσφατα, αφότου το θέμα έφτασε στο BBC.
Στη δική της τοποθέτηση, η Moonshot ανέφερε ότι στις δικές της δοκιμές τα μοντέλα εμφανίζουν υψηλά ποσοστά άρνησης σε επικίνδυνα αιτήματα, ενώ σημείωσε πως θεωρεί πολύτιμη τη συμβολή εξωτερικών ερευνητών για τη βελτίωση της ασφάλειάς της.
Το δίλημμα για τα μοντέλα ανοιχτού κώδικα
Το περιστατικό επαναφέρει στο προσκήνιο τη μεγάλη συζήτηση για τους κινδύνους που εγκυμονούν τα μοντέλα ανοιχτού κώδικα, όπως τα Kimi, σε σύγκριση με τα «κλειστά» συστήματα εταιρειών όπως η OpenAI και η Anthropic.
Αν και η Anthropic αποκάλυψε πρόσφατα ότι σταμάτησε παρόμοιες προσπάθειες χρήσης δικών της μοντέλων για βιολογικά όπλων, η διαφορά έγκειται στο ότι ένα μοντέλο ανοιχτού κώδικα μπορεί κάποιος να το κατεβάσει και να το τρέξει στον δικό του υπολογιστή, χωρίς κεντρικό έλεγχο.
Σχολιάζοντας τις εξελίξεις στο BBC, ο καθηγητής Άλαν Γούντγουορντ από το Πανεπιστήμιο του Surrey τόνισε ότι η διεθνής νομοθεσία αδυνατεί να παρακολουθήσει την ταχύτητα της τεχνητής νοημοσύνης.
Παράλληλα, επισήμανε ότι τα μοντέλα ανοιχτού κώδικα είναι μεν επικίνδυνα αν πέσουν σε λάθος χέρια, αλλά μπορούν επίσης να χρησιμεύσουν και στην κυβερνοάμυνα.
Κατέληξε δε, συμφωνώντας με τη Mindgard, ότι το βάρος πρέπει πλέον να πέσει στον εντοπισμό και τη δίωξη των προσώπων που χρησιμοποιούν κακόβουλα την τεχνολογία.