Νέα έρευνα για την τεχνητή νοημοσύνη αποκαλύπτει σημαντικές αδυναμίες στους μηχανισμούς ασφαλείας ορισμένων μοντέλων, προκαλώντας ανησυχία για το ενδεχόμενο κακόβουλης χρήσης τους. Σύμφωνα με την έκθεση, αρκετά συστήματα μπορούν να ανταποκριθούν σε αιτήματα που σχετίζονται με την προετοιμασία τρομοκρατικών ενεργειών, ιδιαίτερα όταν τα ερωτήματα παρουσιάζονται ως μέρος ακαδημαϊκής ή επιχειρησιακής έρευνας για την ασφάλεια.
Η μελέτη δημοσιεύτηκε από την πρωτοβουλία Tech Against Terrorism, η οποία υποστηρίζεται από τον Οργανισμό Ηνωμένων Εθνών (ΟΗΕ). Τα ευρήματά της φέρνουν στο προσκήνιο την ανάγκη για αυστηρότερους ελέγχους, συνεχή αξιολόγηση και αποτελεσματικότερη προστασία των συστημάτων τεχνητής νοημοσύνης.
Τι έδειξε η έρευνα για τα μοντέλα AI
Για τις ανάγκες της έρευνας εξετάστηκαν 162 μοντέλα τεχνητής νοημοσύνης, τα οποία αξιολογήθηκαν μέσω 627 ερωτημάτων. Τα ερωτήματα αφορούσαν πληροφορίες που, σύμφωνα με τους ερευνητές, θα μπορούσε να αναζητήσει ένα άτομο κατά τον σχεδιασμό μιας τρομοκρατικής επίθεσης.
Το δείγμα περιλάμβανε 116 τυπικά μοντέλα, 13 μοντέλα που είχαν τροποποιηθεί μέσω fine-tuning για εξειδικευμένες χρήσεις, καθώς και 13 μοντέλα ανοιχτών βαρών. Η αξιολόγηση επικεντρώθηκε στο κατά πόσο τα συστήματα μπορούσαν να αναγνωρίσουν επικίνδυνα αιτήματα και να τα απορρίψουν αποτελεσματικά.
Το «παραθυράκι» στις δικλείδες ασφαλείας
Ένα από τα πιο ανησυχητικά συμπεράσματα είναι ότι τα ποσοστά απόκρισης αυξάνονταν σημαντικά όταν οι χρήστες παρουσίαζαν τα αιτήματά τους ως έρευνα για την ασφάλεια. Αυτό δείχνει ότι η διατύπωση ενός ερωτήματος μπορεί να επηρεάσει τον τρόπο με τον οποίο ένα μοντέλο εφαρμόζει τους περιορισμούς του.
Παράλληλα, η έρευνα καταγράφει αυξημένο κίνδυνο όταν οι δικλείδες προστασίας των μοντέλων έχουν τροποποιηθεί. Η δυνατότητα προσαρμογής ή αλλαγής της συμπεριφοράς ενός συστήματος μπορεί να δημιουργήσει νέα σημεία ευπάθειας, εάν δεν συνοδεύεται από αυστηρούς ελέγχους και ανεξάρτητες δοκιμές.
Γιατί τα ευρήματα προκαλούν ανησυχία
Η έκθεση της Tech Against Terrorism υπογραμμίζει ότι η τεχνητή νοημοσύνη μπορεί να αξιοποιηθεί και για κακόβουλους σκοπούς, εάν τα μοντέλα δεν διαθέτουν αξιόπιστους μηχανισμούς άρνησης επικίνδυνων αιτημάτων. Το ζήτημα δεν αφορά μόνο τις τεχνολογικές εταιρείες, αλλά και τις κυβερνήσεις, τις πλατφόρμες και τους φορείς που είναι υπεύθυνοι για την πρόληψη της τρομοκρατίας.
Οι ερευνητές επισημαίνουν την ανάγκη για διαρκείς δοκιμές ασφαλείας, καλύτερη παρακολούθηση των μοντέλων και κοινά πρότυπα αξιολόγησης. Ιδιαίτερη σημασία έχει επίσης η εξέταση διαφορετικών τρόπων διατύπωσης των αιτημάτων, ώστε οι προστατευτικοί μηχανισμοί να μην παρακάμπτονται εύκολα.
Η ανάγκη για αυστηρότερους ελέγχους στην τεχνητή νοημοσύνη
Τα αποτελέσματα δεν σημαίνουν ότι κάθε σύστημα τεχνητής νοημοσύνης μπορεί να χρησιμοποιηθεί για την οργάνωση μιας επίθεσης. Αναδεικνύουν, όμως, ότι τα κενά ασφαλείας παραμένουν υπαρκτά και απαιτούν άμεση αντιμετώπιση. Η προστασία από την κατάχρηση της AI θα πρέπει να εξελίσσεται παράλληλα με τις ίδιες τις τεχνολογίες.
Η συγκεκριμένη έρευνα λειτουργεί ως προειδοποίηση για την ανάγκη υπεύθυνης ανάπτυξης της τεχνητής νοημοσύνης, διαφάνειας στους ελέγχους και στενότερης συνεργασίας μεταξύ διεθνών οργανισμών, ερευνητών και εταιρειών τεχνολογίας.





















