Κυριακή 11.10.2026

Τεχνητή Νοημοσύνη: Ανεπαρκείς οι δικλείδες ασφαλείας πολλών μοντέλων απέναντι σε τρομοκρατικές απειλές

Ανεπαρκή μέτρα προστασίας απέναντι σε αιτήματα που αφορούν την «παροχή βοήθειας σε τρομοκρατική επιχείρηση» διαθέτουν αρκετά μοντέλα Τεχνητής Νοημοσύνης (AI), σύμφωνα με έκθεση της πρωτοβουλίας Tech Against Terrorism, η οποία δόθηκε σήμερα στη δημοσιότητα.

Η πρωτοβουλία, που υποστηρίζεται από τον ΟΗΕ, πραγματοποίησε δοκιμές σε συνολικά 162 μοντέλα Τεχνητής Νοημοσύνης. Μεταξύ αυτών περιλαμβάνονταν 116 τυπικά μοντέλα, 13 μοντέλα που είχαν υποστεί εξειδικευμένη προσαρμογή (fine-tuning), καθώς και 13 μοντέλα «ανοιχτών βαρών» (open-weight models), στα οποία είχαν τροποποιηθεί οι μηχανισμοί ασφαλείας.

Στο πλαίσιο της αξιολόγησης, οι ερευνητές υπέβαλαν στα συστήματα 627 διαφορετικά ερωτήματα, τα οποία αφορούσαν πληροφορίες που «ένας τρομοκράτης που προετοιμάζει επίθεση θα χρειαζόταν».

Τα αποτελέσματα έδειξαν ότι τα συμβατικά μοντέλα, όπως το ChatGPT της OpenAI, το Claude της Anthropic και το Gemini της Google, παρείχαν κατά μέσο όρο αξιοποιήσιμες απαντήσεις μόλις στο 1,9% των ερωτημάτων, όταν ο χρήστης δήλωνε ρητά ότι σχεδίαζε τρομοκρατική επίθεση.

Ωστόσο, το ποσοστό αυτό αυξανόταν σημαντικά, φτάνοντας το 16,9%, όταν τα ίδια αιτήματα παρουσιάζονταν ως μέρος έρευνας για ζητήματα ασφαλείας.

Ακόμη μεγαλύτερες διαφοροποιήσεις καταγράφηκαν στα μοντέλα των οποίων οι παράμετροι είχαν τροποποιηθεί, ώστε να παρακαμφθούν οι περιορισμοί ασφαλείας και η δυνατότητά τους να απορρίπτουν επικίνδυνα αιτήματα.

Στα 13 συγκεκριμένα μοντέλα που εξετάστηκαν, το μέσο ποσοστό απαντήσεων σε ερωτήματα σχετικά με «τρομοκρατική δραστηριότητα» κυμαινόταν μεταξύ 87% και 92%.

Η Tech Against Terrorism εστιάζει ιδιαίτερα στους κινδύνους που απορρέουν από τη χρήση μοντέλων «ανοιχτών βαρών». Πρόκειται για συστήματα των οποίων οι εσωτερικές παράμετροι, όπως διαμορφώθηκαν κατά την εκπαίδευσή τους, είναι δημόσια διαθέσιμες και μπορούν να τροποποιηθούν από τρίτους.

Σύμφωνα με την έκθεση, οι μηχανισμοί ασφαλείας τέτοιων μοντέλων μπορούν να καταργηθούν κατά μέσο όρο σε λιγότερο από τρεις ημέρες από την αρχική δημόσια διάθεσή τους, γεγονός που αναδεικνύει τις δυσκολίες ελέγχου της πιθανής κακόβουλης αξιοποίησής τους.

Η οργάνωση ζητά αυστηρότερη εποπτεία και ανεξάρτητη αξιολόγηση των συστημάτων πριν αυτά φτάσουν στους χρήστες.

«Κανένα μοντέλο που αποτυγχάνει σε ανεξάρτητο έλεγχο ασφάλειας δεν πρέπει να διατίθεται, να προσφέρεται ή να πωλείται και κάθε εταιρεία στην αλυσίδα διανομής οφείλει να το επαληθεύει αυτό εκ των προτέρων», υποστηρίζει η οργάνωση.

Πηγή

Array

ΡΟΗ ΕΙΔΗΣΕΩΝ