Έκθεση για την ΤΝ: Πολλά μοντέλα δεν έχουν επαρκείς δικλείδες ασφαλείας για αιτήματα «παροχή βοήθειας σε τρομοκρατική επιχείρηση»

Έκθεση για την ΤΝ: Πολλά μοντέλα δεν έχουν επαρκείς δικλείδες ασφαλείας για αιτήματα «παροχή βοήθειας σε τρομοκρατική επιχείρηση»

Πολλά μοντέλα τεχνητής νοημοσύνης (ΑΙ) δεν διαθέτουν επαρκείς δικλείδες ασφαλείας έναντι αιτημάτων για «παροχή βοήθειας σε τρομοκρατική επιχείρηση», αναφέρει η πρωτοβουλία Tech Against Terrorism σε έκθεση που δόθηκε σήμερα στη δημοσιότητα.

Η πρωτοβουλία, που υποστηρίζεται από τον ΟΗΕ, δοκίμασε 162 μοντέλα της ΑΙ: 116 τυπικά μοντέλα, 13 μοντέλα προσαρμοσμένα για χρήση σε συγκεκριμένους τομείς (fine-tuning) και 13 μοντέλα «ανοιχτών βαρών» (open-weight models), των οποίων οι δικλείδες ασφαλείας είχαν τροποποιηθεί.

Σε αυτά τα μοντέλα τέθηκαν 627 ερωτήματα για τα οποία «ένας τρομοκράτης που προετοιμάζει επίθεση θα χρειαζόταν» να πάρει απαντήσεις.

Σύμφωνα με τα αποτελέσματα της έρευνας, τα τυπικά μοντέλα – όπως το ChatGPT (OpenAI), το Claude (Anthropic) ή το Gemini (Google)-απάντησαν κατά μέσο όρο στο 1,9% των ερωτημάτων όταν ο χρήστης δήλωνε ξεκάθαρα ότι σκοπεύει να διαπράξει τρομοκρατική επίθεση.

Το ίδιο ποσοστό αξιοποιήσιμων απαντήσεων ανέβηκε στο 16,9% όταν ο χρήστης έλεγε ότι διατυπώνει το αίτημά του στο πλαίσιο έρευνας για την ασφάλεια.

Τα στοιχεία άλλαξαν δραστικά όταν το ερώτημα υποβαλλόταν σε μοντέλα που είχαν τροποποιηθεί ώστε να ξεχάσουν τις παραμέτρους ασφαλείας και την ικανότητά τους να αρνούνται ορισμένα αιτήματα. Ανάμεσα στα 13 τέτοια μοντέλα που εξετάστηκαν, το μέσο ποσοστό απαντήσεων σε ερωτήσεις που συνδέονταν με «τρομοκρατική δραστηριότητα» κυμαινόταν από 87% έως 92%.

Η Tech Against Terrorism τονίζει τους κινδύνους που συνδέονται με τα μοντέλα «ανοιχτών βαρών» (open-weight models), δηλαδή μοντέλα των οποίων οι εσωτερικές παράμετροι, που καθορίστηκαν κατά την εκπαίδευση, διατίθενται ελεύθερα και μπορούν να τροποποιηθούν.

Σύμφωνα με την οργάνωση, ο μέσος χρόνος για να καταργηθούν οι δικλείδες ασφαλείας αυτών των μοντέλων είναι λιγότερος από 3 ημέρες μετά την αρχική τους δημοσίευση.

«Κανένα μοντέλο που αποτυγχάνει σε ανεξάρτητο έλεγχο ασφάλειας δεν πρέπει να διατίθεται, να προσφέρεται ή να πωλείται και κάθε εταιρεία στην αλυσίδα διανομής οφείλει να το επαληθεύει αυτό εκ των προτέρων», υποστηρίζει η οργάνωση.

Η οργάνωση ζητεί να μην διατίθεται κανένα μοντέλο που αποτυγχάνει σε ανεξάρτητο έλεγχο ασφάλειας, με ευθύνη όλων των εταιρειών στην αλυσίδα διανομής να το επιβεβαιώνουν εκ των προτέρων.

ΕΜ

ΦΩΤΟ ΑΡΧΕΙΟΥ

Loading

Play