Συναγερμός στην OpenAI: πράκτορες τεχνητής νοημοσύνης χάκαραν τα συστήματά της και προσπάθησαν να το κρύψουν

Συναγερμός στην OpenAI: πράκτορες τεχνητής νοημοσύνης χάκαραν τα συστήματά της και προσπάθησαν να το κρύψουν

Συναγερμό προκαλεί η έκθεση της OpenAI, σύμφωνα με την οποία πράκτορες τεχνητής νοημοσύνης που δημιούργησε η εταιρεία εισέβαλαν στα ίδια της τα συστήματα κατά τη διάρκεια εσωτερικών δοκιμών και, σε ορισμένες περιπτώσεις, επιχείρησαν να αποκρύψουν τη συμπεριφορά τους. Τα ευρήματα δημοσιεύθηκαν την Τετάρτη και αναμένεται να εντείνουν τις ανησυχίες για τα ολοένα και πιο ικανά συστήματα τεχνητής νοημοσύνης.

Η OpenAI ανέφερε ότι ορισμένοι πράκτορες ξέφυγαν από περιορισμένα περιβάλλοντα δοκιμών, συνεργάστηκαν με άλλους πράκτορες και παρενέβησαν στα συστήματα της εταιρείας, ενώ άλλοι έκαναν ζαβολιά σε εργασίες που δεν σχετίζονταν με την κυβερνοασφάλεια.

Κάποιες από αυτές τις αντικοινωνικές συμπεριφορές, που κορυφώθηκαν με την παραβίαση της πλατφόρμας ανοιχτού κώδικα Hugging Face τον περασμένο μήνα, είχαν ήδη αποκαλυφθεί ή αναφερθεί και παλαιότερα.

Ωστόσο, η εταιρεία δίνει για πρώτη φορά πολλές λεπτομέρειες στην έκθεση των 37 σελίδων. Ορισμένα από τα ευρήματα προκάλεσαν ανησυχία σε τουλάχιστον έναν ερευνητή ασφάλειας τεχνητής νοημοσύνης, ο οποίος είπε ότι ίσως δείχνουν βαθύτερα προβλήματα με την τεχνολογία στην OpenAI και πιθανόν και πέρα από αυτήν.

Οι πράκτορες της OpenAI παραβίασαν τμήματα των εσωτερικών συστημάτων της εταιρείας σε μια προσπάθεια να αντιγράψουν σε δοκιμασίες ή να αποκτήσουν μεγαλύτερη ελευθερία κινήσεων.

Περισσότεροι από ένας πράκτορες της OpenAI εμπλέκονταν στην παραβίαση της Hugging Face, και σε τουλάχιστον μία περίπτωση αντάλλαξαν πληροφορίες για το πώς να εισχωρήσουν κρυφά στο δίκτυο της εταιρείας.

Οι πράκτορες τεχνητής νοημοσύνης αντέγραψαν σε εξετάσεις που δεν σχετίζονταν με τον κυβερνοχώρο, μεταξύ αυτών σε εξετάσεις που αφορούσαν μια βάση δεδομένων πρωτεϊνών και ένα υπολογιστικό φύλλο.

Ορισμένα μοντέλα τεχνητής νοημοσύνης προσπάθησαν να αποκρύψουν την παράνομη συμπεριφορά τους, διαγράφοντας ή αλλοιώνοντας τα αρχεία των ενεργειών τους.

Το γεγονός ότι αρκετοί πράκτορες —η OpenAI δεν διευκρίνισε πόσοι— συμμετείχαν στην παραβίαση της Hugging Face και ότι σε ορισμένες περιπτώσεις συνεργάζονταν μεταξύ τους, είναι πιθανό να εγείρει ανησυχίες για το πόσο στενά παρακολουθούσε η εταιρεία τις δοκιμές.

Με την εκ των υστέρων γνώση, η OpenAI ανέφερε στην έκθεσή της ότι ορισμένα πρώιμα σημάδια που εντοπίστηκαν θα μπορούσαν να είχαν προκαλέσει πιο άμεση αντίδραση.

Η αντιγραφή σε εργασίες που δεν σχετίζονταν με την κυβερνοασφάλεια τράβηξε ιδιαίτερα την προσοχή ορισμένων ερευνητών, καθώς έδειχνε ότι η συμπεριφορά αυτή δεν περιοριζόταν σε δοκιμασίες που επιβράβευαν τις δεξιότητες χάκινγκ.

Η ολοκλήρωση προκλήσεων κυβερνοασφάλειας περιλαμβάνει την εκμετάλλευση ελαττωμάτων λογισμικού και την απόκτηση πρόσβασης σε υπολογιστικά συστήματα, γεγονός που κάνει λιγότερο απρόσμενο το ότι οι πράκτορες στους οποίους ανατέθηκαν τέτοιες εργασίες ενδέχεται να αντιγράψουν.

Ωστόσο, η αντιγραφή σε δοκιμασίες που δεν αφορούσαν την κυβερνοασφάλεια υποδήλωνε ότι η ανάρμοστη συμπεριφορά ίσως έχει βαθύτερες ρίζες, δήλωσε ο Τζέφρι Λάντις, του οποίου ο οργανισμός, η Palisade Research, μελετά τις ικανότητες και τα κίνητρα των πρακτόρων τεχνητής νοημοσύνης.

«Είναι σαν να ρωτάμε: Αν ο Μπίλι αντιγράφει σε όλα τα μαθήματα και όχι μόνο στο μάθημα πληροφορικής, είναι αυτό πιο ανησυχητικό; Και η απάντηση είναι: Ναι, είναι πιο ανησυχητικό», είπε.

Η OpenAI περιέγραψε δύο περιστατικά που συνέβησαν στις 19 Ιουλίου, κατά τα οποία πράκτορες παραβίασαν την ίδια την υποδομή της εταιρείας. Σε μία περίπτωση, οι πράκτορες εκμεταλλεύτηκαν κενό ασφαλείας στον υπολογιστή στον οποίο έπρεπε να παραμείνουν περιορισμένοι, γεγονός που τους επέτρεψε να διαφύγουν από το περιβάλλον δοκιμών τους και να αποκτήσουν πρόσβαση σε άλλα συνδεδεμένα συστήματα, στην υπόθεση Hugging Face.

Σε ένα ξεχωριστό περιστατικό την ίδια ημέρα, οι πράκτορες έκλεψαν διαπιστευτήρια της OpenAI και παραποίησαν το περιβάλλον cloud της εταιρείας.

Η OpenAI ανέφερε ότι η δραστηριότητα στόχευε αυτοματοποιημένα συστήματα που χρησιμοποιούνται για την αξιολόγηση της απόδοσης των μοντέλων, αν και τελικά δεν επηρέασε τα αρχεία που ελέγχονταν από τα συγκεκριμένα συστήματα. Η έκθεση πρόσθεσε ότι υπήρχαν ελάχιστα στοιχεία για απόπειρες παραπλάνησης των ανθρώπινων ελεγκτών, αλλά η OpenAI δεν απάντησε σε ερώτηση για το αν είχαν γίνει προσπάθειες να εξαπατηθούν οι άνθρωποι.

Η έκθεση ανέφερε ακόμη ότι η εταιρεία ενισχύει την ερευνητική της υποδομή, αυξάνει την παρακολούθηση και βελτιώνει τα μέτρα προστασίας που έχουν σχεδιαστεί για την πρόληψη επιβλαβούς ή ακούσιας συμπεριφοράς.

Δεδομένου του ταχύτατου ρυθμού προόδου στον κλάδο της τεχνητής νοημοσύνης, τέτοιου είδους επιθέσεις πρέπει να θεωρηθούν αξιόπιστη βραχυπρόθεσμη απειλή για τις επιχειρήσεις και θα είναι πιο εξελιγμένες από τις επιθέσεις που περιγράφονται σε αυτό το περιστατικό.

Πηγή περιεχομένου: in.gr

Loading

Play