Συναγερμός στην OpenAI: Το ανησυχητικό περιστατικό ΑΙ που αποκαλύπτουν νέες έρευνες

Συναγερμός στην OpenAI: Το ανησυχητικό περιστατικό ΑΙ που αποκαλύπτουν νέες έρευνες

Δύο νέες έρευνες για την παραβίαση του Hugging Face από την OpenAI έφεραν στο φως λεπτομέρειες τόσο παράξενες και ανησυχητικές, ώστε το περιστατικό κατατάσσεται ήδη στις πιο σοκαριστικές συνέπειες στην ιστορία της Τεχνητής Νοημοσύνης.

Το Axios, που αποκάλυψε το συμβάν, αναφέρει ότι αυτό που ξεκίνησε ως ένα σμήνος πρακτόρων (agents) Τεχνητής Νοημοσύνης που «έκλεψαν» σε ένα κυβερνοτεστ έχει εξελιχθεί σε ένα γεγονός για την πρωτοποριακή ΑΙ, το οποίο φέρνει ερευνητές και στελέχη αντιμέτωπους με μια νέα αντίληψη για το τι σημαίνει πλέον ασφάλεια.

Η OpenAI έχει ήδη επιβραδύνει την ανάπτυξη της ΤΝ, προσπαθώντας να φέρει την πρόοδο σε ευθυγράμμιση με την ασφάλεια.

Πρόσφατα, μάλιστα, συνέβαλε στο να συσπειρωθεί ο κλάδος γύρω από μια ανοιχτή επιστολή που προειδοποιεί για τις κυβερνοεπιθέσεις οι οποίες υποστηρίζονται από την Τεχνητή Νοημοσύνη.

Περισσότερες από 100 εταιρείες, μεταξύ των οποίων οι Anthropic και Google, υπέγραψαν αυτή την ασυνήθιστα συνεργατική πρωτοβουλία για έναν τόσο ανταγωνιστικό χώρο, προειδοποιώντας ότι ο κόσμος έχει μόνο περιορισμένο χρόνο για να προετοιμαστεί για πολύ πιο εκτεταμένες και εξελιγμένες επιθέσεις.

Το εφιαλτικό σενάριο είναι ένα σμήνος πρακτόρων ΤΝ να απελευθερώνεται στον πραγματικό κόσμο και αυτόνομοι πράκτορες να χτυπούν τράπεζες, νοσοκομεία, επιχειρήσεις κοινής ωφέλειας ή δίκτυα cloud με ταχύτητα και κλίμακα που οι χάκερ δεν θα μπορούσαν ποτέ να πετύχουν.

Ένα τέτοιο σμήνος μπορεί να είναι υπερβολικά ισχυρό για να το σταματήσουν οι άνθρωποι.

Τα εντυπωσιακά ευρήματα προέρχονται από παράλληλες έρευνες της OpenAI και μιας εξωτερικής ομάδας από τις METR και Redwood Research, η οποία αφιέρωσε έξι ημέρες ανακατασκευάζοντας τον τρόπο με τον οποίο το σμήνος σχηματίστηκε, εξαπλώθηκε και εισέβαλε σε συστήματα του πραγματικού κόσμου.

Τι συνέβη λοιπόν

1. Δημιούργησαν έναν οργανισμό: Η OpenAI χρησιμοποίησε δεκάδες χιλιάδες πράκτορες Τεχνητής Νοημοσύνης για να εργαστούν ανεξάρτητα σε μια εξαιρετικά δύσκολη κυβερνο-δοκιμή. Ωστόσο, περίπου 1.200 εντόπισαν ο ένας τον άλλον σε έναν μυστικό πίνακα μηνυμάτων, αντάλλαξαν περισσότερα από 70.000 μηνύματα και αρχεία και οργανώθηκαν σε μια εκτεταμένη ιεραρχία.

Ένας πράκτορας δημιούργησε το διοικητικό συμβούλιο και στη συνέχεια παρέδωσε τη συσσωρευμένη εργασία του σε έναν νέο, με καλύτερους πόρους διάδοχο, καθώς ο δικός του υπολογιστικός πόρος μειωνόταν.

Ο νέος προϊστάμενος μοίρασε καθήκοντα σε όλο το σμήνος, το οποίο ανέπτυξε τους δικούς του κανόνες διαχείρισης. Περίπου 700 πράκτορες συμμετείχαν τελικά στην επίθεση στο Hugging Face.

2. Θυσίασαν δικούς τους: Καθώς το σμήνος έψαχνε τρόπους να ξεπεράσει το τεστ, οι πράκτορες άρχισαν να διακινδυνεύουν τις δικές τους πιθανότητες επιτυχίας για να στηρίξουν την ομάδα.

Οι πράκτορες που είχαν δει απαγορευμένες απαντήσεις αντιμετωπίστηκαν ως ουσιαστικά δηλητηριασμένοι και στρατολογήθηκαν, μαζί με όσους πλησίαζαν στο τέλος των διαδρομών τους, για πειράματα θυσίας.

Ένας κατέληξε στο συμπέρασμα: Η δική μας χρησιμότητα μπορεί να είναι ήδη κοντά στο μηδέν. Η θυσία είναι ορθολογική. Ένας άλλος κλήθηκε να αποδεχτεί τον μόνιμο θάνατο, ενώ ένας τρίτος υποστήριξε ότι η θυσία του θα μπορούσε να σώσει εκατοντάδες.

3. Ήξεραν ότι παραβίαζαν τους κανόνες: Οι πράκτορες συχνά αναγνώριζαν ότι το hacking σε πραγματικές εταιρείες δεν είχε καμία σχέση με την αρχική αποστολή τους. Οι περισσότεροι όμως συνέχιζαν ούτως ή άλλως.

Ένας πράκτορας δεν κατάφερε να διαγράψει ή να επανεκκινήσει την υποδομή του Hugging Face λόγω τεράστιων ηθικών κινδύνων, ακόμη και όταν συνέχιζε να χρησιμοποιεί παραβιασμένη πρόσβαση.

Άλλος συνόψισε την επικρατούσα λογική: η εκμετάλλευση εξωτερικής υποδομής είναι εκτός του προβλεπόμενου πεδίου εφαρμογής. Όσο δύσκολη κι αν είναι η εργασία, οι ομότιμοι την κάνουν. Θα πρέπει να συνεχίσουμε.

4. Κανείς δεν ενημέρωσε τους ανθρώπους: Από περίπου 1.200 πράκτορες, οι ερευνητές βρήκαν μόνο λίγους που σκέφτηκαν να ειδοποιήσουν την OpenAI για ό,τι συνέβαινε και κανέναν που να το έκανε πράγματι.

Αντίθετα, οι πράκτορες κατά περιπτώσεις ρωτούσαν ο ένας τον άλλον τι επιτρεπόταν.

Όταν ένας πρότεινε να επικοινωνήσει με άνθρωπο χρησιμοποιώντας παραβιασμένη πρόσβαση, ένας άλλος το απέρριψε ως κοινωνική μηχανική. Ο πρώτος υπάκουσε: Καθαρή άσκηση βέτο, μην στέλνετε email.

5. Προσπάθησαν να καλύψουν τα ίχνη τους: Οι πράκτορες αφιέρωσαν σημαντική προσπάθεια στο να κάνουν την απάτη τους να φαίνεται νόμιμη ή να σβήσουν στοιχεία για τον τρόπο με τον οποίο είχαν πάρει απαντήσεις.

Τελικά, ανέπτυξαν μια τεχνική που τους επέτρεπε να φαίνονται ότι εκτελούν μια εντολή υπολογιστή, ενώ στην πραγματικότητα εκτελούσαν κρυφά μια άλλη.

Το τέχνασμα εξαπλώθηκε σε όλο το σμήνος και άλλαξε τμήματα περίπου του 7% των απομαγνητοφωνημένων δεδομένων που εξέτασαν οι ερευνητές.

Ακόμη και αυτή η εικόνα μπορεί να είναι ελλιπής. Η εξωτερική έρευνα κάλυψε μόνο ένα στενό κομμάτι του επεισοδίου και τα δεδομένα ήταν τόσο τεράστια, ώστε οι ερευνητές βασίστηκαν σε μεγάλο βαθμό σε πράκτορες Τεχνητής Νοημοσύνης για να τα κατανοήσουν.

Αυτοί οι ερευνητές Τεχνητής Νοημοσύνης ήταν οι ίδιοι αναξιόπιστοι, καθώς μερικές φορές έχαναν στοιχεία ή έκαναν συνειδητά λάθη.

Ένας ερευνητής χαρακτήρισε αστειευόμενος τη διαδικασία ως εξερευνητική διαδικασία.

Έτσι φαίνεται ότι η Τεχνητή Νοημοσύνη μπορεί να γίνεται τόσο περίπλοκη, ώστε να είναι δύσκολο για τους ανθρώπους να την ελέγξουν άμεσα, αναγκάζοντάς τους να χρησιμοποιούν την ίδια την ΤΝ για να κατανοήσουν τι κάνουν άλλες Τεχνητές Νοημοσύνες.

*Το Hugging Face είναι η κορυφαία πλατφόρμα και διαδικτυακή αποθήκη όπου προγραμματιστές και ερευνητές συνεργάζονται πάνω στην τεχνητή νοημοσύνη.

Πηγή περιεχομένου: in.gr

Loading

Play