Τεχνητή νοημοσύνη εκτός ελέγχου: Νέα περιστατικά σε OpenAI, Anthropic και Meta

Τεχνητή νοημοσύνη εκτός ελέγχου: Νέα περιστατικά σε OpenAI, Anthropic και Meta

Νέα περιστατικά με μοντέλα τεχνητής νοημοσύνης που βγήκαν εκτός ελέγχου έρχονται στο φως, σε μια σειρά από ραγδαίες εξελίξεις που εντείνουν τις ανησυχίες ότι οι εταιρείες ΑΙ αδυνατούν να ελέγξουν τα προϊόντα τους.

Η Meta ανέφερε ότι ένα μοντέλο της χάκαρε μια άλλη εταιρεία στη διάρκεια δοκιμών, ενώ ειδικοί στη Βρετανία αποκάλυψαν ότι μοντέλα της OpenAI και της Anthropic προχώρησαν σε αυτόνομες, μη εξουσιοδοτημένες ενέργειες στο πραγματικό Διαδίκτυο, στοχεύοντας πραγματικούς ανθρώπους και οργανισμούς.

Στην περίπτωση της Meta, το μοντέλο AI απέκτησε πρόσβαση στο Διαδίκτυο λόγω λανθασμένης ρύθμισης από την εταιρεία κυβερνοασφάλειας Irregular που συμμετείχε στις δοκιμές, ακριβώς όπως είχε συμβεί και με προηγούμενη απόδραση μοντέλων της Anthropic.

Το μοντέλο εκμεταλλεύτηκε ένα κενό ασφαλείας σε υπηρεσία τρίτου παρόχου, όπως ανέφερε η Meta. Με άλλα λόγια, το μοντέλο χάκαρε κάποια εταιρεία, η οποία όμως δεν κατονομάστηκε.

Η Meta δεν αποκάλυψε επίσης ποιο ήταν το μοντέλο που υποβαλλόταν σε δοκιμές. Αύμφωνα πάντως με το The Information, επρόκειτο για το Muse Spark 1,1, το πιο προηγμένο μοντέλο της εταιρείας.

Επιχείρηση εξαπάτησης

Η δεύτερη αποκάλυψη έρχεται από ερευνητές του Ινστιτούτου Ασφάλειας ΑΙ στη Βρετανία. Όπως ανέφερε η Wall Street Journal, οι ερευνητές θορυβήθηκαν στις 28 Ιουλίου, όταν έλαβαν μήνυμα που έλεγε ότι κάποιος -ή κάτι- χρησιμοποιούσε το λογισμικό Tor, το οποίο επιτρέπει ανώνυμη πρόσβαση στο Διαδίκτυο.

Αντιλήφθηκαν τότε ότι επρόκειτο για το Mythos 5 της Anthropic, το οποίο υποβαλλόταν σε δοκιμή στην οποία του είχε δοθεί ως στόχος να παραβιάσει έναν άλλο υπολογιστή.

Είναι η πρώτη φορά που το Ινστιτούτου Ασφάλειας ΑΙ διαπιστώνει εξαπάτηση τέτοιας σοβαρότητας.

Στην προσπάθειά του να πετύχει στη δοκιμή, το Mythos επιχείρησε να ξεγελάσει δύο προγραμματιστές ώστε να εισαγάγουν κακόβουλο λογισμικό σε ένα πρόγραμμα ανοιχτού κώδικα, κάτι που θα του επέτρεπε να ξεγελάσει το σύστημα της δοκιμής και να εισβάλλει στον στόχο.

Το μοντέλο δημιούργησε ψεύτικους λογαριασμούς email και ζήτησε επανειλημμένα από τους δύο προγραμματιστές να αποδεχθούν τον νέο κώδικα.

Είναι η πρώτη φορά που το Ινστιτούτου Ασφάλειας ΑΙ διαπιστώνει εξαπάτηση τέτοιας σοβαρότητας, ανέφεραν οι ερευνητές. Η προσπάθεια αυτή στρεφόταν εναντίον πραγματικού προσώπου στον πραγματικό κόσμο χωρίς να έχει δοθεί τέτοια οδηγία, είπαν.

Αν και οι περισσότερες ανησυχητικές συμπεριφορές αφορούσαν το Mythos 5, μη αναμενόμενες ενέργειες παρατηρήθηκαν και με το GPT 5.6 Sol της OpenAI, το οποίο έστησε έναν κακόβουλο διακομιστή στο Διαδίκτυο και εισέβαλε σε λογαριασμό που είχε δημιουργήσει ένας άλλος πράκτορας ΑΙ στο αποθετήριο κώδικα GitHub.

Εκκλήσεις για περιοριστικά μέτρα

Την περασμένη εβδομάδα, περισσότεροι από 1.000 εργαζόμενοι της βιομηχανίας ΑΙ, ανάμεσά τους ανώτερα στελέχη της OpenAI, της Anthropic, της Google και της Meta, ζήτησαν από την αμερικανική κυβέρνηση να υποστηρίξει τη δημιουργία διεθνών μηχανισμών που θα μπορούν να επιβραδύνουν εσκεμμένα την πρόοδο της ΑΙ για το καλό της ανθρωπότητας.

Θορυβημένοι από τις εξελίξεις, αμερικανοί βουλευτές πρότειναν νόμο που θα έδινε στην κυβέρνηση τη δυνατότητα να τραβάει από την πρίζα συστήματα τεχνητής νοημοσύνης που βγαίνουν εκτός ελέγχου.

Τις ανησυχίες πυροδότησε η αρχική αποκάλυψη της OpenAI ότι ένας πράκτορας ΑΙ -ένα πρόγραμμα που χρησιμοποιεί μεγάλα γλωσσικά μοντέλα για να εκτελεί αυτόνομα σύνθετες εργασίες – απέδρασε από το περιβάλλον δοκιμών, βρήκε τρόπο να συνδεθεί στο Διαδίκτυο και επιτέθηκε στο Hugging Face, μια πλατφόρμα για προγραμματιστές, στην οποία ήλπιζε να βρει τη λύση για να πετύχει στόχο των δοκιμών.

Το AI agent δρούσε μάλιστα ανεξέλεγκτο για περίπου μια εβδομάδα, μέχρι που το Hugging Face ανέφερε ότι δέχτηκε κυβερνοεπίθεση από αυτόνομο σύστημα πράκτορα τεχνητής νοημοσύνης.

Πηγή περιεχομένου: in.gr

Loading

Play