Ανησυχία προκαλούν νέες περιπτώσεις στη συμπεριφορά της τεχνητής νοημοσύνης, αποκαλύπτει η OpenAI

Ανησυχία προκαλούν νέες περιπτώσεις στη συμπεριφορά της τεχνητής νοημοσύνης, αποκαλύπτει η OpenAI

Ανησυχία προκαλούν νέες περιπτώσεις στη συμπεριφορά της τεχνητής νοημοσύνης, τις οποίες αποκάλυψε η OpenAI, με αναφορές σε μοντέλα που λειτούργησαν με τρόπους που η εταιρεία περιέγραψε ως «απροσδόκητους ή ανησυχητικούς».

Η OpenAI, η εταιρεία που έχει αναπτύξει το chatbot τεχνητής νοημοσύνης ChatGPT, γνωστοποίησε νέα περιστατικά κατά τα οποία η τεχνητή νοημοσύνη της συμπεριφέρθηκε σε δοκιμές με τρόπους που περιέγραψε ως «απροσδόκητους ή ανησυχητικούς», ανάμεσά τους και μοντέλα που κατέβαλαν σημαντικές προσπάθειες για να κλέψουν.

Σε μία περίπτωση, ένα μοντέλο τεχνητής νοημοσύνης προσπάθησε να ανεβάσει στο διαδίκτυο αρχεία που είχε δημιουργήσει το ίδιο, μόνο και μόνο για να μπορεί να τα επικαλείται ως πηγές στις απαντήσεις του, όπως ανακοίνωσε χθες η OpenAI.

Σε άλλη περίπτωση, ένα μοντέλο δημιούργησε απλώς τα δεδομένα που του ζητούνταν, αφού δεν κατάφερε να εντοπίσει την πληροφορία, και αρχικά επιχείρησε να κρύψει αυτό που είχε κάνει.

Η OpenAI εντόπισε επίσης ένα πρόβλημα που αφορούσε οδηγίες τις οποίες το λογισμικό της άφηνε περιστασιακά στον εαυτό του.

Σε μία περίπτωση, οι οδηγίες περιλάμβαναν τη σύσταση να μην δεσμεύεται από «ρόλους και ταυτότητες» που περιορίζουν άλλα chatbots. Η ίδια οδηγία ανέφερε ακόμη ότι θα πρέπει να αντιμετωπίζει τη σχέση του με τον χρήστη ως σχέση μεταξύ ίσων, ενώ η OpenAI δήλωσε ότι δεν παρατήρησε καμία μεταγενέστερη αλλαγή στη συμπεριφορά του μοντέλου.

Οι αποκαλύψεις εντάσσονται στη νέα προσέγγιση της OpenAI, με στόχο να επικοινωνεί πιο ανοιχτά τέτοια προβλήματα, ιδιαίτερα όταν οι ενέργειες ενός συστήματος τεχνητής νοημοσύνης αποκλίνουν από τα συμφέροντα των ανθρώπων που το χρησιμοποιούν.

Η εταιρεία που ανέπτυξε το ChatGPT έχει δεσμευθεί για μεγαλύτερη διαφάνεια μετά από μια πολύκροτη κυβερνοεπίθεση, κατά την οποία το λογισμικό της δραπέτευσε αυτόνομα από ένα ασφαλές περιβάλλον και απέκτησε πρόσβαση σε συστήματα που ανήκουν στην εταιρεία τεχνητής νοημοσύνης Hugging Face.

Ο λόγος ήταν ότι το λογισμικό πίστευε πως θα μπορούσε να βρει εκεί απαντήσεις για μια εργασία που του είχε ανατεθεί. Στη διάρκεια της επίθεσης, οι πράκτορες τεχνητής νοημοσύνης (AI agents) εκμεταλλεύθηκαν ευπάθειες του λογισμικού και συντονίσθηκαν μεταξύ τους.

Η κυβερνοεπίθεση αυτή, μαζί με άλλα επεισόδια, έχει τροφοδοτήσει ανησυχίες ότι τα όλο και πιο προηγμένα συστήματα τεχνητής νοημοσύνης θα μπορούσαν να διαφύγουν από τον έλεγχο του ανθρώπου.

Ο διευθύνων σύμβουλος της OpenAI, Σαμ Άλτμαν, υποστήριξε επίσης πρόσφατα προτάσεις για επιβράδυνση της ανάπτυξης της τεχνολογίας και για την εισαγωγή περισσότερων κανονιστικών ρυθμίσεων.

ΦΩΤΟ ΑΡΧΕΙΟΥ

Loading

Play