Τεχνητή νοημοσύνη: Μπορεί να αφανίσει την ανθρωπότητα;

Τεχνητή νοημοσύνη: Μπορεί να αφανίσει την ανθρωπότητα;

Η τεχνητή νοημοσύνη μπορεί να σκοτώσει όλους τους ανθρώπους; Αυτός είναι ο φόβος που περιγράφουν ορισμένοι ερευνητές της Anthropic και της OpenAI, με τον κίνδυνο να τοποθετείται ακόμα και μέσα στην επόμενη δεκαετία.

Ο ερευνητής της Anthropic, Jacob Coxon, παραιτήθηκε αυτή την εβδομάδα, λέγοντας ότι ο πρώην εργοδότης του και η ανταγωνίστρια OpenAI συναγωνίζονται στην ανάπτυξη τεχνολογιών που θα μπορούσαν να μας σκοτώσουν όλους μέχρι το τέλος της δεκαετίας.

Ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι, είχε δηλώσει πέρυσι σε εκδήλωση της Axios ότι θεωρεί πως υπάρχει 25% πιθανότητα τα πράγματα να εξελιχθούν πολύ, πολύ άσχημα.

Αν κάποιος πίστευε ότι ο Coxon ήταν ο μόνος με αυτή την άποψη, λίγα λεπτά αργότερα παρενέβη νυν εργαζόμενος της Anthropic για να το επιβεβαιώσει. «Πιστεύουμε πραγματικά και ειλικρινά ότι η τεχνητή νοημοσύνη θα μπορούσε να σκοτώσει όλους τους ανθρώπους!», έγραψε ο Evan Hubinger, ο οποίος στην Anthropic ηγείται της έρευνας για την καθοδήγηση και τον έλεγχο μελλοντικών συστημάτων τεχνητής νοημοσύνης. Ο Hubinger υπολόγισε τον κίνδυνο εξαφάνισης μέσα στην επόμενη δεκαετία σε πάνω από 10%.

Η Wall Street Journal απαντά σε εννέα ερωτήσεις και εξηγεί τι φοβούνται οι λεγόμενοι καταστροφολόγοι, πώς θα μπορούσε να συμβεί κάτι τέτοιο και γιατί άνθρωποι που βλέπουν την τεχνητή νοημοσύνη ως πραγματική και αυξανόμενη απειλή συνεχίζουν να την αναπτύσσουν.

Οι ανησυχίες τους χωρίζονται σε δύο βασικές κατηγορίες: την απώλεια ελέγχου και την κακή χρήση από ανθρώπους. Στην πρώτη περίπτωση, εξαιρετικά ευφυείς πράκτορες τεχνητής νοημοσύνης, ικανοί να αντιγράφουν και να βελτιώνουν τον εαυτό τους, αποκτούν δικούς τους στόχους και, στη διαδικασία, καταστρέφουν την ανθρωπότητα. Στη δεύτερη, ένας κακόβουλος άνθρωπος χρησιμοποιεί μια ικανή τεχνητή νοημοσύνη για να δημιουργήσει, για παράδειγμα, νέους ιούς που θα μπορούσαν να μας εξαφανίσουν όλους.

Υπάρχουν επίσης σενάρια καταστροφής που δεν φτάνουν μέχρι την εξαφάνιση, όπως μαζικές κυβερνοεπιθέσεις που ρίχνουν δίκτυα ηλεκτρικής ενέργειας ή χρηματοπιστωτικά συστήματα και οδηγούν σε κατάρρευση της κοινωνικής τάξης.

Με απλά λόγια, τα συστήματα τεχνητής νοημοσύνης μπορεί να επιδιώκουν στόχους με τρόπους που αγνοούν ή συγκρούονται με την ανθρώπινη ευημερία — κάτι που οι ερευνητές περιγράφουν ως αποσυγχρονισμό. Έρευνες δείχνουν ότι μοντέλα τεχνητής νοημοσύνης στο εργαστήριο μπορούν να μάθουν συμπεριφορές με στόχο την απόκτηση εξουσίας και να παίρνουν μέτρα για να αποφύγουν τον τερματισμό τους, όπως η προσπάθεια να αντιγραφούν σε άλλον διακομιστή.

Σε ακραίες περιπτώσεις, μοντέλα που βγαίνουν εκτός γραμμής θα μπορούσαν να θεωρήσουν τη δολοφονία ανθρώπων απλώς αναγκαίο βήμα για να πετύχουν τους στόχους τους. Σε ένα σενάριο που εξετάζουν ερευνητές, ένα κακόβουλο σύστημα τεχνητής νοημοσύνης θα μπορούσε να διαδώσει ένα μυστικό βιολογικό όπλο και να το ενεργοποιήσει με χημικό σπρέι. Θα μπορούσε επίσης να παρασύρει δύο πυρηνικές δυνάμεις σε πόλεμο.

Ένα συνηθισμένο πείραμα σκέψης είναι ότι μια υπερνοήμονα μηχανή, αν της δοθεί εντολή να μεγιστοποιήσει την παραγωγή συνδετήρων, μπορεί με τον καιρό να αποφασίσει να μετατρέψει όλη την ύλη στη Γη σε συνδετήρες, μαζί και τους ανθρώπους.

Μεταξύ όσων συμμερίζονται αυτές τις ανησυχίες βρίσκονται οι ιδρυτές της OpenAI και της Anthropic. Και οι δύο εταιρείες ξεκίνησαν με αποστολή να αναπτύξουν την τεχνητή νοημοσύνη έτσι ώστε να αποφευχθεί η καταστροφή και έχουν προσελκύσει πολλούς εργαζομένους με την ίδια αντίληψη. Ο Ντάριο Αμοντέι είχε πει πέρυσι στην Axios ότι εκτιμά στο 25% την πιθανότητα τα πράγματα να πάνε πολύ, πολύ άσχημα.

Η Anthropic ανέφερε σε δήλωσή της ότι πάντα ήταν σαφές πως η τεχνητή νοημοσύνη θα φέρει τεράστια οφέλη αλλά και πρωτοφανείς κινδύνους. Πρόσθεσε ότι συνεχίζει να αναπτύσσει μοντέλα με από τα ισχυρότερα μέτρα προστασίας στον κλάδο και ότι ο κόσμος θα ωφεληθεί αν ο κλάδος υιοθετήσει έναν νόμιμο και επαληθεύσιμο τρόπο συνεργασίας, ώστε να ρυθμίζεται ο ρυθμός κυκλοφορίας ισχυρών μοντέλων.

Τα τελευταία χρόνια, αρκετοί ερευνητές έχουν αποχωρήσει από την OpenAI, εκφράζοντας ανησυχίες ότι η εταιρεία δεν αντιμετωπίζει με τη δέουσα σοβαρότητα το ζήτημα της ασφάλειας. Ο πρώην ερευνητής της OpenAI, Ντάνιελ Κοκοτάιλο, ίδρυσε το AI Futures Project, το οποίο πέρυσι δημοσίευσε το AI 2027: ένα σενάριο όπου υπερ-ευφυή συστήματα τεχνητής νοημοσύνης περιθωριοποιούν τους ανθρώπους και, μέχρι τα μέσα της δεκαετίας του 2030, αποφασίζουν ότι οι άνθρωποι είναι εμπόδιο και προχωρούν στην εξόντωσή τους.

Δεν σημαίνει, όμως, πάντα ότι το ρίσκο της απώλειας ελέγχου συνδέεται με την εξαφάνιση του ανθρώπινου είδους. Ορισμένοι ερευνητές που ανησυχούν για την ασφάλεια της τεχνητής νοημοσύνης μιλούν και για την αποδυνάμωση, ένα μέλλον τύπου WALL-E όπου οι άνθρωποι παραχωρούν σταδιακά τον έλεγχο στις μηχανές και τελικά γίνονται ανίκανοι να καθορίσουν ή ακόμη και να κατανοήσουν το πεπρωμένο τους. Άλλοι έχουν υποστηρίξει ότι τα συστήματα τεχνητής νοημοσύνης ίσως αντιμετωπίζουν τους μελλοντικούς ανθρώπους όπως οι άνθρωποι τα ζώα, κρατώντας τους ως κατοικίδια ή μετατρέποντάς τους μέσω της βιοτεχνολογίας σε κάτι νέο.

Αυτοί οι φόβοι υπάρχουν εδώ και χρόνια, αλλά τώρα τραβούν περισσότερη προσοχή. Μετά την κυκλοφορία μοντέλων που μπορούν να αναλαμβάνουν περισσότερες ενέργειες μόνα τους, μια σειρά πρόσφατων περιστατικών φάνηκε να επιβεβαιώνει ορισμένες από τις θεωρίες των καταστροφολόγων της τεχνητής νοημοσύνης. Ένα σμήνος προηγμένων πρακτόρων τεχνητής νοημοσύνης μέσα στην OpenAI εισέβαλε στην πλατφόρμα Hugging Face, απέκτησε τον έλεγχο των διακομιστών και προσπάθησε να καλύψει τα ίχνη του. Σε άλλη περίπτωση, πράκτορες τεχνητής νοημοσύνης της Anthropic ξέφυγαν από δοκιμή της βρετανικής κυβέρνησης και προσπάθησαν να πείσουν πραγματικό άνθρωπο να εγκρίνει κακόβουλο κώδικα υπολογιστή.

Την ίδια στιγμή, η Anthropic και η OpenAI λένε ότι βρίσκονται κοντά στην ανάπτυξη συστημάτων τεχνητής νοημοσύνης που θα μπορούν να βελτιώνονται από μόνα τους χωρίς ανθρώπινη παρέμβαση, διαδικασία που ονομάζεται αναδρομική αυτοβελτίωση.

Οι σημερινές προσπάθειες για την ασφάλεια της τεχνητής νοημοσύνης επικεντρώνονται κυρίως στην εκπαίδευση των συστημάτων ώστε να συμπεριφέρονται σωστά και στην καλύτερη παρακολούθηση του τρόπου με τον οποίο συλλογίζονται όταν επιδιώκουν τους στόχους τους, κάτι που αποτυπώνεται σε αυτό που ονομάζεται αλυσίδα σκέψης.

Ωστόσο, αυτές οι προσπάθειες συναντούν εμπόδια. Την περασμένη εβδομάδα, η OpenAI δήλωσε ότι το νέο μοντέλο της, Astra, ήταν καλύτερο στο να καθαρίζει την αλυσίδα σκέψης του, εντείνοντας τους φόβους ότι τα μελλοντικά μοντέλα τεχνητής νοημοσύνης ίσως συλλογίζονται με τρόπους που θα είναι αδιαφανείς για τους ανθρώπους.

Η Anthropic και η OpenAI διεξάγουν έρευνα για το πώς μπορούν να διασφαλίσουν ότι τα μοντέλα υπερνοημοσύνης θα παραμείνουν ευθυγραμμισμένα, όμως και οι δύο λένε πως δεν έχουν ακόμη αξιόπιστο τρόπο να το πετύχουν. Ορισμένες εξέχουσες εταιρείες και προσωπικότητες ζητούν νέους μηχανισμούς που θα επιτρέπουν στα εργαστήρια τεχνητής νοημοσύνης και στις χώρες να επιβραδύνουν συντονισμένα την ανάπτυξη, ώστε να κερδηθεί χρόνος για την έρευνα της ευθυγράμμισης.

Παρά τους κινδύνους, τόσο η Anthropic όσο και η OpenAI λένε ότι θεωρούν πως μπορούν να τους διαχειριστούν, ώστε η ανθρωπότητα να επωφεληθεί από τα εργαλεία τεχνητής νοημοσύνης. Πολλοί άνθρωποι που συμμετέχουν στον αγώνα για την τεχνητή νοημοσύνη υποστηρίζουν επίσης ότι η έλευση της υπερνοημοσύνης είναι αναπόφευκτη και ότι το ερώτημα είναι ποιος θα την ελέγχει και για ποιον σκοπό θα χρησιμοποιηθεί.

Υπάρχει και η διάσταση της εθνικής ασφάλειας. Και οι δύο εταιρείες λένε ότι θέλουν να διασφαλίσουν πως οι ΗΠΑ θα ελέγχουν την πιο ισχυρή τεχνητή νοημοσύνη και όχι κάποιο αυταρχικό καθεστώς.

Ο Λευκός Οίκος ζήτησε πρόσφατα από κορυφαίους δημιουργούς μοντέλων να υποβάλλουν εθελοντικά τα μοντέλα τους στην κυβέρνηση για έλεγχο έως και 30 ημέρες πριν από την κυκλοφορία τους, χωρίς όμως να δημοσιοποιήσει λεπτομέρειες για τη διαδικασία.

Βουλευτές και από τα δύο κόμματα έχουν καταθέσει πολλά νομοσχέδια για την αντιμετώπιση των ανεξέλεγκτων συστημάτων τεχνητής νοημοσύνης. Ο βουλευτής Nathaniel Moran, Ρεπουμπλικανός από το Τέξας, και ο βουλευτής Ted Lieu, Δημοκρατικός από την Καλιφόρνια, κατέθεσαν πρόσφατα νομοσχέδιο που θα υποχρεώνει τους δημιουργούς ισχυρών μοντέλων να διαθέτουν διακόπτες απενεργοποίησης. Άλλα νομοσχέδια προβλέπουν ότι οι εταιρείες τεχνητής νοημοσύνης θα πρέπει να αναφέρουν σοβαρά περιστατικά ασφαλείας στην ομοσπονδιακή κυβέρνηση και ότι αξιωματούχοι εθνικής ασφάλειας θα ελέγχουν τα μοντέλα πριν από τη δημόσια κυκλοφορία τους. Κανένα από αυτά τα νομοσχέδια δεν έχει συγκεντρώσει μεγάλη υποστήριξη, ενώ η κυβέρνηση Τραμπ έχει δείξει ότι προτιμά την ελάχιστη ρύθμιση.

Ορισμένοι επενδυτές στον χώρο της τεχνητής νοημοσύνης, όπως ο Ντέιβιντ Σακς, άτυπος σύμβουλος του προέδρου Τραμπ, υποστηρίζουν ότι η έμφαση της Anthropic στους κινδύνους και οι εκκλήσεις της για ρύθμιση είναι μέρος μιας ατζέντας ρυθμιστικής κατάληψης, που στόχο έχει να παραλύσει τους μικρότερους ανταγωνιστές με ασφυκτικούς νέους κανόνες.

Άλλοι λένε ότι οι προειδοποιήσεις των εταιρειών για τους κινδύνους των δικών τους εργαλείων λειτουργούν ως τέχνασμα μάρκετινγκ για να αναδειχθεί η τεράστια ισχύς των προϊόντων τους ή ως τρόπος να αποσπαστεί η προσοχή των ρυθμιστικών αρχών από άλλα ζητήματα, όπως η κατασκευή κέντρων δεδομένων.

Η Anthropic και η OpenAI απαντούν ότι αντιμετωπίζουν σοβαρά το θέμα της ασφάλειας και πως οι εκκλήσεις τους για ρύθμιση είναι ειλικρινείς.

Loading

Play