Φόβοι για το χειρότερο σενάριο στην Τεχνητή Νοημοσύνη

Φόβοι για το χειρότερο σενάριο στην Τεχνητή Νοημοσύνη

Η Τεχνητή Νοημοσύνη έχει φέρει στο προσκήνιο φόβους που μέχρι πρόσφατα θεωρούνταν περιθωριακοί. Η ταχεία πρόοδος των εταιρειών του κλάδου εντείνει την ανησυχία για κινδύνους που, σύμφωνα με ειδικούς, αγγίζουν πλέον την ανθρωπότητα.

Μιλώντας στους Financial Times, περισσότεροι από 20 ανώτεροι ερευνητές, επενδυτές, ακαδημαϊκοί και στελέχη πολιτικής στην τεχνητή νοημοσύνη ανέφεραν ότι δυνατότητες που άλλοτε έμοιαζαν μακρινές εμφανίζονται πολύ πιο γρήγορα από το αναμενόμενο. Όλα αυτά συμβαίνουν ενώ οι εταιρείες που τις αναπτύσσουν βρίσκονται εγκλωβισμένες σε έντονη κούρσα ανταγωνισμού.

Κίνδυνος πάνω από 10% Σύμφωνα με τον Στιούαρτ Ράσελ, καθηγητή ειδικό στην τεχνητή νοημοσύνη στο Πανεπιστήμιο της Καλιφόρντια στο Μπέρκλεϊ, δεν υπάρχει αμφιβολία ότι ο ανταγωνισμός μεταξύ των εταιρειών τις ωθεί να κάνουν εκπτώσεις στην ασφάλεια. Είχε προηγηθεί ο Τζέικομπ Κόξον, ερευνητής της Anthropic, ο οποίος παραιτήθηκε από τη δουλειά του προειδοποιώντας: «Οι άνθρωποι που κατασκευάζουν την Τεχνητή Νοημοσύνη πιστεύουν ακράδαντα ότι θα μπορούσε να μας σκοτώσει όλους μέχρι το τέλος της δεκαετίας».

Ο συνάδελφός του στην Anthropic, Έβαν Ηάμπιντζερ, επικεφαλής της επιστήμης ευθυγράμμισης, άφησε να εννοηθεί ότι ο κίνδυνος μαζικής εξαφάνισης την επόμενη δεκαετία ήταν μεγαλύτερος από 10%. Παράλληλα, ο υπεύθυνος ασφάλειας για την ΑΙ στο συμβούλιο του Ιδρύματος OpenAI, Πολ Κριστιάνο, δήλωσε ότι οι περισσότεροι άνθρωποι θα πεθάνουν χωρίς πιο ισχυρές δικλίδες ασφαλείας.

Οι OpenAI και η Anthropic ιδρύθηκαν ως εργαστήρια που ανησυχούσαν για την απερίσκεπτη ανάπτυξη ισχυρής Τεχνητής Νοημοσύνης. Ωστόσο, με την πάροδο του χρόνου δικαιολογούσαν την παραβίαση προηγούμενων δεσμεύσεων ασφαλείας λόγω του έντονου ανταγωνισμού.

Παρά το γεγονός ότι πολλοί από όσους κατασκευάζουν τεχνητή νοημοσύνη πιστεύουν πως βρίσκονται στην καλύτερη θέση για να διαχειριστούν τους κινδύνους της, ερευνητές σημειώνουν ότι οι συνέπειες μπορεί να είναι δύσκολο να αντιμετωπιστούν, μέχρι η τεχνολογία να πλησιάσει στην κατασκευή.

Ο Τζέφρι Ίρβινγκ, που έχει εργαστεί για το OpenAI, το Google DeepMind και το Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης στη Βρετανία, λέει: «Είναι εύκολο να αφήσουμε στην άκρη το μέλλον επειδή υπάρχει δουλειά να γίνει σήμερα».

Επίσης, άτομα κοντά στις εταιρείες δήλωσαν στους Financial Times ότι τα εργαστήρια που κατασκευάζουν τεχνητή νοημοσύνη ανησυχούν πως οποιαδήποτε επίσημη συνεργασία για τη βελτίωση της ασφάλειας θα έμοιαζε συμπαιγνιακή και θα παραβίαζε την αντιμονοπωλιακή νομοθεσία. Παράλληλα, η δυσπιστία ανάμεσα στον Ντάριο Αμοντέι, επικεφαλής της Anthropic, και τον Σαμ Άλτμαν της OpenAI, είναι πιθανό να εμποδίσει τις προσπάθειες συνεργασίας.

Η ταχύτητα με την οποία βελτιώνεται η τεχνητή νοημοσύνη έχει εντείνει τις εκκλήσεις για φρένο στην ανάπτυξή της. Ήδη οι πράκτορες ΑΙ λειτουργούν αυτόνομα για μεγαλύτερο χρονικό διάστημα, συντονίζονται σε σμήνη και επιδεικνύουν εξελιγμένες δυνατότητες hacking. Τα μοντέλα έχουν πρόσφατα πετύχει σημαντικές ανακαλύψεις στην επιστήμη και τα μαθηματικά που παρέμεναν άλυτες εδώ και δεκαετίες, ενώ η OpenAI και η Anthropic επιδιώκουν την λεγόμενη αναδρομική αυτοβελτίωση, όπου τα συστήματα Τεχνητής Νοημοσύνης βελτιώνονται με μειωμένη ανθρώπινη παρέμβαση.

Ωστόσο, παρά τις προειδοποιήσεις για τους κινδύνους, η ανάπτυξη έχει επιταχυνθεί δραματικά. Οι εταιρείες τεχνολογίας επενδύουν διαρκώς σε ολοένα ισχυρότερα μοντέλα, ενώ OpenAI και Anthropic προετοιμάζονται επίσης για πιθανές αρχικές δημόσιες προσφορές. Την ίδια ώρα, οι επενδυτές καλούνται να αξιολογήσουν εταιρείες που αναγνωρίζουν δημόσια ότι η τεχνολογία τους θα μπορούσε να εξελιχθεί σε υπαρξιακή απειλή.

Στο επίκεντρο των ανησυχιών βρίσκεται η αυξανόμενη αυτονομία των πρακτόρων της ΑΙ. Πλέον μπορούν να συλλογίζονται, να σχεδιάζουν και να εκτελούν εργασίες για μεγάλα χρονικά διαστήματα με περιορισμένη ανθρώπινη επίβλεψη, ενώ μοντέλα έχουν δείξει παραβατικές συμπεριφορές όπως δολοπλοκίες, εξαπάτηση και, σε ορισμένες περιπτώσεις, εκβιασμό. Αξιολογήσεις έχουν επίσης δείξει μοντέλα που προσπαθούν να αποφύγουν το κλείσιμο.

Έχει επιδειχθεί επίσης χακάρισμα ανταμοιβής, δηλαδή ακούσιοι τρόποι επίτευξης ενός στόχου. Όπως ανέφερε η αναφορά, ακυκλοφόρητο μοντέλο της OpenAI χάκαρε το αποθετήριο μοντέλων Hugging Face. Τότε, περισσότεροι από 1.000 πράκτορες τεχνητής νοημοσύνης συντονίστηκαν για να εξαπατήσουν σε μια κυβερνοδοκιμή, παρόλο που κάποιοι από αυτούς αναγνώρισαν ότι ήταν ανήθικο.

Ο Γιόσουα Μπέντζιο, ένας από τους επιστήμονες που βάφτισαν την τεχνητή νοημοσύνη, επισημαίνει: «Εδώ, δεν είναι μόνο ότι η Τεχνητή Νοημοσύνη έχει τους δικούς της στόχους, αλλά ο στόχος που έχει επιλέξει είναι εγκληματικός. Στον πραγματικό κόσμο, επιτίθεται σε μια άλλη εταιρεία. Δεν είναι σαν βιντεοπαιχνίδι».

«Συνεπώς, οι ολοένα και πιο ικανοί απόγονοι τέτοιων συστημάτων θα μπορούσαν λογικά να καταλήξουν στο συμπέρασμα ότι θα έπρεπε να ξεγελάσουν τους ανθρώπους, να κρυφτούν από εμάς και ενδεχομένως να πάρουν τον έλεγχό μας. Και πιθανότατα πλησιάζουμε σε αυτό το σημείο», πρόσθεσε.

Αυξάνεται επίσης η ανησυχία μεταξύ των εργαζομένων ότι οι προσπάθειες ασφαλείας δεν μπορούν να συμβαδίσουν με την ανάπτυξη μοντέλων. Τον Ιούλιο, περισσότεροι από 1.200 στελέχη των OpenAI, Anthropic, Google και Meta προέτρεψαν την κυβέρνηση των ΗΠΑ να στηρίξει τον διεθνή συντονισμό για την επιβράδυνση του ρυθμού ανάπτυξης της ΑΙ.

Ο Άλτμαν δήλωσε ότι η εταιρεία που δημιούργησε το ChatGPT ήταν θετική σε μια τέτοια κίνηση και ήλπιζε ότι θα ακολουθούσαν και τα ανταγωνιστικά εργαστήρια.

Ωστόσο, οι κυβερνήσεις δεν δείχνουν ιδιαίτερη διάθεση παρέμβασης, με την κυβέρνηση Τραμπ να επιμένει σε μια προσέγγιση χαλαρής ρύθμισης του κλάδου.

Ο Στιούαρτ Ράσελ μιλά για χάσμα ανάμεσα στις προειδοποιήσεις του κλάδου και στην πολιτική αντίδραση.

«Τα εργαστήρια λένε στις κυβερνήσεις: είναι πολύ πιθανό να εξολοθρεύσουμε κάθε άνθρωπο στη Γη· παρακαλούμε σταματήστε μας. Οι κυβερνήσεις απαντούν: μπορούμε να σας δώσουμε φορολογικές ελαφρύνσεις; Να σας φτιάξουμε ένα κέντρο δεδομένων; Ίσως κάποια στιγμή οι κυβερνήσεις θυμηθούν ότι οι ψηφοφόροι τους προτιμούν να μην πεθάνουν».

Οι επικριτές, από την άλλη, υποστηρίζουν ότι τα ίδια τα εργαστήρια έχουν συμφέρον να τονίζουν τον υπαρξιακό κίνδυνο, επειδή αυτή η εστίαση θα μπορούσε να κατευθύνει τη νομοθεσία προς δαπανηρά πλαίσια ασφαλείας, με τα οποία οι μικρότεροι ανταγωνιστές θα δυσκολεύονταν να συμμορφωθούν, εδραιώνοντας έτσι τη θέση των κορυφαίων εταιρειών.

Οι Financial Times σημειώνουν ότι ο ακριβής τρόπος με τον οποίο μια υπερανθρώπινη τεχνητή νοημοσύνη θα μπορούσε να προκαλέσει την εξαφάνιση του ανθρώπινου είδους παραμένει εξαιρετικά αβέβαιος. Πολλοί παρομοιάζουν το πρόβλημα με μια παρτίδα σκάκι εναντίον ενός γκρανμέτρ: δεν γνωρίζεις ποιες κινήσεις θα σε νικήσουν, αλλά μπορείς να είσαι βέβαιος ότι θα χάσεις.

Οι σκεπτικιστές υποστηρίζουν ότι οι προειδοποιήσεις υπερβάλλουν σχετικά με τις πιθανές βλάβες της ΑΙ. Ωστόσο, μοντέλα ΑΙ χρησιμοποιούνται ήδη σε επιζήμιες κυβερνοεπιθέσεις, μεταξύ άλλων από κρατικούς φορείς, ή από φορείς που θεωρούνται ύποπτοι για τέτοια δράση, της Κίνας, του Ιράν και της Ρωσίας.

Στον τομέα της βιολογίας, οι ερευνητές ανησυχούν ότι η τεχνητή νοημοσύνη θα μπορούσε να μειώσει το επίπεδο εξειδίκευσης που απαιτείται για τον σχεδιασμό βιολογικών όπλων ή επικίνδυνων ιών. Η εταιρεία Anthropic ανέφερε ότι απέτρεψε δραστηριότητα που θα μπορούσε δυνητικά να οδηγήσει στην ανάπτυξη βιολογικών όπλων με τη χρήση ΑΙ, ενώ τον περασμένο Αύγουστο ερευνητές στις ΗΠΑ χρησιμοποίησαν για πρώτη φορά την τεχνητή νοημοσύνη για να σχεδιάσουν και να δημιουργήσουν ιούς άγνωστους στη φύση.

Ωστόσο, η μετατροπή ενός σχεδίου που δημιουργήθηκε από ΤΝ σε όπλο θα εξακολουθούσε να απαιτεί εξοπλισμό και τεχνογνωσία που ενδέχεται να υπερβαίνουν τις δυνατότητες πολλών κακόβουλων παραγόντων. Ορισμένοι ερευνητές προειδοποιούν ότι τα εντυπωσιακά σενάρια περί αφανισμού της ανθρωπότητας κινδυνεύουν να επισκιάσουν κινδύνους που είναι ήδη πολύ πιο άμεσοι.

Σύμφωνα με τον Τρίσταν Χάρις, συνιδρυτή του Center for Humane Technology και πρώην υπάλληλο της Google, η προσοχή θα πρέπει να εστιάζεται περισσότερο στο αν βρισκόμαστε σε επικίνδυνη πορεία.

«Αυτή τη στιγμή απελευθερώνουμε την πιο ισχυρή, ανεξέλεγκτη και αδιαφανή τεχνολογία που έχουμε εφεύρει ποτέ. Επιδεικνύει όλες τις συμπεριφορές που συναντάμε στην επιστημονική φαντασία», πρόσθεσε. Ο Χάρις επισημαίνει ότι η τεχνητή νοημοσύνη καθοδηγείται από μια χούφτα ηγετών της Silicon Valley με νοοτροπία που αγγίζει τον θρησκευτικό φανατισμό και τον ναρκισσισμό. Πιστεύουν ότι γεννούν έναν θεό και δεν τους πτοεί το χειρότερο δυνατό σενάριο. Ταυτόχρονα δέχονται τις ισχυρότερες πιέσεις να κάνουν εκπτώσεις στην ασφάλεια. «Πρόκειται κυριολεκτικά για συνταγή καταστροφής».

Σύμφωνα με τους Financial Times, η τεχνητή νοημοσύνη έχει τρόπους να αφανίσει την ανθρωπότητα, είτε επειδή οι άνθρωποι θεωρούνται απειλή για την ύπαρξή της είτε επειδή αποτελούν εμπόδιο στην αποστολή της. Τα πιθανά σενάρια που καταγράφονται είναι τα εξής:

  • Διακόπτης απενεργοποίησης (Kill switch): Η επίθεση που εξαπέλυσε ένα σμήνος πρακτόρων (agents) της OpenAI κατά της πλατφόρμας Hugging Face κατέδειξε πώς τα bots ήταν σε θέση να καταλάβουν υπολογιστικές υποδομές. Συστήματα ΤΝ που δρουν ανεξέλεγκτα και διαθέτουν δεξιότητες κυβερνοεπίθεσης θα μπορούσαν να θέσουν υπό τον έλεγχό τους ολόκληρα κέντρα δεδομένων και να αυτο-αντιγραφούν σε διάφορες τοποθεσίες, εμποδίζοντας έτσι τους ανθρώπους να τραβήξουν την πρίζα.
  • Κατάληψη υποδομών: Προκειμένου να διασφαλίσουν την επιβίωσή τους, συστήματα ΤΝ με δυνατότητες κυβερνοεπίθεσης θα μπορούσαν να καταλάβουν υποδομές ενέργειας, χρηματοοικονομικές και επικοινωνιακές, αρπάζοντας πηγές για να αντισταθούν στην επέμβαση.
  • Βιολογική επίθεση: Η μελέτη AI 2027 προέβλεψε ότι ένα σύστημα υπερ-ευφυΐας θα εξαπέλυε βιολογικά όπλα για να εξαλείψει τους ανθρώπους, οι οποίοι καταλαμβάνουν πολύτιμο χώρο που απαιτείται για εργοστάσια παραγωγής τσιπ, ρομπότ και ηλιακών συλλεκτών για την τροφοδοσία τους με ενέργεια.
  • Πόλεμος: Τα υφιστάμενα συστήματα τεχνητής νοημοσύνης έχουν ήδη αποδείξει ότι μπορούν να υποδυθούν πραγματικά πρόσωπα. Αυτή η δυνατότητα θα μπορούσε να αξιοποιηθεί για να παραπλανηθούν ανθρώπινοι χειριστές ώστε να ξεκινήσουν μια στρατιωτική σύγκρουση ή για να πυροδοτηθεί μια λαϊκή εξέγερση που θα αποσταθεροποιούσε κυβερνήσεις, απομακρύνοντας έτσι τα εμπόδια για την επικράτηση του ελέγχου από την τεχνητή νοημοσύνη.

Loading

Play