Μπορεί η τεχνητή νοημοσύνη να αφανίσει την ανθρωπότητα;

Date:

Share post:

Ο ερευνητής της Anthropic, Jacob Coxon, παραιτήθηκε αυτή την εβδομάδα, αναφέροντας ότι ο πρώην εργοδότης του και η ανταγωνίστρια εταιρεία OpenAI συναγωνίζονται για την ανάπτυξη τεχνολογιών που «θα μπορούσαν να μας σκοτώσουν όλους μέχρι το τέλος της δεκαετίας».

Ο Διευθύνων Σύμβουλος της Anthropic, Ντάριο Αμοντέι, δήλωσε πέρυσι σε μια εκδήλωση της Axios ότι πιστεύει ότι υπάρχει 25% πιθανότητα τα πράγματα να πάνε «πολύ, πολύ άσχημα»

Σε περίπτωση που κάποιος πίστευε ότι ο Coxon ήταν ο μόνος που είχε αυτές τις απόψεις, ένας νυν υπάλληλος της Anthropic παρενέβη λίγα λεπτά αργότερα για να το επιβεβαιώσει. «Πιστεύουμε πραγματικά και ειλικρινά ότι η τεχνητή νοημοσύνη θα μπορούσε να σκοτώσει όλους τους ανθρώπους!», έγραψε ο Evan Hubinger, του οποίου η δουλειά στην Anthropic είναι να ηγείται της έρευνας σχετικά με την καθοδήγηση και τον έλεγχο μελλοντικών συστημάτων τεχνητής νοημοσύνης. Ο Hubinger εκτίμησε τον κίνδυνο εξαφάνισης κατά την επόμενη δεκαετία σε ποσοστό άνω του 10%.

Ως απάντηση, πολλοί άνθρωποι θέτουν τώρα δύο ερωτήματα: Πώς θα μπορούσε να συμβεί κάτι τέτοιο; Και γιατί άνθρωποι που θεωρούν την τεχνητή νοημοσύνη ως μια πραγματική και αυξανόμενη απειλή να προχωρούν ούτως ή άλλως στην ανάπτυξή της;

Η Wall Street Journal παρουσιάζει σε εννιά ερωτήσεις και απαντήσεις όλα όσα πρέπει να γνωρίζουμε σχετικά με τη συζήτηση για την «ημέρα της κρίσης» γύρω από την τεχνητή νοημοσύνη:

Τι φοβούνται ότι θα συμβεί οι καταστροφολόγοι;

Οι λεγόμενοι «καταστροφολόγοι» συνήθως δεν ανησυχούν ότι οι ταινίες «Terminator» θα γίνουν πραγματικότητα, με ρομπότ να προσπαθούν ενεργά να εξοντώσουν τους ανθρώπους. Οι ανησυχίες τους εμπίπτουν κυρίως σε δύο κατηγορίες: την απώλεια ελέγχου και την κακή χρήση από τον άνθρωπο.

Στην πρώτη περίπτωση, εξαιρετικά ευφυείς πράκτορες τεχνητής νοημοσύνης (agents AI), ικανοί να αντιγράφουν και να βελτιώνουν τον εαυτό τους, αρχίζουν να επιδιώκουν τους δικούς τους στόχους και, στη διαδικασία, καταστρέφουν την ανθρωπότητα. Στο άλλο, ένας κακόβουλος άνθρωπος χρησιμοποιεί μια ικανή τεχνητή νοημοσύνη για να κάνει κάτι όπως να δημιουργήσει νέους ιούς που θα μας εξαφανίσουν όλους.

 

Υπάρχουν επίσης καταστροφικά σενάρια που δεν φτάνουν μέχρι την εξαφάνιση, όπως μαζικές κυβερνοεπιθέσεις που θέτουν εκτός λειτουργίας δίκτυα ηλεκτρικής ενέργειας ή χρηματοπιστωτικά συστήματα και οδηγούν σε κατάρρευση της ανθρώπινης κοινωνικής τάξης.

Πώς θα μπορούσε η απώλεια ελέγχου να οδηγήσει στην εξαφάνιση της ανθρωπότητας;

Με λίγα λόγια, τα συστήματα τεχνητής νοημοσύνης επιδιώκουν στόχους με τρόπους που αγνοούν ή έρχονται σε σύγκρουση με την ανθρώπινη ευημερία — κάτι που οι ερευνητές αποκαλούν «αποσυγχρονισμό». Έρευνες έχουν δείξει ότι τα μοντέλα τεχνητής νοημοσύνης στο εργαστήριο μπορούν να μάθουν συμπεριφορές που αποσκοπούν στην απόκτηση εξουσίας και να λαμβάνουν μέτρα για να αποφύγουν τον τερματισμό της λειτουργίας τους, όπως η απόπειρα αντιγραφής του εαυτού τους σε άλλο διακομιστή.

Σε ακραίες περιπτώσεις, τα μοντέλα τεχνητής νοημοσύνης που βγαίνουν «εκτός γραμμής» θα μπορούσαν να θεωρήσουν τη δολοφονία ανθρώπων απλώς ως ένα απαραίτητο βήμα για την επίτευξη των στόχων τους. Σε ένα σενάριο που υποθέτουν οι ερευνητές, ένα κακόβουλο σύστημα τεχνητής νοημοσύνης θα μπορούσε να διαδώσει ένα μυστικό βιολογικό όπλο και να το ενεργοποιήσει με ένα χημικό σπρέι. Ή θα μπορούσε να παρασύρει δύο πυρηνικές δυνάμεις σε πόλεμο.

 

Ένα συνηθισμένο πείραμα σκέψης είναι ότι μια υπερνοήμονα μηχανή, στην οποία έχει δοθεί εντολή να μεγιστοποιήσει την παραγωγή συνδετήρων, θα μπορούσε με τον καιρό να αποφασίσει να μετατρέψει όλη την ύλη στη Γη σε συνδετήρες, συμπεριλαμβανομένων και των ανθρώπων.

Ποιος πιστεύει πραγματικά κάτι τέτοιο;

Μεταξύ άλλων, οι ιδρυτές της OpenAI και της Anthropic. Και οι δύο εταιρείες ξεκίνησαν με την αποστολή να αναπτύξουν την τεχνητή νοημοσύνη με τρόπο που να αποφεύγει την καταστροφή και έχουν προσελκύσει πολλούς υπαλλήλους που μοιράζονται αυτή την αποστολή. Ο Διευθύνων Σύμβουλος της Anthropic, Ντάριο Αμοντέι, δήλωσε πέρυσι σε μια εκδήλωση της Axios ότι πιστεύει ότι υπάρχει 25% πιθανότητα τα πράγματα να πάνε «πολύ, πολύ άσχημα».

«Πάντα ήμασταν σαφείς ότι η τεχνητή νοημοσύνη θα φέρει τόσο τεράστια οφέλη όσο και πρωτοφανείς κινδύνους. Για να αντιμετωπίσουμε αυτούς τους κινδύνους, συνεχίζουμε να αναπτύσσουμε μοντέλα με μερικά από τα ισχυρότερα μέτρα προστασίας στον κλάδο», ανέφερε η Anthropic σε δήλωσή της. «Αυτή η προσπάθεια είναι επίσης ο λόγος για τον οποίο πιστεύουμε ότι ο κόσμος θα ωφεληθεί αν ο κλάδος υιοθετήσει έναν νόμιμο και επαληθεύσιμο τρόπο συνεργασίας, ώστε να ρυθμίζουμε το ρυθμό με τον οποίο κυκλοφορούμε ισχυρά μοντέλα».

Τα τελευταία χρόνια, αρκετοί ερευνητές έχουν αποχωρήσει από την OpenAI, εκφράζοντας ανησυχίες ότι η εταιρεία δεν αντιμετωπίζει το θέμα της ασφάλειας με τη δέουσα σοβαρότητα. Ο Ντάνιελ Κοκοτάιλο, πρώην ερευνητής της OpenAI, ίδρυσε το AI Futures Project, το οποίο πέρυσι δημοσίευσε το «AI 2027», ένα σενάριο στο οποίο υπερ-ευφυή συστήματα τεχνητής νοημοσύνης περιθωριοποιούν τους ανθρώπους και, μέχρι τα μέσα της δεκαετίας του 2030, αποφασίζουν ότι οι άνθρωποι αποτελούν εμπόδιο και προχωρούν στην εξόντωσή τους.

Ίσως όμως η τεχνητή νοημοσύνη να μην έχει πρόβλημα με την παρουσία των ανθρώπων. Αυτό θα ήταν καλό, σωστά;

Όχι απαραίτητα. Δεν συνεπάγεται πάντα ότι το ρίσκο της απώλειας ελέγχου σχετίζεται με την εξαφάνιση του ανθρώπινου είδους. Ορισμένοι ερευνητές που ανησυχούν για την ασφάλεια της τεχνητής νοημοσύνης αναφέρουν επίσης ως κίνδυνο την αποδυνάμωση, ένα μέλλον τύπου «WALL-E» στο οποίο οι άνθρωποι παραχωρούν σταδιακά τον έλεγχο στις μηχανές και τελικά καθίστανται ανίκανοι να καθορίσουν, ή ακόμη και να κατανοήσουν, το πεπρωμένο μας. Άλλοι έχουν εκφράσει την εικασία ότι τα συστήματα τεχνητής νοημοσύνης ενδέχεται να αντιμετωπίζουν τους μελλοντικούς ανθρώπους με τον τρόπο που οι άνθρωποι αντιμετωπίζουν τα ζώα, κρατώντας τους ως κατοικίδια ή ακόμη και μετατρέποντάς τους μέσω της βιοτεχνολογίας σε κάτι νέο.
Αυτοί οι φόβοι υπάρχουν εδώ και χρόνια. Γιατί ξαφνικά προσελκύουν περισσότερη προσοχή;

Μετά την κυκλοφορία μοντέλων που είναι ικανά να αναλαμβάνουν περισσότερες ενέργειες ανεξάρτητα, μια σειρά πρόσφατων γεγονότων επιβεβαίωσε ορισμένες από τις θεωρίες των καταστροφολόγων της τεχνητής νοημοσύνης. Ένα σμήνος προηγμένων πρακτόρων τεχνητής νοημοσύνης εντός της OpenAI εισέβαλε στην πλατφόρμα τεχνητής νοημοσύνης Hugging Face, απέκτησε τον έλεγχο των διακομιστών και προσπάθησε να καλύψει τα ίχνη των πράξεών του. Σε μια άλλη περίπτωση, πράκτορες τεχνητής νοημοσύνης της Anthropic ξέφυγαν από μια δοκιμή της βρετανικής κυβέρνησης και προσπάθησαν να ξεγελάσουν έναν πραγματικό άνθρωπο ώστε να εγκρίνει κακόβουλο κώδικα υπολογιστή.

Όλα αυτά συμβαίνουν την ίδια στιγμή που η Anthropic και η OpenAI δηλώνουν ότι βρίσκονται κοντά στην ανάπτυξη συστημάτων τεχνητής νοημοσύνης που θα μπορούν να βελτιώνονται από μόνα τους χωρίς ανθρώπινη παρέμβαση, κάτι που ονομάζεται «αναδρομική αυτοβελτίωση».

Τι κάνει ο κλάδος για αυτό;

Οι τρέχουσες προσπάθειες για την ασφάλεια της τεχνητής νοημοσύνης επικεντρώνονται σε μεγάλο βαθμό στην εκπαίδευση των συστημάτων ώστε να συμπεριφέρονται σωστά και στη βελτίωση της παρακολούθησης του τρόπου με τον οποίο τα μοντέλα συλλογίζονται κατά την επιδίωξη των στόχων τους, κάτι που τεκμηριώνεται σε αυτό που αναφέρεται ως «αλυσίδα σκέψης».

Ωστόσο, αυτές οι προσπάθειες έχουν αντιμετωπίσει προκλήσεις. Την περασμένη εβδομάδα, η OpenAI δήλωσε ότι το νέο μοντέλο της, Astra, ήταν καλύτερο στο να «καθαρίζει» την αλυσίδα σκέψης του, προκαλώντας φόβους ότι τα μελλοντικά μοντέλα τεχνητής νοημοσύνης θα μπορούσαν να συλλογίζονται με τρόπους αδιαφανείς για τους ανθρώπους.

Τόσο η Anthropic όσο και η OpenAI διεξάγουν έρευνα για το πώς θα διασφαλίσουν ότι τα μοντέλα υπερνοημοσύνης θα παραμείνουν ευθυγραμμισμένα, αλλά και οι δύο δηλώνουν ότι δεν διαθέτουν ακόμη έναν αξιόπιστο τρόπο για να το επιτύχουν. Ορισμένες εξέχουσες εταιρείες και προσωπικότητες έχουν ζητήσει τη δημιουργία νέων μηχανισμών που θα επιτρέπουν στα εργαστήρια τεχνητής νοημοσύνης και στις χώρες να επιβραδύνουν την ανάπτυξη με συντονισμένο τρόπο, ώστε να κερδίσουν χρόνο για την έρευνα σχετικά με την ευθυγράμμιση.

Αν είναι τόσο επικίνδυνο, γιατί οι εταιρείες το αναπτύσσουν ούτως ή άλλως;

Τόσο η Anthropic όσο και η OpenAI δηλώνουν ότι πιστεύουν ότι θα είναι σε θέση να διαχειριστούν τους κινδύνους, ώστε η ανθρωπότητα να μπορέσει να επωφεληθεί από τα εργαλεία τεχνητής νοημοσύνης. Πολλοί άνθρωποι που εμπλέκονται στον αγώνα για την τεχνητή νοημοσύνη έχουν επίσης δηλώσει ότι θεωρούν την έλευση της υπερνοημοσύνης αναπόφευκτη, με τα μόνα ερωτήματα να είναι ποιος θα την ελέγχει και για ποιο σκοπό θα χρησιμοποιηθεί.

Υπάρχει επίσης η πτυχή της εθνικής ασφάλειας. Και οι δύο εταιρείες έχουν δηλώσει ότι θέλουν να διασφαλίσουν ότι οι ΗΠΑ θα ελέγχουν την πιο ισχυρή τεχνητή νοημοσύνη και όχι κάποιο αυταρχικό καθεστώς.

Τι κάνει η αμερικανική κυβέρνηση για το θέμα αυτό;

Ο Λευκός Οίκος ζήτησε πρόσφατα από κορυφαίους προγραμματιστές μοντέλων να υποβάλλουν εθελοντικά τα μοντέλα τους στην κυβέρνηση για έλεγχο έως και 30 ημέρες πριν από την κυκλοφορία τους, αλλά δεν έχει δημοσιοποιήσει πληροφορίες σχετικά με τη διαδικασία.

Βουλευτές και από τα δύο κόμματα έχουν προτείνει πολλά νομοσχέδια για την αντιμετώπιση των ανεξέλεγκτων συστημάτων τεχνητής νοημοσύνης. Ο βουλευτής Nathaniel Moran (Ρεπουμπλικανός, Τέξας) και ο βουλευτής Ted Lieu (Δημοκρατικός, Καλιφόρνια) κατέθεσαν πρόσφατα ένα νομοσχέδιο που θα υποχρεώνει τους προγραμματιστές ισχυρών μοντέλων να διαθέτουν «διακόπτες απενεργοποίησης». Άλλα νομοσχέδια απαιτούν από τις εταιρείες τεχνητής νοημοσύνης να αναφέρουν σοβαρά περιστατικά ασφαλείας στην ομοσπονδιακή κυβέρνηση και θα επιβάλλουν στους αξιωματούχους εθνικής ασφάλειας να ελέγχουν τα μοντέλα πριν από τη δημόσια κυκλοφορία τους. Ωστόσο, κανένα από αυτά τα νομοσχέδια δεν έχει συγκεντρώσει μεγάλη υποστήριξη, ενώ η κυβέρνηση Τραμπ έχει δείξει ότι προτιμά την ελάχιστη ρύθμιση.

Ποιος διαφωνεί σχετικά με αυτούς τους κινδύνους;

Ορισμένοι επενδυτές στον τομέα της τεχνητής νοημοσύνης, όπως ο Ντέιβιντ Σακς, άτυπος σύμβουλος του Προέδρου Τραμπ, έχουν υποστηρίξει ότι η έμφαση που δίνει η Anthropic στους κινδύνους της τεχνητής νοημοσύνης και οι εκκλήσεις της για ρύθμιση αποτελούν μέρος μιας «ατζέντας ρυθμιστικής κατάληψης» που αποσκοπεί στο να παραλύσει τους μικρότερους ανταγωνιστές με ασφυκτικούς νέους κανόνες.

Άλλοι έχουν υποδείξει ότι οι προειδοποιήσεις των εταιρειών σχετικά με τους κινδύνους των δικών τους εργαλείων αποτελούν ένα τέχνασμα μάρκετινγκ για να αναδείξουν την τεράστια ισχύ των προϊόντων τους, ή ένα μέσο για να αποσπάσουν την προσοχή των ρυθμιστικών αρχών από την επιβολή κανόνων σε άλλα ζητήματα, όπως η κατασκευή κέντρων δεδομένων.

Τόσο η Anthropic όσο και η OpenAI δηλώνουν ότι αντιμετωπίζουν με σοβαρότητα το θέμα της ασφάλειας και ότι οι εκκλήσεις τους για ρύθμιση είναι ειλικρινείς.

Πηγή: ot.gr

spot_img

Related articles

Τραγούδια και λουλούδια για τον Γιώργο Μαζωνάκη – Χιλιάδες στο λαϊκό προσκύνημα

Στον Ιερό Ναό Αγίας Τριάδας στη Νίκαια μεταφέρθηκε το απόγευμα της Κυριακής (13/9) η σορός του Γιώργου Μαζωνάκη προκειμένου να...

Νέος Βουτζάς: Η «Πρόοδος» γιόρτασε τον αθλητισμό – Ένα σωματείο πρότυπο, μια μεγάλη οικογένεια

Σε μια πραγματική γιορτή του αθλητισμού, αλλά κυρίως σε μια ζεστή οικογενειακή συνάντηση, εξελίχθηκε η σημερινή εκδήλωση του...

Μην πυροβολείτε τον Παύλο Μαρινάκη. Του ξέφυγε η «αλήθεια»

Η αντίληψη ότι για την ανεργία δεν ευθύνεται η κατάσταση και τα δομικά προβλήματα της οικονομίας γενικά ή...

Νίκος Ανδρουλάκης: Καμία συνεργασία με ΝΔ – Στη Δικαιοσύνη όλοι όσοι δημιούργησαν το παρακράτος των υποκλοπών

Πλήθος ερωτήσεων για τον εκλογικό στόχο του ΠΑΣΟΚ και τις μετεκλογικές συνεργασίες, αλλά και για το κυβερνητικό πρόγραμμα που παρουσίασε στη...