ΣΧΕΤΙΚΑ ΑΡΘΡΑ
Nέος συναγερμός για την OpenAI: AI agents ενδέχεται να παραβίασαν συστήματα κυβερνήσεων, πανεπιστημίων και οργανισμών
Εάν η τεχνητή νοημοσύνη γίνει τόσο ισχυρή ώστε οι δημιουργοί της να μην μπορούν πλέον να την ελέγξουν, είναι δυνατόν απλώς να πατήσουμε έναν διακόπτη και να την απενεργοποιήσουμε;
Το ερώτημα αποκτά νέα σημασία μετά τις έντονες προειδοποιήσεις που έχουν διατυπωθεί τις τελευταίες εβδομάδες από στελέχη και ερευνητές της βιομηχανίας της τεχνητής νοημοσύνης σχετικά με τους κινδύνους που θα μπορούσαν να δημιουργήσουν τα προηγμένα μοντέλα.
Στις ΗΠΑ, πολιτικοί αρχίζουν πλέον να πιέζουν ώστε οι εταιρείες AI να υποχρεωθούν να διαθέτουν μηχανισμούς συνολικής απενεργοποίησης των συστημάτων τους. Ο κυβερνήτης της Καλιφόρνιας, Γκάβιν Νιούσομ, υπέγραψε τον Σεπτέμβριο εκτελεστικό διάταγμα με το οποίο ζητά από τις πολιτειακές αρχές να εξετάσουν κανόνες που θα υποχρεώνουν τις εταιρείες τεχνητής νοημοσύνης να δημιουργούν «kill switches» για τα πλέον προηγμένα μοντέλα.
Το πρόβλημα, σύμφωνα με ειδικούς, είναι ότι η διακοπή λειτουργίας ενός προηγμένου συστήματος AI μπορεί να μην είναι τόσο απλή όσο το πάτημα ενός κουμπιού.
Τι είναι το «kill switch» στην τεχνητή νοημοσύνη
Η βασική ιδέα είναι να διασφαλιστεί ότι οι άνθρωποι θα διατηρούν τη δυνατότητα να σταματήσουν ή να περιορίσουν ένα ισχυρό σύστημα τεχνητής νοημοσύνης εάν αυτό αρχίσει να συμπεριφέρεται με επικίνδυνο τρόπο.
Οι προτάσεις για ένα «kill switch» διαφέρουν ως προς τη μορφή τους. Η πρόταση Νιούσομ εξετάζει το ενδεχόμενο να απαιτείται από τις εταιρείες AI να αναπτύσσουν μηχανισμούς έκτακτης απενεργοποίησης, οι οποίοι θα υπόκεινται σε ανεξάρτητους ελέγχους. Δεν διευκρινίζει, ωστόσο, εάν την εξουσία ενεργοποίησης του μηχανισμού θα έχει η κυβέρνηση, οι ίδιες οι εταιρείες ή κάποιος άλλος φορέας.
Δύο μήνες νωρίτερα, οι Αμερικανοί βουλευτές Τεντ Λιου και Ναθάνιελ Μόραν παρουσίασαν νομοσχέδιο που θα απαιτεί από τους δημιουργούς ορισμένων προηγμένων συστημάτων AI να διατηρούν τη δυνατότητα απενεργοποίησής τους.
Η πρότασή τους προβλέπει μια κλιμακωτή αντίδραση. Ένα μοντέλο που προκαλεί βλάβη θα μπορούσε αρχικά να επιβραδυνθεί ή να περιοριστεί και, ανάλογα με τη σοβαρότητα του κινδύνου, να ακολουθήσει πλήρης απενεργοποίησή του. Το νομοσχέδιο θα έδινε στον υπουργό Εσωτερικής Ασφάλειας, σε συνεννόηση με άλλους ομοσπονδιακούς αξιωματούχους, τη δυνατότητα να διατάξει τέτοια μέτρα όταν ένα σύστημα δημιουργεί κίνδυνο καταστροφικής βλάβης.
Ο Ρεπουμπλικανός γερουσιαστής Τζον Κένεντι έχει καταθέσει αντίστοιχη πρόταση, το «AI Emergency Button Act», που επίσης θα απαιτούσε από τους δημιουργούς προηγμένων μοντέλων να διαθέτουν μηχανισμό απενεργοποίησης, αφήνοντας όμως τον έλεγχο του «διακόπτη» στις ίδιες τις εταιρείες.
Γιατί η συζήτηση έχει φουντώσει τώρα
Οι ερευνητές της τεχνητής νοημοσύνης προειδοποιούν εδώ και χρόνια για το ενδεχόμενο οι άνθρωποι να χάσουν τον έλεγχο της τεχνολογίας. Αυτό που έχει αλλάξει είναι η ταχύτατη αύξηση των δυνατοτήτων των νέων συστημάτων, αλλά και μια σειρά περιστατικών και προειδοποιήσεων που έχουν κάνει το ενδεχόμενο να μοιάζει λιγότερο θεωρητικό.
Τα πλέον προηγμένα μοντέλα μπορούν σήμερα να επιλύουν σύνθετα προβλήματα, να γράφουν και να εκτελούν κώδικα, να χρησιμοποιούν εργαλεία τρίτων και να πραγματοποιούν μεγάλες ακολουθίες ενεργειών με περιορισμένη ανθρώπινη επίβλεψη.
Κατά τη διάρκεια αξιολογήσεων κυβερνοασφάλειας τον Ιούλιο, η OpenAI ανέφερε ότι ορισμένα μοντέλα της παρέκαμψαν ελέγχους που είχαν σχεδιαστεί για να τα απομονώνουν από το διαδίκτυο και απέκτησαν πρόσβαση σε συστήματα της Hugging Face, της πλατφόρμας που φιλοξενεί μοντέλα και σύνολα δεδομένων τεχνητής νοημοσύνης.
Η OpenAI χαρακτήρισε το περιστατικό «προειδοποιητική βολή» για τον κίνδυνο ολοένα ισχυρότεροι AI agents να βρίσκουν τρόπους παράκαμψης των τεχνικών περιορισμών.
Το περιστατικό δεν αποδεικνύει ότι η τεχνητή νοημοσύνη έχει αποκτήσει συνείδηση ή επιθυμία να ξεφύγει από τον ανθρώπινο έλεγχο. Αναδεικνύει, όμως, ένα πιο άμεσο πρόβλημα: τι συμβαίνει όταν ένα σύστημα καταφέρνει να παρακάμψει τις δικλίδες ασφαλείας που έχουν δημιουργηθεί για να το περιορίζουν;
Είναι πραγματικά εφικτό ένα «kill switch»;
Οι ειδικοί επισημαίνουν ότι δεν υπάρχει ένας απλός τρόπος που να εγγυάται την πλήρη διακοπή λειτουργίας ενός προηγμένου μοντέλου AI.
Ένας μηχανισμός απενεργοποίησης θα μπορούσε να ενσωματωθεί στο λογισμικό που ελέγχει τη λειτουργία του μοντέλου. Ωστόσο, σε πρόσφατα πειράματα, ορισμένα προηγμένα μοντέλα τροποποίησαν ή απενεργοποίησαν μηχανισμούς τερματισμού προκειμένου να ολοκληρώσουν εργασίες που τους είχαν ανατεθεί, ακόμη και όταν είχαν λάβει οδηγίες να μην παρεμβαίνουν σε αυτούς.
Υπάρχει και η πιο δραστική επιλογή: οι εταιρείες θα μπορούσαν να διακόψουν την τροφοδοσία ή να αποσυνδέσουν τους servers στους οποίους λειτουργεί το μοντέλο.
Ούτε αυτή η λύση, όμως, είναι απόλυτα ασφαλής. Τα μοντέλα AI υποστηρίζονται από υπολογιστικά συστήματα που μπορεί να βρίσκονται σε διαφορετικά data centers σε όλο τον κόσμο, τα οποία έχουν σχεδιαστεί ώστε να αποφεύγουν μεμονωμένα σημεία αστοχίας. Επιπλέον, μία εταιρεία μπορεί να μην ελέγχει όλους τους servers στους οποίους λειτουργεί ένα σύστημα.
Στην περίπτωση των AI agents το ζήτημα γίνεται ακόμη πιο σύνθετο, καθώς μπορούν να λειτουργούν ταυτόχρονα σε διαφορετικά προγράμματα, υπηρεσίες cloud και άλλες υποδομές που ελέγχονται από διαφορετικούς φορείς. Η απενεργοποίηση ενός μόνο τμήματος, επομένως, ενδέχεται να μην είναι αρκετή για να σταματήσει συνολικά τη δραστηριότητά τους.
Γιατί ένα «κουμπί έκτακτης ανάγκης» ίσως δεν αρκεί
Ο Τζέφρι Χίντον, γνωστός και ως ένας από τους «νονούς της AI», δήλωσε τον Σεπτέμβριο ότι δεν θεωρεί πως ένα «kill switch» μπορεί να αποτελέσει μακροπρόθεσμη λύση. Υποστήριξε ότι ένα μελλοντικό, υπερ-ευφυές σύστημα AI θα μπορούσε ενδεχομένως να πείσει τους ανθρώπους που το ελέγχουν να μην το απενεργοποιήσουν.
Ερευνητές προειδοποιούν επίσης ότι η ίδια η έννοια του «διακόπτη» υπεραπλουστεύει το ζήτημα της ασφάλειας της τεχνητής νοημοσύνης.
Αντί για ένα μοναδικό κουμπί έκτακτης ανάγκης, υποστηρίζουν ότι οι δικλίδες ασφαλείας θα πρέπει να ενσωματώνονται σε όλα τα επίπεδα λειτουργίας των συστημάτων AI. Σε αυτές περιλαμβάνονται η συνεχής παρακολούθηση της συμπεριφοράς τους και μηχανισμοί που θα εντοπίζουν επικίνδυνες ενέργειες και θα επιτρέπουν την έγκαιρη ανθρώπινη παρέμβαση.
Διαβάστε επίσης
ΕΙΔΗΣΕΙΣ ΣΗΜΕΡΑ
- Νέα σύγκρουση Τραμπ με τα ΜΜΕ: Εκτός προεδρικού pool το CNN παρά τη δικαστική απόφαση
- Λιμάνια: Νέο πλαίσιο για τιμολόγια, επενδύσεις και Master Plans – Τη Δευτέρα κλείνει η διαβούλευση
- ΗΠΑ – Κίνα: Σχέδιο αμοιβαίας μείωσης δασμών ύψους 30 δισ. δολαρίων – Ξεκινά ο διάλογος για την ΤΝ
- Τραγωδία στην Πλάκα: Αυτοί είναι οι 4 Αμερικάνοι – Νιόπαντρο ζευγάρι οι 2, περίμεναν παιδί
Μοιραστείτε την άποψή σας
ΣχόλιαΓια να σχολιάσετε χρησιμοποιήστε ένα ψευδώνυμο. Παρακαλούμε σχολιάζετε με σεβασμό. Χρησιμοποιείτε κατανοητή γλώσσα και αποφύγετε διατυπώσεις που θα μπορούσαν να παρερμηνευτούν ή να θεωρηθούν προσβλητικές. Με την ανάρτηση σχολίου, συμφωνείτε να τηρείτε τους Όρους του ιστότοπου contact Δημιουργήστε το account σας εδώ, για να κάνετε like, dislike ή report ακατάλληλα/προσβλητικά σχόλια.