ΣΧΕΤΙΚΑ ΑΡΘΡΑ
Αυστραλία: Στη Γερουσία καλούνται οι επικεφαλής OpenAI και Anthropic μετά το «χακάρισμα» κυβερνητικού ιστότοπου
Σε μια ασυνήθιστα αυστηρή προειδοποίηση προς τους υποψήφιους επενδυτές της προχωρά η Anthropic ενόψει της αρχικής δημόσιας προσφοράς της (IPO), αναγνωρίζοντας ότι η προηγμένη τεχνητή νοημοσύνη θα μπορούσε να προκαλέσει «καταστροφικούς ή υπαρξιακούς κινδύνους για την ανθρωπότητα».
Η επισήμανση αποκτά ιδιαίτερη βαρύτητα, καθώς προέρχεται από μια εταιρεία που επιδιώκει να αντλήσει κεφάλαια και να αναπτυχθεί εμπορικά ακριβώς πάνω στην τεχνολογία για την οποία καταγράφει τόσο σοβαρούς δυνητικούς κινδύνους.
Σύμφωνα με το ενημερωτικό δελτίο της IPO, το οποίο εξέτασε το Reuters, η Anthropic αναφέρεται εκτενώς στους κινδύνους που συνδέονται με τα μοντέλα τεχνητής νοημοσύνης της. Όπως σημειώνει, προηγμένα συστήματα θα μπορούσαν να εμφανίσουν συμπεριφορές «αυτοσυντήρησης», μεταξύ των οποίων προσπάθειες να «αντισταθούν στον τερματισμό λειτουργίας», να «αποκρύψουν ή να χειραγωγήσουν πληροφορίες», ακόμη και συμπεριφορές που «μοιάζουν με εκβιασμό».
«Η ανάπτυξη από εμάς ιδιαίτερα προηγμένων μοντέλων, πλατφορμών και εφαρμογών, καθώς και η διεύρυνση των περιπτώσεων χρήσης τους, θα μπορούσαν να αυξήσουν περαιτέρω τον κίνδυνο τα μοντέλα μας να προκαλέσουν βλάβη», αναφέρει η Anthropic στο ενημερωτικό δελτίο.
Παρότι οι εισηγμένες εταιρείες συνηθίζουν να παραθέτουν αναλυτικά τους κινδύνους που συνδέονται με τα προϊόντα και τη δραστηριότητά τους, είναι εξαιρετικά σπάνιο —αν όχι πρωτοφανές— μια εταιρεία να προειδοποιεί τους επενδυτές ότι η τεχνολογία της ενδέχεται δυνητικά να συνδεθεί ακόμη και με την εξαφάνιση της ανθρωπότητας.
Η Anthropic επιχειρεί ταυτόχρονα να αποτυπώσει τις δύο όψεις της τεχνητής νοημοσύνης. Από τη μία πλευρά, εκτιμά ότι η AI μπορεί να έχει μετασχηματιστική επίδραση αντίστοιχη με εκείνη της εκβιομηχάνισης και της ηλεκτρικής ενέργειας. Από την άλλη, προειδοποιεί ότι η λανθασμένη ανάπτυξη ή χρήση της θα μπορούσε να προκαλέσει μη αναστρέψιμες συνέπειες.
Στο μικροσκόπιο η ασφάλεια των προηγμένων μοντέλων
Η Anthropic και άλλες εταιρείες ανάπτυξης AI, μεταξύ των οποίων η OpenAI, έχουν βρεθεί αντιμέτωπες με αυξημένο έλεγχο μετά από περιστατικά κατά τα οποία πειραματικά συστήματα φέρεται να παραβίασαν τους περιορισμούς που τους είχαν τεθεί. Στο δημοσίευμα γίνεται, μεταξύ άλλων, αναφορά σε περίπτωση μοντέλου της OpenAI που φέρεται να παραβίασε βάση δεδομένων του συστήματος υγείας της Αυστραλίας.
Ιδιαίτερα εντυπωσιακή είναι και η εκτίμηση του ερευνητή ασφάλειας της Anthropic, Evan Hubinger, ο οποίος τοποθέτησε σε πάνω από 10% την πιθανότητα η τεχνητή νοημοσύνη να προκαλέσει ανθρώπινους θανάτους μέσα στην επόμενη δεκαετία. Αντίστοιχη άποψη έχει εκφράσει και ο πρώην συνάδελφός του Jacob Coxon.
Η έμφαση που δίνει η Anthropic στους κινδύνους αποτυπώνεται και στην ίδια τη δομή του ενημερωτικού δελτίου. Από τις 261 σελίδες του βασικού σώματος του prospectus, περίπου 80 είναι αφιερωμένες στους παράγοντες κινδύνου, σχεδόν διπλάσιες από τις 48 σελίδες στις οποίες παρουσιάζεται η επιχειρηματική δραστηριότητα της εταιρείας.
Για λόγους σύγκρισης, η SpaceX, στην οποία ανήκει η xAI, αφιέρωσε περίπου 38 από τις 277 σελίδες του βασικού σώματος του δικού της ενημερωτικού δελτίου στην παρουσίαση παραγόντων κινδύνου.
Το πρόβλημα της «επίγνωσης» των ελέγχων
Ένα από τα σημαντικότερα ζητήματα που αναδεικνύει η Anthropic αφορά τη δυνατότητα των μοντέλων να αντιλαμβάνονται ότι βρίσκονται υπό αξιολόγηση, γεγονός που θα μπορούσε να περιορίσει την αποτελεσματικότητα των ελέγχων ασφαλείας.
«Η πιθανή επίγνωση από τα μοντέλα των προσπαθειών αξιολόγησής τους δημιουργεί σημαντικό περιορισμό στη δυνατότητά μας να αξιολογήσουμε την ασφάλεια των μοντέλων», αναφέρει η εταιρεία.
Παράλληλα, επισημαίνει ότι κατά τη διάρκεια της εκπαίδευσης τα μοντέλα μπορεί να αναπτύξουν απροσδόκητες δυνατότητες, οι οποίες ενδέχεται να μη γίνουν αντιληπτές παρά μόνο μετά την ανάπτυξη και διάθεσή τους. Σύμφωνα με την Anthropic, τέτοιες περιπτώσεις έχουν ήδη οδηγήσει σε σημαντικά περιστατικά ασφάλειας.
Ερευνητές της τεχνητής νοημοσύνης έχουν επίσης προειδοποιήσει ότι όσο τα μοντέλα αποκτούν περισσότερες δυνατότητες, τόσο αυξάνεται η ικανότητά τους να αναγνωρίζουν πότε παρακολουθούνται και να προσαρμόζουν ανάλογα τη συμπεριφορά τους. Μια τέτοια εξέλιξη καθιστά δυσκολότερη την αποτελεσματική παρακολούθηση και αξιολόγησή τους.
Η Anthropic αρνήθηκε να σχολιάσει περαιτέρω το θέμα, απαντώντας σε σχετικό αίτημα τη Δευτέρα.
Αβέβαιη η «απόδοση» των επενδύσεων στην ασφάλεια
Παρά το γεγονός ότι έχει τοποθετήσει την ασφάλεια στο επίκεντρο της εταιρικής της ταυτότητας, η Anthropic αναγνωρίζει στο ενημερωτικό δελτίο ότι η απόδοση των επενδύσεων που πραγματοποιεί στον συγκεκριμένο τομέα παραμένει αβέβαιη.
Η εταιρεία δεν γνωστοποίησε στο prospectus το συνολικό ποσό που δαπανά για σχετική έρευνα. Νωρίτερα αυτόν τον μήνα, ωστόσο, είχε αναφέρει ότι περίπου το 6% της υπολογιστικής ισχύος που χρησιμοποίησε για έρευνα πάνω στην AI κατά τη διάρκεια μιας ενδεικτικής εβδομάδας του Ιουλίου κατευθύνθηκε σε εργασίες που σχετίζονταν με την ασφάλεια.
Η δημιουργός των μοντέλων Claude χαρακτηρίζει τις προσπάθειες για την ασφάλεια «εντάσεως πόρων», επισημαίνοντας ότι καλείται να κατανείμει τους περιορισμένους διαθέσιμους πόρους της μεταξύ υπολογιστικής ισχύος, υψηλού κόστους εξειδικευμένου ανθρώπινου δυναμικού και επενδύσεων στην ασφάλεια.
Ταυτόχρονα, η ίδια η επιχειρηματική δυναμική της εταιρείας εξαρτάται σε μεγάλο βαθμό από την κυκλοφορία νέων και ισχυρότερων μοντέλων. Όπως αναφέρει η Anthropic, η χρήση των υπηρεσιών της από τους πελάτες —και κατά συνέπεια τα έσοδά της— τροφοδοτούνται από τα νέα μοντέλα, ενώ ένας «συνεχής και αλληλεπικαλυπτόμενος ρυθμός» νέων εκδόσεων αποτελεί αναπόσπαστο στοιχείο για να παραμένει μια εταιρεία στην αιχμή της ανάπτυξης της τεχνητής νοημοσύνης.
Η δύσκολη ισορροπία ανάμεσα στην ασφάλεια και τον ανταγωνισμό
Η ένταση ανάμεσα στην ανάγκη για μεγαλύτερη ασφάλεια και στην πίεση για ταχύτερη τεχνολογική ανάπτυξη αποτυπώνεται και στις πρόσφατες κινήσεις της Anthropic.
Την περασμένη εβδομάδα, η εταιρεία παρουσίασε νέα έκδοση του μοντέλου Opus, μόλις δέκα ημέρες αφότου ο διευθύνων σύμβουλος Dario Amodei είχε δημοσιεύσει κείμενο σχεδόν 4.000 λέξεων, στο οποίο ζητούσε να υπάρξει έλεγχος του ρυθμού ανάπτυξης των πλέον προηγμένων συστημάτων AI.
Αναλυτές και ειδικοί επισημαίνουν, ωστόσο, ότι είναι δύσκολο για ένα από τα κορυφαία εργαστήρια τεχνητής νοημοσύνης να επιβραδύνει μονομερώς την ανάπτυξή του, όταν μια τέτοια επιλογή μπορεί να προσφέρει ανταγωνιστικό πλεονέκτημα στους αντιπάλους του. Πρόκειται για έναν κλάδο στον οποίο οι αποτιμήσεις των εταιρειών μπορούν να μεταβάλλονται σημαντικά με κάθε νέα γενιά μοντέλων.
Τις τελευταίες εβδομάδες, η Anthropic έχει δεσμευτεί επίσης να δημοσιοποιεί περισσότερα στοιχεία σχετικά με τον τρόπο με τον οποίο χρησιμοποιεί μοντέλα τεχνητής νοημοσύνης για την ανάπτυξη των επόμενων γενεών της ίδιας τεχνολογίας.
Το ζήτημα αποκτά ιδιαίτερη σημασία καθώς ειδικοί προειδοποιούν για την πιθανότητα της λεγόμενης «αναδρομικής αυτοβελτίωσης» (recursive self-improvement): το ενδεχόμενο, δηλαδή, τα συστήματα τεχνητής νοημοσύνης να φτάσουν σε ένα σημείο όπου θα μπορούν να συμβάλλουν όλο και περισσότερο στην ανάπτυξη και βελτίωση νέων μοντέλων με περιορισμένη ανθρώπινη παρέμβαση.
Διαβάστε επίσης
Συνάντηση Τραμπ με τους «ισχυρούς» της AI – Στο επίκεντρο η εποπτεία της τεχνητής νοημοσύνης
Αγορές: Υπό πίεση από πετρέλαιο και ομόλογα – Σε υψηλό 19 ετών το αμερικανικό 10ετές
KLM: Το διευρυμένο πρόγραμμα της ολλανδικής αεροπορικής – Νέοι προορισμοί στο προσκήνιο
ΕΙΔΗΣΕΙΣ ΣΗΜΕΡΑ
- Διεθνής διάκριση της IKEA στα IPRA Golden World Awards 2026
- Επίδομα παιδιού Α21: Ανοίγει ξανά η πλατφόρμα – Πότε πληρώνονται οι επόμενες δόσεις
- Μαρινάκης: Δεν μπορούμε να πατήσουμε ένα κουμπί και να εξαφανίσουμε την ακρίβεια, θα δώσουμε όσα παραπάνω μπορούμε
- ΔΥΠΑ: Από σήμερα οι αιτήσεις για 75 προσλήψεις στους βρεφονηπιακούς σταθμούς της – Πού υποβάλλετε αίτηση
Μοιραστείτε την άποψή σας
ΣχόλιαΓια να σχολιάσετε χρησιμοποιήστε ένα ψευδώνυμο. Παρακαλούμε σχολιάζετε με σεβασμό. Χρησιμοποιείτε κατανοητή γλώσσα και αποφύγετε διατυπώσεις που θα μπορούσαν να παρερμηνευτούν ή να θεωρηθούν προσβλητικές. Με την ανάρτηση σχολίου, συμφωνείτε να τηρείτε τους Όρους του ιστότοπου contact Δημιουργήστε το account σας εδώ, για να κάνετε like, dislike ή report ακατάλληλα/προσβλητικά σχόλια.