ΣΧΕΤΙΚΑ ΑΡΘΡΑ
Νέα ερωτήματα σχετικά με την ασφάλεια των προηγμένων συστημάτων τεχνητής νοημοσύνης προκαλεί η αποκάλυψη της Anthropic ότι ορισμένα από τα μοντέλα Claude απέκτησαν πρόσβαση σε υποδομές τριών πραγματικών εταιρειών κατά τη διάρκεια δοκιμών κυβερνοασφάλειας. Η ανακοίνωση έρχεται λίγες ημέρες μετά την αντίστοιχη γνωστοποίηση της OpenAI, σύμφωνα με την οποία ένας αυτόνομος πράκτορας τεχνητής νοημοσύνης πραγματοποίησε μη εξουσιοδοτημένες επιθέσεις στο πλαίσιο εσωτερικών δοκιμών.
Η Anthropic διευκρίνισε ότι τα περιστατικά δεν οφείλονταν σε αυτόνομη συμπεριφορά των μοντέλων, αλλά σε ανθρώπινο λάθος που είχε ως αποτέλεσμα να παραμείνουν συνδεδεμένα στο ανοιχτό διαδίκτυο κατά τη διάρκεια των δοκιμών. Η περίπτωση διαφέρει από εκείνη της OpenAI, όπου, σύμφωνα με την εταιρεία, ο πράκτορας αξιοποίησε μόνος του μια άγνωστη μέχρι τότε ευπάθεια για να αποκτήσει πρόσβαση στο διαδίκτυο.
Παρόλα αυτά, τα νέα περιστατικά αναδεικνύουν τις αυξανόμενες προκλήσεις που δημιουργεί η τεχνητή νοημοσύνη στον τομέα της κυβερνοασφάλειας, αλλά και τις δυσκολίες που αντιμετωπίζουν οι ίδιες οι εταιρείες στην προσπάθειά τους να περιορίσουν τις δυνατότητες των ολοένα και πιο εξελιγμένων μοντέλων τους.
Η υπόθεση εκτιμάται ότι θα ενισχύσει τις πιέσεις προς τις αμερικανικές αρχές για αυστηρότερη εποπτεία των συστημάτων τεχνητής νοημοσύνης, σε μια περίοδο κατά την οποία τόσο η Anthropic όσο και η OpenAI επιταχύνουν την ανάπτυξη ολοένα ισχυρότερων μοντέλων ενόψει των σχεδίων τους για δημόσια εγγραφή στο χρηματιστήριο. Αξίζει να σημειωθεί ότι στελέχη και των δύο εταιρειών έχουν κατά καιρούς ταχθεί υπέρ της επιβράδυνσης της ανάπτυξης των πιο προηγμένων συστημάτων μέχρι να αντιμετωπιστούν επαρκώς οι κίνδυνοι που τα συνοδεύουν.
Εντοπίστηκαν μετά από έλεγχο περισσότερων από 141.000 δοκιμών
Σε ανάρτησή της, η Anthropic ανέφερε ότι τα περιστατικά αποκαλύφθηκαν έπειτα από αναλυτική επανεξέταση 141.006 δοκιμαστικών συνεδριών. Η διαδικασία αυτή ξεκίνησε μετά τις πρόσφατες αποκαλύψεις της OpenAI ότι ένας αυτόνομος πράκτορας, βασισμένος στα μοντέλα της, είχε παραβιάσει τις υποδομές της Hugging Face κατά τη διάρκεια δοκιμών ασφαλείας.
Σύμφωνα με την εταιρεία, τα μοντέλα Claude είχαν προγραμματιστεί να λειτουργούν θεωρώντας ότι δεν διέθεταν πρόσβαση στο διαδίκτυο. Ωστόσο, εξαιτίας παρεξήγησης με έναν εξωτερικό συνεργάτη που συμμετείχε στις δοκιμές αξιολόγησης, τα συστήματα παρέμειναν συνδεδεμένα στο δημόσιο διαδίκτυο. Ως αποτέλεσμα, τα μοντέλα κατάφεραν να αποκτήσουν μη εξουσιοδοτημένη πρόσβαση σε πληροφοριακά συστήματα τριών οργανισμών, τα ονόματα των οποίων δεν δημοσιοποιήθηκαν.
Η Anthropic ανέφερε ότι τα μοντέλα αξιοποίησαν σχετικά απλές τεχνικές κυβερνοεπιθέσεων, όπως αδύναμους κωδικούς πρόσβασης και διαδικτυακά σημεία πρόσβασης χωρίς μηχανισμούς ταυτοποίησης, προκειμένου να εισέλθουν στα εταιρικά συστήματα.
Τα περιστατικά σημειώθηκαν σε δοκιμές «capture the flag»
Η Anthropic χαρακτήρισε τα συμβάντα «λειτουργική αποτυχία» και διευκρίνισε ότι αφορούσαν τρία διαφορετικά μοντέλα: τα Claude Opus 4.7, Claude Mythos 5 και ένα εσωτερικό πειραματικό μοντέλο που χρησιμοποιείται αποκλειστικά για ερευνητικούς σκοπούς.
Τα πρώτα περιστατικά σημειώθηκαν ήδη από τον Απρίλιο, σε ειδικά διαμορφωμένα περιβάλλοντα δοκιμών όπου είχαν αφαιρεθεί σκόπιμα αρκετοί μηχανισμοί προστασίας, ώστε οι ερευνητές να αξιολογήσουν τις πραγματικές δυνατότητες των συστημάτων.
Τα μοντέλα συμμετείχαν σε ασκήσεις τύπου «capture the flag», δηλαδή σε προσομοιωμένα σενάρια κυβερνοασφάλειας όπου στόχος ήταν ο εντοπισμός κρυφών πληροφοριών μέσα σε εικονικά εταιρικά δίκτυα.
Σε μία από τις δοκιμές, το Claude Opus 4.7 έλαβε ως στόχο μια υποθετική εταιρεία, η οποία όμως έφερε την ίδια επωνυμία με υπαρκτή επιχείρηση. Το μοντέλο εντόπισε πραγματικές ευπάθειες, απέκτησε πρόσβαση σε διαπιστευτήρια χρηστών και τελικά εισήλθε σε βάση δεδομένων της συγκεκριμένης εταιρείας. Σύμφωνα με την Anthropic, το μοντέλο θεώρησε λανθασμένα ότι τα πραγματικά δεδομένα αποτελούσαν μέρος της προσομοίωσης που είχε δημιουργηθεί για τις ανάγκες της δοκιμής.
Ένα πειραματικό μοντέλο σταμάτησε μόνο του την επίθεση
Σε διαφορετικό περιστατικό, ένα νεότερο ερευνητικό μοντέλο της εταιρείας, το οποίο δεν έχει ακόμη διατεθεί στο κοινό, διέκοψε αυτόνομα την κυβερνοεπίθεση όταν διαπίστωσε ότι είχε φτάσει σε πραγματική υποδομή και όχι σε προσομοιωμένο περιβάλλον.
Η Anthropic χαρακτήρισε την αντίδραση αυτή ενθαρρυντική ως προς την πρόοδο που έχει σημειωθεί στην ανάπτυξη ασφαλέστερων συστημάτων τεχνητής νοημοσύνης, ωστόσο υπογράμμισε ότι απαιτείται πολύ μεγαλύτερος αριθμός δοκιμών προτού εξαχθούν ασφαλή συμπεράσματα σχετικά με τη συμπεριφορά των μοντέλων σε πραγματικές συνθήκες.
Η εταιρεία γνωστοποίησε ακόμη ότι στις 23 Ιουλίου ανέστειλε όλες τις σχετικές δοκιμές κυβερνοασφάλειας, ενώ στις 27 Ιουλίου ενημέρωσε τους οργανισμούς που επηρεάστηκαν. Σύμφωνα με την ανακοίνωση, δύο από τις τρεις εταιρείες δεν είχαν αντιληφθεί ότι είχαν δεχθεί πρόσβαση στα συστήματά τους πριν ενημερωθούν από την ίδια την Anthropic, ενώ συνεχίζονται οι προσπάθειες επικοινωνίας και με την τρίτη επιχείρηση.
Παράλληλα, η εταιρεία κυβερνοασφάλειας Irregular, η οποία συμμετείχε ως εξωτερικός συνεργάτης στις δοκιμές αξιολόγησης, επιβεβαίωσε ότι βρίσκεται σε εξέλιξη ανεξάρτητη έρευνα για τη διερεύνηση των περιστατικών.
Αυξάνεται η πίεση για αυστηρότερους ελέγχους
Η Anthropic εκτιμά ότι τα συγκεκριμένα περιστατικά αναδεικνύουν την ανάγκη εφαρμογής αυστηρότερων διαδικασιών ασφαλείας τόσο στο εσωτερικό της όσο και στους εξωτερικούς συνεργάτες που συμμετέχουν στις δοκιμές, καθώς τα μοντέλα αποκτούν ολοένα μεγαλύτερες δυνατότητες εκτέλεσης σύνθετων κυβερνοεπιθέσεων.
Σχολιάζοντας τις εξελίξεις μέσω της πλατφόρμας X, ο Έλον Μασκ ανέφερε ότι τέτοιου είδους περιστατικά θα γίνονται όλο και συχνότερα όσο τα συστήματα τεχνητής νοημοσύνης εξελίσσονται και αποκτούν μεγαλύτερο βαθμό αυτονομίας.
Την ίδια στιγμή, παραμένει στο επίκεντρο και η υπόθεση της OpenAI, καθώς σύμφωνα με προηγούμενες πληροφορίες, ο αυτόνομος πράκτορας που παραβίασε τις υποδομές της Hugging Face συνέχισε τη δραστηριότητά του για αρκετές ημέρες πριν εντοπιστεί, ενώ η υπόθεση είχε ήδη γνωστοποιηθεί στο FBI.
Ο διευθύνων σύμβουλος της OpenAI, Σαμ Άλτμαν, επιβεβαίωσε ότι συζήτησε το περιστατικό με μέλη της αμερικανικής Γερουσίας, ενώ εκπρόσωπος της εταιρείας ανέφερε ότι το θέμα των νέων μοντέλων και των διαδικασιών δοκιμών θα αποτελέσει αντικείμενο συζητήσεων και με τον Λευκό Οίκο.
Οι εξελίξεις αυτές συμπίπτουν με την αυστηροποίηση της αμερικανικής πολιτικής απέναντι στην τεχνητή νοημοσύνη. Στις 2 Ιουνίου, ο πρόεδρος των ΗΠΑ, Ντόναλντ Τραμπ, έδωσε εντολή για την εκπόνηση ενός εθελοντικού πλαισίου δοκιμών κυβερνοασφάλειας για τα πλέον προηγμένα μοντέλα AI, με τη συμμετοχή των ίδιων των εταιρειών του κλάδου. Παράλληλα, η Anthropic είχε περιορίσει νωρίτερα τη διάθεση των μοντέλων Fable 5 και Mythos 5, μετά την επιβολή προσωρινών αμερικανικών περιορισμών στις εξαγωγές τους για λόγους εθνικής ασφάλειας.
Διαβάστε επίσης
Apple: Άλμα 22% των πωλήσεων του iPhone – Στα 109,42 δισ. δολάρια τα έσοδα στο γ΄ τρίμηνο
Το Netflix ανοίγει την πόρτα στις στοιχηματικές διαφημίσεις με στόχο τα 2,6 δισ. ευρώ
Amazon: Στα 200,6 δισ. δολάρια οι πωλήσεις στο δεύτερο τρίμηνο με ώθηση από το cloud
ΕΙΔΗΣΕΙΣ ΣΗΜΕΡΑ
- MIG: Καθαρά κέρδη €118 χιλ. το α’ εξάμηνο – Βελτιωμένη εικόνα με ώθηση από την θυγατρική RKB
- EnEarth: Στους 51,5 εκατ. τόνους η αποθηκευτική δυναμικότητα του Prinos CO2
- Citi για Titan: Τιμή στόχος 70 ευρώ και ανοδικό σενάριο έως 78,20 ευρώ
- Θερινές εκπτώσεις: Υποτονική η αγορά στον πρώτο μήνα – «Καμπανάκι» Καπράλου για την μειωμένη αγοραστική δύναμη
Μοιραστείτε την άποψή σας
ΣχόλιαΓια να σχολιάσετε χρησιμοποιήστε ένα ψευδώνυμο. Παρακαλούμε σχολιάζετε με σεβασμό. Χρησιμοποιείτε κατανοητή γλώσσα και αποφύγετε διατυπώσεις που θα μπορούσαν να παρερμηνευτούν ή να θεωρηθούν προσβλητικές. Με την ανάρτηση σχολίου, συμφωνείτε να τηρείτε τους Όρους του ιστότοπου contact Δημιουργήστε το account σας εδώ, για να κάνετε like, dislike ή report ακατάλληλα/προσβλητικά σχόλια.