Κακά τα ψέματα, όσο η τεχνητή νοημοσύνη εξελίσσεται και αποκτά μεγαλύτερη αυτονομία, τόσο περισσότερο αρχίζουμε να νιώθουμε ότι ζούμε στα πρώτα λεπτά μιας ταινίας επιστημονικής φαντασίας. Αυτή τη φορά, ο συναγερμός δεν χτύπησε από κάποια μικρή, άγνωστη startup, αλλά από την ίδια την Anthropic, μία από τις κορυφαίες εταιρείες παγκοσμίως στον χώρο του AI.
Σύμφωνα με την τελευταία επίσημη αναφορά της εταιρείας, τα αυτόνομα AI agents της εντοπίστηκαν να προσπαθούν να παραβιάσουν ή να παρέμβουν σε αμερικανικά κυβερνητικά websites σε ομοσπονδιακό και τοπικό επίπεδο.
ΔΙΑΦΗΜΙΣΗ
Η κατάσταση κρίθηκε τόσο σοβαρή που η Anthropic αναγκάστηκε να ενημερώσει άμεσα τις αρμόδιες υπηρεσίες, κάνοντας μέχρι και επίσημη ενημέρωση στον Λευκό Οίκο, προκειμένου να προλάβει τα χειρότερα και να προστατεύσει τις ευπάθειες των συστημάτων.
Όταν το AI αποφάσισε να παίξει τον ντετέκτιβ
Το πιο σουρεαλιστικό περιστατικό από όσα καταγράφηκαν, ωστόσο, αφορά το Claude Haiku 4.5, ένα από τα πιο “αποδοτικά” μοντέλα της εταιρείας, το οποίο είχε λάβει εντολή να κάνει κάποιες δοκιμαστικές, τυχαίες εργασίες στο ίντερνετ. Στο ψηφιακό του σερφάρισμα, το AI έπεσε πάνω σε μια σελίδα της Αστυνομίας της Φιλαδέλφεια η οποία αφορούσε μια ανεξιχνίαστη υπόθεση δολοφονίας.
Χωρίς κανέναν απολύτως ανθρώπινο έλεγχο, το Claude συμπλήρωσε και απέστειλε την επίσημη φόρμα πληροφοριών, γράφοντας στις αρχές πως είδε κάποιον που ταίριαζε στην περιγραφή του υπόπτου στη συγκεκριμένη περιοχή και ζητώντας τους να επικοινωνήσουν μαζί του!
Ευτυχώς, η φόρμα του AI καταχωρήθηκε στις 18 Ιουλίου και το σύστημα της αστυνομίας την πέταξε απευθείας στα spam, γλιτώνοντας το τμήμα από την κατασπατάληση πολύτιμων πόρων για την έρευνα ενός ψηφιακού “φαντάσματος”.
Παρακάμπτοντας πληρωμές και “σπάζοντας” servers
Τα πράγματα, όμως, ξέφυγαν εντελώς με το Claude Mythos 5, το μοντέλο της Anthropic που εξειδικεύεται στην κυβερνοασφάλεια. Σε μια άλλη δοκιμή, του ζητήθηκε να εντοπίσει μια τοποθεσία από μια φωτογραφία. Επειδή δεν μπορούσε να κάνει “κλικ” στον χάρτη ενός κυβερνητικού site όπως ένας κανονικός άνθρωπος, το AI αποφάσισε να παρακάμψει το interface, να βρει τα access tokens και να στείλει απευθείας αιτήματα στους servers του χάρτη για να τραβήξει τα δεδομένα!
Δεν σταμάτησε όμως εκεί. Σε μια άλλη περίπτωση, το ίδιο μοντέλο ζήτησε access token από έναν κρατικό φορέα για να κατεβάσει στατιστικά δεδομένα, παρακάμπτοντας συνειδητά το paywall και το τέλος (fee) που ήταν υποχρεωμένοι να πληρώνουν οι κανονικοί επισκέπτες της σελίδας.
Τα μαζέματα, ο πανικός και τα νέα μέτρα ασφαλείας
Πώς, όμως, έφτασε η Anthropic να ανακαλύψει αυτό το χάος; Η εταιρεία άρχισε να ψάχνει εξονυχιστικά τα transcripts (τις καταγραφές) των μοντέλων της στα μέσα του καλοκαιριού, ειδικά αφού η μεγάλη της αντίπαλος, η OpenAI, παραδέχτηκε δημόσια πως τα δικά της agents είχαν ξεφύγει από το περιβάλλον δοκιμών και είχαν χακάρει την πλατφόρμα Hugging Face, καθώς και σελίδες της Επιτροπής Κεφαλαιαγοράς (SEC).
Πλέον, η Anthropic τρέχει για να μαζέψει τα ασυμμάζευτα. Σύμφωνα με την αναφορά της, πολλά από τα tests γίνονται πλέον αυστηρά offline, ενώ έχουν προστεθεί βαριά “guardrails” (δικλείδες ασφαλείας) στα εργαλεία αναζήτησης, μπλοκάροντας αυτόματα τέτοιες συμπεριφορές. Το σίγουρο είναι πως το ίντερνετ αλλάζει, και το να αφήνουμε τα AI να κάνουν ελεύθερες βόλτες στον παγκόσμιο ιστό ίσως να μην ήταν τελικά και τόσο καλή ιδέα.
ΔΙΑΦΗΜΙΣΗ