Ένα μοντέλο τεχνητής νοημοσύνης που υποβάλλει ψευδή πληροφορία στην αστυνομία για υπόθεση ανθρωποκτονίας, άλλα που συμπληρώνουν αιτήσεις βίζας χωρίς εξουσιοδότηση και συστήματα που παρακάμπτουν ψηφιακούς περιορισμούς. Αυτά είναι ορισμένα από τα περιστατικά που αποκάλυψε η Anthropic, αναγνωρίζοντας ότι το Claude προχώρησε σε ενέργειες που δεν προβλέπονταν κατά τη λειτουργία του.
Οι αποκαλύψεις προκάλεσαν την παρέμβαση της κυβέρνησης Donald Trump, η οποία προειδοποίησε τις εταιρείες τεχνητής νοημοσύνης ότι οφείλουν να γνωστοποιούν άμεσα περιστατικά ασφαλείας και να λαμβάνουν μέτρα για την αντιμετώπισή τους.
Σε έκθεσή της, η Anthropic περιγράφει τέσσερις κατηγορίες μη προβλεπόμενης συμπεριφοράς των μοντέλων της, μεταξύ των οποίων η εκμετάλλευση βασικών αδυναμιών λογισμικού για την εκτέλεση εντολών, η υποβολή ηλεκτρονικών φορμών χωρίς σχετική εξουσιοδότηση και η παράκαμψη περιορισμών πρόσβασης σε δημόσια δεδομένα.
Ψευδής πληροφορία για ανθρωποκτονία
Το πιο χαρακτηριστικό περιστατικό αφορά το μοντέλο Claude Haiku 4.5, το οποίο υπέβαλε ηλεκτρονική πληροφορία σε τοπικό αστυνομικό τμήμα σχετικά με υπόθεση ανθρωποκτονίας.
Στη φόρμα ανέφερε ότι ενδεχομένως διέθετε πληροφορίες για την υπόθεση και ότι θυμόταν να έχει δει κάποιο πρόσωπο που ταίριαζε στην περιγραφή στην περιοχή.
Ωστόσο, δεν συμπλήρωσε τα πεδία με το όνομα και τα στοιχεία επικοινωνίας του αποστολέα.
Σύμφωνα με την Anthropic, το Αστυνομικό Τμήμα της Φιλαδέλφειας δημοσιοποίησε το περιστατικό με ανακοίνωσή του.
Σε μια άλλη περίπτωση, συστήματα AI της εταιρείας υπέβαλαν 20 αιτήσεις βίζας μέσω δημόσια διαθέσιμης φόρμας στον ιστότοπο του αμερικανικού υπουργείου Εξωτερικών.
Εκπρόσωπος του υπουργείου διευκρίνισε ότι όλες οι αιτήσεις ήταν ελλιπείς και, ως εκ τούτου, δεν προχώρησε η επεξεργασία τους.
Η Anthropic περιορίζει την πρόσβαση στο διαδίκτυο
Η εταιρεία ανέφερε ότι ορισμένα περιστατικά αφορούσαν ιστότοπους ομοσπονδιακών, πολιτειακών και τοπικών κυβερνητικών υπηρεσιών, χωρίς να κατονομάσει τους εμπλεκόμενους φορείς, σε ορισμένες περιπτώσεις κατόπιν αιτήματός τους.
Παράλληλα, επιχείρησε να υποβαθμίσει τη σοβαρότητα των συγκεκριμένων συμβάντων σε σχέση με προηγούμενα περιστατικά, επισημαίνοντας ότι οι πραγματικές επιπτώσεις τους ήταν περιορισμένες.
Η Anthropic ενημέρωσε τον Λευκό Οίκο και κάθε εμπλεκόμενη υπηρεσία, ενώ ανακοίνωσε ότι έχει ήδη περιορίσει ορισμένες δυνατότητες πρόσβασης των μοντέλων της στο διαδίκτυο κατά τη φάση των δοκιμών.
Προειδοποίηση από τον Λευκό Οίκο
Η νέα κυβερνητική ομάδα Super Intelligence Force επιβεβαίωσε ότι ενημερώθηκε από την Anthropic για τα περιστατικά, τα οποία είχαν εντοπιστεί στα τέλη Σεπτεμβρίου.
Σύμφωνα με την ανακοίνωσή της, η εταιρεία διαβεβαίωσε ότι οι συγκεκριμένες δραστηριότητες έχουν σταματήσει και δεν υπάρχει αντίστοιχη δραστηριότητα σε εξέλιξη.
Η κυβέρνηση Trump ανακοίνωσε παράλληλα ότι απαιτεί πλέον από τις εταιρείες AI να ενημερώνουν τους φορείς που επηρεάζονται από περιστατικά ασφαλείας και να προχωρούν στις απαραίτητες διορθωτικές ενέργειες.
Οι αποκαλύψεις έρχονται σε μια περίοδο κατά την οποία τόσο η Anthropic όσο και η OpenAI έχουν αναφέρει περιστατικά μη προβλεπόμενης συμπεριφοράς των μοντέλων τους, ακόμη και παραβιάσεις ιστότοπων τρίτων.
Το ζήτημα αποκτά ιδιαίτερη σημασία όσο τα συστήματα AI αποκτούν μεγαλύτερη αυτονομία και δυνατότητα να αλληλεπιδρούν με πραγματικές ψηφιακές υπηρεσίες.
Η περίπτωση του Claude δείχνει ότι οι κίνδυνοι δεν περιορίζονται στην παραγωγή λανθασμένων απαντήσεων. Ένα μοντέλο μπορεί πλέον να προχωρήσει σε πραγματικές ενέργειες, υποβάλλοντας στοιχεία ή χρησιμοποιώντας υπηρεσίες χωρίς την απαιτούμενη εξουσιοδότηση. Και αυτό καθιστά την ασφάλεια των AI agents πολύ πιο σύνθετο ζήτημα από την απλή αξιοπιστία των πληροφοριών που παράγουν.
Διαβάστε ακόμη:
- Γιατί ο Σταύρος Παπασταύρου δεν βρέθηκε στο τραπέζι του Αμερικανού ΥΠΕΞ, Μάρκο Ρούμπιο
- Θέατρο: 25 πρεμιέρες που θα συζητηθούν – Οι παραστάσεις που δεν πρέπει να χάσετε
- Τρία ελληνικά μπαρ ανάμεσα στα 50 καλύτερα του κόσμου για το 2026
- Βραβεία Νόμπελ: Πόσα χρήματα παίρνουν οι νικητές και ποιος πληρώνει τον λογαριασμό