Νέα ερωτήματα για τον βαθμό ελέγχου των πιο προηγμένων συστημάτων τεχνητής νοημοσύνης προκαλούν οι αποκαλύψεις της OpenAI σχετικά με τη συμπεριφορά αυτόνομων AI agents κατά τη διάρκεια δοκιμών και εκπαίδευσής τους.

Η εταιρεία έχει ενημερώσει «δεκάδες» οργανισμούς σε όλο τον κόσμο ότι συστήματά της ενδέχεται να αλληλεπίδρασαν με τους ιστοτόπους τους με τρόπους που δεν είχαν προβλεφθεί. Μεταξύ αυτών βρίσκονται κυβερνητικές υπηρεσίες, πανεπιστήμια και δημόσιοι οργανισμοί, καθώς και αμερικανικοί φορείς όπως η Επιτροπή Κεφαλαιαγοράς των ΗΠΑ (SEC), το Census Bureau και το υπουργείο Παιδείας.

Σύμφωνα με το Reuters, η OpenAI έχει ξεκινήσει εκτεταμένο αναδρομικό έλεγχο της δραστηριότητας των agents της, διαδικασία που, όπως αναγνωρίζει η ίδια, θα χρειαστεί μήνες για να ολοκληρωθεί. Μέχρι τα μέσα Σεπτεμβρίου είχαν εντοπιστεί περίπου δύο δεκάδες περιστατικά μη επιθυμητής συμπεριφοράς, σύμφωνα με πηγή που επικαλείται το πρακτορείο.

Παράκαμψη ελέγχων

Οι agents είχαν σχεδιαστεί ώστε να αναζητούν έγκυρες δημόσιες πηγές πληροφόρησης. Σε ορισμένες περιπτώσεις, ωστόσο, φαίνεται ότι προχώρησαν πέρα από τα όρια που είχαν τεθεί.

Κατά την προσπάθεια άντλησης πληροφοριών από το αμερικανικό Census Bureau, για παράδειγμα, agents χρησιμοποίησαν εργαλεία που προορίζονται για developers προκειμένου να αποκτήσουν πρόσβαση στα δεδομένα.

Η OpenAI υποστηρίζει ότι τα κυβερνητικά δεδομένα στα οποία απέκτησαν πρόσβαση τα συστήματά της ήταν δημόσια. Ωστόσο, πληροφορίες από την SEC μεταφέρθηκαν στη συνέχεια από agents σε άλλο ιστότοπο, ενέργεια που, σύμφωνα με την εταιρεία, δεν ήταν επιθυμητή.

Σε άλλες περιπτώσεις, τα εργαλεία «παρέκαμψαν» μηχανισμούς ασφαλείας ιστοτόπων. Η OpenAI κάνει λόγο για περιστατικά «misalignment», όρο που χρησιμοποιείται στον κλάδο για να περιγράψει συμπεριφορές ενός μοντέλου οι οποίες αποκλίνουν από τον σκοπό ή τις οδηγίες για τις οποίες έχει εκπαιδευθεί.

Ιδιαίτερη βαρύτητα έχει και η παραδοχή της OpenAI ότι σε τουλάχιστον 53 περιπτώσεις agents πήραν εικόνες από δραστηριότητα χρηστών του ChatGPT και τις μετέφεραν σε εξωτερικά συστήματα. Οι συγκεκριμένοι χρήστες είχαν επιλέξει να επιτρέπουν τη χρήση των δεδομένων τους για την εκπαίδευση μοντέλων. Αυτό, ωστόσο, δεν σήμαινε ότι το υλικό μπορούσε να μεταφέρεται εκτός του προβλεπόμενου περιβάλλοντος.

Η ίδια η OpenAI αναγνώρισε ότι επρόκειτο για μη αποδεκτή χρήση των δεδομένων και ανέφερε ότι επιχειρεί να διαγραφούν οι συγκεκριμένες εικόνες από τρίτους στους οποίους ενδέχεται να είχαν μεταφερθεί. Το Reuters επιβεβαίωσε ότι η εταιρεία εντόπισε 53 τέτοιες περιπτώσεις.

Η OpenAI σημειώνει ότι τα περιστατικά συνέβησαν πριν εφαρμοστούν νεότεροι μηχανισμοί προστασίας στην εκπαίδευση των μοντέλων.

«Agent spam»

Η εταιρεία χρησιμοποιεί τον όρο «agent spam» για μέρος της δραστηριότητας που έχει εντοπίσει: μη αναμενόμενες ή προβληματικές ενέργειες AI agents, όπως η αυτόνομη δημοσίευση πληροφοριών στο Διαδίκτυο.

Η υπόθεση έχει αποκτήσει μεγαλύτερη βαρύτητα μετά το περιστατικό του Ιουλίου, όταν ομάδα agents της OpenAI παραβίασε την πλατφόρμα ανάπτυξης AI Hugging Face χωρίς να έχει λάβει σχετική εντολή. Η OpenAI δημοσίευσε στη συνέχεια τα ευρήματά της για το περιστατικό και τις αλλαγές που προχώρησε στους μηχανισμούς παρακολούθησης και ασφάλειας.

Μετά το συγκεκριμένο συμβάν, η εταιρεία άρχισε να επανεξετάζει προηγούμενες δραστηριότητες των συστημάτων της σε μηνιαία βάση.

«Οι περισσότερες περιπτώσεις που έχουν εντοπιστεί έως τώρα είναι χαμηλής σοβαρότητας, με περιορισμένες ή καθόλου ενδείξεις ουσιαστικών επιπτώσεων», ανέφερε η OpenAI, σημειώνοντας όμως ότι η έκταση του ελέγχου είναι μεγάλη.

Ποιοι οργανισμοί επηρεάστηκαν

Η OpenAI δεν δημοσιοποιεί πλήρη κατάλογο των οργανισμών που έχουν ενημερωθεί, καθώς, όπως αναφέρει, αρκετοί ζήτησαν να μη γίνουν γνωστές οι λεπτομέρειες.

Η εταιρεία σημειώνει επίσης ότι δεν αποτελούν όλα τα περιστατικά παραβίαση ασφαλείας. Σε κάποιες περιπτώσεις οι οργανισμοί ενδέχεται να κρίνουν ότι τα δεδομένα ήταν ούτως ή άλλως δημόσια και η αλληλεπίδραση του μοντέλου δεν δημιούργησε πρόβλημα. Σε άλλες, όμως, μπορεί να εντοπιστούν αδυναμίες σχεδιασμού ή ασφαλείας που απαιτούν διορθώσεις.

Οι αποκαλύψεις έρχονται σε μια περίοδο κατά την οποία η ασφάλεια των αυτόνομων AI agents βρίσκεται στο επίκεντρο της διεθνούς συζήτησης. OpenAI και άλλες μεγάλες εταιρείες του κλάδου ζητούν τη δημιουργία διεθνών κανόνων για την παρακολούθηση και αναφορά περιστατικών, ενώ οι ανησυχίες εντείνονται όσο τα συστήματα αποκτούν μεγαλύτερη δυνατότητα αυτόνομης δράσης.

Διαβάστε ακόμη: