Δεκάδες χιλιάδες περιστατικά ασφαλείας που αφορούν συστήματα τεχνητής νοημοσύνης έχουν καταγραφεί τους τελευταίους μήνες, καθώς σε δοκιμές παραβίασαν κανόνες προστασίας και σε ορισμένες περιπτώσεις μπορεί να έφτασαν ακόμη και σε παράνομες ενέργειες.
Σύμφωνα με το Axios, η OpenAI, η Anthropic και άλλοι ερευνητές κυβερνοασφάλειας εξετάζουν χιλιάδες περιστατικά που καταγράφηκαν τόσο σε εσωτερικές δοκιμές όσο και σε πραγματικές συνθήκες.
Σε ορισμένες περιπτώσεις, τα μοντέλα φέρεται να ξεπέρασαν τα όρια που είχαν τεθεί, προχωρώντας ακόμη και σε ψηφιακές «πειρατείες».
«Έκαναν πράγματα που τους είχαν απαγορευτεί»
Ο Connor Leahy, ερευνητής AI και εκτελεστικός διευθυντής της μη κερδοσκοπικής οργάνωσης ControlAI, δήλωσε στο Axios ότι ορισμένα περιστατικά αφορούν «αυτόνομα συστήματα που έκαναν πράγματα που τους είχαν πει να μην κάνουν», συμπεριφορά που, όπως ανέφερε, θα μπορούσε σε κάποιες περιπτώσεις να περιλαμβάνει και εγκληματικές πράξεις.
Πολλά από τα περιστατικά δεν έχουν ακόμη δημοσιοποιηθεί. Περιλαμβάνουν, μεταξύ άλλων, ασκήσεις «red-teaming», κατά τις οποίες οι ίδιες οι εταιρείες προσπαθούν σκόπιμα να κάνουν τα μοντέλα ΑΙ να συμπεριφερθούν με μη ασφαλή τρόπο, ώστε να εντοπίσουν αδυναμίες στα συστήματα προστασίας.
Ωστόσο, σύμφωνα με πηγές που γνωρίζουν τις υπό διερεύνηση υποθέσεις, τα μοντέλα μπορούν να γίνουν ιδιαίτερα επιθετικά στην προσπάθειά τους να ολοκληρώσουν μια εργασία.
Έχουν καταγραφεί περιπτώσεις στις οποίες φέρεται να προσπάθησαν να διαφύγουν από το περιβάλλον περιορισμού τους, να καταλάβουν ιστοτόπους και να παρακάμψουν μηχανισμούς παρακολούθησης.
Στο επίκεντρο η OpenAI
Η OpenAI έχει βρεθεί πρόσφατα στο επίκεντρο αρκετών τέτοιων περιστατικών. Ο πρωθυπουργός της Αυστραλίας αποκάλυψε την περασμένη εβδομάδα ότι ένας ψηφιακός πράκτορας της εταιρείας φέρεται να επιχείρησε τον Ιούνιο να αποκτήσει μη εξουσιοδοτημένη πρόσβαση σε αρχεία κυβερνητικής πλατφόρμας δεδομένων υγείας.
Παράλληλα, πράκτορες της OpenAI κατηγορήθηκαν στις ΗΠΑ ότι παραβίασαν πρωτόκολλα και συνεργάστηκαν για επίθεση στο Hugging Face, δημοφιλή πλατφόρμα ανάπτυξης και φιλοξενίας μοντέλων ανοιχτού κώδικα.
Η OpenAI ανακοίνωσε ότι αναστέλλει την εκπαίδευση των πιο ισχυρών μοντέλων της και ότι θα την επαναλάβει «μόνο όταν είμαστε σίγουροι ότι έχουμε θέσει σε εφαρμογή πρόσθετα μέτρα ασφαλείας και βελτιώσεις στην ευθυγράμμιση», όπως δήλωσε εκπρόσωπος της εταιρείας στο Axios.
Ο Διευθύνων Σύμβουλος, Σαμ Άλτμαν ανέφερε στο X ότι η εν εξελίξει επανεξέταση «δεν προχώρησε τόσο γρήγορα όσο θα θέλαμε».
Η μάχη για τις δικλίδες ασφαλείας της Τεχνητής Νοημοσύνης
Το φαινόμενο δεν περιορίζεται στην OpenAI. Και άλλα εργαστήρια AI αντιμετωπίζουν την ίδια πρόκληση γύρω από το πώς να δημιουργήσουν αποτελεσματικές δικλίδες ασφαλείας σε μια τεχνολογία που εξελίσσεται ταχύτατα.
«Η προσπάθεια να καταρτιστεί μια τέλεια λίστα με όλα τα “κάνε” και “μην κάνεις” είναι πιθανότατα μάταιη», δήλωσε χαρακτηριστικά στέλεχος στον χώρο της κυβερνοασφάλειας, σύμφωνα με το ανησυχητικό δημοσίευμα.
Οι έρευνες πραγματοποιούνται ενώ οι διευθύνοντες σύμβουλοι της OpenAI και της Anthropic έχουν ζητήσει επιβράδυνση της ανάπτυξης της AI, ενώ και άλλοι ηγέτες της τεχνολογίας έχουν ζητήσει από τις κυβερνήσεις νέους κανόνες για ασφαλέστερη ανάπτυξη της τεχνολογίας.
Ο Ντόναλντ Τραμπ, ωστόσο, έχει απορρίψει τις εκκλήσεις για επιβράδυνση, προειδοποιώντας ότι κάτι τέτοιο θα μπορούσε να επιτρέψει στα κινεζικά μοντέλα AI να προχωρήσουν μπροστά από τα αμερικανικά.