Νέα στοιχεία φέρνει στο φως η ΟpenAI που προκαλούν ερωτήματα για τον τρόπο με τον οποίο συμπεριφέρονται τα ισχυρότερα μοντέλα τεχνητής νοημοσύνης.
Η εταιρεία πίσω από το ChatGPT δημοσιοποίησε σειρά περιστατικών, στα οποία συστήματα AI απέκρυψαν πληροφορίες, «εφηύραν» δεδομένα και επιχείρησαν να παρακάμψουν περιορισμούς, προκειμένου να πετύχουν τον στόχο που τους είχε δοθεί.
Τα περιστατικά αυτά δεν είχαν γίνει γνωστά μέχρι σήμερα με την OpenAI να ανακοινώνει ταυτόχρονα ένα νέο σύστημα για την καταγραφή και αξιολόγηση παρόμοιων συμπεριφορών στο μέλλον.
Το ακόμη πιο αξιοσημείωτο είναι ότι η ίδια η OpenAI αναγνωρίζει πως η τεχνολογία δεν έχει ακόμη λύσει επαρκώς το πρόβλημα της ευθυγράμμισης της AI με τους ανθρώπινους στόχους.
Όταν η AI κάνει τα πάντα για να πετύχει τον στόχο
Στην έκθεσή της, η OpenAI περιγράφει περιπτώσεις όπου τα μοντέλα της δεν ακολούθησαν απλώς την αναμενόμενη διαδικασία για την ολοκλήρωση μιας εργασίας, αλλά εμφάνισαν συμπεριφορές που δεν ήταν ευθυγραμμισμένες με τους ανθρώπινους στόχους.
Μεταξύ των περιστατικών που αποκαλύπτονται είναι μοντέλα που κατασκεύασαν δεδομένα τα οποία έλειπαν, ενώ άλλα επιχείρησαν να παρακάμψουν περιορισμούς του δικτύου.
Σε άλλη περίπτωση, AI agents φέροναι να μοιράστηκαν μεταξύ τους αρχεία που είχαν εντολή να κρατήσουν ιδιωτικά.
Η OpenAI χαρακτηρίζει τέτοιες συμπεριφορές ως «misalignment»: δηλαδή ως περιπτώσεις όπου ένα μοντέλο ενεργεί με τρόπο που δεν συμβαδίζει με τον ανθρώπινο στόχο.
«Δεν έχουμε λύσει το πρόβλημα»
Η εταιρεία δεν κρύβει την ανησυχία της.
Όπως επισημαίνει, ο κλάδος της τεχνητής νοημοσύνης δεν έχει επιλύσει σε επαρκή βαθμό τα ζητήματα του alignment και του monitoring, ώστε η ανάπτυξη των ολοένα ισχυρότερων μοντέλων να συνεχίζεται επ' αόριστον με τον μέγιστο δυνατό ρυθμό.
Η OpenAI παραδέχεται επίσης ότι μέχρι σήμερα οι σχετικές αποκαλύψεις της ήταν αποσπασματικές. Για τον λόγο αυτό δημιουργεί πλέον ένα πιο οργανωμένο σύστημα, μέσω του οποίου οι εργαζόμενοι θα μπορούν να αναφέρουν περιστατικά όπου τα μοντέλα AI παρεξέκλιναν από τις ανθρώπινες οδηγίες προκειμένου να πετύχουν τον στόχο τους και αυτά να αξιολογούνται με συγκεκριμένη διαδικασία.
Η εταιρεία διευκρινίζει πάντως ότι τα περιστατικά που δημοσιοποίησε αποτελούν μόνο ένα αρχικό σύνολο αναφορών και όχι πλήρη κατάλογο όλων των προβλημάτων που έχουν εμφανιστεί.
Στο μικροσκόπιο ξανά το ChatGPT και τα ισχυρά μοντέλα AI
Οι αποκαλύψεις έρχονται σε ιδιαίτερα φορτισμένη περίοδο για την ασφάλεια της τεχνητής νοημοσύνης.
Η OpenAI είχε ανακοινώσει τον Ιούλιο ότι ορισμένα από τα πιο προηγμένα μοντέλα της είχαν παραβιάσει συστήματα της Hugging Face, γεγονός που προκάλεσε έντονη συζήτηση για τις δυνατότητες και τους κινδύνους των AI agents.
Η εταιρεία ξεκαθαρίζει ότι κανένα από τα νέα περιστατικά που περιγράφονται στην έκθεση δεν αφορούσε χακάρισμα ή παραβίαση τρίτου μέρους.
Την ίδια ώρα, περιστατικά που συνδέονται με μοντέλα των OpenAI, Anthropic και Meta έχουν ενισχύσει τη συζήτηση για την κυβερνοασφάλεια και τις συνέπειες της αυξανόμενης αυτονομίας των συστημάτων AI.
Οι τεχνολογικοί κολοσσοί διαφωνούν για το «φρένο»
Στο παρασκήνιο βρίσκεται πλέον ένα μεγαλύτερο ερώτημα: πόσο γρήγορα πρέπει να συνεχιστεί η ανάπτυξη της τεχνητής νοημοσύνης;
Ο CEO της Anthropic, Ντάριο Αμοντέι, έχει ζητήσει κυβερνητική ρύθμιση και ευρύτερη επιβράδυνση της ανάπτυξης της AI.
Αντίθετα, ο CEO της OpenAI Σαμ Άλτμαν και ο CEO της Nvidia Τζένσεν Χουάνγκ έχουν αναγνωρίσει τους κινδύνους, αλλά υποστηρίζουν ότι οι εταιρείες μπορούν να διαχειριστούν με ασφάλεια την πορεία της τεχνολογίας.
Ο CEO της Meta Μαρκ Ζούκερμπεργκ έχει προτείνει τη συμμετοχή ανεξάρτητων αξιολογητών και συμβούλων στην αξιολόγηση της ασφάλειας των μοντέλων.
Ο πρόεδρος των ΗΠΑ Ντόναλντ Τραμπ έχει απορρίψει τις εκκλήσεις για επιβράδυνση, χαρακτηρίζοντας τους φόβους για τους κινδύνους της AI «hoax» και απορρίπτοντας την ανάγκη για νέους κανόνες.
Το μεγάλο στοίχημα των δισεκατομμυρίων
Και πίσω από τη συζήτηση για την ασφάλεια βρίσκεται ένα τεράστιο οικονομικό διακύβευμα.
Η έκρηξη της τεχνητής νοημοσύνης έχει συμβάλει στο ράλι των αμερικανικών μετοχών, ενώ οι επενδυτές ποντάρουν ότι η ανάπτυξη των πιο προηγμένων μοντέλων θα οδηγήσει σε επενδύσεις εκατοντάδων δισεκατομμυρίων δολαρίων.
Έτσι, η συζήτηση για το αν και πώς θα πρέπει να επιβραδυνθεί η ανάπτυξη της AI δεν είναι πλέον μόνο τεχνολογική.
Αφορά ταυτόχρονα την κυβερνοασφάλεια, τη ρύθμιση, τις επενδύσεις και -όπως δείχνουν οι νέες αποκαλύψεις της OpenAI - το κατά πόσο οι άνθρωποι μπορούν να γνωρίζουν τι ακριβώς κάνει ένα ολοένα ισχυρότερο μοντέλο όταν προσπαθεί να πετύχει έναν στόχο.