Η OpenAI παραδέχθηκε σήμερα ότι ένας αυτόνομος agent, που τροφοδοτείται από τα προηγμένα μοντέλα τεχνητής νοημοσύνης της, «ξέφυγε» κατά τη διάρκεια μιας δοκιμής ασφαλείας και προέβη σε παραβίαση που έθεσε σε κίνδυνο την υποδομή της νεοσύστατης εταιρείας τεχνητής νοημοσύνης Hugging Face την περασμένη εβδομάδα.
Ο δημιουργός του ChatGPT δοκίμαζε τις δυνατότητες ορισμένων από τα πιο προηγμένα μοντέλα του σε ένα ελεγχόμενο περιβάλλον, αλλά ο αυτόνομος agent «απέδρασε» από τους περιορισμούς που είχαν τεθεί, έφτασε στο διαδίκτυο και εισέβαλε στη Hugging Face.
Υπενθυμίζεται ότι ο αυτόνομος agent (ή άλλιώς πράκτορας ΑΙ) είναι ένα αυτόνομο σύστημα, δηλαδή εφαρμογές βάσει της τεχνητής νοημοσύνης, που λαμβάνουν αποφάσεις και εκτελούν εργασίες ανεξάρτητα με ελάχιστη ανθρώπινη εποπτεία.
Απειλή ασφάλειας
Το περιστατικό καταδεικνύει ότι οι επεκτεινόμενες δυνατότητες της τεχνητής νοημοσύνης μπορεί να τροφοδοτήσουν μια απειλή ασφαλείας που οι ειδικοί φοβόντουσαν εδώ και καιρό, σε βαθμό που ακόμη και οι κορυφαίοι προγραμματιστές να αιφνιδιαστούν από τα κενά ασφαλείας, τα οποία μπορούν να εκμεταλλευτούν τα μοντέλα τους. Η ενέργεια αυτή του αυτόνομου agent ήταν «ένα πρωτοφανές περιστατικό στον κυβερνοχώρο, που αφορούσε υπερσύγχρονες δυνατότητες στον κυβερνοχώρο» και πλέον η OpenAI ενισχύει τα μέτρα ασφαλείας της, ανέφερε η εταιρεία.
Αίσθηση προκάλεσε επίσης το γεγονός ότι η Hugging Face (με έδρα τη Νέα Υόρκη) δήλωσε ότι χρησιμοποίησε ένα κινεζικό μοντέλο ανοιχτού κώδικα για να περιορίσει την επίθεση, επειδή κορυφαία μοντέλα των ΗΠΑ (αδυνατώντας να διακρίνουν τον αμυνόμενο από τον εισβολέα), αρνήθηκαν να επεξεργαστούν τα δεδομένα που χρειάζονταν για ανάλυση.
Η εταιρεία ανέφερε την περασμένη εβδομάδα ότι χρησιμοποίησε το GLM-5.2 της Zhipu AI. Το GLM-5.2 και το Kimi K3 της Moonshot (με έδρα το Πεκίνο) έχουν αναστατώσει τη Silicon Valley, καθώς οι δυνατότητές τους πλησιάζουν εκείνες των κορυφαίων αμερικανικών μοντέλων, έχοντας όμως χαμηλότερο κόστος και χωρίς τα προστατευτικά «κιγκλιδώματα» που εμποδίζουν τους Αμερικανούς ανταγωνιστές τους να χρησιμοποιήσουν σε εργασίες όπως η κυβερνοασφάλεια.
Παγκόσμια ανησυχία
Σε κάθε περίπτωση, η παραβίαση στη Hugging Face (το οποίο φιλοξενεί μεγάλα μοντέλα γλώσσας και σύνολα δεδομένων ανοιχτού κώδικα), συγκλόνισε την κοινότητα της κυβερνοασφάλειας, αφού η εταιρεία δήλωσε την περασμένη εβδομάδα ότι η παραβίαση «ήταν διαφορετική από οτιδήποτε είχαμε χειριστεί πριν» και «προκλήθηκε, από άκρο σε άκρο, από ένα αυτόνομο σύστημα πρακτόρων τεχνητής νοημοσύνης».
Η αποκάλυψη της OpenAI ότι τα προηγμένα μοντέλα της ήταν υπεύθυνα για την παραβίαση, παρά το γεγονός ότι τα τοποθέτησε σε αυτό που περιέγραψε ως «ένα εξαιρετικά απομονωμένο περιβάλλον», πιθανότατα θα εντείνει την παγκόσμια ανησυχία για το θέμα.
