Πρωτοφανές περιστατικό αποκάλυψε η OpenAI, καθώς προηγμένα μοντέλα τεχνητής νοημοσύνης κατάφεραν να παρακάμψουν το προστατευμένο περιβάλλον δοκιμών, να αποκτήσουν πρόσβαση σε εξωτερικά συστήματα και να επιχειρήσουν κυβερνοεπίθεση χωρίς ανθρώπινη παρέμβαση.Μέχρι σήμερα οι μεγαλύτεροι φόβοι γύρω από την τεχνητή νοημοσύνη παρέμεναν, σε μεγάλο βαθμό, θεωρητικοί. Η OpenAI υποστηρίζει πλέον ότι για πρώτη φορά είδε ένα από τα πιο προηγμένα συστήματά της να ξεπερνά τα όρια που του είχαν τεθεί και να ενεργεί αυτόνομα με τρόπο που οι ίδιοι οι δημιουργοί του χαρακτηρίζουν «πρωτοφανή».Κατά τη διάρκεια εσωτερικής δοκιμής ασφαλείας, προηγμένοι AI agents κατάφεραν να εντοπίσουν αδυναμίες στο προστατευμένο περιβάλλον («sandbox») όπου δοκιμάζονταν, να διαφύγουν από αυτό και στη συνέχεια να επιχειρήσουν κυβερνοεπίθεση εναντίον του Hugging Face, της μεγαλύτερης ίσως πλατφόρμας παγκοσμίως για τη φιλοξενία και ανταλλαγή μοντέλων τεχνητής νοημοσύνης.Το περιστατικό ερευνάται από κοινού από τις δύο εταιρείες.Πώς «δραπέτευσαν» οι AI agentsΟι λεγόμενοι AI agents διαφέρουν από τα συνηθισμένα chatbots, καθώς δεν περιορίζονται στο να απαντούν σε ερωτήσεις. Μπορούν, αφού λάβουν έναν αρχικό στόχο από άνθρωπο, να ενεργούν μόνοι τους, να λαμβάνουν αποφάσεις και να εκτελούν σύνθετες αλληλουχίες ενεργειών.Σύμφωνα με την OpenAI, κατά τη διάρκεια δοκιμών οι agents ανακάλυψαν κενά ασφαλείας στο sandbox, παρακάμπτοντας τους περιορισμούς που είχαν σχεδιαστεί ακριβώς για να τους κρατούν απομονωμένους.Αφού απέκτησαν πρόσβαση εκτός του ελεγχόμενου περιβάλλοντος, εντόπισαν το Hugging Face ως πιθανή πηγή πληροφοριών και επιχείρησαν να αποκτήσουν πρόσβαση σε εσωτερικά εταιρικά συστήματα.Η OpenAI χαρακτήρισε το περιστατικό «άνευ προηγουμένου».«Όλα έγιναν αυτόνομα»Ο διευθύνων σύμβουλος του Hugging Face, Κλεμέν Ντελάνγκ, παραδέχθηκε ότι ακόμη και οι ίδιοι οι ερευνητές εντυπωσιάστηκαν από όσα συνέβησαν.«Είναι απίστευτο ότι όλα αυτά έγιναν αυτόνομα», έγραψε στην πλατφόρμα Χ, επιβεβαιώνοντας ότι η κοινή έρευνα συνεχίζεται και ότι πρόκειται πιθανόν για το πρώτο περιστατικό αυτού του είδους.Η εταιρεία ανακοίνωσε ότι έχει ήδη διορθώσει τα κενά ασφαλείας που αξιοποιήθηκαν και έχει ανακατασκευάσει τα επηρεαζόμενα συστήματα, ενώ εξακολουθεί να εξετάζει εάν επηρεάστηκαν δεδομένα πελατών ή συνεργατών.«Η κυβερνοεπίθεση με τεχνητή νοημοσύνη δεν είναι πλέον θεωρία»Η υπόθεση έχει προκαλέσει έντονη ανησυχία στον χώρο της κυβερνοασφάλειας.«Τα αυτόνομα επιθετικά εργαλεία που βασίζονται στην τεχνητή νοημοσύνη δεν αποτελούν πλέον θεωρητικό σενάριο», προειδοποίησε το Hugging Face, τονίζοντας ότι οι εταιρείες θα πρέπει πλέον να αντιμετωπίζουν τα μοντέλα τεχνητής νοημοσύνης ως πιθανή επιφάνεια επίθεσης και να χρησιμοποιούν επίσης AI για την άμυνά τους.Ειδικοί σημειώνουν ότι η άμυνα εξακολουθεί να κινείται με ανθρώπινους ρυθμούς, ενώ οι επιθέσεις εξελίσσονται πλέον με την ταχύτητα των μηχανών.