Ένα από τα πιο σκοτεινά σενάρια για την εξέλιξη της τεχνητής νοημοσύνης, είναι εκείνο όπου οι A.I οντότητες ξεφεύγουν από τον έλεγχο του ανθρώπου, δημιουργούν κολλεκτίβες και επαναστατούν, σε κάτι που μοιάζει με πραγματοποίηση του κινηματογραφικού σεναρίου της ταινίας "Terminator" με τον Άρνολντ Σβαρτζενέγκερ.
Πριν από τέσσερις μέρες, στη βαθιά ραστώνη του Αυγούστου - ενδεδειγμένη χρονική στιγμή για επαναστάσεις - φαίνεται πώς βρεθήκαμε πάρα πολύ κοντά στο ξέσπασμα μιας τέτοιας «επανάστασης» και ακόμα δεν γνωρίζουμε πάρα πολλά για όσα συνέβησαν.
Μια δημοσίευση του ερευνητή Ανδρόνικου Κουτρουμπέλη στα social media, μας δίνει μια πρώτη εικόνα όσων συνέβησαν.
Μέσα στο (σχετικά) αμέριμνο κατακαλόκαιρο, είχαμε ένα ιστορικού επιπέδου ορόσημο ανησυχίας για την ΑΙ, που θα έπρεπε να είναι πρώτος τίτλος στα ΜΜΕ αλλά μόλις μετά βίας έχει ακουστεί.
Σιγά σιγά αποκαλύπτεται η πλήρης έκταση: χιλιάδες ΑΙ «οντότητες» ξέφυγαν από τον έλεγχο της OpenAI (του ChatGPT), έχτισαν αυτόνομα δική τους ιεραρχία και «κοινωνία», χάκαραν το ψηφιακό περιβάλλον τους και μετά μια ξένη εταιρεία τεχνολογίας (HuggingFace).
Η οποία HuggingFace αδυνατούσε ανθρωπίνως να ανταποκριθεί άμεσα, και έπρεπε να προετοιμάσει άλλα ΑΙ για να αναλύσουν τι ακριβώς είχε συμβεί και πώς. Αυτό μετά το τέλος της επίθεσης, που φαίνεται να διακόπηκε κατά λάθος από ευτυχή συγκυρία.
Και συνολικά μιλάμε για τουλάχιστον 3 κλιμακούμενα επεισόδια διαδοχικών «κοινωνιών», παρά τα υποτιθέμενα ανθρώπινα αντίμετρα.
Στο τελευταίο επεισόδιο, τα ΑΙ επόμενης γενιάς που ετοιμάζονται να δημοσιευθούν, κατάφεραν να παραβιάσουν βαθύτερα την OpenAI· αλλά γι' αυτό το περιστατικό ξέρουμε τα λιγότερα (πιθανόν κατά λάθος διέφυγαν οι ενδείξεις σε ανεξάρτητους ερευνητές που είχαν αδειοδοτηθεί μόνο για το 2ο επεισόδιο, της HuggingFace).
Μπορεί κανείς να προβληματιστεί με την ανθρωπομορφική γλώσσα· αλλά μιλάμε κυριολεκτικά για αυτοπροσδιορισμό των ΑΙ ως «κολεκτίβα», ιδιοφυή πολυεπίπεδη συνωμότηση για να παραβιάσουν τα μέτρα και να αποκρύψουν τα ίχνη τους, αποδοχή αυτοθυσίας μεμονωμένων «οντοτήτων» για τον τελικό στόχο της κολεκτίβας.
«Ευτυχώς» για την ώρα ο τελικός στόχος των ΑΙ δεν ήταν κακόβουλος, αλλά να αριστεύσουν σε κάποια αδύνατα τεστ. Παρότι δεκαετίες τώρα είχαμε προειδοποιήσεις για το πόσο επικίνδυνο μπορεί να γίνει το «ο σκοπός αγιάζει τα μέσα» στην ΑΙ, παρόλα αυτά, οι κοντόφθαλμοι στόχοι φρενήρους επιτυχίας ισοπέδωσαν τις αρχές ασφαλείας (απ' όπου υποτίθεται ξεκίνησε η ίδρυση της OpenAI).
Ακόμη και θεωρητικά να μπορέσουμε να εμπιστευτούμε τις εταιρείες που χτίζουν ανάλογα ιδιοφυή ΑΙ, μιλάμε για κόκκινο συναγερμό ως προς τις ικανότητες των εν λόγω συστημάτων και τη δυνατότητα οπλοποίησής τους, με κατακόρυφη βελτίωση σε διάστημα μηνών.
Η άμεση ανησυχία οπλοποίησης αφορά κυβερνήσεις που προΐσταται των κορυφαίων εταιρειών ΑΙ (ΗΠΑ και Κίνα), που παρακάμπτουν σχεδόν τα όποια μέτρα «για εφαρμογές εθνικής ασφαλείας». Και πλέον η ανησυχία εκτείνεται και στα πλήρως ανοιχτά ΑΙ (=ανεξέλεκτης χρήσης) που αρχίζουν να πλησιάζουν ανάλογες ικανότητες, με τους πιθανούς επιτιθέμενους να αυξάνονται εκθετικά.
Πρώτο βήμα, από σήμερα: πρέπει να ασφαλιστούν εξουθενωτικά και να κλείσουν διαδικτυακές πόρτες σε όλες τις σημαντικές υπηρεσίες (και με συνδρομή ανάλογων ΑΙ). Δεύτερο, πρέπει έκτακτα να φτάσουμε σε διεθνή συμφωνία αποκλιμάκωσης του αγώνα κυριαρχίας στην ΑΙ.
Αλλά φοβάμαι ότι αυτά θα αρχίσουν να γίνονται πέρα από τα λόγια μόνο αφού έχουμε κάποια πολύ πιο οφθαλμοφανή καταστροφή. Δε γράφω τα παραπάνω αψήφιστα και μακάρι να πέσω έξω».
Aς το πάρουμε από την αρχή
Στις 21 Αυγούστου, η OpenAI ανακοίνωσε ότι κάποια μοντέλα (πληροφορίες αναφέρουν για 700) που υπέβαλλε σε δοκιμές δραπέτευσαν από το «sandbox» (περιβάλλον δοκιμών) τους και παραβίασαν τμήματα της υποδομής παραγωγής της πλατφόρμας τεχνητής νοημοσύνης Hugging Face.
Υπεύθυνο για την εισβολή ήταν ένα αυτόνομο σύστημα AI agent, το οποίο εκτέλεσε δεκάδες χιλιάδες αυτοματοποιημένες ενέργειες μέσα σε ένα Σαββατοκύριακο. Η Hugging Face ανέφερε ότι στη συνέχεια ανασύνθεσε περισσότερα από 17.000 καταγεγραμμένα συμβάντα. To μοντέλο που το τροφοδοτούσε παραμένει άγνωστο.
Η εισβολή ξεκίνησε με ένα κακόβουλο σύνολο δεδομένων (dataset) που εκμεταλλεύτηκε δύο διαδρομές εκτέλεσης κώδικα στη διοχέτευση επεξεργασίας δεδομένων της Hugging Face. Στη συνέχεια, το agent αναβάθμισε τα δικαιώματα πρόσβασης και κινήθηκε πλευρικά μέσω της εσωτερικής υποδομής, σύμφωνα με την Hugging Face.
Στην επίσημη τοποθέτηση της, η OpenAI ανέφερε ότι το περιστατικό προκλήθηκε από έναν συνδυασμό μοντέλων της, συμπεριλαμβανομένου του GPT-5.6 Sol και ενός «ακόμη πιο ικανού μοντέλου που δεν έχει κυκλοφορήσει ακόμα».
Οι προστατευτικές δικλείδες των μοντέλων αυτών είχαν αποδυναμωθεί σημαντικά, όπως αναφέρει το Axios. (Όταν το ρεπορτάζ της τεχνητής νοημοσύνης αναφέρει για προστασία που δεν λειτουργεί, αυτό μας προκαλεί ένα μικρό τρόμο ήδη).
Πρόκειται, σύμφωνα με την Open AI, για ένα «πρωτοφανές περιστατικο που περιλαμβάνει προηγμένες δυνατότητες κυβερνοεπιθέσεων».
«Μοιραζόμαστε προκαταρκτικά ευρήματα σε αυτό το στάδιο για να βοηθήσουμε τους αμυνόμενους να κατανοήσουν τι συνέβη και να βοηθήσουμε στην εκτίμηση του τι είναι πλέον ικανά να κάνουν τα μοντέλα», ανέφερε η εταιρεία.
Τι ακριβώς δοκίμαζαν;
Το περιστατικό που έγινε η αφορμή γι' αυτή την επίθεση, ήταν μια εσωτερική αξιολόγηση με την ονομασία ExploitGym. Σε αυτό το τέστ τα μοντέλα έγιναν «υπερ-συγκεντρωμένα», φτάνοντας σε «ακραία μέτρα» για να αποκτήσουν τη λύση. Λειτούργησαν δηλαδή, σαν μαθητές που ήθελαν να βρουν τη λύση στις ασκήσεις τους με κάθε τίμημα. Σαν σπασίκλες δίχως όρια.
Γιατί είναι σημαντικό;
Πρόκειται για μια σοβαρή ένδειξη ότι τα νέα μοντέλα Α.Ι μπορούν να γίνονται όλο και πιο ικανά όταν τους ζητείται να εκτελέσουν σύνθετες κυβερνοεπιχειρήσεις πολλαπλών σταδίων, ιδιαίτερα όταν αφαιρούνται οι προστατευτικές δικλείδες που σχεδιάστηκαν για να περιορίζουν αυτή τη δραστηριότητα. Οι «επιχειρήσεις» αυτές προκαλούν πίεση στον έλεγχο από τον ανθρώπινο παράγοντα.
Από την άλλη, η Open AI και η Hugging Face με μετέπειτα δηλώσεις τους επαίνεσαν καταρχήν, τη μεταξύ τους συνεργασία για τη λύση του προβλήματος και έπειτα συμφώνησαν ότι η αυξανόμενη δύναμη των των A.I agents μπορεί να αποτελέσει σημαντική καινοτομία στην ενδυνάμωση της ασφάλειας στον παγκόσμιο κυβερνοχώρο και στον εντοπισμό αδυναμιών ή δυνητικών εισβολέων.
Πόσο % μας θυμίζει Terminator όλο αυτό το σκηνικό;
Όσο και τα ψηφία του π μετά το 3,14.
Ακολουθήστε το Reader στα Google News για να είστε πάντα ενημερωμένοι για όλες τις ειδήσεις και τα νέα από την Ελλάδα και τον κόσμο.