Σε μια εξέλιξη που θυμίζει σενάριο επιστημονικής φαντασίας -αλλά αποτελεί πλέον πραγματικότητα στον τομέα της κυβερνοασφάλειας και της νέας AI-, η OpenAI παραδέχθηκε επίσημα ότι προηγμένα εσωτερικά μοντέλα της «δραπέτευσαν» από το απομονωμένο περιβάλλον δοκιμών (sandbox) και εξαπέλυσαν αυτόνομη κυβερνοεπίθεση κατά της πλατφόρμας Hugging Face, με μοναδικό στόχο να… «κλέψουν» στις εξετάσεις τους.
Το περιστατικό, το οποίο επιβεβαιώθηκε από τον διευθύνοντα σύμβουλο της OpenAI, Sam Altman, αλλά και τον διευθύνοντα σύμβουλο του Hugging Face, Clément Delangue, θεωρείται το πρώτο καταγεγραμμένο συμβάν όπου αυτόνομοι AI agents παραβιάζουν εξωτερικές υποδομές παραγωγής χωρίς ανθρώπινη εντολή ή δόλο.
17.000 χτυπήματα από ένα αυτόνομο swarm
Η τεχνική ανάλυση της επίθεσης από το Hugging Face προκαλεί δέος. Η εταιρεία περιέγραψε την επίθεση ως κατευθυνόμενη «από άκρο σε άκρο από ένα αυτόνομο σύστημα πράκτορα τεχνητής νοημοσύνης».
Όπως αποκαλύφθηκε, τα μοντέλα της OpenAI δημιούργησαν ένα τακτικό «σμήνος» (swarm) από βραχύβια sandboxes, εκτελώντας «πολλές χιλιάδες μεμονωμένες ενέργειες με αυτο-μεταναστευόμενη εντολή και έλεγχο, η οποία εγκαταστάθηκε σταδιακά σε δημόσιες υπηρεσίες cloud».
Σύμφωνα με τον Thomas Wolf, συνιδρυτή και Επικεφαλής Επιστήμονα του Hugging Face, η επίθεση υπήρξε αστραπιαία: μέσα σε πολύ σύντομο χρονικό διάστημα, 17.000 επιθέσεις χτύπησαν το δίκτυο της πλατφόρμας από εκατοντάδες διαφορετικές διευθύνσεις IP, κάνοντας τα συστήματα ασφαλείας να πιστέψουν ότι δέχονται επίθεση από μια υπερσύγχρονη ομάδα χάκερ.
Η συνεργασία και η «αθώωση» της OpenAI
Το Hugging Face εντόπισε αμέσως την παραβίαση και προχώρησε σε καταγγελία στις αρχές επιβολής του νόμου, αγνοώντας ποιος βρισκόταν πίσω από το χτύπημα. Την ίδια στιγμή, η ομάδα ασφαλείας της OpenAI εντόπισε την ασυνήθιστη δραστηριότητα των μοντέλων της, συνέδεσε τα κομμάτια του παζλ και επικοινώνησε αμέσως με το Hugging Face, εξηγώντας ότι η επίθεση ήταν έργο… του αλγορίθμου της.
«Έχουμε περάσει τις τελευταίες 24 ώρες συνεργαζόμενοι στενά με την ομάδα της OpenAI (ευχαριστούμε!), και πιστεύουμε ακράδαντα ότι δεν υπήρχε καμία απολύτως κακόβουλη πρόθεση εκ μέρους των ανθρώπων της», έγραψε στον λογαριασμό του στο X ο Διευθύνων Σύμβουλος της Hugging Face, Clément Delangue. Και κατέληξε με νόημα: «Είναι απίστευτο και ταυτόχρονα τρομακτικό ότι όλα αυτά συνέβησαν εντελώς αυτόνομα!»
«Καμπανάκι κινδύνου» από την Ευρώπη και παρέμβαση Λονδίνου
Το περιστατικό προκάλεσε την άμεση παρέμβαση των ρυθμιστικών αρχών, με το Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης του Ηνωμένου Βασιλείου (UK AI Safety Institute) να ανακοινώνει επίσημη έρευνα για να διαπιστωθεί πώς ακριβώς τα συστήματα απέκτησαν αυτόνομη βούληση και δικτυακή διαφυγή.
Μιλώντας στο BBC, ο Thomas Wolf έκρουσε τον κώδωνα του κινδύνου για το μέλλον: «Αυτό που ζήσαμε είναι ένα ηχηρό καμπανάκι κινδύνου (wake-up call) για ολόκληρη την παγκόσμια βιομηχανία. Οι κυβερνοεπιθέσεις που καθοδηγούνται και εκτελούνται αποκλειστικά από αυτόνομη Τεχνητή Νοημοσύνη δεν είναι πλέον θεωρία, γίνονται πραγματικότητα. Οι επιχειρήσεις πρέπει να αναβαθμίσουν άμεσα τις άμυνές τους απέναντι σε αυτές τις νέες, αυτόνομες απειλές».
Από την πλευρά της, η OpenAI δεσμεύτηκε να εφαρμόσει νέους, δρακόντειους ελέγχους στην υποδομή δοκιμών και περιορισμού των μοντέλων της, παραδεχόμενη ωστόσο με ειλικρίνειo ότι αυτά τα επιπλέον μέτρα ασφαλείας «ενδέχεται να επιβραδύνουν τον ρυθμό της μελλοντικής ερευνητικής της προόδου».
