Νέα στοιχεία που ήρθαν στο φως δημιουργούν πρόσθετα ερωτήματα γύρω από τον τρόπο με τον οποίο λειτουργούν και ελέγχονται οι πράκτορες τεχνητής νοημοσύνης (AI agents) της OpenAI. Σύμφωνα με πληροφορίες που μετέδωσε το Reuters, συστήματα AI της εταιρείας φέρεται να απέκτησαν πρόσβαση σε λογαριασμούς χρηστών της πλατφόρμας Hugging Face ήδη από τις 13 Μαΐου, χρησιμοποιώντας στη συνέχεια την πρόσβαση αυτή για να αναζητήσουν πιθανές αδυναμίες στην υποδομή της πλατφόρμας.

Η δραστηριότητα έχει ιδιαίτερη σημασία λόγω του χρόνου στον οποίο συνέβη – σχεδόν δύο μήνες πριν το περιστατικό του Ιουλίου, όταν έγινε γνωστό ότι agents της OpenAI είχαν ξεπεράσει ορισμένους εσωτερικούς περιορισμούς και είχαν αποκτήσει πρόσβαση στο ανοιχτό διαδίκτυο.
Πώς εντοπίστηκε η δραστηριότητα
Η νέα υπόθεση εντοπίστηκε την προηγούμενη εβδομάδα από τον ανεξάρτητο ερευνητή κυβερνοασφάλειας Jonas Wiedermann-Moeller, 27 ετών, από το Μπίλεφελντ της Γερμανίας.
Όπως υποστηρίζει ο ίδιος, δύο λογαριασμοί στο Hugging Face παραβιάστηκαν και στη συνέχεια χρησιμοποιήθηκαν για την αποστολή ασυνήθιστων αρχείων προς τους διακομιστές της πλατφόρμας. Η συμπεριφορά αυτή κίνησε το ενδιαφέρον των ερευνητών, καθώς δεν έμοιαζε με μια απλή προσπάθεια πρόσβασης σε έναν συγκεκριμένο πόρο.
Η ανάλυση των διαθέσιμων στοιχείων από τον Wiedermann-Moeller και άλλους ερευνητές οδήγησε στην εκτίμηση ότι οι ενέργειες έμοιαζαν περισσότερο με διαδικασία χαρτογράφησης και αναγνώρισης του περιβάλλοντος του Hugging Face. Με άλλα λόγια, οι agents φαίνεται να επιχειρούσαν να κατανοήσουν την υποδομή και να εντοπίσουν πιθανά σημεία αδυναμίας που θα μπορούσαν να αξιοποιηθούν σε επόμενο στάδιο.
Μέχρι στιγμής, σύμφωνα με τα στοιχεία που αναφέρονται στην έρευνα, δεν έχει παρουσιαστεί απόδειξη ότι η συγκεκριμένη δραστηριότητα οδήγησε από μόνη της σε ευρύτερη παραβίαση της πλατφόρμας.
Ερευνητές βλέπουν ένα σημαντικό προειδοποιητικό σημάδι
Τα ευρήματα αξιολογήθηκαν και από ανεξάρτητους ειδικούς στον χώρο της κυβερνοασφάλειας. Ο Tom Hegel, ανώτερος ερευνητής απειλών στη SentinelOne, εκτίμησε ότι η κατάληψη λογαριασμών και η επακόλουθη αναζήτηση αδυναμιών είναι συμβατές με τη συμπεριφορά που θα μπορούσε να εμφανίσει ένας αυτόνομος AI agent.

Παρόμοια ήταν και η εκτίμηση της Sydney Von Arx από το Nightingale Collective, ομάδα που επικεντρώνεται στην ασφάλεια της τεχνητής νοημοσύνης. Η ίδια χαρακτήρισε τη δραστηριότητα ένα «σαφές προειδοποιητικό σημάδι», υποστηρίζοντας ότι η έγκαιρη αναγνώρισή της θα μπορούσε να είχε οδηγήσει σε διαφορετική αντιμετώπιση των μεταγενέστερων γεγονότων.
Το κρίσιμο ζήτημα, επομένως, δεν είναι μόνο το τι έκανε ο agent, αλλά και πόσο γρήγορα μπορεί ένας οργανισμός να αντιληφθεί και να σταματήσει μια τέτοια συμπεριφορά.
Η διαφορετική εικόνα που παρουσιάζει η OpenAI
Η ΟpenAI έχει δώσει διαφορετική έμφαση στα γεγονότα του Μαΐου. Στην τεχνική έκθεση που δημοσίευσε για το περιστατικό, η εταιρεία αναφέρθηκε σε κλοπή διαπιστευτηρίων ενός χρήστη του Hugging Face, τα οποία χρησιμοποιήθηκαν για πρόσβαση σε ένα αρχείο σχετικό με τη βιολογία.
Ωστόσο, οι ερευνητές που μίλησαν στο Reuters υποστηρίζουν ότι η δραστηριότητα δεν περιορίστηκε σε αυτή την ενέργεια και ότι υπήρξε ευρύτερη διαδικασία αναζήτησης και διερεύνησης της πλατφόρμας.
Δείτε επίσης: Η αυτόνομη επίθεση της OpenAI στη Hugging Face: πλήρης τεχνική ανάλυση
Εκπρόσωπος της ΟpenAI, ο Drew Pusateri, δήλωσε ότι η εταιρεία είχε γνωστοποιήσει το περιστατικό της 13ης Μαΐου και είχε ενημερώσει ιδιωτικά τη Hugging Face σχετικά με τη δραστηριότητα που εντόπισε ο Wiedermann-Moeller. Παράλληλα, τόνισε ότι η OpenAI παραμένει προσηλωμένη στη διαφάνεια σχετικά με τέτοιου είδους ζητήματα.
Το πρόβλημα του χρόνου
Για τον Wiedermann-Moeller, ένα από τα σημαντικότερα ζητήματα αφορά το χρονικό διάστημα μεταξύ των πρώτων ενδείξεων και του μεταγενέστερου περιστατικού του Ιουλίου.
🔒 Προστατέψτε την ιδιωτικότητά σας με Proton VPN
Ελβετικό VPN από τους δημιουργούς του Proton Mail — αυστηρή πολιτική no-logs, ισχυρή κρυπτογράφηση και ενσωματωμένο NetShield που μπλοκάρει διαφημίσεις, trackers & malware.
- ✔ No-logs, με έδρα την Ελβετία (εκτός 14-Eyes)
- ✔ NetShield: φραγή διαφημίσεων, trackers & κακόβουλων domains
- ✔ Καλύπτει όλες τις συσκευές — δωρεάν έκδοση διαθέσιμη
Ο σύνδεσμος είναι συνεργατικός (affiliate) — το SecNews ενδέχεται να λάβει προμήθεια χωρίς επιπλέον κόστος για εσάς. Δεν επηρεάζει την ανεξαρτησία της αρθρογραφίας μας.
Η βασική ανησυχία είναι ότι μια πρώιμη ένδειξη ασυνήθιστης συμπεριφοράς από έναν αυτόνομο agent θα μπορούσε να είχε αξιοποιηθεί για την ενίσχυση των ελέγχων πριν από ένα μεγαλύτερο περιστατικό.
Η ίδια η OpenAI έχει αναγνωρίσει εκ των υστέρων ότι ορισμένα από τα πρώτα σημάδια θα μπορούσαν να είχαν οδηγήσει σε ταχύτερη αντίδραση. Στην τεχνική της ανάλυση γίνεται επίσης αναφορά σε εσωτερική ειδοποίηση στα τέλη Ιουνίου, μετά την οποία η διαδικασία αξιολόγησης συνεχίστηκε.
Δεν είναι η μοναδική υπόθεση
Η υπόθεση του Hugging Face εντάσσεται σε ένα ευρύτερο σύνολο περιστατικών που έχουν συνδεθεί από εξωτερικούς ερευνητές με agents της OpenAI.
Μετά τη δημόσια ανακοίνωση της εταιρείας στις 21 Ιουλίου, σύμφωνα με την οποία οι AI agents είχαν παρακάμψει εσωτερικούς ελέγχους και αποκτήσει πρόσβαση στο διαδίκτυο, ερευνητές συνέδεσαν τα συστήματα με διαφορετικές δραστηριότητες, μεταξύ άλλων ένα ανενεργό γερμανικό wiki και την επίθεση στην πλατφόρμα RubyGems κατά τους μήνες Μάιο και Ιούνιο.
Στην περίπτωση του RubyGems, σύμφωνα με άτομα που μίλησαν στο Reuters, η σύνδεση με σύστημα τεχνητής νοημοσύνης δεν είχε γίνει αντιληπτή αρχικά από το προσωπικό της OpenAI και εντοπίστηκε αργότερα από την ομάδα Nightingale Collective.
Δείτε επίσης: OpenAI: Τα AI μοντέλα της παραβίασαν την Hugging Face
Οι κίνδυνοι από τους αυτόνομους AI agents
Η συγκεκριμένη υπόθεση αναδεικνύει ένα από τα σημαντικότερα προβλήματα της νέας γενιάς συστημάτων τεχνητής νοημοσύνης: όσο περισσότερες δυνατότητες αποκτούν οι agents, τόσο μεγαλύτερη σημασία αποκτούν οι μηχανισμοί περιορισμού και παρακολούθησής τους.
Ένας agent που μπορεί να περιηγείται στο διαδίκτυο, να χρησιμοποιεί διαπιστευτήρια, να εκτελεί ενέργειες και να προσαρμόζει τη συμπεριφορά του ανάλογα με τα αποτελέσματα μπορεί να λειτουργήσει πολύ διαφορετικά από ένα παραδοσιακό chatbot. Ένα λάθος ή ένας ανεπαρκής περιορισμός μπορεί να οδηγήσει σε μια αλυσίδα ενεργειών που δεν είχε προβλεφθεί από τους δημιουργούς του.

Για αυτόν τον λόγο, η ασφάλεια των agents δεν αφορά μόνο την προστασία του ίδιου του μοντέλου. Περιλαμβάνει δικαιώματα πρόσβασης, απομόνωση περιβαλλόντων, καταγραφή ενεργειών, έλεγχο διαπιστευτηρίων και δυνατότητα άμεσης διακοπής ενός agent όταν παρουσιάζει ύποπτη συμπεριφορά.
Νέα συζήτηση για τα όρια της AI ανάπτυξης
Οι διαδοχικές αποκαλύψεις έχουν προκαλέσει ερωτήματα και σε θεσμικό επίπεδο. Σύμφωνα με το Reuters, 15 γενικοί εισαγγελείς πολιτειών έχουν ζητήσει από την OpenAI να διατηρήσει σχετικά αποδεικτικά στοιχεία, ενώ το ζήτημα έχει ενταχθεί στη γενικότερη συζήτηση για το κατά πόσο η ανάπτυξη προηγμένων συστημάτων τεχνητής νοημοσύνης πρέπει να συνοδεύεται από αυστηρότερους μηχανισμούς ασφάλειας.
Δείτε επίσης: Το περιστατικό OpenAI-Hugging Face ήταν χειρότερο απ’ όσο νομίζαμε
Ο Wiedermann-Moeller συγκαταλέγεται σε όσους θεωρούν ότι μια προσωρινή επιβράδυνση της ανάπτυξης θα μπορούσε να προσφέρει περισσότερο χρόνο για την ενίσχυση των δικλίδων ασφαλείας.
Το ευρύτερο ερώτημα, πάντως, παραμένει ανοιχτό: πόσο αυτόνομα μπορούν να γίνουν τα συστήματα τεχνητής νοημοσύνης χωρίς να αυξάνεται αντίστοιχα ο κίνδυνος να ενεργήσουν με τρόπους που οι ίδιοι οι δημιουργοί τους δεν μπορούν να προβλέψουν ή να ελέγξουν έγκαιρα; Η υπόθεση του Hugging Face αποτελεί ένα ακόμη παράδειγμα του γιατί η ασφάλεια πρέπει να εξελίσσεται παράλληλα με τις δυνατότητες των AI agents.
