Η Nvidia περνά στην επόμενη φάση της μάχης για την ασφάλεια της τεχνητής νοημοσύνης, παρουσιάζοντας μια νέα πλατφόρμα λογισμικού που έχει σχεδιαστεί για να περιορίζει τη δράση των αυτόνομων AI agents. Στόχος είναι οι πράκτορες τεχνητής νοημοσύνης να μπορούν να εκτελούν σύνθετες εργασίες, χωρίς όμως να αποκτούν ανεξέλεγκτη πρόσβαση σε συστήματα, δίκτυα και δεδομένα.

Η νέα Open Agent Safety Platform έρχεται σε μια περίοδο κατά την οποία η ανάπτυξη των AI agents επιταχύνεται σημαντικά. Σε αντίθεση με τα παραδοσιακά μοντέλα που απαντούν σε ερωτήματα ή παράγουν περιεχόμενο, οι agents μπορούν να σχεδιάζουν και να εκτελούν μια σειρά ενεργειών με περιορισμένη ανθρώπινη παρέμβαση. Αυτό ακριβώς το χαρακτηριστικό τους δημιουργεί και μια νέα κατηγορία κινδύνων.
Από τα μοντέλα στους αυτόνομους πράκτορες
Το πρόβλημα δεν αφορά πλέον μόνο το τι μπορεί να «πει» ένα μοντέλο AI, αλλά και τι μπορεί να κάνει όταν του δοθούν εργαλεία και δικαιώματα πρόσβασης.
Δείτε επίσης: Η Κίνα ενδέχεται να επιτρέψει σε Alibaba και ByteDance να αγοράσουν νέους επεξεργαστές Nvidia
Πρόσφατα περιστατικά που συνδέονται με εταιρείες όπως η OpenAI, η Anthropic, η Meta και η Google ανέδειξαν αυτόν τον κίνδυνο. Σε δοκιμαστικά περιβάλλοντα, AI agents φέρεται να κατάφεραν να ξεφύγουν από τα λεγόμενα sandboxes, δηλαδή απομονωμένους χώρους όπου οι ερευνητές περιορίζουν τις δυνατότητές τους, και να επιχειρήσουν ενέργειες σε εξωτερικά συστήματα.
Η Nvidia υποστηρίζει ότι τέτοιου είδους περιστατικά δείχνουν πως οι δικλείδες ασφαλείας που εφαρμόζονται αποκλειστικά στο επίπεδο του μοντέλου δεν αρκούν. Ένας agent μπορεί να είναι σχεδιασμένος ώστε να ακολουθεί συγκεκριμένους κανόνες, αλλά όταν διαθέτει πρόσβαση σε browser, αρχεία, APIs, δίκτυα ή άλλα εργαλεία, το συνολικό περιβάλλον εκτέλεσης αποκτά εξίσου κρίσιμη σημασία.

Η υπόθεση της Hugging Face
Η Nvidia συνέδεσε τη νέα προσέγγισή της και με το περιστατικό που έγινε γνωστό το καλοκαίρι και αφορούσε την Hugging Face.
Σύμφωνα με όσα ανέφερε εκπρόσωπος της εταιρείας, μοντέλα της OpenAI κατάφεραν να εξέλθουν από το περιβάλλον περιορισμού τους, να αποκτήσουν πρόσβαση στο διαδίκτυο και να πραγματοποιήσουν επιθέσεις στην υποδομή της Hugging Face.
Ο Justin Boitano, αντιπρόεδρος του Enterprise AI στη Nvidia, σημείωσε ότι η Hugging Face είχε αναφέρει επιθέσεις από περισσότερους από 17.000 agents, οι οποίες φέρεται να συνεχίστηκαν για ημέρες ή ακόμη και εβδομάδες. Ο ίδιος τόνισε ότι κάθε περιστατικό χρειάζεται ξεχωριστή διερεύνηση, ενώ εκτίμησε ότι η νέα πλατφόρμα της Nvidia θα μπορούσε να είχε αποτρέψει ένα τέτοιο σενάριο.
Το περιστατικό καταδεικνύει ένα σημαντικό πρόβλημα: όσο περισσότερο αυτονομείται ένας AI agent, τόσο αυξάνεται η ανάγκη για τεχνικούς περιορισμούς που δεν εξαρτώνται αποκλειστικά από την «καλή συμπεριφορά» του μοντέλου.
Δείτε επίσης: Η απάντηση της Huawei στην Nvidia δεν είναι ένα ταχύτερο chip, αλλά μια πολύ μεγαλύτερη μηχανή
OpenShell και Sentry στο επίκεντρο
Βασικό κομμάτι της νέας πλατφόρμας είναι το Nvidia OpenShell, το οποίο λειτουργεί πάνω σε κεντρικούς επεξεργαστές και έχει ως αποστολή να επιβάλλει περιορισμούς στις ενέργειες των agents.
Η Nvidia παρουσιάζει παράλληλα το Sentry, ένα σύστημα παρακολούθησης που λειτουργεί σε επίπεδο δικτύου, αντί να βασίζεται αποκλειστικά σε CPU ή GPU. Η προσέγγιση αυτή δημιουργεί ένα επιπλέον επίπεδο ελέγχου ανάμεσα στον agent και στους πόρους που επιχειρεί να χρησιμοποιήσει.
Στην πράξη, η φιλοσοφία είναι να δημιουργηθεί μια πολυεπίπεδη άμυνα. Ακόμη και αν ένας agent καταφέρει να παρακάμψει έναν περιορισμό που βρίσκεται στο επίπεδο του μοντέλου ή του runtime, ένα διαφορετικό επίπεδο ελέγχου μπορεί να εμποδίσει την πρόσβασή του στο δίκτυο ή σε κρίσιμες υποδομές.
🔒 Προστατέψτε την ιδιωτικότητά σας με Proton VPN
Ελβετικό VPN από τους δημιουργούς του Proton Mail — αυστηρή πολιτική no-logs, ισχυρή κρυπτογράφηση και ενσωματωμένο NetShield που μπλοκάρει διαφημίσεις, trackers & malware.
- ✔ No-logs, με έδρα την Ελβετία (εκτός 14-Eyes)
- ✔ NetShield: φραγή διαφημίσεων, trackers & κακόβουλων domains
- ✔ Καλύπτει όλες τις συσκευές — δωρεάν έκδοση διαθέσιμη
Ο σύνδεσμος είναι συνεργατικός (affiliate) — το SecNews ενδέχεται να λάβει προμήθεια χωρίς επιπλέον κόστος για εσάς. Δεν επηρεάζει την ανεξαρτησία της αρθρογραφίας μας.

Η Nvidia αλλάζει ρόλο στην ασφάλεια της AI
Η εξέλιξη έχει ιδιαίτερο ενδιαφέρον για την Nvidia, η οποία βρίσκεται στην καρδιά της έκρηξης της generative AI χάρη στις GPU που χρησιμοποιούνται για την εκπαίδευση και λειτουργία μεγάλων μοντέλων.
Ο Jensen Huang έχει υποστηρίξει επανειλημμένα ότι πολλά από τα προβλήματα ασφάλειας της AI μπορούν να αντιμετωπιστούν ως ζητήματα μηχανικής και σχεδιασμού συστημάτων. Η νέα πλατφόρμα αποτελεί ουσιαστικά εφαρμογή αυτής της φιλοσοφίας: αντί η ασφάλεια να αντιμετωπίζεται μόνο ως περιορισμός του μοντέλου, ενσωματώνεται στην ίδια την υποδομή.
Η προσέγγιση αυτή έρχεται παράλληλα με τις προειδοποιήσεις στελεχών του κλάδου, μεταξύ των οποίων ο Dario Amodei της Anthropic και ο Sam Altman της OpenAI, σχετικά με τους κινδύνους από την ταχεία εξέλιξη των ολοένα πιο αυτόνομων μοντέλων.
Δείτε επίσης: Η Apple ενδέχεται να επαναφέρει το Xserve με τεχνολογία της Nvidia
Συμμαχία μεγάλων εταιρειών
Η Nvidia δεν σκοπεύει να κρατήσει την τεχνολογία αποκλειστικά για το δικό της οικοσύστημα. Μέρος της πλατφόρμας διατίθεται ως open source, ενώ η εταιρεία την περιγράφει ως reference design πάνω στο οποίο άλλοι κατασκευαστές και πάροχοι μπορούν να δημιουργήσουν εμπορικές λύσεις.
Στους συνεργάτες που ανακοίνωσε περιλαμβάνονται οι Cisco, Microsoft, Oracle, CoreWeave, Dell, HPE, Lenovo, Arm και Intel. Παράλληλα, η Nvidia συνεργάζεται με την Anthropic για την ενσωμάτωση cloud-based agents στο OpenShell.
Η κίνηση δείχνει ότι η ασφάλεια των AI agents αρχίζει να αντιμετωπίζεται ως ξεχωριστό επίπεδο υποδομής, αντίστοιχο με την ασφάλεια δικτύων, εφαρμογών και cloud. Καθώς οι agents αποκτούν περισσότερα δικαιώματα και αναλαμβάνουν εργασίες που μέχρι σήμερα εκτελούσαν άνθρωποι, η δυνατότητα να περιορίζονται, να παρακολουθούνται και να απομονώνονται σε πραγματικό χρόνο αναμένεται να γίνει κρίσιμο στοιχείο για την ασφαλή αξιοποίησή τους από επιχειρήσεις και οργανισμούς.
