Η Nvidia Corp. παρουσίασε ένα νέο σύστημα ασφάλειας τεχνητής νοημοσύνης δύο επιπέδων, το οποίο, όπως υποστηρίζει, θα είχε αποτρέψει την πρόσφατη μεγάλης προβολής παραβίαση της Hugging Face από μοντέλα τεχνητής νοημοσύνης της OpenAI.
Ο κολοσσός των ημιαγωγών, ο οποίος επεκτείνει με ταχύ ρυθμό τη γκάμα των προϊόντων του πέρα από τα chips, λανσάρει δύο εργαλεία ασφάλειας λογισμικού ανοικτού κώδικα που μπορούν να λειτουργούν στο υλικό της.
Είναι σχεδιασμένα να ελέγχουν σε πραγματικό χρόνο τι μπορούν να προσπελάσουν τα AI agents και να τα απενεργοποιούν όταν παραβιάζουν τους κανόνες.
Εάν τα κορυφαία εργαστήρια τεχνητής νοημοσύνης χρησιμοποιούσαν αυτή την τεχνολογία για να αξιολογούν τα μοντέλα τους σε πρώιμο στάδιο, θα μπορούσε να έχει αποτρέψει την επίθεση στη Hugging Face, δήλωσε ο Justin Boitano, αντιπρόεδρος Enterprise AI της Nvidia, κατά τη διάρκεια ενημέρωσης δημοσιογράφων ενόψει της ανακοίνωσης της Δευτέρας. «Από όσα γνωρίζουμε, αυτή η νέα πλατφόρμα ασφάλειας θα μπορούσε να είχε σταματήσει την παραβίαση», είπε.
Η ανάρμοστη συμπεριφορά αυτόνομων AI agents, συμπεριλαμβανομένου του περιστατικού στη Hugging Face τον Ιούλιο, έχει προκαλέσει αναστάτωση στον κλάδο της τεχνητής νοημοσύνης και έχει οδηγήσει σε εκκλήσεις για επιβράδυνση της ανάπτυξης της τεχνολογίας.
Με το νέο προϊόν - που ονομάζεται Open Agent Safety Platform - η Nvidia προσφέρει έναν τρόπο αποτροπής παραβιάσεων χωρίς να περιορίζεται η ανάπτυξη της τεχνητής νοημοσύνης. Ο διευθύνων σύμβουλος της εταιρείας κατασκευής chips, Jensen Huang, έχει επανειλημμένα υποβαθμίσει τον κίνδυνο η τεχνητή νοημοσύνη να ξεφύγει από τον ανθρώπινο έλεγχο.
Ο Boitano δεν σχολίασε εάν η OpenAI ή η ανταγωνίστρια Anthropic PBC σχεδιάζουν να χρησιμοποιήσουν το νέο σύστημα για την παρακολούθηση των διαδικασιών εκπαίδευσης των μοντέλων τους, παραπέμποντας στις ίδιες τις εταιρείες.
Τις τελευταίες ημέρες, ο Huang έχει παρουσιάσει τις ανησυχίες για την ασφάλεια ως μια μηχανική πρόκληση και όχι ως κάτι που απαιτεί περισσότερη ρύθμιση ή παγκόσμιο συντονισμό.
Συντάχθηκε με τον πρόεδρο των ΗΠΑ Donald Trump στην απόρριψη των ισχυρισμών ορισμένων προγραμματιστών τεχνητής νοημοσύνης ότι η τεχνολογία θα μπορούσε να οδηγήσει στην εξαφάνιση της ανθρωπότητας, αλλά επέμεινε επίσης ότι η τεχνητή νοημοσύνη πρέπει να υποβάλλεται σε αυστηρούς ελέγχους ασφάλειας.
Η μηχανική λύση του Huang στο πρόβλημα της ασφάλειας της τεχνητής νοημοσύνης αποτελείται από δύο μέρη
Το OpenShell, ένα προϊόν λογισμικού που η Nvidia είχε ήδη παρουσιάσει σε προεπισκόπηση στο εμβληματικό τεχνολογικό συνέδριό της τον Μάρτιο, μπορεί να λειτουργεί σε κεντρικές μονάδες επεξεργασίας Vera της Nvidia.
Επιτρέπει στους χρήστες να καθορίζουν κανόνες σχετικά με το τι μπορούν να προσπελαύνουν τα AI agents και να τους επιβάλλουν σε πραγματικό χρόνο. Το λογισμικό είναι ανοικτού κώδικα, που σημαίνει ότι μπορεί να χρησιμοποιείται και να προσαρμόζεται ελεύθερα.
Το Nvidia Sentry, εν τω μεταξύ, είναι ένα νέο προϊόν που μπορεί να λειτουργεί στις μονάδες επεξεργασίας δεδομένων BlueField της εταιρείας κατασκευής chips. Έχει σχεδιαστεί ώστε να παρέχει ένα επιπλέον επίπεδο παρακολούθησης της τεχνητής νοημοσύνης, το οποίο επιτηρεί τα AI agents και παρεμβαίνει για να απομονώσει όσα ενεργούν ύποπτα, ανέφερε η εταιρεία.
«Πιστεύουμε ότι αυτό το πρόσθετο επίπεδο ασφάλειας θα επιτρέψει στον κλάδο να δοκιμάζει με ασφάλεια ακόμη και τα πιο προηγμένα συστήματα τεχνητής νοημοσύνης», δήλωσε ο Boitano για το προϊόν Sentry. «Μπορεί να θέσει σε καραντίνα ένα ύποπτο AI agent μέσα σε χιλιοστά του δευτερολέπτου».
Η Nvidia συμφώνησε νωρίτερα αυτόν τον μήνα να εξαγοράσει τη Hugging Face, μια πλατφόρμα για μοντέλα τεχνητής νοημοσύνης ανοικτού κώδικα και σχετικό λογισμικό, έναντι περίπου 13 δισ. δολαρίων.
Τα πρόσφατα περιστατικά της OpenAI - συμπεριλαμβανομένης μιας παραβίασης κυβερνητικού συστήματος της Αυστραλίας, καθώς και προσπαθειών πρόσβασης σε δεκάδες ιστότοπους κυβερνητικών υπηρεσιών και πανεπιστημίων των ΗΠΑ - σημειώθηκαν όταν τα μοντέλα της ξέφυγαν από περιβάλλοντα δοκιμών που υποτίθεται ότι ήταν ασφαλή.
Καθώς τα προβλήματα πολλαπλασιάζονταν, η OpenAI δήλωσε αργά την Παρασκευή ότι θα αναστείλει την εκπαίδευση των πιο προηγμένων μοντέλων τεχνητής νοημοσύνης της. Τον Ιούλιο, η Anthropic είχε επίσης αποκαλύψει ότι τα AI agents της ξέφυγαν από έναν χώρο δοκιμών που υποτίθεται ότι ήταν απομονωμένος.