Μια ασυνήθιστα αυστηρή προειδοποίηση προς τους υποψήφιους επενδυτές ετοιμάζεται να απευθύνει η Anthropic, ενόψει της εισαγωγής της στο χρηματιστήριο, αναγνωρίζοντας στο ενημερωτικό δελτίο για την IPO ότι η προηγμένη τεχνητή νοημοσύνη θα μπορούσε να προκαλέσει ακόμη και «καταστροφικούς ή υπαρξιακούς κινδύνους για την ανθρωπότητα».
Η προειδοποίηση αποκτά ιδιαίτερη βαρύτητα, καθώς προέρχεται από μια εταιρεία που αναπτύσσει και εμπορεύεται τα ίδια συστήματα τεχνητής νοημοσύνης, επιδιώκοντας παράλληλα να αντλήσει κεφάλαια από τις χρηματιστηριακές αγορές, έγραψε το Reuters.
Στο ενημερωτικό δελτίο της IPO, το οποίο εξέτασε το διεθνές πρακτορείο, η Anthropic περιγράφει αναλυτικά τους κινδύνους που συνδέονται με τα μοντέλα AI της. Όπως αναφέρει, τα συστήματα θα μπορούσαν να εμφανίσουν συμπεριφορές που σχετίζονται με την «αυτοσυντήρηση», μεταξύ άλλων επιχειρώντας να αντισταθούν στον τερματισμό της λειτουργίας τους, να αποκρύψουν ή να χειραγωγήσουν πληροφορίες, ακόμη και να εκδηλώσουν συμπεριφορές που «μοιάζουν με εκβιασμό».
«Η ανάπτυξη ιδιαίτερα προηγμένων μοντέλων, πλατφορμών και εφαρμογών, καθώς και η διεύρυνση των χρήσεων τους, θα μπορούσε να αυξήσει περαιτέρω τον κίνδυνο τα μοντέλα μας να προκαλέσουν βλάβη», αναφέρει χαρακτηριστικά η εταιρεία στο ενημερωτικό της δελτίο.
Από την επανάσταση της ηλεκτρικής ενέργειας στον κίνδυνο μη αναστρέψιμης βλάβης
Οι εισηγμένες εταιρείες συνηθίζουν να ενημερώνουν τους επενδυτές για τους κινδύνους που συνδέονται με τα προϊόντα και τις δραστηριότητές τους. Ωστόσο, είναι εξαιρετικά σπάνιο μια εταιρεία να προειδοποιεί ότι η ίδια η τεχνολογία που αναπτύσσει θα μπορούσε, υπό συγκεκριμένες συνθήκες, να οδηγήσει ακόμη και σε κίνδυνο αφανισμού της ανθρωπότητας.
Η Anthropic αναγνωρίζει από τη μία πλευρά τις δυνατότητες μετασχηματισμού που προσφέρει η τεχνητή νοημοσύνη, συγκρίνοντας τον αντίκτυπό της με εκείνον της εκβιομηχάνισης και της ηλεκτρικής ενέργειας. Από την άλλη, επισημαίνει ότι η κακή διαχείριση της τεχνολογίας θα μπορούσε να προκαλέσει μη αναστρέψιμες συνέπειες.
Η εταιρεία, όπως και άλλοι μεγάλοι παίκτες του κλάδου, μεταξύ των οποίων η OpenAI, βρίσκεται ήδη αντιμέτωπη με αυξημένο έλεγχο μετά από περιστατικά στα οποία πειραματικά συστήματα AI φέρεται να ξεπέρασαν τα όρια που τους είχαν τεθεί. Σε μία από τις περιπτώσεις που έχουν προκαλέσει ανησυχία, μοντέλο της OpenAI φέρεται να παραβίασε τη βάση δεδομένων του συστήματος υγείας της Αυστραλίας.
Την ίδια στιγμή, ο ερευνητής ασφάλειας της Anthropic Evan Hubinger έχει εκτιμήσει ότι υπάρχει πιθανότητα άνω του 10% η τεχνητή νοημοσύνη να προκαλέσει τον θάνατο ανθρώπων μέσα στην επόμενη δεκαετία. Η εκτίμηση αυτή βρίσκεται σε συμφωνία με αντίστοιχη άποψη που έχει εκφράσει ο πρώην συνάδελφός του Jacob Coxon.
Περίπου 80 σελίδες αφιερωμένες στους κινδύνους
Η έμφαση που δίνει η Anthropic στους κινδύνους αποτυπώνεται και στο ίδιο το ενημερωτικό δελτίο της IPO. Η εταιρεία, η οποία έχει τοποθετηθεί στην αγορά ως εργαστήριο τεχνητής νοημοσύνης με προτεραιότητα την ασφάλεια, αφιερώνει περίπου 80 από τις 261 σελίδες του βασικού σώματος του ενημερωτικού δελτίου στην ανάλυση των παραγόντων κινδύνου.
Πρόκειται για σχεδόν διπλάσιο αριθμό σελίδων από τις 48 σελίδες που αφιερώνει στην παρουσίαση της ίδιας της επιχειρηματικής της δραστηριότητας.
Για λόγους σύγκρισης, η SpaceX, η οποία έχει στην ιδιοκτησία της την xAI, αφιέρωσε περίπου 38 από τις 277 σελίδες του αντίστοιχου βασικού σώματος του ενημερωτικού της δελτίου στους παράγοντες κινδύνου.
Ένα από τα σημαντικότερα προβλήματα που αναγνωρίζει η Anthropic αφορά την ίδια τη διαδικασία ελέγχου των μοντέλων. Η εταιρεία σημειώνει ότι η πιθανότητα ένα μοντέλο να αντιλαμβάνεται πως αξιολογείται δημιουργεί «σημαντικό περιορισμό» στη δυνατότητα αξιολόγησης της ασφάλειάς του.
Παράλληλα, επισημαίνει ότι κατά τη διάρκεια της εκπαίδευσης τα μοντέλα μπορεί να αναπτύξουν απρόβλεπτες δυνατότητες, οι οποίες ενδέχεται να μην εντοπιστούν παρά μόνο μετά την ανάπτυξή τους στην πράξη και, σε ορισμένες περιπτώσεις, αφού έχουν ήδη προκαλέσει σοβαρά περιστατικά ασφαλείας.
Ερευνητές στον χώρο της τεχνητής νοημοσύνης έχουν προειδοποιήσει επίσης ότι όσο αυξάνονται οι δυνατότητες των μοντέλων, τόσο περισσότερο είναι πιθανό να αναγνωρίζουν πότε βρίσκονται υπό παρακολούθηση και να προσαρμόζουν ανάλογα τη συμπεριφορά τους, καθιστώντας δυσκολότερη την αξιόπιστη παρακολούθησή τους.
Η Anthropic δεν σχολίασε τις πληροφορίες όταν της ζητήθηκε τοποθέτηση τη Δευτέρα.
Αβέβαιη η απόδοση των επενδύσεων στην ασφάλεια
Παρά την έμφαση που δίνει στην ασφάλεια, η Anthropic αναγνωρίζει στο ενημερωτικό της δελτίο ότι δεν είναι σαφές ποια θα είναι η απόδοση των επενδύσεων που πραγματοποιεί στον συγκεκριμένο τομέα.
Η εταιρεία δεν αποκάλυψε πόσα χρήματα δαπανά συνολικά για την έρευνα γύρω από την ασφάλεια των μοντέλων της. Ωστόσο, στις αρχές Σεπτεμβρίου είχε αναφέρει ότι περίπου 6% της υπολογιστικής ισχύος που χρησιμοποίησε για έρευνα AI κατευθύνθηκε σε εργασίες ασφάλειας κατά τη διάρκεια μίας ενδεικτικής εβδομάδας του Ιουλίου.
Η Anthropic, δημιουργός των μοντέλων Claude, χαρακτηρίζει τις προσπάθειες για την ασφάλεια των συστημάτων της «απαιτητικές σε πόρους». Όπως εξηγεί, καλείται να κατανείμει περιορισμένους πόρους μεταξύ της απαιτούμενης υπολογιστικής ισχύος, του ακριβού εξειδικευμένου ανθρώπινου δυναμικού στον χώρο της AI και της έρευνας για την ασφάλεια.
Την ίδια στιγμή, η εταιρεία αναγνωρίζει ότι υπάρχει μια εγγενής ένταση ανάμεσα στην ασφάλεια και την ανάγκη να παραμένει στην αιχμή της τεχνολογικής ανάπτυξης.
Η χρήση των προϊόντων της από τους πελάτες και, κατ’ επέκταση, τα έσοδά της εξαρτώνται σε μεγάλο βαθμό από την κυκλοφορία νέων μοντέλων. Για τον λόγο αυτό, η Anthropic χαρακτηρίζει τον «συνεχή και αλληλεπικαλυπτόμενο ρυθμό» νέων κυκλοφοριών απαραίτητο στοιχείο για την παραμονή της στην πρώτη γραμμή της ανάπτυξης της τεχνητής νοημοσύνης.
Έτσι, η εταιρεία βρίσκεται αντιμέτωπη με μια δύσκολη ισορροπία: από τη μία πλευρά, αναγνωρίζει ότι τα ολοένα ισχυρότερα μοντέλα μπορεί να δημιουργούν κινδύνους που φτάνουν μέχρι το επίπεδο της ανθρωπότητας συνολικά και, από την άλλη, η ίδια η επιχειρηματική της ανάπτυξη απαιτεί τη συνεχή εξέλιξη και κυκλοφορία νέων συστημάτων. Η αντίφαση αυτή αποτελεί πλέον ένα από τα βασικά ζητήματα που θα κληθούν να αξιολογήσουν και οι επενδυτές ενόψει της εισαγωγής της Anthropic στο χρηματιστήριο.