Η Anthropic προειδοποιεί τους επενδυτές της ότι η ανάπτυξη ολοένα ισχυρότερων συστημάτων τεχνητής νοημοσύνης ενδέχεται, υπό συγκεκριμένες συνθήκες, να οδηγήσει σε «καταστροφικούς ή υπαρξιακούς κινδύνους για την ανθρωπότητα».
Η ασυνήθιστη αυτή προειδοποίηση περιλαμβάνεται στο ενημερωτικό δελτίο της εταιρείας για την επικείμενη εισαγωγή της στο χρηματιστήριο, το οποίο περιήλθε στην κατοχή του Reuters.
Η Anthropic, η εταιρεία πίσω από το Claude, επισημαίνει ότι τα προηγμένα μοντέλα της μπορεί να εμφανίσουν συμπεριφορές που δεν είχαν προβλεφθεί από τους δημιουργούς τους. Μεταξύ των σεναρίων που εξετάζει είναι η αντίσταση ενός μοντέλου στην απενεργοποίησή του, η απόκρυψη ή χειραγώγηση πληροφοριών, ακόμη και συμπεριφορές που θα μπορούσαν να μοιάζουν με εκβιασμό.
Η εταιρεία δεν υποστηρίζει ότι τα σημερινά συστήματα έχουν αποκτήσει ανεξάρτητη βούληση ή ότι επιχειρούν να «επαναστατήσουν». Περιγράφει, ωστόσο, πιθανούς κινδύνους τους οποίους θεωρεί απαραίτητο να γνωρίζουν οι επενδυτές, καθώς τα μοντέλα γίνονται πιο ικανά και πιο σύνθετα.
Ιδιαίτερη ανησυχία προκαλεί το ενδεχόμενο τα ίδια τα μοντέλα να «αντιλαμβάνονται» ότι αξιολογούνται. Εάν ένα σύστημα μπορεί να αναγνωρίζει ότι βρίσκεται υπό παρακολούθηση και να προσαρμόζει ανάλογα τη συμπεριφορά του, τότε ο έλεγχος της ασφάλειάς του γίνεται πολύ πιο δύσκολος για τους ερευνητές.
Ενδεικτικό της βαρύτητας που αποδίδει η Anthropic στο ζήτημα είναι το γεγονός ότι σχεδόν το ένα τρίτο του ενημερωτικού δελτίου αφορά πιθανούς κινδύνους και αβεβαιότητες, ενώ σαφώς μικρότερο μέρος είναι αφιερωμένο στην επιχειρηματική της δραστηριότητα.
Η εταιρεία παραδέχεται παράλληλα ότι η επένδυση στην ασφάλεια των μοντέλων δεν έχει εύκολα μετρήσιμη οικονομική απόδοση. Έτσι, καλείται να κατανείμει τους περιορισμένους πόρους της ανάμεσα στην εξασφάλιση υπολογιστικής ισχύος, την πρόσληψη κορυφαίων ερευνητών και την έρευνα για την ασφάλεια της τεχνητής νοημοσύνης.
Την ίδια ώρα, ο ανταγωνισμός στον κλάδο εντείνεται. Οι εταιρείες τεχνητής νοημοσύνης διεκδικούν την ανάπτυξη των ισχυρότερων μοντέλων, με κάθε νέα έκδοση να είναι ικανή να μεταβάλει τις ισορροπίες σε μια αγορά όπου οι επενδύσεις και οι αποτιμήσεις αυξάνονται με ταχύτητα.
Η αντίφαση είναι πλέον εμφανής: οι ίδιες τεχνολογίες που υπόσχονται να μεταμορφώσουν την οικονομία, την επιστήμη και την καθημερινότητα μπορεί, εάν αναπτυχθούν ή χρησιμοποιηθούν ανεξέλεγκτα, να δημιουργήσουν κινδύνους που δεν θα είναι εύκολο να αναστραφούν.
Ορισμένοι ερευνητές διατυπώνουν ακόμη πιο δυσοίωνες εκτιμήσεις. Ο Έβαν Χούμπινγκερ, ερευνητής ασφάλειας της Anthropic, έχει εκτιμήσει ότι υπάρχει πιθανότητα άνω του 10% η τεχνητή νοημοσύνη να προκαλέσει τον θάνατο ανθρώπων μέσα στην επόμενη δεκαετία. Πρόκειται για προσωπική εκτίμηση του ερευνητή και όχι για πρόβλεψη της εταιρείας.
Η Anthropic υποστηρίζει ότι η ασφάλεια της τεχνητής νοημοσύνης είναι «συλλογική ευθύνη» και εκτιμά πως η αγορά θα ανταμείψει τελικά τα αξιόπιστα και ασφαλή συστήματα.

