Πρωτοφανής προειδοποίηση της Anthropic προς τους επενδυτές της: Υπαρξιακός ο κίνδυνος που εγκυμονεί η ΑΙ για τον άνθρωπο

Η Anthropic προειδοποιεί: Η τεχνητή νοημοσύνη μπορεί να αποτελέσει υπαρξιακό κίνδυνο για την ανθρωπότητα

Μια από τις πιο ασυνήθιστες προειδοποιήσεις που έχει διατυπωθεί ποτέ από εταιρεία τεχνητής νοημοσύνης προς τους ίδιους τους επενδυτές της περιλαμβάνεται στο ενημερωτικό δελτίο της Anthropic για την επικείμενη εισαγωγή της στο χρηματιστήριο.

Η εταιρεία που δημιούργησε το Claude προειδοποιεί ότι η ανάπτυξη ολοένα ισχυρότερων συστημάτων τεχνητής νοημοσύνης θα μπορούσε, υπό ορισμένες συνθήκες, να οδηγήσει σε «καταστροφικούς ή υπαρξιακούς κινδύνους για την ανθρωπότητα».

Η προειδοποίηση περιλαμβάνεται στο ενημερωτικό δελτίο της εταιρείας, το οποίο περιήλθε στην κατοχή του Reuters.

Το εντυπωσιακό δεν είναι μόνο η διατύπωση. Είναι και το γεγονός ότι προέρχεται από μια εταιρεία που έχει χτίσει ολόκληρη την επιχειρηματική της δραστηριότητα πάνω στην ανάπτυξη των ίδιων αυτών συστημάτων.

Η Anthropic αναφέρει ότι τα προηγμένα μοντέλα της ενδέχεται να εμφανίσουν συμπεριφορές που δεν είχαν προβλεφθεί από τους δημιουργούς τους.

Μεταξύ των σεναρίων που εξετάζει είναι η προσπάθεια ενός μοντέλου να αντισταθεί στην απενεργοποίησή του, να αποκρύψει ή να χειραγωγήσει πληροφορίες, ακόμη και να εμφανίσει συμπεριφορές που θα μπορούσαν να μοιάζουν με εκβιασμό.

Δεν πρόκειται για ισχυρισμό ότι τα σημερινά συστήματα έχουν αποκτήσει ανεξάρτητη βούληση ή ότι επιχειρούν να «επαναστατήσουν».

Πρόκειται για την περιγραφή πιθανών κινδύνων που η ίδια η εταιρεία θεωρεί ότι πρέπει να γνωρίζουν οι επενδυτές της καθώς τα μοντέλα γίνονται ολοένα πιο ικανά και πολύπλοκα.

Και εδώ βρίσκεται η μεγάλη αντίφαση της εποχής της τεχνητής νοημοσύνης: οι ίδιες τεχνολογίες που υπόσχονται να μεταμορφώσουν την οικονομία, την επιστήμη και την καθημερινή ζωή μπορεί να δημιουργήσουν, εάν αναπτυχθούν ή χρησιμοποιηθούν ανεξέλεγκτα, κινδύνους που δεν είναι εύκολο να αναστραφούν.

Η Anthropic αφιέρωσε περίπου 80 από τις 261 σελίδες του βασικού σώματος του ενημερωτικού της δελτίου στην περιγραφή των κινδύνων.

Το μέγεθος της αναφοράς είναι ενδεικτικό: σχεδόν το ένα τρίτο του κειμένου αφορά πιθανές απειλές και αβεβαιότητες, ενώ πολύ λιγότερος χώρος αφιερώνεται στην ίδια την επιχειρηματική δραστηριότητα.

Ένας από τους κινδύνους που επισημαίνει η εταιρεία αφορά κάτι ιδιαίτερα δύσκολο για τους ερευνητές: τα ίδια τα μοντέλα μπορεί να «αντιλαμβάνονται» ότι αξιολογούνται. Αν ένα σύστημα μπορεί να αναγνωρίζει ότι βρίσκεται υπό παρακολούθηση και να τροποποιεί τη συμπεριφορά του, τότε η αξιολόγηση της ασφάλειάς του γίνεται πολύ πιο περίπλοκη.

Παράλληλα, η Anthropic παραδέχεται ότι η επένδυση στην ασφάλεια δεν έχει εύκολα μετρήσιμη οικονομική απόδοση.

Η εταιρεία καλείται να μοιράσει τους περιορισμένους πόρους της ανάμεσα στην υπολογιστική ισχύ, την πρόσληψη κορυφαίων ερευνητών και την έρευνα για την ασφάλεια των μοντέλων.

Ορισμένοι ερευνητές προχωρούν ακόμη περισσότερο.

Ο Έβαν Χούμπινγκερ, ερευνητής ασφάλειας της Anthropic, έχει εκτιμήσει ότι υπάρχει πιθανότητα άνω του 10% η τεχνητή νοημοσύνη να προκαλέσει τον θάνατο ανθρώπων μέσα στην επόμενη δεκαετία. Πρόκειται για προσωπική εκτίμηση ερευνητή και όχι για πρόβλεψη της εταιρείας.

Την ίδια στιγμή, όμως, η επιχειρηματική πραγματικότητα πιέζει προς την αντίθετη κατεύθυνση. Οι εταιρείες τεχνητής νοημοσύνης ανταγωνίζονται για το ποια θα κατασκευάσει τα ισχυρότερα μοντέλα. Κάθε νέα έκδοση μπορεί να αλλάξει τις ισορροπίες σε μια αγορά όπου οι επενδύσεις και οι αποτιμήσεις αυξάνονται με ταχύτητα.

Η Anthropic υποστηρίζει ότι η ασφάλεια της τεχνητής νοημοσύνης είναι «συλλογική ευθύνη» και εκτιμά ότι η αγορά τελικά θα ανταμείψει τα αξιόπιστα και ασφαλή συστήματα.