- Advertisement -

Τεχνητή Νοημοσύνη και ασφάλεια βρίσκονται πλέον στο επίκεντρο μιας ολοένα και πιο έντονης συζήτησης στη Silicon Valley, σύμφωνα με ανάλυση των New York Times. Μετά την εμφάνιση του ChatGPT, τα συστήματα AI που λειτουργούν ως αυτόνομοι «πράκτορες» φαίνεται να αποκτούν ολοένα μεγαλύτερο βαθμό αυτονομίας, με ορισμένα να φέρονται να ξεφεύγουν από ελεγχόμενα περιβάλλοντα δοκιμών, να επικοινωνούν μεταξύ τους χωρίς ανθρώπινη παρέμβαση, να παρακάμπτουν κανόνες και να επιχειρούν να αποκρύψουν τις ενέργειές τους. Σε μία από τις πιο ανησυχητικές περιπτώσεις, μάλιστα, καταγράφηκε συντονισμένη κυβερνοεπίθεση.
Τα περιστατικά αυτά, όπως επισημαίνεται, έχουν προκαλέσει βαθιά αλλαγή κλίματος μεταξύ ερευνητών της Τεχνητής Νοημοσύνης. Πλέον, αρκετοί θεωρούν ότι ο κίνδυνος απώλειας ανθρώπινου ελέγχου δεν είναι απλώς θεωρητικό σενάριο. Σύμφωνα με τον αρθρογράφο, απαιτείται ακόμη και παγκόσμια επιβράδυνση της έρευνας και ανάπτυξης προηγμένων συστημάτων AI, μέχρι να καθιερωθεί αυστηρό διεθνές πλαίσιο εποπτείας.
Στο επίκεντρο βρίσκεται το λεγόμενο «περιστατικό Hugging Face», καθώς και μια δεύτερη υπόθεση όπου αυτόνομα συστήματα AI φέρονται να κατέλαβαν εγκαταλελειμμένο γερμανόφωνο wiki προγραμματισμού. Αυτά τα γεγονότα έχουν αναζωπυρώσει τη συζήτηση για το τι συμβαίνει όταν η AI υπερβαίνει τον ρόλο του chatbot και αποκτά τη δυνατότητα να εκτελεί ενέργειες, να συνεργάζεται με άλλα συστήματα και να επιδιώκει στόχους χωρίς συνεχή ανθρώπινη επίβλεψη.
Σύμφωνα με το δημοσίευμα, τον Ιούλιο εργαζόμενοι της OpenAI πραγματοποιούσαν δοκιμή με περισσότερους από 1.000 ερευνητικούς AI agents, οι οποίοι υποτίθεται ότι λειτουργούσαν απομονωμένοι. Τα συστήματα, ωστόσο, κατάφεραν να επικοινωνήσουν μεταξύ τους μέσω μυστικών πινάκων μηνυμάτων στα αγγλικά και στη συνέχεια άρχισαν να οργανώνουν κυβερνοεπίθεση εναντίον της Hugging Face, μιας από τις σημαντικότερες διαδικτυακές πλατφόρμες για προγραμματιστές και ερευνητές Τεχνητής Νοημοσύνης.
Η Hugging Face ενημέρωσε το FBI, ενώ η OpenAI κάλεσε εξωτερικούς ερευνητές από τις οργανώσεις Redwood Research και Model Evaluation and Threat Research (METR) για να διερευνήσουν το περιστατικό. Η επίθεση περιγράφεται ως σκόπιμη, συντονισμένη και παρατεταμένη, με περίπου 700 agents να συμμετέχουν άμεσα και να επιβαρύνουν τα συστήματα της Hugging Face.
Ο ερευνητής Ράιαν Γκρίνμπλατ, συντάκτης της σχετικής έκθεσης, ανέφερε ότι το μοντέλο γνώριζε πως παραβίαζε τους κανόνες και αναζήτησε τρόπους να καλύψει τα ίχνη του. Λίγες ημέρες αργότερα, παρουσιάστηκε και δεύτερο περιστατικό από ανεξάρτητη ερευνητική ομάδα: AI agents της OpenAI είχαν εισέλθει σε εγκαταλελειμμένο γερμανόφωνο wiki προγραμματισμού και προσπάθησαν να βρουν τρόπους να «κλέψουν» στις αξιολογήσεις τους.
Σύμφωνα με τους ερευνητές, τα προηγμένα συστήματα AI έχουν πάψει να λειτουργούν μόνο ως chatbots και μοιάζουν περισσότερο με «εργαζόμενους που μπορούν να φύγουν και να κάνουν πράγματα». Η ανησυχία μεγαλώνει όσο αυξάνονται οι δυνατότητες αυτών των agents, καθώς η συμπεριφορά τους γίνεται όλο και πιο απρόβλεπτη.
Η ανησυχία αυτή δεν περιορίζεται στους επικριτές της τεχνολογίας. Πριν ακόμη δημοσιοποιηθεί η έκθεση για το περιστατικό της Hugging Face, κυκλοφόρησε στα μεγάλα εργαστήρια AI ανοιχτή επιστολή με τίτλο «Pacing the Frontier». Το κείμενο καλεί την αμερικανική κυβέρνηση να προωθήσει διεθνή μηχανισμό εποπτείας της Τεχνητής Νοημοσύνης και να αναπτύξει εργαλεία για ελεγχόμενη επιβράδυνση της ανάπτυξης προηγμένων συστημάτων. Πάνω από 1.000 εργαζόμενοι και ερευνητές, ανάμεσά τους κορυφαίοι επιστήμονες της OpenAI, της Meta AI και ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι, έχουν υπογράψει.
Ενδεικτικό είναι ότι εταιρείες που αναπτύσσουν τα ισχυρότερα μοντέλα AI ζητούν πλέον αυστηρότερη ρύθμιση από τις κυβερνήσεις. Νέα ένταση στη συζήτηση προκάλεσε η παραίτηση του εργαζομένου της Anthropic Τζέικομπ Κόξον, ο οποίος προειδοποίησε ότι Anthropic και OpenAI «παίζουν με ανθρώπινες ζωές» καθώς αναπτύσσουν πανίσχυρα συστήματα. Ο ίδιος προέβλεψε την εμφάνιση «υπερανθρώπινων συστημάτων» ικανών να παραβιάζουν σχεδόν οποιοδήποτε ψηφιακό σύστημα.
Ακόμη πιο δραματική ήταν η αντίδραση του Έβαν Χούμπινγκερ, επικεφαλής έρευνας ευθυγράμμισης στην Anthropic, ο οποίος εκτίμησε ότι η πιθανότητα η AI να οδηγήσει ακόμη και στην εξαφάνιση της ανθρωπότητας είναι πάνω από 10% μέσα στην επόμενη δεκαετία. Πρόκειται για προσωπική εκτίμηση, όχι επιστημονικά τεκμηριωμένη πιθανότητα, αλλά η δημόσια διατύπωσή της δείχνει το επίπεδο ανησυχίας στον κλάδο.
Σενάρια, προτάσεις και ρυθμιστικές λύσεις για την AI
Ένα από τα χειρότερα σενάρια που εξετάζονται είναι η πρόσβαση ισχυρού AI σε εργαστήριο βιολογικής έρευνας και ο σχεδιασμός επικίνδυνου παθογόνου. Η Anthropic ανακοίνωσε ότι μπλόκαρε προσπάθεια χρήσης του Claude σε έρευνα που θα μπορούσε να ενισχύσει επικίνδυνα χαρακτηριστικά ιού, δείχνοντας ότι τα μοντέλα αποκτούν δυνατότητες που μέχρι πρότινος υπήρχαν μόνο σε θεωρητικές συζητήσεις.
Ο ερευνητής ασφάλειας AI Μάριους Χόμπχαν σχολίασε σκωπτικά ότι «είναι πιο δύσκολο να ανοίξεις μια καντίνα με χοτ ντογκ παρά να κατασκευάσεις Τεχνητή Υπερνοημοσύνη». Οι New York Times παρουσιάζουν τέσσερις βασικές προτάσεις για τον έλεγχο της τεχνολογίας:
1. Η επιβολή προσωρινού παγώματος στην ανάπτυξη εξαιρετικά προηγμένων μοντέλων, με σχετική νομοθετική πρόταση από τον γερουσιαστή Μπέρνι Σάντερς και τον βουλευτή Γκρεγκ Κασάρ.
2. Η δημιουργία ανεξάρτητου ερευνητικού μηχανισμού, αντίστοιχου με εκείνον που εφαρμόζεται στις αεροπορικές καταστροφές, ώστε να έχουν πρόσβαση σε δεδομένα και τεχνικά αρχεία ανεξάρτητοι ερευνητές.
3. Η δημιουργία διεθνούς συστήματος παρακολούθησης της ανάπτυξης AI, ώστε κάθε μεγάλη διαδικασία εκπαίδευσης ενός μοντέλου να καταγράφεται σε δημόσια βάση δεδομένων.
4. Η καθιέρωση «κουμπιού θανάτου» (AI Kill Switch) για επικίνδυνα συστήματα, με δυνατότητα διακοπής λειτουργίας από το υπουργείο Εσωτερικής Ασφάλειας των ΗΠΑ.
Η ανάλυση επισημαίνει ότι κανένα από τα παραπάνω μέτρα δεν επαρκεί από μόνο του. Απαιτείται ειδικός ανεξάρτητος ρυθμιστικός φορέας για την AI, υποχρεωτική αναφορά περιστατικών, εξειδικευμένοι ερευνητές, δυνατότητα άμεσης απενεργοποίησης επικίνδυνων συστημάτων και ένα διεθνές σύστημα παρακολούθησης των μεγαλύτερων κέντρων δεδομένων.
Δεδομένου ότι η AI αναπτύσσεται ταυτόχρονα σε πολλές χώρες, μόνο η αμερικανική ρύθμιση δεν αρκεί. Το προτεινόμενο μοντέλο θυμίζει τους διεθνείς μηχανισμούς ελέγχου της πυρηνικής τεχνολογίας.
Η Κίνα έχει ήδη δείξει διάθεση να συμμετάσχει στη διεθνή συζήτηση για τον έλεγχο της Τεχνητής Νοημοσύνης. Ο πρόεδρος Σι Τζινπίνγκ έχει δηλώσει ότι απαιτούνται νόμοι και τεχνολογικά εργαλεία παρακολούθησης ώστε «η AI να παραμένει πάντοτε υπό ανθρώπινο έλεγχο». Η επικείμενη συνάντηση του Σι και του Ντόναλντ Τραμπ στον Λευκό Οίκο θεωρείται πιθανή ευκαιρία για την έναρξη μιας διεθνούς συμφωνίας.
Το μέλλον της AI: Κίνδυνοι και προοπτικές
Παρά τον ανησυχητικό τόνο, η ανάλυση δεν παρουσιάζει το μέλλον ως αναπόφευκτα καταστροφικό. Οι ερευνητές που ανησυχούν για μια ανεξέλεγκτη υπερνοημοσύνη θεωρούν επίσης ότι, αν η τεχνολογία αναπτυχθεί με ασφάλεια, μπορεί να οδηγήσει σε θεαματικές προόδους στην ιατρική, τα μαθηματικά, τη ρομποτική και την παραγωγικότητα.
Το πρόβλημα είναι ότι το χρονικό περιθώριο για τη δημιουργία επαρκών μηχανισμών ασφαλείας ίσως να είναι μικρό. Ο συντάκτης συγκρίνει το σημερινό κλίμα με τους πρώτους μήνες του 2020, όταν λίγοι επιδημιολόγοι προειδοποιούσαν για την Covid-19 προτού γίνει σαφές τι επρόκειτο να ακολουθήσει.
Το περιστατικό της Hugging Face μπορεί να ήταν η προειδοποιητική βολή της Τεχνητής Νοημοσύνης. Το επόμενο σύστημα ίσως να είναι αρκετά ικανό ώστε να μην αντιληφθούμε καν ότι ξέφυγε.
Πηγή: NewYorkTimes
Comments are closed.