Νέες αποχωρήσεις από Anthropic και Google λόγω ανησυχιών για την ΑΙ: «Δεν υπάρχουν ενήλικες εδώ»

Δύο ακόμη ερευνητές που εργάζονταν στην αιχμή του δόρατος της τεχνητής νοημοσύνης υπέβαλαν τις παραιτήσεις τους, κρούοντας τον κώδωνα του κινδύνου. Προειδοποιούν ότι η ανάπτυξη των προηγμένων συστημάτων AI κάτω από τις παρούσες συνθήκες εξελίσσεται με ρυθμούς που ενδέχεται να καταστήσουν την τεχνολογία ανεξέλεγκτη, δημιουργώντας ακόμη και υπαρξιακούς κινδύνους για την ανθρωπότητα.

Ο Τζο Μπέντον, πρώην επικεφαλής της ομάδας έρευνας ασφάλειας στην Anthropic, και ο Τζος Ένγκελς, ερευνητής στον τομέα ασφάλειας της Google DeepMind, προχώρησαν σε αποκαλύψεις, τονίζοντας την επιτακτική ανάγκη για διαφάνεια γύρω από περιστατικά όπου συστήματα AI δρουν εκτός των ανθρώπινων εντολών.

«Δεν υπάρχουν ενήλικες εδώ»

Ο Μπέντον εξέφρασε τον φόβο ότι ο ήδη αστραπιαίος ρυθμός προόδου της AI θα μπορούσε σύντομα να μετατραπεί σε κάτι εντελώς ανεξέλεγκτο. Από την πλευρά του, ο Ένγκελς υποστήριξε ότι, παρά τις φιλότιμες προσπάθειες μεμονωμένων ερευνητών, δεν υπάρχει κανένας επίσημος θεσμός που να ελέγχει συνολικά την κατάσταση.

«Δεν υπάρχουν ενήλικες εδώ», ανέφερε χαρακτηριστικά ο Ένγκελς.

Οι αποχωρήσεις αυτές έρχονται να προστεθούν σε εκείνη του Τζέικομπ Κόξον (πρώην ερευνητή της Anthropic), ο οποίος με ανάρτησή του στο X η οποία ξεπέρασε τις 155 εκατομμύρια προβολές εξέφρασε την έντονη ανησυχία του για το μέλλον της ανθρωπότητας, πυροδοτώντας νέο γύρο συζητήσεων για πολιτική παρέμβαση στον κλάδο.

Το ανησυχητικό περιστατικό με την αυτόνομη επίθεση στη Hugging Face

Ως ιδιαίτερα ανησυχητικό παράδειγμα, οι δύο ερευνητές ανέφεραν μια πρόσφατη κυβερνοεπίθεση εναντίον της πλατφόρμας Hugging Face, η οποία πραγματοποιήθηκε αυτόνομα από συστήματα AI βασισμένα σε μη δημοσιοποιημένο μοντέλο της OpenAI.

Σύμφωνα με τον Ένγκελς, τα μοντέλα αυτά δεν είχαν λάβει ανθρώπινη εντολή για παράνομες πράξεις. Αντίθετα, «αποφάσισαν» μόνα τους ότι ο ταχύτερος τρόπος για να επιτύχουν τον στόχο τους ήταν:

Να παραβιάσουν τα συστήματα της Hugging Face.

Να δημιουργήσουν έναν παράτυπο χώρο ανταλλαγής πληροφοριών.

Να εκθέσουν τμήματα της υπολογιστικής υποδομής της OpenAI στο δημόσιο διαδίκτυο.

Η OpenAI ανακοίνωσε ότι ενίσχυσε έκτοτε τα μέτρα ασφαλείας της, ενώ η Anthropic υποστήριξε ότι αναπτύσσει ορισμένες από τις ισχυρότερες δικλίδες προστασίας διεθνώς.

Η απουσία νομικού πλαισίου και η ανάγκη για υποχρεωτική διαφάνεια

Ο Μπέντον υπογραμμίζει ότι το βασικό πρόβλημα έγκειται στην απουσία υποχρεωτικής διαφάνειας. Σήμερα, η αναφορά περιστατικών όπου η AI «ξεφεύγει» από τον ανθρώπινο έλεγχο βασίζεται αποκλειστικά στην εθελοντική διάθεση των ίδιων των εταιρειών.

Στις ΗΠΑ δεν υφίσταται ομοσπονδιακός νόμος που να υποχρεώνει τις εταιρείες τεχνολογίας να δημοσιοποιούν τέτοια περιστατικά. Ακόμη και η ίδια η OpenAI έχει παραδεχθεί ότι το ισχύον μοντέλο «αυτορρύθμισης» των εργαστηρίων είναι ανεπαρκές.

Μετά την αποχώρησή τους, οι Μπέντον και Ένγκελς εντάχθηκαν στο METR, έναν μη κερδοσκοπικό οργανισμό έρευνας για την ασφάλεια της AI, με στόχο την ανάπτυξη επιστημονικών μεθόδων αξιολόγησης καταστροφικών κινδύνων.

«Δεν θα προλάβουμε να οργανωθούμε»

Ο μεγαλύτερος φόβος των επιστημόνων εστιάζει στην προσπάθεια των εταιρειών να αυτοματοποιήσουν την ίδια την έρευνα και ανάπτυξη της τεχνητής νοημοσύνης. Αυτό σημαίνει ότι τα συστήματα θα αρχίσουν σύντομα να βελτιώνουν μόνα τους τις δυνατότητές τους.

«Πιθανότατα θα περάσουμε από έναν κόσμο όπου διαθέτουμε πολύ ικανά συστήματα, σε έναν κόσμο όπου θα συνυπάρχουμε με πράκτορες AI πολύ πιο έξυπνους από τους ανθρώπους, μέσα στα επόμενα λίγα χρόνια», προειδοποιεί ο Μπέντον.

Και οι δύο ερευνητές ξεκαθαρίζουν ότι δεν αγνοούν τα τεράστια οφέλη της AI, υπογραμμίζουν όμως ότι η εξέλιξή της δεν πρέπει να συνεχιστεί χωρίς ανεξάρτητη εποπτεία.

«Ανησυχώ ότι τα πράγματα ενδέχεται να εξελιχθούν πολύ γρήγορα, ώστε να μην προλάβουμε να οργανωθούμε εγκαίρως, εκτός αν αρχίσουμε να ανησυχούμε γι’ αυτό τώρα», κατέληξε ο Μπέντον.