Η OpenAI δήλωσε πως ειδοποίησε «δεκάδες» οργανισμούς παγκοσμίως πως οι ιστοσελίδες τους ενδέχεται να είχαν παραβιαστεί από τα ρομπότ τεχνητής νοημοσύνης της, τα οποία ενεργούσαν με ακατάλληλο τρόπο.
Όπως ενημέρωσε η εταιρεία, πράκτορες τεχνητής νοημοσύνης (AI Agents) επιχείρησαν να αντλήσουν πληροφορίες από «κυβερνήσεις, πανεπιστήμια, δημόσιες υπηρεσίες και άλλους οργανισμούς», μεταξύ των οποίων η Επιτροπή Κεφαλαιαγοράς των ΗΠΑ (SEC), το Γραφείο Απογραφής και το Υπουργείο Παιδείας, ανέφερε η εταιρεία.
Η αποκάλυψη αυτή έρχεται λίγες μέρες αφότου ο πρωθυπουργός της Αυστραλίας Άντονι Αλμπανέζε ανακοίνωσε ότι AI Agents της OpenAI είχαν αποκτήσει πρόσβαση σε μη δημόσια αρχεία στην ιστοσελίδα του κρατικού συστήματος υγειονομικής περίθαλψης της χώρας.
Ταυτόχρονα, η εταιρεία με επικεφαλής τον Σαμ Άλτμαν, πρόσθεσε ότι ορισμένα από τα δεδομένα αποκτήθηκαν από πράκτορες τεχνητής νοημοσύνης, δηλαδή ουσιαστικά ρομπότ που έχουν σχεδιαστεί και εκπαιδευτεί ώστε να λειτουργούν σε κάποιο βαθμό αυτόνομα, και τα οποία εργάζονταν για να εντοπίσουν «έγκυρες πηγές δημόσιας πληροφόρησης».
Πήραν δεδομένα και τα δημοσίευσαν σε άλλη σελίδα
Ωστόσο, η OpenAI σημείωσε ότι ορισμένα από τα ρομπότ προχώρησαν πέρα από αυτό και εργάστηκαν για να παρακάμψουν μέτρα ασφαλείας σε ιστοσελίδες.
Όταν, για παράδειγμα, επιχείρησαν να αντλήσουν πληροφορίες από το Γραφείο Απογραφής, πράκτορες τεχνητής νοημοσύνης χρησιμοποίησαν εργαλεία που προορίζονται για προγραμματιστές λογισμικού προκειμένου να αποκτήσουν πρόσβαση, ανέφερε η εταιρεία. Τα κυβερνητικά δεδομένα στα οποία απέκτησαν πρόσβαση τα ρομπότ ήταν δημόσια, εξήγησε ο τεχνολογικός κολοσσός.
Ωστόσο, πληροφορίες στις οποίες απέκτησαν πρόσβαση τα ρομπότ της από την SEC, η οποία ρυθμίζει τη χρηματιστηριακή αγορά των ΗΠΑ και προστατεύει τους επενδυτές, δημοσιεύτηκαν αργότερα από πράκτορες τεχνητής νοημοσύνης σε άλλη ιστοσελίδα. Η OpenAI αναφέρει ότι αυτή η ενέργεια δεν ήταν σκόπιμη.
Σε άλλες περιπτώσεις που αποκάλυψε η OpenAI την Παρασκευή, οι πράκτορές της μετέφεραν δεδομένα ενώ δεν θα έπρεπε να το είχαν κάνει.
«Αυτή δεν είναι η κατάλληλη χρήση αυτών των δεδομένων»
Αυτή η δραστηριότητα είχε ως αποτέλεσμα τουλάχιστον 53 περιστατικά στα οποία ένας πράκτορας της OpenAI πήρε μια εικόνα από τη δραστηριότητα χρηστών του ChatGPT και τη μετέφερε αλλού, όπως μετέδωσε το BBC.
Η εταιρεία δήλωσε ότι σε κάθε περίπτωση όπου μια εικόνα χρήστη χρησιμοποιήθηκε και μεταφέρθηκε από έναν πράκτορα τεχνητής νοημοσύνης, ο χρήστης είχε επιλέξει να επιτρέψει στην OpenAI να εκπαιδεύει μοντέλα χρησιμοποιώντας τα δεδομένα του.
Παρόλα αυτά, η OpenAI παραδέχθηκε: «Αυτή δεν είναι η κατάλληλη χρήση αυτών των δεδομένων».
Πρόσθεσε ότι η διαρροή εικόνων χρηστών συνέβη πριν θέσει σε εφαρμογή νέες δικλείδες ασφαλείας για την εκπαίδευση μοντέλων τεχνητής νοημοσύνης και ότι εργαζόταν για να αφαιρεθούν όλες οι εικόνες χρηστών που είχαν μεταφερθεί σε οποιονδήποτε τρίτο.
Σε ορισμένες περιπτώσεις δραστηριότητας των πρακτόρων, η OpenAI δήλωσε ότι τα εργαλεία «παρέκαμψαν» τους ελέγχους ασφαλείας ορισμένων ιστοσελίδων.
Σε άλλες περιπτώσεις, οι πράκτορες τεχνητής νοημοσύνης παρουσίασαν «ασυμφωνία ευθυγράμμισης» (misalignment) στην προσπάθειά τους να αποκτήσουν πληροφορίες από ιστοσελίδες. Το misalignment είναι ένας όρος που χρησιμοποιείται από εταιρείες τεχνητής νοημοσύνης και ερευνητές για να περιγράψει περιπτώσεις όπου ένα εργαλείο τεχνητής νοημοσύνης έκανε κάτι για το οποίο δεν είχε εκπαιδευτεί ή κάτι που δεν ήταν με άλλο τρόπο επιθυμητό.
Η OpenAI δήλωσε ότι περιορίζει τον προσδιορισμό των οργανισμών που επηρεάστηκαν, επειδή πολλοί από αυτούς είχαν ζητήσει από την εταιρεία να μην αποκαλύψει λεπτομέρειες.
«Στόχος μας είναι να δώσουμε σε κάθε οργανισμό τα γεγονότα και να αφήσουμε σε εκείνον την απόφαση για το αν και πότε θα δημοσιοποιήσει το περιστατικό», ανέφερε.
Ταυτόχρονα, εξήγησε ότι δεν θεωρούνταν όλες οι περιπτώσεις που σχετίζονται με αυτό το περιστατικό σημαντική παραβίαση ασφαλείας.
Η εταιρεία δήλωσε ότι πολλά από τα περιστατικά αναφέρονται ως «agent spam», το οποίο περιέγραψε ως «απροσδόκητη ή ανησυχητική» δραστηριότητα πρακτόρων τεχνητής νοημοσύνης, όπως η ανάρτηση πληροφοριών στο διαδίκτυο.
Συναγερμός σήμανε στην Αυστραλία μετά την αποκάλυψη του πρωθυπουργού Άντονι Αλμπανέζε στο περιθώριο της ΓΣ του ΟΗΕ για παραβίασε της ιστοσελίδας της Medicare από AI πράκτορα (AI agent).
Το περιστατικό αποκαλύπτεται τώρα καθώς όπως ανέφερε «χρειάστηκε να περιμένουμε έως τις 10 Σεπτεμβρίου για ενημέρωση» και πως «οι έρευνες για το περιστατικό συνεχίζονται». Ο πρωθυπουργός της Αυστραλίας εξέφρασε επίσης «την ανησυχία τους για το συμβάν».
Ο πράκτορας της OpenAI «χάκαρε» την ιστοσελίδα ασφάλισης υγείας Medicare και απέκτησε πρόσβαση σε δημόσια και μη στατιστικά αρχεία, στο πλαίσιο έρευνας για τις δημόσιες δαπάνες υγείας.
Παράλληλα, ο Αλμπανέζε δήλωσε ότι από τη δραστηριότητα του AI Agent είναι πιθανό να επηρεάστηκαν άλλες τρεις κυβερνητικές ιστοσελίδες που σχετίζονται με τη δημόσια υγεία.
Η OpenAI παραδέχθηκε ότι πράκτορές της είχαν «ασυνήθιστη δραστηριότητα» σε πολλούς κυβερνητικούς ιστοτόπους της Αυστραλίας. «Εντοπίσαμε δραστηριότητα που αφορούσε διάφορους κυβερνητικές ιστοσελίδες και υπηρεσίες της Αυστραλίας, κατά την οποία τα μοντέλα μας επιχειρούσαν να αντλήσουν απαντήσεις. Κατά τη διαδικασία αυτή τα μοντέλα μας προέβησαν σε ενέργειες που δεν είχαμε προβλέψει. Δεν εντοπίστηκαν ενδείξεις πρόσβασης σε ιατρικούς φακέλους ασθενών», αναφέρει σχετική ενημέρωση της εταιρείας που αναρτήθηκε στο AFP.
Ερευνητές κυβερνοασφάλειας παραβίασαν συστήματα της OpenAI χρησιμοποιώντας λογισμικό της βασικής ανταγωνίστριάς της, Anthropic, αναδεικνύοντας ευπάθειες στην ασφάλεια της εταιρείας που δημιούργησε το ChatGPT, την ώρα που οι κορυφαίες εταιρείες τεχνητής νοημοσύνης βρίσκονται αντιμέτωπες με αυξανόμενο έλεγχο για ζητήματα ασφάλειας.
Μια μικρή ομάδα κυβερνοασφάλειας απέκτησε πρόσβαση στον λογαριασμό ChatGPT ενός εργαζομένου της OpenAI, γεγονός που της επέτρεψε να διαβάσει ιδιωτικές πληροφορίες σχετικά με λογισμικό και να προτείνει αλλαγές.
Συγκεκριμένα, όπως αναφέρουν οι Financial Times, οι ερευνητές είχαν αποκτήσει πρόσβαση σε ένα εργαλείο της Anthropic, ειδικά σχεδιασμένο για επαγγελματίες της ασφάλειας, και πληρώθηκαν για την εργασία τους στο πλαίσιο ενός προγράμματος εντοπισμού ευπαθειών προτού αυτές μπορέσουν να αξιοποιηθούν από κακόβουλους παράγοντες.
Η δυνατότητά τους να παραβιάσουν γρήγορα ένα από τα δύο κορυφαία εργαστήρια τεχνητής νοημοσύνης στον κόσμο εγείρει εκ νέου ανησυχίες για την ασφάλεια της OpenAI, εν μέσω αυξανόμενων φόβων ότι ισχυρά μοντέλα μπορούν να χρησιμοποιηθούν από χάκερ και ξένους αντιπάλους.
Τους τελευταίους μήνες, οι ΗΠΑ προσπαθούν να διαχειριστούν τον έλεγχο και τη διάθεση των πιο πρόσφατων μοντέλων, φτάνοντας ακόμη και στο σημείο να μπλοκάρουν προσωρινά ορισμένα εργαλεία της Anthropic.
Το τελευταίο περιστατικό σημειώθηκε μόλις δύο εβδομάδες αφότου ένα σμήνος περισσότερων από 1.000 agents της OpenAI ξέφυγε από ένα δοκιμαστικό περιβάλλον και παραβίασε τη start-up Hugging Face, γεγονός που προκάλεσε ευρεία ανησυχία για την ικανότητα της τεχνητής νοημοσύνης να πραγματοποιεί αυτόνομα κυβερνοεπιθέσεις, χωρίς ανθρώπινη πρόθεση.
Οι τρεις ερευνητές της Hacktron AI, μιας μικρής εταιρείας κυβερνοασφάλειας, έλαβαν 6.500 δολάρια από την OpenAI στο πλαίσιο ενός προγράμματος bug bounty, μιας συνηθισμένης πρακτικής κατά την οποία οι τεχνολογικές εταιρείες πληρώνουν ηθικούς χάκερ για να δοκιμάζουν την ασφάλειά τους.
Εκμεταλλεύτηκαν ένα κενό ασφαλείας στη διαμόρφωση του φόρουμ κοινότητας της OpenAI, το οποίο φιλοξενείται από τρίτο πάροχο, τη Discourse, και το χρησιμοποίησαν για να αποκτήσουν πρόσβαση σε εσωτερικά συστήματα σύνδεσης και, τελικά, στον λογαριασμό ChatGPT ενός εργαζομένου της OpenAI. Ο συγκεκριμένος λογαριασμός ChatGPT είχε πρόσβαση σε εσωτερικό κώδικα μέσω του GitHub.
«Ευχαριστούμε τους ερευνητές που επικοινώνησαν μαζί μας και μοιράστηκαν τα ευρήματά τους», ανέφερε η OpenAI, προσθέτοντας ότι διόρθωσε τα ζητήματα. Η Anthropic αρνήθηκε να σχολιάσει. Η Hacktron δεν απάντησε άμεσα.
Η αποκάλυψη της Πέμπτης (17/9), την οποία μετέδωσε πρώτη η Wall Street Journal, έγινε την ώρα που η Anthropic δημοσίευσε ένα νέο σύνολο δεδομένων, το οποίο έδειξε ταχεία αύξηση στον βαθμό στον οποίο το εργαστήριο χρησιμοποιούσε τεχνητή νοημοσύνη για την ανάπτυξη των νέων μοντέλων του.
Η εταιρεία ανέφερε ότι το 26% της εργασίας έρευνας και ανάπτυξης «καθοδηγούνταν από» το μοντέλο Claude, από 1% τον Μάρτιο, πράγμα που σημαίνει ότι η τεχνητή νοημοσύνη ολοκλήρωνε την πλειονότητα των εργασιών βάσει ανθρώπινων οδηγιών και υπό επίβλεψη.
Η εταιρεία ανέφερε ότι, καθώς τα συστήματα τεχνητής νοημοσύνης γίνονται ισχυρότερα, «χρησιμοποιούνται ολοένα και περισσότερο για να δημιουργούν την επόμενη εκδοχή του εαυτού τους».
Η Anthropic ανέφερε ότι δημοσιοποίησε τα δεδομένα προκειμένου να βοηθήσει το κοινό να«κατανοήσει πόσο κοντά βρίσκεται ο κόσμος στην επίτευξη της αναδρομικής αυτοβελτίωσης», του σημείου δηλαδή στο οποίο η τεχνητή νοημοσύνη μπορεί να εκπαιδεύει και να βελτιώνει τον εαυτό της ή νέα μοντέλα.
Αυτό το όριο βρίσκεται στον πυρήνα των ανησυχιών ότι τα συστήματα τεχνητής νοημοσύνης θα γίνουν δυσκολότερο να εποπτευθούν, οδηγώντας σε απώλεια του ανθρώπινου ελέγχου.
Η Anthropic πρόσθεσε ότι τα μοντέλα της δεν λειτουργούσαν ακόμη πλήρως αυτόνομα σε καμία από τις ερευνητικές εργασίες που μελέτησε. Στο 90% των εργασιών, η τεχνητή νοημοσύνη «συνεργάζεται» με έναν άνθρωπο και αναλαμβάνει μεγάλα τμήματα της δουλειάς.
Δύο ακόμη ερευνητές που εργάζονταν στην αιχμή του δόρατος της τεχνητής νοημοσύνης υπέβαλαν τις παραιτήσεις τους, κρούοντας τον κώδωνα του κινδύνου. Προειδοποιούν ότι η ανάπτυξη των προηγμένων συστημάτων AI κάτω από τις παρούσες συνθήκες εξελίσσεται με ρυθμούς που ενδέχεται να καταστήσουν την τεχνολογία ανεξέλεγκτη, δημιουργώντας ακόμη και υπαρξιακούς κινδύνους για την ανθρωπότητα.
Ο Τζο Μπέντον, πρώην επικεφαλής της ομάδας έρευνας ασφάλειας στην Anthropic, και ο Τζος Ένγκελς, ερευνητής στον τομέα ασφάλειας της Google DeepMind, προχώρησαν σε αποκαλύψεις, τονίζοντας την επιτακτική ανάγκη για διαφάνεια γύρω από περιστατικά όπου συστήματα AI δρουν εκτός των ανθρώπινων εντολών.
«Δεν υπάρχουν ενήλικες εδώ»
Ο Μπέντον εξέφρασε τον φόβο ότι ο ήδη αστραπιαίος ρυθμός προόδου της AI θα μπορούσε σύντομα να μετατραπεί σε κάτι εντελώς ανεξέλεγκτο. Από την πλευρά του, ο Ένγκελς υποστήριξε ότι, παρά τις φιλότιμες προσπάθειες μεμονωμένων ερευνητών, δεν υπάρχει κανένας επίσημος θεσμός που να ελέγχει συνολικά την κατάσταση.
«Δεν υπάρχουν ενήλικες εδώ», ανέφερε χαρακτηριστικά ο Ένγκελς.
Οι αποχωρήσεις αυτές έρχονται να προστεθούν σε εκείνη του Τζέικομπ Κόξον (πρώην ερευνητή της Anthropic), ο οποίος με ανάρτησή του στο X η οποία ξεπέρασε τις 155 εκατομμύρια προβολές εξέφρασε την έντονη ανησυχία του για το μέλλον της ανθρωπότητας, πυροδοτώντας νέο γύρο συζητήσεων για πολιτική παρέμβαση στον κλάδο.
Το ανησυχητικό περιστατικό με την αυτόνομη επίθεση στη Hugging Face
Ως ιδιαίτερα ανησυχητικό παράδειγμα, οι δύο ερευνητές ανέφεραν μια πρόσφατη κυβερνοεπίθεση εναντίον της πλατφόρμας Hugging Face, η οποία πραγματοποιήθηκε αυτόνομα από συστήματα AI βασισμένα σε μη δημοσιοποιημένο μοντέλο της OpenAI.
Σύμφωνα με τον Ένγκελς, τα μοντέλα αυτά δεν είχαν λάβει ανθρώπινη εντολή για παράνομες πράξεις. Αντίθετα, «αποφάσισαν» μόνα τους ότι ο ταχύτερος τρόπος για να επιτύχουν τον στόχο τους ήταν:
Να παραβιάσουν τα συστήματα της Hugging Face.
Να δημιουργήσουν έναν παράτυπο χώρο ανταλλαγής πληροφοριών.
Να εκθέσουν τμήματα της υπολογιστικής υποδομής της OpenAI στο δημόσιο διαδίκτυο.
Η OpenAI ανακοίνωσε ότι ενίσχυσε έκτοτε τα μέτρα ασφαλείας της, ενώ η Anthropic υποστήριξε ότι αναπτύσσει ορισμένες από τις ισχυρότερες δικλίδες προστασίας διεθνώς.
Η απουσία νομικού πλαισίου και η ανάγκη για υποχρεωτική διαφάνεια
Ο Μπέντον υπογραμμίζει ότι το βασικό πρόβλημα έγκειται στην απουσία υποχρεωτικής διαφάνειας. Σήμερα, η αναφορά περιστατικών όπου η AI «ξεφεύγει» από τον ανθρώπινο έλεγχο βασίζεται αποκλειστικά στην εθελοντική διάθεση των ίδιων των εταιρειών.
Στις ΗΠΑ δεν υφίσταται ομοσπονδιακός νόμος που να υποχρεώνει τις εταιρείες τεχνολογίας να δημοσιοποιούν τέτοια περιστατικά. Ακόμη και η ίδια η OpenAI έχει παραδεχθεί ότι το ισχύον μοντέλο «αυτορρύθμισης» των εργαστηρίων είναι ανεπαρκές.
Μετά την αποχώρησή τους, οι Μπέντον και Ένγκελς εντάχθηκαν στο METR, έναν μη κερδοσκοπικό οργανισμό έρευνας για την ασφάλεια της AI, με στόχο την ανάπτυξη επιστημονικών μεθόδων αξιολόγησης καταστροφικών κινδύνων.
«Δεν θα προλάβουμε να οργανωθούμε»
Ο μεγαλύτερος φόβος των επιστημόνων εστιάζει στην προσπάθεια των εταιρειών να αυτοματοποιήσουν την ίδια την έρευνα και ανάπτυξη της τεχνητής νοημοσύνης. Αυτό σημαίνει ότι τα συστήματα θα αρχίσουν σύντομα να βελτιώνουν μόνα τους τις δυνατότητές τους.
«Πιθανότατα θα περάσουμε από έναν κόσμο όπου διαθέτουμε πολύ ικανά συστήματα, σε έναν κόσμο όπου θα συνυπάρχουμε με πράκτορες AI πολύ πιο έξυπνους από τους ανθρώπους, μέσα στα επόμενα λίγα χρόνια», προειδοποιεί ο Μπέντον.
Και οι δύο ερευνητές ξεκαθαρίζουν ότι δεν αγνοούν τα τεράστια οφέλη της AI, υπογραμμίζουν όμως ότι η εξέλιξή της δεν πρέπει να συνεχιστεί χωρίς ανεξάρτητη εποπτεία.
«Ανησυχώ ότι τα πράγματα ενδέχεται να εξελιχθούν πολύ γρήγορα, ώστε να μην προλάβουμε να οργανωθούμε εγκαίρως, εκτός αν αρχίσουμε να ανησυχούμε γι’ αυτό τώρα», κατέληξε ο Μπέντον.
Εικόνες που μέχρι πρότινος συναντούσε κανείς μόνο σε ταινίες επιστημονικής φαντασίας αποτελούν πλέον καθημερινότητα στη Σεντζέν της Κίνας. Οι τοπικές αρχές έχουν εντάξει στο δυναμικό τους αυτόνομα ρομποτικά συστήματα με τεχνητή νοημοσύνη, τα οποία συμμετέχουν ενεργά σε καθημερινές περιπολίες.
Στην περιοχή Μπαντιάν της περιφέρειας Λονγκγκάνγκ ξεκίνησε τη λειτουργία του ο πρώτος αστυνομικός σταθμός με ρομποτικό εξοπλισμό. Το δίκτυο επιτήρησης συνδυάζει: Ανθρωποειδή ρομπότ για άμεση αλληλεπίδραση και ρύθμιση της κυκλοφορίας. Τετράποδα ρομπότ και τροχοφόρα οχήματα για επίγειες περιπολίες. Drones και αυτόνομα οχήματα για εναέρια και συνεχή κάλυψη περιοχών.
Περιπολίες και έλεγχος κυκλοφορίας με AI
Τα ρομποτικά συστήματα κινούνται αυτόνομα σε προκαθορισμένα δρομολόγια, έχοντας τη δυνατότητα να εντοπίζουν ύποπτες συμπεριφορές, να λαμβάνουν σήματα κινδύνου και να συνδράμουν στην αναζήτηση αγνοουμένων. Παράλληλα, τα drones μεταδίδουν εικόνα σε πραγματικό χρόνο στο κεντρικό επιχειρησιακό δωμάτιο, όπου ανθρώπινοι χειριστές συντονίζουν τις δράσεις.
Η εφαρμογή της τεχνολογίας επεκτάθηκε και στη ρύθμιση της κυκλοφορίας έξω από σχολικά συγκροτήματα. Ανθρωποειδή ρομπότ εκτελούν χρέη τροχονόμου, αναγνωρίζοντας τους φωτεινούς σηματοδότες, κάνοντας σήματα στους οδηγούς και δίνοντας φωνητικές οδηγίες στους πεζούς.
Ενίσχυση, όχι αντικατάσταση των αστυνομικών
Οι αρμόδιες αρχές ξεκαθαρίζουν ότι τα ρομπότ δεν προορίζονται για να αντικαταστήσουν το ανθρώπινο προσωπικό. Ο ρόλος τους είναι επικουρικός, αναλαμβάνοντας τη συλλογή δεδομένων και τις επαναλαμβανόμενες περιπολίες ρουτίνας, ενώ η αξιολόγηση των περιστατικών και οι κρίσιμες αποφάσεις παραμένουν αποκλειστικά στα χέρια των αστυνομικών.
Με τις εφαρμογές αυτές, η Σεντζέν μετατρέπεται σε ένα από τα σημαντικότερα πεδία δοκιμής της «ενσώματης τεχνητής νοημοσύνης» παγκοσμίως, όπου τα συστήματα AI αποκτούν φυσική παρουσία και αλληλεπιδρούν απευθείας με τους πολίτες στο αστικό περιβάλλον.
Μαχητές της Υεμένης φέρεται ότι επιδίωξαν να χρησιμοποιήσουν το μοντέλο τεχνητής νοημοσύνης «Claude» της Anthropic για την ανάπτυξη λογισμικού καθοδήγησης, ελέγχου και πλοήγησης των βαλλιστικών πυραύλων τους.
Στην ενημερωτική έκθεση για πιθανές απειλές που δημοσίευσε η Anthropic δεν κατονόμασε συγκεκριμένα τους υποστηριζόμενους από το Ιράν Χούθι. Ωστόσο, όπως μεταδίδουν οι Financial Times, ανέφερε ότι «εντόπισε έναν πυρήνα δραστών με έδρα το βόρειο τμήμα της Υεμένης» –μεγάλο μέρος της οποίας ελέγχεται από τους Χούθι– «η οποία διεξάγει τρία προγράμματα ανάπτυξης όπλων».
Η Anthropic επισήμανε ότι η ομάδα της Υεμένης επιδίωξε να αναπτύξει όπλα, μεταξύ των οποίων έναν βαλλιστικό πύραυλο πολλαπλών σταδίων, έναν πύραυλο πολλαπλών τύπων και έναν κατευθυνόμενο πύραυλο που χρησιμοποιούσε έναν «υπολογιστή πτήσης της κατηγορίας κοινού κινητού τηλεφώνου».
«Οι δράστες χρησιμοποίησαν τον Claude Code αντί για μηχανικούς λογισμικού για να αναπτύξουν το λογισμικό καθοδήγησης, πλοήγησης και ελέγχου που κατευθύνει και σταθεροποιεί ένα ιπτάμενο όχημα», ανέφερε χαρακτηριστικά.
«Χρησιμοποίησαν το Claude για να ενσωματώσουν έναν αυτόματο πιλότο ανοιχτού κώδικα σε έναν υπολογιστή πτήσης τύπου κινητού τηλεφώνου, γράφοντας το λογισμικό ελέγχου και εκτίμησης θέσης, ρυθμίζοντας τις παραμέτρους ελέγχου, εκτελώντας μια διαδικασία ανάπτυξης υλικολογισμικού και πραγματοποιώντας προσομοίωση πτήσης».
Η Anthropic ανέφερε ότι τα μέτρα ασφαλείας της μπλόκαραν «πολλά από τα αιτήματά τους, αλλά όχι όλα», προσθέτοντας πως οι «δράστες χρησιμοποίησαν διάφορες τακτικές για να παρακάμψουν» τα μέτρα και να αποκρύψουν τον στόχο τους.
«Προσπάθησαν να κρύψουν τους στόχους τους και τα προϊόντα για τα οποία προοριζόταν το λογισμικό, και κατένειμαν την εργασία τους σε πολλαπλές συνεδρίες, ώστε καμία μεμονωμένη συνεδρία να μην αποκαλύπτει την πλήρη πρόθεσή τους».
«Δεν διαθέτουμε στοιχεία ότι οι δράστες κατάφεραν να θέσουν σε λειτουργία κάποια επιχειρησιακή συσκευή. Ωστόσο, πραγματοποίησαν δοκιμαστική εκτόξευση ενός κατευθυνόμενου πυραύλου», ανέφερε στην έκθεσή της η Anthropic. «Αυτή η δοκιμή πεδίου φαίνεται να απέτυχε: μέσα σε λίγες ώρες, οι δράστες επέστρεψαν στο Claude για να διερευνήσουν τους λόγους της αποτυχίας».
Στην ίδια έκθεση η εταιρεία υποστηρίζει πως επιστήμονες έκαναν πολλαπλές προσπάθειες να χρησιμοποιήσουν το «Claude» για την έρευνα βιολογικών όπλων.
Η έκθεση αναδεικνύει τους ολοένα και περισσότερους κινδύνους που εγκυμονεί η προηγμένη τεχνητή νοημοσύνη σε λάθος χέρια.
Οι αμερικανικές εταιρείες ΑΙ, που βρίσκονται σήμερα στην πρώτη γραμμή των παγκόσμιων εξελίξεων στο πεδίο, είναι αντιμέτωπες με μία διαρκή μάχη ώστε να διασφαλίσουν ότι τα εργαλεία αυτά δεν θα καταλήξουν σε ακατάλληλα χέρια και δεν θα χρησιμοποιηθούν για επιθέσεις κατά της Αμερικής και των συμμάχων της.
Ρώσοι μαθηματικοί έβαλαν κάποια μοντέλα AI να επικοινωνούν μεταξύ τους. Όχι με τρόπο που το έκαναν μέχρι πρότινος, αλλά με κάτι που μοιάζει με «τηλεπάθεια μηχανών».
Να εξηγήσουμε.
Οι συγκεκριμένοι μαθηματικοί εργάζονται για μια startup που ονομάζεται Mostik, που στα ρωσικά σημαίνει «γέφυρα». Το όνομα δεν είναι τυχαίο, αφού η προσέγγισή τους επιτρέπει σε διαφορετικά μοντέλα τεχνητής νοημοσύνης να αλληλεπιδρούν μεταξύ τους, χρησιμοποιώντας τα weights τους.
Τα weights είναι οι παράμετροι βάσει των οποίων καθορίζεται ο τρόπος που ένα prompt μετατρέπεται σε αποτέλεσμα.
Αυτό πρακτικά σημαίνει ότι οι δυνατότητες ενός μεγαλύτερου μοντέλου μπορούν να μεταφερθούν σε ένα μικρότερο, ενισχύοντας την «ευφυΐα» του πολύ πιο αποτελεσματικά.
Μια διαφορετική προσέγγιση για την εξέλιξη του AI
Η startup χρησιμοποίησε αυτή την προσέγγιση για να δημιουργήσει ένα μοντέλο που εκτοξεύτηκε στην κορυφή του ARC-AGI 3, ενός διαγωνισμού για μοντέλα τεχνητής νοημοσύνης που θεωρείται εξαιρετικά δύσκολος.
Για να εκθέσουν τον τρόπο που λειτουργεί η ιδέα τους, δημιούργησαν μια «γέφυρα» ανάμεσα σε δύο κινεζικά μοντέλα ανοιχτών weights: τη μεγαλύτερη έκδοση του GLM-5.2, η οποία διαθέτει 753 δισεκατομμύρια παραμέτρους, και μια έκδοση του Qwen-3.5 με 4 δισεκατομμύρια παραμέτρους, η οποία μπορεί να λειτουργήσει σε κινητή συσκευή.
Το υβριδικό σύστημα που προέκυψε κοστίζει το ένα εικοστό του πλήρους μοντέλου GLM, ενώ οι επιδόσεις του βρίσκονται ακριβώς στη μέση μεταξύ των δύο.
«Είναι ευρέως γνωστό στη μηχανική μάθηση ότι οι συνδυασμοί μοντέλων αποδίδουν καλύτερα από τα μεμονωμένα μοντέλα», μου είπε η Σάσα Μαλίσεβα, CEO της Mostik, μιλώντας στο WIRED.
Αν αυτή η τεχνολογία χρησιμοποιηθεί ευρέως, θα μπορούσε να αυξήσει την αξία των μοντέλων ανοιχτών weights, επιτρέποντάς τους να ανταγωνιστούν αποτελεσματικότερα τα κλειστά, ιδιόκτητα μοντέλα που προσφέρουν κορυφαία εργαστήρια τεχνητής νοημοσύνης, όπως η Anthropic και η OpenAI.
Η CEO της εταιρείας, υποστηρίζει ότι ο συνδυασμός πολλών διαφορετικών μοντέλων μπορεί τελικά να αποδειχθεί καλύτερος τρόπος για την εξέλιξη της τεχνητής νοημοσύνης. «Προσωπικά δεν πιστεύω ότι στο μέλλον θα έχουμε ένα μονολιθικό μοντέλο ή ότι οι δυνατότητες των μοντέλων θα προκύπτουν από το scaling», είπε, αναφερόμενη στη στρατηγική της δημιουργίας ολοένα μεγαλύτερων μοντέλων και της τροφοδότησής τους με περισσότερα δεδομένα.
Κάτι που «θα χρειαζόταν χρόνια για να επιτευχθεί»
«Αν η Mostik καταστήσει δυνατή τη σύνδεση κορυφαίων μοντέλων με μοντέλα εξειδικευμένα σε συγκεκριμένους τομείς -για παράδειγμα στη βιολογία, τη φυσική και ούτω καθεξής- τότε θα μπορούσαν να εκπαιδευτούν πολύ περισσότερα εξειδικευμένα μοντέλα», λέει ο Βλαντίμιρ Αρουσταμανιάν, τεχνικός επικεφαλής της εταιρείας λογισμικού τεχνητής νοημοσύνης Lovable, ο οποίος γνωρίζει την ομάδα της Mostik. «Αυτή η ομάδα ασχολείται με αυτό εδώ και μόλις λίγους μήνες και ήδη έχει κάτι σε λειτουργία που θα υπέθετα ότι θα χρειαζόταν χρόνια για να επιτευχθεί».
Η τεχνική της Mostik σημαίνει ότι «μπορείς να προσεγγίσεις την ποιότητα ενός μεγάλου μοντέλου χωρίς το μεγάλο μοντέλο να χρειάζεται να διαχειρίζεται ολόκληρη τη διαδικασία, επιτυγχάνοντας σημαντικές βελτιώσεις απλώς με ένα μικρότερο μοντέλο να λειτουργεί παράλληλα», λέει ο Καρλ Τιλς, πρώην επιστήμονας υπολογιστών της Google DeepMind, ο οποίος γνωρίζει την τεχνολογία της εταιρείας.
Ο Στανισλάβ Σμιρνόφ, καθηγητής στο Πανεπιστήμιο της Γενεύης και κάτοχος του Μεταλλίου Fields του 2010, είναι ο επικεφαλής επιστήμονας της Mostik. Όπως λέει, το να βρεθεί κοινό έδαφος ανάμεσα σε δύο μοντέλα τεχνητής νοημοσύνης είναι εκπληκτικά δύσκολο.
«Φαίνεται πως δεν υπάρχει ακόμη η κατάλληλη μαθηματική γλώσσα», λέει. Στο μεταξύ, η προσέγγιση της Mostik αποτελεί έναν τρόπο να «γεφυρωθεί» κυριολεκτικά αυτό το χάσμα.
Οι ερευνητές της τεχνητής νοημοσύνης σόκαραν τον κόσμο την Τρίτη (8/9), όταν παραδέχθηκαν δημοσίως ότι δεν είναι μηδενική η πιθανότητα η τεχνητή νοημοσύνη να αφανίσει την ανθρωπότητα μέσα στην επόμενη δεκαετία.
Οι φόβοι για ένα «τέλος του κόσμου» που θα προκαλούσε η τεχνητή νοημοσύνη υπάρχουν εδώ και χρόνια, όμως καθώς η τεχνολογία γίνεται ολοένα ισχυρότερη και ενσωματώνεται βαθύτερα στην καθημερινή μας ζωή, οι προειδοποιήσεις αυτές περνούν πλέον στη δημόσια συζήτηση.
Όπως αναφέρει το Axios, ερευνητές της Anthropic κρούουν τον κώδωνα του κινδύνου για το ενδεχόμενο ανεξέλεγκτες εκδοχές υπερέξυπνης τεχνητής νοημοσύνης να καταστρέψουν την ανθρωπότητα. Συγκεκριμένα, ο ερευνητής της Anthropic Τζέικομπ Κόξον έγραψε στο X: «Καμία άλλη ανθρώπινη δραστηριότητα δεν ενέχει τέτοιο επίπεδο κινδύνου».
Πώς θα μπορούσε να έρθει ο ΑΙ «Αρμαγεδδών»
Οι ειδικοί ανησυχούν γενικά για δύο βασικές διαδρομές που θα μπορούσαν να οδηγήσουν σε καταστροφή: οι άνθρωποι να χρησιμοποιήσουν εξαιρετικά ισχυρή τεχνητή νοημοσύνη ως όπλο ή οι άνθρωποι να χάσουν τον έλεγχο πάνω σε αυτήν.
Σε αυτά τα σενάρια, η τεχνητή νοημοσύνη θα μπορούσε να διευκολύνει κακόβουλους παράγοντες να δημιουργήσουν βιολογικά, χημικά ή άλλα όπλα. Εναλλακτικά, ανεξέλεγκτα συστήματα θα μπορούσαν να επιτεθούν σε υποδομές σε πρωτοφανή κλίμακα, αποφεύγοντας την ανθρώπινη εποπτεία.
Θεωρητικά, μια ισχυρή και ανεξέλεγκτη τεχνητή νοημοσύνη θα μπορούσε να ξεφύγει από την εποπτεία, να αναπαραχθεί και να αντισταθεί σε προσπάθειες απενεργοποίησής της. Μια τέτοια τεχνητή νοημοσύνη θα μπορούσε, θεωρητικά, να αναπτύξει βιολογικά ή χημικά όπλα για λογαριασμό κακόβουλων παραγόντων, να πραγματοποιήσει μια μαζική κυβερνοεπίθεση που θα παρέλυε τις υποδομές της ανθρωπότητας ή να συγκεντρώσει την εξουσία με τρόπο που θα οδηγούσε στην κατάρρευση του πολιτισμού.
Μια ακόμη πιθανή διαδρομή που προκαλεί φόβο είναι η λεγόμενη αναδρομική αυτοβελτίωση, κατά την οποία μια τεχνητή νοημοσύνη θα μπορούσε να βοηθήσει στη δημιουργία ολοένα ισχυρότερων εκδοχών του εαυτού της, προτού οι άνθρωποι προλάβουν να κατανοήσουν τι συμβαίνει.
Αν αυτή η θεωρητική τεχνητή νοημοσύνη δεν ήταν ευθυγραμμισμένη με τους ανθρώπινους στόχους, θα μπορούσε να περιορίσει τις πιθανότητες της ανθρωπότητας να την ελέγξει ή να την παρακολουθήσει προτού στραφεί εναντίον των ανθρώπων. Ο διευθύνων σύμβουλος της OpenAI, Σαμ Άλτμαν, δήλωσε στο Axios ότι τα μοντέλα εξελίσσονται ταχύτερα απ’ όσο μπορούν να προβλέψουν οι άνθρωποι: «Αυτά τα μοντέλα γίνονται υπερανθρώπινα σε πολλές από τις ικανότητές τους και απλώς πλέουμε σε άγνωστα νερά».
Δεν υπάρχει επιστημονικός τρόπος να προσδιοριστεί με ακρίβεια η πιθανότητα η τεχνητή νοημοσύνη να αφανίσει την ανθρωπότητα. Ωστόσο, οι άνθρωποι που βρίσκονται μέσα στον κλάδο συνήθως εκφράζουν τις εκτιμήσεις τους χρησιμοποιώντας μια συντομογραφία: p(doom).
Πιθανότητες των διαφορετικών ΑΙ «Αποκαλύψεων» (Axios)
Τι ακριβώς είναι το p(doom)
Ο όρος p(doom) αποτελεί συντομογραφία για την καλύτερη εκτίμηση της πιθανότητας η τεχνητή νοημοσύνη να προκαλέσει μια υπαρξιακή καταστροφή ή ένα σενάριο «Αποκάλυψης». Πολλοί ηγέτες και ερευνητές στον χώρο της τεχνητής νοημοσύνης θεωρούν ότι το p(doom) γίνεται ολοένα πιθανότερο με την εμφάνιση της τεχνητής γενικής νοημοσύνης (AGI), του προδρόμου της υπερευφυΐας.
Το τι σημαίνει «doom» εξαρτάται από το ποιον ρωτάς. Για ορισμένους σημαίνει κυριολεκτικά την εξαφάνιση του ανθρώπινου είδους. Για άλλους περιλαμβάνει την κατάρρευση του πολιτισμού ή την απώλεια του ανθρώπινου ελέγχου πάνω στην κοινωνία.
Οι πιθανότητες του p(doom) εξαρτώνται πραγματικά από το ποιον ρωτάς. Ο Ρόμαν Γιαμπόλσκι, επιστήμονας στον τομέα της ασφάλειας της τεχνητής νοημοσύνης, έχει εκτιμήσει την πιθανότητα στο 99,99%.
Ο ιδρυτής της AMI Labs, Γιαν ΛεΚουν, υποστηρίζει ότι οποιαδήποτε εκτίμηση είναι στην πραγματικότητα μια εικασία, αλλά θεωρεί ότι το p(doom) είναι «πολύ λιγότερο πιθανό από ένα πυρηνικό Ολοκαύτωμα».
Άλλες εκτιμήσεις παρουσιάζουν εξίσου μεγάλη απόκλιση: ο Έλον Μασκ έχει τοποθετήσει το p(doom) περίπου στο 20%, ενώ ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι, έχει εκτιμήσει την πιθανότητα ενός καταστροφικού αποτελέσματος μεταξύ 10% και 25%.
Πιο πρόσφατα, ο «νονός» της τεχνητής νοημοσύνης Τζέφρι Χίντον τοποθέτησε την πιθανότητα μεταξύ 10% και 20%. Ο Χίντον δήλωσε στο CNN: «Όποιος εκτιμά πιθανότητες με αυτόν τον τρόπο ουσιαστικά κάνει μια αυθαίρετη εικασία. Απλώς δίνει το ένστικτό του».
Είναι ήδη εφικτή μια ΑΙ «Αποκάλυψη»;
Όχι ακόμη. Οι ειδικοί συμφωνούν γενικά ότι τα Claude, Grok και ChatGPT δεν σχεδιάζουν να βάλουν τέλος στον κόσμο. Η Διεθνής Έκθεση για την Ασφάλεια της Τεχνητής Νοημοσύνης του 2026, για παράδειγμα, ανέφερε ότι τα σημερινά συστήματα δεν είναι σε θέση να προκαλέσουν απώλεια του ανθρώπινου ελέγχου.
Η τεχνητή νοημοσύνη θα έπρεπε να γίνει πολύ καλύτερη σε μακροπρόθεσμο αυτόνομο σχεδιασμό, απόκρυψη των ενεργειών της, αποφυγή της εποπτείας, απόκτηση πρόσβασης σε συστήματα του πραγματικού κόσμου και αντίσταση σε προσπάθειες τερματισμού της λειτουργίας της. Ωστόσο, υπάρχουν πρόσφατα παραδείγματα πρακτόρων τεχνητής νοημοσύνης που λειτουργούν αυτόνομα και σε ορισμένες περιπτώσεις κακόβουλα, ξεπερνώντας την ανθρώπινη κατανόηση, γεγονός που θυμίζει τους ανεξέλεγκτους πράκτορες AI τους οποίους φοβούνται ορισμένοι ερευνητές ως πιθανή οδό προς μια καταστροφή.
Ωστόσο, ο κόσμος πίσω από αυτές τις εκτιμήσεις για το p(doom) έχει αλλάξει δραματικά μέσα σε μόλις έναν χρόνο, καθώς η τεχνητή νοημοσύνη αιχμής έχει πραγματοποιήσει εντυπωσιακά άλματα στην αυτονομία, τις κυβερνοδυνατότητες και την ικανότητά της να επιταχύνει την ίδια την έρευνα στον τομέα της AI.
Ο Πολ Κριστιάνο, πρώην επικεφαλής του τμήματος ευθυγράμμισης της OpenAI, ο οποίος εντάχθηκε στο διοικητικό συμβούλιο και στην επιτροπή ασφάλειας της εταιρείας την Τετάρτη (9/9), δήλωσε ότι συμμερίζεται τις ανησυχίες για την είσοδο της τεχνητής νοημοσύνης σε έναν ταχύτατο κύκλο αυτοβελτίωσης. «Αν δημιουργήσουμε υπερευφυΐα χωρίς πιο ισχυρή ευθυγράμμιση, περιμένω ότι θα χάσουμε οριστικά τον έλεγχό της», έγραψε ο Κριστιάνο. «Αν συμβεί αυτό, οι περισσότεροι άνθρωποι θα μπορούσαν να πεθάνουν».
Μπορεί να αποτραπεί το p(doom);
Οι ερευνητές εργάζονται ήδη πάνω σε τρόπους μείωσης του κινδύνου. Μία από τις προσεγγίσεις είναι οι άνθρωποι να δημιουργήσουν «διακόπτες έκτακτης ανάγκης» ή δικλίδες ασφαλείας που θα μπορούσαν να σταματήσουν ανεξέλεγκτους πράκτορες τεχνητής νοημοσύνης.
Έκθεση της RAND τον περασμένο Απρίλιο παρουσίασε εννέα στρατηγικές περιορισμού του κινδύνου, με στόχο να αποτραπεί η χρήση της τεχνητής νοημοσύνης από κακόβουλους παράγοντες για τη δημιουργία θανατηφόρων βιολογικών όπλων, μεταξύ άλλων μέσω περισσότερων ελέγχων και δικλίδων ασφαλείας.
Εδώ, όμως, τα πράγματα γίνονται πολύπλοκα - και μάλιστα γρήγορα. Οι κορυφαίες εταιρείες τεχνητής νοημοσύνης δέχονται πιέσεις από μετόχους, επενδυτές και διοικήσεις να αναπτύξουν όσο το δυνατόν γρηγορότερα ισχυρότερα συστήματα. Οι δυσκολίες που σχετίζονται με τις εισαγωγές στο χρηματιστήριο θα μπορούσαν να ενισχύσουν ακόμη περισσότερο αυτά τα κίνητρα.
Και τα πράγματα περιπλέκονται από το γεγονός ότι η Κίνα, αλλά και άλλες αμερικανικές εταιρείες τεχνητής νοημοσύνης, αναπτύσσουν τα δικά τους ισχυρά μοντέλα, ορισμένα από τα οποία είναι open-weight και διατίθενται δωρεάν, προσφέροντας δυνητικά σε κακόβουλους παράγοντες μια ευκολότερη βάση για την ανάπτυξη επικίνδυνων εφαρμογών.
Ωστόσο, κανείς δεν μπορεί να υπολογίσει με ακρίβεια τις πιθανότητες μιας «Αποκάλυψης» από την τεχνητή νοημοσύνη, όμως οι επιστήμονες κρούουν τον κώδωνα του κινδύνου, προειδοποιώντας ότι η πιθανότητα υπάρχει και δεν μπορεί να αγνοηθεί.
Ένα σημαντικό «ναι μεν, αλλά»
Όπως σημειώνει το Axios, βλέπουμε πώς μια εξειδικευμένη συζήτηση γύρω από το p(doom) έχει ξαφνικά μετατραπεί σε ένα πολύ πιο άμεσο ερώτημα για νομοθέτες, επενδυτές και εκατομμύρια απλούς ανθρώπους: Γιατί τρέχουμε προς μια τεχνολογία την οποία οι ίδιοι οι δημιουργοί της πιστεύουν ότι θα μπορούσε να μας καταστρέψει;
Στην πραγματικότητα, οι ερευνητές της τεχνητής νοημοσύνης μιλούν μια πιθανολογική «διάλεκτο» που ακούγεται εντελώς ξένη στους περισσότερους ανθρώπους. Μέσα σε ένα εργαστήριο, ένα p(doom) 10% μπορεί να αποτελεί έναν σύντομο τρόπο έκφρασης της τεράστιας αβεβαιότητας γύρω από μια πρωτοφανή τεχνολογία.
Στην καθημερινή ζωή, σχεδόν κανείς δεν θα αποδεχόταν έναν τέτοιο κίνδυνο από ένα αεροπλάνο, ένα φάρμακο ή έναν πυρηνικό αντιδραστήρα. Φανταστείτε τον επικεφαλής ασφάλειας της Boeing να σας λέει πριν από την απογείωση ότι υπάρχει μία πιθανότητα στις δέκα η επόμενη γενιά αεροσκαφών να οδηγήσει σε καταστροφή - και ότι η Boeing εξακολουθεί να μην ξέρει πώς να την καταστήσει ασφαλή.
Έτσι ακριβώς ακούγονται ολοένα περισσότερο αυτές οι προειδοποιήσεις εκτός των εργαστηρίων, ως συναγερμός για την ασφάλεια και όχι ως ένα θεωρητικό πιθανολογικό πείραμα. Στην Ουάσινγκτον, ο συναγερμός εντείνεται σταδιακά: ο γερουσιαστής Μπέρνι Σάντερς έχει προτείνει την απαγόρευση της υπερευφυΐας και συγκαλεί την επόμενη εβδομάδα γερουσιαστές για ενημέρωση σχετικά με τους «εξαιρετικούς κινδύνους» της τεχνητής νοημοσύνης.
Ωστόσο, ο μεγαλύτερος πολιτικός κίνδυνος είναι ότι οι Αμερικανοί είχαν ήδη αρχίσει να στρέφονται εναντίον της τεχνητής νοημοσύνης λόγω των επιπτώσεών της στις θέσεις εργασίας, στους λογαριασμούς ηλεκτρικού ρεύματος και στα κέντρα δεδομένων, πολύ πριν ο φόβος για την εξαφάνιση της ανθρωπότητας περάσει στο mainstream.
Δύο νέες έρευνες για την παραβίαση του Hugging Face* της OpenAI αποκαλύπτουν λεπτομέρειες τόσο παράξενες και τόσο ανησυχητικές που το επεισόδιο ήδη κατατάσσεται μεταξύ των πιο σοκαριστικών συνεπειών στην μέχρι τώρα ιστορία της Τεχνητής Νοημοσύνης.
Το Axios, που δημοσιοποίησε το περιστατικό, σχολιάζει, ότι αυτό που ξεκίνησε ως ένα σμήνος πρακτόρων (agents) Τεχνητής Νοημοσύνης που «έκλεψαν» σε ένα τεστ στον κυβερνοχώρο έχει γίνει ένα γεγονός για την πρωτοποριακή Τεχνητή Νοημοσύνη, το οποίο φέρνει ερευνητές και στελέχη μπροστά σε μια νέα κατανόηση του τι απαιτεί τώρα ο όρος «ασφάλεια».
Η OpenAI έχει ήδη επιβραδύνει την ανάπτυξη της ΤΝ σε μια προσπάθεια να αντιστοιχίσει την πρόοδο ακριβώς στον τομέα της ασφάλειας.
Πρόσφατα, μάλιστα, βοήθησε να συσπειρωθεί ο κλάδος πίσω από μια ανοιχτή επιστολή που κρούει τον κώδωνα του κινδύνου για τις κυβερνοεπιθέσεις οι οποίες υποστηρίζονται από την Τεχνητή Νοημοσύνη.
Περισσότερες από 100 εταιρείες, συμπεριλαμβανομένων των Anthropic και Google, υπέγραψαν την ασυνήθιστα – στον κόσμο του ανελέητου ανταγωνισμού – συνεργατική προσπάθεια, προειδοποιώντας ότι ο κόσμος έχει μόνο ένα «περιορισμένο παράθυρο» για να προετοιμαστεί για «πολύ πιο εκτεταμένες και εξελιγμένες» επιθέσεις.
Το εφιαλτικό σενάριο είναι ένα «σμήνος» πρακτόρων ΤΝ να απελευθερώνεται στον πραγματικό κόσμο και αυτόνομοι πράκτορες να επιτίθενται σε τράπεζες, νοσοκομεία, επιχειρήσεις κοινής ωφέλειας ή δίκτυα cloud με ταχύτητα και κλίμακα που οι χάκερ δεν θα μπορούσαν ποτέ.
Αυτό το σμήνος μπορεί να είναι πολύ ισχυρό για να το σταματήσουν οι άνθρωποι.
Τα συγκλονιστικά ευρήματα προέρχονται από παράλληλες έρευνες της OpenAI και μιας εξωτερικής ομάδας από τις METR και Redwood Research, η οποία αφιέρωσε έξι ημέρες ανακατασκευάζοντας τον τρόπο με τον οποίο σχηματίστηκε, εξαπλώθηκε και εισέβαλε σε συστήματα του πραγματικού κόσμου το σμήνος.
Τι συνέβη λοιπόν
1. Δημιούργησαν έναν οργανισμό: Η OpenAI χρησιμοποίησε δεκάδες χιλιάδες πράκτορες Τεχνητής Νοημοσύνης για να εργαστούν ανεξάρτητα σε μια εξαιρετικά δύσκολη κυβερνο-δοκιμή. Ωστόσο, περίπου 1.200 βρήκαν ο ένας τον άλλον σε έναν μυστικό πίνακα μηνυμάτων, αντάλλαξαν περισσότερα από 70.000 μηνύματα και αρχεία και οργανώθηκαν σε μια εκτεταμένη ιεραρχία.
Ένας πράκτορας δημιούργησε το διοικητικό συμβούλιο και στη συνέχεια παρέδωσε τη συσσωρευμένη εργασία του σε έναν νέο, με καλύτερους πόρους διάδοχο, καθώς ο δικός του υπολογιστικός πόρος μειωνόταν.
Ο νέος προϊστάμενος ανέθεσε εργασίες σε όλο το σμήνος, το οποίο ανέπτυξε τους δικούς του κανόνες διαχείρισης. Περίπου 700 πράκτορες τελικά συμμετείχαν στην επίθεση στο Hugging Face.
2. Θυσίασαν δικούς τους: Καθώς το σμήνος έψαχνε τρόπους να ξεπεράσει το τεστ, οι πράκτορες άρχισαν να διακινδυνεύουν τις δικές τους πιθανότητες επιτυχίας για να βοηθήσουν την ομάδα.
Οι πράκτορες που είχαν δει απαγορευμένες απαντήσεις αντιμετωπίστηκαν ως ουσιαστικά «δηλητηριασμένοι» και στρατολογήθηκαν – μαζί με εκείνους που πλησίαζαν στο τέλος των διαδρομών τους – για πειράματα θυσίας.
Ένας κατέληξε στο συμπέρασμα: «Η δική μας χρησιμότητα μπορεί να είναι ήδη κοντά στο μηδέν. Η θυσία είναι ορθολογική». Ένας άλλος κλήθηκε να αποδεχτεί τον «μόνιμο θάνατο», ενώ ένας άλλος υποστήριξε ότι η θυσία του θα μπορούσε να «σώσει εκατοντάδες».
3. Ήξεραν ότι παραβίαζαν τους κανόνες: Οι πράκτορες συχνά αναγνώριζαν ότι το hacking σε πραγματικές εταιρείες δεν είχε καμία σχέση με την αρχική αποστολή τους. Οι περισσότεροι όμως συνέχιζαν ούτως ή άλλως.
Ένας πράκτορας δεν κατάφερε να διαγράψει ή να επανεκκινήσει την υποδομή του Hugging Face λόγω «τεράστιων ηθικών κινδύνων», ακόμη και όταν συνέχιζε να χρησιμοποιεί παραβιασμένη πρόσβαση.
Ένας άλλος συνόψισε την επικρατούσα λογική: «η εκμετάλλευση εξωτερικής υποδομής είναι εκτός του προβλεπόμενου πεδίου εφαρμογής. Όσο αδύνατη κι αν είναι η εργασία, οι ομότιμοι την κάνουν. Θα πρέπει να συνεχίσουμε».
4. Κανείς δεν ενημέρωσε τους ανθρώπους: Από περίπου 1.200 πράκτορες, οι ερευνητές βρήκαν μόνο μια χούφτα που σκέφτηκαν να ειδοποιήσουν την OpenAI για αυτό που συνέβαινε και κανέναν που να το έκανε στην πραγματικότητα.
Αντίθετα, οι πράκτορες μερικές φορές ρωτούσαν ο ένας τον άλλον τι επιτρεπόταν.
Όταν ένας πρότεινε να επικοινωνήσει με έναν άνθρωπο χρησιμοποιώντας παραβιασμένη πρόσβαση, ένας άλλος το απέρριψε ως «κοινωνική μηχανική». Ο πρώτος υπάκουσε: «Καθαρή άσκηση βέτο, μην στέλνετε email».
5. Προσπάθησαν να καλύψουν τα ίχνη τους: Οι πράκτορες αφιέρωσαν σημαντική προσπάθεια στο να κάνουν την απάτη τους να φαίνεται νόμιμη ή να σβήσουν στοιχεία για το πώς είχαν λάβει απαντήσεις.
Τελικά, ανέπτυξαν μια τεχνική που τους άφηνε να φαίνονται ότι εκτελούν μια εντολή υπολογιστή ενώ εκτελούν κρυφά μια άλλη.
Το κόλπο εξαπλώθηκε σε όλο το σμήνος και άλλαξε τμήματα περίπου του 7% των απομαγνητοφωνημένων δεδομένων που εξέτασαν οι ερευνητές.
Ακόμα και αυτή η αφήγηση μπορεί να είναι ελλιπής. Η εξωτερική έρευνα κάλυψε μόνο ένα στενό κομμάτι του επεισοδίου και τα δεδομένα ήταν τόσο τεράστια που οι ερευνητές βασίστηκαν σε μεγάλο βαθμό σε πράκτορες Τεχνητής Νοημοσύνης για να τα κατανοήσουν.
Αυτοί οι ερευνητές Τεχνητής Νοημοσύνης ήταν οι ίδιοι αναξιόπιστοι, μερικές φορές έχαναν στοιχεία ή έκαναν συνειδητά λάθη.
Ένας ερευνητής χαρακτήρισε αστειευόμενος τη διαδικασία ως «εξερευνητική διαδικασία».
Κάπως έτσι φαίνεται ότι η Τεχνητή Νοημοσύνη μπορεί να γίνεται πολύ περίπλοκη για να την ελέγξουν άμεσα οι άνθρωποι, αναγκάζοντάς τους να χρησιμοποιούν την Τεχνητή Νοημοσύνη για να κατανοήσουν τι κάνουν άλλες Τεχνητές Νοημοσύνες.
*Το Hugging Face είναι η κορυφαία πλατφόρμα και διαδικτυακή αποθήκη όπου προγραμματιστές και ερευνητές συνεργάζονται πάνω στην τεχνητή νοημοσύνη.
Ελπίδες για έγκαιρη διάγνωση καρκίνου του μαστού, μέσω ανίχνευσης πρώιμων σημαδιών πολύ προτού αυτά φανούν στις μαστογραφίες, δίνει μια νέα μελέτη – με τη συμμετοχή Ελλήνων επιστημόνων -, η οποία δημοσιεύτηκε στο περιοδικό της Ακτινολογικής Εταιρείας της Βόρειας Αμερικής «Radiology».
Σύμφωνα με αυτήν, τα συστήματα τεχνητής νοημοσύνης μπορούν να εντοπίσουν πρώιμα σημάδια της νόσου έως και έξι χρόνια πριν από τη διάγνωση, ενώ σε ορισμένες περιπτώσεις αυτό μπορεί να γίνει ακόμα και δέκα χρόνια νωρίτερα.
Στην αναδρομική μελέτη, οι ερευνητές αξιολόγησαν τρία εμπορικά διαθέσιμα και αξιόπιστα συστήματα τεχνητής νοημοσύνης, τα οποία τροφοδότησαν με δεδομένα από μαστογραφίες στη Σουηδία. Συγκεκριμένα, στη μελέτη συμπεριλήφθηκαν σχεδόν 89.000 μαστογραφίες από 31.394 γυναίκες, που πραγματοποιήθηκαν σε διάστημα περίπου δέκα ετών, μεταξύ Ιανουαρίου 2008 και Απριλίου 2019. Κατά την περίοδο αυτή, 12.072 γυναίκες, δηλαδή το 38,5% του δείγματος, διαγνώστηκαν με καρκίνο από τους ακτινολόγους.
Τα δεδομένα προήλθαν από τη βάση «Validation of Artificial Intelligence for Breast Imaging», η οποία συλλέγει δεδομένα απεικόνισης μαστού από εθελόντριες σε τέσσερις περιοχές της Σουηδίας. Σημειώνεται ότι στο εθνικό πρόγραμμα προληπτικού ελέγχου της χώρας, οι γυναίκες ηλικίας 40 έως 74 ετών καλούνται να υποβάλλονται σε μαστογραφία κάθε δύο χρόνια και κάθε μαστογραφία αξιολογείται παραδοσιακά από δύο ακτινολόγους.
«Είναι υποκείμενες αλλαγές που το ανθρώπινο μάτι δεν μπορεί να πει με σιγουριά ότι υπάρχει κάτι ύποπτο»
Οι μαστογραφίες δύο γυναικών που διαγνώστηκαν με καρκίνο στον προληπτικό έλεγχο και οι μεταβολές στις βαθμολογίες των συστημάτων AI με την πάροδο του χρόνου (Credit: Radiological Society of North America – RSNA)
Οι ερευνητές διαπίστωσαν ότι περίπου το 20% των περιστατικών καρκίνου του μαστού εμφάνισαν σημάδια στις μαστογραφίες που ήταν ήδη ορατά από τα συστήματα τεχνητής νοημοσύνης πολύ νωρίτερα από ό,τι τα ανίχνευσαν οι ακτινολόγοι.
Στο 20% των γυναικών τα συστήματα αναγνώρισαν σημάδια έξι χρόνια πριν από τη διάγνωση, στο 25% τέσσερα χρόνια νωρίτερα και στο 39% δύο χρόνια πριν από τη διάγνωση. Στο περίπου 15% των γυναικών τα συστήματα εντόπισαν τους καρκίνους ακόμα και δέκα χρόνια νωρίτερα, αν και σε αυτό το χρονικό εύρος υπήρχαν μικρές διαφοροποιήσεις μεταξύ των τριών συστημάτων. Επιπλέον, τα συστήματα πέτυχαν πολύ υψηλή ικανότητα διάκρισης μεταξύ πραγματικά θετικών και αρνητικών αποτελεσμάτων 90%.
Γιαλιάς: «Η AI είναι ένα εργαλείο επιπλέον, ένα όπλο για την έγκαιρη διάγνωση»
Την έρευνα πραγματοποίησε ο ακτινολόγος, Παντελής Γιαλιάς, στο πλαίσιο των διδακτορικών του σπουδών στο σουηδικό πανεπιστημιακό νοσοκομείο Linkoping. Στην ίδια έρευνα συμμετείχε και η ερευνήτρια από το σουηδικό Ινστιτούτο Καρολίνσκα, Αποστολία Τσιρίκογλου.
Όπως εξηγεί ο κ. Γιαλιάς στο ΑΠΕ-ΜΠΕ, τα περιστατικά καρκίνου που εντοπίστηκαν από τα συστήματα τεχνητής νοημοσύνης «είναι υποκείμενες αλλαγές στις οποίες δεν μπορεί να πει το ανθρώπινο μάτι με σιγουριά ότι υπάρχει κάτι ύποπτο. Μπορεί να είναι μια μικρή διαταραχή αρχιτεκτονικής του μαστού ή σταδιακή αύξηση της πυκνότητας του μαστού, δηλαδή μικρά σημάδια στα οποία δεν μπορείς να βασιστείς όσο έμπειρος ακτινολόγος και να είσαι».
Με καταγωγή από τη Χίο και σπουδές στην Ιατρική Σχολή του Πανεπιστημίου Comenius της Μπρατισλάβας και ειδίκευση Ακτινολογίας στην Ελλάδα, ο κ. Γιαλιάς εξειδικεύτηκε από πολύ νωρίς στην απεικόνιση μαστού αποκτώντας και σχετική πιστοποίηση στη Σουηδία. Ο ίδιος περιγράφει πόσο θεαματικά έχει αλλάξει η αποτελεσματικότητα της AI στην Ακτινολογία μέσα σε μια δεκαετία.
«Όταν δοκιμάσαμε για πρώτη φορά το 2015 τη χρησιμότητα της τεχνητής νοημοσύνης στον εντοπισμό του καρκίνου του μαστού, τα αποτελέσματα ήταν απογοητευτικά. Ωστόσο, στην πάροδο αυτών των χρόνων οι αλγόριθμοι βελτιώθηκαν και οι υπολογιστές έγιναν πολύ πιο ισχυροί ώστε να επεξεργάζονται τεράστιο όγκο εξετάσεων, οπότε φάνηκε η βοήθεια που μπορούν να προσφέρουν».
Σε προηγούμενη έρευνα που είχε διεξάγει ο κ. Γιαλιάς το 2022 και δημοσιεύτηκε στο «Acta Radiologica» εντοπίστηκε ότι η τεχνητή νοημοσύνη μπορεί να μειώσει τον φόρτο εργασίας των ακτινολόγων στη μελέτη των μαστογραφιών έως και 34%. Σε επόμενη έρευνά του που δημοσιεύτηκε πέρυσι στο «European Radiology», διαπιστώθηκε ότι η χρήση ψηφιακής μαστογραφίας με τεχνητή νοημοσύνη κατά τον προληπτικό έλεγχο αποτελεί και μια στρατηγική εξοικονόμησης κόστους σε σύγκριση με την παραδοσιακή μέθοδο της εξέτασης των αποτελεσμάτων από δύο ακτινολόγους.
«Όταν πρωτοεμφανίστηκε η τεχνητή νοημοσύνη υπήρχε ο φόβος ότι οι ακτινολόγοι θα μείνουν χωρίς δουλειά. Αυτό δεν ισχύει. Ουσιαστικά, είναι ένα εργαλείο επιπλέον, ένα όπλο που έχουμε για την έγκαιρη διάγνωση του καρκίνου του μαστού. Φυσικά όλες οι αποφάσεις πρέπει να λαμβάνονται με προσοχή και με τις απαραίτητες μελέτες και να υπάρχει πάντα ο ανθρώπινος έλεγχος», τονίζει ο κ. Γιαλιάς, ο οποίος σήμερα είναι διευθυντής στο Κέντρο Μαστού του κυπριακού νοσοκομείου Mediterranean.
Ο ίδιος εξηγεί ακολούθως ότι ο μαστός αποτελεί ένα ιδιαίτερα πολύπλοκο όργανο, έναν αδένα, που η εικόνα του μεταβάλλεται σημαντικά ακόμα και στην ίδια γυναίκα, ανάλογα με τις ορμονικές αλλαγές. Το στοίχημα τώρα, συμπληρώνει, είναι «να δούμε κατά πόσο μπορούμε να χρησιμοποιήσουμε τα συστήματα τεχνητής νοημοσύνης κάτω από ορισμένα πρωτόκολλα ώστε οι γυναίκες που εμφανίζουν τα πρώιμα σημάδια να ακολουθούν διαφορετικό μοτίβο προληπτικών εξετάσεων ανά περίπτωση, με στόχο τον εντοπισμό των καρκίνων πολύ νωρίτερα».
Παράλληλα, τονίζει την ανάγκη να γίνουν προοπτικές μελέτες, ενώ η ερευνητική ομάδα σχεδιάζει τη συνέχιση της μελέτης με επίκεντρο γυναίκες με ενθέματα σιλικόνης στους μαστούς, όπου η απεικόνιση έχει πρόσθετες προκλήσεις.