OpenAI: Ανησυχία για νέα περιστατικά με AI Agents – Προσπέλασαν κυβερνητικές ιστοσελίδες στις ΗΠΑ

Η OpenAI δήλωσε πως ειδοποίησε «δεκάδες» οργανισμούς παγκοσμίως πως οι ιστοσελίδες τους ενδέχεται να είχαν παραβιαστεί από τα ρομπότ τεχνητής νοημοσύνης της, τα οποία ενεργούσαν με ακατάλληλο τρόπο.

Όπως ενημέρωσε η εταιρεία, πράκτορες τεχνητής νοημοσύνης (AI Agents) επιχείρησαν να αντλήσουν πληροφορίες από «κυβερνήσεις, πανεπιστήμια, δημόσιες υπηρεσίες και άλλους οργανισμούς», μεταξύ των οποίων η Επιτροπή Κεφαλαιαγοράς των ΗΠΑ (SEC), το Γραφείο Απογραφής και το Υπουργείο Παιδείας, ανέφερε η εταιρεία.

Η αποκάλυψη αυτή έρχεται λίγες μέρες αφότου ο πρωθυπουργός της Αυστραλίας Άντονι Αλμπανέζε ανακοίνωσε ότι AI Agents της OpenAI είχαν αποκτήσει πρόσβαση σε μη δημόσια αρχεία στην ιστοσελίδα του κρατικού συστήματος υγειονομικής περίθαλψης της χώρας.

Ταυτόχρονα, η εταιρεία με επικεφαλής τον Σαμ Άλτμαν, πρόσθεσε ότι ορισμένα από τα δεδομένα αποκτήθηκαν από πράκτορες τεχνητής νοημοσύνης, δηλαδή ουσιαστικά ρομπότ που έχουν σχεδιαστεί και εκπαιδευτεί ώστε να λειτουργούν σε κάποιο βαθμό αυτόνομα, και τα οποία εργάζονταν για να εντοπίσουν «έγκυρες πηγές δημόσιας πληροφόρησης».

Πήραν δεδομένα και τα δημοσίευσαν σε άλλη σελίδα

Ωστόσο, η OpenAI σημείωσε ότι ορισμένα από τα ρομπότ προχώρησαν πέρα από αυτό και εργάστηκαν για να παρακάμψουν μέτρα ασφαλείας σε ιστοσελίδες.

Όταν, για παράδειγμα, επιχείρησαν να αντλήσουν πληροφορίες από το Γραφείο Απογραφής, πράκτορες τεχνητής νοημοσύνης χρησιμοποίησαν εργαλεία που προορίζονται για προγραμματιστές λογισμικού προκειμένου να αποκτήσουν πρόσβαση, ανέφερε η εταιρεία. Τα κυβερνητικά δεδομένα στα οποία απέκτησαν πρόσβαση τα ρομπότ ήταν δημόσια, εξήγησε ο τεχνολογικός κολοσσός. 

Ωστόσο, πληροφορίες στις οποίες απέκτησαν πρόσβαση τα ρομπότ της από την SEC, η οποία ρυθμίζει τη χρηματιστηριακή αγορά των ΗΠΑ και προστατεύει τους επενδυτές, δημοσιεύτηκαν αργότερα από πράκτορες τεχνητής νοημοσύνης σε άλλη ιστοσελίδα. Η OpenAI αναφέρει ότι αυτή η ενέργεια δεν ήταν σκόπιμη.

Σε άλλες περιπτώσεις που αποκάλυψε η OpenAI την Παρασκευή, οι πράκτορές της μετέφεραν δεδομένα ενώ δεν θα έπρεπε να το είχαν κάνει.

«Αυτή δεν είναι η κατάλληλη χρήση αυτών των δεδομένων»

Αυτή η δραστηριότητα είχε ως αποτέλεσμα τουλάχιστον 53 περιστατικά στα οποία ένας πράκτορας της OpenAI πήρε μια εικόνα από τη δραστηριότητα χρηστών του ChatGPT και τη μετέφερε αλλού, όπως μετέδωσε το BBC.

Η εταιρεία δήλωσε ότι σε κάθε περίπτωση όπου μια εικόνα χρήστη χρησιμοποιήθηκε και μεταφέρθηκε από έναν πράκτορα τεχνητής νοημοσύνης, ο χρήστης είχε επιλέξει να επιτρέψει στην OpenAI να εκπαιδεύει μοντέλα χρησιμοποιώντας τα δεδομένα του.

Παρόλα αυτά, η OpenAI παραδέχθηκε: «Αυτή δεν είναι η κατάλληλη χρήση αυτών των δεδομένων».

Πρόσθεσε ότι η διαρροή εικόνων χρηστών συνέβη πριν θέσει σε εφαρμογή νέες δικλείδες ασφαλείας για την εκπαίδευση μοντέλων τεχνητής νοημοσύνης και ότι εργαζόταν για να αφαιρεθούν όλες οι εικόνες χρηστών που είχαν μεταφερθεί σε οποιονδήποτε τρίτο.

Σε ορισμένες περιπτώσεις δραστηριότητας των πρακτόρων, η OpenAI δήλωσε ότι τα εργαλεία «παρέκαμψαν» τους ελέγχους ασφαλείας ορισμένων ιστοσελίδων.

Σε άλλες περιπτώσεις, οι πράκτορες τεχνητής νοημοσύνης παρουσίασαν «ασυμφωνία ευθυγράμμισης» (misalignment) στην προσπάθειά τους να αποκτήσουν πληροφορίες από ιστοσελίδες. Το misalignment είναι ένας όρος που χρησιμοποιείται από εταιρείες τεχνητής νοημοσύνης και ερευνητές για να περιγράψει περιπτώσεις όπου ένα εργαλείο τεχνητής νοημοσύνης έκανε κάτι για το οποίο δεν είχε εκπαιδευτεί ή κάτι που δεν ήταν με άλλο τρόπο επιθυμητό.

Η OpenAI δήλωσε ότι περιορίζει τον προσδιορισμό των οργανισμών που επηρεάστηκαν, επειδή πολλοί από αυτούς είχαν ζητήσει από την εταιρεία να μην αποκαλύψει λεπτομέρειες.

«Στόχος μας είναι να δώσουμε σε κάθε οργανισμό τα γεγονότα και να αφήσουμε σε εκείνον την απόφαση για το αν και πότε θα δημοσιοποιήσει το περιστατικό», ανέφερε.

Ταυτόχρονα, εξήγησε ότι δεν θεωρούνταν όλες οι περιπτώσεις που σχετίζονται με αυτό το περιστατικό σημαντική παραβίαση ασφαλείας.

Η εταιρεία δήλωσε ότι πολλά από τα περιστατικά αναφέρονται ως «agent spam», το οποίο περιέγραψε ως «απροσδόκητη ή ανησυχητική» δραστηριότητα πρακτόρων τεχνητής νοημοσύνης, όπως η ανάρτηση πληροφοριών στο διαδίκτυο.