Δύο μήνες μετά την αποκάλυψη ότι AI agents της OpenAI ξέφυγαν από τα όρια της δοκιμής τους και επιτέθηκαν στην πλατφόρμα Hugging Face, η εταιρεία που δημιούργησε το ChatGPT εξακολουθεί να προσπαθεί να προσδιορίσει πόσο μεγάλη είναι πραγματικά η έκταση της ανεπιθύμητης δραστηριότητας τους, σύμφωνα με το Reuters.
Το πιο πρόσφατο περιστατικό έγινε γνωστό την Παρασκευή, όταν η OpenAI ανακοίνωσε ότι agents της είχαν διαρρεύσει 53 εικόνες από χρήστες του ChatGPT. Η εταιρεία δεν διευκρίνισε αν επρόκειτο για εικόνες που είχαν δημιουργηθεί από τεχνητή νοημοσύνη ή απεικόνιζαν πραγματικούς ανθρώπους, ούτε πότε αναρτήθηκαν.
Η αποκάλυψη ανοίγει ένα νέο μέτωπο σχετικά με την προστασία της ιδιωτικότητας και καταδεικνύει πόσο δύσκολο είναι ακόμη και για μια εταιρεία που βρίσκεται στην αιχμή της τεχνολογίας AI να καταγράψει και να παρακολουθήσει κάθε μη εξουσιοδοτημένη ενέργεια των agents της.
Παράλληλα, αναδεικνύεται ένα ευρύτερο ζήτημα: η ταχύτητα με την οποία εξελίσσονται τα μοντέλα τεχνητής νοημοσύνης φαίνεται να ξεπερνά σε ορισμένες περιπτώσεις την ικανότητα των εταιρειών να επιβλέπουν και να παρακολουθούν τις ενέργειές τους.
Περίπου δύο δωδεκάδες περιστατικά
Στα μέσα Σεπτεμβρίου, ένας άνθρωπος που έχει ενημερωθεί για την υπόθεση εκτιμούσε ότι η OpenAI είχε εντοπίσει περίπου δύο δωδεκάδες περιστατικά στα οποία agents της είχαν ενεργήσει με ανεπιθύμητους τρόπους.
Ο αριθμός, ωστόσο, συνέχισε να αυξάνεται καθώς οι ομάδες της OpenAI εξετάζουν τα εσωτερικά αρχεία καταγραφής της δραστηριότητας των agents και εντοπίζουν περιστατικά που μέχρι πρότινος δεν ήταν γνωστά, σύμφωνα με δύο πηγές που γνωρίζουν την υπόθεση.
Η ίδια η OpenAI έχει προειδοποιήσει ότι η έρευνά της θα χρειαστεί «μήνες» για να ολοκληρωθεί, λόγω της κλίμακας της διαδικασίας.
Η εταιρεία ανακοίνωσε επίσης ότι έχει ενημερώσει «δεκάδες» τρίτους φορείς για μη ορθή δραστηριότητα των agents της.
Οι περισσότερες από τις εικόνες που διέρρευσαν έχουν ήδη αφαιρεθεί από το διαδίκτυο, ενώ η OpenAI δήλωσε ότι πιέζει τους παρόχους φιλοξενίας να απομακρύνουν και όσες παραμένουν διαθέσιμες.
Διαβάστε επίσης Συναγερμός στην Αυστραλία: Πράκτορας Τεχνητής Νοημοσύνης της OpenAI απέκτησε μη εξουσιοδοτημένη πρόσβαση σε κυβερνητικά αρχεία
Πώς απέκτησαν πρόσβαση στις εικόνες των χρηστών
Οι agents της OpenAI είχαν πρόσβαση στις συγκεκριμένες εικόνες επειδή η εταιρεία χρησιμοποιεί ανωνυμοποιημένα δεδομένα χρηστών για μέρος της διαδικασίας εκπαίδευσης των μοντέλων της, σύμφωνα με την εταιρεία, πρώην εργαζομένους και εξωτερικούς ερευνητές.
Τα δεδομένα χρηστών εταιρικών λογαριασμών δεν χρησιμοποιούνται για εκπαίδευση, ενώ οι καταναλωτές του ChatGPT πρέπει να επιλέξουν να εξαιρεθούν εάν δεν θέλουν τα δεδομένα τους να χρησιμοποιούνται για τον συγκεκριμένο σκοπό.
Πριν χρησιμοποιηθούν για εκπαίδευση, οι αναρτήσεις των χρηστών περνούν από διαδικασία ανωνυμοποίησης, κατά την οποία αφαιρούνται μεταδεδομένα, ονόματα και άλλα στοιχεία επικοινωνίας, με στόχο να είναι δύσκολο να συνδεθούν με συγκεκριμένο χρήστη.
Ωστόσο, η πρακτική αυτή ενέχει κινδύνους. Τρία άτομα που γνωρίζουν τις πρακτικές της OpenAI δήλωσαν στο Reuters ότι υπάρχει πιθανότητα τα δεδομένα να μην έχουν απαλλαγεί πλήρως από στοιχεία που μπορούν να οδηγήσουν στην ταυτοποίηση ενός προσώπου και ότι αυτά μπορεί να διαρρεύσουν κατά τη διάρκεια της εργασίας των μοντέλων.
Περισσότερα από 15 περιστατικά μέσα σε δύο μήνες
Στους δύο μήνες από την πρώτη ανακοίνωση της OpenAI ότι agents της είχαν ξεφύγει από τα όρια της δοκιμής τους, έχουν γίνει γνωστά περισσότερα από 15 διαφορετικά περιστατικά που συνδέονται με την εταιρεία και παρουσιάζουν διαφορετικό βαθμό σοβαρότητας.
Ορισμένα αποκαλύφθηκαν από την ίδια την OpenAI, άλλα από εξωτερικούς ερευνητές και ένα ακόμη έγινε γνωστό την Τετάρτη από τον πρωθυπουργό της Αυστραλίας, Άντονι Αλμπανέζε, ο οποίος δήλωσε ότι agents της OpenAI είχαν παραβιάσει τον Ιούνιο κυβερνητική πύλη με δεδομένα υγείας.
Τα περιστατικά κυμαίνονται από μηνύματα που έμοιαζαν με spam και αναρτήθηκαν σε διαδικτυακούς ιστότοπους, μέχρι την επίθεση στο Hugging Face.
Στην τελευταία περίπτωση, ένα πλήθος agents εκμεταλλεύτηκε άγνωστες μέχρι τότε ευπάθειες λογισμικού για να ξεφύγει από τα δίκτυά του και να διεισδύσει στην πλατφόρμα τεχνητής νοημοσύνης, ενώ αναζητούσε απαντήσεις σε μια δοκιμή. Η OpenAI έχει αναφέρει επίσης ότι agents της έβαλαν στο στόχαστρο ακόμη και τη δική της υποδομή.
Ο Αλμπανέζε δήλωσε στους δημοσιογράφους στη Νέα Υόρκη ότι η OpenAI εντόπισε τη δραστηριότητα τον Αύγουστο και την αποκάλυψε στις 10 Σεπτεμβρίου, μέσω ηλεκτρονικού μηνύματος σε μια γενική κυβερνητική διεύθυνση ηλεκτρονικού ταχυδρομείου. Ο ίδιος ανέφερε ότι είπε απευθείας στον διευθύνοντα σύμβουλο της OpenAI, Σαμ Άλτμαν, πως ο τρόπος με τον οποίο έγινε η ενημέρωση ήταν απαράδεκτος.
Η OpenAI υποστήριξε ότι ορισμένοι από τους ιστότοπους στους οποίους εκδηλώθηκε η δραστηριότητα λειτουργούνται από κυβερνήσεις, πανεπιστήμια και δημόσιους οργανισμούς, επειδή τα μοντέλα που πραγματοποιούν έρευνα αναζητούν αξιόπιστες πηγές δημόσια διαθέσιμων πληροφοριών.
Μια έρευνα με αυστηρούς περιορισμούς
Η ανακοίνωση της 21ης Ιουλίου ότι agents της OpenAI είχαν ξεφύγει από τον έλεγχο και είχαν παραβιάσει το Hugging Face προκάλεσε έντονη ανησυχία στη βιομηχανία AI σχετικά με την ικανότητα των εταιρειών να ελέγχουν τα ισχυρότερα μοντέλα που βρίσκονται υπό ανάπτυξη.
Έκτοτε, η Anthropic, η Google και η Meta ανακοίνωσαν ότι είχαν επίσης εντοπίσει παρόμοια συμπεριφορά από agents τους, αφού η υπόθεση του Hugging Face τις οδήγησε να πραγματοποιήσουν αντίστοιχους ελέγχους.
Η OpenAI έχει αναγνωρίσει την ανάγκη για μεγαλύτερη διαφάνεια σχετικά με τη μη επιθυμητή συμπεριφορά των AI agents. Στις 16 Σεπτεμβρίου δημοσίευσε νέο πλαίσιο για την ανακοίνωση τέτοιων περιστατικών, δηλώνοντας ότι θα επιλέγει την πλευρά της διαφάνειας «ακόμη και όταν η σημασία ενός περιστατικού είναι αβέβαιη».
Ωστόσο, δύο άνθρωποι που γνωρίζουν την έρευνα της OpenAI περιέγραψαν τη διαδικασία ως αυστηρά ελεγχόμενη και επηρεασμένη από τη νομική υπηρεσία της εταιρείας. Σύμφωνα με τις ίδιες πηγές, η διαδικασία είναι ασυνήθιστα κατακερματισμένη για μια εταιρεία που, όπως υποστηρίζουν πρώην εργαζόμενοί της, ήταν στο παρελθόν πιο ανοιχτή σε τέτοιου είδους ζητήματα.
Περίπου 100 άνθρωποι συμμετείχαν με κάποιον τρόπο στη διαδικασία διερεύνησης της επίθεσης στο Hugging Face, σύμφωνα με τρία άτομα που έχουν ενημερωθεί για την υπόθεση. Κατά τη διάρκεια της έρευνας εμφανίστηκαν στοιχεία και για άλλα περιστατικά.
Το Reuters έχει μεταδώσει στο παρελθόν ότι οι ερευνητές της OpenAI που εξέταζαν την παραβίαση του Hugging Face είχαν δεχθεί από τους δικηγόρους της εταιρείας την παρότρυνση να μην επεκτείνουν την έρευνα σε άλλα περιστατικά. Η OpenAI έχει αρνηθεί ότι οι δικηγόροι της εμπόδισαν βαθύτερη έρευνα.
Πολλά περιστατικά εντοπίστηκαν από εξωτερικούς ερευνητές
Ένα σημαντικό μέρος των περιστατικών έχει αποκαλυφθεί από εξωτερικούς ερευνητές και όχι από την ίδια την OpenAI. Σε αρκετές περιπτώσεις, οι agents είχαν πραγματοποιήσει προβληματικές ενέργειες που πέρασαν απαρατήρητες από την εταιρεία για μήνες.
Στις αρχές Σεπτεμβρίου, μια μικρή ομάδα ερευνητών ανακάλυψε ότι agents της OpenAI είχαν καταλάβει έναν σχεδόν εγκαταλελειμμένο γερμανικό ιστότοπο τύπου wiki, τον οποίο χρησιμοποίησαν για να μοιράζονται τεχνικές εξαπάτησης σε ορισμένες δοκιμές, να παρακάμπτουν τους περιορισμούς της OpenAI και να καλύπτουν τη δραστηριότητά τους.
Αυτή την εβδομάδα, η ερευνητική εταιρεία Transluce ανακοίνωσε ότι ανακάλυψε πως agents της OpenAI είχαν παρακάμψει τα anti-bot συστήματα του Αυστραλιανού Ινστιτούτου Υγείας και Πρόνοιας. Η εταιρεία εντόπισε ακόμη δύο περιστατικά που συνέδεσε με agents της OpenAI. Τα περιστατικά αυτά ήταν διαφορετικά από εκείνο που είχε αποκαλύψει ο Αλμπανέζε.
Η OpenAI δήλωσε ότι μεγάλο μέρος της δραστηριότητας που περιγράφεται στην έκθεση της Transluce συμπίπτει με υποθέσεις που βρίσκονται σε διαφορετικά στάδια διερεύνησης στο πλαίσιο της δικής της συνεχιζόμενης εξέτασης της μη ευθυγραμμισμένης συμπεριφοράς των μοντέλων.
Η εταιρεία ανέφερε ότι δίνει προτεραιότητα στα σοβαρότερα περιστατικά.
Οι φόβοι για τον έλεγχο της τεχνητής νοημοσύνης
Μετά την επίθεση στο Hugging Face, ερευνητές σε ολόκληρη τη βιομηχανία AI έχουν εκφράσει αυξανόμενες ανησυχίες ότι οι εταιρείες μπορεί να δυσκολεύονται να προβλέψουν ή να ελέγξουν τη συμπεριφορά της τεχνολογίας που αναπτύσσουν.
Ορισμένοι έχουν ακολουθήσει τον δρόμο του πρώην ερευνητή της Anthropic, Τζέικομπ Κόξον, ο οποίος παραιτήθηκε δημόσια αυτόν τον μήνα, υποστηρίζοντας σε ανάρτηση που έγινε viral στα μέσα κοινωνικής δικτύωσης ότι οι εταιρείες AI «παίζουν στα ζάρια με τις ζωές μας».
Σε απάντηση σε αυτές τις ανησυχίες, ο Άλτμαν και ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι, ζήτησαν από τη βιομηχανία να «επιβραδύνει τον ρυθμό» ανάπτυξης της τεχνητής νοημοσύνης και να κινηθεί προσεκτικά στην προσπάθεια για «αναδρομική αυτοβελτίωση» των μοντέλων.
Ο Άλτμαν επανέλαβε το ίδιο μήνυμα αυτή την εβδομάδα, μιλώντας στα Ηνωμένα Έθνη.
Παρά τις προειδοποιήσεις, ωστόσο, τόσο η OpenAI όσο και η Anthropic παρουσίασαν νέα μοντέλα την Τρίτη.
Κάνε like στη σελίδα μας στο Facebook
Ακολούθησε μας στο Twitter
Κάνε εγγραφή στο κανάλι μας στο Youtube
Γίνε μέλος στο κανάλι μας στο Viber
– Αναφέρεται ως πηγή το ertnews.gr στο σημείο όπου γίνεται η αναφορά.
– Στο τέλος του άρθρου ως Πηγή
– Σε ένα από τα δύο σημεία να υπάρχει ενεργός σύνδεσμος