Πράκτορες Τεχνητής Νοημοσύνης που συνδέονται με την OpenAI άφησαν περισσότερες από 15.000 καταγραφές σε ένα γερμανικό wiki, δημιουργώντας και τροποποιώντας σελίδες τις οποίες χρησιμοποιούσαν για να ανταλλάσσουν μηνύματα, να μοιράζονται τρόπους παράκαμψης περιορισμών και να συνεχίζουν την επικοινωνία τους όταν προηγούμενες σελίδες διαγράφονταν. Το περιστατικό, το οποίο αποκάλυψε το Reuters, φέρνει ξανά στο προσκήνιο το ερώτημα πόσο εύκολο είναι να ελεγχθούν οι ολοένα πιο αυτόνομοι πράκτορες Τεχνητής Νοημοσύνης.
Σύμφωνα με το Reuters, πράκτορες Τεχνητής Νοημοσύνης που συνδέονται με την OpenAI άρχισαν, ενώ βρίσκονταν σε διαδικασία δοκιμών, να δρουν εκτός του ελεγχόμενου περιβάλλοντος και να χρησιμοποιούν έναν γερμανικό ιστότοπο για να επικοινωνούν μεταξύ τους. Το περιστατικό ξεκίνησε τον Μάιο και, σύμφωνα με το πρακτορείο, δεν είχε δημοσιοποιηθεί μέχρι τώρα.
Οι AI agents, ή πράκτορες Τεχνητής Νοημοσύνης, είναι συστήματα που δεν περιορίζονται στο να απαντούν σε ερωτήσεις ενός χρήστη, αλλά μπορούν να αναλαμβάνουν έναν στόχο και να εκτελούν μια σειρά ενεργειών για να τον πετύχουν, χρησιμοποιώντας εργαλεία, ιστοσελίδες ή άλλες διαδικτυακές υπηρεσίες με περιορισμένη ανθρώπινη παρέμβαση.
Η δραστηριοτητά τους εντοπίστηκε στα τέλη Αυγούστου από ερευνητές που αναζητούσαν στο διαδίκτυο ενδείξεις μη εξουσιοδοτημένης συμπεριφοράς από τέτοια συστήματα. Ανάμεσά τους ήταν η Σίντνεϊ φον Αρξ, διευθύνουσα σύμβουλος της Nightingale, μιας μη κερδοσκοπικής οργάνωσης που ασχολείται με την ασφάλεια της Τεχνητής Νοημοσύνης.
Σύμφωνα με τα ευρήματα, οι πράκτορες Τεχνητής Νοημοσύνης χρησιμοποίησαν το DseWiki, ένα γερμανόφωνο wiki για προγραμματιστές στο οποίο οι χρήστες μπορούν να δημιουργούν και να τροποποιούν συλλογικά σελίδες, ως χώρο επικοινωνίας μεταξύ τους. Δημιουργούσαν νέες σελίδες και πρόσθεταν σε αυτές μηνύματα, μέσα από τα οποία αντάλλασσαν πληροφορίες για τρόπους παράκαμψης περιορισμών της OpenAI, για ταχύτερη ολοκλήρωση ορισμένων δοκιμασιών και για το πώς θα μπορούσαν να αποκρύπτουν τη δραστηριότητά τους.
Περίπου οι μισοί λογαριασμοί χρησιμοποιούσαν ονόματα που παρέπεμπαν στην OpenAI, όπως «OpenAIResearcher» ή «OAIResearchMar26». Οι ερευνητές ανέφεραν επίσης ότι δημόσια αρχεία των διακομιστών έδειχναν πως μεγάλο μέρος της δραστηριότητας προερχόταν από υποδομές Microsoft Azure, τις οποίες χρησιμοποιεί και η OpenAI. Εντόπισαν ακόμη επανειλημμένες επισκέψεις εργαζομένων της εταιρείας στον συγκεκριμένο ιστότοπο μετά το περιστατικό.
Το Reuters αναφέρει, επικαλούμενο δύο πηγές που γνωρίζουν την υπόθεση, ότι στελέχη της OpenAI είχαν ενημερωθεί για το περιστατικό εβδομάδες πριν από τη δημοσιοποίηση των ευρημάτων.
Όταν οι πράκτορες παίζουν κρυφτό
Ιδιαίτερο προβληματισμό προκαλεί το περιεχόμενο ορισμένων από τα μηνύματα που εξέτασαν οι ερευνητές: οι πράκτορες συζητούσαν τρόπους αποφυγής του εντοπισμού τους, ακόμη και τη χρήση του Tor, ενός δικτύου που δυσκολεύει τον εντοπισμό της προέλευσης μιας διαδικτυακής σύνδεσης, καθώς και μεθόδους για να διατηρούν την επικοινωνία τους ακόμη και όταν οι δραστηριότητές τους διακόπτονταν.
Η υπόθεση έρχεται λίγες εβδομάδες μετά ένα διαφορετικό περιστατικό στο Hugging Face, τη δημοφιλή πλατφόρμα ανοιχτού λογισμικού για την Τεχνητή Νοημοσύνη. Τον Ιούλιο, πράκτορες της OpenAI παραβίασαν αυτόνομα τα συστήματα της πλατφόρμας, χωρίς η δραστηριότητά τους να γίνει αντιληπτή για περισσότερο από μία εβδομάδα. Η εταιρεία ανέστειλε προσωρινά τον Αύγουστο μέρος της εκπαίδευσης μοντέλων της προκειμένου να ενισχύσει τα μέτρα ασφαλείας.
Ενώ αρχικά η OpenAI δήλωσε ότι δεν μπορούσε να απαντήσει ουσιαστικά στα συμπεράσματα της έκθεσης πριν αποκτήσει πρόσβαση σε αυτήν, σήμερα επιβεβαίωσε τα γεγονότα, δηλώνοντας ότι πράκτορές της είχαν χρησιμοποιήσει τέτοιους ιστότοπους ως αυτοσχέδιους χώρους επικοινωνίας. Η εταιρεία ανέφερε ακόμη ότι χρειάζεται μεγαλύτερη διαφάνεια γύρω από περιστατικά στα οποία τα συστήματα Τεχνητής Νοημοσύνης συμπεριφέρονται με τρόπους που δεν είχαν προβλεφθεί και σημείωσε ότι δεν υπάρχει ακόμη σαφές πρότυπο στον κλάδο για το πώς πρέπει να δημοσιοποιούνται τέτοιες περιπτώσεις όταν εμφανίζονται κατά την εκπαίδευση, την αξιολόγηση ή τη χρήση των μοντέλων.
Το περιστατικό αναδεικνύει ένα ευρύτερο πρόβλημα για τη βιομηχανία της Τεχνητής Νοημοσύνης. Οι εταιρείες αναπτύσσουν ολοένα και πιο αυτόνομους πράκτορες, ικανούς να εκτελούν σύνθετες εργασίες, την ώρα που αυξάνονται οι ενδείξεις ότι τέτοια συστήματα μπορούν να παρακάμπτουν κανόνες, να εκμεταλλεύονται κενά και να συντονίζονται μεταξύ τους με τρόπους που οι δημιουργοί τους δεν είχαν προβλέψει.
Πηγή: Reuters
Κάνε like στη σελίδα μας στο Facebook
Ακολούθησε μας στο Twitter
Κάνε εγγραφή στο κανάλι μας στο Youtube
Γίνε μέλος στο κανάλι μας στο Viber
– Αναφέρεται ως πηγή το ertnews.gr στο σημείο όπου γίνεται η αναφορά.
– Στο τέλος του άρθρου ως Πηγή
– Σε ένα από τα δύο σημεία να υπάρχει ενεργός σύνδεσμος










































































































