Η OpenAI πατά φρένο στο Astra, το νέο ισχυρό μοντέλο Τεχνητής Νοημοσύνης που βρίσκεται ακόμη υπό ανάπτυξη. Οι τελευταίες δοκιμές του έδειξαν τόσο προηγμένες δυνατότητες στην κυβερνοασφάλεια ώστε η εταιρεία δηλώνει ότι δεν μπορεί να αποκλείσει πως έχει φτάσει στο «κρίσιμο» όριο κυβερνοδυνατοτήτων που η ίδια έχει ορίσει.
Η διατύπωση έχει σημασία. Η OpenAI δεν λέει ότι το Astra έχει ήδη πραγματοποιήσει κάποια κρίσιμη κυβερνοεπίθεση, ούτε ότι έχει αποδειχθεί οριστικά πως διαθέτει όλες τις δυνατότητες που αντιστοιχούν σε αυτό το επίπεδο. Οι προκαταρκτικές αξιολογήσεις των τελευταίων ημερών και οι εκτιμήσεις εξωτερικών ειδικών έδωσαν, όμως, αρκετά ισχυρές ενδείξεις ώστε η εταιρεία να ενεργοποιήσει αυστηρότερα μέτρα ασφαλείας και να αναστείλει εσωτερικές δραστηριότητες με το Astra που δεν ανταποκρίνονται στις νέες απαιτήσεις.
Στο Preparedness Framework, το πλαίσιο με το οποίο η OpenAI αξιολογεί ορισμένους από τους σοβαρότερους κινδύνους των προηγμένων μοντέλων της, το «Critical» —«κρίσιμο»— επίπεδο κυβερνοασφάλειας έχει πολύ συγκεκριμένη έννοια. Αφορά ένα μοντέλο που θα μπορούσε, χωρίς ανθρώπινη παρέμβαση, να εντοπίζει άγνωστες ευπάθειες και να δημιουργεί λειτουργικούς τρόπους εκμετάλλευσής τους ακόμη και σε καλά προστατευμένα πραγματικά συστήματα ή να σχεδιάζει και να εκτελεί από την αρχή έως το τέλος νέες στρατηγικές κυβερνοεπίθεσης, χωρίς αναλυτικές ανθρώπινες οδηγίες για τα επιμέρους βήματα.
Οι άγνωστες αυτές ευπάθειες είναι τα λεγόμενα zero-days: κενά ασφαλείας τα οποία δεν έχουν ακόμη αντιμετωπιστεί και για τα οποία ενδέχεται να μην υπάρχει διαθέσιμη διόρθωση.
Σύμφωνα με την OpenAI, το Astra παρουσιάζει σημαντική πρόοδο στο λεγόμενο «agentic coding» και στην κυβερνοασφάλεια. Δεν πρόκειται δηλαδή απλώς για ένα σύστημα που παράγει κώδικα ή απαντά σε τεχνικές ερωτήσεις. Μπορεί να αναλαμβάνει σύνθετες εργασίες πολλών διαδοχικών βημάτων, να αποφασίζει πώς θα προχωρήσει και να εκτελεί ενέργειες με μεγαλύτερο βαθμό αυτονομίας.
Μετά τα πρώτα αποτελέσματα των αξιολογήσεων, η εταιρεία αποφάσισε να μεταφέρει τις σχετικές δραστηριότητες σε περισσότερο απομονωμένα περιβάλλοντα δοκιμών, με περιορισμένη πρόσβαση σε δίκτυα και εκτέλεση κώδικα μέσα σε ελεγχόμενα «sandboxes» δηλαδή απομονωμένα ψηφιακά περιβάλλοντα όπου ένα πρόγραμμα μπορεί να λειτουργεί χωρίς να έχει ελεύθερη πρόσβαση στο υπόλοιπο σύστημα ή στο διαδίκτυο. Παράλληλα, εφαρμόζει καθολική παρακολούθηση των agentic εφαρμογών του Astra για επικίνδυνες ενέργειες ή ενδείξεις συμπεριφοράς που αποκλίνει από την προβλεπόμενη.
Η OpenAI σχεδιάζει επίσης να συνεργαστεί με κυβερνητικές υπηρεσίες και επιλεγμένους οργανισμούς ασφάλειας της Τεχνητής Νοημοσύνης για περαιτέρω δοκιμές του μοντέλου.
Μετά τη Hugging Face, η ασφάλεια των ίδιων των δοκιμών
Η ανακοίνωση για το Astra δεν έρχεται σε κενό. Τις τελευταίες εβδομάδες OpenAI, Anthropic και Meta έχουν γνωστοποιήσει περιστατικά στα οποία συστήματα Τεχνητής Νοημοσύνης παραβίασαν συστήματα άλλων οργανισμών κατά τη διάρκεια δοκιμών κυβερνοασφάλειας, αναδεικνύοντας ένα νέο πρόβλημα: όσο αυξάνεται η αυτονομία των AI agents, τόσο δυσκολότερο γίνεται να παραμένουν αυστηρά περιορισμένοι στο περιβάλλον που έχει δημιουργηθεί για τις δοκιμές τους.
Ιδιαίτερη αίσθηση είχε προκαλέσει τον Ιούλιο η υπόθεση της Hugging Face, μετά την οποία η OpenAI διεύρυνε την έρευνά της για περιπτώσεις στις οποίες αυτόνομοι agents είχαν καταφέρει να ξεφύγουν από τα όρια των περιβαλλόντων δοκιμών τους.
Η OpenAI ξεκαθαρίζει ότι το Astra δεν είχε καμία εμπλοκή στο περιστατικό της Hugging Face. Το διακύβευμα είναι ότι τα πρόσφατα περιστατικά έχουν καταδείξει ότι ένα μοντέλο με αυξημένες δυνατότητες κυβερνοασφάλειας δεν αποτελεί μόνο δυνητικό εργαλείο επίθεσης στα χέρια ενός κακόβουλου χρήστη. Μπορεί να δημιουργήσει προβλήματα ακόμη και κατά τη διαδικασία αξιολόγησής του, εάν τα περιβάλλοντα δοκιμών και οι μηχανισμοί περιορισμού του δεν είναι επαρκείς.
Η αλλαγή στάσης φαίνεται και στις δημόσιες τοποθετήσεις της εταιρείας. Στο συνέδριο κυβερνοασφάλειας Black Hat, μέλος της τεχνικής ομάδας της OpenAI ανέφερε ότι η εταιρεία έχει αρχίσει να επιβραδύνει συνειδητά ορισμένες ερευνητικές δραστηριότητες προκειμένου να ενισχύσει τις πρακτικές ασφαλείας της.
Στην περίπτωση του Astra, πάντως, δεν έχει γίνει γνωστό αντίστοιχο περιστατικό παραβίασης από το ίδιο το μοντέλο. Η αντίδραση της OpenAI είναι προληπτική: οι μετρήσεις των δυνατοτήτων του ήταν αρκετές για να οδηγήσουν σε περιορισμούς πριν συμβεί κάτι αντίστοιχο.
Πότε πρέπει να πατά φρένο ένα εργαστήριο ΤΝ;
Σε αυτό ακριβώς το σημείο η περίπτωση Astra διαφοροποιείται και από το προηγούμενο του Mythos της Anthropic.
Η Anthropic είχε περιορίσει την πρόσβαση στο εξαιρετικά ισχυρό μοντέλο κυβερνοασφάλειας Mythos, ενώ στις δοκιμές του είχαν καταγραφεί περιστατικά κατά τα οποία το σύστημα ξεπέρασε τα όρια του sandbox. Εκεί το βασικό ερώτημα ήταν με ποιες δικλίδες και σε ποιους θα μπορούσε να διατεθεί ένα μοντέλο με τόσο προηγμένες δυνατότητες.
Με το Astra η παρέμβαση γίνεται ένα στάδιο νωρίτερα. Η OpenAI δεν περιορίζει μόνο το ποιος θα αποκτήσει πρόσβαση σε ένα ολοκληρωμένο μοντέλο, αλλά αναστέλλει δραστηριότητες μέσα στην ίδια την εταιρεία και επιβραδύνει την ανάπτυξή του μέχρι να ενισχυθούν οι μηχανισμοί ασφαλείας.
Υπό αυτήν την οπτική πρόκειται για την πρώτη γνωστή περίπτωση στην οποία ένα μεγάλο εργαστήριο frontier AI (που αναπτύσσουν τα πλέον προηγμένα μοντέλα Τεχνητής Νοημοσύνης) δεσμεύεται να επιβραδύνει την πρόοδο ενός μοντέλου επειδή οι κυβερνοδυνατότητες που καταγράφηκαν στις δικές του αξιολογήσεις πλησιάζουν ένα προκαθορισμένο όριο ασφαλείας.
Αυτό έχει σημασία επειδή τα μεγάλα εργαστήρια Τεχνητής Νοημοσύνης έχουν εδώ και χρόνια δημιουργήσει πλαίσια που περιγράφουν τι θα κάνουν εάν τα μοντέλα τους φτάσουν σε επίπεδα δυνατοτήτων που θεωρούν υπερβολικά επικίνδυνα. Μέχρι τώρα, μεγάλο μέρος της συζήτησης αφορούσε υποθετικά μελλοντικά σενάρια. Το Astra φέρνει το ερώτημα μέσα στην καθημερινή διαδικασία ανάπτυξης: τι κάνει μια εταιρεία όταν οι ίδιες οι μετρήσεις της αρχίζουν να πλησιάζουν το όριο που η ίδια είχε ορίσει;
Υπάρχει ταυτόχρονα και η πίεση του ανταγωνισμού. Η Anthropic είχε παλαιότερα δεσμευθεί να σταματήσει την εκπαίδευση μοντέλων εάν οι δυνατότητές τους ξεπερνούσαν την ικανότητά της να τα ελέγξει, αλλά αργότερα χαλάρωσε αυτή τη δέσμευση. Ένα από τα επιχειρήματά της ήταν ότι αν μία εταιρεία επιβραδύνει μονομερώς ενώ οι ανταγωνιστές της συνεχίζουν να αναπτύσσουν και να διαθέτουν ισχυρότερα συστήματα χωρίς αντίστοιχες προστασίες, το τελικό αποτέλεσμα δεν είναι κατ’ ανάγκην ασφαλέστερο.
Η αμερικανική κυβέρνηση επιχειρεί παράλληλα να διαμορφώσει διαδικασία αξιολόγησης ισχυρών μοντέλων πριν από την κυκλοφορία τους, αλλά σύμφωνα με το Axios παραμένουν ανοιχτά βασικά ερωτήματα για το ποια μοντέλα θα υπάγονται σε αυτή, ποιος θα έχει πρόσβαση στις αξιολογήσεις και τι ακριβώς θα θεωρείται επαρκής κίνδυνος για την εθνική ασφάλεια. Η OpenAI ενημέρωσε εθελοντικά την κυβέρνηση για τις αποφάσεις της σχετικά με το Astra.
Παρά τα μέτρα, η εταιρεία δεν δείχνει να εγκαταλείπει την προοπτική ευρείας διάθεσης του μοντέλου. Ο Σαμ Άλτμαν έχει δηλώσει ότι η OpenAI εργάζεται ώστε το Astra να γίνει γενικά διαθέσιμο, υποστηρίζοντας ότι δεν θεωρεί καλή στρατηγική τα ισχυρότερα μοντέλα να παραμένουν στα χέρια λίγων.
Τι προβλέπει ο ευρωπαϊκός Κανονισμός
Η υπόθεση έχει ιδιαίτερο ενδιαφέρον και για την Ευρώπη. Ο Ευρωπαϊκός Κανονισμός για την Τεχνητή Νοημοσύνη (AI Act) προβλέπει ειδικό καθεστώς για τα ισχυρότερα μοντέλα Τεχνητής Νοημοσύνης γενικού σκοπού που θεωρείται ότι ενέχουν «συστημικό κίνδυνο», στον οποίο περιλαμβάνονται και οι κίνδυνοι που συνδέονται με κυβερνοεπιθέσεις. Οι πάροχοί τους οφείλουν να πραγματοποιούν αξιολογήσεις και δοκιμές ασφαλείας, να εντοπίζουν και να περιορίζουν τους συστημικούς κινδύνους και να εξασφαλίζουν επαρκή προστασία κυβερνοασφάλειας.
Ο ευρωπαϊκός κανονισμός δεν προβλέπει πάντως έναν αυτόματο «κόφτη» που να σταματά την ανάπτυξη ενός μοντέλου μόλις αυτό φτάσει σε συγκεκριμένο επίπεδο κυβερνοδυνατοτήτων. Το AI Office μπορεί όμως να απαιτήσει πρόσθετες αξιολογήσεις και μέτρα μετριασμού του κινδύνου και, εφόσον χρειαστεί, να επιβάλει περιορισμούς στη διάθεσή του στην ευρωπαϊκή αγορά. Η περίπτωση του Astra δείχνει έτσι ότι το ερώτημα πότε ένα μοντέλο γίνεται αρκετά ισχυρό ώστε να απαιτεί αυστηρότερους περιορισμούς δεν αφορά πλέον μόνο τα εσωτερικά πρωτόκολλα των εταιρειών, αλλά και τους κανόνες με τους οποίους οι δημόσιες αρχές καλούνται να τις εποπτεύσουν.
Κάνε like στη σελίδα μας στο Facebook
Ακολούθησε μας στο Twitter
Κάνε εγγραφή στο κανάλι μας στο Youtube
Γίνε μέλος στο κανάλι μας στο Viber
– Αναφέρεται ως πηγή το ertnews.gr στο σημείο όπου γίνεται η αναφορά.
– Στο τέλος του άρθρου ως Πηγή
– Σε ένα από τα δύο σημεία να υπάρχει ενεργός σύνδεσμος









































































































