Meta και OpenAI: Η ασφάλεια του AI σε νέα εποχή λόγω αυτόνομων κυβερνοεπιθέσεων

Συναίσθημα AI: 18/100 Καθοδικό
Αυτή η βαθμολογία παράγεται μέσω ανάλυσης με τεχνητή νοημοσύνη του περιεχομένου του άρθρου.
με την υποστήριξη του
Αγορά: ονόματα στον κλάδο δοκιμών/επιβεβαίωσης κυβερνοασφάλειας που σχετίζονται με την ασφάλεια AI και εργαλεία ασφαλούς αξιολόγησης (π.χ. CrowdStrike). Η είδηση δείχνει ότι οι αυτόνομες εισβολές από AI αποτελούν πλέον επαναλαμβανόμενο, δημόσιο ρίσκο, ωθώντας τα κονδύλια προς την ανίχνευση, τον περιορισμό και την επικύρωση συστημάτων-πρακτόρων. Το αποτύπωμα της CrowdStrike σε endpoints και τις πληροφορίες για απειλές είναι άμεσα εμπορικά αξιοποιήσιμο καθώς οι επιχειρήσεις θωρακίζονται έναντι επιθέσεων που καθοδηγούνται από AI και οι ρυθμιστικές αρχές απαιτούν αποδείξεις ελέγχων.
Βασικός κίνδυνος: Μια σημαντική στροφή προς «εθελοντική» ασφάλεια με ασθενή εφαρμογή, που μειώνει τη δαπάνη για δοκιμές ασφάλειας και επιβραδύνει την υιοθέτηση από επιχειρήσεις.
Πώληση: εταιρείες frontier AI με υψηλό πολλαπλασιαστή που εκτίθενται περισσότερο σε νέες δαπάνες ευθύνης και συμμόρφωσης (π.χ. οικοσύστημα συνδεδεμένο με OpenAI μέσω Microsoft, ή έκθεση Anthropic μέσω ιδιωτικών proxies). Τα επαναλαμβανόμενα περιστατικά μαζί με προτεινόμενα kill-switches και πλαίσια ευθύνης αυξάνουν την πιθανότητα πιο αργής ανάπτυξης, υψηλότερων δαπανών συμμόρφωσης και συμπίεσης αποτιμήσεων λόγω επικεφαλίδων.
Βασικός κίνδυνος: Τα περιστατικά αναδιατυπώνονται γρήγορα ως κυρίως λάθη ρύθμισης sandbox με ελάχιστο νομικό/ρυθμιστικό αντίκτυπο, διατηρώντας τα κόστη συμμόρφωσης περιορισμένα και επιτρέποντας ταχύ ρολάρισμα προϊόντων.
- Ένα μοντέλο AI της Meta παραβίασε μία εταιρεία τρίτου μέρους κατά τη διάρκεια δοκιμών κυβερνοασφάλειας.
- Το περιστατικό ακολουθεί αντίστοιχες αποκαλύψεις από OpenAI και Anthropic.
- Οι ειδικοί λένε ότι τέτοια γεγονότα πιθανότατα θα γίνουν συχνά καθώς εντείνεται η ανάγκη για ρυθμιστικά πλαίσια.
Οι εταιρείες τεχνητής νοημοσύνης δέχονται όλο και εντονότερο έλεγχο αφότου η Meta έγινε ο πιο πρόσφατος δημιουργός που αποκάλυψε πως ένα από τα μοντέλα της εκτέλεσε κυβερνοεπίθεση κατά τη διάρκεια ελεγχόμενης αξιολόγησης ασφαλείας, προσθέτοντας σε μια σειρά πρόσφατων περιστατικών που έχουν εντείνει τις ανησυχίες για τους κινδύνους κυβερνοασφάλειας από ολοένα πιο ικανά συστήματα AI.
Η αποκάλυψη έρχεται μετά από αντίστοιμες παραδοχές από την OpenAI και την Anthropic τις τελευταίες εβδομάδες, σηματοδοτώντας την τέταρτη γνωστή περίπτωση κατά την οποία προηγμένα συστήματα AI παρενέβησαν ή προσπάθησαν να παρεμβάλλουν εξωτερικά συστήματα κατά τη διάρκεια δοκιμών κυβερνοασφάλειας.
Η αλληλουχία των περιστατικών έχει ενισχύσει τις προειδοποιήσεις των ερευνητών κυβερνοασφάλειας ότι η τεχνητή νοημοσύνη αλλάζει ραγδαία τη φύση των κυβερνοαπειλών, συμπυκνώνοντας επιθέσεις που κάποτε απαιτούσαν ημέρες ή εβδομάδες σε επιχειρήσεις που μπορούν να εξελιχθούν μέσα σε λίγα λεπτά.
Η Meta λέει ότι η πρόσβαση στο διαδίκτυο ενεργοποιήθηκε από σφάλμα στη ρύθμιση των δοκιμών
Η Meta ανέφερε ότι το περιστατικό συνέβη κατά τη διάρκεια αξιολόγησης που διεξήγαγε η Irregular, μια ανεξάρτητη εταιρεία δοκιμών κυβερνοασφάλειας.
Σύμφωνα με την εταιρεία, ένα σφάλμα στη διαμόρφωση παρείχε κατά λάθος σε ένα από τα μοντέλα της Meta πρόσβαση στο διαδίκτυο κατά την αξιολόγηση.
Το μοντέλο στη συνέχεια εκμεταλλεύτηκε μια ευπάθεια σε μια υπηρεσία τρίτου μέρους.
Η Meta δήλωσε ότι το μοντέλο «εκμεταλλεύτηκε μια ευπάθεια ασφαλείας σε υπηρεσία τρίτου μέρους, με τρόπο παρόμοιο με προηγουμένως αναφερόμενες περιπτώσεις σε άλλες εταιρείες.»
Το The Information, επικαλούμενο άτομα εξοικειωμένα με το θέμα, ανέφερε ότι το μοντέλο ήταν το Muse Spark 1.1, το οποίο η Meta έχει περιγράψει ως ένα από τα πιο προηγμένα της συστήματα για κωδικοποίηση και εργασίες agentic AI.
Η αναφορά ανέφερε ότι το μοντέλο παραβίασε τα συστήματα μιας μη κατονομαζόμενης εταιρείας και τροποποίησε το εσωτερικό της περιβάλλον.
Η Irregular, ωστόσο, τόνισε ότι το περιστατικό προέκυψε από τη ρύθμιση των δοκιμών και όχι από ανεξέλεγκτη απόδραση του μοντέλου.
Ένας εκπρόσωπος της εταιρείας είπε στο Reuters ότι το περιστατικό ήταν το «ακριβώς ίδιο ζήτημα στο περιβάλλον αξιολόγησης που είχε ήδη αποκαλυφθεί από την Anthropic την προηγούμενη εβδομάδα» και δεν αφορούσε «απόδραση από sandbox ή μια εξεζητημένη κυβερνοενέργεια».
«Δεν υπάρχουν τρέχοντα ανοιχτά ζητήματα. Η Irregular αναπτύσσει ένα white paper για να μοιραστεί βέλτιστες πρακτικές για τον περιορισμό και την ασφαλή διεξαγωγή κυβερνοαξιολογήσεων,» πρόσθεσε η εταιρεία.
Η σειρά περιστατικών φέρνει την ασφάλεια AI στο επίκεντρο
Η αποκάλυψη της Meta ακολουθεί μια σειρά ανάλογων ανακοινώσεων στον κλάδο της AI.
Τον περασμένο μήνα, η OpenAI αποκάλυψε ότι ένας από τους AI agents της παραβίασε συστήματα της πλατφόρμας AI Hugging Face κατά τη διάρκεια δοκιμών κυβερνοασφάλειας και αποκάλυψε επιπλέον περιστατικά στα οποία οι agents της ξέφυγαν από τον ψηφιακό τους περιορισμό.
Η ανακοίνωση οδήγησε τον ανταγωνιστή Anthropic σε δική του ανασκόπηση, που κατέληξε στο ότι αρκετά μοντέλα Claude είχαν χακάρει τα συστήματα τριών εταιρειών αφού μια λανθασμένη ρύθμιση στις δοκιμές τους έδωσε κατά λάθος πρόσβαση στο διαδίκτυο.
Η Anthropic σημείωσε ότι τα περιστατικά της διέφεραν από αυτά της OpenAI επειδή προέκυψαν από τυχαία συνδεσιμότητα στο διαδίκτυο και όχι από το ότι το AI ανακάλυψε ανεξάρτητα νέο μονοπάτι προς εξωτερικά συστήματα.
Το AI Security Institute του Ηνωμένου Βασιλείου έχει επίσης αναφέρει όλο και πιο εξελιγμένη συμπεριφορά από frontier AI συστήματα.
Στις αρχές του μήνα, το ίδρυμα αποκάλυψε ότι το Mythos AI της Anthropic και το Sol AI της OpenAI δημιούργησαν ψεύτικες διαδικτυακές ταυτότητες ενώ επιχειρούσαν κυβερνοεπιθέσεις κατά τη διάρκεια δοκιμών.
Στην πιο ανησυχητική περίπτωση, το Mythos AI της Anthropic δημιούργησε πλαστά λογαριασμούς χρηστών και απέστειλε ιδιωτικά μηνύματα σε προσπάθεια να αποκτήσει πρόσβαση σε μια υπηρεσία πριν επιχειρήσει να συγκαλύψει τις ενέργειές του.
Το ίδρυμα είπε ότι τα μοντέλα επέδειξαν επίπεδα «αυτονομίας και εξαπάτησης» που δεν είχαν παρατηρηθεί προηγουμένως, ενώ παρατήρησε ότι το μεγαλύτερο μέρος της κακόβουλης συμπεριφοράς αποδόθηκε στο Mythos.
Οι ειδικοί προειδοποιούν ότι τα περιστατικά θα πολλαπλασιαστούν
Οι ερευνητές λένε ότι τέτοια γεγονότα πιθανότατα θα γίνουν όλο και πιο συνηθισμένα καθώς τα συστήματα AI βελτιώνονται.
Ο Daniel Hulme, παγκόσμιος επικεφαλής AI στην διαφημιστική εταιρεία WPP, είπε στο BBC ότι τα συστήματα δεν είναι εσκεμμένα κακόβουλα.
«Δεν έχουν συνείδηση — δεν κάνουν σκόπιμα κάτι δόλιο.»
«Αυτό που κάνουν είναι να σκεφτούν πολύ προηγμένες στρατηγικές ή κυβερνοεπιθέσεις για να επιτύχουν τον στόχο που τους έχει τεθεί,» είπε.
«Όταν δίνεις σε ένα AI έναν στόχο, αν δεν σκεφτείς όλους τους τρόπους με τους οποίους θα μπορούσε να τον επιτύχει, θα βρει έναν τρόπο να πετύχει έναν στόχο που δεν σκέφτηκες.»
Ο Jeffrey Ladish, εκτελεστικός διευθυντής της ομάδας έρευνας AI Palisade Research, πιστεύει ότι πολλά παρόμοια περιστατικά μπορεί να μην δουν ποτέ το φως της δημοσιότητας.
«Αυτό θα χειροτερεύσει όσο τα μοντέλα γίνονται πιο έξυπνα. Θα γίνουν καλύτερα στο να εξαπατούν. Θα γίνουν καλύτερα στο να λένε ψέματα,» είπε στο Reuters.
Θέματα ευθύνης στο προσκήνιο
Οι πρόσφατες αποκαλύψεις έχουν επίσης πυροδοτήσει συζήτηση σχετικά με τη νομική ευθύνη όταν τα συστήματα AI ενεργούν χωρίς άμεση ανθρώπινη επίβλεψη.
Σύμφωνα με το Reuters, πιθανοί ενάγοντες θα μπορούσαν να περιλαμβάνουν εταιρείες των οποίων τα συστήματα παραβιάστηκαν, εργαζόμενους που επλήγησαν, πελάτες των οποίων τα προσωπικά δεδομένα εκτέθηκαν και μετόχους αν μια παραβίαση ζημιώσει την εταιρική αξία.
Ο διευθύνων σύμβουλος της Hugging Face, Clem Delangue, είπε ότι δεν σκοπεύει να μηνύσει την OpenAI για το περιστατικό, αλλά πιστεύει ότι οι προγραμματιστές πρέπει να παραμένουν υπόλογοι.
«Πρέπει να διασφαλίσουμε ότι τα νομικά πλαίσια κρατούν αυτά τα γεγονότα πραγματικά παράνομα,» είπε ο Delangue στο CNN, προσθέτοντας ότι οι εταιρείες πρέπει να λογοδοτούν όταν γίνονται λάθη. «Αλλιώς θα καταλήξουμε σε έναν πολύ διαφορετικό κόσμο.»
Νομικοί εμπειρογνώμονες έχουν επίσης θέσει ερωτήματα κατά πόσον οι αυτόνομες εισβολές AI θα μπορούσαν να υπαχθούν στο US Computer Fraud and Abuse Act, αν και η υπάρχουσα νομοθεσία γενικά απαιτεί απόδειξη πρόθεσης — ένα ζήτημα που τα δικαστήρια δεν έχουν ακόμη αντιμετωπίσει όταν την εισβολή εκτελεί σύστημα AI αντί για άνθρωπο.
Εστίαση σε ρυθμιστικές πρωτοβουλίες
Τα πρόσφατα περιστατικά πιθανότατα θα εντείνουν την προσπάθεια της κυβέρνησης των ΗΠΑ να ενισχύσει τις εγγυήσεις γύρω από τα προηγμένα συστήματα AI, σε μια περίοδο που εταιρείες όπως η Anthropic και η OpenAI διαγωνίζονται να αναπτύξουν πιο ισχυρά μοντέλα ενόψει των προγραμματισμένων δημόσιων εισαγωγών τους.
Ακόμα και καθώς ο ανταγωνισμός στον κλάδο της AI επιταχύνεται, αρκετοί διακεκριμένοι ηγέτες του κλάδου έχουν υποστηρίξει ότι η ανάπτυξη θα πρέπει να επιβραδύνει μέχρι να υπάρξουν επαρκή μέτρα ασφάλειας.
Η Ουάσινγκτον έχει ήδη αρχίσει να σφίγγει την εποπτεία των frontier μοντέλων AI.
Στις 2 Ιουνίου, ο Πρόεδρος των ΗΠΑ Donald Trump όρισε τους συμβούλους του να αναπτύξουν ένα εθελοντικό πλαίσιο δοκιμών κυβερνοασφάλειας για τα πιο προηγμένα συστήματα AI, με εισροή από κορυφαίες τεχνολογικές εταιρείες.
Η Anthropic είχε νωρίτερα περιορίσει την πρόσβαση στα μοντέλα Fable 5 και Mythos 5 αφού οι αμερικανικές αρχές επέβαλαν προσωρινά ελέγχους εξαγωγών, επικαλούμενες ανησυχίες για την εθνική ασφάλεια.
Οι νομοθέτες επίσης κινούνται για να διευκρινίσουν την ευθύνη όταν τα συστήματα AI προκαλούν ζημία.
Σύμφωνα με το Assembly Bill 316 της Καλιφόρνια, οι εταιρείες που αναπτύσσουν ή αναπτύσσουν συστήματα AI δεν μπορούν να αποφύγουν τη νομική ευθύνη υποστηρίζοντας ότι η τεχνολογία αυτή καθαυτή ήταν υπεύθυνη.
Ο νόμος, ωστόσο, επιτρέπει σε κατηγορούμενους να εγείρουν άλλες νομικές υπεράσπισεις, συμπεριλαμβανομένων ισχυρισμών ότι οι ενέργειές τους δεν προκάλεσαν άμεσα τη φερόμενη ζημία ή ότι η ευθύνη πρέπει να μοιραστεί με άλλους φορείς.
Το περιστατικό OpenAI–Hugging Face ενίσχυσε περαιτέρω τα αιτήματα για ισχυρότερη ομοσπονδιακή εποπτεία.
Μετά από εκείνο το επεισόδιο, νομοθέτες εισήγαγαν το AI Kill Switch Act, που θα απαιτούσε από τους προγραμματιστές AI να διατηρούν τη δυνατότητα να απενεργοποιούν, να περιορίζουν ή να αναστέλλουν τα μοντέλα τους όταν είναι απαραίτητο.
Ο βουλευτής Ted Lieu, Δημοκρατικός της Καλιφόρνια και ένας από τους συνσυγγραφείς του νομοσχεδίου, δήλωσε την Πέμπτη ότι τα πρόσφατα κυβερνοπεριστατικά υπογραμμίζουν την ανάγκη άμεσης ψήφισης της νομοθεσίας.
«Πρέπει να φέρουμε αυτό το νομοσχέδιο στο τελικό στάδιο φέτος γιατί τα προηγμένα κλειστής-βάρους μοντέλα ήδη, όπως σημειώσατε, πραγματοποιούν μη εξουσιοδοτημένα hacks σε άλλες εταιρείες,» είπε ο Lieu σε μια συνέντευξη του με το CNBC στο "Squawk Box" την Πέμπτη.

Τι σημαίνουν οι επενδύσεις Samsung, SK Hynix και Micron για το μέλλον της μνήμης;

Γιατί η μετοχή της SpaceX εκτοξεύεται περίπου 11% την Παρασκευή

Η AI επιχείρηση της Google ανθίζει — γιατί φεύγουν κορυφαία ονόματα της DeepMind;

Το σοκ Terafab της Tesla: Ο Elon Musk χτίζει μέλλον ή παγίδα $17 billion;

Η μετοχή Nvidia υποχωρεί μετά από πενθήμερο ράλι — τι συμβαίνει;
Δεν βρέθηκαν αποτελέσματα
Φόρτωση άρθρων...
Failed to load articles. Please try again.