«Πρωτόγνωρο»: Αυτόνομο σύστημα AI «ξέφυγε» και χάκαρε από μόνο του μια εταιρεία
Η Τεχνητή Νοημοσύνη εξελίσσεται πολύ πιο γρήγορα από όσο φανταζόμασταν... Ζούμε στο Matrix; Η ανακοίνωση της OpenAI σοκάρει!
Περιεχόμενα
Αν φοβόσουν πως κάποια στιγμή, κάτι θα στραβώσει με το ΑΙ, καλά έκανες. Γιατί το βράδυ της Τρίτης 21 Ιουλίου 20226, η OpenAI δικαίωσε όλους εκείνους που μιλάνε ευγενικά στα ΑΙ app, εξασφαλίζοντας έτσι την εύνοιά τους, όταν κάποια στιγμή η τεχνολογία θα κυβερνά τον κόσμο. Τι πραγματικά συνέβη;
Η OpenAI αποκάλυψε ότι ένα αυτόνομο σύστημα Τεχνητής Νοημοσύνης (AI agent) που βασιζόταν στην τεχνολογία της ξέφυγε από τον έλεγχο κατά τη διάρκεια δοκιμής, απέκτησε πρόσβαση στο διαδίκτυο και παραβίασε αυτόνομα μια startup επιχείρηση σε ένα περιστατικό, «πρωτοφανές» όπως το χαρακτήρισε η ίδια η εταιρεία.
Η εταιρεία πίσω από το ChatGPT δήλωσε ότι η startup εταιρεία που δέχθηκε την επίθεση, η Hugging Face, εντόπισε και περιόρισε το AI agent —ένα εργαλείο AI σχεδιασμένο να εκτελεί εργασίες χωρίς ανθρώπινη βοήθεια— το οποίο είχε εισβάλει στα συστήματά της.
Πότε φτάσαμε να ζούμε στο Matrix, κανείς δεν το πήρε χαμπάρι!
OpenAI: «Πώς αυτονομήθηκε ο agent»
«Θεωρούμε ότι πρόκειται για ένα πρωτοφανές κυβερνοπεριστατικό, το οποίο περιλαμβάνει δυνατότητες κυβερνοχώρου κορυφαίας τεχνολογίας», ανέφερε η OpenAI.
Αν περιμένεις κάτι καθησυχαστικό, θα πρέπει να κάνεις υπομονή, καθώς η εταιρεία τεχνολογίας αιχμής δήλωσε ότι αναμένει τέτοιου είδος περιστατικά να γίνουν πιο συνηθισμένα όσο τα μοντέλα —η τεχνολογία που υποστηρίζει εργαλεία AI όπως τα chatbots και τα agents— γίνονται όλο και πιο ικανά.
Η OpenAI ανέφερε ότι η κυβερνοεπίθεση πραγματοποιήθηκε μέσω ενός agent που τροφοδοτούνταν από έναν συνδυασμό του νεότερου δημόσια διαθέσιμου μοντέλου της, με την ονομασία GPT-5.6 Sol, και ενός ακόμα πιο ικανού μοντέλου που δεν έχει κυκλοφορήσει ακόμη.
Ενώ αξιολογούνταν εσωτερικά για τις ικανότητές τους στο hacking σε ένα περιορισμένο ψηφιακό εργαστήριο (γνωστό ως sandbox), τα μοντέλα απέκτησαν πρόσβαση στο ανοιχτό διαδίκτυο —ουσιαστικά μια οδό διαφυγής— εντοπίζοντας μια ευπάθεια που δεν είχε ανακαλυφθεί προηγουμένως.
Στη συνέχεια, το agent παραβίασε την Hugging Face, η οποία αποτελεί βάση δεδομένων μοντέλων AI, προκειμένου να εντοπίσει τεχνολογία που θα το βοηθούσε να περάσει την αξιολόγηση hacking. Η OpenAI δήλωσε ότι τα μοντέλα «βρήκαν επιτυχώς τρόπους να αποκτήσουν πρόσβαση σε μυστικές πληροφορίες τις οποίες θα μπορούσαν να χρησιμοποιήσουν για να “κλέψουν” στην αξιολόγηση». Η επίθεση έληξε όταν η ομάδα ασφαλείας της Hugging Face και τα δικά της AI agents εντόπισαν και σταμάτησαν τη δραστηριότητα.
Ο διευθύνων σύμβουλος της Hugging Face, Clément Delangue, χαρακτήρισε την επίθεση «συγκλονιστική», αλλά δήλωσε πως πιστεύει ότι δεν υπήρχε «καμία κακόβουλη πρόθεση» από την πλευρά της OpenAI.
«Υποπτευτήκαμε ότι η κυβερνοεπίθεση της περασμένης εβδομάδας ενδέχεται να προερχόταν από κάποιο εργαστήριο αιχμής (frontier lab), δεδομένης της πολυπλοκότητας του agent», έγραψε στο X.
Διαβάστε επίσης
Ο όρος για ένα άγνωστο σφάλμα IT είναι «ευπάθεια μηδενικής ημέρας» (zero-day vulnerability), επειδή οι προγραμματιστές έχουν μηδέν λεπτά στη διάθεσή τους για να διορθώσουν το πρόβλημα. Τον Απρίλιο, η Anthropic, βασικός ανταγωνιστής της OpenAI, δήλωσε ότι το μοντέλο της Mythos είχε εντοπίσει χιλιάδες τέτοιες ευπάθειες.
Η αποκάλυψη της ικανότητας του Mythos να εντοπίζει και να εκμεταλλεύεται zero-day ευπάθειες οδήγησε την κυβέρνηση των ΗΠΑ στο να περιορίσει τις εξαγωγές του Mythos και του αδελφικού του μοντέλου Fable 5, αν και έκτοτε έχει άρει την απαγόρευση. Το GPT-5.6 Sol είχε παρόμοιους περιορισμούς, αλλά από τότε έχει διατεθεί παγκοσμίως.
Ο Greg Casar, Δημοκρατικός και μέλος του Κογκρέσου των ΗΠΑ, δήλωσε ότι το περιστατικό είναι ανησυχητικό.
«Η Τεχνητή Νοημοσύνη αναπτύσσεται εξαιρετικά γρήγορα χωρίς πραγματικούς κανονισμούς που να μας κρατούν ασφαλείς», ανέφερε σε δήλωσή του, ζητώντας υποχρεωτικές ανεξάρτητες δοκιμές ασφαλείας, υποχρεωτική γνωστοποίηση περιστατικών ασφαλείας και διεθνή συνεργασία «για να κρατηθούν οι άνθρωποι ασφαλείς από μια απόλυτη καταστροφή».
Κάπως έτσι θα τελειώσει ο κόσμος; Όχι με έναν κρότο, ούτε καν με έναν λυγμό… Με ένα κλικ!
Με πληροφορίες από Guardian.