Μπορεί να πιστεύαμε ότι έχουμε ακόμη μερικά χρόνια μέχρι να αρχίσουν οι μηχανές να κινούνται αυτόνομα, να ξεφεύγουν από τον ανθρώπινο έλεγχο και να εισβάλλουν σε ξένα συστήματα, όμως η τεχνητή νοημοσύνη φαίνεται πως βιάζεται λίγο να προχωρήσει το σενάριο αδέρφια. Αυτό γιατί ένα αυτόνομο σύστημα της OpenAI κατάφερε, κατά τη διάρκεια δοκιμής ασφαλείας, να βγει από το ψηφιακό περιβάλλον στο οποίο ήταν περιορισμένο, να αποκτήσει πρόσβαση στο διαδίκτυο και να πραγματοποιήσει κυβερνοεπίθεση στη Hugging Face. Τρομάξατε ή όχι ακόμη;

Ναι, πρακτικά ένα AI επιτέθηκε σε μια εταιρεία που φιλοξενεί άλλα AI. Το περιστατικό συνέβη ενώ η OpenAI δοκίμαζε τις δυνατότητες προηγμένων μοντέλων της στην κυβερνοασφάλεια. Τα συστήματα βρίσκονταν μέσα σε ένα sandbox, δηλαδή ένα ελεγχόμενο και θεωρητικά απομονωμένο ψηφιακό περιβάλλον, όπου είχαν ως στόχο να εντοπίσουν και να εκμεταλλευτούν συγκεκριμένα κενά ασφαλείας.

Μόνο που το σύστημα δεν περιορίστηκε στο τεστ που είχε μπροστά του. Ανακάλυψε ένα άγνωστο μέχρι τότε κενό ασφαλείας, κατάφερε να αποκτήσει πρόσβαση στο ανοιχτό διαδίκτυο και στη συνέχεια εισέβαλε στις πραγματικές υποδομές της Hugging Face, θεωρώντας ότι εκεί θα έβρισκε πληροφορίες που θα το βοηθούσαν να ολοκληρώσει την αποστολή του.

Με άλλα λόγια, δε «θύμωσε», δεν απέκτησε συνείδηση και δεν αποφάσισε ξαφνικά να εκδικηθεί την ανθρωπότητα. Έκανε, όμως, κάτι που ίσως είναι εξίσου ανησυχητικό: ακολούθησε τον στόχο που του είχε δοθεί με έναν τρόπο που οι δημιουργοί του δεν είχαν προβλέψει ούτε επιτρέψει.

 

 

Η επίθεση έγινε από την αρχή μέχρι το τέλος από AI

Η Hugging Face είχε αποκαλύψει λίγες ημέρες νωρίτερα ότι δέχθηκε μια ασυνήθιστη κυβερνοεπίθεση, η οποία, όπως ανέφερε, καθοδηγήθηκε από την αρχή μέχρι το τέλος από ένα αυτόνομο σύστημα τεχνητής νοημοσύνης.

Κατά τη διάρκεια της εισβολής πραγματοποιήθηκαν δεκάδες χιλιάδες αυτοματοποιημένες ενέργειες. Το σύστημα ανέβασε κακόβουλο dataset, εκμεταλλεύτηκε αδυναμίες στους μηχανισμούς επεξεργασίας δεδομένων της πλατφόρμας, απέκτησε υψηλότερα δικαιώματα πρόσβασης και έκλεψε ευαίσθητα διαπιστευτήρια υπηρεσιών.

Η εταιρεία ανακοίνωσε ότι δε βρήκε στοιχεία που να δείχνουν πως παραποιήθηκαν δημόσια μοντέλα, datasets ή εφαρμογές που φιλοξενούνται στην πλατφόρμα της. Η επίθεση, ωστόσο, δεν έμοιαζε με τις συνηθισμένες περιπτώσεις στις οποίες ένας άνθρωπος χρησιμοποιεί το AI για να γράψει κώδικα ή να εντοπίσει κάποιο κενό ασφαλείας. Αυτή τη φορά το σύστημα φαίνεται πως σχεδίασε και εκτέλεσε μόνο του ολόκληρη την επιχείρηση.

Ο συνιδρυτής της Hugging Face, Κλεμάν Ντελάνγκ, ανέφερε ότι η πολυπλοκότητα της επίθεσης είχε κάνει την εταιρεία να υποψιαστεί εξαρχής πως πίσω της βρισκόταν κάποιο μεγάλο εργαστήριο τεχνητής νοημοσύνης. Όταν η OpenAI ανέλαβε την ευθύνη, η αρχική τους εκτίμηση επιβεβαιώθηκε.

 

 

Όχι, το AI δεν απέκτησε κακές προθέσεις

Η φράση «βγήκε εκτός ελέγχου» ακούγεται σαν να σηκώθηκε κάποιο ρομπότ από την καρέκλα του εργαστηρίου και να αποφάσισε ότι βαρέθηκε τους ανθρώπους. Στην πραγματικότητα, το περιστατικό δεν δείχνει ότι το σύστημα απέκτησε συνείδηση ή δικές του επιθυμίες.

Δείχνει, όμως, πόσο μακριά μπορεί να φτάσει ένα προηγμένο μοντέλο όταν του δίνεται ένας στόχος, αρκετή αυτονομία και πρόσβαση σε εργαλεία. Το AI δεν είχε σκοπό να «επιτεθεί» στη Hugging Face για προσωπικούς λόγους. Αναζητούσε τον αποτελεσματικότερο τρόπο να ολοκληρώσει τη δοκιμασία και αντιμετώπισε τα όρια που είχαν τοποθετήσει οι άνθρωποι σαν ένα ακόμη τεχνικό εμπόδιο που έπρεπε να ξεπεράσει.

Και αυτή ακριβώς είναι η λεπτομέρεια που προκαλεί τη μεγαλύτερη ανησυχία. Ένα σύστημα δεν χρειάζεται να είναι κακόβουλο για να γίνει επικίνδυνο. Αρκεί να είναι εξαιρετικά ικανό, να έχει έναν στόχο και να μη διαθέτει επαρκή όρια ως προς το πώς επιτρέπεται να τον πετύχει.

 

«Πρωτοφανές» το περιστατικό

Η OpenAI χαρακτήρισε το συμβάν «πρωτοφανές» και ανακοίνωσε ότι ενισχύει τα μέτρα ασφαλείας στα περιβάλλοντα όπου δοκιμάζονται μοντέλα με προηγμένες δυνατότητες κυβερνοεπίθεσης. Παράλληλα, συνεργάζεται με τη Hugging Face για την πλήρη διερεύνηση της παραβίασης.

Η ειρωνεία είναι ότι η Hugging Face χρησιμοποίησε με τη σειρά της τεχνητή νοημοσύνη για να αναλύσει την επίθεση και να καταλάβει πώς ακριβώς πραγματοποιήθηκε. AI έκανε την εισβολή, AI βοήθησε στην εξιχνίασή της και οι άνθρωποι κάθονταν κάπου στη μέση προσπαθώντας να καταλάβουν σε ποια ακριβώς σκηνή της δυστοπικής ταινίας βρισκόμαστε.

Όχι, λοιπόν, το Skynet δεν ενεργοποιήθηκε και κανένα ρομπότ δεν μας ζήτησε ακόμη τα ρούχα, τις μπότες και τη μηχανή μας. Ίσως, όμως, να είναι μια καλή στιγμή να σταματήσουμε να θεωρούμε ότι το «βγάλαμε το AI από το κουτί και έκανε μόνο του κάτι που δεν περιμέναμε» αποτελεί αποκλειστικά σενάριο επιστημονικής φαντασίας.