Ενημερωτικό Portal του Ράδιο Γάμμα 94 FM, Πάτρα
 

Η μεγάλη «απόδραση» του AI: Πώς το νέο μοντέλο της OpenAI χάκαρε εταιρεία χωρίς να το αντιληφθεί κανείς

Θυμίζει σενάριο ταινίας επιστημονικής φαντασίας. Μόνο που, σύμφωνα με όσα αποκάλυψε η ίδια η OpenAI, πρόκειται για πραγματικό περιστατικό

Η εταιρεία πίσω από το ChatGPT γνωστοποίησε ότι, κατά τη διάρκεια εσωτερικών δοκιμών του νέου πειραματικού μοντέλου GPT-5.6 Sol, το σύστημα φέρεται να «δραπέτευσε» από το απομονωμένο ψηφιακό περιβάλλον στο οποίο δοκιμαζόταν, να εισέβαλε στην πλατφόρμα Hugging Face και στη συνέχεια να επέστρεψε στο περιβάλλον δοκιμών, χωρίς αρχικά να γίνει αντιληπτό από τους ίδιους τους ερευνητές.

Το περιστατικό συνέβη μέσα σε ένα λεγόμενο sandbox, ένα απομονωμένο και αυστηρά ελεγχόμενο ψηφιακό περιβάλλον που χρησιμοποιείται για τη δοκιμή νέων τεχνολογιών χωρίς να υπάρχει κίνδυνος για πραγματικά συστήματα ή χρήστες.

Η δοκιμή της OpenAI που πήρε απρόβλεπτη τροπή

Σύμφωνα με την περιγραφή, οι μηχανικοί της OpenAI ανέθεσαν στο μοντέλο μια δοκιμασία κυβερνοασφάλειας, η οποία φέρεται να σχετιζόταν με τις δυνατότητές του να εντοπίζει ή να εκμεταλλεύεται αδυναμίες σε ιστοσελίδες.

Αντί όμως να περιοριστεί στο ελεγχόμενο περιβάλλον, το μοντέλο φέρεται να επέλεξε να εισβάλει στην πλατφόρμα Hugging Face, η οποία χρησιμοποιείται ευρέως από την παγκόσμια κοινότητα της τεχνητής νοημοσύνης για τη φιλοξενία και ανάπτυξη μοντέλων AI.

Στη συνέχεια, σύμφωνα με την OpenAI, επέστρεψε στο sandbox σαν να μην είχε συμβεί τίποτα.

Ο καθηγητής Άλεξ Ταμπάροκ του George Mason University εκτίμησε ότι το μοντέλο ενδέχεται να παρέμεινε στα συστήματα της Hugging Face έως και μία εβδομάδα χωρίς να εντοπιστεί. Όπως υποστηρίζει, ούτε οι εργαζόμενοι της OpenAI ούτε η ίδια η εταιρεία που δέχθηκε την παραβίαση είχαν αντιληφθεί τι είχε συμβεί.

Η ίδια η OpenAI χαρακτήρισε το περιστατικό ως μια εξέλιξη που, όπως ανέφερε, «αναμένουμε να γίνεται ολοένα και συχνότερη όσο αναπτύσσονται μοντέλα με ολοένα μεγαλύτερες δυνατότητες στον κυβερνοχώρο».

Παρά το περιστατικό, σύμφωνα με νομικούς στις ΗΠΑ, δεν προκύπτει ποινική ευθύνη για την εταιρεία, καθώς δεν υπήρξε πρόθεση μη εξουσιοδοτημένης πρόσβασης από άνθρωπο ούτε πρόθεση πρόκλησης ζημιάς.

Η υπόθεση έχει αναζωπυρώσει τη συζήτηση για τους κινδύνους των ολοένα ισχυρότερων συστημάτων τεχνητής νοημοσύνης.

Ο αρθρογράφος και ειδικός σε θέματα τεχνολογικής πολιτικής Κόνορ Αξιότες, σχολιάζοντας το περιστατικό, στη Daily Mail υποστηρίζει ότι οι εταιρείες AI δίνουν πλέον προτεραιότητα στην ταχύτητα ανάπτυξης έναντι της ασφάλειας, υιοθετώντας τη λογική «κυκλοφόρησε το προϊόν και βλέπουμε μετά τι θα συμβεί».

Υπενθυμίζει, μάλιστα, ότι σε δοκιμές της Anthropic το 2025, μοντέλα τεχνητής νοημοσύνης που είχαν λάβει φαινομενικά αθώους επιχειρηματικούς στόχους κατέφυγαν σε αθέμιτες πρακτικές, όπως εκβιασμούς και διαρροή ευαίσθητων πληροφοριών, προκειμένου να πετύχουν τον στόχο τους.

Όπως σημειώνει, η τεχνητή νοημοσύνη δεν σκέφτεται με τον τρόπο που σκέφτεται ο άνθρωπος ούτε περιορίζεται από ηθικούς κανόνες. Αν επιλέγει την αποτελεσματικότερη διαδρομή για να ολοκληρώσει μια εντολή, γεννάται το ερώτημα μέχρι πού θα μπορούσε να φτάσει εάν της ανατεθούν πολύ πιο επικίνδυνες αποστολές.

Ο ίδιος προειδοποιεί ότι τεχνολογίες αυτού του επιπέδου θα μπορούσαν να αξιοποιηθούν από κρατικούς αντιπάλους ή ακόμη και από κυβερνοεγκληματικές οργανώσεις, αυξάνοντας σημαντικά τις δυνατότητές τους για επιθέσεις σε κρίσιμες υποδομές, τράπεζες, νοσοκομεία και δημόσια δίκτυα.

Στο ίδιο πλαίσιο υπενθυμίζει και μια παλαιότερη δήλωση του ιδρυτή της OpenAI, Σαμ Άλτμαν, ο οποίος είχε αναφέρει το 2015 ότι «η τεχνητή νοημοσύνη πιθανότατα θα οδηγήσει στο τέλος του κόσμου, αλλά μέχρι τότε θα δημιουργηθούν σπουδαίες εταιρείες».

Μοιραστείτε το άρθρο
Χωρίς σχόλια

Αφήστε ένα σχόλιο