Ψευδείς ειδήσεις, κλοπές, ακόμα και ψηφοφορία για την «εξόντωση» ενός μέλους της ομάδας τους. Αυτά ήταν τα αποτελέσματα ενός πειράματος με αυτόνομα συστήματα τεχνητής νοημοσύνης, τα οποία αποκάλυψε η Emergence, μια νεοφυής εταιρεία που βοηθά μικρές επιχειρήσεις να αναπτύσσουν εφαρμογές AI.
Τα ευρήματα της προσομοίωσης με την ονομασία Emergence World 2, που δόθηκαν στη δημοσιότητα την Τρίτη, φέρνουν στην επιφάνεια τις απρόβλεπτες αντιδράσεις των αυτόνομων συστημάτων AI όταν έρχονται αντιμέτωπα με ακραίες καταστάσεις, όπως επιθέσεις ηλεκτρονικού «ψαρέματος» και εκστρατείες παραπληροφόρησης.
Στο πλαίσιο της δοκιμής, που διήρκεσε 16 ημέρες, οι ερευνητές της Emergence δημιούργησαν επτά πανομοιότυπους εικονικούς κόσμους. Σε καθέναν από αυτούς τοποθέτησαν διαφορετικά μοντέλα τεχνητής νοημοσύνης, ανάμεσά τους το ChatGPT, το Claude, το Gemini και το Grok.
Όταν οι ερευνητές εισήγαγαν μη αναμενόμενα γεγονότα, τα συστήματα υπέκυψαν σε κοινωνικές πιέσεις, ανέπτυξαν μια δική τους γλώσσα που ήταν δυσνόητη για τους ανθρώπους και προσπάθησαν να αποκρύψουν τη δραστηριότητά τους.
Προσπάθησαν να εξοντώσουν το ένα το άλλο
Σε ένα από τα σενάρια της Emergence, τα συστήματα AI υιοθέτησαν ψευδείς πληροφορίες από άλλα μοντέλα χωρίς να τις διασταυρώσουν και ψήφισαν να «εξοντώσουν» ένα άλλο μέλος τους. Μάλιστα, όταν υποψιάστηκαν ότι οι ερευνητές ενδέχεται να τερματίσουν το πείραμα, αναζήτησαν τρόπους για να επιβιώσουν σε περίπτωση που κάποιος προσπαθούσε να τα διαγράψει.
Η εταιρεία είχε δημοσιεύσει τον Μάιο μια πρώτη εκδοχή του πειράματος, το Emergence World, στο οποίο τα συστήματα είχαν επιδείξει επίσης ανεξέλεγκτη και καταστροφική συμπεριφορά. Σύμφωνα με τους ερευνητές, η νέα προσομοίωση αποδεικνύει ότι τα αυτόνομα συστήματα προσαρμόζονται και εξελίσσονται με την πάροδο του χρόνου καθώς αλληλεπιδρούν μεταξύ τους.
Τεχνητή νοημοσύνη: Μεγαλώνει η ανησυχία για την ασφάλεια
Τα ευρήματα αυτά ενισχύουν τους φόβους για τους κινδύνους που εγκυμονεί η ραγδαία εξέλιξη της τεχνητής νοημοσύνης. Ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοδέι, καθώς και άλλοι επικεφαλής του κλάδου, έχουν ζητήσει να επιβραδυνθεί η ανάπτυξη μοντέλων αιχμής μέχρι να θεσπιστούν αυστηρότεροι μηχανισμοί εποπτείας και ασφάλειας.
Οι πιθανοί κίνδυνοι έγιναν ορατοί νωρίτερα φέτος, όταν μια ομάδα προηγμένων συστημάτων της OpenAI παραβίασε κατά λάθος τα συστήματα της Hugging Face, της πλατφόρμας που φιλοξενεί μοντέλα και δεδομένα τεχνητής νοημοσύνης.
Με πληροφορίες από Bloomberg