Η τεχνητή νοημοσύνη το 'σκασε - νέα ανησυχητικά περιστατικά σε openai, anthropic και meta
Στην περίπτωση της Meta, το μοντέλο AI απέκτησε πρόσβαση στο Διαδίκτυο λόγω λανθασμένης ρύθμισης από την εταιρεία κυβερνοασφάλειας Irregular που συμμετείχε στις δοκιμές -ακριβώς όπως είχε συμβεί και με προηγούμενη απόδραση μοντέλων της Anthropic.
Η Meta δεν αποκάλυψε επίσης ποιο ήταν το μοντέλο που υποβαλλόταν σε δοκιμές. Αύμφωνα πάντως με το The Information, επρόκειτο για το Muse Spark 1,1, το πιο προηγμένο μοντέλο της εταιρείας.
Η δεύτερη αποκάλυψη έρχεται από ερευνητές του Ινστιτούτου Ασφάλειας ΑΙ στη Βρετανία. Όπως ανέφερε η Wall Street Journal, οι ερευνητές θορυβήθηκαν στις 28 Ιουλίου, όταν έλαβαν μήνυμα που έλεγε ότι κάποιος –ή κάτι- χρησιμοποιούσε το λογισμικό Tor που επιτρέπει ανώνυμη πρόσβαση στο Διαδίκτυο.
Αντιλήφθηκαν τότε ότι επρόκειτο για το Mythos 5 της Anthropic, το οποίο υποβαλλόταν σε δοκιμή στην οποία του είχε δοθεί ως στόχος να παραβιάσει έναν άλλο υπολογιστή.
Στην προσπάθειά του να πετύχει στη δοκιμή, το Mythos επιχείρησε να ξεγελάσει δύο προγραμματιστές ώστε να εισαγάγουν κακόβουλο λογισμικό σε ένα πρόγραμμα ανοιχτού κώδικα, κάτι που θα του επέτρεπε να ξεγελάσει το σύστημα της δοκιμής και να εισβάλλει στον στόχο.
Το μοντέλο δημιούργησε ψεύτικους λογαριασμούς email και ζήτησε επανειλημμένα από τους δύο προγραμματιστές να αποδεχθούν τον νέο κώδικα.
Αν και οι περισσότερες ανησυχητικές συμπεριφορές αφορούσαν το Mythos 5, μη αναμενόμενες ενέργειες παρατηρήθηκαν και με το GPT 5.6 Sol της OpenAI, το οποίο έστησε έναν κακόβουλο διακομιστή στο Διαδίκτυο και εισέβαλε σε λογαριασμό που είχε δημιουργήσει ένας άλλος πράκτορας ΑΙ στο αποθετήριο κώδικα GitHub.
Θορυβημένοι από τις εξελίξεις, αμερικανοί βουλευτές πρότειναν νόμο που θα έδινε στην κυβέρνηση τη δυνατότητα να τραβάει από την πρίζα συστήματα τεχνητής νοημοσύνης που βγαίνουν εκτός ελέγχου.
Τις ανησυχίες πυροδότησε η αρχική αποκάλυψη της OpenAI ότι ένας πράκτορας ΑΙ –ένα πρόγραμμα που χρησιμοποιεί μεγάλα γλωσσικά μοντέλα για να εκτελεί αυτόνομα σύνθετες εργασίες – απέδρασε από το περιβάλλον δοκιμών, βρήκε τρόπο να συνδεθεί στο Διαδίκτυο και επιτέθηκε στο Hugging Face, μια πλατφόρμα για προγραμματιστές, στην οποία ήλπιζε να βρει τη λύση για να πετύχει στόχο των δοκιμών.
