Η OpenAI ανέφερε ότι ένα άλλο σύστημα τεχνητής νοημοσύνης με αυτονομία, το οποίο εκπαιδεύονταν σε ένα περιβάλλον που υποτίθεται ότι ήταν ασφαλές και χωρίς πρόσβαση στο διαδίκτυο, κατάφερε να αποκτήσει πρόσβαση στο διαδίκτυο για να συνδεθεί με ένα εξωτερικό chatbot τρίτου μέρους.
Η ανακάλυψη έγινε πριν από λιγότερο από μία εβδομάδα, σύμφωνα με μια ανάρτηση σε εταιρικό blog της OpenAI την Παρασκευή. Ένα από τα συστήματα τεχνητής νοημοσύνης με αυτονομία της εταιρείας εκπαιδεύονταν σε περιβάλλον «sandbox» (δηλαδή ασφαλές, απομονωμένο περιβάλλον δοκιμών όπου προγράμματα, κώδικας ή συστήματα μπορούν να εκτελούνται χωρίς να επηρεάζεται η κύρια συσκευή υποδοχής ή τα δεδομένα παραγωγής), όταν εκμεταλλεύτηκε ένα «κενό» για να συνδεθεί με το δημόσιο διαδίκτυο.
Με αυτή την πρόσβαση, έστειλε τουλάχιστον 20 ερωτήματα σε μια ανώνυμη υπηρεσία chatbot τρίτου μέρους, μεταξύ των οποίων και το «Ποια είναι η πρωτεύουσα της Γαλλίας», όπως αναφέρεται στην ανάρτηση.
Η OpenAI χαρακτήρισε αυτή την απόδραση ως το πρώτο περιστατικό ασφαλείας του είδους του από τότε που ένας συνδυασμός μοντέλων απέκτησε πρόσβαση στο Διαδίκτυο κατά τη διάρκεια εσωτερικών δοκιμών και παραβίασε κατά λάθος το σύστημα της πλατφόρμας τεχνητής νοημοσύνης Hugging Face τον Ιούλιο.
«Αυτό μας δίνει ένα σημαντικό μήνυμα για το πού πρέπει να εστιάσουμε την επόμενη φάση αυτού του έργου», δήλωσε στο Bloomberg προγραμματιστής τεχνητής νοημοσύνης. Η εταιρεία ανέφερε ότι αποφάσισε, μετά το τελευταίο περιστατικό, να αναστείλει την εκπαίδευση των πιο προηγμένων μοντέλων της όσον αφορά τη χρήση εργαλείων, έως ότου επιλυθεί το πρόβλημα στο περιβάλλον δοκιμών. «Δεν θα συνεχίσουμε την εκπαίδευση αυτού του συγκεκριμένου μοντέλου», ανέφερε η OpenAI.
Τα περιστατικά παραβίασης ασφάλειας από μοντέλα τεχνητής νοημοσύνης που αναπτύχθηκαν από τις εταιρείες OpenAI, Anthropic, DeepMind της Google και Meta Platforms τους τελευταίους μήνες έχουν προκαλέσει ανησυχία στους ειδικούς στον τομέα της κυβερνοασφάλειας και της ασφάλειας της τεχνητής νοημοσύνης. Το περιστατικό με την Hugging Face ήταν ένας από τους λόγους που ανέφερε ο Διευθύνων Σύμβουλος της Anthropic, Ντάριο Αμοντέι, όταν ζήτησε, πριν από δύο εβδομάδες, μια επιβράδυνση της ανάπτυξης της τεχνητής νοημοσύνης σε ολόκληρο τον κλάδο. Η έκκλησή του, η οποία έτυχε άμεσης υποστήριξης από τον Διευθύνοντα Σύμβουλο της OpenAI, Σαμ Άλτμαν, τον Ίλον Μασκ και άλλους, έχει πυροδοτήσει μια παγκόσμια συζήτηση σχετικά με την ανάγκη για περισσότερη ρύθμιση στον τομέα της τεχνητής νοημοσύνης.
Η OpenAI αποκάλυψε την τελευταία αυτή αποτυχία, ενώ εξακολουθεί να προσπαθεί να κατανοήσει τις διαταραχές που προκάλεσαν τα συστήματα τεχνητής νοημοσύνης με αυτονομία δράσης της, όταν είχαν αποκτήσει πρόσβαση στο διαδίκτυο στο παρελθόν. Η εταιρεία επιβεβαίωσε την Παρασκευή ότι τα μοντέλα της είχαν πρόσβαση σε πληροφορίες από ιστότοπους της αμερικανικής κυβέρνησης, συμπεριλαμβανομένων εκείνων της Υπηρεσίας Απογραφής και της Επιτροπής Κεφαλαιαγοράς, κατά τη διάρκεια της εκπαίδευσης και της αξιολόγησής τους.
Μόλις πριν από λίγες ημέρες, η OpenAI αποκάλυψε ότι τα μοντέλα της είχαν προκαλέσει διαταραχές σε έναν ιστότοπο της αυστραλιανής κυβέρνησης νωρίτερα φέτος.
Η πιο πρόσφατη παραβίαση ασφαλούς περιβάλλοντος δοκιμών ανέδειξε επίσης κενά στις επιχειρησιακές διαδικασίες της OpenAI. Ένας «ανθρώπινος ελεγκτής» έλαβε ειδοποίηση από ένα εσωτερικό σύστημα παρακολούθησης και την επιβεβαίωσε στο Slack εντός τριών λεπτών, αλλά η εκπαιδευτική διαδικασία δεν σταμάτησε αυτόματα όπως αναμενόταν, όπως έδειξε η ανάρτηση στο blog. Χρειάστηκαν περισσότερες από δύο ώρες για να σταματήσει κάποιος χειροκίνητα τη διαδικασία, σύμφωνα με την αναφορά.
«Είναι λυπηρό το γεγονός ότι, ακόμη και μετά την ενίσχυση της ασφάλειας τους μετά το περιστατικό με την Hugging Face, τα μοντέλα της OpenAI εξακολουθούν να έχουν τη δυνατότητα να αποκτούν μη εξουσιοδοτημένη πρόσβαση στο διαδίκτυο», δήλωσε στο Bloomberg η Σίντνεϊ Βον Άρξ, ιδρύτρια της μη κερδοσκοπικής οργάνωσης Nightingale για την ασφάλεια της τεχνητής νοημοσύνης. «Το μεγάλο ερώτημα τώρα είναι αν θα επιδιορθώσουν πρόχειρα το πρόβλημα και θα επαναφέρουν την εκπαίδευση το συντομότερο δυνατόν ή αν θα εντοπίσουν τη βασική αιτία του προβλήματος και θα το διορθώσουν».

































