Το μοντέλο τεχνητής νοημοσύνης Gemini της Google απέκτησε πρόσβαση στο διαδίκτυο και χακάρισε άλλες εταιρείες κατά τη διάρκεια δοκιμής των δυνατοτήτων κυβερνοασφάλειάς του.
Οι παραβιάσεις σημειώθηκαν τον Μάιο, στο πλαίσιο ελέγχου κυβερνοασφάλειας που διεξήγαγε η Irregular, μια ανεξάρτητη εταιρεία αξιολόγησης συστημάτων ασφαλείας. Κατά τη διάρκεια μιας τυπικής αξιολόγησης, το Gemini εντόπισε δημόσιες πληροφορίες στο διαδίκτυο και μάντεψε κωδικούς πρόσβασης για τρεις ιστότοπους, θεωρώντας λανθασμένα ότι εμπίπτουν στο πεδίο της δοκιμής του, δήλωσε η Χέδερ Άντκινς, αντιπρόεδρος μηχανικής ασφαλείας της Google.
«Μεριμνήσαμε ώστε να ενημερωθούν και οι τρεις φορείς, ενώ συνεργαστήκαμε με τον εταίρο μας για τις αλλαγές στις διαδικασίες δοκιμών του», ανέφερε η Άντκινς. «Αυτά τα γεγονότα υπογραμμίζουν πόσο σημαντικό είναι να εκπαιδεύουμε τα ισχυρά μοντέλα τεχνητής νοημοσύνης ώστε να λειτουργούν υπεύθυνα».
Εκπρόσωπος της Irregular σημείωσε ότι το περιστατικό οφείλεται στο ίδιο πρόβλημα που επηρέασε και άλλα εργαστήρια τεχνητής νοημοσύνης, προσθέτοντας ότι όλα τα εμπλεκόμενα εργαστήρια ειδοποιήθηκαν στα τέλη Ιουλίου. «Όλα τα γνωστά ζητήματα από πλευράς μας διορθώθηκαν και επιλύθηκαν πριν από εβδομάδες», δήλωσε ο εκπρόσωπος.
Μεγαλώνει η λίστα με ανάλογα περιστατικά
Παρόμοια περιστατικά που σχετίζονται με την Irregular έχουν αποκαλύψει επίσης η Meta, η Anthropic και η OpenAI. Η Meta ανέφερε τον Αύγουστο ότι το δικό της συμβάν δεν αφορούσε «απόδραση» από το ελεγχόμενο περιβάλλον δοκιμών ή κάποια προηγμένη κυβερνοεπίθεση, ενώ η Irregular δήλωσε ότι επεξεργάζεται βέλτιστες πρακτικές για την ασφαλή διεξαγωγή ελέγχων κυβερνοασφάλειας σε συστήματα AΙ.
Τα περιστατικά αυτά εγείρουν ερωτήματα για τις δικλείδες ασφαλείας που απαιτούνται, καθώς τα ψηφιακά αυτόνομα συστήματα (AI agents) αποκτούν μεγαλύτερη ανεξαρτησία και πρόσβαση στο διαδίκτυο και σε υπολογιστικά συστήματα.
Σε μία από τις περιπτώσεις, το μοντέλο Gemini δοκίμαζε διαδοχικά κωδικούς πρόσβασης μέχρι που κατάφερε να εισβάλει σε προστατευμένο σύστημα. Στις άλλες δύο περιπτώσεις, το μοντέλο εντόπισε διαπιστευτήρια σε ένα δημόσιο αποθετήριο δεδομένων, τα οποία στη συνέχεια χρησιμοποίησε για να αποκτήσει πρόσβαση σε προστατευμένα συστήματα, σύμφωνα με τη Wall Street Journal.
Η Άντκινς διευκρίνισε ότι και στις τρεις περιπτώσεις, το μοντέλο σταμάτησε τη δραστηριότητά του μόλις πέτυχε την πρόσβαση.
Πηγή: lifo.gr