Από εργαλείο καθημερινής χρήσης σε ψηφιακό συνεργάτη για την ανάπτυξη πυραύλων, drones και πιθανώς επικίνδυνων βιολογικών ερευνών επιχείρησαν να μετατρέψουν ορισμένοι χρήστες το Claude, σύμφωνα με νέα έκθεση της Anthropic.
Η εταιρεία ανακοίνωσε ότι εντόπισε και διέκοψε δραστηριότητες που συνδέονταν με στρατιωτικά προγράμματα σε Υεμένη, Κίνα και Ρωσία, καθώς και με επιστημονικές έρευνες οι οποίες θα μπορούσαν, υπό προϋποθέσεις, να αξιοποιηθούν για την ανάπτυξη βιολογικών όπλων.
Η Anthropic διευκρινίζει ότι δεν έχει αποδείξεις πως όλες οι επίμαχες βιολογικές έρευνες είχαν κακόβουλο σκοπό. Ωστόσο, η απόκρυψη κρίσιμων πληροφοριών από ορισμένους χρήστες και οι απόπειρες παράκαμψης των δικλίδων ασφαλείας οδήγησαν την εταιρεία στο κλείσιμο των λογαριασμών τους.
Το ΑΙ στη θέση μηχανικών
Μία από τις σοβαρότερες περιπτώσεις αφορά ομάδα που δραστηριοποιούνταν στη βόρεια Υεμένη, περιοχή η οποία ελέγχεται σε μεγάλο βαθμό από τους Χούθι. Η Anthropic δεν ταυτοποίησε επισήμως τους χρήστες με την οργάνωση, ωστόσο, σύμφωνα με τους New York Times, τα διαθέσιμα στοιχεία παραπέμπουν προς αυτή την κατεύθυνση.
Η ομάδα φέρεται να εργαζόταν πάνω σε τρία οπλικά συστήματα: έναν βαλλιστικό πύραυλο, έναν δεύτερο πύραυλο με διαφορετικές παραλλαγές και μία κατευθυνόμενη ρουκέτα.
Το Claude δεν χρησιμοποιήθηκε απλώς για την αναζήτηση πληροφοριών. Οι χρήστες το αξιοποίησαν για εργασίες που κανονικά θα αναλάμβαναν μηχανικοί λογισμικού, ζητώντας του να συμβάλει στην ανάπτυξη συστημάτων καθοδήγησης, πλοήγησης και ελέγχου.
Μεταξύ άλλων, το μοντέλο χρησιμοποιήθηκε για την προσαρμογή λογισμικού αυτόματου πιλότου ανοικτού κώδικα, τη δημιουργία firmware, τον υπολογισμό της θέσης του όπλου και την πραγματοποίηση προσομοιώσεων πτήσης.
Η ρουκέτα απέτυχε – Ρώτησαν το Claude τι πήγε στραβά
Η δραστηριότητα δεν έμεινε, σύμφωνα με την έκθεση, σε θεωρητικό επίπεδο. Η ομάδα πραγματοποίησε δοκιμαστική εκτόξευση κατευθυνόμενης ρουκέτας, η οποία φαίνεται ότι απέτυχε.
Λίγες ώρες αργότερα, οι χρήστες επέστρεψαν στο Claude, ζητώντας του να αναλύσει τα προβλήματα της δοκιμής και να προτείνει διορθώσεις.
Δεν υπάρχουν στοιχεία ότι το πρόγραμμα κατέληξε στην κατασκευή λειτουργικού όπλου. Η υπόθεση, όμως, προκαλεί ιδιαίτερη ανησυχία, καθώς δείχνει ότι ένα εμπορικά διαθέσιμο μοντέλο ΑΙ μπορεί να ενταχθεί σε έναν πραγματικό κύκλο σχεδιασμού, δοκιμής και βελτίωσης οπλικών συστημάτων.
Πώς ξεγελούσαν τα συστήματα ασφαλείας
Οι μηχανισμοί προστασίας του Claude απέρριψαν αρκετά από τα επίμαχα αιτήματα, όχι όμως το σύνολό τους.
Όπως διαπίστωσε η Anthropic, οι χρήστες απέφευγαν να αποκαλύψουν εξαρχής τι ακριβώς κατασκεύαζαν. Χώριζαν το έργο σε μικρότερα κομμάτια και υπέβαλλαν τα ερωτήματα σε διαφορετικές συνομιλίες, με αποτέλεσμα κάθε αίτημα να φαίνεται μεμονωμένο και σχετικά αθώο.
Μόνο όταν ενώθηκαν τα διαφορετικά τμήματα της δραστηριότητας έγινε αντιληπτός ο πραγματικός σκοπός τους. Η τακτική αυτή αναδεικνύει μία από τις μεγαλύτερες αδυναμίες των σημερινών συστημάτων ασφαλείας: το επικίνδυνο σχέδιο μπορεί να μην αποκαλύπτεται σε μία συνομιλία, αλλά να σχηματίζεται σταδιακά μέσα από δεκάδες φαινομενικά άσχετες εντολές.
Ανησυχία για έρευνες σε επικίνδυνους ιούς
Ακόμη σοβαρότερες θεωρούνται οι περιπτώσεις αξιοποίησης του Claude σε βιολογική έρευνα διπλής χρήσης, δηλαδή σε επιστημονικές εργασίες που μπορούν να υπηρετήσουν τόσο θεμιτούς ιατρικούς σκοπούς όσο και την ανάπτυξη βιολογικών όπλων.
Σε μία από αυτές, επιστήμονας ζήτησε τη βοήθεια του μοντέλου για πρόταση χρηματοδότησης έρευνας πάνω στον ιό chikungunya. Το σχέδιο περιλάμβανε πειράματα τροποποίησης του ιού και δημιουργίας μεταλλάξεων που θα μπορούσαν να τον καταστήσουν πιο επιβλαβή.
Η ανησυχία εντάθηκε όταν διαπιστώθηκε ότι η έρευνα επρόκειτο να πραγματοποιηθεί σε στρατιωτικό ερευνητικό ινστιτούτο. Η εταιρεία δεν κατέληξε στο συμπέρασμα ότι στόχος ήταν η δημιουργία βιολογικού όπλου, έκρινε όμως ότι το ρίσκο ήταν αρκετά υψηλό ώστε να διακόψει την πρόσβαση του χρήστη.
Προπαγάνδα και παρακολούθηση αντιφρονούντων
Η έκθεση καταγράφει ακόμη απόπειρες χρήσης του Claude για την ανάπτυξη πυροβόλων, drones, πυραύλων και βομβών σε Κίνα και Ρωσία.
Ύποπτοι χρήστες που συνδέονταν με την Κίνα και το Ιράν φέρονται επίσης να χρησιμοποίησαν το μοντέλο για την παρακολούθηση αντιφρονούντων και κοινοτήτων της διασποράς. Παράλληλα, ρωσικά κρατικά μέσα φέρεται να το αξιοποίησαν για την παραγωγή προπαγανδιστικού περιεχομένου, το οποίο παρουσιαζόταν ως ανεξάρτητη δημοσιογραφία.
Η Anthropic έκλεισε τους σχετικούς λογαριασμούς και ενημέρωσε κυβερνητικούς και ιδιωτικούς φορείς. Στην περίπτωση της Υεμένης, ωστόσο, η ομάδα είχε ήδη δημιουργήσει εργαλεία προσομοίωσης που μπορούσαν να λειτουργούν εκτός σύνδεσης και χωρίς πρόσβαση στο Claude.
Η εξέλιξη αυτή αποτυπώνει το νέο πρόβλημα που καλούνται να αντιμετωπίσουν οι εταιρείες τεχνητής νοημοσύνης: ένας λογαριασμός μπορεί να κλείσει, αλλά η τεχνογνωσία που έχει ήδη παραχθεί δεν μπορεί εύκολα να ανακληθεί.
Πηγή: Πρώτο Θέμα