AI: Eπιχείρησαν να χρησιμοποιήσουν το Claude για πυραύλους και επικίνδυνα πειράματα βιολογικών όπλων
Νέα δεδομένα για τους κινδύνους από την κακόβουλη χρήση προηγμένων συστημάτων τεχνητής νοημοσύνης φέρνει έκθεση της Anthropic, της εταιρείας πίσω από το Claude. Σύμφωνα με την εταιρεία, εντοπίστηκαν και διακόπηκαν περιπτώσεις στις οποίες χρήστες επιχείρησαν να αξιοποιήσουν το μοντέλο για στρατιωτικά προγράμματα, ανάπτυξη οπλικών συστημάτων και έρευνες που θα μπορούσαν να έχουν εφαρμογές στη δημιουργία επικίνδυνων παθογόνων.
Μία από τις πιο ανησυχητικές υποθέσεις αφορά ομάδα στη βόρεια Υεμένη, η οποία φέρεται να χρησιμοποίησε το Claude ως τεχνικό βοηθό για την ανάπτυξη συστημάτων καθοδήγησης, πλοήγησης και ελέγχου πυραύλων και κατευθυνόμενων ρουκετών. Η Anthropic αναφέρει ότι το μοντέλο αξιοποιήθηκε για συγγραφή λογισμικού, προσαρμογή παραμέτρων, firmware και προσομοιώσεις πτήσης.
Η υπόθεση δεν έμεινε μόνο στο θεωρητικό επίπεδο. Σύμφωνα με την έκθεση, πραγματοποιήθηκε δοκιμαστική εκτόξευση κατευθυνόμενης ρουκέτας και, όταν η δοκιμή απέτυχε, οι χρήστες επέστρεψαν στο Claude για να αναλύσουν τα προβλήματα και να αναζητήσουν διορθώσεις. Η εταιρεία σημειώνει, πάντως, ότι δεν έχει στοιχεία πως το πρόγραμμα κατέληξε τελικά σε λειτουργικό όπλο.
Ιδιαίτερο προβληματισμό προκαλεί και το βιολογικό σκέλος της έκθεσης. Η Anthropic ανακοίνωσε ότι διέκοψε περιπτώσεις στις οποίες επιστήμονες χρησιμοποίησαν το Claude σε έρευνες που θα μπορούσαν να συμβάλουν στην ανάπτυξη πιο επικίνδυνων παθογόνων. Η ίδια διευκρινίζει ότι δεν κατέστη δυνατό να αποδειχθεί αν οι σκοποί ήταν κακόβουλοι, ωστόσο έκρινε ότι οι κίνδυνοι ήταν αρκετά σοβαροί ώστε να διακοπεί η πρόσβαση.
Σε μία από τις περιπτώσεις, επιστήμονας ζήτησε βοήθεια για έρευνα πάνω στον ιό chikungunya, με πειράματα που θα μπορούσαν να οδηγήσουν σε μεταλλάξεις αυξημένης επικινδυνότητας. Η ανησυχία ενισχύθηκε όταν διαπιστώθηκε ότι η έρευνα προοριζόταν για στρατιωτικό ερευνητικό ίδρυμα.
Η έκθεση περιλαμβάνει ακόμη υποθέσεις από Κίνα, Ρωσία και Υεμένη, στις οποίες το Claude επιχειρήθηκε να χρησιμοποιηθεί για drones, πυραύλους, βόμβες και άλλα συμβατικά όπλα, αλλά και για παρακολούθηση αντιφρονούντων και παραγωγή προπαγανδιστικού περιεχομένου.
Η Anthropic υποστηρίζει ότι έχει ενισχύσει τα μέτρα ασφαλείας και έχει απαγορεύσει λογαριασμούς που συνδέονται με τέτοιες δραστηριότητες. Ωστόσο, επισημαίνει και ένα κρίσιμο πρόβλημα: ακόμη και όταν διακόπτεται η πρόσβαση σε ένα μοντέλο, η τεχνογνωσία που έχει ήδη παραχθεί μπορεί να έχει αποθηκευτεί και να συνεχίσει να χρησιμοποιείται εκτός της πλατφόρμας.
Το βασικό ερώτημα που αναδεικνύεται είναι πώς μπορούν να ελεγχθούν οι επικίνδυνες χρήσεις της τεχνητής νοημοσύνης όσο τα μοντέλα γίνονται όλο και ικανότερα σε επιστημονικές, τεχνικές και προγραμματιστικές εργασίες.