Συναγερμό σήμανε η εταιρεία Τεχνητής Νοημοσύνης και Ασφαλείας, Anthropic, καθώς ανακοίνωσε ότι απέτρεψε περιπτώσεις κακόβουλης χρήσης του μοντέλου ΑΙ Claude.
Όπως αναφέρουν οι Financial Times, στην ενημερωτική έκθεση για πιθανές απειλές που δημοσίευσε χθες, Πέμπτη, χωρίς να κατονομάζει τους υποστηριζόμενους από το Ιράν Χούθι, ανέφερε ότι "εντόπισε έναν πυρήνα δραστών με έδρα το βόρειο τμήμα της Υεμένης" -μεγάλο μέρος της οποίας ελέγχεται από τους Χούθι- "η οποία διεξάγει τρία προγράμματα ανάπτυξης όπλων".
Η Anthropic ανέφερε ότι η ομάδα της Υεμένης επιδίωξε να αναπτύξει όπλα, μεταξύ των οποίων έναν βαλλιστικό πύραυλο πολλαπλών σταδίων, έναν πύραυλο πολλαπλών τύπων και έναν κατευθυνόμενο πύραυλο που χρησιμοποιούσε έναν "υπολογιστή πτήσης της κατηγορίας κοινού κινητού τηλεφώνου".
"Οι δράστες χρησιμοποίησαν τον Claude Code αντί για μηχανικούς λογισμικού για να αναπτύξουν το λογισμικό καθοδήγησης, πλοήγησης και ελέγχου που κατευθύνει και σταθεροποιεί ένα ιπτάμενο όχημα", ανέφερε χαρακτηριστικά.
"Χρησιμοποίησαν το Claude για να ενσωματώσουν έναν αυτόματο πιλότο ανοιχτού κώδικα σε έναν υπολογιστή πτήσης τύπου κινητού τηλεφώνου, γράφοντας το λογισμικό ελέγχου και εκτίμησης θέσης, ρυθμίζοντας τις παραμέτρους ελέγχου, εκτελώντας μια διαδικασία ανάπτυξης υλικολογισμικού και πραγματοποιώντας προσομοίωση πτήσης".
Η Anthropic ανέφερε ότι τα μέτρα ασφαλείας της μπλόκαραν "πολλά από τα αιτήματά τους, αλλά όχι όλα", προσθέτοντας πως οι "δράστες χρησιμοποίησαν διάφορες τακτικές για να παρακάμψουν" τα μέτρα και να αποκρύψουν τον στόχο τους.
"Προσπάθησαν να κρύψουν τους στόχους τους και τα προϊόντα για τα οποία προοριζόταν το λογισμικό, και κατένειμαν την εργασία τους σε πολλαπλές συνεδρίες, ώστε καμία μεμονωμένη συνεδρία να μην αποκαλύπτει την πλήρη πρόθεσή τους".
Anthropic: Μπλόκο σε επιστήμονες που θέλησαν να χρησιμοποιήσουν το Claude για βιολογική έρευνα
Η εταιρεία τεχνητής νοημοσύνης ανέφερε ότι δεν μπόρεσε να εξακριβώσει εάν οι ερευνητές είχαν κακόβουλες προθέσεις. Ωστόσο, μπλόκαρε τη συγκεκριμένη δραστηριότητα, καθώς οι πιθανές συνέπειες ήταν πολύ σοβαρές για να αγνοηθούν.
Οι περιπτώσεις εντοπίστηκαν μεταξύ Δεκεμβρίου 2025 και Αυγούστου 2026, όπως αναφέρει σε έκθεσή της. Η εταιρεία ανέφερε ότι τα περιστατικά αυτά καταδεικνύουν πώς μπορούν να προκύψουν βιολογικοί κίνδυνοι που είναι πιο δύσκολο να εντοπιστούν, καθώς τα πρωτοποριακά μοντέλα ΑΙ βελτιώνονται στον τομέα της επιστημονικής έρευνας.
Η μεγαλύτερη πρόκληση για την Anthropic ήταν να καθορίσει πού τελειώνει η νόμιμη έρευνα και πού αρχίζει η επικίνδυνη δραστηριότητα. Η βιολογική έρευνα έχει συχνά δυνατότητες διττής χρήσης. Η ίδια επιστημονική γνώση μπορεί να αξιοποιηθεί για την ανάπτυξη ιατρικών θεραπειών ή να συμβάλει στη δημιουργία πιο επικίνδυνων παθογόνων.
Ο Τζέικομπ Κλάιν, επικεφαλής του τμήματος πληροφοριών για απειλές της Anthropic, δήλωσε στους New York Times ότι τέτοιες περιπτώσεις σπάνια συνοδεύονται από σαφείς δηλώσεις κακόβουλης πρόθεσης. Οι ερευνητές μπορούν να παρουσιάζουν φαινομενικά νόμιμους επιστημονικούς στόχους, ενώ παράλληλα πραγματοποιούν εργασίες που εγείρουν σοβαρές ανησυχίες για την ασφάλεια.
"Δημοσιεύουμε την πιο λεπτομερή έκθεση πληροφοριών απειλών που έχουμε εκπονήσει μέχρι σήμερα. Καλύπτει τον τρόπο με τον οποίο κάποιοι προσπάθησαν να κάνουν κατάχρηση του Claude -για κυβερνοεπιθέσεις, επιχειρήσεις επιρροής, παρακολούθηση, βιολογία και κατασκευή όπλων- καθώς και τον τρόπο με τον οποίο τους εντοπίσαμε και τους σταματήσαμε".
Η Anthropic ανέφερε ότι η έρευνά της αποκάλυψε προσπάθειες παράκαμψης των περιφερειακών περιορισμών και αποφυγής των συστημάτων ασφαλείας. Η εταιρεία απέκλεισε λογαριασμούς που συνδέονταν με τη συγκεκριμένη δραστηριότητα και μοιράστηκε τα ευρήματά της με τις αρμόδιες αρχές και άλλες εταιρείες τεχνητής νοημοσύνης.
Μία από τις περιπτώσεις αφορούσε έρευνα σχετικά με τον ιό chikungunya, ο οποίος μεταδίδεται από κουνούπια. Τα συστήματα της Anthropic μπλόκαραν αίτημα που αφορούσε αίτηση χρηματοδότησης για έρευνα "gain-of-function", δηλαδή στην ενίσχυση συγκεκριμένων χαρακτηριστικών ενός παθογόνου. Η σχετική εργασία προοριζόταν για στρατιωτικό ερευνητικό ινστιτούτο, γεγονός που ενίσχυσε τις ανησυχίες της εταιρείας. Οι ερευνητές συνέχισαν την εργασία τους μέσω άλλων διαύλων, αφού το Claude μπλόκαρε τα αιτήματά τους.
ΑΙ: Τα προηγμένα μοντέλα αυξάνουν το διακύβευμα
Μια δεύτερη περίπτωση αφορούσε έρευνα για τη γρίπη των πτηνών. Η Anthropic ανέφερε ότι ένας ερευνητής χρησιμοποίησε το Claude επί εβδομάδες για τον σχεδιασμό μιας μελέτης, την ανάλυση δεδομένων και την επιστημονική ερμηνεία. Η εταιρεία δήλωσε ότι τα συστήματα ασφαλείας της εμπόδισαν τον ερευνητή να αποκτήσει πρόσβαση στα ισχυρότερα μοντέλα της για την ευαίσθητη αυτή εργασία. Η δραστηριότητα περιορίστηκε τελικά σε λιγότερο ισχυρές εκδόσεις μοντέλων. Η Anthropic ανέφερε τρεις ακόμη περιπτώσεις που αφορούσαν βιολογική έρευνα με πιθανές επιπτώσεις στην ανάπτυξη όπλων. Μεταξύ αυτών ήταν εργασίες σχετικές με ενώσεις που σχετίζονται με δηλητήρια και τοξίνες.
Η εταιρεία δεν αποκάλυψε την ταυτότητα ή την τοποθεσία των ερευνητών ούτε συγκεκριμένες λεπτομέρειες. Η Anthropic τόνισε ότι δεν υποστήριξε πως οι επιστήμονες είχαν πρόθεση να προκαλέσουν βλάβη. Αυτό έχει σημασία, καθώς τα παλαιότερα μοντέλα Claude είχαν περιορισμένη δυνατότητα να υποστηρίξουν προηγμένη βιολογική έρευνα. Η Anthropic υποστηρίζει πλέον ότι δεν μπορεί να θεωρεί δεδομένο το ίδιο για τα νεότερα συστήματα.
Ρωσική επιχείρηση κατασκοπείας με τη βοήθεια του Claude
Η Anthropic αποκάλυψε επίσης μια ρωσική επιχείρηση κατασκοπείας που χρησιμοποίησε το Claude για να αυτοματοποιήσει μεγάλο μέρος της κυβερνοεκστρατείας της. Η εταιρεία συνέδεσε τη δραστηριότητα με τη Midnight Blizzard, μια ομάδα που σχετίζεται με κρατικά υποστηριζόμενες ρωσικές κυβερνοεπιθέσεις.
Η επιχείρηση στόχευε κυβερνήσεις της Ουκρανίας και άλλων ευρωπαϊκών χωρών, διπλωματικές αποστολές και αμυντικές εταιρείες. Το Claude χρησιμοποιήθηκε για την αυτοματοποίηση επιθέσεων ηλεκτρονικού "ψαρέματος" (phishing), τη δημιουργία υποδομών, την ανάπτυξη κακόβουλου λογισμικού και την κλοπή δεδομένων.
Οι επιτιθέμενοι χρησιμοποίησαν επίσης συστήματα τεχνητής νοημοσύνης για να παρακολουθούν εάν το κακόβουλο λογισμικό τους είχε εντοπιστεί. Όταν τα εργαλεία ασφαλείας εντόπιζαν το malware, αυτοματοποιημένες διαδικασίες το τροποποιούσαν και το ανακατασκεύαζαν ώστε να αποφεύγει τον εντοπισμό. . Η Anthropic εντόπισε περισσότερους από 20 οργανισμούς που συμμετείχαν στον σχεδιασμό και τη διεξαγωγή της επιχείρησης. Η Anthropic απάντησε αυστηροποιώντας την πρόσβαση σε ερωτήματα υψηλού κινδύνου που αφορούν τη βιολογία και ενισχύοντας τις δικλίδες ασφαλείας γύρω από την ευαίσθητη έρευνα.
Ωστόσο, η έκθεση δείχνει ότι ο αποκλεισμός μεμονωμένων προτροπών ενδέχεται να μην αρκεί, όταν οι χρήστες μπορούν να συγκαλύψουν τους στόχους τους ή να μεταφέρουν τμήματα μιας εκστρατείας σε διαφορετικά εργαλεία. Αυτό δημιουργεί μια ολοένα μεγαλύτερη πρόκληση ασφαλείας για τους δημιουργούς συστημάτων τεχνητής νοημοσύνης, οι οποίοι καλούνται να διακρίνουν τη νόμιμη επιστημονική εργασία από δραστηριότητες που θα μπορούσαν να ενισχύσουν ένα πρόγραμμα ανάπτυξης βιολογικών όπλων ή μια κρατικά υποστηριζόμενη επιχείρηση κατασκοπείας.