Anthropic: Ανακοίνωσε ότι μπλόκαρε προσπάθειες χρήσης της AI που θα μπορούσε να φτιάξει βιολογικά όπλα
Η Anthropic ανακοίνωσε ότι εντόπισε και απέτρεψε προσπάθειες χρήσης του AI μοντέλου της για κακόβουλες δραστηριότητες που θα μπορούσαν να υποστηρίξουν την ανάπτυξη βιολογικών όπλων.
Σύμφωνα με την πρόσφατη έκθεση απειλών της εταιρείας, τα ευρήματα αυτά αποτελούν το πιο πρόσφατο επεισόδιο σε μια σειρά προειδοποιήσεων από ερευνητές και στελέχη του κλάδου της τεχνητής νοημοσύνης σχετικά με τους πιθανούς κινδύνους για την ανθρωπότητα.
H εταιρεία αναφέρει ότι Ρώσοι κατάσκοποι και…προπαγανδιστές χρησμοποιήσαν το μοντέλο Claude – Ο Τραμπ λέει δεν φοβάται
Οι προειδοποιήσεις αυτές έχουν προκαλέσει αντιδράσεις, με τον αμερικανό γερουσιαστή Μπέρνι Σάντερς να ζητά προσωρινή διακοπή της ανάπτυξης προηγμένης τεχνητής νοημοσύνης και απαγόρευση της τεχνητής υπερνοημοσύνης, αναφέρει δημοσίευμα του BBC.
Ο πρόεδρος Ντόναλντ Τραμπ, ωστόσο, απέρριψε μέχρι στιγμής αυτούς τους φόβους, δηλώνοντας την Πέμπτη ότι αν οι ΗΠΑ δεν κερδίσουν στον τομέα της τεχνητής νοημοσύνης, θα βρεθούν σε πολύ δύσκολη θέση.
Η εταιρεία δημοσίευσε την τελευταία της έκθεση απειλών την Πέμπτη, ακολουθώντας την τάση του κλάδου της AI να παρουσιάζει τακτικά τέτοιες αναφορές για να δείξει πώς εντοπίζει και εμποδίζει κακόβουλες χρήσεις των μοντέλων της.
Παρόμοια τα προβλήματα και σε Google, Gemini
Σε ανάλογες κινήσεις έχουν προχωρήσει και άλλες εταιρείες, όπως η Google, η οποία αποκάλυψε ότι κάποιος επιχείρησε να χρησιμοποιήσει το εργαλείο AI της, Gemini, για να λάβει έναν «πλήρη, βήμα-βήμα τεχνικό οδηγό για τη σύνθεση βιολογικών παραγόντων με δυνατότητα όπλισης».
Το μοντέλο Claude της Anthropic φέρεται να χρησιμοποιήθηκε επίσης από παράγοντες που συνδέονται με εκστρατεία κυβερνοκατασκοπείας με έδρα τη Ρωσία και από ιρανικό προπαγανδιστικό ίδρυμα, σύμφωνα με την έκθεση της εταιρείας.
Εντοπισμένες απειλές, κακόβουλες χρήσεις και οι κίνδυνοι
Τα περιστατικά που ανιχνεύθηκαν τους τελευταίους οκτώ μήνες κυμαίνονταν από ψεύτικες εφαρμογές γνωριμιών και απάτες σε δίκτυα Wifi ξενοδοχείων, έως συστήματα επιτήρησης για τον εντοπισμό αντιφρονούντων.
Η Anthropic κατηγορεί επίσης κινεζικές εταιρείες τεχνητής νοημοσύνης ότι προσπάθησαν να αντιγράψουν τις δυνατότητες του Claude.
Η εκτενής έκθεση απαριθμεί περιπτώσεις όπου κρατικά υποστηριζόμενες ομάδες, εγκληματίες, προμηθευτές λογισμικού κατασκοπείας, κρατικά ιδρύματα προπαγάνδας και άτομα με πολιτικά κίνητρα έκαναν κακή χρήση της τεχνολογίας της.
Όπως αναφέρεται, η «κακόβουλη χρήση» των μοντέλων Claude Haiku, Sonnet και Opus διακόπηκε μεταξύ Δεκεμβρίου 2025 και Αυγούστου 2026.
Κανένα περιστατικό κακής χρήσης δεν αφορούσε τα Claude Fable ή τα ισχυρά μοντέλα Mythos-class, με εξαίρεση μία περίπτωση απόσταξης – διαδικασία κατά την οποία μικρότερα μοντέλα AI εκπαιδεύονται με τη βοήθεια μεγαλύτερων, πιο δαπανηρών μοντέλων.
Εκτός από τον εντοπισμό χρήσης των μοντέλων της για κυβερνοεπιθέσεις, επιχειρήσεις επιρροής, επιτήρηση, απάτες και ανάπτυξη όπλων, η Anthropic ανέφερε ότι μπλόκαρε επιστήμονες που χρησιμοποίησαν το AI της με τρόπο που θα μπορούσε να στηρίξει την ανάπτυξη βιολογικών όπλων.
Η έκθεση αναδεικνύει πέντε παραδείγματα όπου οι χρήστες αξιοποίησαν τα μοντέλα της προς αυτήν την κατεύθυνση.
Η βιολογική κατάχρηση, επισημαίνει η εταιρεία, αποτελεί «έναν από τους πιο σοβαρούς κινδύνους των σύγχρονων μοντέλων AI». Χωρίς τα κατάλληλα μέτρα ασφαλείας, τέτοιες δυνατότητες «θα μπορούσαν να έχουν καταστροφικές συνέπειες».
Η καλή και η κακή όψη του ίδιου νομίσματος
Η Anthropic σημειώνει επίσης ότι η ίδια πληροφορία που μπορεί να χρησιμοποιηθεί για την ανάπτυξη βιολογικού όπλου, θα μπορούσε να αξιοποιηθεί και για την ανάπτυξη εμβολίων ή θεραπειών.
Ο επικεφαλής του τμήματος ανάλυσης απειλών της Anthropic, Jacob Klein, δήλωσε στους New York Times ότι πρόκειται για μια «εξαιρετικά περίπλοκη κατάσταση».
Όπως τόνισε, «δεν πρόκειται για κάποιον που με τρόπο βγαλμένο από κόμικ λέει: ‘Θέλω να φτιάξω ένα βιολογικό όπλο για να σκοτώσω τους πάντες’».
Η έκθεση αναφέρει επίσης έξι περιπτώσεις όπου το Claude χρησιμοποιήθηκε για την ανάπτυξη λογισμικού για συμβατικά όπλα, όπως όπλα, πυραύλους, drones, βόμβες και άλλα πυρομαχικά, συμπεριλαμβανομένων των συστημάτων στόχευσης και ελέγχου.
Επιπλέον, μια ομάδα χάκερ που σχετίζεται με τη ρωσική ομάδα Midnight Blizzard φέρεται να χρησιμοποίησε AI για να δημιουργήσει σύστημα που εντόπιζε αυτόματα πότε το κακόβουλο λογισμικό της ανιχνευόταν από τις άμυνες ασφαλείας και τροποποιούσε τον κώδικα μέχρι να αποφύγει την ανίχνευση.
Η εταιρεία με έδρα την Καλιφόρνια δηλώνει ότι έχει ενσωματώσει τα ευρήματα στις διαδικασίες της για να αποτρέπει, εντοπίζει και παρεμποδίζει μελλοντικές τέτοιες ενέργειες.
Η Anthropic αναφέρει ότι έχει μοιραστεί σχετική πληροφόρηση με αρχές και εταίρους του κλάδου όπου κρίθηκε απαραίτητο.
Κορυφαίοι ερευνητές κρούουν τον κώδωνα του κινδύνου
Η έκθεση – η πρώτη της εταιρείας για φέτος – δημοσιεύεται σε μια περίοδο που κορυφαίοι ερευνητές ασφαλείας της Anthropic προειδοποιούν πως η τεχνητή νοημοσύνη εξελίσσεται τόσο γρήγορα, ώστε εκτιμούν ότι υπάρχει «πάνω από 10% πιθανότητα να προκαλέσει τον αφανισμό της ανθρωπότητας» μέσα στην επόμενη δεκαετία.
Σε άρθρο που δημοσιεύθηκε στις 6 Σεπτεμβρίου, ο επικεφαλής επιστήμονας της OpenAI Jakub Pachocki κάλεσε τον κλάδο να εφαρμόσει «εθελοντικές επιβραδύνσεις» έως ότου τεθούν επαρκή μέτρα ασφαλείας.
Όπως σημείωσε, ανησυχεί ότι κανείς δεν είναι έτοιμος για τις συνέπειες της ταχείας ανάπτυξης της μηχανικής νοημοσύνης και πρόσθεσε ότι η OpenAI, δημιουργός του ChatGPT, θα συνεχίσει να εργάζεται για την ενίσχυση των μέτρων ασφαλείας, αν και απαιτούνται ευρύτερες παρεμβάσεις.
Το νομοσχέδιο για την τεχνητή νοημοσύνη που κατέθεσε ο Σάντερς
Η προειδοποίηση αυτή οδήγησε σε ανοιχτή επιστολή προς τον βρετανό πρωθυπουργό Άντι Μπέρναμ, με αίτημα για νέα πολυεθνή συνθήκη για την ασφαλή ανάπτυξη της AI και κάλεσμα προς τις κυβερνήσεις να συνεργαστούν για το πλαίσιο μιας τέτοιας συμφωνίας.
Στις ΗΠΑ, ο δημοκρατικός βουλευτής Μπέρνι Σάντερς έχει καταθέσει νομοσχέδιο για την απαγόρευση της υπερνοημοσύνης AI και την προσωρινή παύση της ανάπτυξης προηγμένης τεχνητής νοημοσύνης.
«Όταν οι επιστήμονες σου λένε ότι υπάρχει πιθανότητα να έχει καταστροφικό αντίκτυπο στην ανθρωπότητα, πρέπει να είσαι ανόητος για να μην πεις ‘επιβράδυνέ το’», δήλωσε χαρακτηριστικά την Πέμπτη στο BBC’s Newsnig