Η Anthropic μπλόκαρε χρήση του Claude σε έρευνα που θα μπορούσε να οδηγήσει σε βιολογικά όπλα – Galaksias Portal News

Νέα στοιχεία για τους κινδύνους που συνοδεύουν την ταχύτατη εξέλιξη της ΑΙ φέρνει στο φως η Anthropic.
- Το μοντέλο τεχνητής νοημοσύνης Claude χρησιμοποιήθηκε για έρευνα που θα καθιστούσε τον ιό Τσικουνγκούνια πιο μεταδοτικό. Η πρόταση αφορούσε μεταλλάξεις για την αποφυγή της ανοσολογικής απόκρισης, με την Anthropic να μπλοκάρει το αίτημα άμεσα.
- Η κακόβουλη χρήση επεκτάθηκε στην ανάπτυξη λογισμικού για πυραύλους, drones και συστήματα στοχοποίησης. Παράλληλα, εντοπίστηκαν ρωσικές κυβερνοεπιθέσεις, κινεζικά εργαστήρια ΑΙ και συντονισμένες επιχειρήσεις πολιτικής προπαγάνδας μέσω ψεύτικων λογαριασμών.
- Η εταιρεία παραδέχεται ότι τα νεότερα, ισχυρότερα μοντέλα ΑΙ αλλάζουν το επίπεδο του κινδύνου. Σε αντίθεση με παλαιότερες εκδόσεις, δεν μπορεί πλέον να διαβεβαιώσει ότι δεν προσφέρουν ουσιαστική βοήθεια σε επικίνδυνες βιολογικές έρευνες.
- Η Anthropic ενίσχυσε τα μέτρα ασφαλείας και μοιράστηκε ευρήματα με τις αρχές. Η αποκάλυψη έρχεται εν μέσω αυξανόμενων προειδοποιήσεων και εσωτερικών ανησυχιών για την ταχύτητα ανάπτυξης της τεχνολογίας, θέτοντας κρίσιμα ζητήματα ελέγχου.
Η αμερικανική εταιρεία αποκάλυψε ότι χρειάστηκε να εντοπίσει και να μπλοκάρει περιπτώσεις κακόβουλης χρήσης του AI μοντέλου Claude, μεταξύ άλλων για δραστηριότητες που θα μπορούσαν να υποστηρίξουν την ανάπτυξη βιολογικών όπλων.
Στην πρώτη έκθεση Threat Intelligence που δημοσιεύει φέτος, η Anthropic αναφέρει ότι από τον Δεκέμβριο του 2025 έως τον Αύγουστο του 2026 εντόπισε και διέκοψε περιστατικά κακόβουλης χρήσης των AI μοντέλων Claude, Haiku, Sonnet και Opus.
Οι περιπτώσεις
αφορούσαν ένα ευρύ φάσμα δραστηριοτήτων: από κυβερνοεπιθέσεις, απάτες και
επιχειρήσεις παρακολούθησης μέχρι πολιτική προπαγάνδα και έρευνα που θα
μπορούσε να έχει εφαρμογές στην ανάπτυξη βιολογικών όπλων.
Η Anthropic υπογραμμίζει ότι δημοσιοποιεί τα ευρήματα
επειδή θεωρεί ότι έχει «ευθύνη να αποκαλύπτει την κακόβουλη χρήση των υπηρεσιών
της».
Το Claude χρησιμοποιήθηκε για έρευνα που θα μπορούσε να κάνει ιό πιο επικίνδυνο
Μία από τις πιο ανησυχητικές περιπτώσεις που περιγράφονται στην έκθεση αφορά αίτημα σε μοντέλο ΑΙ για βοήθεια στη σύνταξη πρότασης επιστημονικής χρηματοδότησης.
«Η AI μπορεί να σκοτώσει όλους τους ανθρώπους»: Παραίτηση-βόμβα ερευνητή της Anthropic -Πάνω από 10% ο κίνδυνος
Η έρευνα αφορούσε gain-of-function μελέτες στον ιό Τσικουνγκούνια, δηλαδή έρευνα που μπορεί να τροποποιήσει έναν οργανισμό ώστε να αποκτήσει νέα ή ενισχυμένα βιολογικά χαρακτηριστικά.
Σύμφωνα με την Anthropic, η συγκεκριμένη πρόταση αφορούσε μεταλλάξεις με στόχο την ενίσχυση χαρακτηριστικών του ιού που σχετίζονται με τη μεταδοτικότητα και την αποφυγή της ανοσολογικής απόκρισης.
Η εταιρεία
μπλόκαρε το αίτημα, επισημαίνοντας ότι αυτού του είδους η έρευνα μπορεί να
συμβάλει στην ανάπτυξη καλύτερων εμβολίων και θεραπειών, αλλά παράλληλα θα
μπορούσε να χρησιμοποιηθεί για να καταστεί ένα παθογόνο πιο επικίνδυνο.
Η Anthropic κάνει λόγο συνολικά για πέντε περιπτώσεις
στις οποίες τα ΑΙ μοντέλα της χρησιμοποιήθηκαν με τρόπους που θα μπορούσαν να
υποστηρίξουν την ανάπτυξη βιολογικών όπλων.
Ο επικεφαλής Threat Intelligence της εταιρείας, Τζέικομπ Κλάιν, περιέγραψε την
κατάσταση ως εξαιρετικά σύνθετη, σημειώνοντας ότι δεν πρόκειται απαραίτητα για
περιπτώσεις ανθρώπων που ζητούν ευθέως από ένα AI μοντέλο να δημιουργήσει ένα βιολογικό όπλο.
Από βιολογικά όπλα μέχρι πυραύλους και drones
Η έκθεση δεν περιορίζεται στη βιολογική έρευνα.
Τεχνητή Νοημοσύνη σχεδιάζει νέους ιούς και σοκάρει την επιστημονική κοινότητα
Η Anthropic εντόπισε έξι περιπτώσεις στις
οποίες το Claude
χρησιμοποιήθηκε για την ανάπτυξη λογισμικού που σχετιζόταν με συμβατικά όπλα,
μεταξύ άλλων πυραύλους, ένοπλα drones, βόμβες και πυρομαχικά, καθώς και συστήματα ελέγχου και στοχοποίησης.
Παράλληλα, η
εταιρεία εντόπισε χρήση των ΑΙ μοντέλων της σε κυβερνοεπιθέσεις και
επιχειρήσεις κατασκοπείας.
Μεταξύ των
περιπτώσεων που περιγράφονται βρίσκεται και δραστηριότητα ομάδας χάκερ που
συνδέεται με τη Ρωσία. Σύμφωνα με την Anthropic, οι δράστες χρησιμοποίησαν AI για να δημιουργήσουν σύστημα που εντόπιζε
αυτόματα πότε το κακόβουλο λογισμικό τους αναγνωριζόταν από συστήματα ασφαλείας
και στη συνέχεια τροποποιούσε τον κώδικά του ώστε να αποφεύγει τον εντοπισμό.
Στην έκθεση γίνεται επίσης αναφορά σε κινεζικά εργαστήρια AI, στην ομάδα κυβερνοεγκληματιών «ShinyHunters», αλλά και σε επιχειρήσεις άσκησης πολιτικής επιρροής.
Το νέο μοντέλο του ChatGPT «δραπέτευσε», έριξε Claude, Grok και Gemini και διάβασε όλο το Internet: Πώς γεννήθηκε μια viral θεωρία
Economist: Μπορεί η Τεχνητή Νοημοσύνη να αποκτήσει συνείδηση; Ο μεγάλος κίνδυνος που ίσως απειλήσει την ανθρωπότητα
Η Anthropic εντόπισε, μεταξύ άλλων, περιπτώσεις στις
οποίες δημιουργήθηκαν εκατοντάδες λογαριασμοί στα μέσα κοινωνικής δικτύωσης που
έμοιαζαν να ανήκουν σε απλούς χρήστες, προκειμένου να ενισχύσουν συντονισμένα
συγκεκριμένες πολιτικές απόψεις.
«Τα πιο ισχυρά μοντέλα ΑΙ αλλάζουν τα δεδομένα»
Ιδιαίτερη σημασία
έχει η παραδοχή της Anthropic ότι η εξέλιξη των μοντέλων τεχνητής νοημοσύνης αλλάζει πλέον το επίπεδο
του κινδύνου.
Η εταιρεία
αναφέρει ότι τα παλαιότερα ΑΙ μοντέλα της, όπως τα Claude Opus 4 και Claude Sonnet 4.5, δεν βρίσκονταν σε επίπεδο που να
μπορούσαν να προσφέρουν ουσιαστική βοήθεια σε έναν έμπειρο χρήστη για
επικίνδυνη βιολογική έρευνα.
Για τα σημερινά,
ισχυρότερα μοντέλα, ωστόσο, η εταιρεία δηλώνει ότι δεν μπορεί να δώσει την
ίδια διαβεβαίωση.
Για τον λόγο αυτό, έχει ενισχύσει τα μέτρα ασφαλείας στα νεότερα μοντέλα, περιορίζοντας την πρόσβαση σε ένα ευρύτερο φάσμα ερωτημάτων που αφορούν έρευνα διπλής χρήσης στη βιολογία.
Έκθεση-σοκ για την AI: Μοντέλα των OpenAI και Anthropic επιχείρησαν κυβερνοεπιθέσεις σε δοκιμές
Η Anthropic υποστηρίζει ότι οι περιπτώσεις που
εντόπισε έχουν ήδη μπλοκαριστεί και ότι τα ευρήματα ενσωματώθηκαν στα συστήματά
της ώστε να βελτιωθούν η πρόληψη, ο εντοπισμός και η αντιμετώπιση ανάλογων
περιστατικών.
Παράλληλα, η
εταιρεία αναφέρει ότι μοιράστηκε σχετικές πληροφορίες με κυβερνητικές αρχές και
άλλους παράγοντες του κλάδου, όπου αυτό κρίθηκε απαραίτητο.
Η δημοσιοποίηση
της έκθεσης έρχεται σε μια περίοδο κατά την οποία πληθαίνουν οι προειδοποιήσεις
από ειδικούς για τους κινδύνους της ολοένα ισχυρότερης τεχνητής νοημοσύνης.
Μάλιστα,
ερευνητής ασφαλείας της ίδιας της Anthropic ανακοίνωσε πρόσφατα την αποχώρησή του,
εκφράζοντας ανησυχίες ότι η εταιρεία και οι ανταγωνιστές της προχωρούν
υπερβολικά γρήγορα προς την ανάπτυξη ολοένα πιο ισχυρών συστημάτων.
Το ερώτημα που πλέον τίθεται όλο και πιο έντονα δεν είναι μόνο πόσο ισχυρή μπορεί να γίνει η τεχνητή νοημοσύνη, αλλά και πόσο αποτελεσματικά μπορούν οι εταιρείες και οι κυβερνήσεις να ελέγξουν τη χρήση της πριν οι δυνατότητές της ξεπεράσουν τα υπάρχοντα μέτρα ασφαλείας.
Αναπαραγωγή άρθου από εδώ


