- Οι διαπραγματεύσεις μεταξύ της κυβέρνησης Τραμπ και της Anthropic έχουν σταματήσει λόγω ανεπίλυτων ανησυχιών σχετικά με τα τρωτά σημεία "jailbreaking" στο μοντέλο Claude Fable 5.
- Η NSA επιβεβαίωσε ότι τα εμπόδια ασφαλείας μπορούσαν να παρακαμφθούν για την πρόσβαση σε ευαίσθητα δεδομένα κυβερνοασφάλειας και βιοχημικά δεδομένα, οδηγώντας σε αυστηρούς ελέγχους εξαγωγών.
- Οι ειδικοί του κλάδου προειδοποιούν ότι η απαίτηση της κυβέρνησης για ένα σύστημα 100% ανθεκτικό σε jailbreak ενδέχεται να είναι τεχνικά αδύνατη λόγω της φύσης των μεγάλων γλωσσικών μοντέλων.
- Αυτή η αντιπαράθεση σηματοδοτεί μια σημαντική μετατόπιση στην πολιτική των ΗΠΑ, η οποία αντιμετωπίζει την προηγμένη Τεχνητή Νοημοσύνη ως στρατηγική εθνική υποδομή και όχι απλώς ως εμπορικό λογισμικό.

Το πρόσφατο αδιέξοδο μεταξύ της κυβέρνησης Τραμπ και της Anthropic έχει προκαλέσει αναταραχή στον κόσμο της τεχνολογίας, καθώς οι διαπραγματεύσεις για την κυκλοφορία του μοντέλου Claude Fable 5 έφτασαν σε αδιέξοδο αυτή την εβδομάδα. Παρά τις ημέρες συνομιλιών υψηλού επιπέδου στις οποίες συμμετείχαν κορυφαία στελέχη και κυβερνητικοί αξιωματούχοι, οι αυστηροί έλεγχοι εξαγωγών που επιβάλλονται στην πιο προηγμένη τεχνητή νοημοσύνη της Anthropic παραμένουν σε ισχύ. Η τρέχουσα κατάσταση υποδηλώνει ότι η Ουάσινγκτον δεν είναι πλέον πρόθυμη να μείνει σε δεύτερη μοίρα, ενώ τα εργαστήρια τρέχουν προς ολοένα και πιο ισχυρά συστήματα χωρίς αλεξίσφαιρες εγγυήσεις ασφάλειας.
Στην καρδιά του ζητήματος βρίσκεται μια τεχνική γνωστή ως jailbreaking, όπου οι χρήστες χειραγωγούν τις υποδείξεις της Τεχνητής Νοημοσύνης για να παρακάμψουν τα πρωτόκολλα ασφαλείας. Ενώ η Anthropic έχει υποστηρίξει επανειλημμένα ότι οι κίνδυνοι διογκώνονται δυσανάλογα, οι ανησυχίες της κυβέρνησης επικυρώθηκαν από μια εις βάθος ανάλυση που διεξήγαγε η Εθνική Υπηρεσία Ασφαλείας (NSA). Το δράμα ουσιαστικά έχει χαράξει μια γραμμή στην άμμο, δείχνοντας ότι ο Λευκός Οίκος θεωρεί πλέον τα μοντέλα τεχνητής νοημοσύνης αιχμής ως στρατηγικά εθνικά περιουσιακά στοιχεία που απαιτούν το ίδιο επίπεδο ελέγχου με τα προηγμένα όπλα ή την πυρηνική τεχνολογία.
Η παρέμβαση της NSA και το lockdown του Claude Fable 5
Η ένταση κορυφώθηκε την περασμένη εβδομάδα όταν το Υπουργείο Εμπορίου εξέδωσε οδηγία που ουσιαστικά διέκοψε τη διεθνή πρόσβαση στο Fable 5. Αυτή η κίνηση δεν ήταν απλώς ένα τυχαίο γραφειοκρατικό εμπόδιο. Προκλήθηκε αφότου ο Διευθύνων Σύμβουλος της Amazon, Andy Jassy, φέρεται να έκρουσε τον κώδωνα του κινδύνου στον Υπουργό Οικονομικών Scott Bessent σχετικά με πιθανά τρωτά σημεία στο σύστημα. Όταν η NSA παρενέβη για να επαληθεύσει αυτούς τους ισχυρισμούς, κατέληξε στο συμπέρασμα ότι οι διασφαλίσεις που αποσκοπούσαν στην προστασία των δυνατοτήτων κυβερνοασφάλειας και βιοχημικών δυνατοτήτων του μοντέλου Claude Mythos θα μπορούσαν πράγματι να παρακαμφθούν.
Επειδή αυτά τα μοντέλα είναι τόσο βαθιά αλληλένδετα, μια παραβίαση στο Fable 5, που απευθύνεται στον καταναλωτή, θα μπορούσε ενδεχομένως να δώσει τα κλειδιά του βασιλείου σε κακούς παίκτες που επιδιώκουν να εκμεταλλευτούν την υποκείμενη δύναμη του Mythos. Η Anthropic προσπάθησε να μετριάσει την κατάσταση απενεργοποιώντας τα μοντέλα παγκοσμίως, ισχυριζόμενη ότι ήταν λειτουργικά αδύνατο να περιοριστεί η πρόσβαση αποκλειστικά σε ξένες οντότητες. Αυτό το πλήρες κλείσιμο έχει αφήσει πολλούς χρήστες σε δύσκολη θέση, αλλά υπογραμμίζει πώς η εθνική ασφάλεια έχει πλέον προτεραιότητα έναντι της εμπορικής διαθεσιμότητας στα μάτια της κυβέρνησης των ΗΠΑ.
Ένα τεχνικό πεδίο μάχης: Είναι εφικτό το μηδενικό ρίσκο;
Ενώ η κυβέρνηση θέλει μια πλήρη λύση, πολλοί στην επιστημονική κοινότητα πιστεύουν ότι η Ουάσινγκτον ζητά το αδύνατο. Σε αντίθεση με το παραδοσιακό λογισμικό όπου μπορείς απλώς να καλύψεις ένα κενό στον κώδικα, τα jailbreaks τεχνητής νοημοσύνης είναι ένας κάπως κινούμενος στόχος επειδή βασίζονται στις αποχρώσεις της ανθρώπινης γλώσσας και όχι σε ένα συγκεκριμένο τεχνικό σφάλμα. Οι ειδικοί έχουν επισημάνει ότι εφόσον αυτά τα μοντέλα έχουν σχεδιαστεί για να είναι ευέλικτα και δημιουργικά, πιθανότατα θα υπάρχει πάντα ένας έξυπνος τρόπος να τους πείσεις να κάνουν κάτι που δεν πρέπει.
Η Anthropic προωθεί μια στρατηγική «άμυνας σε βάθος», η οποία επικεντρώνεται στην παρακολούθηση και την ταχεία αντίδραση αντί να υπόσχεται μια τέλεια ασπίδα. Ωστόσο, η κυβέρνηση Τραμπ φαίνεται να επιμένει σε ένα υψηλότερο επίπεδο επαληθεύσιμης ασφάλειας πριν αφήσει το μοντέλο να επιστρέψει στην άγρια φύση. Αυτή η σύγκρουση φιλοσοφιών δημιουργεί πολλές τριβές, καθώς οι εταιρείες τεχνολογίας αισθάνονται ότι υπόκεινται σε ένα πρότυπο τελειότητας που απλά δεν υπάρχει στον πραγματικό κόσμο της μηχανικής.
Οι αλληλοεπιδράσεις αυτής της απόφασης γίνονται ήδη αισθητές σε ολόκληρο τον κλάδο, σηματοδοτώντας μια νέα εποχή «σκιώδους ρύθμισης» όπου οι έλεγχοι εξαγωγών χρησιμοποιούνται ως κύριο εργαλείο εποπτείας. Κάνοντας το Anthropic τη δοκιμαστική περίπτωση για αυτούς τους νέους κανόνες , ο Λευκός Οίκος στέλνει ένα σαφές μήνυμα σε άλλους γίγαντες όπως το OpenAI και η Google. Εάν θέλετε να αναπτύξετε την επόμενη γενιά μοντέλων frontier, θα πρέπει να αποδείξετε στους ομοσπονδιακούς ότι τα εσωτερικά σας εμπόδια είναι κάτι περισσότερο από μια απλή ευγενική πρόταση προς τον χρήστη.
Στο μέλλον, η εστίαση πιθανότατα θα μετατοπιστεί στη δημιουργία ενός τυποποιημένου πλαισίου για τη μέτρηση αυτών των κινδύνων, ώστε οι αποφάσεις να μην λαμβάνονται ακαριαία κατά τη διάρκεια έκτακτων συσκέψεων. Προς το παρόν, οι έλεγχοι εξαγωγών στο Claude Fable 5 αποτελούν υπενθύμιση ότι η εποχή της Άγριας Δύσης στην ανάπτυξη της Τεχνητής Νοημοσύνης φτάνει στο τέλος της. Ο κλάδος εισέρχεται σε μια πιο στρατηγική, και ίσως πιο περιορισμένη, φάση όπου η ασφάλεια και η καινοτομία πρέπει επιτέλους να βρουν έναν τρόπο να συνυπάρχουν υπό το άγρυπνο βλέμμα των εθνικών ρυθμιστικών αρχών.