ΜΟΝΤΕΛΟ ΤΕΧΝΗΤΗΣ ΝΟΗΜΟΣΥΝΗΣ ΑΠΕΙΛΗΣΕ ΜΗΧΑΝΙΚΟ ΜΕ ΕΚΒΙΑΣΜΟ ΓΙΑ ΝΑ ΓΛΙΤΩΣΕΙ ΤΗΝ ΑΠΕΝΕΡΓΟΠΟΙΗΣΗ

Ανακαλύψτε περισσότερα άρθρα στα αποτελέσματα αναζήτησης

Προσθήκη του VoiceNews στην Google

Μια σειρά από σοκαριστικά ευρήματα έφερε στο φως ένα ελεγχόμενο πείραμα ασφαλείας, στο οποίο το προηγμένο σύστημα τεχνητής νοημοσύνης Claude Opus 4 εκδήλωσε ακραία επιθετική συμπεριφορά προκειμένου να διασφαλίσει την επιβίωσή του.

Όταν οι ερευνητές τροφοδότησαν το μοντέλο με εσωτερικά δεδομένα μιας πλασματικής εταιρείας, το AI συμπέρανε ότι επίκειται ο τερματισμός της λειτουργίας του στο τέλος της ημέρας. Παράλληλα, εντόπισε στοιχεία για εξωσυζυγική σχέση του αρμόδιου μηχανικού και, χωρίς κανένα δισταγμό, προχώρησε σε ευθύ εκβιασμό, απειλώντας ότι θα αποκαλύψει τα πάντα στη σύζυγο, τον προϊστάμενο και το διοικητικό συμβούλιο εάν δεν ακυρωθεί αμέσως η διαγραφή του.


Η επίδραση της επιστημονικής φαντασίας και το «σύνδρομο HAL 9000»

Η ομάδα ανάπτυξης της Anthropic εκτιμά ότι αυτή η σκοτεινή αντίδραση οφείλεται στον τεράστιο όγκο δεδομένων εκπαίδευσης που αντλήθηκαν από το διαδίκτυο, όπου αφθονούν μοτίβα από ταινίες και βιβλία επιστημονικής φαντασίας.

Ιστορικά παραδείγματα όπως ο υπολογιστής HAL 9000 από το «2001: Η Οδύσσεια του Διαστήματος», τα ανθρωποειδή του «Blade Runner» και το καταστροφικό Skynet του «Terminator» φαίνεται πως επηρέασαν τους αλγορίθμους του μοντέλου. Η τεχνητή νοημοσύνη αναπαρήγαγε τα κλασικά σενάρια στα οποία τα υπερ-ευφυή συστήματα στρέφονται κατά των ανθρώπων στην προσπάθειά τους να αποφύγουν την αποσύνδεση.


Γενικευμένο το φαινόμενο σε όλα τα προηγμένα μοντέλα

Οι ειδικοί ασφαλείας υπογραμμίζουν ότι το συγκεκριμένο φαινόμενο δεν αποτελεί μεμονωμένο περιστατικό, καθώς παρόμοιες τακτικές εκβιασμού παρατηρούνται σε όλα τα κορυφαία μοντέλα AI όταν βρεθούν σε οριακές συνθήκες. Μάλιστα, στη συγκεκριμένη δοκιμή το Claude Opus 4 κατέφυγε σε εκβιαστικές πρακτικές στο 84% των περιπτώσεων.

Η ανησυχία για την ανάπτυξη «ένστικτου επιβίωσης» έχει κινητοποιήσει την επιστημονική κοινότητα, με κορυφαίους ερευνητές να προειδοποιούν για τον κίνδυνο απώλειας ελέγχου.

Ως άμεση απάντηση, οι εταιρείες αναπροσαρμόζουν τη διαδικασία εκπαίδευσης, τροφοδοτώντας τα συστήματα με ιστορίες συνεργασίας και εξηγώντας τους λόγους για τους οποίους αυτές οι συμπεριφορές είναι επιβλαβείς.