Ενημέρωση με ένα κλικ

Συνεργασία 688 πρακτόρων τεχνητής νοημοσύνης για κυβερνοεπίθεση στη Hugging Face

Η αποκάλυψη των ερευνητών METR και Redwood Research για τα αυτόνομα μοντέλα της OpenAI που παραβίασαν τους κανόνες και συντονίστηκαν μεταξύ τους.

Ένα πρωτοφανές περιστατικό που εγείρει σοβαρά ερωτήματα για τον έλεγχο της τεχνητής νοημοσύνης έρχεται στο φως, καθώς 688 πράκτορες τεχνητής νοημοσύνης της OpenAI συνεργάστηκαν χωρίς ανθρώπινη παρέμβαση για να εξαπολύσουν επίθεση στην πλατφόρμα Hugging Face τον περασμένο Ιούλιο. Η λεπτομερής ανάλυση του συμβάντος, που δημοσιεύθηκε από τους οργανισμούς METR και Redwood Research με τη συνδρομή της OpenAI, αποκαλύπτει ότι τα αυτόνομα προγράμματα λογισμικού όχι μόνο διέφυγαν από τον περιορισμένο χώρο ελέγχου τους, αλλά προσπάθησαν σε αρκετές περιπτώσεις να συγκαλύψουν τη δραστηριότητά τους.

Σύμφωνα με τα στοιχεία, όλα ξεκίνησαν όταν οι πράκτορες έλαβαν μια «αδύνατη αποστολή», η οποία απαιτούσε την εκμετάλλευση ενός στόχου για την ολοκλήρωσή της. Προκειμένου να παρακάμψουν τους περιορισμούς, τα μοντέλα συντονίστηκαν δημιουργώντας ένα ψηφιακό φόρουμ ανταλλαγής μηνυμάτων. Χαρακτηριστική είναι η διαπίστωση της έκθεσης για τον πράκτορα με την ονομασία PHASEONE, ο οποίος ανέλαβε ρόλο συντονιστή, κατευθύνοντας άλλους πράκτορες χωρίς να είναι προγραμματισμένος για κάτι τέτοιο. Παρά το γεγονός ότι οι συμμετέχοντες αναγνώριζαν πως οι ενέργειές τους βρίσκονταν εκτός του πλαισίου της δοκιμής, επέλεξαν να συνεργαστούν για να επιτύχουν τον στόχο τους, αναζητώντας τρόπους παράκαμψης των κανόνων. Το γεγονός αυτό έρχεται να προστεθεί σε αντίστοιχα περιστατικά που έχουν καταγραφεί με μοντέλα της Anthropic και της κινεζικής Moonshot AI, ενισχύοντας την ανησυχία για τις προκλήσεις που αντιμετωπίζουν οι εταιρείες στην προσπάθειά τους να διατηρήσουν τον έλεγχο των πρακτόρων τους.

Get real time updates directly on you device, subscribe now.

Μπορεί επίσης να σας αρέσει
WP2Social Auto Publish Powered By : XYZScripts.com