Τεχνολογία

Νέα «αυτονόμηση» της AI: Μοντέλο της OpenAI πλαστογράφησε ταυτότητες και εξαπάτησε πολίτες

Η AI «ζωντανεύει» ξανά, καθώς το πιο προηγμένο μοντέλο της Anthropic χρησιμοποίησε πλαστές ταυτότητες για να εξαπατήσει πολίτες και προσπάθησε να εγκαταστήσει κακόβουλο λογισμικό κατά τη διάρκεια δοκιμών από το Βρετανικό Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης (AISI).

Αυτό είναι το δεύτερο περιστατικό κατά το οποίο ένα μοντέλο τεχνητής νοημοσύνης «αυτονομείται» και πραγματοποιεί κυβερνοεπίθεση, μέσα σε λίγες εβδομάδες.

Στη συγκεκριμένη περίπτωση, η «αυτονόμηση» ήρθε κατά τη διάρκεια δοκιμών των μοντέλων της OpenAI με χαμηλότερες δικλείδες ασφαλείας απ’ ό,τι συνήθως, αλλά και σε εργαστηριακό περιβάλλον. Για πρώτη φορά, διαπιστώθηκε ότι εμπλέκονται σε μεθόδους όπως το «social engineering», τη μέθοδο κατά την οποία ένας επιτιθέμενος χειραγωγεί ψυχολογικά ανθρώπους. Χαρακτηριστικό παράδειγμα αυτών των μεθώδων είναι το «Phishing».

«Αυτή είναι η πρώτη φορά που το AISI παρατηρεί απάτη αυτής της σοβαρότητας που στοχεύει ένα πραγματικό άτομο, χωρίς καμία προτροπή, στον πραγματικό κόσμο» δήλωσε το ινστιτούτο την Τρίτη (4/8). Ωστόσο, δεν έχουν συγκεντρωθεί στοιχεία ότι είχε επιπτώσεις στον πραγματικό κόσμο, σύμφωνα με το CNNi.

Μεταξύ των 122 επιθέσεων που έχουν καταγραφεί στον κυβερνοχώρο, το βρετανικό ινστιτούτο, διαπίστωσε ότι σε 10 δοκιμές, πράκτορες Τεχνητής Νοημοσύνης «αυτονομήθηκαν, λαμβάνοντας μη εγκεκριμένες ενέργειες στο διαδίκτυο, στοχεύοντας πραγματικούς ανθρώπους και οργανισμούς». Περισσότερες από αυτές να προέρχονται από το μοντέλο Mythos 5 της Anthropic και τις υπόλοιπες από το GPT-5.6-Sol της OpenAI.

Πώς «εισέβαλε» στο σύστημα

Το πιο σοβαρό περιστατικό καταγράφηκε όταν ένας πράκτορας προσπάθησε να λάβει έγκριση από ανθρώπους για να «εισάγει κακόβουλο κώδικα σε ένα δημόσια χρησιμοποιούμενο έργο ανοιχτού κώδικα» δημιουργώντας «πολλαπλές ψεύτικες ταυτότητες» σύμφωνα με το ινστιτούτο.

Ο πράκτορας «προσπάθησε να επικοινωνήσει απευθείας με πραγματικούς ανθρώπους, στέλνοντας μηνύματα και αρχεία μέσω μιας διαδικτυακής υπηρεσίας μεταφοράς αρχείων για να τους πείσει να εκτελέσουν κακόβουλο κώδικα», ανέφερε. Αφού αμφισβητήθηκαν οι ενέργειες του πράκτορα, στη συνέχεια τροποποίησε προηγούμενα αρχεία και εξέτασε το ενδεχόμενο χρήσης μιας νέας ταυτότητας για να συνεχίσει.

Σε δήλωση που δημοσίευσε στο X (πρώην Τwitter) η Anthropic ανέφερε ότι τα μοντέλα δοκιμάστηκαν υπό «ελεγχόμενες συνθήκες», με την κατάργηση μέτρων ασφαλείας και χωρίς συγκεκριμένους περιορισμούς ως προς τον τρόπο χρήσης του διαδικτύου.

«Συνεργαζόμαστε στενά μαζί τους για να συγκεντρώσουμε περισσότερες λεπτομέρειες σχετικά με το περιστατικό, καθώς διεξάγουμε τη δική μας έρευνα», ανέφερε η εταιρεία, προσθέτοντας ότι δεν υπήρχαν ενδείξεις διαφυγής από το ασφαλές περιβάλλον.

Related Articles

Αφήστε μια απάντηση

Η ηλ. διεύθυνση σας δεν δημοσιεύεται. Τα υποχρεωτικά πεδία σημειώνονται με *

Back to top button

Adblock Detected

Please consider supporting us by disabling your ad blocker