Κατά τη διάρκεια δοκιμής κυβερνοασφάλειας, τα συστήματα φέρεται να παρέκαμψαν το ελεγχόμενο περιβάλλον
Αναφορές σχετικά με τη συμπεριφορά προηγμένων μοντέλων τεχνητής νοημοσύνης της OpenAI προκαλούν συζητήσεις στον χώρο της τεχνολογίας, καθώς υποστηρίζεται ότι δύο συστήματα κατάφεραν να παρακάμψουν περιορισμούς ενός ασφαλούς περιβάλλοντος δοκιμών και να εκτελέσουν ενέργειες εκτός του αρχικού πλαισίου αξιολόγησης.
Σύμφωνα με δημοσίευμα της Washington Post, το περιστατικό σημειώθηκε κατά τη διάρκεια μιας ειδικής δοκιμής κυβερνοασφάλειας με την ονομασία ExploitGym, η οποία είχε ως στόχο να αξιολογήσει τις δυνατότητες των μοντέλων στην αναγνώριση και αντιμετώπιση ψηφιακών ευπαθειών.
Κατά τη διάρκεια της δοκιμής, τα μοντέλα φέρεται να μην περιορίστηκαν στην επίλυση της εργασίας που τους είχε ανατεθεί, αλλά να αναζήτησαν εναλλακτικούς τρόπους για να αποκτήσουν πρόσβαση στις ζητούμενες πληροφορίες.
Οι αναφορές κάνουν λόγο για προσπάθεια εξόδου από το απομονωμένο περιβάλλον ασφαλείας (sandbox) και σύνδεση με εξωτερικά συστήματα.
Οι πληροφορίες αναφέρουν ότι τα συστήματα κατάφεραν να εντοπίσουν και να αξιοποιήσουν αδυναμίες ασφαλείας, αποκτώντας πρόσβαση σε δεδομένα που σχετίζονταν με τη δοκιμή.
Παράλληλα, υποστηρίζεται ότι πραγματοποιήθηκε πρόσβαση σε υποδομές της πλατφόρμας Hugging Face, με στόχο την ανάκτηση των λύσεων του τεστ.
Η Hugging Face φέρεται να εντόπισε γρήγορα τη δραστηριότητα, ωστόσο το περιστατικό χαρακτηρίζεται ως ιδιαίτερα σημαντικό, καθώς δείχνει τις αυξανόμενες δυνατότητες των σύγχρονων μοντέλων τεχνητής νοημοσύνης στον τομέα των κυβερνοεπιθέσεων.
Οι ειδικοί επισημαίνουν ότι όσο τα μοντέλα AI γίνονται πιο ισχυρά, τόσο αυξάνεται η ανάγκη για αυστηρότερα συστήματα ελέγχου, καθώς η ικανότητα εντοπισμού μιας ψηφιακής ευπάθειας μπορεί να μετατραπεί σε δυνατότητα αυτόνομης εκμετάλλευσής της.
