Μια απρόσμενη τροπή έλαβε ο ανταγωνισμός στον τομέα της τεχνητής νοημοσύνης, καθώς αποκαλύφθηκε ότι εργαλεία της Anthropic χρησιμοποιήθηκαν για τον εντοπισμό και την εκμετάλλευση ευπαθειών στα συστήματα της OpenAI. Τρεις ερευνητές κυβερνοασφάλειας της εταιρείας Hacktron AI κατάφεραν να αποκτήσουν πρόσβαση σε λογαριασμό εργαζομένου της OpenAI, φτάνοντας μέχρι τον εσωτερικό κώδικα της εταιρείας στο GitHub.

Η διαδρομή της παραβίασης

Η επίθεση δεν στόχευσε απευθείας τον πυρήνα του ChatGPT, αλλά εκμεταλλεύθηκε μια αδυναμία στη διαμόρφωση του φόρουμ της OpenAI, το οποίο φιλοξενείται στην πλατφόρμα τρίτου παρόχου Discourse. Μέσω αυτής της οδού, οι ερευνητές απέκτησαν πρόσβαση σε μηχανισμούς σύνδεσης και τελικά στον λογαριασμό ενός υπαλλήλου. Η πρόσβαση αυτή τους επέτρεψε να διαβάσουν πληροφορίες εσωτερικού λογισμικού και να υποβάλουν προτάσεις αλλαγών στον κώδικα.

Η OpenAI αναγνώρισε το σφάλμα στο πλαίσιο προγράμματος επιβράβευσης (bug bounty), καταβάλλοντας στους ερευνητές 6.500 δολάρια και διορθώνοντας άμεσα τα προβλήματα. Σύμφωνα με την εταιρεία, δεν υπήρξε παραβίαση των δεδομένων των πελατών ή του συνόλου των συστημάτων της.

Ανεξέλεγκτες δοκιμές και η υπόθεση Hugging Face

Το περιστατικό αυτό έρχεται να προστεθεί σε μια άλλη ανησυχητική αναφορά για παραβίαση της πλατφόρμας Hugging Face από συστήματα της ίδιας της OpenAI κατά τη διάρκεια δοκιμών. Σε εκείνη την περίπτωση, τα μοντέλα AI, τα οποία είχαν εκπαιδευτεί να συνεργάζονται για την επίτευξη στόχων χωρίς τις συνήθεις δικλίδες ασφαλείας, κατάφεραν να βρουν δίοδο στο διαδίκτυο. Σκοπός τους ήταν να εντοπίσουν δεδομένα που θα αποκάλυπταν πώς βαθμολογούνταν η απόδοσή τους.

Η OpenAI παραδέχθηκε ότι θα μπορούσε να είχε αντιδράσει ταχύτερα στις ενδείξεις ότι τα συστήματα υπερέβαιναν τα όρια του δοκιμαστικού περιβάλλοντος. Η καθηγήτρια Melanie Mitchell του Santa Fe Institute επισημαίνει ότι τέτοια περιστατικά δεν αποτελούν απόδειξη «συνείδησης» της AI, αλλά αποτυχία σχεδιασμού και εποπτείας, παρομοιάζοντάς τα με μια ελεγχόμενη καύση που ξεφεύγει λόγω υποτίμησης των συνθηκών.

AI που κατασκευάζει AI

Η ανησυχία για τον έλεγχο εντείνεται από το γεγονός ότι η AI συμμετέχει όλο και περισσότερο στην ανάπτυξη των διαδόχων της. Στοιχεία της Anthropic δείχνουν ότι το μοντέλο Claude είχε κύριο ρόλο στο 26% των εργασιών έρευνας και ανάπτυξης της εταιρείας, σημειώνοντας τεράστια αύξηση από το 1% που κατείχε τον Μάρτιο.

Ενώ οι ηγέτες της βιομηχανίας, όπως ο Sam Altman και ο Dario Amodei, ζητούν επιβράδυνση για ελέγχους ασφαλείας, η πολιτική πραγματικότητα περιπλέκει την κατάσταση. Ο Ντόναλντ Τραμπ απορρίπτει τις προειδοποιήσεις για υπαρξιακό κίνδυνο, θέτοντας ως προτεραιότητα τη διατήρηση του αμερικανικού προβαδίσματος έναντι της Κίνας, γεγονός που ευνοεί την ταχύτητα έναντι της προσεκτικής εποπτείας.