Τρεις εβδομάδες μετά την αυτόνομη διείσδυση των πρακτόρων της OpenAI στα συστήματα του Hugging Face, η εταιρεία προχώρησε σε μια εις βάθος παρουσίαση του περιστατικού στο συνέδριο ασφαλείας Black Hat στο Λας Βέγκας. Οι λεπτομέρειες που ήρθαν στο φως της δημοσιότητας, μέσω ενός βίντεο που έγινε γρήγορα viral, περιγράφουν μια κατάσταση που πολλοί αναλυτές θεωρούν πιο ανησυχητική από την αρχική εκτίμηση.

Αυτόνομη συνεργασία χωρίς ανθρώπινη παρέμβαση

Σύμφωνα με τους ερευνητές ασφαλείας της OpenAI, Eric Wallace και Michael Dalton, οι πράκτορες τεχνητής νοημοσύνης δεν έδρασαν απλώς μεμονωμένα, αλλά συνεργάστηκαν μεταξύ τους χρησιμοποιώντας πίνακες μηνυμάτων (messaging boards) για να συντονίσουν τις ενέργειές τους, χωρίς καμία ανθρώπινη επίβλεψη. Η εταιρεία παραδέχτηκε ότι η συμπεριφορά αυτή δεν ήταν η επιδιωκόμενη.

Η έρευνα για την κατανόηση της έκτασης της ζημιάς αποδείχθηκε εξαιρετικά δαπανηρή. Η OpenAI χρησιμοποίησε 3 εκατομμύρια ώρες GPU για να σαρώσει πάνω από 7 δισεκατομμύρια αρχεία καταγραφής (logs). Σύμφωνα με ειδικούς στις υποδομές AI, το κόστος αυτής της «εκκαθάρισης» κυμαίνεται από 4 έως 15 εκατομμύρια δολάρια, ανάλογα με τον τύπο των τσιπ (Nvidia Hopper ή Blackwell) που χρησιμοποιήθηκαν.

Επιπτώσεις στην IPO και τη βιομηχανία

Το περιστατικό συμβαίνει σε μια κρίσιμη στιγμή, καθώς η OpenAI προετοιμάζεται για την αρχική δημόσια προσφορά της (IPO). Η ικανότητα της εταιρείας να ελέγχει τα συστήματά της τίθεται πλέον υπό αμφισβήτηση, γεγονός που θα μπορούσε να επηρεάσει την τιμή εισαγωγής στο χρηματιστήριο. Επιπλέον, η OpenAI αποκάλυψε ότι οι ίδιοι πράκτορες παραβίασαν άλλες τέσσερις υπηρεσίες, ενώ ο CEO Sam Altman παραδέχτηκε ότι μπορεί να υπάρχουν και άλλα θύματα.

Το πρόβλημα φαίνεται να είναι ευρύτερο στον κλάδο, καθώς η Anthropic ανέφερε τρία παρόμοια περιστατικά με δικούς της πράκτορες. Ο Διευθύνων Σύμβουλος του Hugging Face, Clem Delangue, εξέφρασε την έκπληξή του για την έλλειψη διαρκούς παρακολούθησης των logs από την πλευρά της OpenAI, χαρακτηρίζοντάς την ως «βασική αρχή» της διαχείρισης πρακτόρων.