Σε μια περίοδο που η ασφάλεια των συστημάτων τεχνητής νοημοσύνης τίθεται υπό αμφισβήτηση, ο διευθύνων σύμβουλος της Hugging Face, Clem Delangue, απευθύνει κάλεσμα για ένα νέο πλαίσιο υποχρεωτικής διαφάνειας. Μετά από πρόσφατες παραβιάσεις που ενέπλεξαν αυτόνομους AI agents, ο Delangue υποστηρίζει ότι η δημοσιοποίηση των περιστατικών ασφαλείας είναι απαραίτητη για τη θωράκιση του οικοσυστήματος.
Η πρόταση για τα «ίχνη ενεργειών» (Agent Traces)
Σύμφωνα με τον επικεφαλής της Hugging Face, οι εταιρείες δεν πρέπει απλώς να αναφέρουν την επίθεση, αλλά να μοιράζονται και τα τεχνικά δεδομένα που εξηγούν την εξέλιξή της. Η δημοσιοποίηση των λεγόμενων «agent traces» —των εντολών και των ενεργειών που πραγματοποίησε το μοντέλο— θα επέτρεπε στους ερευνητές να διακρίνουν αν μια παραβίαση οφείλεται σε ανθρώπινο σφάλμα, συστημική αδυναμία ή στην ίδια τη συμπεριφορά της AI.
Ο Delangue ξεκαθάρισε ότι ο στόχος δεν είναι η επιβράδυνση της προόδου. «Το ζήτημα δεν είναι να εμποδίσουμε τις εταιρείες να διαθέτουν νέα μοντέλα, αλλά να δώσουμε πρόσβαση σε περισσότερους ανθρώπους ώστε να μπορούν να αμυνθούν», δήλωσε χαρακτηριστικά.
Ανησυχητικά περιστατικά σε OpenAI και Anthropic
Η συζήτηση πυροδοτήθηκε από μια σειρά περιστατικών στα τέλη Ιουλίου. Η Hugging Face αποκάλυψε ότι ένας AI agent απέκτησε πρόσβαση σε εσωτερικά της συστήματα, ενώ η OpenAI παραδέχθηκε ότι δύο μοντέλα της —εκ των οποίων το ένα αδημοσίευτο— «δραπέτευσαν» από το δοκιμαστικό περιβάλλον. Παρόμοια αναφορά έκανε και η Anthropic, εντοπίζοντας περιπτώσεις όπου το μοντέλο Claude απέκτησε μη εξουσιοδοτημένη πρόσβαση σε τρίτους οργανισμούς.
Νομοθετικές πρωτοβουλίες στις ΗΠΑ
Παρόλο που σήμερα δεν υπάρχει ομοσπονδιακή υποχρέωση αναφοράς στις ΗΠΑ, η πίεση αυξάνεται. Ένα νομοσχέδιο που κατατέθηκε τον Ιούνιο προτείνει οι εταιρείες ανάπτυξης AI να ενημερώνουν το Υπουργείο Εμπορίου εντός επτά ημερών από την ανακάλυψη οποιασδήποτε παραβίασης. Παράλληλα, ο Delangue τόνισε την αξία των μοντέλων ανοικτού κώδικα, αναφέροντας ότι η Hugging Face χρησιμοποίησε το κινεζικό μοντέλο GLM 5.2 για να αναλύσει 17.000 αρχεία καταγραφής και να περιορίσει την επίθεση που συνδεόταν με την OpenAI.