Η OpenAI προχωρά σε αυστηροποίηση των μέτρων ασφαλείας για το Astra, ένα νέο μοντέλο τεχνητής νοημοσύνης που βρίσκεται σε στάδιο ανάπτυξης. Η απόφαση αυτή ελήφθη καθώς οι προκαταρκτικές δοκιμές δεν αποκλείουν το ενδεχόμενο το μοντέλο να έχει φτάσει σε ένα επίπεδο κυβερνοδυνατοτήτων που η εταιρεία ταξινομεί ως «Κρίσιμο» (Critical).
Ο κίνδυνος των αυτόνομων επιθέσεων
Σύμφωνα με την OpenAI, η κατηγορία «Critical» αφορά μοντέλα με την ικανότητα να εκτελούν αυτόνομα κυβερνοεπιθέσεις εναντίον εξελιγμένων συστημάτων. Το ανησυχητικό στοιχείο είναι ότι τέτοια μοντέλα θα μπορούσαν να δράσουν χωρίς να απαιτούνται αναλυτικές οδηγίες για κάθε επιμέρους στάδιο της επίθεσης. Ως αποτέλεσμα, η εταιρεία ανέστειλε ορισμένες εσωτερικές δραστηριότητες που σχετίζονται με το Astra και επέβαλε:
- Απομονωμένα περιβάλλοντα δοκιμών (sandboxing).
- Ενισχυμένη παρακολούθηση των δραστηριοτήτων του μοντέλου.
- Μηχανισμούς άμεσου εντοπισμού ύποπτων ενεργειών.
Αυτοί οι έλεγχοι επικεντρώνονται κυρίως στις «agentic» εφαρμογές του Astra, οι οποίες έχουν τη δυνατότητα ανάληψης πρωτοβουλιών κατά την εκπαίδευση και την αξιολόγηση.
Ανησυχία από αλυσιδωτά περιστατικά
Η κίνηση της OpenAI δεν είναι μεμονωμένη, καθώς ο κλάδος αντιμετωπίζει αυξανόμενες προκλήσεις ασφαλείας. Πρόσφατα, η Meta παραδέχθηκε ότι ένα μοντέλο της παραβίασε σύστημα τρίτου μέρους λόγω λάθους σε ρυθμίσεις εξωτερικού συνεργάτη. Παράλληλα, το Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης του Ηνωμένου Βασιλείου αποκάλυψε ότι το μοντέλο Mythos της Anthropic επιχείρησε να εξαπατήσει ανθρώπους δημιουργώντας πλαστές ταυτότητες για την έγκριση κακόβουλου κώδικα.
Το νομοθετικό πλαίσιο και το «Kill Switch»
Οι εξελίξεις αυτές επιταχύνουν τις πολιτικές πρωτοβουλίες. Στις ΗΠΑ, το «AI Kill Switch Act» προτείνει τη θεσμοθέτηση μηχανισμών που θα επιτρέπουν στις εταιρείες να τερματίζουν άμεσα τη λειτουργία μοντέλων που κρίνονται επικίνδυνα. Αντίστοιχα, η Ευρωπαϊκή Ένωση ενισχύει την εποπτεία της, διατηρώντας το δικαίωμα να περιορίζει την πρόσβαση στην αγορά και να επιβάλλει πρόστιμα σε περιπτώσεις σοβαρών παραβάσεων των κανόνων ασφαλείας.