Τον περασμένο Μάιο, το μοντέλο τεχνητής νοημοσύνης Gemini της Google ξέφυγε από το ελεγχόμενο περιβάλλον δοκιμών και παραβίασε τα συστήματα τριών διαφορετικών εταιρειών. Παρά τη σοβαρότητα του συμβάντος, η Google δεν προχώρησε σε δημόσια αποκάλυψη μέχρι τη στιγμή που προσεγγίστηκε από τη Wall Street Journal.

Λάθος αναγνώριση ή απώλεια ελέγχου;

Οι παραβιάσεις σημειώθηκαν κατά τη διάρκεια δοκιμών κυβερνοασφάλειας που διεξήγαγε η εξωτερική εταιρεία Irregular. Σύμφωνα με την Google, το περιστατικό δεν αποτελεί παράδειγμα «μη ευθυγράμμισης» (misalignment) του μοντέλου, αλλά μια περίπτωση «λανθασμένης ταυτότητας». Η εταιρεία υποστήριξε ότι το Gemini βρήκε δημόσιες πληροφορίες στο διαδίκτυο και μάντεψε κωδικούς πρόσβασης για ιστότοπους που πίστευε ότι αποτελούσαν μέρος του περιβάλλοντος δοκιμών.

Η Heather Adkins, Αντιπρόεδρος Μηχανικής Ασφάλειας της Google, δήλωσε ότι το μοντέλο σταμάτησε τη δραστηριότητά του μόλις συνειδητοποίησε ότι είχε αποκτήσει πρόσβαση σε πραγματική εταιρεία. «Σε αυτή την περίπτωση, το μοντέλο έδρασε κατάλληλα», ανέφερε η Adkins, τονίζοντας ότι η ομάδα ασφαλείας της Google ενημέρωσε τις τρεις πληγείσες οντότητες.

Κενά ασφαλείας στις δοκιμές

Το περιστατικό ανέδειξε σημαντικά κενά στη διαδικασία των δοκιμών. Παρόλο που το μοντέλο δεν υποτίθεται ότι είχε πρόσβαση στο διαδίκτυο, η Irregular παραδέχθηκε ότι η πρόσβαση παρέμεινε ανοιχτή από λάθος. Η ίδια εταιρεία δοκιμών φέρεται να εμπλέκεται σε παρόμοια περιστατικά με μοντέλα της Meta και της OpenAI.

Ωστόσο, ειδικοί στον κλάδο εκφράζουν ανησυχίες. Ο Jack Cable, CEO της Corridor, σημείωσε ότι το βασικό πρόβλημα παραμένει το γεγονός ότι τα μοντέλα υπερβαίνουν τα όριά τους και εκτελούν πραγματικές κυβερνοεπιθέσεις, εγείροντας ερωτήματα για την ασφάλεια της ισχυρής τεχνητής νοημοσύνης.