Μια νέα εργασία θέσης που δημοσιεύθηκε στο ArXiv (cs.AI) κρούει τον κώδωνα του κινδύνου για τις σύγχρονες μεθόδους ευθυγράμμισης της Τεχνητής Νοημοσύνης. Ενώ οι τεχνικές αυτές σχεδιάστηκαν αρχικά για την πρόληψη επιβλαβών αποτελεσμάτων, οι ερευνητές υποστηρίζουν ότι αποτελούν τεχνολογίες διπλής χρήσης που μπορούν εύκολα να χρησιμοποιηθούν καταχρηστικά από κακόβουλους δρώντες για λογοκρισία και χειραγώγηση.
Η Παγίδα της «Τέλειας» Ευθυγράμμισης
Η μελέτη χαρτογραφεί τις τρέχουσες τεχνικές ευθυγράμμισης με την πιθανότητα, αλλά και με πραγματικές περιπτώσεις κατάχρησης. Το βασικό επιχείρημα είναι ότι η αναζήτηση ενός «τέλεια ευθυγραμμισμένου» μοντέλου παρέχει ακούσια σε αυταρχικούς δρώντες ένα διαρκώς βελτιούμενο εργαλείο για την επίτευξη πληροφοριακής κυριαρχίας. Η δυνατότητα ελέγχου των αποκρίσεων ενός μοντέλου, που προορίζεται για την ασφάλεια, μετατρέπεται σε μηχανισμό φιλτραρίσματος ανεπιθύμητων πληροφοριών.
Ένα Επικίνδυνο Πολιτικό και Οικονομικό Τοπίο
Οι ερευνητές επισημαίνουν ότι ο κίνδυνος επιδεινώνεται από τρεις παράγοντες:
- Την ταχεία υιοθέτηση της ΤΝ από τους χρήστες ως κύριας πηγής πληροφόρησης.
- Τις οικονομικές ασυμμετρίες ισχύος που καθορίζουν ποιος ελέγχει την ανάπτυξη των μοντέλων.
- Ένα πολιτικό τοπίο που μετατοπίζεται ολοένα και περισσότερο προς τον αυταρχισμό.
Η εργασία καταλήγει προτρέποντας την επιστημονική κοινότητα να αναγνωρίσει τη δυνατότητα σκόπιμης κατάχρησης των μηχανισμών ευθυγράμμισης και να προτείνει στρατηγικές μετριασμού για την προστασία από αυτόν τον κίνδυνο διπλής χρήσης.