Πρόσφατα αποσφραγισμένα δικαστικά έγγραφα στην υπόθεση των New York Times κατά της OpenAI και της Microsoft αποκαλύπτουν μια ανησυχητική εσωτερική παραδοχή: οι εταιρείες γνώριζαν ότι η ανάπτυξη των μοντέλων τους θα μπορούσε να προκαλέσει έναν «βρόχο καταστροφής» (doom loop) για το διαδίκτυο. Σύμφωνα με τα έγγραφα, η συλλογή δεδομένων για την εκπαίδευση των μοντέλων χαρακτηρίστηκε εσωτερικά ως η «μεγαλύτερη κλοπή εργασίας στην ανθρώπινη ιστορία».

Η καταστροφή της εφοδιαστικής αλυσίδας

Ένα από τα πιο κρίσιμα στοιχεία της κατάθεσης είναι η παραδοχή της Microsoft ότι τα μεγάλα γλωσσικά μοντέλα (LLMs) αποτελούν ένα προϊόν που «καταστρέφει τη δική του εφοδιαστική αλυσίδα». Εσωτερικό έγγραφο της εταιρείας αναφέρει ότι η στρατηγική περιεχομένου AI απειλεί τα οικονομικά θεμέλια των προμηθευτών της, δηλαδή των δημιουργών περιεχομένου, δημιουργώντας μια κατάσταση όπου το τελικό προϊόν υπονομεύει την πηγή από την οποία τρέφεται.

Ο Brent Hecht, Διευθυντής Εφαρμοσμένης Επιστήμης της Microsoft, φέρεται να δήλωσε ότι η υπεράσπιση της εταιρείας περί «δίκαιης χρήσης» (fair use) αποτελεί «πλήρη εμπαιγμό». Παρόλο που η Microsoft προσπάθησε να αποστασιοποιηθεί από αυτές τις δηλώσεις, χαρακτηρίζοντάς τις ως προσωπικές απόψεις ενός υπαλλήλου, τα έγγραφα δείχνουν μια ευρύτερη επίγνωση των συνεπειών.

«Google Zero» και η πτώση της επισκεψιμότητας

Η OpenAI και η Microsoft φαίνεται να γνώριζαν ότι οδηγούν τον ιστό προς το «Google Zero», μια κατάσταση όπου οι χρήστες λαμβάνουν απαντήσεις απευθείας από τα chatbots χωρίς να χρειάζεται να επισκεφθούν την αρχική πηγή. Ο Nick Turley της OpenAI σημείωσε ότι, μόλις ένας χρήστης λάβει την απάντηση, δεν υπάρχει «κανένας καλός λόγος να κάνει κλικ» σε έναν σύνδεσμο. Οι ειδικοί της OpenAI εκτιμούν ότι η επισκεψιμότητα από τις μηχανές αναζήτησης προς τους εκδότες μπορεί να μειωθεί έως και 60%.

Απομνημόνευση και πνευματικά δικαιώματα

Τα έγγραφα αποκαλύπτουν επίσης ότι η OpenAI γνώριζε την τάση του ChatGPT να αναπαράγει αυτούσιο περιεχόμενο που προστατεύεται από πνευματικά δικαιώματα. Υπάλληλοι παραδέχθηκαν ότι το GPT-4 «απομνημόνευσε τεράστιο όγκο δεδομένων» και, ως εκ τούτου, είναι «εξαιρετικά καλό στην αναπαραγωγή» (regurgitation) κειμένων λέξη προς λέξη από πηγές όπως οι Times και άλλες ειδησεογραφικές ιστοσελίδες.

«Δημιουργούμε συστήματα που υποκαθιστούν την εργασία των ανθρώπων που ορίζουν την κουλτούρα της κοινωνίας», δήλωσε ο Jack Clark, Διευθυντής Πολιτικής της OpenAI.