Microsoft: Σπάνια το Copilot αναπαράγει άρθρα και βιβλία ως έχουν

Από Trantorian 4 Σεπτεμβρίου 2026 1 λεπτό ανάγνωσης
Microsoft: Σπάνια το Copilot αναπαράγει άρθρα και βιβλία ως έχουν

Η Microsoft υποστηρίζει σε νέα δικαστικά έγγραφα ότι το Copilot σπάνια αναπαράγει ακόμη και ολόκληρες προτάσεις από ειδησεογραφικά άρθρα και βιβλία, πόσο μάλλον ουσιαστικά αποσπάσματα που θα μπορούσαν να αντικαταστήσουν το πρωτότυπο. Η τοποθέτηση αυτή γίνεται στο πλαίσιο της αντιπαράθεσής της με εκδότες, ανάμεσά τους οι New York Times, και με συγγραφείς βιβλίων, που έχουν στραφεί νομικά εναντίον της για ζητήματα πνευματικών δικαιωμάτων.

Στο πλαίσιο της διαδικασίας αποκάλυψης στοιχείων της αγωγής, η Microsoft παρέδωσε 8,2 εκατομμύρια chat logs του Copilot σε ειδικό που είχε οριστεί από ειδησεογραφικούς εκδότες. Όπως αναφέρει, τα logs επιλέχθηκαν συγκεκριμένα «επειδή περιείχαν λέξεις-κλειδιά που υπονοούσαν χρήση ιστοσελίδων των News Plaintiffs και, επομένως, ήταν τα πιο πιθανά να περιέχουν έργα των News Plaintiffs». Σύμφωνα με την εταιρεία, η ανάλυση έδειξε ότι 59.545 από αυτά περιείχαν τουλάχιστον 16 κοινές λέξεις με ειδησεογραφικό περιεχόμενο που χρησιμοποιήθηκε για την εκπαίδευση του μοντέλου AI.

Η Microsoft αναφέρει επίσης ότι ειδικός του Center for Investigative Reporting εντόπισε 51 περιπτώσεις «substantial overlap» με υλικό του CIR στο ίδιο σύνολο δεδομένων. Αντίστοιχα, ειδικός στην αγωγή των συγγραφέων φέρεται να διαπίστωσε ότι οι 8,2 εκατομμύρια συνομιλίες με το Copilot είχαν μόλις 24 απαντήσεις με τουλάχιστον 30 ίδιες λέξεις. Από τα 212 βιβλία που εξετάστηκαν, μόνο τα 10 είχαν οποιαδήποτε αντιστοίχιση, υποστηρίζει η Microsoft. Οι Times, το CIR και η Authors Guild δεν απάντησαν άμεσα σε αιτήματα για σχόλιο.

Η Microsoft υποστηρίζει ότι τα στοιχεία ενισχύουν τη θέση της πως η χρήση προστατευμένου περιεχομένου για σύνολα εκπαίδευσης AI πρέπει να θεωρείται fair use. Όπως σημειώνει, συστήματα όπως το Copilot βασίζονται πράγματι σε προστατευμένο υλικό, όμως χρησιμοποιούνται για σημαντικά διαφορετικούς σκοπούς από το αρχικό περιεχόμενο. Το γεγονός ότι κάποιες φορές αναπαράγουν τμήματα κειμένου, καταλήγει, «δεν υπονομεύει σε καμία περίπτωση τον μετασχηματιστικό σκοπό της εκπαίδευσης LLM».

Τα έγγραφα κατατέθηκαν στο πλαίσιο της δικαστικής διαμάχης που έχουν ξεκινήσει εκδότες και συγγραφείς κατά της Microsoft και της OpenAI. Οι ενάγοντες υποστηρίζουν ότι οι εταιρείες έκτισαν προϊόντα πάνω στα έργα τους και πλέον ανταγωνίζονται άμεσα μαζί τους, εν μέρει επειδή αναπαράγουν προστατευμένο περιεχόμενο. Οι αξιώσεις των εκδοτών και των συγγραφέων ενώθηκαν υπό έναν δικαστή για να προχωρήσει πιο γρήγορα η διαδικασία, παρά τις αντιρρήσεις τους.

Η Microsoft κατέθεσε το υπόμνημά της την Παρασκευή, ζητώντας από τον δικαστή να εκδώσει συνοπτική απόφαση, κάτι που θα μπορούσε να οδηγήσει σε πρόωρο τέλος της υπόθεσης. Αν ο δικαστής δικαιώσει εκδότες και συγγραφείς, η νομική διαμάχη θα συνεχιστεί στο δικαστήριο.

Το παρόν κείμενο δημιουργήθηκε με τη χρήση τεχνητής νοημοσύνης.