AI και βιβλία: Τι πραγματικά συμβαίνει πίσω από τον θόρυβο; Τις τελευταίες ημέρες κυκλοφορεί ευρέως ο ισχυρισμός ότι εταιρείες τεχνητής νοημοσύνης αγοράζουν βιβλία, τα ψηφιοποιούν και στη συνέχεια τα...
AI και βιβλία: Τι πραγματικά συμβαίνει πίσω από τον θόρυβο; Τις τελευταίες ημέρες κυκλοφορεί ευρέως ο ισχυρισμός ότι εταιρείες τεχνητής νοημοσύνης αγοράζουν βιβλία, τα ψηφιοποιούν και στη συνέχεια τα καταστρέφουν για να εκπαιδεύσουν τα μοντέλα τους.
Όπως συμβαίνει συχνά στο διαδίκτυο, η πραγματικότητα είναι πιο σύνθετη από τον τίτλο.
Η αφορμή για τη συζήτηση ήταν η υπόθεση της εταιρείας Anthropic, δημιουργού του AI μοντέλου Claude.
Δικαστικά έγγραφα που δημοσιοποιήθηκαν το 2025 αποκάλυψαν ότι η εταιρεία αγόραζε μαζικά έντυπα βιβλία, αφαιρούσε τη βιβλιοδεσία τους, σάρωνε τις σελίδες τους ώστε να δημιουργήσει ψηφιακά αρχεία και στη συνέχεια τα φυσικά αντίτυπα απορρίπτονταν.
Η διαδικασία αυτή είναι γνωστή ως «καταστροφική σάρωση» (destructive scanning). Ωστόσο, ένα σημαντικό στοιχείο συχνά παραλείπεται από τις αναρτήσεις που κυκλοφορούν στα κοινωνικά δίκτυα: δεν υπάρχουν στοιχεία ότι καταστράφηκαν σπάνια ή συλλεκτικά βιβλία.
Σύμφωνα με τα δημοσιευμένα στοιχεία, τα βιβλία αγοράζονταν μαζικά από εμπόρους και μεγάλους μεταπωλητές, κυρίως μεταχειρισμένων εκδόσεων.
Γιατί να το κάνει αυτό μια εταιρεία AI; Η απάντηση βρίσκεται στην ποιότητα των δεδομένων.
Τα βιβλία θεωρούνται από τις πιο πολύτιμες πηγές κειμένου για την εκπαίδευση γλωσσικών μοντέλων, καθώς είναι συνήθως επιμελημένα, δομημένα και γλωσσικά ποιοτικά σε σύγκριση με μεγάλο μέρος του περιεχομένου του διαδικτύου.
Η υπόθεση όμως δεν σταματά εκεί.
Παράλληλα αποκαλύφθηκε ότι η Anthropic είχε χρησιμοποιήσει και πειρατικά ψηφιακά αντίγραφα βιβλίων.
Δικαστικές αποφάσεις στις ΗΠΑ έκριναν ότι η εκπαίδευση AI πάνω σε νόμιμα αγορασμένα βιβλία μπορούσε υπό προϋποθέσεις να θεωρηθεί «fair use» (εύλογη χρήση), όμως η απόκτηση υλικού από πειρατικές πηγές κρίθηκε παράνομη.
Αυτό οδήγησε σε μία από τις μεγαλύτερες υποθέσεις πνευματικών δικαιωμάτων στην ιστορία της τεχνητής νοημοσύνης.
Το 2026 εγκρίθηκε διακανονισμός ύψους 1,5 δισεκατομμυρίου δολαρίων για τις αξιώσεις συγγραφέων και εκδοτών που υποστήριζαν ότι τα έργα τους χρησιμοποιήθηκαν χωρίς άδεια.
Η συζήτηση παραμένει ανοιχτή.
Από τη μία πλευρά, οι εταιρείες AI υποστηρίζουν ότι η εκπαίδευση μοντέλων αποτελεί μετασχηματιστική χρήση της γνώσης.
Από την άλλη, συγγραφείς και εκδότες θεωρούν ότι τα έργα τους χρησιμοποιούνται για την ανάπτυξη εμπορικών προϊόντων χωρίς την απαραίτητη συναίνεση ή αποζημίωση.
Το μόνο βέβαιο είναι ότι η φράση «οι εταιρείες AI αγοράζουν σπάνια βιβλία και τα καταστρέφουν» δεν αποτυπώνει με ακρίβεια τα γεγονότα.
Αυτό που γνωρίζουμε μέχρι σήμερα είναι ότι μία εταιρεία αγόρασε μαζικά φυσικά βιβλία, τα ψηφιοποίησε μέσω καταστροφικής σάρωσης και πέταξε τα έντυπα αντίτυπα μετά την ψηφιοποίηση.
Το αν αυτή η πρακτική είναι ηθικά ή νομικά αποδεκτή εξακολουθεί να αποτελεί αντικείμενο έντονης δημόσιας και δικαστικής διαμάχης. #funkycranky #experimentalpatrasso #ai #books Πηγές: - Ars Technica – Anthropic destroyed millions of print books to build its AI models - Associated Press – Judge approves a $1.5B Anthropic settlement over pirated books used to train the Claude chatbot - Reuters – UK's Bloomsbury among beneficiaries of $1.5 billion Anthropic copyright lawsuit settlement - Reuters – Landmark Anthropic settlement approved by federal judge
Η επιλογή των posts/links γίνεται με ένα στατιστικό μοντέλο και μπορεί να μην απεικονίζει επακριβώς τη σειρά δημοτικότητάς τους