[451 Logo]
 Μόνο Top News & Social
 Επικαιρότητα
 Αθλητικά
 Οικονομία
 Ροή

Δείτε πρόβλημα που απέκτησε η Τεχνητή Νοημοσύνη. Η τεχνολογία αυτή «μαθαίνει» να απαντά με βάση την υπάρχουσα πληροφορία που υπάρχει στο διαδίκτυο. Όμως πολλοί άνθρωποι για διάφορους λόγους...

Original Post

Πλήρες Κείμενο:

Δείτε πρόβλημα που απέκτησε η Τεχνητή Νοημοσύνη. Η τεχνολογία αυτή «μαθαίνει» να απαντά με βάση την υπάρχουσα πληροφορία που υπάρχει στο διαδίκτυο.

Όμως πολλοί άνθρωποι για διάφορους λόγους κερδοσκοπικούς ή για τρολάρισμα ή για εξαπάτηση παράγουν με χρήση της Τεχνητής Νοημοσύνης παρανοϊκές εικόνες, παρανοϊκά κείμενα ... τα οποία σύντομα θα λαμβάνονται υπόψη από τις μηχανές Τεχνητής Νοημοσύνης και οι απαντήσεις θα συμπεριλαμβάνουν τέτοιου είδους «σκουπίδια». Για να «εκπαιδεύσουν» λοιπόν την τεχνολογία χωρίς να κινδυνεύουν να «μολυνθεί» από τα σκουπίδια που έχουν παράξει οι άνθρωποι ... οι εταιρίες Τεχνητής Νοημοσύνης ...αγοράζουν βιβλία που γράφτηκαν πριν το 2022 ώστε να είναι σίγουροι ότι γράφτηκαν από ανθρώπους.

Για να σκαναριστούν γρήγορα αυτά τα βιβλία διαλύονται από την βιβλιοδεσία τους ώστε να μείνουν ανεξάρτητες σελίδες να μπορούν να μπουν στα μηχανήματα ανάγνωσης.

Κι έτσι εκτός από το να εκπαιδεύουν τους υπολογιστές καταστρέφουν και τα βιβλία ως αντικείμενα. >>>Οι προγραμματιστές τεχνητής νοημοσύνης έχουν καταφύγει στην αγορά βιβλίων που τυπώθηκαν πριν από το 2022, προκειμένου να εξασφαλίσουν δεδομένα απαλλαγμένα από το λεγόμενο «AI slop» (περιεχόμενο χαμηλής ποιότητας που παράγεται από τεχνητή νοημοσύνη) — και καταστρέφουν τα βιβλία όταν τα ενσωματώνουν στα σύνολα δεδομένων τους.

Ο ανοικτός ιστός (open web) γεμίζει με ταχύτατους ρυθμούς από κείμενα που έχουν παραχθεί από μηχανές, δημιουργώντας μια σοβαρή κρίση «μόλυνσης» των δεδομένων, την οποία έχει προκαλέσει η ίδια η βιομηχανία της τεχνητής νοημοσύνης.

Όταν τα μοντέλα τεχνητής νοημοσύνης εκπαιδεύονται σε δεδομένα που έχουν παραχθεί από άλλα συστήματα τεχνητής νοημοσύνης, διατρέχουν τον κίνδυνο της λεγόμενης «κατάρρευσης του μοντέλου» (model collapse) — ενός φαινομένου κατά το οποίο οι διαδοχικές γενιές μοντέλων υποβαθμίζονται προοδευτικά ως προς την ποιότητά τους.

Για να αποφύγουν αυτόν τον φαύλο κύκλο, οι προγραμματιστές αναζητούν εναγωνίως αυθεντικό περιεχόμενο γραμμένο από ανθρώπους.

Η λύση τους βρίσκεται στα ράφια των βιβλιοθηκών: τα βιβλία που εκδόθηκαν πριν από το 2022, δηλαδή πριν από την εποχή των σύγχρονων chatbot, αποτελούν τα τελευταία μεγάλα αποθέματα εντελώς «αμόλυντης», ανθρώπινης σκέψης, η οποία έχει επίσης επιμεληθεί από ανθρώπους.

Για να αποκτήσουν αυτά τα δεδομένα, εταιρείες-μεσάζοντες, όπως η ISBNdb, αγοράζουν μαζικά παλαιότερα έντυπα βιβλία.

Στη συνέχεια, εργαζόμενοι κόβουν τις ράχες των βιβλίων ώστε να σαρωθούν εκατομμύρια σελίδες με μεγάλη ταχύτητα, καταστρέφοντας ολοκληρωτικά τα φυσικά αντίτυπα κατά τη διαδικασία.

Επειδή η πολτοποίηση βιβλίων ενέχει σοβαρό κίνδυνο αρνητικής δημοσιότητας, οι αγοραστές κρατούν αυστηρά μυστική την ταυτότητά τους.

Η τάση αυτή ενισχύεται ακόμη περισσότερο από πρόσφατες αποφάσεις αμερικανικών δικαστηρίων, οι οποίες υποδηλώνουν ότι η εκπαίδευση μοντέλων τεχνητής νοημοσύνης σε ένα βιβλίο που έχει αγοραστεί νόμιμα και καταστρέφεται κατά τη διαδικασία σάρωσης ενδέχεται να θεωρείται νόμιμη χρήση (fair use). Έτσι, η βιομηχανία οδηγείται σιωπηλά στην καταστροφή ενός μέρους της λογοτεχνικής και πνευματικής κληρονομιάς, προκειμένου να τροφοδοτήσει το ψηφιακό μέλλον. Πηγή: Constantin, A. M. (22 Ιουλίου 2026). AI firms are buying old books for slop-free training data. TNW.<<<

Η επιλογή των posts/links γίνεται με ένα στατιστικό μοντέλο και μπορεί να μην απεικονίζει επακριβώς τη σειρά δημοτικότητάς τους


Όροι Χρήσης - Επικοινωνία
Update cookies preferences