Il database di metadati librari ISBNdb ha rimosso un servizio mirato alla fornitura di libri cartacei per l'addestramento dei modelli di intelligenza artificiale. L'azienda ha ridimensionato l'iniziativa definendola un mero test di mercato, mentre emergono interrogativi sull'uso della letteratura fisica pre-2022 per prevenire il fenomeno del model collapse.

Its pitch is simple: older books offer cleaner data. "The world's best AI training data is sitting on a shelf," the company says on its website. "Books...

Before AI can learn from old books, someone has to scan them. For millions of physical copies, that has meant cutting off the spine.