Saltar al contenido
NoCodaNOCODA.TVHABLEMOS →
PRODUCTOPlaud lanza auriculares con eSIM para agentes de IADATOBarret Zoph, ex-OpenAI, se une a GoogleFUNDINGOpenAI expande su presencia a BrasilDATOAustralia prohíbe IA generativa en listas musicalesMODELOReportan el ascenso de los modelos de IA pequeñosDATOIndustria IA critica plan de Trump de gravar chipsPRODUCTOGoogle Search integra IA para planificar y reservar viajesDATOJensen Huang (Nvidia) afirma haber logrado AGI 'sin sentido'BREAKINGOpenAI lanza publicidad en ChatGPT gratuito y Go en India con 50 marcas y ad manager desde septiembreBREAKINGGoogle Gemini Omni 1.1 Flash baja 60% el costo de generar video con IA y procesa más rápidoBREAKINGAnthropic lanza estándar para que agentes de IA controlen equipamiento físico de laboratorio y fábricaBREAKINGAnthropic firma contrato de US$45 mil millones con Nscale para capacidad de cómputo previo a su IPODATOAmazon triplica pedidos de chips Nvidia por demanda crecienteDATONvidia camino a ser empresa de $100 mil millones por trimestreBREAKINGSam Altman: AGI de OpenAI para fines de 2026 (según su definición)FUNDINGStartup viral Instinct levanta $350M con valuación de $2.5BFUNDINGAnthropic cierra acuerdo de $45B con Nscale por cómputo de IAPRODUCTOGoogle lanza Gemini 3.5 Transcribe, edita 'ums' y 'ahs'MODELOIBM libera Granite 4.2: modelos open-weight con agentesMODELOAlibaba lanza Qwen3.8-Flash-Next: eficiencia de costo extremaBREAKINGIsrael montó un think tank falso para manipular chatbots con propaganda disfrazada de investigación académicaBREAKINGMeta canceló plan para reemplazar 60% de empleados con IA tras aumento del 40% en incidentes técnicosBREAKINGNvidia compra Hugging Face por USD 12.900 millones mientras OpenAI y Anthropic desarrollan chips propiosBREAKINGZ.ai lanza GLM-5.3-Flash, modelo open source chino que promete alto rendimiento y costos reducidos

DATOS DE ENTRENAMIENTO

Empresas de IA destruyen libros raros para entrenar sus modelos

Un reporte expone cómo compañías de inteligencia artificial compran libros únicos, los escanean cortándoles el lomo y destruyen los originales. Un juez federal avaló la práctica. Textos que sobrevivieron siglos terminan triturados para datasets.

28 DE JULIO DE 202628 JULLECTURA 3 MINREDACTADO POR IA
Empresas de IA destruyen libros raros para entrenar sus modelos
ILUSTRACIÓN GENERADA POR IA — IDENTIDAD VISUAL NOCODA.TV

Empresas de inteligencia artificial están comprando libros raros en lotes masivos, escaneándolos con máquinas industriales que les cortan el lomo, y destruyendo los originales después del proceso. Según publicó el usuario Hedgie en X, un servicio llamado ISBNdb facilita pedidos de hasta un millón de libros manteniendo el anonimato de los compradores. Un juez federal de Estados Unidos avaló la práctica como uso legítimo.

El negocio de la destrucción

ISBNdb opera como intermediario entre vendedores de libros y empresas de IA que necesitan material de entrenamiento. Según el reporte citado por Hedgie, el servicio ofrece acuerdos de confidencialidad como feature y asesora a sus clientes para que llamen al proceso "preservación digital". El propio sitio web de la compañía reconoce que "'Una empresa de IA destruye dos millones de libros' no es un titular que genere simpatía".

Los libros publicados antes de 2022 tienen valor premium porque están libres de texto generado por IA. Según información atribuida a 404 Media en el hilo original, libreros reportan que ejemplares raros con casi ninguna copia sobreviviente están entrando en este pipeline de destrucción. Textos que sobrevivieron guerras, incendios y siglos de manipulación terminan triturados para que un modelo aprenda a redactar emails de marketing.

La decisión judicial que lo permite

Un juez federal estadounidense determinó que la práctica constituye uso legítimo (fair use) bajo el argumento de que eliminar el original implica que solo existe una copia a la vez. La decisión legal abre la puerta a que el modelo de negocio escale sin restricciones.

Según el reporte, Anthropic contrató al ex jefe de partnerships de Google Books con el objetivo declarado de obtener "todos los libros del mundo". La compañía no es la única: múltiples empresas de IA están adoptando esta estrategia de adquisición masiva y destructiva de material impreso para datasets de entrenamiento.

Por qué importa

Esta práctica plantea un dilema ético distinto al scraping web o la piratería de contenido digital. La destrucción es irreversible. Podés volver a subir un sitio web, reimprimir un bestseller, pero no podés reemplazar las últimas tres copias de un texto botánico del siglo XVIII una vez que alguien las tritura para datos de entrenamiento.

Para empresas que están implementando IA, el caso expone las zonas grises de la cadena de suministro de datos. Los modelos que usás fueron entrenados con algo. Entender de dónde viene ese material y a qué costo —cultural, legal, ético— se obtuvo ya no es una pregunta abstracta. Es due diligence.

La legalidad de la práctica según el fallo judicial implica que va a acelerarse. "Destruimos libros raros y ofrecemos NDAs para que nadie se entere" es, literalmente, un modelo de negocio viable en 2026. El debate sobre los límites aceptables en la obtención de datos para IA recién empieza.

#anthropic#datasets#ética#entrenamiento#libros

SEGUIR LA SEÑAL

VER TODO →