Oxford permitió que OpenAI entrenara modelos de IA en textos bodleianos, informa The Guardian



Oxford ha permitido que OpenAI utilice textos antiguos de su Biblioteca Bodleian para entrenar sus modelos de IA, según documentos internos vistos por el guardián. Ethan Penny y Dan Milmo dieron a conocer la historia el sábado.

Los documentos dicen que los textos que OpenAI escaneó en la biblioteca se incluyeron en los datos de capacitación de la empresa.

Oxford hizo su lidiar con OpenAI público en marzo de 2025. En ese momento, dijo que las herramientas de OpenAI ayudarían a escanear textos raros para que más estudiantes y académicos pudieran leerlos. No dijo que los textos se utilizarían para entrenar IA.

En junio de 2025, Bodleian había enviado a OpenAI 125.000 escaneos de antiguas tesis doctorales, informó The Guardian. Incluyen tesis escritas en universidades europeas y estadounidenses en los siglos XIX y XX.

Las notas de las reuniones del personal, que The Guardian obtuvo a través de una solicitud de libertad de información, muestran que algunos empleados tenían dudas. Les preocupaba el daño al nombre de Oxford y el uso de energía de la IA.

Sin embargo, Oxford dijo que los escaneos fueron a pequeña escala, sin derechos de autor y no exclusivos de OpenAI. La biblioteca conserva los derechos y comenzará a publicar los escaneos en línea en los próximos meses, dijo un portavoz.

El portavoz también dijo que el lado del entrenamiento de IA no se había ocultado. El escaneo era el objetivo principal de Oxford, pero el personal se había mostrado abierto a que los textos también se utilizaran para entrenar modelos.

«Con más de mil millones de personas utilizando esta tecnología en la vida cotidiana, es importante que refleje diferentes culturas, historias y perspectivas», dijo un portavoz de OpenAI a The Guardian.

Oxford es el único miembro del Reino Unido de OpenAI Grupo NextGenAI. Otros miembros incluyen la Biblioteca Pública de Boston, Caltech, el MIT y la Universidad de Michigan.

El acuerdo se produce cuando las empresas de inteligencia artificial compran libros impresos por datos de entrenamiento sin pendienteya que la web ahora está llena de texto creado por IA. Algunos compradores cortan los libros para escanearlos, lo que ha molestado libreros de segunda mano.

En agosto, 404 Medios rastreó una caja de libros raros hasta un sitio de Amazon que escanea y destruye libros en busca de IA. Los libros del Bodleian permanecen íntegros según el acuerdo, informó The Guardian.



Fuente: TNW

Compartir:

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Esta web utiliza cookies propias y de terceros para su funcionamiento, análisis, programas de afiliación y para mostrar publicidad personalizada basada en tu perfil y hábitos de navegación. Además, incluye enlaces a sitios externos con sus propias políticas de privacidad, las cuales podrás gestionar al visitarlos. Al hacer clic en Aceptar, consientes el uso de estas tecnologías y el tratamiento de tus datos para estos fines.   
Privacidad