El director ejecutivo de Reddit dice que Microsoft necesita pagar para buscar en el sitio


Después de llegar a acuerdos con Google y OpenAIEl director ejecutivo de Reddit, Steve Huffman, pide a Microsoft y a otros que paguen si quieren seguir recopilando datos del sitio.

“Sin estos acuerdos, no tenemos voz ni voto sobre cómo se muestran nuestros datos ni para qué se utilizan, lo que nos ha puesto en la posición de bloquear a personas que no han estado dispuestas a llegar a un acuerdo sobre cómo nos gustaría que se utilizaran o no nuestros datos”, dijo Huffman en una entrevista esta semana. Mencionó específicamente a Microsoft, Anthropic y Perplexity por negarse a negociar, diciendo que ha sido “un verdadero dolor de cabeza bloquear a estas empresas”.

Reddit ha intensificado su lucha contra los rastreadores en los últimos meses. A principios de julio, Su archivo robots.txt fue actualizado para bloquear los rastreadores web con los que no tiene acuerdos. Entonces La gente empezó a notarlo que los resultados de Reddit solo eran visibles en los resultados de Google (donde se le paga a Reddit para que se muestren sus datos) y no en otros motores de búsqueda como Bing.

Huffman dijo que Microsoft ha estado usando los datos de Reddit para entrenar su IA y resumir su contenido en los resultados de Bing «sin decirnos nada» y que los datos de Reddit también se han vendido a través de la API de Bing a otros motores de búsqueda. En la entrevista, hizo referencia al reciente comentario del director ejecutivo de IA de Microsoft, Mustafa Suleyman, en una conferencia de que los datos públicos En Internet hay “software gratuito”.

“Hemos visto a Microsoft, Anthropic y Perplexity actuar como si todo el contenido de Internet fuera gratuito para ellos”, dijo Huffman. “Esa es su verdadera postura”.

En respuesta a la reciente desaparición de los resultados de Reddit de Bing, el jefe de búsqueda de Microsoft, Jordi Ribas, dijo en X que “Reddit ha impedido que Bing rastree su sitio para realizar búsquedas, lo que favorece a otro motor de búsqueda y afecta la competencia de Bing y los motores basados ​​en Bing”. Caitlin Roulston, portavoz de Microsoft contado por separado El borde la semana pasada que “respetamos las instrucciones proporcionadas por los sitios web que no desean que el contenido de sus páginas se utilice con nuestros modelos de IA generativa”.

“El intercambio de valor tradicional de los motores de búsqueda ha cambiado”

Huffman señaló a OpenAI Anuncio reciente de SearchGPTque podrá mostrar los resultados de Reddit gracias a un acuerdo que ambas compañías alcanzaron a principios de este año, como el modelo que quiere replicar. Ninguno de los acuerdos de licencia de contenido que Reddit ha hecho hasta la fecha incluye casos de uso exclusivos para sus datos, según el portavoz Tim Rathschmidt.

Al pedir acuerdos de licencia, Reddit está… Unirse a más editores de medios tradicionales (incluido El borde La empresa matriz, Vox Media, busca un pago por permitir que su contenido alimente la IA generativa. “Creo que el intercambio de valor tradicional de los motores de búsqueda ha cambiado”, dijo Huffman. “La búsqueda, el resumen y el entrenamiento se están fusionando, y el intercambio de valor del rastreo a cambio del tráfico de vuelta se está volviendo confuso”.

Después de que se publicara esta historia, la portavoz de Anthropic, Jennifer Martínez, envió la siguiente declaración: “Reddit ha estado en nuestra lista de bloqueo para el rastreo web desde mediados de mayo y no hemos agregado ninguna URL de Reddit a nuestro rastreador desde entonces. Respetamos robots.txt, la señal aceptada por la industria para bloquear el rastreo web”.

Microsoft se negó a hacer comentarios para este artículo. Perplexity no respondió a una solicitud de comentarios.

Actualización, 31 de julio: Se agregó una declaración de Anthropic y se señaló que Microsoft se negó a hacer comentarios y Perplexity no respondió.



Fuente: The Verge

Compartir:

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Esta web utiliza cookies propias y de terceros para su funcionamiento, análisis, programas de afiliación y para mostrar publicidad personalizada basada en tu perfil y hábitos de navegación. Además, incluye enlaces a sitios externos con sus propias políticas de privacidad, las cuales podrás gestionar al visitarlos. Al hacer clic en Aceptar, consientes el uso de estas tecnologías y el tratamiento de tus datos para estos fines.   
Privacidad