Hogar
Varios medios de comunicación estadounidenses bloquean el rastreador «Wayback Machine» de Internet Archive para evitar el uso indebido en el entrenamiento de la IA
Según informa Wired, varios medios de comunicación y plataformas importantes —entre ellos The New York Times, Reddit y la empresa matriz de USA Today— han bloqueado recientemente la Wayback Machine de Internet Archive. La medida tiene por objeto impedir que las empresas de inteligencia artificial utilicen esta herramienta de archivo para extraer indirectamente material protegido por derechos de autor con el fin de entrenar sus modelos.

La ironía de bloquear mientras se se beneficia
Irónicamente, la reciente investigación en profundidad de USA Today sobre las estadísticas de la política de inmigración se basó en datos históricos conservados por la Wayback Machine. Sin embargo, el portavoz del grupo mediático afirmó que han bloqueado por completo todos los rastreadores, incluido el ia_archiverbot, para hacer frente al creciente riesgo de infracciones relacionadas con la IA.
Cómo están aplicando las restricciones las organizaciones de medios de comunicación
Al menos 23 sitios web de noticias de gran difusión han implementado ya restricciones:
Bloqueo total: The New York Times y Reddit han bloqueado directamente el rastreador específico de Wayback Machine.
Filtrado de la interfaz: The Guardian no ha bloqueado por completo los rastreadores, pero ha excluido su contenido de la API de Internet Archive y ha filtrado su interfaz de búsqueda, lo que dificulta enormemente a los usuarios el acceso a los archivos históricos.
En respuesta a estas medidas de bloqueo, más de 100 periodistas en activo, entre ellos Rachel Maddow, han firmado conjuntamente una carta de apoyo dirigida a la Electronic Frontier Foundation (EFF). En ella describen a Wayback Machine como una «herramienta indispensable» para la verificación de datos, el seguimiento de los cambios en el comportamiento de instituciones poderosas y la preservación de la historia digital.
Los editores sostienen que el hecho de que las empresas de inteligencia artificial entrenen sus modelos con los vastos datos de Internet Archive viola la ley de derechos de autor y compite directamente con ellos. Sin embargo, el director de Internet Archive, Mark Graham, advierte de que el cierre continuado de contenidos web públicos está socavando gravemente la capacidad de la sociedad para comprender las verdades históricas y ejercer la supervisión pública. Si esta tendencia continúa, una gran parte de los primeros registros digitales podría correr el riesgo de perderse por completo.
Artículo relacionado
CEO de DeepMind, Hassabis: Duermo seis horas al día y generalmente me siento con energía alrededor de la 1 a. m.
Fortune ha presentado recientemente una entrevista con Demis Hassabis, director ejecutivo de Google DeepMind, en la que revela su enfoque poco convencional para el descanso y la productividad. Hassabis ha revelado que duerme muy poco, estructurando s
OpenAI y Anthropic compiten por la cuota de mercado a pesar de la caída de los ingresos
A pesar de los recientes informes que sugieren que OpenAI no ha alcanzado sus objetivos de ingresos —lo que ha generado presión sobre las acciones tecnológicas este martes—, los inversores privados en
Cumplimiento de la normativa sobre vehículos autónomos en California: una nueva era de multas, geovallas y 1 millón de millas
Guident opera un servicio de transporte de AuveTech en el sur de Florida, gestionando una ruta de cuatro millas en West Palm Beach y otra de una milla en Boca Ratón mediante su tecnología de monitoriz
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
Según informa Wired, varios medios de comunicación y plataformas importantes —entre ellos The New York Times, Reddit y la empresa matriz de USA Today— han bloqueado recientemente la Wayback Machine de Internet Archive. La medida tiene por objeto impedir que las empresas de inteligencia artificial utilicen esta herramienta de archivo para extraer indirectamente material protegido por derechos de autor con el fin de entrenar sus modelos.

La ironía de bloquear mientras se se beneficia
Irónicamente, la reciente investigación en profundidad de USA Today sobre las estadísticas de la política de inmigración se basó en datos históricos conservados por la Wayback Machine. Sin embargo, el portavoz del grupo mediático afirmó que han bloqueado por completo todos los rastreadores, incluido el ia_archiverbot, para hacer frente al creciente riesgo de infracciones relacionadas con la IA.
Cómo están aplicando las restricciones las organizaciones de medios de comunicación
Al menos 23 sitios web de noticias de gran difusión han implementado ya restricciones:
Bloqueo total: The New York Times y Reddit han bloqueado directamente el rastreador específico de Wayback Machine.
Filtrado de la interfaz: The Guardian no ha bloqueado por completo los rastreadores, pero ha excluido su contenido de la API de Internet Archive y ha filtrado su interfaz de búsqueda, lo que dificulta enormemente a los usuarios el acceso a los archivos históricos.
En respuesta a estas medidas de bloqueo, más de 100 periodistas en activo, entre ellos Rachel Maddow, han firmado conjuntamente una carta de apoyo dirigida a la Electronic Frontier Foundation (EFF). En ella describen a Wayback Machine como una «herramienta indispensable» para la verificación de datos, el seguimiento de los cambios en el comportamiento de instituciones poderosas y la preservación de la historia digital.
Los editores sostienen que el hecho de que las empresas de inteligencia artificial entrenen sus modelos con los vastos datos de Internet Archive viola la ley de derechos de autor y compite directamente con ellos. Sin embargo, el director de Internet Archive, Mark Graham, advierte de que el cierre continuado de contenidos web públicos está socavando gravemente la capacidad de la sociedad para comprender las verdades históricas y ejercer la supervisión pública. Si esta tendencia continúa, una gran parte de los primeros registros digitales podría correr el riesgo de perderse por completo.
CEO de DeepMind, Hassabis: Duermo seis horas al día y generalmente me siento con energía alrededor de la 1 a. m.
Fortune ha presentado recientemente una entrevista con Demis Hassabis, director ejecutivo de Google DeepMind, en la que revela su enfoque poco convencional para el descanso y la productividad. Hassabis ha revelado que duerme muy poco, estructurando s
OpenAI y Anthropic compiten por la cuota de mercado a pesar de la caída de los ingresos
A pesar de los recientes informes que sugieren que OpenAI no ha alcanzado sus objetivos de ingresos —lo que ha generado presión sobre las acciones tecnológicas este martes—, los inversores privados en











