Дом
Несколько американских СМИ заблокировали робот-сканер «Wayback Machine» от Internet Archive, чтобы предотвратить злоупотребления при обучении ИИ
Как сообщает Wired, несколько крупных СМИ и платформ — в том числе The New York Times, Reddit и материнская компания USA Today — недавно заблокировали доступ к сервису Wayback Machine, принадлежащему Internet Archive. Этот шаг призван помешать компаниям, занимающимся искусственным интеллектом, использовать данный архивный инструмент для косвенного сбора материалов, защищенных авторским правом, с целью обучения моделей.

Ирония блокировки при одновременной выгоде
Как ни парадоксально, недавнее подробное расследование USA Today, посвящённое статистике иммиграционной политики, опиралось именно на исторические данные, сохраненные сервисом Wayback Machine. Тем не менее представитель медиа-группы заявил, что они полностью заблокировали все сканеры, включая ia_archiverbot, чтобы противостоять растущему риску нарушений авторских прав со стороны ИИ.
Как медиаорганизации вводят ограничения
На данный момент ограничения ввели как минимум 23 крупных новостных сайта:
Полная блокировка: The New York Times и Reddit напрямую заблокировали специальный сканер Wayback Machine.
Фильтрация интерфейса: The Guardian не заблокировал сканеры полностью, но исключил свой контент из API Internet Archive и отфильтровал свой поисковый интерфейс, что значительно затрудняет пользователям доступ к историческим архивам.
В ответ на эти меры по блокировке более 100 действующих журналистов, в том числе Рэйчел Мэддоу, подписали письмо поддержки в адрес Electronic Frontier Foundation (EFF). Они описывают Wayback Machine как «незаменимый инструмент» для проверки фактов, отслеживания изменений в поведении влиятельных институтов и сохранения цифровой истории.
Издатели утверждают, что компании, занимающиеся обучением искусственного интеллекта на обширных данных Internet Archive, нарушают закон об авторском праве и напрямую конкурируют с ними. Однако директор Internet Archive Марк Грэм предупреждает, что продолжающееся закрытие общедоступного веб-контента серьезно подрывает способность общества понимать историческую правду и осуществлять общественный контроль. Если эта тенденция сохранится, значительная часть ранних цифровых записей может оказаться под угрозой полной утраты.
Связанная статья
Генеральный директор DeepMind Хассабис: я сплю шесть часов в день, обычно чувствую прилив энергии около часа ночи.
В недавнем интервью журналу Fortune генеральный директор Google DeepMind Демис Хаассабис раскрыл свой нестандартный подход к отдыху и продуктивности. Хаассабис признался, что спит очень мало, распределяя свои бодрствующие часы на два отдельных рабочи
OpenAI и Anthropic борются за долю рынка, несмотря на снижение выручки
Несмотря на недавние сообщения о том, что OpenAI не достигла целевых показателей по выручке, что во вторник оказало давление на акции технологических компаний, частные инвесторы, вкладывающие средства
Соблюдение требований к автономным транспортным средствам в Калифорнии: новая эра штрафов, геозоны и 1 млн миль
Компания Guident эксплуатирует шаттл AuveTech в Южной Флориде, обслуживая маршрут протяженностью четыре мили в Вест-Палм-Бич и маршрут протяженностью одну милю в Бока-Ратоне с использованием своей тех
Рекомендации по связанным специальным темам
Комментарии (0)
Как сообщает Wired, несколько крупных СМИ и платформ — в том числе The New York Times, Reddit и материнская компания USA Today — недавно заблокировали доступ к сервису Wayback Machine, принадлежащему Internet Archive. Этот шаг призван помешать компаниям, занимающимся искусственным интеллектом, использовать данный архивный инструмент для косвенного сбора материалов, защищенных авторским правом, с целью обучения моделей.

Ирония блокировки при одновременной выгоде
Как ни парадоксально, недавнее подробное расследование USA Today, посвящённое статистике иммиграционной политики, опиралось именно на исторические данные, сохраненные сервисом Wayback Machine. Тем не менее представитель медиа-группы заявил, что они полностью заблокировали все сканеры, включая ia_archiverbot, чтобы противостоять растущему риску нарушений авторских прав со стороны ИИ.
Как медиаорганизации вводят ограничения
На данный момент ограничения ввели как минимум 23 крупных новостных сайта:
Полная блокировка: The New York Times и Reddit напрямую заблокировали специальный сканер Wayback Machine.
Фильтрация интерфейса: The Guardian не заблокировал сканеры полностью, но исключил свой контент из API Internet Archive и отфильтровал свой поисковый интерфейс, что значительно затрудняет пользователям доступ к историческим архивам.
В ответ на эти меры по блокировке более 100 действующих журналистов, в том числе Рэйчел Мэддоу, подписали письмо поддержки в адрес Electronic Frontier Foundation (EFF). Они описывают Wayback Machine как «незаменимый инструмент» для проверки фактов, отслеживания изменений в поведении влиятельных институтов и сохранения цифровой истории.
Издатели утверждают, что компании, занимающиеся обучением искусственного интеллекта на обширных данных Internet Archive, нарушают закон об авторском праве и напрямую конкурируют с ними. Однако директор Internet Archive Марк Грэм предупреждает, что продолжающееся закрытие общедоступного веб-контента серьезно подрывает способность общества понимать историческую правду и осуществлять общественный контроль. Если эта тенденция сохранится, значительная часть ранних цифровых записей может оказаться под угрозой полной утраты.
Генеральный директор DeepMind Хассабис: я сплю шесть часов в день, обычно чувствую прилив энергии около часа ночи.
В недавнем интервью журналу Fortune генеральный директор Google DeepMind Демис Хаассабис раскрыл свой нестандартный подход к отдыху и продуктивности. Хаассабис признался, что спит очень мало, распределяя свои бодрствующие часы на два отдельных рабочи
OpenAI и Anthropic борются за долю рынка, несмотря на снижение выручки
Несмотря на недавние сообщения о том, что OpenAI не достигла целевых показателей по выручке, что во вторник оказало давление на акции технологических компаний, частные инвесторы, вкладывающие средства











