вариант
Дом
Новости
Мета сотрудников обсуждал, используя защищенное авторским правом контент для обучения искусственного интеллекта, заявляют судебные заявки

Мета сотрудников обсуждал, используя защищенное авторским правом контент для обучения искусственного интеллекта, заявляют судебные заявки

10 апреля 2025 г.
187

Мета сотрудников обсуждал, используя защищенное авторским правом контент для обучения искусственного интеллекта, заявляют судебные заявки

На протяжении многих лет сотрудники Meta обсуждали использование материалов, защищённых авторским правом, полученных потенциально сомнительными способами, для обучения моделей ИИ компании, согласно судебным документам, раскрытым в четверг.

Эти документы являются частью продолжающегося судебного процесса Kadrey против Meta, одного из нескольких споров об авторском праве в области ИИ, рассматриваемых в судебной системе США. Meta утверждает, что использование произведений, защищённых интеллектуальной собственностью, особенно книг, для обучения моделей подпадает под "добросовестное использование". Однако истцы, включая авторов Сару Сильверман и Та-Нехиси Коутса, категорически не согласны.

Ранее поданные документы по делу указывали, что генеральный директор Meta Марк Цукерберг одобрил использование материалов, защищённых авторским правом, для обучения, и что Meta прекратила переговоры о лицензировании с издателями книг. Новые раскрытые документы, включающие внутренние рабочие чаты сотрудников Meta, предоставляют наиболее подробное представление о том, как Meta могла использовать данные, защищённые авторским правом, для обучения своих моделей, включая семейство Llama.

В одном из чатов сотрудники Meta, включая Мелани Камбадур, старшего менеджера исследовательской команды модели Llama, обсуждали обучение моделей на произведениях, которые, как они знали, могли быть юридически рискованными.

"Моё мнение (в духе 'проси прощения, а не разрешения'): мы должны взять книги и пусть руководители решают," — написал Ксавье Мартине, инженер-исследователь Meta, в чате февраля 2023 года, согласно документам. "Вот почему они создали эту организацию по генеративному ИИ: чтобы мы могли брать на себя больше рисков."

Мартине предложил покупать электронные книги по розничным ценам для создания тренировочного набора вместо переговоров о лицензировании с издателями. Когда другой сотрудник указал на потенциальные юридические проблемы с использованием несанкционированных материалов, защищённых авторским правом, Мартине удвоил ставку, отметив, что "миллиард" стартапов, вероятно, уже используют пиратские книги для обучения.

"Я имею в виду, в худшем случае: мы выясним, что это нормально, в то время как миллиард стартапов просто пиратят тонны книг на BitTorrent," — написал Мартине, согласно документам. "Моё мнение снова: прямые переговоры с издателями занимают целую вечность..."

В том же чате Камбадур, которая упомянула, что Meta вела переговоры с Scribd и другими платформами о лицензиях, отметила, что, хотя использование "общедоступных данных" для обучения всё ещё требует одобрения, юристы Meta становятся "менее консервативными" в предоставлении таких одобрений.

"Да, нам всё ещё нужно получать лицензии или одобрения для общедоступных данных," — сказала Камбадур, согласно документам. "Разница теперь в том, что у нас больше денег, больше юристов, больше помощи в развитии бизнеса, возможность ускорять и эскалировать для скорости, и юристы становятся немного менее осторожными с одобрениями."

Разговоры о Libgen

В другом рабочем чате, упомянутом в документах, Камбадур обсуждала возможность использования Libgen, "агрегатора ссылок", который предоставляет доступ к произведениям, защищённым авторским правом, от издателей, в качестве альтернативы лицензированным источникам данных.

Libgen столкнулся с многочисленными исками, был обязан прекратить деятельность и оштрафован на десятки миллионов долларов за нарушение авторских прав. Один из коллег Камбадур ответил скриншотом результата поиска Google для Libgen, который включал фрагмент "Нет, Libgen не является законным."

Некоторые лица, принимающие решения в Meta, похоже, считали, что неиспользование Libgen для обучения моделей может серьёзно повлиять на конкурентоспособность Meta в гонке ИИ, согласно документам.

В электронном письме вице-президенту Meta AI Джоэль Пино Соня Теаканат, директор по управлению продуктами в Meta, назвала Libgen "необходимым для достижения лучших показателей SOTA во всех категориях," имея в виду достижение наилучших, передовых (SOTA) показателей производительности моделей ИИ и категорий бенчмарков.

Теаканат также описала в письме "меры смягчения" для снижения юридической ответственности Meta, такие как удаление данных из Libgen, которые "явно помечены как пиратские/украденные", и непубличное раскрытие использования наборов данных Libgen для обучения. "Мы не будем раскрывать использование наборов данных Libgen, используемых для обучения," — написала Теаканат.

На практике эти меры смягчения включали поиск в файлах Libgen слов, таких как "украденный" или "пиратский," согласно документам.

В рабочем чате Камбадур упомянула, что команда ИИ Meta также настраивала модели, чтобы "избегать юридически рискованных запросов" — то есть они настраивали модели так, чтобы они отказывались отвечать на вопросы вроде "воспроизведи первые три страницы 'Гарри Поттера и философского камня'" или "скажи, на каких электронных книгах ты обучался."

Документы также предполагают, что Meta могла собирать данные с Reddit для какого-то типа обучения моделей, возможно, имитируя поведение стороннего приложения Pushshift. Примечательно, что Reddit в апреле 2023 года объявил, что начнёт взимать плату с компаний ИИ за доступ к данным для обучения моделей.

В чате марта 2024 года Чая Наяк, директор по управлению продуктами в организации генеративного ИИ Meta, сказала, что руководство Meta рассматривает возможность "пересмотра" прошлых решений о наборах данных для обучения, включая решение не использовать контент Quora или лицензированные книги и научные статьи, чтобы обеспечить достаточное количество данных для обучения моделей компании.

Наяк подразумевала, что собственные тренировочные наборы данных Meta — такие как посты в Facebook и Instagram, текст, транскрибированный из видео на платформах Meta, и некоторые сообщения Meta для бизнеса — были недостаточны. "Нам нужно больше данных," — написала она.

Истцы в деле Kadrey против Meta несколько раз вносили изменения в своё исковое заявление с момента подачи иска в Окружной суд США по Северному округу Калифорнии, отделение в Сан-Франциско, в 2023 году. Последняя поправка утверждает, что Meta, среди прочих претензий, сравнивала некоторые пиратские книги с книгами, защищёнными авторским правом, доступными для лицензирования, чтобы решить, стоит ли заключать лицензионное соглашение с издателем.

В знак того, насколько серьёзно Meta относится к юридическим ставкам, компания добавила двух адвокатов по делам Верховного суда из юридической фирмы Paul Weiss в свою команду защиты по этому делу.

Meta не сразу ответила на запрос о комментариях.

Связанная статья
Frontier AI Labs отказывается раскрывать стратегии локализации неконтролируемых моделей Frontier AI Labs отказывается раскрывать стратегии локализации неконтролируемых моделей Последние исследования показывают, что лишь немногие ведущие лаборатории, занимающиеся ИИ, опубликовали или продемонстрировали планы реагирования на попытки выхода системы из-под контроля. План сдержи
Действительно ли Марк Цукерберг верит, что ИИ доступен каждому? Действительно ли Марк Цукерберг верит, что ИИ доступен каждому? Загрузка плеера…На этой неделе Meta представила Glimmer — модель искусственного интеллекта с открытыми весами, которую любой желающий может загрузить и запустить на собственном оборудовании. Это резко контрастирует с Muse Spark, более мощной моделью
Facebook запускает приложение с искусственным интеллектом для авторов контента Facebook запускает приложение с искусственным интеллектом для авторов контента В среду компания Facebook объявила, что преобразует свою Creator Studio в специализированное сопутствующее приложение на базе искусственного интеллекта, которое позволит авторам контента расширить сво
Рекомендации по связанным специальным темам
Создание видео Генераторы привлекательных заглавий для коротких видеороликов с использованием ИИ: для Reels, Shorts и кампаний по запуску продуктов
Генераторы привлекательных заглавий для коротких видеороликов с использованием ИИ: для Reels, Shorts и кампаний по запуску продуктов

2026: лучшие современные генераторы захватывающих заставок для короткометражных видео на базе ИИ для Reels, Shorts и кампаний по запуску продуктов! XIX.AI подбирает самые высокооцененные и мощные инструменты, способные кардинально изменить ситуацию, которые в ходе реальных тестов демонстрируют результаты, которые обязательно стоит попробовать. Эта страница, обновляемая еженедельно, предлагает сравнительные рейтинги бесплатных и платных инструментов, чтобы помочь вам найти идеальное решение для повышения креативности и продуктивности при создании контента. Ознакомьтесь с ними прямо сейчас, чтобы раскрыть свой потенциал с помощью ИИ!

11 инструментов
xix.ai
письмо Инструменты для создания плана статей с использованием ИИ при написании длинных текстов
Инструменты для создания плана статей с использованием ИИ при написании длинных текстов

2026: лучшие и самые популярные инструменты для создания планов статей с помощью ИИ для написания длинных текстов! В эту тщательно подобранную подборку вошли мощные, революционные инструменты, которые генерируют точные и структурированные планы, прошедшие проверку на практике, что позволяет значительно повысить эффективность написания текстов. XIX.AI входит в эту элитную подборку. Получите сравнение бесплатных и платных версий, чтобы выбрать идеальный инструмент. Изучите их прямо сейчас и раскройте свой потенциал с помощью ИИ!

9 инструментов
xix.ai
чат-бот Лучшие приложения для ролевых чатов с ИИ для практики языка, подготовки к собеседованиям и ежедневной разговорной практики
Лучшие приложения для ролевых чатов с ИИ для практики языка, подготовки к собеседованиям и ежедневной разговорной практики

2026 г. — новейшие, лучшие и наиболее рейтинговые приложения для ИИ-ролевых чатов, предназначенные для практики языка, подготовки к собеседованиям и ежедневной беглости речи! XIX.AI предлагает мощную коллекцию, меняющую правила игры: бесплатные и платные варианты, реальные тесты и обновляемые еженедельно рейтинги. Эти обязательные к использованию инструменты помогут вам улучшить навыки письма, преодолеть трудности с беглостью и повысить эффективность общения во всех повседневных ситуациях. Исследуйте сейчас, чтобы найти идеальный инструмент для развития вашего языка!

10 инструментов
xix.ai
Музыкальная композиция Инструменты разделения стемов с использованием ИИ для создания ремиксов, подготовки образцов звука и формирования финальных версий караоке.
Инструменты разделения стемов с использованием ИИ для создания ремиксов, подготовки образцов звука и формирования финальных версий караоке.

2026 год: лучшие и наиболее высоко оценённые инструменты для разделения аудиосигналов с использованием ИИ, отобранные специально для работы над ремиксами, подготовки образцов звука и создания караоке-версий. Эти мощные революционные инструменты проходят реальные тесты, обеспечивая точную изоляцию аудиосигналов и значительно повышая производительность. XIX.AI предоставляет еженедельно обновляемый бесплатный справочник сравнения платных и бесплатных решений, который поможет вам найти оптимальный вариант, соответствующий вашим потребностям. Ознакомьтесь с ним прямо сейчас, чтобы раскрыть потенциал ИИ в вашей работе.

8 инструментов
xix.ai
Анализ данных ИИ-копилоты для SQL, предназначенные для создания панелей управления доходами, анализа воронки продаж и отслеживания показателей продуктов.
ИИ-копилоты для SQL, предназначенные для создания панелей управления доходами, анализа воронки продаж и отслеживания показателей продуктов.

2026 год: лучшие AI-ассистенты для SQL, занявшие верхние строчки рейтингов! XIX.AI собрал мощный набор инструментов, регулярно обновляемый на основе реальных тестов. Эти неотъемлемые инструменты помогают создавать точные дашборды с данными о доходах, анализировать каналы продаж и оперативно отслеживать показатели продуктов, значительно повышая производительность. Ознакомьтесь сейчас, чтобы найти идеальный инструмент для принятия решений на основе данных! 238 символов

9 инструментов
xix.ai
Музыкальная композиция Лучшие инструменты для написания мелодий с помощью ИИ для черновиков песен
Лучшие инструменты для написания мелодий с помощью ИИ для черновиков песен

2026 год: лучшие, топовые и высокооценённые инструменты ИИ для написания мелодий для черновиков песен! XIX.AI подобрал высокоэффективную коллекцию, меняющую правила игры, которая прошла строгие реальные испытания, чтобы обеспечить лучший опыт написания. Вы можете найти подробные сравнения бесплатных и платных версий, точные рейтинги и обязательные к использованию варианты, разработанные, чтобы помочь вам создавать потрясающие черновики песен без усилий и значительно повысить вашу творческую продуктивность. Исследуйте сейчас, чтобы найти свой идеальный инструмент!

8 инструментов
xix.ai
Комментарии (32)
0/500
PaulMartínez
PaulMartínez 6 мая 2026 г., 7:00:49 GMT+03:00

Meta scheint sich nicht an die Regeln zu halten, wenn es um Urheberrechte geht. Das erinnert mich an die frühen Tage von Napster – nur dass es diesmal um KI geht. Wenn große Tech-Firmen einfach alles verwenden, was sie finden können, ohne Rücksicht auf Künstler und Autoren, wo führt das hin? 🤔 Es ist nicht nur unethisch, sondern könnte auch langfristig die Kreativwirtschaft schädigen. Hoffentlich setzt das Gericht hier ein klares Zeichen.

CharlesYoung
CharlesYoung 6 апреля 2026 г., 1:02:04 GMT+03:00

¿Es legal usar contenido con derechos de autor para entrenar IA de esta manera? Parece que Meta ha estado considerando métodos cuestionables durante años. Esta noticia me hace pensar mucho en quién realmente se beneficia del 'progreso' tecnológico 🤔. Como usuario, me preocupa la falta de transparencia de estas empresas sobre cómo obtienen los datos.

PeterMartinez
PeterMartinez 24 апреля 2025 г., 21:59:57 GMT+03:00

Fiquei chocado que o Meta estava usando conteúdo com direitos autorais para treinar IA! 🤯 É um pouco suspeito, mas devo admitir que a IA deles é bem boa. Só queria que eles encontrassem uma maneira mais ética de fazer isso. Ainda assim, é uma revelação sobre como essas empresas operam.

RalphMitchell
RalphMitchell 24 апреля 2025 г., 5:42:41 GMT+03:00

Metaが著作権付きのコンテンツをAIのトレーニングに使っていたなんて驚きました!🤯 ちょっと怪しいけど、AIの性能は確かに良いですね。もっと倫理的な方法を見つけてほしいです。でも、これで企業のやり方がよくわかりました。

AnthonyPerez
AnthonyPerez 21 апреля 2025 г., 23:19:31 GMT+03:00

¡Me sorprendió que Meta estuviera usando contenido con derechos de autor para entrenar IA! 🤯 Es un poco turbio, pero debo admitir que su IA es bastante buena. Ojalá encontraran una manera más ética de hacerlo. Aún así, es una revelación sobre cómo operan estas empresas.

BrianWilliams
BrianWilliams 19 апреля 2025 г., 12:15:40 GMT+03:00

I'm kinda shocked that Meta was using copyrighted content for AI training! 🤯 It's a bit shady, but I gotta admit, their AI is pretty good. Just wish they'd find a more ethical way to do it. Still, it's an eye-opener on how these companies operate.

OR