вариант
Дом
Новости
Мета сотрудников обсуждал, используя защищенное авторским правом контент для обучения искусственного интеллекта, заявляют судебные заявки

Мета сотрудников обсуждал, используя защищенное авторским правом контент для обучения искусственного интеллекта, заявляют судебные заявки

10 апреля 2025 г.
189

Мета сотрудников обсуждал, используя защищенное авторским правом контент для обучения искусственного интеллекта, заявляют судебные заявки

На протяжении многих лет сотрудники Meta обсуждали использование материалов, защищённых авторским правом, полученных потенциально сомнительными способами, для обучения моделей ИИ компании, согласно судебным документам, раскрытым в четверг.

Эти документы являются частью продолжающегося судебного процесса Kadrey против Meta, одного из нескольких споров об авторском праве в области ИИ, рассматриваемых в судебной системе США. Meta утверждает, что использование произведений, защищённых интеллектуальной собственностью, особенно книг, для обучения моделей подпадает под "добросовестное использование". Однако истцы, включая авторов Сару Сильверман и Та-Нехиси Коутса, категорически не согласны.

Ранее поданные документы по делу указывали, что генеральный директор Meta Марк Цукерберг одобрил использование материалов, защищённых авторским правом, для обучения, и что Meta прекратила переговоры о лицензировании с издателями книг. Новые раскрытые документы, включающие внутренние рабочие чаты сотрудников Meta, предоставляют наиболее подробное представление о том, как Meta могла использовать данные, защищённые авторским правом, для обучения своих моделей, включая семейство Llama.

В одном из чатов сотрудники Meta, включая Мелани Камбадур, старшего менеджера исследовательской команды модели Llama, обсуждали обучение моделей на произведениях, которые, как они знали, могли быть юридически рискованными.

"Моё мнение (в духе 'проси прощения, а не разрешения'): мы должны взять книги и пусть руководители решают," — написал Ксавье Мартине, инженер-исследователь Meta, в чате февраля 2023 года, согласно документам. "Вот почему они создали эту организацию по генеративному ИИ: чтобы мы могли брать на себя больше рисков."

Мартине предложил покупать электронные книги по розничным ценам для создания тренировочного набора вместо переговоров о лицензировании с издателями. Когда другой сотрудник указал на потенциальные юридические проблемы с использованием несанкционированных материалов, защищённых авторским правом, Мартине удвоил ставку, отметив, что "миллиард" стартапов, вероятно, уже используют пиратские книги для обучения.

"Я имею в виду, в худшем случае: мы выясним, что это нормально, в то время как миллиард стартапов просто пиратят тонны книг на BitTorrent," — написал Мартине, согласно документам. "Моё мнение снова: прямые переговоры с издателями занимают целую вечность..."

В том же чате Камбадур, которая упомянула, что Meta вела переговоры с Scribd и другими платформами о лицензиях, отметила, что, хотя использование "общедоступных данных" для обучения всё ещё требует одобрения, юристы Meta становятся "менее консервативными" в предоставлении таких одобрений.

"Да, нам всё ещё нужно получать лицензии или одобрения для общедоступных данных," — сказала Камбадур, согласно документам. "Разница теперь в том, что у нас больше денег, больше юристов, больше помощи в развитии бизнеса, возможность ускорять и эскалировать для скорости, и юристы становятся немного менее осторожными с одобрениями."

Разговоры о Libgen

В другом рабочем чате, упомянутом в документах, Камбадур обсуждала возможность использования Libgen, "агрегатора ссылок", который предоставляет доступ к произведениям, защищённым авторским правом, от издателей, в качестве альтернативы лицензированным источникам данных.

Libgen столкнулся с многочисленными исками, был обязан прекратить деятельность и оштрафован на десятки миллионов долларов за нарушение авторских прав. Один из коллег Камбадур ответил скриншотом результата поиска Google для Libgen, который включал фрагмент "Нет, Libgen не является законным."

Некоторые лица, принимающие решения в Meta, похоже, считали, что неиспользование Libgen для обучения моделей может серьёзно повлиять на конкурентоспособность Meta в гонке ИИ, согласно документам.

В электронном письме вице-президенту Meta AI Джоэль Пино Соня Теаканат, директор по управлению продуктами в Meta, назвала Libgen "необходимым для достижения лучших показателей SOTA во всех категориях," имея в виду достижение наилучших, передовых (SOTA) показателей производительности моделей ИИ и категорий бенчмарков.

Теаканат также описала в письме "меры смягчения" для снижения юридической ответственности Meta, такие как удаление данных из Libgen, которые "явно помечены как пиратские/украденные", и непубличное раскрытие использования наборов данных Libgen для обучения. "Мы не будем раскрывать использование наборов данных Libgen, используемых для обучения," — написала Теаканат.

На практике эти меры смягчения включали поиск в файлах Libgen слов, таких как "украденный" или "пиратский," согласно документам.

В рабочем чате Камбадур упомянула, что команда ИИ Meta также настраивала модели, чтобы "избегать юридически рискованных запросов" — то есть они настраивали модели так, чтобы они отказывались отвечать на вопросы вроде "воспроизведи первые три страницы 'Гарри Поттера и философского камня'" или "скажи, на каких электронных книгах ты обучался."

Документы также предполагают, что Meta могла собирать данные с Reddit для какого-то типа обучения моделей, возможно, имитируя поведение стороннего приложения Pushshift. Примечательно, что Reddit в апреле 2023 года объявил, что начнёт взимать плату с компаний ИИ за доступ к данным для обучения моделей.

В чате марта 2024 года Чая Наяк, директор по управлению продуктами в организации генеративного ИИ Meta, сказала, что руководство Meta рассматривает возможность "пересмотра" прошлых решений о наборах данных для обучения, включая решение не использовать контент Quora или лицензированные книги и научные статьи, чтобы обеспечить достаточное количество данных для обучения моделей компании.

Наяк подразумевала, что собственные тренировочные наборы данных Meta — такие как посты в Facebook и Instagram, текст, транскрибированный из видео на платформах Meta, и некоторые сообщения Meta для бизнеса — были недостаточны. "Нам нужно больше данных," — написала она.

Истцы в деле Kadrey против Meta несколько раз вносили изменения в своё исковое заявление с момента подачи иска в Окружной суд США по Северному округу Калифорнии, отделение в Сан-Франциско, в 2023 году. Последняя поправка утверждает, что Meta, среди прочих претензий, сравнивала некоторые пиратские книги с книгами, защищёнными авторским правом, доступными для лицензирования, чтобы решить, стоит ли заключать лицензионное соглашение с издателем.

В знак того, насколько серьёзно Meta относится к юридическим ставкам, компания добавила двух адвокатов по делам Верховного суда из юридической фирмы Paul Weiss в свою команду защиты по этому делу.

Meta не сразу ответила на запрос о комментариях.

Связанная статья
Frontier AI Labs отказывается раскрывать стратегии локализации неконтролируемых моделей Frontier AI Labs отказывается раскрывать стратегии локализации неконтролируемых моделей Последние исследования показывают, что лишь немногие ведущие лаборатории, занимающиеся ИИ, опубликовали или продемонстрировали планы реагирования на попытки выхода системы из-под контроля. План сдержи
Действительно ли Марк Цукерберг верит, что ИИ доступен каждому? Действительно ли Марк Цукерберг верит, что ИИ доступен каждому? Загрузка плеера…На этой неделе Meta представила Glimmer — модель искусственного интеллекта с открытыми весами, которую любой желающий может загрузить и запустить на собственном оборудовании. Это резко контрастирует с Muse Spark, более мощной моделью
Facebook запускает приложение с искусственным интеллектом для авторов контента Facebook запускает приложение с искусственным интеллектом для авторов контента В среду компания Facebook объявила, что преобразует свою Creator Studio в специализированное сопутствующее приложение на базе искусственного интеллекта, которое позволит авторам контента расширить сво
Рекомендации по связанным специальным темам
Дизайн и искусство Инструменты искусственного интеллекта для создания визуальных стилей, предназначенные для создания характеристик персонажей, мудбордов и презентаций
Инструменты искусственного интеллекта для создания визуальных стилей, предназначенные для создания характеристик персонажей, мудбордов и презентаций

2026: лучшие современные инструменты на базе ИИ для создания визуальных стилей персонажей, мудбордов и презентаций — уже доступны на XIX.AI! В этом тщательно подобранном списке самых высокооцененных инструментов представлены мощные решения, способные кардинально изменить ваш подход к работе и прошедшие строгие тесты в реальных условиях. Здесь вы найдёте сравнение бесплатных и платных версий, подробные рейтинги и варианты, которые обязательно стоит попробовать, чтобы повысить творческий потенциал и оптимизировать рабочий процесс. Ознакомьтесь с ним прямо сейчас, чтобы найти идеальный инструмент для повышения продуктивности!

11 инструментов
xix.ai
SEO Лучшие инструменты для анализа результатов поиска с помощью ИИ при разработке поисковой стратегии
Лучшие инструменты для анализа результатов поиска с помощью ИИ при разработке поисковой стратегии

XIX.AI подготовила подборку лучших и наиболее высокооцененных инструментов для анализа результатов поиска с помощью ИИ (2026 г.) на основе тщательных тестов в реальных условиях и еженедельно обновляемого рейтинга. Эти мощные инструменты помогут вам раскрыть скрытые возможности оптимизации, повысить эффективность контента и получить конкурентное преимущество в поиске. Найдите свой идеальный инструмент, чтобы уже сегодня усовершенствовать свою поисковую стратегию. Ознакомьтесь с ними прямо сейчас!

13 инструментов
xix.ai
Анализ данных Лучшие инструменты ИИ для обнаружения аномалий при мониторинге KPI в командах SaaS и электронной коммерции
Лучшие инструменты ИИ для обнаружения аномалий при мониторинге KPI в командах SaaS и электронной коммерции

2026 г. Лучшие новейшие высокооцененные инструменты ИИ для обнаружения аномалий в мониторинге KPI для команд SaaS и электронной коммерции! XIX.AI подготовила мощную, меняющую правила игры коллекцию на основе строгих реальных тестов и еженедельно обновляемых рейтингов. Вы найдете подробные сравнительные данные по бесплатным и платным решениям, которые помогут вам определить обязательное к использованию решение, повышающее производительность и раскрывающее ваш потенциал в области ИИ. Исследуйте сейчас!

10 инструментов
xix.ai
письмо Лучшие генераторы конспектов на базе ИИ для длинных статей, оптимизированных для SEO
Лучшие генераторы конспектов на базе ИИ для длинных статей, оптимизированных для SEO

2026 год: лучшие и самые высокооцененные генераторы конспектов на базе ИИ для длинных SEO-статей, тщательно отобранные XIX.AI. Эти мощные инструменты обеспечивают революционную помощь в быстром создании высококачественного контента, значительно повышая эффективность написания текстов. Ознакомьтесь со сравнением бесплатных и платных версий, а также с результатами реальных тестов и подробными рейтингами, которые помогут вам найти вариант, который обязательно стоит попробовать и который соответствует вашим потребностям. Изучите их прямо сейчас, чтобы раскрыть весь потенциал ИИ.

8 инструментов
xix.ai
Образование и обучение Инструменты на базе искусственного интеллекта для выполнения домашних заданий и подготовки к экзаменам
Инструменты на базе искусственного интеллекта для выполнения домашних заданий и подготовки к экзаменам

2026: лучшие современные инструменты на базе ИИ для выполнения домашних заданий и подготовки к экзаменам! XIX.AI подготовило рейтинг самых эффективных и революционных инструментов, которые помогают учащимся повысить продуктивность, оптимизировать выполнение домашних заданий и сдавать экзамены на «отлично», проходя проверку в реальных условиях. Получите сравнение бесплатных и платных версий, подробные рейтинги и варианты, которые обязательно стоит попробовать, чтобы раскрыть свой потенциал с помощью ИИ. Узнайте больше прямо сейчас!

10 инструментов
xix.ai
Музыкальная композиция Инструменты для создания вокальных демо на основе ИИ для авторов песен, создания хуков, написания тоpline-мелодий и проведения многоязычных черновых сессий
Инструменты для создания вокальных демо на основе ИИ для авторов песен, создания хуков, написания тоpline-мелодий и проведения многоязычных черновых сессий

2026 г. лучшие инструменты для демо-записи вокала на базе ИИ для авторов песен, создателей хуков и команд, работающих с контентом на нескольких языках! XIX.AI подготовил список высокооцененных мощных инструментов, изменивших правила игры, прошедших строгие реальные тесты. Вы найдёте подробные данные сравнения бесплатных и платных версий, комплексные рейтинги и обязательные к использованию варианты, которые помогут повысить эффективность написания и раскрыть ваш творческий потенциал. Исследуйте сейчас, чтобы найти идеальный инструмент для всех ваших задач по созданию контента!

9 инструментов
xix.ai
Комментарии (32)
0/500
PaulMartínez
PaulMartínez 6 мая 2026 г., 7:00:49 GMT+03:00

Meta scheint sich nicht an die Regeln zu halten, wenn es um Urheberrechte geht. Das erinnert mich an die frühen Tage von Napster – nur dass es diesmal um KI geht. Wenn große Tech-Firmen einfach alles verwenden, was sie finden können, ohne Rücksicht auf Künstler und Autoren, wo führt das hin? 🤔 Es ist nicht nur unethisch, sondern könnte auch langfristig die Kreativwirtschaft schädigen. Hoffentlich setzt das Gericht hier ein klares Zeichen.

CharlesYoung
CharlesYoung 6 апреля 2026 г., 1:02:04 GMT+03:00

¿Es legal usar contenido con derechos de autor para entrenar IA de esta manera? Parece que Meta ha estado considerando métodos cuestionables durante años. Esta noticia me hace pensar mucho en quién realmente se beneficia del 'progreso' tecnológico 🤔. Como usuario, me preocupa la falta de transparencia de estas empresas sobre cómo obtienen los datos.

PeterMartinez
PeterMartinez 24 апреля 2025 г., 21:59:57 GMT+03:00

Fiquei chocado que o Meta estava usando conteúdo com direitos autorais para treinar IA! 🤯 É um pouco suspeito, mas devo admitir que a IA deles é bem boa. Só queria que eles encontrassem uma maneira mais ética de fazer isso. Ainda assim, é uma revelação sobre como essas empresas operam.

RalphMitchell
RalphMitchell 24 апреля 2025 г., 5:42:41 GMT+03:00

Metaが著作権付きのコンテンツをAIのトレーニングに使っていたなんて驚きました!🤯 ちょっと怪しいけど、AIの性能は確かに良いですね。もっと倫理的な方法を見つけてほしいです。でも、これで企業のやり方がよくわかりました。

AnthonyPerez
AnthonyPerez 21 апреля 2025 г., 23:19:31 GMT+03:00

¡Me sorprendió que Meta estuviera usando contenido con derechos de autor para entrenar IA! 🤯 Es un poco turbio, pero debo admitir que su IA es bastante buena. Ojalá encontraran una manera más ética de hacerlo. Aún así, es una revelación sobre cómo operan estas empresas.

BrianWilliams
BrianWilliams 19 апреля 2025 г., 12:15:40 GMT+03:00

I'm kinda shocked that Meta was using copyrighted content for AI training! 🤯 It's a bit shady, but I gotta admit, their AI is pretty good. Just wish they'd find a more ethical way to do it. Still, it's an eye-opener on how these companies operate.

OR