Дом
Reddit подал иск против компании Anthropic по поводу сбора данных о пользователях для обучения искусственного интеллекта
Reddit подал в суд на компанию Anthropic, утверждая, что она без разрешения собирала пользовательский контент с платформы для обучения своих моделей искусственного интеллекта Claude. В жалобе, поданной в суд штата Калифорния, говорится, что Anthropic сделала более 100 000 несанкционированных запросов к серверам Reddit, даже после того, как публично заявила, что прекратила их.
В иске утверждается, что Anthropic пренебрег как техническими гарантиями, так и условиями предоставления услуг. По мнению Reddit, Anthropic обходила такие средства защиты, как файл robots.txt, который предназначен для блокировки автоматического скраппинга. Платформа также утверждает, что Anthropic нарушает конфиденциальность пользователей, собирая и используя личные сообщения, включая удаленные материалы, для получения коммерческой выгоды.
Reddit отмечает, что предоставляет доступ к структурированным данным благодаря официальному лицензионному партнерству с такими компаниями, как OpenAI и Google. Эти соглашения включают пункты, регулирующие использование контента, защиту конфиденциальности и удаление данных. Reddit утверждает, что Anthropic отказался от заключения официального лицензионного соглашения, решив вместо этого напрямую соскабливать контент, чтобы избежать платы и обойти защиту пользователей.
В заявлении приводится исследовательская работа 2021 года, написанная в соавторстве с генеральным директором Anthropic Дарио Амодеем, в которой Reddit рассматривался как ценный источник данных для обучения языковых моделей. Reddit также представил примеры, когда Клод воспроизводил посты на Reddit почти дословно, включая контент, удаленный пользователями. Это, по мнению Reddit, свидетельствует о неспособности Anthropic внедрить средства защиты, которые уважают конфиденциальность пользователей или запросы на удаление контента.
Reddit требует возмещения денежного ущерба и судебного постановления, запрещающего Anthropic использовать контент Reddit в будущих итерациях своих моделей.
Anthropic ответила, заявив, что оспаривает обвинения и намерена защищаться. Однако это не первый судебный иск, с которым компания сталкивается в связи с практикой сбора данных об обучении.
В августе 2024 года группа авторов подала коллективный иск против Anthropic, утверждая, что компания использовала их работы, защищенные авторским правом, без согласия. Они утверждали, что компания обучала свои модели на книгах и других произведениях без разрешения, а затем потребовала компенсацию за использование контента.
Аналогичный иск, поданный в октябре 2023 года, касался Universal Music Group и других издателей, которые подали в суд на Anthropic за то, что она якобы воспроизводила тексты песен, защищенные авторским правом, с помощью своего чат-бота Claude. Музыкальные компании утверждали, что это нарушает их права на интеллектуальную собственность, и добивались судебного запрета на дальнейшее использование текстов песен.
В отличие от этих дел, иск Reddit не связан с авторскими правами. Вместо этого он сосредоточен на нарушении контракта и недобросовестной конкуренции. Reddit утверждает, что данные с его сайта не просто общедоступны - на них распространяются условия, которые Anthropic сознательно проигнорировала. Это различие может создать важный прецедент для платформ, которые размещают пользовательский контент, но пытаются регулировать его использование в коммерческих системах искусственного интеллекта.
Reddit также обвиняет Anthropic в введении общественности в заблуждение. В иске указывается на публичные заявления Anthropic, утверждающие, что она следует правилам скраппинга и уважает конфиденциальность пользователей - утверждения Reddit противоречат фактическому поведению компании.
"Несмотря на то, что говорится в ее маркетинговых материалах, Anthropic не заботится о правилах Reddit или пользователях", - говорится в жалобе. "Она считает, что имеет право безнаказанно брать любой контент и использовать его по своему усмотрению".
После объявления о подаче иска акции Reddit выросли почти на 67 %, что свидетельствует о поддержке инвесторами судебного иска. Результат может установить юридическую планку для балансировки открытого интернет-контента с правами пользователей и владельцев контента.
По мере того как все больше компаний с искусственным интеллектом зависят от огромных объемов онлайн-данных, юридические и этические последствия веб-скреппинга становятся все более актуальными. Дело Reddit вносит свой вклад в растущее число судебных исков, которые повлияют на следующий этап развития ИИ.
См. также: Этика в автоматизации: Решение проблемы предвзятости и соблюдения требований в ИИ
Хотите узнать больше об ИИ и больших данных от лидеров отрасли? Посетите выставку AI & Big Data Expo, которая пройдет в Амстердаме, Калифорнии и Лондоне. Это комплексное мероприятие проводится совместно с другими ведущими событиями, включая Intelligent Automation Conference, BlockX, Digital Transformation Week и Cyber Security & Cloud Expo.
Ознакомиться с другими предстоящими мероприятиями в области корпоративных технологий и вебинарами, проводимыми TechForge, можно здесь.
Связанная статья
Олли делает ставку на приватность, чтобы выиграть гонку за лидерство в сфере ИИ-помощников
Чтобы быть по-настоящему полезным, ИИ-помощник должен глубоко понимать своего пользователя. Ollie — личный помощник, разработанный для повседневной жизни, — работает по принципу, согласно которому для
Как на мероприятии AI LIVE: London будут рассматриваться темы искусственного интеллекта и промышленной автоматизации
На саммите соберутся руководители высшего звена со всего мира, чтобы обсудить актуальные проблемы мировых отраслей — от радикальных изменений, вызванных искусственным интеллектом, до экономической нес
Anthropic выходит на рынок юридических технологий ИИ по мере усиления конкуренции
Anthropic unveiled a suite of new chatbot capabilities on Tuesday, aimed at delivering automated support to legal practices. Эти инструменты были представлены во вторник и направлены на предоставление автоматизированной поддержки юридическим фирмам.
Рекомендации по связанным специальным темам
Комментарии (2)
RedditがAnthropicを訴えたのか!Claudeの学習に無断でデータ奪ったのは許せないよ😡 ユーザーの投稿がただの餌食にされるなんて、AI開発の傲慢さを感じます。賠償金いくらになるのか楽しみだけど、まずは謝罪からだな📜
Saw this on my feed and honestly not surprised at all. Another day another lawsuit over AI scraping data without consent 🤦♂️. Companies really need to get their act together on training data sources. How many more platforms will need to sue before proper rules are established? Feels like the wild west out here.
Reddit подал в суд на компанию Anthropic, утверждая, что она без разрешения собирала пользовательский контент с платформы для обучения своих моделей искусственного интеллекта Claude. В жалобе, поданной в суд штата Калифорния, говорится, что Anthropic сделала более 100 000 несанкционированных запросов к серверам Reddit, даже после того, как публично заявила, что прекратила их.
В иске утверждается, что Anthropic пренебрег как техническими гарантиями, так и условиями предоставления услуг. По мнению Reddit, Anthropic обходила такие средства защиты, как файл robots.txt, который предназначен для блокировки автоматического скраппинга. Платформа также утверждает, что Anthropic нарушает конфиденциальность пользователей, собирая и используя личные сообщения, включая удаленные материалы, для получения коммерческой выгоды.
Reddit отмечает, что предоставляет доступ к структурированным данным благодаря официальному лицензионному партнерству с такими компаниями, как OpenAI и Google. Эти соглашения включают пункты, регулирующие использование контента, защиту конфиденциальности и удаление данных. Reddit утверждает, что Anthropic отказался от заключения официального лицензионного соглашения, решив вместо этого напрямую соскабливать контент, чтобы избежать платы и обойти защиту пользователей.
В заявлении приводится исследовательская работа 2021 года, написанная в соавторстве с генеральным директором Anthropic Дарио Амодеем, в которой Reddit рассматривался как ценный источник данных для обучения языковых моделей. Reddit также представил примеры, когда Клод воспроизводил посты на Reddit почти дословно, включая контент, удаленный пользователями. Это, по мнению Reddit, свидетельствует о неспособности Anthropic внедрить средства защиты, которые уважают конфиденциальность пользователей или запросы на удаление контента.
Reddit требует возмещения денежного ущерба и судебного постановления, запрещающего Anthropic использовать контент Reddit в будущих итерациях своих моделей.
Anthropic ответила, заявив, что оспаривает обвинения и намерена защищаться. Однако это не первый судебный иск, с которым компания сталкивается в связи с практикой сбора данных об обучении.
В августе 2024 года группа авторов подала коллективный иск против Anthropic, утверждая, что компания использовала их работы, защищенные авторским правом, без согласия. Они утверждали, что компания обучала свои модели на книгах и других произведениях без разрешения, а затем потребовала компенсацию за использование контента.
Аналогичный иск, поданный в октябре 2023 года, касался Universal Music Group и других издателей, которые подали в суд на Anthropic за то, что она якобы воспроизводила тексты песен, защищенные авторским правом, с помощью своего чат-бота Claude. Музыкальные компании утверждали, что это нарушает их права на интеллектуальную собственность, и добивались судебного запрета на дальнейшее использование текстов песен.
В отличие от этих дел, иск Reddit не связан с авторскими правами. Вместо этого он сосредоточен на нарушении контракта и недобросовестной конкуренции. Reddit утверждает, что данные с его сайта не просто общедоступны - на них распространяются условия, которые Anthropic сознательно проигнорировала. Это различие может создать важный прецедент для платформ, которые размещают пользовательский контент, но пытаются регулировать его использование в коммерческих системах искусственного интеллекта.
Reddit также обвиняет Anthropic в введении общественности в заблуждение. В иске указывается на публичные заявления Anthropic, утверждающие, что она следует правилам скраппинга и уважает конфиденциальность пользователей - утверждения Reddit противоречат фактическому поведению компании.
"Несмотря на то, что говорится в ее маркетинговых материалах, Anthropic не заботится о правилах Reddit или пользователях", - говорится в жалобе. "Она считает, что имеет право безнаказанно брать любой контент и использовать его по своему усмотрению".
После объявления о подаче иска акции Reddit выросли почти на 67 %, что свидетельствует о поддержке инвесторами судебного иска. Результат может установить юридическую планку для балансировки открытого интернет-контента с правами пользователей и владельцев контента.
По мере того как все больше компаний с искусственным интеллектом зависят от огромных объемов онлайн-данных, юридические и этические последствия веб-скреппинга становятся все более актуальными. Дело Reddit вносит свой вклад в растущее число судебных исков, которые повлияют на следующий этап развития ИИ.
См. также: Этика в автоматизации: Решение проблемы предвзятости и соблюдения требований в ИИ
Хотите узнать больше об ИИ и больших данных от лидеров отрасли? Посетите выставку AI & Big Data Expo, которая пройдет в Амстердаме, Калифорнии и Лондоне. Это комплексное мероприятие проводится совместно с другими ведущими событиями, включая Intelligent Automation Conference, BlockX, Digital Transformation Week и Cyber Security & Cloud Expo.
Ознакомиться с другими предстоящими мероприятиями в области корпоративных технологий и вебинарами, проводимыми TechForge, можно здесь.
Олли делает ставку на приватность, чтобы выиграть гонку за лидерство в сфере ИИ-помощников
Чтобы быть по-настоящему полезным, ИИ-помощник должен глубоко понимать своего пользователя. Ollie — личный помощник, разработанный для повседневной жизни, — работает по принципу, согласно которому для
Как на мероприятии AI LIVE: London будут рассматриваться темы искусственного интеллекта и промышленной автоматизации
На саммите соберутся руководители высшего звена со всего мира, чтобы обсудить актуальные проблемы мировых отраслей — от радикальных изменений, вызванных искусственным интеллектом, до экономической нес
Anthropic выходит на рынок юридических технологий ИИ по мере усиления конкуренции
Anthropic unveiled a suite of new chatbot capabilities on Tuesday, aimed at delivering automated support to legal practices. Эти инструменты были представлены во вторник и направлены на предоставление автоматизированной поддержки юридическим фирмам.
RedditがAnthropicを訴えたのか!Claudeの学習に無断でデータ奪ったのは許せないよ😡 ユーザーの投稿がただの餌食にされるなんて、AI開発の傲慢さを感じます。賠償金いくらになるのか楽しみだけど、まずは謝罪からだな📜
Saw this on my feed and honestly not surprised at all. Another day another lawsuit over AI scraping data without consent 🤦♂️. Companies really need to get their act together on training data sources. How many more platforms will need to sue before proper rules are established? Feels like the wild west out here.











