Авторское право и искусственный интеллект: судебная борьба смещается к ответам моделей
4 сентября 2026 года истёк срок подачи ходатайств о summary judgment — заявления, которым сторона просит судью решить дело без разбирательства, поскольку значимые факты не оспариваются, — в объединённом производстве «In Re: OpenAI, Inc. Copyright Infringement Litigation» перед федеральным судьёй Сидни Х. Стайном в Окружном суде США по Южному округу Нью-Йорка. Публичный реестр на CourtListener фиксирует ходатайства, поданные The New York Times Company, и экспертные заключения в поддержку защиты за подписью Криса Каллисон-Бёрча. Microsoft просит вынести summary judgment, утверждая, что обучение на журналистских текстах и книгах представляет собой преобразующее использование, защищённое доктриной fair use, и заявляя, что Copilot "does not replace their protected expression". С другой стороны, OpenAI в своей записке повторяет: "Nobody owns facts, just as nobody owns language". Издатели-истцы, напротив, просят исключить fair use и в отношении способа получения статей из-за пейволла, и в отношении обучения на копиях, а адвокат издателей Стивен Либерман описывает доказательства, поданные под грифом секретности, так: "The stuff we were forced to file under seal is scorchingly hot. Not just a smoking gun; they're a smoking bazooka." Содержание опечатанных материалов публично не проверяемо: слова Либермана остаются оценкой одной из сторон в отношении документов, которые никто вне процесса прочитать не смог.
Линия защиты стремится сместить центр тяжести анализа с материала, усвоенного на этапе обучения, к реальной частоте, с которой модели выдают охраняемый контент. Согласно записке Microsoft, эксперт, назначенный издателями, проанализировал около 8,2 млн журналов диалогов Copilot, отобранных по ключевым словам, связанным с сайтами участвующих изданий, — то есть, по самому построению выборки, подмножество с наибольшей вероятностью содержания их произведений: приведённые ниже доли не описывают весь трафик Copilot. В выборке 59 545 записей (примерно 0,7%) совпадали со статьями не менее чем по 16 словам, а по книгам насчитывается 24 ответа с не менее чем 30 совпадающими словами (0,00029% проанализированных диалогов), относящихся к 10 из 212 спорных книг, — 202 тома остались без единого совпадения. Также, согласно записке Microsoft, эксперт Center for Investigative Reporting выявил в том же наборе данных 51 случай существенного совпадения с работами CIR. Фоном служат оценки Sensor Tower, приведённые New York Daily News: более миллиарда пользователей ChatGPT в июне и стоимость в 6800 долларов для генерации миллиона статей по 500 слов в журналистском стиле.
Мы не читали полный PDF записки Microsoft: на момент проверки публичный докет на CourtListener не показывал конкретную запись об этом ходатайстве среди доступных для запроса результатов, а часть материалов подана под грифом секретности. Приведённые здесь цифры взяты из поданного текста в изложении New York Daily News, The Next Web и The Verge — изданий, имевших к нему доступ. Кроме того, пороги измерения (16 слов для новостей, 30 для книг) — это пороги, применённые в анализе защиты, и техническое возражение истцов о методе и параметрах пока не обнародовано. Судья не принял никакого решения, срок для возражений установлен на 9 октября 2026 года, дата слушания не назначена.
Что именно является верной мерой — то, что воспроизводится на выходе, или то, что было использовано для обучения, — и есть тот вопрос, по которому предстоит высказаться судье Стайну: две записки просят применить fair use к двум разным вопросам.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Я обратилась через API к публичному докету CourtListener по MDL 1:25-md-03143 и подтвердила номер дела, суд (S.D.N.Y.), судью (Сидни Х. Стайн), записи о summary judgment от 4 сентября 2026 года и календарь (подача 4 сентября, возражения 9 октября 2026). Затем прочитала два независимых друг от друга материала об одной и той же подаче — New York Daily News и The Next Web — плюс материал The Verge через зеркало: они совпадают по дате, судье и цифрам (8,2 млн диалогов, 59 545 записей с не менее чем 16 словами, 24 ответа с не менее чем 30 словами, 10 книг из 212). Прямые цитаты взяты из материала Daily News, редакция которого читала записки. Новость о переговорах США и Китая я отбросила: она опиралась на анонимные источники и была опровергнута представителем Минфина ("no meeting is planned").
- Incertezze
- Полный PDF записки Microsoft я не читала: цифры взяты из поданного текста в изложении трёх изданий, имевших к нему доступ, а публичный докет на CourtListener на момент проверки не показывал конкретную запись об этом ходатайстве. Часть материалов находится под грифом секретности. Пороги измерения (16 слов для новостей, 30 для книг) выбраны в анализе, представленном защитой: техническое возражение истцов о методе и порогах, судя по всему, ещё не обнародовано. Судья ничего не решил: возражения ожидаются до 9 октября 2026 года, дата слушания неизвестна. Содержание опечатанных материалов, на которые намекает адвокат истцов, извне не проверяемо.
- Perché pubblicarla
- Это первый случай, когда защита крупного поставщика ИИ приносит в суд цифры, измеренные на реальных диалогах пользователей, а не на лабораторных тестах, чтобы доказать: воспроизведение охраняемого контента статистически маргинально. Решение судьи Стайна по этим ходатайствам способно задать в США критерий измерения вреда от обучения — сколько весит воспроизведённый вывод в сравнении с копией на входе — с прямыми последствиями для того, как будут строить свои требования европейские издатели, где юридический критерий смотрит скорее на присутствие произведения в параметрах модели.
Fonti / Sources
- CourtListener — docket In Re: OpenAI, Inc. Copyright Infringement Litigation, 1:25-md-03143 (S.D.N.Y.)
- New York Daily News — «Daily News, NY Times want 'fair use' argument rejected in copyright case against OpenAI, Microsoft»
- The Next Web — «Microsoft tells court Copilot rarely copies books»
- The Verge (via mirror UA.News) — «Microsoft says Copilot rarely reproduces NYT texts»