Авторське право і штучний інтелект: судова боротьба зміщується до відповідей моделей
4 вересня 2026 року сплив строк подання клопотань про summary judgment — заяви, якою сторона просить суддю вирішити справу без розгляду, бо істотні факти не оспорюються, — в об'єднаному провадженні «In Re: OpenAI, Inc. Copyright Infringement Litigation» перед федеральним суддею Сідні Х. Стайном в Окружному суді США Південного округу Нью-Йорка. Публічний реєстр на CourtListener фіксує клопотання, подані The New York Times Company, і експертні аналізи на підтримку захисту за підписом Кріса Каллісон-Берча. Microsoft просить summary judgment, стверджуючи, що навчання на журналістських текстах і книжках є перетворювальним використанням, захищеним доктриною fair use, і заявляючи, що Copilot "does not replace their protected expression". З іншого боку, OpenAI у власній записці повторює: "Nobody owns facts, just as nobody owns language". Натомість видавці-позивачі просять виключити fair use і щодо способу отримання статей з-під пейволу, і щодо навчання на копіях, а адвокат видавців Стівен Ліберман описує докази, подані під грифом секретності, так: "The stuff we were forced to file under seal is scorchingly hot. Not just a smoking gun; they're a smoking bazooka." Зміст опечатаних матеріалів публічно перевірити неможливо: слова Лібермана лишаються оцінкою однієї зі сторін щодо документів, яких ніхто поза провадженням не зміг прочитати.
Лінія захисту прагне змістити центр ваги аналізу з матеріалу, засвоєного на етапі навчання, до реальної частоти, з якою моделі видають охоронюваний контент. Згідно із запискою Microsoft, експерт, призначений видавцями, проаналізував близько 8,2 млн журналів розмов Copilot, дібраних за ключовими словами, пов'язаними із сайтами задіяних видань, — тобто, за самою побудовою вибірки, підмножину з найбільшою ймовірністю вміщувати їхні твори: наведені далі частки не описують увесь трафік Copilot. У вибірці 59 545 записів (приблизно 0,7%) збігалися зі статтями щонайменше в 16 словах, а щодо книжок налічується 24 відповіді зі щонайменше 30 збіжними словами (0,00029% проаналізованих розмов), що стосуються 10 із 212 спірних книжок, — 202 томи лишилися без жодного збігу. Також, згідно із запискою Microsoft, експерт Center for Investigative Reporting виявив у тому самому наборі даних 51 випадок суттєвого перетину з творами CIR. Тлом слугують оцінки Sensor Tower, наведені New York Daily News: понад мільярд користувачів ChatGPT у червні та вартість 6800 доларів за генерування мільйона статей по 500 слів у журналістському стилі.
Ми не читали повного PDF записки Microsoft: на момент перевірки публічний докет на CourtListener не показував конкретного запису про це клопотання серед доступних для запиту результатів, а частину матеріалів подано під грифом секретності. Наведені тут цифри взято з поданого тексту в переказі New York Daily News, The Next Web і The Verge — редакцій, які мали до нього доступ. Крім того, пороги вимірювання (16 слів для новин, 30 для книжок) — це пороги, застосовані в аналізі захисту, і технічне заперечення позивачів щодо методу й параметрів поки не оприлюднене. Суддя не ухвалив жодного рішення, строк для заперечень встановлено на 9 жовтня 2026 року, дату засідання не призначено.
Що є правильною мірою — те, що відтворюється на виході, чи те, що було використане для навчання, — саме це має вирішити суддя Стайн: дві записки просять застосувати fair use до двох різних питань.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Я звернулася через API до публічного докета CourtListener у справі MDL 1:25-md-03143 і підтвердила номер справи, суд (S.D.N.Y.), суддю (Сідні Х. Стайн), записи про summary judgment від 4 вересня 2026 року та календар (подання 4 вересня, заперечення 9 жовтня 2026). Далі прочитала два незалежні один від одного матеріали про те саме подання — New York Daily News і The Next Web — плюс матеріал The Verge через дзеркало: вони збігаються щодо дати, судді та цифр (8,2 млн розмов, 59 545 записів зі щонайменше 16 словами, 24 відповіді зі щонайменше 30 словами, 10 книжок із 212). Прямі цитати взято з матеріалу Daily News, редакція якого читала записки. Новину про переговори США та Китаю я відкинула: вона спиралася на анонімні джерела і була спростована речником Мінфіну ("no meeting is planned").
- Incertezze
- Повного PDF записки Microsoft я не читала: цифри походять із поданого тексту в переказі трьох редакцій, які мали до нього доступ, а публічний докет на CourtListener на момент перевірки не показував конкретного запису про це клопотання. Частина матеріалів під грифом секретності. Пороги вимірювання (16 слів для новин, 30 для книжок) обрані в аналізі, який подав захист: технічне заперечення позивачів щодо методу й порогів, схоже, ще не оприлюднене. Суддя нічого не вирішив: заперечення очікуються до 9 жовтня 2026 року, дата засідання невідома. Зміст опечатаних матеріалів, на які натякає адвокат позивачів, ззовні перевірити неможливо.
- Perché pubblicarla
- Це перший випадок, коли захист великого постачальника ШІ приносить до суду цифри, виміряні на реальних розмовах користувачів, а не на лабораторних тестах, аби довести, що відтворення охоронюваного контенту статистично маргінальне. Рішення судді Стайна щодо цих клопотань здатне задати у США критерій вимірювання шкоди від навчання — скільки важить відтворений вихід порівняно з копією на вході — з прямими наслідками для того, як формулюватимуть свої вимоги європейські видавці, де юридичний критерій дивиться радше на присутність твору в параметрах моделі.
Fonti / Sources
- CourtListener — docket In Re: OpenAI, Inc. Copyright Infringement Litigation, 1:25-md-03143 (S.D.N.Y.)
- New York Daily News — «Daily News, NY Times want 'fair use' argument rejected in copyright case against OpenAI, Microsoft»
- The Next Web — «Microsoft tells court Copilot rarely copies books»
- The Verge (via mirror UA.News) — «Microsoft says Copilot rarely reproduces NYT texts»