В деле об обучении ИИ появились внутренние сообщения OpenAI и Microsoft
Суду представили переписку руководителей и сотрудников о влиянии чат-ботов на издателей и трафик сайтов. Материал стал частью продолжающегося спора о добросовестном использовании контента.
Переписка компаний в суде
В деле о законности обучения ИИ суду представили ранее не публиковавшиеся письма, сообщения и показания руководителей OpenAI и Microsoft. Сотрудники обсуждали риск вытеснения издателей и снижения переходов на исходные сайты.
Глава ChatGPT Ник Тёрли называл ситуацию «экзистенциальной угрозой», а инженер OpenAI сомневался, что пользователи будут переходить по ссылкам. Сатья Наделла под присягой подтвердил, что ответы чат-ботов могут заменять посещения оригинальных сайтов.
Значение для спора
Эти материалы дополняют спор о добросовестном использовании защищённого контента для обучения моделей и понимании компаниями влияния продуктов.
Переписка сама по себе не устанавливает нарушение авторских прав. Судебное дело продолжается; окончательного решения в материале нет.
В иске участвуют The New York Times, Chicago Tribune и Denver Post через группу Daily News, Ziff Davis, Center for Investigative Reporting и The Intercept; истцы требуют миллиарды долларов, сообщает Financial Times. Это сводное разбирательство включает несколько исков, начиная с подачи The New York Times в декабре 2023 года.
В документах фигурируют внутренние сообщения Microsoft о масштабах использования материалов и показания о том, что чат-боты конкурируют за внимание аудитории. Эти сведения представляют аргументы истцов в ходатайстве о вынесении решения, а не вывод суда о добросовестном использовании.
Внутренняя оценка Microsoft показала, что переходов к материалам The New York Times из Copilot было на 87–93% меньше, чем из обычного Bing; для Daily News разница составляла 83–91%, для Ziff Davis — 51–94%. Эти диапазоны относятся к указанным издателям и внутренним данным Microsoft, процитированным в судебных материалах.
Истцы утверждают, что OpenAI обходила платный доступ и использовала 1,8 млн статей NYT вопреки ограниченной лицензии; OpenAI не смогла назвать способ выявления платных материалов в обучающих данных. После подачи исков компания добавила фильтр, который ограничивает воспроизведение спорного контента. Все это — аргументы сторон и представленные документы, а не вынесенное судом заключение о нарушении.