В суде раскрыли опасения OpenAI за будущее издателей
Внутренние документы могут осложнить защиту компании в споре об авторских правах.
В федеральном суде Манхэттена раскрывают ранее закрытые фрагменты документов по одному из главных споров об авторском праве в эпоху генеративного ИИ. The New York Times и другие издатели используют внутренние переписки OpenAI и Microsoft, чтобы оспорить ключевой тезис защиты: обучение моделей на журналистских текстах было «добросовестным использованием» и не подменяло оригинальные публикации.
Самая заметная формулировка появилась во внутренней записке OpenAI летом 2023 года. Ник Терли, руководивший развитием ChatGPT, писал, что ИИ представляет для издателей «экзистенциальную угрозу». Позже он отмечал, что по мере улучшения такие продукты будут всё сильнее заменять привычное потребление новостей. Для истцов это важно: один из центральных вопросов дела — наносит ли использование защищённых материалов ущерб рынку оригинальных произведений.
По версии издателей, сотрудник OpenAI также сообщил президенту компании Грегу Брокману о способе обойти платный доступ NYT. Брокман ответил: «ah nice». Истцы утверждают, что компания собирала крупные массивы новостных текстов через Common Crawl и другие источники. TechCrunch со ссылкой на материалы дела пишет, что один набор содержал более двух миллионов документов с домена nytimes.com.
Внутренние заметки директора Microsoft по прикладным наукам Брента Хехта содержали формулировки о «беспрецедентной краже» и риске разрушить информационную «цепочку поставок»: если издатели теряют стимул создавать материалы, у будущих моделей становится меньше качественного контента. Microsoft заявляет, что это была личная позиция сотрудника, а не юридическая оценка компании.
OpenAI и Microsoft по-прежнему настаивают, что обучение моделей преобразует исходные материалы и подпадает под fair use. Они отвергают тезис, что ChatGPT и Copilot юридически являются заменой журналистике. Судья Сидни Стайн рассматривает ходатайства о вынесении решения без полноценного процесса; вывода о нарушении авторских прав суд пока не сделал.
Financial Times отдельно приводит довод юристов NYT о записи Брокмана 2017 года, где якобы упоминались «несметные богатства» от коммерциализации ИИ. Но эта формулировка остаётся аргументом стороны истцов, а её первичный контекст в доступных открытых материалах прослеживается хуже, чем переписка об издателях и платном доступе.
Новые документы поэтому не доказывают дело автоматически, но меняют его фактуру. Издатели пытаются показать, что разработчики одновременно понимали риск замещения журналистики и строили продукты на массовом использовании её текстов. Насколько это повлияет на применение fair use, решит суд.
Внутренние опасения сотрудников сами по себе не доказывают нарушение авторского права. Но теперь суд оценивает не только то, как модель перерабатывает тексты, а и то, понимали ли разработчики возможный ущерб рынку, из которого эти тексты были взяты.
Фото: редакция ИЗНАНКИ.