Кратко

  • Документы, рассекреченные в четверг, взяты из иска New York Times о нарушении авторских прав против OpenAI и Microsoft.
  • В служебной записке Microsoft 2023 года предупреждалось, что общественность увидит, как модели «высасывают» их работу, как «кражу беспрецедентных масштабов».
  • Генеральный директор Microsoft Сатья Наделла показал, что всё, что находится за платной подпиской, должно лицензироваться любым, кто хочет это использовать.

Сотрудники Microsoft обсуждали, является ли использование OpenAI новостных статей «крупнейшей кражей труда в истории человечества» и может ли это вызвать «цикл обречённости», который ухудшит модели, которые они создавали, согласно судебным документам, рассекреченным в четверг иопубликованным газетой New York Times.

Эти материалы взяты из иска, который Timesподала против обеих компаний в конце 2023 года, к которому с тех пор присоединились ещё одиннадцать издателей. OpenAI на протяжении всего процессаоспаривала эти утверждения, и дело уже вынудило еёсохранить 20 миллионов журналов разговоров ChatGPT. Судья Сидни Стайн из Южного округа Нью-Йорка рассматривает ходатайства о вынесении решения в упрощённом порядке, и по мере этого документы рассекречиваются.

«Миллионы людей по всему миру вскоре сочтут, что крупные модели, „высасывающие“ всю их работу, — это поразительная кража беспрецедентных масштабов», — говорится в одном внутреннем документе Microsoft 2023 года. Крупные ИИ-модели «являются продуктом, который разрушает свою цепочку поставок», — написал тот же автор.

Microsoft утверждает, что эти служебные записки были написаны Брентом Хехтом, директором по прикладной науке, который также занимал должность в Северо-Западном университете, и не отражают точку зрения компании. Он не был лицом, принимающим решения, и был нанят, чтобы «представлять расходящиеся и асимметричные точки зрения», говорится в судебном документе.

«Оставляя беспорядок на ковре»

Сатья Наделла, генеральный директор Microsoft, показал, что «всё, что находится за платной подпиской, должно лицензироваться любым, кто хочет это использовать», и сказал, что если бы он знал, что OpenAI обучается на контенте за платной подпиской, он воспользовался бы правом Microsoft заставить её переобучить свои модели. Представитель заявил, что он «говорил об общих принципах» относительно того, как люди находят и потребляют информацию.

В OpenAI сотрудник рассказал президенту Грегу Брокману о создании «взлома» для обхода платного доступа NYT. Брокман ответил: «а, мило».

Myriad: OpenAI или Anthropic проведут IPO первыми? Нажмите, чтобы сделать свой прогноз.
Myriad: OpenAI или Anthropic проведут IPO первыми? Нажмите, чтобы сделать свой прогноз.

Ник Тёрли, руководивший командой ChatGPT, в июне 2023 года писал, что ИИ представляет «экзистенциальную угрозу» для издателей, а в феврале 2024 года — что продукты на основе ИИ «будут становиться всё более и более заменяющими по мере своего совершенствования». В другом месте он писал, что ИИ-«продукты в значительной степени являются заменяющими, и точка».

Инженер OpenAI в феврале 2023 года писал, что «как бы заметно мы ни показывали ссылки, пользователи не будут по ним кликать», — вывод, который противоречит аргументу о том, что чат-боты направляют трафик обратно издателям.

В служебной записке 2020 года, адресованной Брокману и Сэму Альтману, тогдашний директор по политике Джек Кларк предупреждал, что компания «создаёт системы, которые заменяют труд людей, определяющих „культуру“ общества», и что они «станут символом того, как Кремниевая долина бездумно вторгается в другие сферы жизни и оставляет беспорядок на ковре». Кларк ушёл, чтобы стать соучредителем Anthropic, которая перенаправила запрос о комментарии от Times в OpenAI.

И Microsoft, и OpenAI утверждают, что обучение было добросовестным использованием, преобразующим статьи в новую работу, а не заменяющим оригиналы. «Мир может увидеть, что OpenAI и Microsoft всё это время думали о справедливости собственного поведения», — сказал Стивен Либерман, представляющий New York Daily News и ещё семь газет.

Times, истец по этому делу, отказался от комментариев своим собственным репортёрам, которые сообщили, что OpenAI не ответила на запросы о комментарии.