Коротко

  • Розсекречені в четвер документи походять із позову New York Times щодо авторських прав проти OpenAI та Microsoft.
  • У службовій записці Microsoft 2023 року попереджалося, що громадськість сприйматиме те, як моделі «висмоктують» їхню працю, як «крадіжку безпрецедентних масштабів».
  • Генеральний директор Microsoft Сатья Наделла засвідчив, що будь-який контент за платною підпискою має ліцензуватися тим, хто хоче його використовувати.

Співробітники Microsoft обговорювали, чи використання OpenAI новинних статей є «найбільшою крадіжкою праці в історії людства» і чи може це запустити «цикл приреченості», який погіршить моделі, які вони створювали, згідно з судовими документами, розсекреченими в четвер і про які повідомила New York Times.

Ці матеріали походять із позову, який Timesподала проти обох компаній наприкінці 2023 року, до якого згодом приєдналися ще одинадцять видавців. OpenAI оспорювала ці твердження протягом усього часу, і справа вже змусила її зберегти 20 мільйонів журналів розмов ChatGPT. Суддя Сідні Стайн із Південного округу Нью-Йорка розглядає клопотання про спрощене судове провадження, і документи розсекречуються в міру цього розгляду.

«Мільйони людей у всьому світі незабаром вважатимуть, що великі моделі, які „висмоктують“ усю їхню працю, — це приголомшлива крадіжка безпрецедентних масштабів», — ідеться в одному внутрішньому документі Microsoft 2023 року. Великі ШІ-моделі «є продуктом, який руйнує свій ланцюг постачання», — писав той самий автор.

Microsoft заявляє, що ці записки написав Брент Гехт, директор із прикладної науки, який також обіймав посаду в Північно-Західному університеті, і вони не відображають поглядів компанії. Він не був особою, що ухвалює рішення, і був найнятий, щоб «представляти розбіжні та асиметричні перспективи», ідеться в судовому документі.

«Залишаючи безлад на килимі»

Сатья Наделла, генеральний директор Microsoft, засвідчив, що «будь-який контент за платною підпискою має ліцензуватися будь-ким, хто хоче його використовувати», і сказав, що якби він знав, що OpenAI тренується на контенті за платною підпискою, він скористався б правом Microsoft змусити її перенавчити свої моделі. Речник сказав, що він «говорив про широкі принципи» щодо того, як люди знаходять і споживають інформацію.

В OpenAI співробітник розповів президенту Грегу Брокману про створення «хакерського способу», щоб обійти платну підписку NYT. Брокман відповів: «ах, класно».

Myriad: OpenAI or Anthropic IPOs first? Click to make your prediction.
Myriad: OpenAI чи Anthropic проведуть IPO першими? Натисніть, щоб зробити свій прогноз.

Нік Терлі, який керував командою ChatGPT, у червні 2023 року писав, що ШІ становить "екзистенційну загрозу" для видавців, а в лютому 2024 року — що ШІ-продукти "ставатимуть дедалі більш замінними в міру свого вдосконалення". В іншому місці він писав, що ШІ "продукти здебільшого є замінними, і крапка".

Інженер OpenAI у лютому 2023 року писав, що "хоч би як помітно ми показували посилання, користувачі не клікатимуть", — висновок, який суперечить аргументу, що чат-боти повертають трафік видавцям.

У службовій записці 2020 року до Брокмана й Сема Альтмана тодішній директор із політики Джек Кларк попереджав, що компанія "створює системи, які замінюють працю людей, що визначають 'культуру' суспільства", і що вони "стануть символом того, як Кремнієва долина бездумно втручається в інші сфери життя й залишає безлад на килимі". Кларк пішов, щоб співзаснувати Anthropic, яка перенаправила запит на коментар від Times до OpenAI.

І Microsoft, і OpenAI стверджують, що навчання було добросовісним використанням, перетворюючи статті на новий твір, а не замінюючи оригінали. "Світ може побачити, що OpenAI і Microsoft весь час думали про справедливість власної поведінки", — сказав Стівен Ліберман, який представляє New York Daily News та ще сім газет.

Times, позивач у цій справі, відмовився коментувати своїм власним репортерам, які повідомили, що OpenAI не відповіла на запити про коментар.