W skrócie

  • Dokumenty odtajnione w czwartek pochodzą z pozwu o prawa autorskie, który New York Times złożył przeciwko OpenAI i Microsoft.
  • Notatka Microsoftu z 2023 roku ostrzegała, że społeczeństwo uzna „pochłanianie” ich pracy przez modele za „kradzież na niespotykaną skalę”.
  • Dyrektor generalny Microsoftu, Satya Nadella, zeznał, że wszystko, co jest za paywallem, powinno być licencjonowane przez każdego, kto chce z tego korzystać.

Pracownicy Microsoftu dyskutowali, czy wykorzystanie artykułów prasowych przez OpenAI stanowi „największą kradzież pracy w historii ludzkości” i czy może wywołać „pętlę zagłady”, która zdegraduje budowane przez nich modele, zgodnie z dokumentami sądowymi odtajnionymi w czwartek iopisane przez New York Times.

Dokumenty pochodzą z pozwu, który Timeswniósł przeciwko obu firmom pod koniec 2023 roku, do którego dołączyło od tego czasu jedenaście innych wydawców. OpenAI przez cały czaskwestionowało te roszczenia, a sprawa zmusiła już firmę dozachowania 20 milionów logów rozmów ChatGPT. Sędzia Sidney Stein z Południowego Dystryktu Nowego Jorku rozpatruje wnioski o wyrok w trybie uproszczonym, a dokumenty są odtajniane w miarę tego procesu.

„Miliony ludzi na całym świecie wkrótce uznają, że duże modele »pochłaniają« całą ich pracę, za zdumiewającą kradzież na niespotykaną skalę” – głosił jeden z wewnętrznych dokumentów Microsoftu z 2023 roku. Duże modele AI „są produktem, który niszczy swój łańcuch dostaw” – napisał ten sam autor.

Microsoft twierdzi, że te notatki zostały napisane przez Brenta Hechta, dyrektora ds. nauk stosowanych, który zajmował również stanowisko na Northwestern University, i nie reprezentują poglądów firmy. Nie był decydentem i został zatrudniony, aby „przedstawiać rozbieżne i asymetryczne perspektywy” – stwierdzono w dokumencie sądowym.

„Zostawianie bałaganu na dywanie”

Satya Nadella, dyrektor generalny Microsoftu, zeznał, że „wszystko, co jest za paywallem, powinno być licencjonowane przez każdego, kto chce z tego korzystać”, i powiedział, że gdyby wiedział, iż OpenAI trenuje na treściach za paywallem, skorzystałby z prawa Microsoftu, aby zmusić je do ponownego trenowania swoich modeli. Rzecznik powiedział, że „mówił o ogólnych zasadach” dotyczących tego, jak ludzie znajdują i konsumują informacje.

W OpenAI pracownik powiedział prezesowi Gregowi Brockmanowi o budowaniu „hacka”, aby ominąć paywall NYT. Brockman odpowiedział: „ah, miło”.

Myriad: OpenAI czy Anthropic wejdą na giełdę pierwsze? Kliknij, aby dokonać prognozy.
Myriad: OpenAI czy Anthropic wejdą na giełdę pierwsze? Kliknij, aby dokonać prognozy.

Nick Turley, który kierował zespołem ChatGPT, napisał w czerwcu 2023 r., że AI stanowi „egzystencjalne zagrożenie” dla wydawców, a w lutym 2024 r., że produkty AI „będą coraz bardziej substytucyjne w miarę, jak będą się stawać lepsze”. W innym miejscu napisał, że produkty AI „są w dużej mierze substytucyjne, kropka”.

Inżynier OpenAI napisał w lutym 2023 r., że „niezależnie od tego, jak widocznie pokazujemy linki, użytkownicy nie będą klikać”, co stoi w sprzeczności z argumentem, że chatboty kierują ruch z powrotem do wydawców.

W notatce z 2020 r. do Brockmana i Sama Altmana ówczesny dyrektor ds. polityki Jack Clark ostrzegał, że firma „tworzy systemy, które zastępują pracę ludzi definiujących »kulturę« społeczeństwa” i „staną się symbolem tego, jak Silicon Valley bezmyślnie wkracza w inne dziedziny życia i zostawia bałagan na dywanie”. Clark odszedł, aby współtworzyć Anthropic, która przekazała prośbę o komentarz od Times do OpenAI.

Zarówno Microsoft, jak i OpenAI argumentują, że trenowanie było dozwolonym użytkiem, przekształcającym artykuły w nowe dzieło, a nie zastępującym oryginały. „Świat może zobaczyć, co OpenAI i Microsoft myślały przez cały czas o uczciwości własnego postępowania” – powiedział Steven Lieberman, który reprezentuje New York Daily News i siedem innych gazet.

Times, powód w tej sprawie, odmówił komentarza własnym reporterom, którzy podali, że OpenAI nie odpowiedziało na prośby o komentarz.