Microsoft i OpenAI wiedziały, że „kradną” treści wydawców. Ujawniono ich wewnętrzne dokumenty

Microsoft i OpenAI wiedziały, że „kradną” treści wydawców. Ujawniono ich wewnętrzne dokumenty

Z odtajnionych w czwartek materiałów sądowych wynika, że w Microsofcie i OpenAI od lat trwały wewnętrzne dyskusje o tym, czy pobieranie milionów tekstów prasowych do szkolenia sztucznej inteligencji jest etyczne i legalne. Informację ujawnił „New York Times” – amerykański dziennik, który sam pozwał obie firmy o naruszenie praw autorskich. Z odtajnionych materiałów wynika, że sami przedstawiciele obu koncernów technologicznych wyrażali poważne zastrzeżenia dotyczące praktyk stosowanych podczas budowy zaawansowanych modeli AI.

Jak podał TechCrunch, wysoki rangą przedstawiciel Microsoftu prywatnie nazwał te praktyki „kradzieżą”. Dyrektor ds. nauk stosowanych Brent Hecht napisał nawet w 2023 r. dokument, w którym pytał, czy pobieranie milionów artykułów nie jest „największą w historii kradzieżą efektów ludzkiej pracy„. Ostrzegał też przed błędnym kołem, które może zaszkodzić samym modelom AI, oraz przewidywał, że opinia publiczna zacznie mówić o „wysysaniu” cudzej pracy przez algorytmy.

Podobne obawy mieli pracownicy OpenAI. Nick Turley, szef zespołu ChatGPT, już w czerwcu 2023 r. określił AI jako „egzystencjalne zagrożenie” dla wydawców prasy. Kilka miesięcy później dodał, że coraz lepsze produkty AI będą coraz skuteczniej wypierać tradycyjne źródła informacji.

Proces zainicjowany pod koniec 2023 r. przez „New York Times” wciąż trwa, a do sprawy dołączyło już wielu innych wydawców. Kolejne dokumenty są sukcesywnie ujawniane opinii publicznej.

Przypomnijmy, że w czerwcu 400 amerykańskich gazet lokalnych i regionalnych (na czele z Arkansas Democrat-Gazette, CherryRoad Media, AIM Media Management) pozwali OpenAI i Microsoft w Sądzie Okręgowym dla Południowego Dystryktu Nowego Jorku, zarzucając „systematyczne i potajemne przeszukiwanie” setek serwisów informacyjnych w celu pozyskania danych do trenowania AI. Wydawcy wskazali, że produkty generatywnej AI przyniosły firmom miliardy dolarów wartości rynkowej, a wydawcom nie przypadł z tego „ani cent”. Koalicja wydawców zarzuca OpenAI i Microsoft naruszenie ustawy o prawie autorskim i zagrożenie dla lokalnego dziennikarstwa. Z kolei Seattle Times i Newsday dołączyły do podobnego pozwu, argumentując wprost, że nie ma nic transformacyjnego w kopiowaniu dziennikarstwa Seattle Times i Newsday bez zapłaty, by budować produkty konkurujące bezpośrednio o tych samych czytelników, tych samych reklamodawców i te same dolary z subskrypcji.

W sierpniu Editorial Perfil wydawca z Argentyny pozwał OpenAI i Microsoft a wcześniej w maju CNN złożyło pierwszy pozew przeciwko firmie AI, zarzucając Perplexity bezprawne skopiowanie ponad 17 000 artykułów, filmów, zdjęć i innych materiałów. Jeszcze w październiku 2025 r. Reddit pozwał Perplexity oraz trzech dostawców scrapingu danych (SerpApi, Oxylabs, AWMProxy), zarzucając im „przemysłową skalę” omijania zabezpieczeń technicznych w celu pozyskania treści Reddita dla wyszukiwarki odpowiedzi AI Perplexity.

Źródło https://businessinsider.com.pl