Niewygodna prawda o "pętli zagłady" AI i co czeka internet
Niewygodna prawda o "kołach zamachowych" AI i przyszłości internetu
Internet od zawsze funkcjonował w oparciu o niepisany kontrakt społeczny: twórcy produkują treści, wyszukiwarki je indeksują, użytkownicy je konsumują, a wszyscy na tym korzystają. Ruch z wyszukiwarek trafia do wydawców. Linki są klikane. System, choć niedoskonały, pozwalał zarabiać milionom niezależnych twórców, redakcji i firm.
Ale co się stanie, gdy pośrednik postanowi, że nie musi już nigdzie was kierować?
To niewygodne pytanie leży w samym sercu niedawno ujawnionych dokumentów sądowych w sprawie New York Times przeciwko OpenAI i Microsoft — i odpowiedzi są...不作简单翻译。
Wiedzieli. I to jest najgorsze.
Najbardziej szokujące w całej tej sprawie nie jest sam fakt, że trenowanie AI może naruszać prawa autorskie. Najbardziej szokujące jest to, że te firmy wiedziały, co robią.
Wewnętrzne dokumenty Microsoftu wprost opisują strategię treści AI jako tworzenie "koła zamachowego", które "zaszkodzi wydajności naszych modeli i całemu internetowi jednocześnie". Przyznawano, że produkty firmy zagrażają "ekonomicznym fundamentom swoich niezbędnych dostawców" — czyli całemu łańcuchowi dostaw treści, który umożliwia istnienie tych systemów.
Innymi słowy: zobaczyli przepaść, skierowali w nią samochód i jechali dalej.
Brent Hecht, dyrektor ds. stosowanych nauk w Microsoft, był w wewnętrznej komunikacji jeszcze bardziej bezpośredni, nazywając praktyki pozyskiwania danych "największą kradzieżą pracy w historii ludzkości" i zauważając, że prawna obrona Microsoftu "czyni całkowite żarty z koncepcji dozwolonego użytku".
Żeby być uczciwym — Microsoft próbował zdystansować się od słów Hechta, przedstawiając je jako "indywidualną perspektywę jednego pracownika". Ale gdy twoje własne wewnętrzne dokumenty mówią zasadniczo to samo, ta dystynkcja staje się dość trudna do utrzymania.
Problem łańcucha dostaw, o którym nikt nie chce mówić
Oto fundamentalna sprzeczność w sercu współczesnego rozwoju AI: duże modele językowe potrzebują ogromnych ilości treści stworzonych przez ludzi, żeby w ogóle działać. Ale te same modele są zaprojektowane tak, żeby wyeliminować potrzebę bezpośredniego dostępu do tych treści.
Dokumenty Microsoftu same przyznawały się do tego paradoksu. LLMy są, ich słowami, "produktem, który niszczy własny łańcuch dostaw", ponieważ substytuuje te same dane treningowe, które czynią je użytecznymi.
Pomyśl przez chwilę, co to oznacza. Za każdym razem, gdy ChatGPT czy Copilot odpowiada na pytanie zamiast skierować cię do źródła — to potencjalny czytelnik, który nigdy nie klika. To przychód z reklam, który się nie materializuje. To twórca, który może dojść do wniosku, że produkowanie treści nie jest już warte wysiłku.
A kiedy studnia wyschnie — kiedy będzie mniej twórców tworzących mniej rzeczy wartych poznania — co stanie się z modelami wytrenowanymi na tych treściach?
Liczby są bezlitosne
Analitycy OpenAI oszacowali, że ruch z wyszukiwania do wydawców może być niższy nawet o 60% przez podsumowania AI i chatboty, które zatrzymują użytkowników na swoich platformach. Google Zero — zjawisko, gdzie strony nie otrzymują żadnego ruchu z wyszukiwań Google — przeszło od teoretycznego zmartwienia do codziennej rzeczywistości dla wielu wydawców.
Sam Satya Nadella przyznał w zeznaniach, że chatboty "zasadniczo zastąpiły wyszukiwanie i wyeliminowały potrzebę udawania się bezpośrednio do źródła informacji". To nie jest błąd w systemie — to funkcja, która czyni te produkty wartościowymi dla użytkowników.
Nick Turley z OpenAI był podobno jeszcze bardziej bezpośredni: kiedy już dostaniesz odpowiedź od ChatGPT, "nie ma dobrego powodu, żeby klikać" link do źródła.
Co to oznacza dla developerów i startupów
Oto gdzie to staje się istotne dla ciebie — developera czy założyciela startupu budującego kolejną generację produktów internetowych.
Firmy AI zasadniczo argumentują, że stare zasady już nie obowiązują — że wspólna pula ludzkiej wiedzy powinna być wyeksploatowana do budowania zastrzeżonych systemów, które następnie zastępują potrzebę dostępu do tej wiedzy. I robią to z pełną świadomością wyrządzanych szkód.
To ma implikacje wykraczające poza prawną teatralność procesu NYT:
Poleganie na API AI jest ryzykowne. Jeśli firmy dostarczające te modele angażują się w prawnie i etycznie wątpliwe praktyki, fundament twojego produktu może być bardziej chwiejny, niż ci się wydaje.
Partnerstwa treści mają znaczenie. Wydawcy są coraz mniej skłonni do allowiania scrapowania ich treści bez wynagrodzenia. Krajobraz prawny i biznesowy przesuwa się w kierunku wymogu licencji.
Ekonomia ruchu polecającego się zmienia. Jeśli budujesz biznes oparty na treściach, nie możesz już zakładać, że ruch z wyszukiwania czy social mediów cię utrzyma. Podsumowania AI mogą odpowiadać na pytania użytkowników, zanim w ogóle dotrą na twoją stronę.
Otwarty web ma wartość. Zasady, które uczyniły internet użytecznym — linkowanie, cytowanie, ruch płynący do źródeł — tworzą ekosystem, który sam umożliwia istnienie AI. Traktowanie tego ekosystemu jako niewyczerpywanego zasobu do wyeksploatowania jest ostatecznie samobójcze.
Ironia jest niemal doskonała
Być może najbardziej ironiczny aspekt całej tej sprawy jest taki, że Microsoft, Google i OpenAI teraz desperacko próbują zawierać umowy licencyjne z wydawcami, których wcześniej wykończyli. Sam Nadella powiedział, że "wszystko za paywallem powinno być licencjonowane" — sentyment, który byłby bardziej przekonujący, gdyby produkty Microsoftu przez lata nie traktowały treści za paywallem jako dane treningowe.
Przedstawiciele OpenAI przyznali w dokumentach, że byli "nieświadomi" jakiegokolwiek systematycznego wysiłku wykrywania lub usuwania treści spod paywalla z ich danych treningowych. Więc AI, która rzekomo była trenowana na publicznie dostępnych informacjach, najwyraźniej miała spore problemy z rozróżnieniem, co jest za darmo, a co za paywallem.
Patrząc w przyszłość
Koło zamachowe nie jest już teoretyczne. Dzieje się w czasie rzeczywistym, dla prawdziwych twórców, dla prawdziwych wydawców próbujących finansować dziennikarstwo i tworzenie treści w coraz wrogośniejszym środowisku.
Dla branży tech twierdzenie, że AI "demokratyzuje informację", jednocześnie niszcząc ekonomiczny model umożliwiający tworzenie tej informacji — to nie innowacja. To przemysł wydobywczy przebrany w język Doliny Krzemowej.
Pytanie dla developerów i firm budujących na AI to nie tylko "jak możemy wykorzystać te narzędzia?" To "jak możemy budować systemy, które nie konsumują własnego fundamentu?"
Pod koniec dnia, web jest wciąż źródłem. API i chatboty to tylko jedna warstwa na jego szczycie. A jeśli zbiorowo uznamy, że ta warstwa jest cenniejsza niż fundament, na którym stoi — cały stos runie.
Koło zamachowe jest realne. Czy branża ma mądrość, żeby z niego wyjść, zanim będzie za późno — zobaczymy.
Co myślisz? Czy branża AI tworzy nieunikniony ekosystem, czy te obawy są przesadzone? Podziel się perspektywą w komentarzach poniżej.