Hvorfor AI kan bli nettets verste fiende
Den ubehagelige sannheten om AI-bransjens «dommedagsloop» og hva det betyr for nettets fremtid
Internett har alltid bygget på en usynlig avtale: skapere lager innhold, plattformer indekserer det, brukere konsumerer det, og alle tjener på det. Søkemotorer sender trafikk til utgivere. Lenker blir klikket. Systemet, selv om det var ufullkomment, holdt hjulene i gang for millioner av uavhengige skapere, nyhetsorganisasjoner og bedrifter.
Men hva skjer når mellomleddet bestemmer seg for at det ikke lenger trenger å sende deg noe sted hen?
Det er det ubehagelige spørsmålet som ligger bak nylig offentliggjorte rettsdokumenter fra New York Times' søksmål mot OpenAI og Microsoft – og svarene er oppsiktsvekkende.
De Visste. Det er den vonde delen.
Det mest slående avslaget handler ikke om at AI-trening kan krenke opphavsrett, eller at store språkmodeller har kompliserte forhold til kildemateriale. Det verste er at disse selskapene visste hva de drev med.
Intern Microsoft-dokumentasjon beskriver eksplisitt deres AI-innholdsstrategi som å skape en «dommedagsloop» som ville «skade ytelsen til modellene våre og hele nettet samtidig.» De innrømmet at produktene deres truet «de økonomiske grunnlagene til sine essensielle leverandører» når det gjelder innholdsleverandørkjeden som gjør disse systemene mulige.
Med andre ord: de så stupet, pekte bilen mot det, og fortsatte å kjøre.
Brent Hecht, Microsofts direktør for anvendt vitenskap, var enda mer direkte i interne kommunikasjoner, og kalte datahøstingen «den største tyverien av arbeidskraft i menneskets historie» og påpekte at Microsofts juridiske forsvar gjorde «full parodi av ideen om rettferdig bruk.»
Nå må vi være rettferdige: Microsoft har prøvd å distansere seg fra Hechts kommentarer, med en talsperson som karakteriserte dem som «én ansatts individuelle perspektiv.» Men når dine egne interne dokumenter sier omtrent det samme, blir det ganske vanskelig å opprettholde den distinksjonen.
Leverandørkjedeproblemet ingen vil snakke om
Her er den grunnleggende motsetningen i hjertet av moderne AI-utvikling: Store språkmodeller trenger enorme mengder menneskeskapt innhold for å fungere. Men disse modellene er designet for å eliminere behovet for at mennesker får tilgang til det innholdet direkte.
Microsofts egne dokumenter anerkjente dette paradokset. LLMer er, i deres egne ord, «et produkt som ødelegger sin egen leverandørkjede» fordi de erstatter de treningsdataene som gjør dem nyttige.
Tenk på hva det betyr. Hver gang ChatGPT eller Copilot svarer på et spørsmål i stedet for å sende deg til en kilde, er det en potensiell leser som aldri klikker seg videre. Det er reklameinntekter som aldri materialiserer seg. Det er en skaper som kanskje bestemmer seg for at det ikke er verdt bryet lenger.
Og når brønnen tørker ut – når det er færre skapere som lager færre ting verdt å lære om – hva skjer med modellene som er trent på det innholdet?
Tallene er brutale
OpenAIs egne analytikere har anslått at søketrafikk til utgivere kan være redusert med opptil 60 prosent på grunn av AI-sammendrag og chatboter som holder brukerne på plattformen. Google Zero – fenomenet der nettsider mottar null trafikk fra Google-søk – har gått fra teoretisk bekymring til virkelighet for mange utgivere.
Satya Nadella selv innrømmet i vitneforklaring at chatboter har «basically erstattet søk og fjernet behovet for å gå rett til kilden for informasjon.» Det er ikke en feil i systemet; det er funksjonen som gjør disse produktene verdifulle for brukerne.
OpenAIs Nick Turley skal ha vært enda mer direkte: når du først har fått et svar fra ChatGPT, er det «ingen god grunn til å klikke» på en lenke til kilden.
Hva dette betyr for utviklere og gründere
Her er hvor dette blir relevant for deg, utvikleren eller gründeren som bygger neste generasjons webprodukter.
AI-selskapene argumenter i bunn og grunn for at de gamle reglene ikke lenger gjelder – at fellesgoder av menneskelig kunnskap skal høstes for å bygge proprietære systemer som deretter erstatter behovet for å få tilgang til den kunnskapen. Og de gjør det med full bevissthet om skaden de forårsaker.
Dette har konsekvenser som strekker seg utover det juridiske teateret i NYT-søksmålet:
Avhengighet av AI-API-er er risikofylt. Hvis selskapene som leverer disse modellene driver med juridisk og etisk tvilsom praksis, kan produktets fundament være mer skjørt enn du tror.
Innholdspartnerskap betyr noe. Utgivere er i økende grad uvillige til å la innholdet sitt skrapes uten kompensasjon. Det juridiske og kommersielle landskapet skifter mot å kreve lisenser.
Trafikkmatematikken er i endring. Hvis du bygger en innholdsbedrift, kan du ikke lenger anta at søketrafikk eller sosiale delinger vil holde deg flytende. AI-sammendrag kan svare på brukernes spørsmål før de noen gang når nettsiden din.
Det åpne nettet har verdi. Prinsippene som gjorde internett nyttig – lenking, sitering, trafikk som flyter til kilder – skaper økosystemet som overhode gjør AI mulig. Å behandle det økosystemet som en utømmelig ressurs som skal gruveutvinnes, er i lengden selvmordsaktig.
Ironien er nesten perfekt
Kanskje det mest ironiske aspektet ved alt dette er at Microsoft, Google og OpenAI nå skuffer for å inngå innholdslisensavtaler med utgiverne de har skadet. Nadella selv sa «alt som er bak betalingsmur bør lisensieres» – en holdning som ville vært mer overbevisende hvis Microsofts produkter ikke hadde brukt år på å behandle innhold bak betalingsmur som rettferdig bruk for treningsdata.
OpenAI-representanter innrømmet i dokumenter at de var «uvitende» om noe systematisk forsøk på å oppdage eller fjerne innhold bak betalingsmur fra treningsdataene sine. Så AI-en som angivelig var trent på offentlig tilgjengelig informasjon, ser ut til å hatt betydelige problemer med å skille mellom hva som var fritt og hva som var bak en betalingsmur.
Veien videre
Dommedagsloopen er ikke lenger teoretisk. Den skjer i sann tid, til virkelige skapere, til virkelige utgivere som prøver å finansiere journalistikk og innholdsproduksjon i et stadig mer fiendtlig miljø.
For tech-bransjen å påstå at AI «demokratiserer informasjon» mens de samtidig ødelegger den økonomiske modellen som gjør informasjonsskaping mulig – det er ikke innovasjon. Det er gruvedrift kledd i Silicon Valley-språk.
Spørsmålet for utviklere og bedrifter som bygger på AI er ikke bare «hvordan kan vi bruke disse verktøyene?» Det er «hvordan kan vi bygge systemer som ikke fortærer sitt eget fundament?»
I bunn og grunn er nettet fortsatt kilden. API-ene og chatbotene er bare et lag oppå det. Og hvis vi kollektivt bestemmer oss for at det laget er mer verdifullt enn fundamentet det hviler på, kommer hele stacken til å rase sammen.
Dommedagsloopen er reell. Om bransjen har visdommen til å trå ut av den før det er for sent, gjenstår å se.
Hva tenker du? Skaper AI-bransjen et uholdbart økosystem, eller er disse bekymringene overdrevet? Del perspektivet ditt i kommentarene nedenfor.