Perché l'AI Potrebbe Farsi Del Male da Sola: La Verità sul Doom Loop che Minaccia il Web
La Verità Scomoda sul "Cerchio della Morte" dell'AI e il Futuro del Web
Il web ha sempre funzionato così: qualcuno crea contenuti, le piattaforme li indicizzano, gli utenti li consumano, tutti ci guadagnano. I motori di ricerca portano visitatori agli editori. I link vengono cliccati. Un sistema imperfetto, certo, ma che ha permesso a milioni di creator, testate giornalistiche e aziende di sopravvivere.
Ma cosa succede quando l'intermediario decide che non ha più bisogno di mandarti da nessuna parte?
È la domanda scomoda al centro dei documenti processuali del caso New York Times contro OpenAI e Microsoft. E le risposte sono pesanti.
Lo Sapevano. Ed È Questo che Fa Male.
La cosa più scioccante non è che l'addestramento dell'AI possa violare il copyright. La cosa più scioccante è che queste aziende sapessero benissimo cosa stavano facendo.
Documenti interni Microsoft descrivevano esplicitamente la loro strategia sui contenuti AI come la creazione di un "cerchio della morte" che avrebbe "danneggiato le prestazioni dei nostri modelli e dell'intero web." Riconoscevano che i loro prodotti minacciavano "le basi economiche dei suoi fornitori essenziali."
In parole povere: hanno visto il burrone e hanno continuato a guidare dritti verso di esso.
Brent Hecht, Director of Applied Science di Microsoft, è stato ancora più diretto nelle comunicazioni interne, definendo le pratiche di raccolta dati "il più grande furto di lavoro nella storia umana" e notando che la difesa legale di Microsoft era "una completa farsa rispetto all'idea di fair use."
Microsoft ha cercato di prendere le distanze, sostenendo che quelle fossero solo opinioni di un singolo dipendente. Ma quando i tuoi stessi documenti interni dicono la stessa cosa, questa distinzione diventa difficile da mantenere.
Il Problema della Catena di Approvvigionamento
Ecco la contraddizione fondamentale dell'AI moderna: i modelli linguistici hanno bisogno di enormi quantità di contenuti creati da esseri umani. Ma quei modelli sono progettati per eliminare la necessità di accedere a quei contenuti.
I documenti Microsoft lo ammettevano. I LLM sono, nelle loro parole, "un prodotto che distrugge la propria catena di approvvigionamento" perché sostituiscono proprio i dati di training che li rendono utili.
Pensaci un attimo. Ogni volta che ChatGPT risponde a una domanda invece di indirizzarti alla fonte, è un potenziale lettore che non clicca mai. È ricavo pubblicitario che non arriva mai. È un creator che potrebbe decidere che creare contenuti non vale più la pena.
E quando il pozzo si svuota — quando ci sono meno creator che producono meno cose degne di essere apprese — cosa succede ai modelli addestrati su quei contenuti?
I Numeri Sono Impietosi
Gli analisti di OpenAI hanno stimato che il traffico di referral verso gli editori potrebbe essere sceso del 60% a causa dei sommari AI e dei chatbot che tengono gli utenti sulle loro piattaforme. Google Zero — il fenomeno per cui i siti ricevono zero traffico da Google — è passato da preoccupazione teorica a realtà per molti editori.
Satya Nadella stesso ha ammesso in tribunale che i chatbot hanno "sostanzialmente sostituito la ricerca e eliminato la necessità di andare direttamente alla fonte." Non è un difetto del sistema. È la caratteristica che rende questi prodotti preziosi per gli utenti.
Nick Turley di OpenAI è stato ancora più esplicito: una volta ottenuta la risposta da ChatGPT, non c'è "nessun buon motivo per cliccare" sul link alla fonte.
Cosa Significa per Developer e Startup
Ed ecco dove diventa rilevante per te, developer o founder che stai costruendo la prossima generazione di prodotti web.
Le aziende AI sostengono essenzialmente che le vecchie regole non valgono più — che il commons della conoscenza umana debba essere raccolto per costruire sistemi proprietari che poi sostituiscono la necessità di accedere a quella conoscenza. E lo fanno con piena consapevolezza del danno che stanno causando.
Questo ha implicazioni oltre il teatro legale del caso NYT:
Affidarsi alle API AI è rischioso. Se le aziende che forniscono questi modelli si dedicano a pratiche discutibili dal punto di vista legale ed etico, le fondamenta del tuo prodotto potrebbero essere più fragili di quanto pensi.
Le partnership sui contenuti contano. Gli editori sono sempre meno disposti a farsi scraping senza compenso. Il panorama legale e commerciale si sta spostando verso la richiesta di licenze.
L'economia del traffico referral sta cambiando. Se stai costruendo un business basato sui contenuti, non puoi più dare per scontato che il traffico da ricerca o social media ti sostenga. I sommari AI potrebbero rispondere alle domande degli utenti prima che raggiungano mai il tuo sito.
Il web aperto ha valore. I principi che hanno reso internet utile — interlinking, citazioni, traffico verso le fonti — creano l'ecosistema che rende possibile l'AI. Trattare quell'ecosistema come una risorsa inesauribile da sfruttare è, alla fine, un autogol.
L'Ironia È Quasi Perfetta
L'aspetto più ironico è che Microsoft, Google e OpenAI ora si stanno precipitando a stringere accordi di licenza con gli editori che hanno danneggiato. Nadella ha detto che "tutto ciò che è dietro un paywall dovrebbe essere licenziato" — un sentiment più convincente se i prodotti Microsoft non avessero passato anni a trattare i contenuti paywalled come fair game per i dati di training.
I rappresentanti OpenAI hanno ammesso nei documenti legali di non essere "a conoscenza" di alcuno sforzo sistematico per rilevare o rimuovere contenuti paywalled dai loro dati di training. Quindi l'AI che doveva essere addestrata su informazioni pubblicamente disponibili sembra abbia avuto non pochi problemi a distinguere tra cosa è gratis e cosa è dietro un paywall.
Guardando Avanti
Il cerchio della morte non è più teorico. Sta accadendo adesso, a creator reali, a editori reali che cercano di finanziare giornalismo e creazione di contenuti in un ambiente sempre più ostile.
Per l'industria tech dire che l'AI sta "democratizzando l'informazione" mentre distrugge simultaneamente il modello economico che rende possibile la creazione di informazione — questo non è innovazione. È industria estrattiva travestita da linguaggio da Silicon Valley.
La domanda per developer e aziende che costruiscono su AI non è solo "come possiamo usare questi strumenti?" È "come possiamo costruire sistemi che non consumino le proprie fondamenta?"
Alla fine dei conti, il web è ancora la fonte. Le API e i chatbot sono solo un livello sopra di esso. E se decidiamo collettivamente che quel livello vale più delle fondamenta su cui poggia, l'intera struttura crolla.
Il cerchio della morte è reale. Se l'industria avrà la saggezza di uscirne prima che sia troppo tardi, lo vedremo.