Ο Ανησυχητικός «Doom Loop» της AI – Τι Σημαίνει Πραγματικά για το Μέλλον του Web
Η Άβολη Αλήθεια για το "Φαύλο Κύκλο" της AI και το Μέλλον του Web
Το internet πάντα λειτουργούσε με ένα άτυπο κοινωνικό συμβόλαιο: οι δημιουργοί παράγουν περιεχόμενο, οι πλατφόρμες το ευρετηριάζουν, οι χρήστες το καταναλώνουν, και όλοι βγαίνουν κερδισμένοι. Οι μηχανές αναζήτησης στέλνουν κόσμο στους εκδότες. Τα links πατιούνται. Το σύστημα, αν και ατελές, κρατούσε "ανοιχτά τα φώτα" για εκατομμύρια ανεξάρτητους δημιουργούς, ειδησεογραφικά πρακτορεία και επιχειρήσεις.
Αλλά τι γίνεται όταν ο μεσάζων αποφασίζει ότι δεν χρειάζεται πια να σε στέλνει πουθενά;
Αυτό είναι το άβολο ερώτημα στον πυρήνα των πρόσφατα δημοσιοποιημένων δικαστικών εγγράφων από την αγωγή της New York Times κατά της OpenAI και της Microsoft—και οι απαντήσεις είναι καταδικαστικές.
Το Ήξεραν. Αυτό Πονάει Περισσότερο.
Η πιο εντυπωσιακή αποκάλυψη δεν είναι ότι η εκπαίδευση AI μπορεί να παραβιάζει πνευματικά δικαιώματα ή ότι τα μεγάλα language models έχουν περίπλοκες σχέσεις με το υλικό προέλευσης. Το πιο εντυπωσιακό είναι ότι αυτές οι εταιρείες ήξεραν τι έκαναν.
Εσωτερικά έγγραφα της Microsoft περιγράφουν ρητά τη στρατηγική περιεχομένου AI τους ως δημιουργία ενός "doom loop" που θα "έβλαπτε την απόδοση των models και ολόκληρο τον ιστό ταυτόχρονα". Αναγνώρισαν ότι τα προϊόντα τους απειλούσαν "τα οικονομικά θεμέλια των απαραίτητων προμηθευτών του" όσον αφορά την αλυσίδα τροφοδοσίας περιεχομένου που κάνει αυτά τα συστήματα δυνατά.
Με άλλα λόγια: είδαν το γκρεμό, στρέψαν το αυτοκίνητο προς τα εκεί, και συνέχισαν να οδηγούν.
Ο Brent Hecht, Director of Applied Science της Microsoft, ήταν ακόμη πιο απόλυτος σε εσωτερικές επικοινωνίες, χαρακτηρίζοντας τις πρακτικές συλλογής δεδομένων ως "τη μεγαλύτερη κλοπή εργασίας στην ανθρώπινη ιστορία" και σημειώνοντας ότι η νομική υπεράσπιση της Microsoft "κορόιδευε πλήρως την ιδέα του fair use".
Τώρα, για να είμαστε δίκαιοι, η Microsoft προσπάθησε να αποστασιοποιηθεί από τα σχόλια του Hecht, με εκπρόσωπο να τα χαρακτηρίζει "ατομική άποψη ενός υπαλλήλου". Αλλά όταν τα ίδια τα εσωτερικά έγγραφα λένε ουσιαστικά το ίδιο πράγμα, αυτή η διάκριση γίνεται αρκετά δύσκολο να σταθεί.
Το Πρόβλημα της Αλυσίδας Τροφοδοσίας που Κανείς δεν Θέλει να Συζητήσει
Ορίστε η θεμελιώδης αντίφαση στην καρδιά της σύγχρονης ανάπτυξης AI: Τα μεγάλα language models χρειάζονται τεράστιες ποσότητες ανθρώπινου περιεχομένου για να λειτουργήσουν. Αλλά αυτά τα models έχουν σχεδιαστεί για να εξαλείψουν την ανάγκη οι άνθρωποι να έχουν πρόσβαση σε αυτό το περιεχόμενο απευθείας.
Τα ίδια έγγραφα της Microsoft αναγνώρισαν αυτό το παράδοξο. Τα LLMs είναι, στα λόγια τους, "ένα προϊόν που καταστρέφει τη δική του αλυσίδα τροφοδοσίας" επειδή υποκαθιστούν τα ίδια εκπαιδευτικά δεδομένα που τα κάνουν χρήσιμα.
Σκέψου τι σημαίνει αυτό για μια στιγμή. Κάθε φορά που το ChatGPT ή το Copilot απαντά μια ερώτηση αντί να σε κατευθύνει σε μια πηγή, είναι ένας πιθανός αναγνώστης που δεν κάνει ποτέ κλικ. Είναι διαφημιστικά έσοδα που δεν υλοποιούνται ποτέ. Είναι ένας δημιουργός που μπορεί να αποφασίσει ότι η παραγωγή περιεχομένου δεν αξίζει τον κόπο.
Και όταν η πηγή στερεύει—όταν υπάρχουν λιγότεροι δημιουργοί που παράγουν λιγότερα πράγματα που αξίζει να μάθεις—τι γίνεται με τα models που εκπαιδεύτηκαν σε αυτό το περιεχόμενο;
Τα Νούμερα Είναι Αμείλικτα
Οι αναλυτές της ίδιας της OpenAI έχουν εκτιμήσει ότι η παραπομπή κίνησης από την αναζήτηση προς τους εκδότες μπορεί να έχει μειωθεί έως και 60% λόγω των AI summaries και των chatbots που κρατούν τους χρήστες στις πλατφόρμες τους. Το Google Zero—το φαινόμενο όπου οι ιστότοποι λαμβάνουν μηδενική κίνηση από το Google—έχει περάσει από θεωρητική ανησυχία σε βιωμένη πραγματικότητα για πολλούς εκδότες.
Ο ίδιος ο Satya Nadella παραδέχτηκε σε κατάθεση ότι τα chatbots έχουν "βασικά αντικαταστήσει την αναζήτηση και εξαλείψει την ανάγκη να πηγαίνεις κατευθείαν στην πηγή για πληροφορίες". Αυτό δεν είναι bug στο σύστημα· είναι το feature που κάνει αυτά τα προϊόντα πολύτιμα για τους χρήστες.
Ο Nick Turley της OpenAI φέρεται να ήταν ακόμη πιο άμεσος: μόλις πάρεις μια απάντηση από το ChatGPT, δεν υπάρχει "κανένας καλός λόγος να κάνεις κλικ" σε ένα link προς την πηγή.
Τι Σημαίνει Αυτό για Developers και Startups
Ορίστε πού γίνεται σχετικό με εσάς, τον developer ή τον ιδρυτή startup που χτίζει την επόμενη γενιά web προϊόντων.
Οι εταιρείες AI ουσιαστικά υποστηρίζουν ότι οι παλιοί κανόνες δεν ισχύουν πια—ότι το commons της ανθρώπινης γνώσης πρέπει να συγκομιστεί για να χτίσει ιδιόκτητα συστήματα που μετά αντικαθιστούν την ανάγκη πρόσβασης σε αυτή τη γνώση. Και το κάνουν με πλήρη επίγνωση της ζημιάς που προκαλούν.
Αυτό έχει επιπτώσεις πέρα από τη νομική θεατρικότητα της αγωγής της NYT:
Η εξάρτηση από AI APIs είναι ριψοκίνδυνη. Αν οι εταιρείες που παρέχουν αυτά τα models ασχολούνται με νομικά και ηθικά αμφισβητήσιμες πρακτικές, τα θεμέλια του προϊόντος σου μπορεί να είναι πιο επισφαλή από ό,τι νομίζεις.
Οι συνεργασίες περιεχομένου έχουν σημασία. Οι εκδότες όλο και περισσότερο δεν θέλουν να γίνεται scraping στο περιεχόμενό τους χωρίς αποζημίωση. Το νομικό και επιχειρηματικό τοπίο μετατοπίζεται προς την απαίτηση αδειών.
Η οικονομία της παραπομπής κίνησης αλλάζει. Αν χτίζεις μια επιχείρηση περιεχομένου, δεν μπορείς πια να υποθέτεις ότι η κίνηση από αναζήτηση ή τα social shares θα σε συντηρήσουν. Τα AI summaries μπορεί να απαντούν στις ερωτήσεις των χρηστών πριν φτάσουν ποτέ στο site σου.
Το open web έχει αξία. Οι αρχές που έκαναν το internet χρήσιμο—η διασύνδεση, οι αναφορές, η κίνηση που ρέει προς τις πηγές—δημιουργούν το οικοσύστημα που κάνει την AI δυνατή εξαρχής. Το να αντιμετωπίζεις αυτό το οικοσύστημα ως ανεξάντλητο πόρο προς εξόρυξη είναι τελικά αυτοκαταστροφικό.
Η Ειρωνεία Είναι Σχεδόν Τέλεια
Ίσως η πιο ειρωνική πτυχή όλων είναι ότι η Microsoft, η Google και η OpenAI τώρα σπεύδουν να δημιουργήσουν συμφωνίες αδειοδότησης περιεχομένου με τους εκδότες που έχουν βλάψει. Ο ίδιος ο Nadella είπε "οτιδήποτε είναι πίσω από paywall πρέπει να αδειοδοτείται"—ένα συναίσθημα που θα ήταν πειστικότερο αν τα προϊόντα της Microsoft δεν είχαν περάσει χρόνια αντιμετωπίζοντας το περιεχόμενο πίσω από paywall ως fair game για εκπαιδευτικά δεδομένα.
Εκπρόσωποι της OpenAI παραδέχτηκαν σε καταθέσεις ότι ήταν "αγνοούντες" οποιασδήποτε συστηματικής προσπάθειας να ανιχνεύσουν ή να αφαιρέσουν περιεχόμενο πίσω από paywall από τα εκπαιδευτικά τους δεδομένα. Οπότε η AI που υποτίθεται εκπαιδεύτηκε σε δημόσια διαθέσιμες πληροφορίες φαίνεται να είχε αρκετό πρόβλημα να διακρίνει μεταξύ του τι είναι δωρεάν και του τι είναι πίσω από paywall.
Κοιτάζοντας Μπροστά
Ο φαύλος κύκλος δεν είναι πια θεωρητικός. Συμβαίνει σε πραγματικό χρόνο, σε πραγματικούς δημιουργούς, σε πραγματικούς εκδότες που προσπαθούν να χρηματοδοτήσουν δημοσιογραφία και δημιουργία περιεχομένου σε ένα ολοένα πιο εχθρικό περιβάλλον.
Για τη βιομηχανία tech να ισχυρίζεται ότι η AI "δημοκρατικοποιεί την πληροφορία" ενώ ταυτόχρονα καταστρέφει το οικονομικό μοντέλο που κάνει τη δημιουργία πληροφορίας δυνατή—αυτό δεν είναι καινοτομία. Είναι εξορυκτική βιομηχανία ντυμένη με γλώσσα Silicon Valley.
Το ερώτημα για τους developers και τις επιχειρήσεις που χτίζουν πάνω στην AI δεν είναι απλώς "πώς μπορούμε να χρησιμοποιήσουμε αυτά τα εργαλεία;" Είναι "πώς μπορούμε να χτίσουμε συστήματα που δεν καταναλώνουν τα ίδια τους τα θεμέλια;"
Στο τέλος της ημέρας, το web είναι ακόμα η πηγή. Τα APIs και τα chatbots είναι απλώς ένα επιπλέον επίπεδο από πάνω του. Και αν αποφασίσουμε συλλογικά ότι αυτό το επίπεδο είναι πιο πολύτιμο από τα θεμέλια που στηρίζεται, όλη η δομή καταρρέει.
Ο φαύλος κύκλος είναι πραγματικός. Αν η βιομηχανία έχει τη σοφία να βγει από αυτόν πριν να είναι πολύ αργά, μένει να το δούμε.
Τι πιστεύεις; Δημιουργεί η βιομηχανία AI ένα μη βιώσιμο οικοσύστημα, ή αυτές οι ανησυχίες είναι υπερβολικές; Μοιράσου την άποψή σου στα σχόλια παρακάτω.