Yapay Zekanın Kendi Zehrini Üretmesi: İnternet Nereye Gidiyor?
Yapay Zeka'nın "Kısır Döngüsü" ve Web'in Geleceği: Rahatsız Edici Gerçekler
İnternet yıllardır sessiz bir toplumsal sözleşme üzerine kurulu: içerik üreticileri içerik üretir, platformlar bunu indeksler, kullanıcılar tüketir ve herkes kazanır. Arama motorları ziyaretçi gönderir, linkler tıklanır, sistem kusursuz değildir ama milyonlarca bağımsız içerik üreticisi, haber kuruluşu ve işletmeyi ayakta tutmuştur.
Peki ya aracı kurum artık sizi bir yere yönlendirmeye gerek olmadığına karar verirse?
İşte New York Times'ın OpenAI ve Microsoft'a karşı açtığı davadan sızan belgelerin merkezinde bu rahatsız edici soru var—ve cevaplar oldukça çarpıcı.
Biliyorlardı. Asıl Acı Olan Kısım Bu.
En çarpıcı olan şey, yapay zeka eğitiminin telif haklarını ihlal edip etmediği veya büyük dil modellerinin kaynak materyal ile karmaşık ilişkileri değil. En çarpıcı olan, bu şirketlerin ne yaptıklarını biliyor olmaları.
Microsoft'un dahili belgeleri, yapay zeka içerik stratejisini "modellerimizin ve tüm web'in performansını aynı anda olumsuz etkileyecek bir kısır döngü" olarak tanımlıyor. Ürünlerinin, bu sistemleri mümkün kılan içerik tedarik zincirindeki "temel tedarikçilerinin ekonomik temellerini" tehdit ettiğini kabul ediyorlar.
Başka bir deyişle: uçurumu gördüler, arabayı ona doğru çevirdiler ve sürmeye devam ettiler.
Microsoft'un Uygulamalı Bilim Direktörü Brent Hecht, dahili yazışmalarda daha da açık sözdü: veri toplama pratiklerini "insanlık tarihinin en büyük emek hırsızlığı" olarak nitelendirdi ve Microsoft'un hukuki savunmasının "adil kullanım fikrini tam bir alay konusu haline getirdiğini" belirtti.
Elbette Microsoft, Hecht'in yorumlarından mesafelenmeye çalıştı ve bir sözcü bunları "tek bir çalışanın bireysel görüşü" olarak nitelendirdi. Ama şirketin kendi dahili belgeleri temelde aynı şeyi söylüyorsa, bu ayrımı sürdürmek epey zorlaşıyor.
Kimsenin Konuşmak İstemediği Tedarik Zinciri Sorunu
Modern yapay zeka geliştirmesinin kalbinde temel bir çelişki var: Büyük dil modelleri çalışmak için devasa miktarda insan tarafından oluşturulmuş içeriğe ihtiyaç duyuyor. Ancak bu modeller, o içeriğe doğrudan erişme ihtiyacını ortadan kaldırmak üzere tasarlanmış.
Microsoft'un kendi belgeleri bu paradoksu kabul ediyor. LLM'ler, kendi ifadeleriyle, "kendi tedarik zincirini yok eden bir ürün" çünkü onları işe yarar kılan eğitim verilerinin yerine geçiyorlar.
Bir an bunun ne anlama geldiğini düşünün. Her seferinde ChatGPT veya Copilot bir soruyu yanıtlayıp sizi bir kaynağa yönlendirmek yerine, potansiyel bir okuyucu oraya asla ulaşmıyor. Bu, hiçbir zaman gerçekleşmeyen reklam geliri. Bu, içerik üretmenin artık emeğe değmeyeceğine karar verebilecek bir üretici.
Ve kaynak kuruduğunda—daha az üreticinin öğrenmeye değer daha az şey ürettiği bir durumda—o içerikle eğitilmiş modellere ne olacak?
Sayılar Acımasız
OpenAI'nin kendi analistleri, yapay zeka özetleri ve kullanıcıları platformlarında tutan sohbet botları nedeniyle yayıncılara gelen arama yönlendirme trafiğinin %60'a kadar düşmüş olabileceğini tahmin ediyor. Google Zero—sitelerin Google aramalarından sıfır trafik alması fenomeni—artık bir teorik endişe değil, birçok yayıncı için yaşanan bir gerçeklik.
Satya Nadella'nın kendisi ifadesinde, sohbet botlarının temelde aramayı "değiştirdiğini ve bilgiye doğrudan kaynaktan ulaşma ihtiyacını ortadan kaldırdığını" kabul etti. Bu sistemin bir hatası değil; bu ürünleri kullanıcılar için değerli kılan özellik.
OpenAI'den Nick Turley'in daha da doğrudan olduğu bildiriliyor: ChatGPT'den bir cevap aldığınızda, kaynağın linkini tıklamak için "hiçbir iyi neden yok."
Geliştiriciler ve Startup'lar İçin Bu Ne Anlama Geliyor?
İşte bu konunun sizin için—bir sonraki nesil web ürünleri inşa eden geliştirici veya startup kurucusu—ne kadar kritik olduğu.
Yapay zeka şirketleri esasen eski kuralların artık geçerli olmadığını savunuyorlar: insan bilgisinin ortak havuzu, proprietary sistemler inşa etmek için hasat edilmeli ve ardından o bilgiye erişim ihtiyacını ortadan kaldırmalı. Ve bunu, yarattıkları zararın tamamen farkında olarak yapıyorlar.
Bu, NYT davasının hukuki gösterisinin ötesinde bazı sonuçlar doğuruyor:
Yapay zeka API'lerine bağımlılık riskli. Bu modelleri sağlayan şirketler yasal ve etik açıdan sorunlu uygulamalarda bulunuyorsa, ürününüzün temeli sandığınızdan çok daha sallantılı olabilir.
İçerik ortaklıkları önemli. Yayıncılar, içeriklerinin tazminat olmaksızın kazınmasına giderek daha isteksiz. Hukuki ve iş dünyası manzarası, lisans gerektiren bir yöne doğru kayıyor.
Yönlendirme trafiği ekonomisi değişiyor. Bir içerik işi kuruyorsanız, arama trafiği veya sosyal paylaşımların sizi ayakta tutacağını artık varsayamazsınız. Yapay zeka özetleri kullanıcıların sorularını siteye hiç uğramadan yanıtlayabilir.
Açık web'in değeri var. İnterneti kullanışlı kılan prensipler—birbirine bağlama, atıf yapma, trafiği kaynaklara yönlendirme—yapay zekayı mümkün kılan ekosistemı oluşturuyor. Bu ekosistemı tükenmez bir kaynak olarak yağmalamak, sonunda kendi kendini yok etmektir.
İroni Neredeyse Mükemmel
Belki de her şeyin en ironik yanı, Microsoft, Google ve OpenAI'nin şimdi zarar verdikleri yayıncılarla içerik lisanslama anlaşmaları yapmak için yarışıyor olmaları. Nadella'nın kendisi "duvar örgüsüyle korunan her şey lisanslanmalı" dedi—bu duygu, Microsoft'un ürünlerinin yıllarca duvar örgülü içeriği eğitim verileri için serbestçe kullandığını düşününce çok daha etkileyici olurdu.
OpenAI temsilcileri dosyalarda, eğitim verilerinden ücretli içeriği tespit etmek veya kaldırmak için sistematik bir çaba olduğundan "habersiz" olduklarını kabul ettiler. Yani varsayılan kamuya açık bilgilerle eğitilmiş yapay zeka, neyin ücretsiz neyin ücretli duvar arkasında olduğunu ayırt etmekte epey zorlanmış gibi görünüyor.
Geleceğe Bakış
Kısır döngü artık teorik değil. Gerçek zamanlı olarak, gerçek üreticilere, gerçek yayıncılara—düşmanlaşan bir ortamda gazetecilik ve içerik üretimini fonlamaya çalışanlara—gerçekleşiyor.
Teknoloji endüstrisinin yapay zekayı bilgiyi "demokratikleştiriyor" diye sunması, bilgi üretimini mümkün kılan ekonomik modeli eş zamanlı olarak yok etmesi—bu yenilik değil. Silicon Valley diline bürünmüş bir madencilik operasyonu.
Yapay zeka üzerine inşa eden geliştiriciler ve işletmeler için soru sadece "bu araçları nasıl kullanabiliriz?" değil. "Kendi temelini tüketmeyen sistemleri nasıl kurabiliriz?" sorusu da aynı derecede önemli.
Sonuç olarak, web hâlâ kaynak. API'ler ve sohbet botları sadece üzerine kurulu bir katman. Ve eğer toplu olarak o katmanın üzerinde durduğu temelden daha değerli olduğuna karar verirsek, tüm yapı çöküyor.
Kısır döngü gerçek. Endüstrinin, çok geç olmadan bu döngüden çıkacak bilgeliğe sahip olup olmadığı ise hâlâ belirsiz.
Sence ne düşünüyorsun? Yapay zeka endüstrisi sürdürülemez bir ekosistem mi yaratıyor, yoksa bu endişeler abartılı mı? Aşağıdaki yorumlarda görüşünüz.