Nowa drukarka internetu: dlaczego strony nie dają rady z botami AI
Pewna historyczna analogia nie даw mi spokoju. W 1727 roku Imperium Osmańskie w końcu zaakceptowało druk — niemal trzy wieki po tym, jak wynalazek Gutenberga zmienił Europę na zawsze. Ich logika była prosta: skrybowie i duchowni mogli kontrolować każde słowo, gdy pismo poruszało się z prędkością ludzkiej ręki. Drukowany tekst mógł jednak trafić do tysiąca rąk do rana — nie do odzyskania, nie do powstrzymania.
Osmanowie wybrali kontrolę zamiast postępu. Europa drukowała, Osmanowie przepisywali. W ciągu dwóch stuleci ta różnica w wiedzy przerodziła się w różnicę w możliwościach, a historycy do dziś dyskutują, jak bardzo przyczyniło się to do upadku imperium.
Mam wrażenie, że ten sam scenariusz rozgrywa się teraz w internecie — tyle że w tempie sieciowym.
Sieć jako jedno żywe archiwum
To, co mnie fascynuje w kontekście AI agents, to ich zdolność do czytania całej sieci w naszym imieniu. Nie w przenośni — dosłownie. Jeden agent może przeskanować oferty wynajmu w całym mieście i wychwycić, którzy właściciele podnieśli czynsze po wejściu nowego prawa. Tysiąc skoordynowanych agentów mogłoby śledzić cały rynek mieszkaniowy codziennie. To samo z cenami, ofertami pracy, niedoborami leków, dokumentami sądowymi. Nagle publiczna sieć przestaje być miliardem rozproszonych stron i staje się jedną bazą danych, którą można przeszukiwać.
To dokładnie ten moment z drukarstwem. Więcej agentów czyta więcej stron, co zwiększa zapotrzebowanie na strony gotowe do odczytu, co z kolei generuje więcej agentów. Pułap nie wynosi miliard stron — sięga całej sieci, przetworzonej i przeszukiwalnej.
Bramkarze i ich ukryte koszty
Większość dużych serwisów już wdrożyła zabezpieczenia. Nazywają to systemami ochronnymi. Ochroną przed botami. Zapobieganiem oszustwom. Marketing brzmi rozsądnie, dopóki nie zajrzysz pod maskę.
Te systemy działają poprzez tworzenie cyfrowego odcisku twojego połączenia, zanim jeszcze zobaczysz stronę. Karta graficzna, czcionki, rozdzielczość ekranu, ruchy myszy, cyfrowy podpis połączenia — wszystko jest oceniane na podstawie tego, co system widział na tysiącach innych stron. Wyglądasz nietypowo? Zablokowany. Nikt nie prosi o zgodę, bo przecież bycie bezpiecznym oznacza rzekomo brak potrzeby pytania.
Rezultaty są przewidywalnie chaotyczne. Użytkownicy VPNów dostają bana. Przeglądarki stawiające na prywatność są blokowane. Zdalni pracownicy z adresami IP biurowymi mają problemy. Tymczasem dobrze finansowane operacje wynajmują residential IP dosłownie za gigabajty i czytają, co chcą. Bramka skutecznie zatrzymuje badaczy, dziennikarzy, niezależnych developerów i wszystkich, których agent pojawia się bez korporacyjnego budżetu.
To niewygodna prawda, której nikt w branży bezpieczeństwa nie chce podjąć: te systemy mają fatalną ekonomię. Dostawcy są opłacani za blokowanie odwiedzających i raportowanie swoich „sukcesów". Prawdziwi użytkownicy, którzy zostali odrzuceni i odeszli, nigdy nie pojawiają się w tych raportach — bo nie można policzyć kogoś, kto nigdy nie przeszedł. Strony widzą dashboard pełen zablokowanych zagrożeń. Nigdy nie widzą czytelników, którzy się poddali i poszli dalej.
Co tak naprawdę sprawdza ochrona
Co decyduje o tym, czy przejdziesz, czy trafisz na słynną stronę „chwilę momencik"?
Lokalizacja, lokalizacja, lokalizacja. Adres IP twojego połączenia zdradza, czy pochodzisz z sieci domowej, czy z serwerowni. System zna różnicę.
To, jak mówi twoja przeglądarka. Zanim cokolwiek się załaduje, twoja przeglądarka i serwer negocjują szyfrowanie. Ta negocjacja ma subtelne cechy charakterystyczne. Prawdziwy Chrome brzmi inaczej. Oprogramowanie udające Chrome brzmi nieco inaczej w tym pierwszym zdaniu.
To, co pod maską. Skrypty badają twoją przeglądarkę: narysuj ten niewidoczny obrazek, podaj model karty graficznej, wyślij listę czcionek. Prawdziwe maszyny odpowiadają nieco inaczej od siebie — jak różni się charakter pisma. Oprogramowanie albo odpowiada jak serwer (brak karty graficznej, standardowe czcionki, które nikogo nie wyróżniają), albo za każdym razem identycznie (tysiąc odwiedzających w tym samym płaszczu).
Czy historia się trzyma. Twoja przeglądarka podaje pewne parametry w pierwszym żądaniu. Skrypty strony zadają te same pytania. Jeśli odpowiedzi się różnią, ktoś kłamie.
Kiedy ochrona ma wątpliwości, czekasz — dosłownie. Strona „chwilę momencik" uruchamia małą łamigłówkę i obserwuje, jak twoja przeglądarka ją przerabia. Prawdziwe przeglądarki kończą i idą dalej. Wiele narzędzi do scrapowania tam utyka, robiąc dokładnie to samo, co tysiące innych zablokowanych odwiedzających.
Nieunikniona przyszłość
Mój прогноз: AI agents będą czytać sieć, tak jak druk ostatecznie dotarł do Imperium Osmańskiego. Technologia jest zbyt użyteczna, wartość zbyt ogromna, presja zbyt nieustępliwa. Jedynymi pytaniami są: jak tam dotrzemy i kto skorzysta na tej transformacji.
Obecni bramkarze nie chronią sieci przed szkodą. Oni pobierają haracz od transformacji, której nie mogą zatrzymać. Blokują małych operatorów, podczas gdy dobrze finansowane operacje śmieją się w drodze przez farmy residential IPs. Tworzą tarcia dla uczciwych badań, podczas gdy zaawansowane scrapery pozostają largely nietknięte.
Developerzy i startupу budujący z AI agents dziś to early adopters technologii, która stanie się standardem w ciągu dekady. Analogia z drukarstwem nie jest idealna — sieć jest bardziej krucha, bardziej sporna, bardziej wartościowa jako wspólna infrastruktura. Ale kierunek jest jasny.
Osmanowie ostatecznie zaakceptowali druk, kiedy Europa wydrukowała już zbyt wiele, by ignorować. Z AI agents jeszcze tam nie jesteśmy. Ale zegar tyka, a koszt bycia po złej stronie tej transformacji stale rośnie.
Pytanie nie brzmi, czy budować z AI agents. Brzmi: czy budować teraz, kiedy krajobraz dopiero się kształtuje, czy czekać, aż warunki ustali ktoś inny.
Wiem, która opcja brzmi jak postęp.