Článok
Môj blog je plný agentov a botov
V minulosti som písal o tom, ako som si vyvíjal vlastný analytický nástroj. Postavil som ho tak, aby bol v súlade s ochranou osobných údajov. A to natoľko, že od návštevníka stránky ani nepotrebuje súhlas. Písal som aj o tom, aké problémy som pri vývoji riešil a ako mi v tom pomáhala AI.
Tento nástroj mal už v prvej verzii zabudovanú detekciu botov a podozrivého správania (pravdepodobných botov). Ale nestačilo to. Návštevy, a najmä návštevy z directu, mali veľmi vysoký počet a zvláštne veľký podiel na celkovej návštevnosti. Preto som sa rozhodol do tejto témy opäť ponoriť a vylepšiť svoje vlastné analytics.
Teraz, potom čo sa mi to podarilo už do značnej miery vyladiť, so záujmom čítam príspevky o tom, ako niekto tvrdí, že 20 % návštev jeho webu sú boti a 80 % ľudia. Na pár takých príspevkov, napríklad na Threads, som zareagoval, že toto som si kedysi tiež myslel, dnes by som povedal, že bližšie k pravde aj na tom vašom webe bude opačný pomer.
Ako som k tomuto pohľadu dospel?
Čo prvá verzia môjho vlastného analytického systému identifikovala ako bota
Prvá verzia stála hlavne na dvoch veciach. Prvá bola jednoduchá. Poznám zoznam známych robotov a hľadám ich meno v hlavičke prehliadača. Googlebot, GPTBot, Amazonbot a ďalšie. Druhá vec bol prehliadač, ktorý neposiela jazyk stránky. To býva tichý znak, že za návštevou nie je človek.
Toto chytí tých zrejmých. Lenže objavila sa nová skupina návštev, ktorú to nechytí. Sú to programy, ktoré sa tvária ako bežný prehliadač. Nemajú v hlavičke meno bota. Majú parametre človeka. Pôvodný filter ich neodhalí.
Prečo scroll nestačí
Napadlo mi, že človeka spoznám podľa toho, že na stránke niečo robí. Že scrolluje, číta, klikne. Niekedy platilo, že robot toto neurobí.
Dnes to už neplatí. Tieto nové programy stránku naozaj spustia. Vyrolujú článok, kliknú na tlačidlo, správajú sa skoro ako človek. Scroll mi teda povie, že návšteva je s určitou aktivitou. Nepovie mi, či za ňou bol človek.
Viac znakov naraz
Tak som prestal hľadať jeden znak a začal som ich skladať. Sám o sebe nestačí žiadny. Ale keď ich dám viac dohromady, vznikne skóre. Podľa neho viem návštevu označiť ako pravdepodobného AI agenta aj vtedy, keď ju jeden jediný znak neprezradí.
Pokračovať v čítaní zadarmo
Zadajte e-mail a čítajte ďalej zadarmo. Prihláste sa tým aj na odber mesačného newslettera. Žiadny spam, kedykoľvek sa odhlásite.
Zhrnutie
Časté otázky k téme článku
Koľko percent návštevnosti webu tvoria boti?
Ako spoznať bota, ktorý sa tvári ako človek?
Prečo scroll nie je dôkaz, že návštevník je človek?
Čo znamenajú náhodné parametre v adrese ako ?subject= alebo ?utm_source=?
Naozaj je väčšina návštevnosti webu neľudská?
Ďalšie články
Pred pár týždňami som si na notebook nainštaloval malý lokálny AI model, ktorý sleduje živý obraz z kamery. Zapol som webkameru vo tme a v skoro úplnej tme rozoznal mňa aj predmety v miestnosti. Že takéto veci existujú, som vedel dávno. Oči mi otvorila dostupnosť. Nainštaloval som to na jeden prompt, zadarmo, beží celé na mojom stroji a nikam neposiela dáta.
Mám pri sebe Heideggera a zápisník. Pýtam sa, kam to všetko smeruje, kam nás vedie umelá inteligencia.
Sedemdesiat percent. Tam začína prvý výstup AI, aj keď jej dáte celý firemný kontext aj najlepšie príklady z minulosti. Hovoríme o type výstupu, ktorý sa nedá zadefinovať programaticky. Je zložitejší. Často ide o kreatívnu prácu. Pri jednom opakovanom type výstupu som sa dostal na osemdesiat percent za týždeň. Každé jedno percento vyššie je ťažšie než to predošlé.
Internet sme dlho brali ako hlavný smer cesty, miesto, kde sa odohráva práca aj vzťahy. Lenže väčšina toho, čo na ňom dnes vidíme, už je alebo čoskoro bude AI-generovaná: text, obrázky, profily aj komentáre. Internet sa mení na online hru plnú botov, kde si pri ničom nemôžete byť istý, že na druhej strane je človek. A tak sa pýtam: bol online svet hlavná cesta, alebo len dočasná odbočka, z ktorej sa časť ľudí vráti späť do offline?
Pred pár dňami som mal pohovor so seniórnym marketérom. Skúsený človek, roky praxe. Spýtal som sa ho na AI. Povedal, že ju takmer nepoužíva. Mal jednu zlú skúsenosť s výstupom a usúdil, že je príliš skúsený na to, aby mu to dávalo hodnotu, keď to nie je stopercentné. Poznám aj druhú stranu: profíkov, ktorí si automatizujú všetko, čo sa automatizovať dá.
Európa nemá kapacity, aby čelila plnohodnotnej masívnej vojne dronov, takej akú vidíme na Ukrajine. Oslabujú ju tri závislosti: materiál pre obranné systémy dodáva Čína, vojenské schopnosti, ktoré Európa nemá, dodávajú USA, a dvadsaťsedem štátov sa nevie dohodnúť, ako rýchlo a za čo. Plány na prezbrojenie existujú, ich napĺňanie je však pomalé.
AI spraví grafiku, newsletter aj produktovú stránku rýchlejšie než človek. Tomu, kto to robil, zostáva jediné: posúdiť, či je výstup dobrý. Lenže väčšina ľudí má horší úsudok než AI. A kto nevie posúdiť kvalitu, nevie ani delegovať. Ako zistíš, či je tvoj úsudok ten, na ktorý sa firma spolieha, alebo ten nahraditeľný?
V apríli som v prvej časti tejto série písal o AI predikčnom systéme, ktorý som začal vyvíjať na vlastnom počítači. Vtedy mal software pár hodín a záznam predpovedí bol prázdny. Odvtedy záznamy v systéme ukázali vec, ktorá sa na začiatku dala čakať. Systém ešte nerozumie trhu, ktorý má predpovedať. Vie si nájsť makro kontext, účtovnú hodnotu firiem, zisky. Ale nevie si tie veci poskladať do niečoho, čo by mu pomáhalo porozumieť cene.
Praha, 13. mája 2026. Cestou do práce som začal premýšľať o niečom, čo mi zostalo v hlave celé dni. Ak väčšina rutinnej práce na počítači v nasledujúcich desiatich rokoch zmizne a s ňou aj veľká časť opakujúcej sa manuálnej práce, čo sa stane s tokom peňazí? Kto bude platiť komu a za čo? Aké ekonomické vrstvy budú existovať, aké budú veľké a aké vzťahy medzi nimi pobežia? Toto je šesťvrstvová mapa, ktorú som ako odpoveď načrtol.
Vyvíjam AI systém na predpovedanie indexu S&P 500. Beží na mojom vlastnom počítači, používa verejne dostupné dáta zdarma od yfinance, FRED a Shillerovho datasetu a každú predpoveď hodnotí oproti realite. Táto séria dokumentuje samotný vývoj: rozhodnutia, metodiku, chyby.
Štyri dni v Katalánsku. Bez počítača, bez AI, takmer bez sociálnych sietí. Kúpil som si tento zápisník, aby som doň písal to, o čom budem premýšľať, a to, na čo na tejto ceste narazím a čo sa naučím.
„Neospravedlniteľné, neobhájiteľné. Na toto sa nesmie nikdy zabudnúť.“
