Detekce AI textu v praxi: které signály fungují
Detekce textu generovaného velkými jazykovými modely se za poslední dva roky posunula od jednoduchých heuristik k systémům, které kombinují statistickou analýzu s hlubokým učením. Základní princip zůstává stejný: lidský text obsahuje určitou míru nepředvídatelnosti, zatímco výstup z LLM má tendenci být hladší, statisticky „pravděpodobnější". Právě tuto vlastnost měří perplexita a burstiness. Nízká perplexita znamená, že model s vysokou jistotou předpovídá každé další slovo. Lidský text má perplexitu vyšší a hlavně kolísavou – střídá banální věty s neobvyklými obraty. Detektory proto nehledají jediný usvědčující znak, ale pracují s kombinací stovek slabých signálů.
Mezi nejspolehlivější praktické indikátory patří opakující se rytmus vět, nadměrné používání spojovacích výrazů („navíc", „kromě toho", „je důležité poznamenat"), vyhýbání se idiomům a absenci konkrétních, ověřitelných detailů. LLM se prozrazují také tím, že drží formální tón i tam, kde by člověk přešel do hovorové zkratky, nebo naopak používají obchodní fráze v neformálním kontextu. Pokud chcete proniknout hlouběji do konkrétních postupů, na aicopywriting.cz najdete praktické metody rozpoznávání, které kombinují jazykovou analýzu s redakční zkušeností. Surová data z detektorů ale nikdy nejsou stoprocentní – falešně pozitivní výsledky jsou běžné u odborných textů, kde je vysoká terminologická hustota a předvídatelná stavba vět.
Proč se LLM stále prozrazují, i když se jejich výstup neustále zlepšuje? Hlavní důvod je architektonický. Modely jsou trénované tak, aby maximalizovaly pravděpodobnost dalšího tokenu, což vede k preferenci bezpečných, průměrných formulací. I pokročilé modely s teplotou nastavenou výše mají tendenci vracet se k výchozímu stylu, jakmile délka textu přesáhne několik odstavců. Dalším prozrazujícím faktorem je neschopnost udržet konzistentní idiosynkratické chyby, které má každý lidský pisatel – třeba specifické překlepy, neobvyklou interpunkci nebo osobní zkratky. Detekce se proto v praxi neobejde bez kombinace automatických nástrojů a lidského posouzení kontextu.
Zajímavé je, že nejlepší detektory dnes nejsou ty s největším tréninkovým datasetem, ale ty, které se zaměřují na stylometrické rysy odolné vůči parafrázování. Mezi ně patří distribuce délek slov, poměr hapax legomen (slov použitých jen jednou) nebo syntaktická hloubka vět. Právě tyto znaky se mění jen pomalu, i když text projde lidskou editací. Pro praktické nasazení to znamená, že detekce AI textu není jednorázový test, ale průběžný proces, který vyžaduje kalibraci na konkrétní doménu a typ obsahu.