Fungujú detektory AI skutočne? Čo hovorí výskum

Fungujú detektory AI skutočne? Čo hovorí výskum

Loch Ness · OVERENÉ ALEBO VIBE? · AI detektory Od Camille G., zakladateľky Loch Ness · Publikované 29. septembra 2026 · Naposledy aktualizované 29. septembra 2026 Krátka odpoveď: niekedy, a nie dosť spoľahlivo na to, aby ste niekoho obviňovali. Nezávislé štúdie stále nachádzajú rovnaký vzor: detektory prehliadajú veľa textu vytváraného AI, najmä keď bol…


Loch Ness · OVERENÉ ALEBO LEN POCITY? · Detektory AI

Autor: Camille G., zakladateľ Loch Ness · Zverejnené 29. septembra 2026 · Posledná aktualizácia 29. septembra 2026

Krátka odpoveď: niekedy, a nie dosť spoľahlivo na to, aby sme niekoho obviňovali. Nezávislé štúdie stále nachádzajú ten istý vzor: detektory prehliadajú veľa textu vytváraného AI, najmä ak bol upravený, a nesprávne označujú skutočné ľudské písanie, najčastejšie od ľudí píšucich v druhom jazyku. Skóre detektora je odhad s připojeným percentom, nie dôkaz.

Sám si staviam nástroje na bodovanie, vrátane algoritmu za našim testom kreativity, takže tieto čísla čítam okom vývojára. Skóre vám povie, ako blízko sa text zhoduje so vzorcom. Nemôže vám povedať, kto sedel pri klávesnici.

Označenie pôvodu ľudí · Pre spisovateľov Napísal si každé slovo. Urob to overiteľným. Ukážte nám svoje návrhy a históriu verzií raz, za živa alebo na obrazovke. Čitatelia a klienti dostanú verejnú stránku, ktorá vás podporuje, nie skóre detektora. Buďte overený, je to zadarmo → Ešte nie ste pripravení na recenziu? Získajte bezplatný samo-deklarovaný badge →

Tvrdenie: "Detektor AI môže zistiť, či to napísal človek alebo stroj"

To je sľub, ktorý stojí za každým „AI skóre", ktoré vidíte: vložte text, dostanete percento, poznacie pravdu. Školy, vydavateľstva a klienti používajú tieto skóre na prijímanie skutočných rozhodnutí o skutočných ľuďoch. Preto záleží na tom, ako často majú pravdu.

Čo hovorí výskum

Najväčší nezávislý test. V roku 2023 tím vedený Deborou Weber-Wulfovou testoval 14 nástrojov na detekciu, vrátane komerčných systémov Turnitin a PlagiarismCheck. Každý nástroj dosiahol presnosť pod 80% a len päť dosiahlo viac ako 70%. Nástroje mali tendenciu označovať texty ako písané ľuďmi a vykázali horšie výsledky, keď bol text z umelej inteligencie upravený, parafrázovaný alebo strojovo preložený. Autori dospeli k záveru, že dostupné nástroje nie sú ani presné ani spoľahlivé (International Journal for Educational Integrity, 2023).

Na počesť detektorom je však potrebné poznamenať jednu výnimku: v teste dokumentov vytvorených umelou inteligenciou ich Turnitin klasifikoval správne ako jediný (Týždenný zhrnutie štúdie AI). Takže niektoré nástroje dobre zachytávajú surový, neupravovaný text AI. Problém je všetko okolo tohto prípadu.

Aj OpenAI sa vzdalo svojho vlastného detektora. OpenAI vydal klasifikátor AI textu v januári 2023. Podľa vlastných údajov správne označil 26% AI-napísaného textu ako pravdepodobne AI a omylom označil ľudský text v 9% prípadov. Bol stiahnutý 20. júla 2023 kvôli jeho nízkej presnosti (OpenAI).

Skupina, ktorá platí cenu. Výskumníci zo Stanfordu spustili 91 esejí napísaných negrafitmi anglického jazyka na skúške TOEFL cez sedem populárnych detektorov. V priemere detektory nesprávne označili 61% týchto ľudských esejí ako vygenerované umelou inteligenciou a 89 z 91 esejí bolo označených aspoň jedným detektorom. Eseje amerických študentov ôsmeho ročníka boli medzitým klasifikované takmer dokonale (Liang et al., Patterns, 2023).

Prečo sa mýlia

Mnohé detektory sa veľmi spoliehajú na to, ako predvídateľný je text. AI modely majú tendenciu vyberať pravdepodobné slová, takže veľmi predvídateľné písanie vyzerá "strojovo". Ale aj veľa ľudí píše predvídateľne: ľudia píšuci v druhom jazyku, študenti nasledujúci šablónu, ktokoľvek píšuci zámerne jednoducho. V štúdii Stanfordu boli eseje, ktoré každý detektor označil, presne tie s najpredvídateľnejším sformulovaním (Vzory).

Opačná strana je rovnako nepohodlná: keď výskumníci požiadali ChatGPT, aby prepísala tie isté eseje s prefíkanejšou slovnou zásobou, detektory ich vyhlásili za ľudské (ScienceDaily). Prediktívnosť je štýl, nie odtlačok prsta. Hlbšie sa venujem tomu, ako dochádza k falošným pozitívam a kto je postihnutý, v prečo detektory AI označujú ľudské písanie.

Verdict: 🟡 Čiastočne overené. Detektory môžu čas od času zachytiť surový, neupravený text vytvorený AI. Avšak nedetegujú upravený text vytvorený AI, nesprávne označujú skutočných autorov a sú najprísnejšie voči ľuďom píšucim v druhom jazyku. Skóre detektora môže spustiť konverzáciu. Nikdy by ju nemal ukončiť.

Ak detektor povie, že ste používali AI

Neargumentuj s percentami. Ukáž radšej svoj postup: históriu verzií tvojho dokumentu, tvoje návrhy, tvoje poznámky. To je dôkaz, ktorý skóre nemôže dosiahnuť, a je to najrýchlejší spôsob, ako veci vyriešiť. Krok za krokom: ako dokázať, že si to napísal sám.

Lepšia otázka ako "čo hovorí detektor?"

Opýtajte sa, ako bol text vytvorený. Používal autor AI na kontrolu pravopisu, na generovanie nápádov, na návrh odseku? To nie sú tie isté veci, a väčšina čitateľov sa zaujíma o rozdiel. Kde čestne nakresliť hranicu: písanie s AI, kde je hranica.

A ak chcete, aby čitatelia vedeli, že vaša práca je vaša skôr, ako ju niekto spustí detektor, označenie podložené skutočnou kontrolou vášho postupu hovorí viac ako akékoľvek skóre. Porovnávam možnosti v značky obsahu napísaného človekom pre autorov a bloggerov.

Chcete, aby vám niekto nezávislý skontroloval váš proces písania a verejne to povedal? Pozrite si, ako funguje recenzia Human Origin →

Úplné zverejnenie: Vytvoril som Human Origin, značku, ktorá kontroluje proces tvorcu a zverejňuje, čo bolo skontrolované. Hovorím vám to, aby ste mohli vážiť moje slová o tom. Všetko vyššie uvedené je založené na zdrojoch nižšie, nie na mojej značke.

Zdroje

Denník aktualizácií

September 29, 2026 — First publication.