Czy detektory AI rzeczywiście działają? Co mówią badania

Czy detektory AI rzeczywiście działają? Co mówią badania

Loch Ness · ZWERYFIKOWANE CZY TYLKO WRAŻENIA? · Detektory AI Autorka: Camille G., założycielka Loch Ness · Opublikowano 29 września 2026 · Ostatnia aktualizacja 29 września 2026 Krótka odpowiedź: czasami, i nie na tyle niezawodnie, aby oskarżać kogoś. Niezależne badania wciąż znajdują ten sam wzorzec: detektory nie wykrywają dużo tekstu generowanego przez AI, zwłaszcza gdy...


Loch Ness · ZWERYFIKOWANE CZY TYLKO SPEKULACJE? · Detektory AI

Autor: Camille G., założyciel Loch Ness · Opublikowano 29 września 2026 · Ostatnia aktualizacja 29 września 2026

Krótka odpowiedź: czasami, ale niewystarczająco niezawodnie, aby kogoś oskarżać. Niezależne badania konsekwentnie wykazują ten sam schemat: detektory przegapniają wiele tekstu AI, szczególnie po edycji, i błędnie flagują prawdziwy tekst pisany przez ludzi, najczęściej przez osoby piszące w języku obcym. Wynik detektora to przypuszczenie z załączonym procentem, a nie dowód.

Stworzę narzędzia do oceniania sam, w tym algorytm stojący za naszym testem kreatywności, więc czytam te liczby okiem dewelopera. Wynik mówi ci, jak blisko tekst odpowiada wzorcowi. Nie może ci powiedzieć, kto siedział przy klawiaturze.

Etykieta pochodzenia człowieka · Dla pisarzy Napisałeś każde słowo. Uczyń to weryfikowalne. Pokaż nam swoje szkice i historię wersji raz, na żywo lub w nagraniu ekranu. Czytelnicy i klienci otrzymują stronę publiczną, która Cię wspiera, a nie wynik detektora. Zweryfikuj się, to darmowe → Nie gotowy na recenzję? Uzyskaj bezpłatny badge samodzielnie deklarowany →

Twierdzenie: „Detektor AI potrafi stwierdzić, czy napisał to człowiek, czy maszyna"

Taka jest obietnica stojąca za każdym "wynikiem AI", który widzisz: wklej tekst, otrzymaj procent, poznaj prawdę. Szkoły, wydawnictwa i klienci używają tych wyników do podejmowania rzeczywistych decyzji dotyczących rzeczywistych ludzi. Dlatego ważne jest, jak często się mylą.

Co mówią badania

Największy niezależny test. W 2023 roku zespół kierowany przez Deborę Weber-Wulff przetestował 14 narzędzi do wykrywania, w tym komercyjne systemy Turnitin i PlagiarismCheck. Każde narzędzie uzyskało dokładność poniżej 80%, a tylko pięć przekroczyło 70%. Narzędzia skłaniały się ku uznaniu tekstów za napisane przez człowieka i radziły sobie gorzej, gdy tekst AI został edytowany, parafrazowany lub przetłumaczony maszynowo. Autorzy wyciągnęli wniosek, że dostępne narzędzia nie są ani dokładne, ani wiarygodne (Międzynarodowy Dziennik Uczciwości Edukacyjnej, 2023).

Aby być sprawiedliwym wobec detektorów, to samo badanie odnotowało jeden wyjątek: w teście dokumentów generowanych przez AI tylko Turnitin zaklasyfikował je wszystkie poprawnie (Tygodniowe streszczenie badania AI). Niektóre narzędzia dobrze wychwytują surowy, niezmontowany tekst AI. Problem leży w całym kontekście tej sprawy.

Nawet OpenAI zrezygnowało ze swojego własnego detektora. OpenAI wypuściło klasyfikator tekstu AI w styczniu 2023 r. Według jego własnych danych, prawidłowo oznaczył 26% tekstu napisanego przez AI jako prawdopodobnie pochodzący z AI i błędnie oznaczył pisanie człowieka w 9% przypadków. Wycofano go 20 lipca 2023 r. z powodu niskiego wskaźnika dokładności (OpenAI).

Grupa, która płaci cenę. Naukowcy ze Stanfordu przeanalizowali 91 esejów napisanych przez osoby mówiące po angielsku jako obcy język, którzy przystępowali do egzaminu TOEFL, używając siedmiu popularnych detektorów. Średnio detektory błędnie zaklasyfikowały 61% tych esejów napisanych przez ludzi jako wygenerowane przez sztuczną inteligencję, a 89 z 91 esejów zostało oznaczonych przez co najmniej jeden detektor. Eseje napisane przez uczniów ósmej klasy z USA były natomiast klasyfikowane niemal bezbłędnie (Liang et al., Patterns, 2023).

Dlaczego się mylą

Wiele detektorów w dużej mierze polega na przewidywalności tekstu. Modele AI mają tendencję do wybierania prawdopodobnych słów, więc bardzo przewidywalne pisanie wygląda „mechanicznie". Ale wiele osób pisze przewidywalnie: osoby piszące w drugim języku, uczniowie stosujący się do szablonu, każdy piszący umyślnie w prosty sposób. W badaniu Stanford każdy esej, który flagowały detektory, to dokładnie te z najbardziej przewidywalnym sformułowaniem (Wzory).

Odwrotna strona jest równie niezręczna: gdy badacze poprosili ChatGPT, aby przepisał te same eseje ze słownictwem bardziej wyszukanym, detektory uznały je za pisane przez człowieka (ScienceDaily). Przewidywalność to styl, a nie odcisk palca. Zagłębiam się w to, jak dochodzi do fałszywych alarmów i kto jest nimi dotknięty, w dlaczego detektory AI oznaczają pisanie człowieka.

Werdykt: 🟡 Częściowo zweryfikowane. Detektory potrafią czasami wychwyciać surowe, niezmienione teksty AI. Jednak nie wykrywają edytowanych tekstów AI, błędnie flagują prace rzeczywistych pisarzy i najsurowej oceniają osoby piszące w języku obcym. Wynik detektora może rozpocząć rozmowę. Nigdy nie powinien jej zakończyć.

Jeśli detektor powie, że użyłeś AI

Nie spieraj się o procent. Zamiast tego pokaż swój proces: historię wersji dokumentu, swoje szkice, swoje notatki. To jest dowód, którego żaden wynik nie może dorównać, i to najszybszy sposób na rozstrzygnięcie sprawy. Krok po kroku: jak udowodnić, że napisałeś to sam.

Lepsze pytanie niż "co mówi detektor?"

Zapytaj, jak powstał tekst. Czy autor wykorzystał AI do sprawdzenia pisowni, do burzy mózgów, do napisania akapitu? To nie jest to samo, a większość czytelników obchodzi różnica. Gdzie uczcziwie wciągnąć granicę: pisanie przy pomocy AI, gdzie jest granica.

A jeśli chcesz, aby czytelnicy wiedzieli, że twoja praca jest twoja, zanim ktoś uruchomi detektor, etykieta poparta rzeczywistą recenzją twojego procesu mówi więcej niż jakakolwiek ocena. Porównuję opcje w etykiety zawartości napisanej przez człowieka dla autorów i blogerów.

Chcesz, żeby ktoś niezależny sprawdził Twój proces pisania i publicznie o tym powiedział? Zobacz, jak działa przegląd Pochodzenia Człowieka →

Pełna transparentność: stworzyłem Human Origin, label, który przegląda proces twórców i publikuje to, co zostało sprawdzone. Informuję Cię o tym, abyś mógł ocenić, co mówię na jego temat. Wszystko, co powyżej, opiera się na źródłach poniżej, a nie na moim labelu.

Źródła

Dziennik aktualizacji

29 września 2026 — Pierwsza publikacja.