Loch Ness · SCRIS DE OAMENI · Fals pozitivi ai detectoarelor de IA
Parte din ghid: Detectoarele de IA funcționează cu adevărat? Ce spune cercetarea
De Camille G., fondatoare a Loch Ness · Publicat 29 septembrie 2026 · Actualizat ultima dată 29 septembrie 2026
Răspuns scurt: majoritatea detectoarelor nu recunosc deloc AI-ul. Ele măsoară cât de previzibil este un text, iar mulți oameni reali scriu în mod previzibil. Oamenii care scriu într-o limbă a doua, studenții care urmează un șablon, oricine scrie în mod intenționat simplu: aceștia sunt cei care sunt marcat. Iată cum se întâmplă acest lucru și de ce nu e vina ta.
Etichetă Origine Umană · Pentru scriitori Un detector te-a marcat? Procesul tău este răspunsul. Arată-ți schiţele și istoricul versiunilor o dată, în direct sau într-o înregistrare de ecran, şi obţine o pagină publică care spune ce a fost verificat. Gratuit în perioada pilotului. Obțineți verificare, este gratuit → Nu sunteți gata pentru o recenzie? Obțineți insigna autodeklarată gratuită →Cum decid majoritatea detectoarelor
Modelele de limbă tind să aleagă cuvinte probabile. Așadar, mulți detectori evaluează un text în funcție de cât de surprinzătoare sunt alegerile sale de cuvinte, o măsură pe care cercetătorii o numesc perplexitate. Surpriza scăzută sună „ca făcută de mașină". Problema este că aceasta măsoară stilul, nu autoria. În studiul Stanford asupra șapte detectori populari, eseurile umane pe care fiecare detector le-a marcat erau exact cele cu cea mai mică perplexitate (Liang et al., 2023).
Cine este semnalat cel mai mult
- Oameni care scriu într-o limbă a doua. Același studiu a procesat 91 de eseuri TOEFL prin șapte detectoare: în medie, 61% au fost etichetate incorect ca fiind generate de IA, iar 89 din 91 au fost marcate de cel puțin un detector. Eseurile elevilor de clasa a VIII-a din SUA au fost clasificate aproape perfect (Modele).
- Texte scurte. OpenAI a declarat că propriul său clasificator a fost nereliabil pe intrări scurte și s-a îmbunătățit pe măsură ce textele deveneau mai lungi, înainte de a-l retrage din cauza preciziei scăzute (OpenAI). O scrisoare de prezentare sau o descriere de produs oferă unui detector foarte puțin cu care să lucreze.
- Scriere formulaică. Șabloanele, structurile standard și tipul de proză neutră pe care școlile și întreprinderile o solicită frecvent sunt previzibile din proiectare.
Același truc funcționează și invers
Când cercetătorii de la Stanford au cerut lui ChatGPT să rescrie acele eseiuri umane cu un vocabular mai sofisticat, detectoarele au început să le numească omenești (ScienceDaily). Un test mai larg a 14 instrumente a găsit aceeași slăbiciune: acuratețea a scăzut mai mult odată ce textul generat de IA a fost editat, parafrazat sau tradus automat (Weber-Wulff et al., 2023). Deci un scor de detector spune mai mult despre cum sună un text decât despre cine l-a scris.
Costă oamenilor lucruri reale
Aceasta nu este doar o problemă academică. Studenții s-au confruntat cu proceduri de integritate din cauza scorurilor de detector, iar în iunie 2024 Gizmodo a raportat că scriitori freelance și jurnaliști și-au pierdut munca după ce software-ul de detecție i-a clasificat în mod eronat ca fiind generate de inteligență artificială (rezumat pe Wikipedia).
Dacă un detector ți-a marcat textul
Nu este nimic care să trebuie remediat în scrisul tău. Ceea ce ajută sunt dovezi cu privire la cum l-ai scris: istoricul versiunilor documentului tău, schițele tale, notele tale. Un procent nu poate concura cu o cronologie a muncii tale. Am pus metoda completă în cum să dovedești că l-ai scris singur.
Și te rog să nu începi să scrii mai "sofisticat" ca să mulțumești un detector. După cum arată cercetarea, asta face exact AI-ul atunci când rescrie pentru a ocoli detectoarele. Vocea ta naturală este bună.
Obosit de a fi judecat după un scor? Lasă pe cineva să vadă cum scrii de fapt. Vedeți cum funcționează recenzia Human Origin →Înapoi la prezentare generală: detectoarele de IA funcționează cu adevărat?.
Transparență deplină: Human Origin, eticheta menționată pe această pagină, este ceva pe care l-am creat eu. O semnallez pentru ca să poți cântări ceea ce spun despre ea. Faptele de mai sus se bazează pe sursele de mai jos.
Surse
- Liang et al. — Detectoarele GPT sunt părtinitor față de scriitori non-nativi de engleză, Patterns (2023)
- Liang et al. — același studiu, text integral pe arXiv
- ScienceDaily — Detectoarele GPT pot fi părtinite împotriva scriitorilor nonne-nativi de limba engleză (iulie 2023)
- OpenAI — Nou clasificator AI pentru indicarea textului scris de AI (cu nota de încetare din iulie 2023)
- Weber-Wulff et al. — Testarea instrumentelor de detectare pentru textul generat de IA (2023), via ERIC
- Wikipedia — Detectarea conținutului creat de inteligența artificială (raportare privind pierderile de locuri de muncă pentru lucrători independenți)
Jurnal de actualizări
September 29, 2026 — First publication.
