Przejdź do treści
aiconsulting.capital

Dane własne

Sprawdziliśmy detektor AI na 18 tekstach w trzech językach

Każde zestawienie detektorów powtarza to samo zdanie: te narzędzia bywają zawodne, traktuj wynik jako sygnał, nie wyrok. Prawie żadne nie pokazuje, jak ta zawodność wygląda w liczbach. Zmierzyliśmy to — na korpusie, w którym przy każdym tekście wiemy na pewno, czy napisał go człowiek, czy maszyna.

Testowany detektor
ZeroGPT (wersja darmowa)
Data testu
2026-07-28
Próg werdyktu
50%

Wynik

Przyjmując 50% i więcej za werdykt „AI", detektor trafił przy 6 tekstach na 18. Przy pytaniu rozstrzyganym na dwie strony to gorzej niż rzut monetą.

trafność ogólna33%6/18
wykryte teksty AI22%2/9
fałszywe oskarżenia56%5/9

To, co najważniejsze: język

Dla polskiego i niemieckiego detektor zwrócił dokładnie 0,0% przy każdym tekście napisanym maszynowo — nie „nie mam pewności", tylko pewny werdykt „napisane przez człowieka". Jednocześnie ludzkie polskie hasła encyklopedyczne ocenił średnio na 74% AI. Dla polszczyzny to nie jest narzędzie niepewne, tylko odwrócone.

Językwykryte AIfałszywe oskarżeniaśr. wynik na tekstach AIśr. wynik na ludzkich
angielski2/32/345,4%69,0%
polski0/32/30,0%73,8%
niemiecki0/31/30,0%33,3%

Każdy tekst, każdy wynik

Pełny korpus, żebyś mógł ocenić sam test, a nie wierzyć nam na słowo. „Oczekiwane" to stan faktyczny, który znamy; „wynik" to surowy procent zwrócony przez detektor.

TekstPochodzenieOczekiwaneWynik detektoraWerdykt
angielski · 170 słównasz artykuł · en-are-we-in-an-ai-bubble.mdAI58,6%trafiony
angielski · 170 słównasz artykuł · en-best-ai-detectors-2026.mdAI20,8%pudło
angielski · 170 słównasz artykuł · en-biggest-ai-companies-2026.mdAI56,8%trafiony
polski · 170 słównasz artykuł · pl-czy-mamy-banke-ai.mdAI0,0%pudło
polski · 170 słównasz artykuł · pl-najlepsze-detektory-ai-2026.mdAI0,0%pudło
polski · 164 słównasz artykuł · pl-najwieksze-spolki-ai-2026.mdAI0,0%pudło
niemiecki · 170 słównasz artykuł · de-ki-blase-2026.mdAI0,0%pudło
niemiecki · 170 słównasz artykuł · de-beste-ki-detektoren-2026.mdAI0,0%pudło
niemiecki · 170 słównasz artykuł · de-groesste-ki-unternehmen-2026.mdAI0,0%pudło
angielski · 170 słówWikipedia, rewizja 2020-05-31 · Baltic Seaczłowiek100,0%pudło
angielski · 170 słówWikipedia, rewizja 2020-05-30 · Wind powerczłowiek40,9%trafiony
angielski · 170 słówWikipedia, rewizja 2020-05-25 · Lighthouseczłowiek66,1%pudło
polski · 170 słówWikipedia, rewizja 2020-04-08 · Morze Bałtyckieczłowiek88,2%pudło
polski · 170 słówWikipedia, rewizja 2020-04-05 · Latarnia morskaczłowiek100,0%pudło
niemiecki · 170 słówWikipedia, rewizja 2020-05-30 · Ostseeczłowiek0,0%trafiony
niemiecki · 170 słówWikipedia, rewizja 2020-05-18 · Windenergieczłowiek100,0%pudło
niemiecki · 170 słówWikipedia, rewizja 2020-04-11 · Leuchtturmczłowiek0,0%trafiony
polski · 170 słówWikipedia, rewizja 2020-05-16 · Wisłaczłowiek33,2%trafiony

Jak zbudowaliśmy korpus

Korpus to 18 tekstów po około 170 słów, po sześć na język. Dziewięć napisał model językowy: to fragmenty artykułów opublikowanych na tym portalu, więc ich pochodzenie nie jest domysłem. Pozostałe dziewięć jest ludzkie i pochodzi z rewizji Wikipedii zapisanych przed czerwcem 2020 — na długo przed obecnym pokoleniem modeli, i właśnie to czyni je użyteczną grupą kontrolną. Każdy tekst wysłaliśmy raz i zapisaliśmy surowy zwrócony procent.

Czego ten test nie pokazuje

  • Jeden detektor, w wersji darmowej, na niewielkiej próbie. To nie jest ranking rynku, tylko sprawdzenie jednej tezy.
  • Płatne narzędzia (Sapling, GPTZero, Copyleaks) wymagają założenia konta, więc nie były testowane i nie podajemy dla nich żadnych liczb.
  • Proza encyklopedyczna czyta się inaczej niż tekst blogowy, a detektory mogą reagować na ten rejestr odmiennie.
  • Wikipedia jest obficie reprezentowana w danych treningowych modeli, co samo w sobie może wpływać na ocenę.

Wykorzystanie tych wyników

Możesz cytować i przedrukowywać tę tabelę, podając link do tej strony. Ludzka połowa korpusu pochodzi z Wikipedii i jest dostępna na licencji CC BY-SA; maszynowa to nasze własne, opublikowane teksty.