Štúdia: 32 % arXiv preprints nesie znaky AI-generovaného textu — CS vedie s 65 %
Čo sa stalo
Nová kvantitatívna štúdia analyzovala arXiv preprints a zistila, že ~32 % nedávnych vedeckých článkov vykazuje charakteristiky strojovo generovaného textu, s ostrými rozdielmi medzi odbormi.
Kontext a dopad
Stúdia používa kalibrovaný detektor s 0,4 % falošne pozitívnou mierou na pre-ChatGPT článkoch ako kontrola. Podiel flagovaných prác vzrástol v dvoch vlnách — po ChatGPT (Q4 2022) a po GPT-4 (Q1 2023). Toto má závažné implikácie pre vedeckú integritu, peer review a spoľahlivosť akademickej výskumnej produkcie.
Detaily
- ~32 % celkových arXiv preprints má znaky AI-generovaného textu (posledný kompletný kvartál)
- Computer Science: 65 % flagovaných článkov
- Matematika: iba 0,7 % flagovaných — takmer nedotknutá
- Metodológia: kalibrovaný detektor s 0,4 % false-positive mierou na pre-GPT baseline
- Rast v dvoch vlnách: prvá po ChatGPT, druhá po GPT-4
- Vyvoláva otázky o peer review procesoch a akademickej integrite
Otvoriť pôvodný zdroj
unslop.run