Proč anotace psané AI popisují práce, které neexistují
Vymyšlený odkaz může vypadat přesně jako skutečný, dokud ho někdo nevyhledá. Anotace pod ním se hůře falšuje, plynulý odstavec popisující metodu a zjištění práce do detailu, u práce, kterou nikdo nenapsal.
Vedoucí čte stejnou větnou strukturu desetkrát za sebou, otevírá anotovanou bibliografii, čte ji nahlas, stránku za stránkou: Tato studie zkoumá vztah mezi X a Y, využívá vzorek účastníků k prozkoumání Z a dochází k závěru, že je zapotřebí další výzkum. Všechny záznamy znějí plynule. Dva z dvanácti zdrojů, vyhledané podle názvu, neexistují.
Citace, které AI v bibliografiích halucinuje, se v referenčním řádku jen zřídka samy prozradí. Vymyšlené jméno autora a vymyšlený časopis mohou vypadat přesně jako skutečné, dokud je někdo nevyhledá. To, co podvrh prozradí jako první, téměř pokaždé, je anotace pod ním, odstavec dostatečně sebejistý na to, aby podrobně popsal metodu a zjištění článku, který nikdy nebyl napsán.
Jak rozpoznat citace, které AI v bibliografiích halucinuje
Čtěte anotaci před referenčním řádkem. Citace sama o sobě, autor, rok, časopis, DOI, to vše jsou malé strukturované vzorce, které jazykový model viděl tisíckrát, a mohou vypadat správně náhodou nebo díky zapamatování, i když za nimi nic skutečného není. Anotace naproti tomu musí říci něco o tom, co daný článek skutečně udělal, a to s takovou mírou podrobnosti, že by bylo možné zjistit, zda je to pravda, nebo ne. Pokud model zdroj nevyhledá nebo nepřečte, nedokáže to spolehlivě, a výsledek se projeví jako obecnost dávno předtím, než se vůbec dostaneme k ověření DOI.
Proč anotace prozradí více než citace
Vymyšlená citace je odhad převlečený za referenci, pravděpodobný autor, pravděpodobný časopis, řetězec ve tvaru DOI se správným počtem číslic. Vymyšlená anotace je odhad převlečený za porozumění, a porozumění je mnohem obtížnější přesvědčivě předstírat v celém odstavci. Model se musí zavázat ke vzorku, metodě a směru zjištění, a každý z těchto detailů je místo, kde mu skutečný článek může odporovat.
To je také důvod, proč je anotace pro čtenáře snazší ke kontrole než pouhý citát. Reference je formátována stejně bez ohledu na to, zda je zdroj skutečný, takže její samotná podoba neprozrazuje žádnou informaci. Anotace uvádí konkrétní tvrzení o konkrétním obsahu, takže je buď podložena skutečným článkem, nebo není, a několik minut s reálným abstraktem rozhodne, které z toho platí.
Zlidštit vlastní práci
Proměňte svůj text s pomocí AI a nechte ho znít lidsky, aniž byste zasahovali do důležitých slov nebo citací.
Co napíše model, když nikdy ve skutečnosti nečetl článek
Požádejte jazykový model, aby anotoval zdroj, pro který má jen název a hrubé téma, a on neodmítne ani se nebude vyhýbat přímé odpovědi. Předpoví odstavec, který by článek s takovým názvem pravděpodobně obsahoval, sestavený z tisíců podobných abstraktů viděných při tréninku, a vrátí jej ve stejném sebejistém registru, jaký by použil u článku, který by mohl citovat řádek po řádku.
Působí to jako průměr všeho, co kdy bylo napsáno blízko daného tématu. Poctivé shrnutí studie o spánku a paměti vám uvede jméno skutečných účastníků studie, skutečný použitý test a skutečnou hlášenou velikost efektu. Vymyšlené shrnutí by řeklo, že studie zkoumala, jak dobře lidé spali a jaká je jejich paměť, a zjistila, že mezi nimi existuje silná souvislost. Je dost obecné na to, aby pohodlně sedělo i pod jiný, nesouvisející název.
| Co je třeba zkontrolovat | Skutečná anotace obvykle obsahuje toto | Vymyšlená obvykle místo toho obsahuje toto |
|---|---|---|
| Čísla | Konkrétní velikost vzorku, velikost efektu nebo procento odpovídající skutečnému abstraktu | Žádná čísla, nebo zaokrouhlený, neověřitelný údaj, který se ve skutečném zdroji nikde neobjevuje |
| Metoda | Skutečně uvedená metoda, konkrétní test, design nebo datový soubor | Vágní odkaz na "studii" nebo "analýzu" bez uvedené metody |
| Omezení | Jedno omezení, které sami autoři uvedli a které je specifické pro jejich design | Obecné omezení, které platí pro téměř jakoukoli práci v oboru |
| Shoda reference | Citace vede na skutečný záznam, jehož název odpovídá anotaci | Reference nevede nikam, nebo vede na jinou, nesouvisející práci |
Žádná z těchto kontrol nevyžaduje přečtení celé práce. Vyžadují pouze její otevření, dostatečně dlouho na to, aby bylo možné zjistit, zda se konkrétní tvrzení v anotaci skutečně objevují v abstraktu.
Proč míra fabrikace potřebuje verzi modelu a datum
Rozsah problému je měřen, i když se jednotlivá měření navzájem neshodují, protože neměřila totéž. Při testování ChatGPT-3.5 a ChatGPT-4 na stejných 42 akademických tématech ve stejný den v roce 2023 zjistili výzkumníci, že 55 procent citací GPT-3.5 bylo zcela vymyšlených, oproti 18 procentům u ChatGPT-4. Stejné prompty, stejní výzkumníci, stejný den, změnil se pouze model a míra klesla o dvě třetiny.
Samostatná studie, která testovala halucinované skutkové okolnosti případů namísto bibliografických citací, zjistila, že ChatGPT-4 se v roce 2024 mýlil v 58 procentech případů u ověřitelných otázek týkajících se skutečných federálních soudních případů a Llama 2 se mýlil v 88 procentech případů. Toto číslo popisuje jiný úkol na jiných modelech a nemělo by se průměrovat s výše uvedenými čísly o fabrikaci citací do jedné hlavní míry. Na čem se obě studie shodují, je podoba problému, procento bez uvedené verze modelu a data nepopisuje nic konkrétního. Širší vzorec napříč šesti takovými studiemi z let 2023 až 2026 je sám o sobě samostatným tématem, does ChatGPT make up references jej pokrývá v plném rozsahu. Co je pro bibliografii konkrétně důležité, zůstává užší, zda anotace prozradí fabrikaci dříve, než někdo zkontroluje DOI.
Jak zkontrolovat každý záznam v anotované bibliografii vytvořené AI
Začněte s řádkem odkazu, vyhledejte přesný název v Google Scholar nebo na vlastním webu časopisu a považujte DOI za neověřené, dokud skutečně nevede k tomuto názvu, protože zfalšovaná citace může nést DOI, které vede na skutečný, nesouvisející článek někoho jiného. AI citation checker, který ověřuje každý záznam proti skutečné vědecké databázi tuto kontrolu automatizuje, místo aby ji ponechal na ručním vyhledávání pro každý jednotlivý zdroj.
Poté porovnejte anotaci se samotným zdrojem, ne s tím, jak přesvědčivě zní. Otevřete skutečný abstrakt a ověřte, že vzorek, metoda a zjištění, která anotace uvádí, jsou v něm skutečně obsaženy. Free annotated bibliography generator, který zakládá každé shrnutí na vlastním abstraktu článku, místo aby je sestavoval z paměti, ukazuje, jak vypadá skutečně na zdroji založená anotace vedle té, která taková nebyla.
U záznamů, které auditem projdou, jsou citing ChatGPT in APA a citing ChatGPT in MLA popsány krok za krokem.
Nic z toho nemění způsob, jakým formátujete záznam poté, co jste potvrdili, že je skutečný. Jak citovat ChatGPT samotný je samostatná otázka, která je plně pokryta pro APA, MLA, Chicago a IEEE, a generátor citací formátuje běžný odkaz stejným způsobem bez ohledu na styl. Ani jeden z nich nezachytí anotaci popisující článek, který nikdo nenapsal, dostatečně plynulou na to, aby nikoho nenapadlo ji zkontrolovat.
Často kladené otázky
Protože citace musí jen vypadat správně, stačí pravděpodobný autor, časopis a DOI, aby prošla letmým pohledem. Anotace musí být správná, protože uvádí konkrétní tvrzení o metodě a zjištěních práce, které buď odpovídá skutečnému zdroji, nebo ne. Model, který práci nikdy nečetl, může mnohem snadněji napodobit podobu odkazu než obsah shrnutí.
Content planner and copywriter at TextPulse. Sara runs the blog day to day, from planning and drafting through to publishing. She writes the practical guides: clear explanations of academic writing problems, aimed at the person who actually has to hand something in.