Academic Writing

Proč anotace psané AI popisují práce, které neexistují

Vymyšlený odkaz může vypadat přesně jako skutečný, dokud ho někdo nevyhledá. Anotace pod ním se hůře falšuje, plynulý odstavec popisující metodu a zjištění práce do detailu, u práce, kterou nikdo nenapsal.

5 min
Table showing how ai hallucinated citations in bibliographies differ from genuine ones

Vedoucí čte stejnou větnou strukturu desetkrát za sebou, otevírá anotovanou bibliografii, čte ji nahlas, stránku za stránkou: Tato studie zkoumá vztah mezi X a Y, využívá vzorek účastníků k prozkoumání Z a dochází k závěru, že je zapotřebí další výzkum. Všechny záznamy znějí plynule. Dva z dvanácti zdrojů, vyhledané podle názvu, neexistují.

Citace, které AI v bibliografiích halucinuje, se v referenčním řádku jen zřídka samy prozradí. Vymyšlené jméno autora a vymyšlený časopis mohou vypadat přesně jako skutečné, dokud je někdo nevyhledá. To, co podvrh prozradí jako první, téměř pokaždé, je anotace pod ním, odstavec dostatečně sebejistý na to, aby podrobně popsal metodu a zjištění článku, který nikdy nebyl napsán.

Jak rozpoznat citace, které AI v bibliografiích halucinuje

Čtěte anotaci před referenčním řádkem. Citace sama o sobě, autor, rok, časopis, DOI, to vše jsou malé strukturované vzorce, které jazykový model viděl tisíckrát, a mohou vypadat správně náhodou nebo díky zapamatování, i když za nimi nic skutečného není. Anotace naproti tomu musí říci něco o tom, co daný článek skutečně udělal, a to s takovou mírou podrobnosti, že by bylo možné zjistit, zda je to pravda, nebo ne. Pokud model zdroj nevyhledá nebo nepřečte, nedokáže to spolehlivě, a výsledek se projeví jako obecnost dávno předtím, než se vůbec dostaneme k ověření DOI.

Proč anotace prozradí více než citace

Vymyšlená citace je odhad převlečený za referenci, pravděpodobný autor, pravděpodobný časopis, řetězec ve tvaru DOI se správným počtem číslic. Vymyšlená anotace je odhad převlečený za porozumění, a porozumění je mnohem obtížnější přesvědčivě předstírat v celém odstavci. Model se musí zavázat ke vzorku, metodě a směru zjištění, a každý z těchto detailů je místo, kde mu skutečný článek může odporovat.

To je také důvod, proč je anotace pro čtenáře snazší ke kontrole než pouhý citát. Reference je formátována stejně bez ohledu na to, zda je zdroj skutečný, takže její samotná podoba neprozrazuje žádnou informaci. Anotace uvádí konkrétní tvrzení o konkrétním obsahu, takže je buď podložena skutečným článkem, nebo není, a několik minut s reálným abstraktem rozhodne, které z toho platí.

Zlidštit vlastní práci

Proměňte svůj text s pomocí AI a nechte ho znít lidsky, aniž byste zasahovali do důležitých slov nebo citací.

Začít zdarma

Co napíše model, když nikdy ve skutečnosti nečetl článek

Požádejte jazykový model, aby anotoval zdroj, pro který má jen název a hrubé téma, a on neodmítne ani se nebude vyhýbat přímé odpovědi. Předpoví odstavec, který by článek s takovým názvem pravděpodobně obsahoval, sestavený z tisíců podobných abstraktů viděných při tréninku, a vrátí jej ve stejném sebejistém registru, jaký by použil u článku, který by mohl citovat řádek po řádku.

Působí to jako průměr všeho, co kdy bylo napsáno blízko daného tématu. Poctivé shrnutí studie o spánku a paměti vám uvede jméno skutečných účastníků studie, skutečný použitý test a skutečnou hlášenou velikost efektu. Vymyšlené shrnutí by řeklo, že studie zkoumala, jak dobře lidé spali a jaká je jejich paměť, a zjistila, že mezi nimi existuje silná souvislost. Je dost obecné na to, aby pohodlně sedělo i pod jiný, nesouvisející název.

Co je třeba zkontrolovatSkutečná anotace obvykle obsahuje totoVymyšlená obvykle místo toho obsahuje toto
ČíslaKonkrétní velikost vzorku, velikost efektu nebo procento odpovídající skutečnému abstraktuŽádná čísla, nebo zaokrouhlený, neověřitelný údaj, který se ve skutečném zdroji nikde neobjevuje
MetodaSkutečně uvedená metoda, konkrétní test, design nebo datový souborVágní odkaz na "studii" nebo "analýzu" bez uvedené metody
OmezeníJedno omezení, které sami autoři uvedli a které je specifické pro jejich designObecné omezení, které platí pro téměř jakoukoli práci v oboru
Shoda referenceCitace vede na skutečný záznam, jehož název odpovídá anotaciReference nevede nikam, nebo vede na jinou, nesouvisející práci

Žádná z těchto kontrol nevyžaduje přečtení celé práce. Vyžadují pouze její otevření, dostatečně dlouho na to, aby bylo možné zjistit, zda se konkrétní tvrzení v anotaci skutečně objevují v abstraktu.

Proč míra fabrikace potřebuje verzi modelu a datum

Rozsah problému je měřen, i když se jednotlivá měření navzájem neshodují, protože neměřila totéž. Při testování ChatGPT-3.5 a ChatGPT-4 na stejných 42 akademických tématech ve stejný den v roce 2023 zjistili výzkumníci, že 55 procent citací GPT-3.5 bylo zcela vymyšlených, oproti 18 procentům u ChatGPT-4. Stejné prompty, stejní výzkumníci, stejný den, změnil se pouze model a míra klesla o dvě třetiny.

Samostatná studie, která testovala halucinované skutkové okolnosti případů namísto bibliografických citací, zjistila, že ChatGPT-4 se v roce 2024 mýlil v 58 procentech případů u ověřitelných otázek týkajících se skutečných federálních soudních případů a Llama 2 se mýlil v 88 procentech případů. Toto číslo popisuje jiný úkol na jiných modelech a nemělo by se průměrovat s výše uvedenými čísly o fabrikaci citací do jedné hlavní míry. Na čem se obě studie shodují, je podoba problému, procento bez uvedené verze modelu a data nepopisuje nic konkrétního. Širší vzorec napříč šesti takovými studiemi z let 2023 až 2026 je sám o sobě samostatným tématem, does ChatGPT make up references jej pokrývá v plném rozsahu. Co je pro bibliografii konkrétně důležité, zůstává užší, zda anotace prozradí fabrikaci dříve, než někdo zkontroluje DOI.

Jak zkontrolovat každý záznam v anotované bibliografii vytvořené AI

Začněte s řádkem odkazu, vyhledejte přesný název v Google Scholar nebo na vlastním webu časopisu a považujte DOI za neověřené, dokud skutečně nevede k tomuto názvu, protože zfalšovaná citace může nést DOI, které vede na skutečný, nesouvisející článek někoho jiného. AI citation checker, který ověřuje každý záznam proti skutečné vědecké databázi tuto kontrolu automatizuje, místo aby ji ponechal na ručním vyhledávání pro každý jednotlivý zdroj.

Poté porovnejte anotaci se samotným zdrojem, ne s tím, jak přesvědčivě zní. Otevřete skutečný abstrakt a ověřte, že vzorek, metoda a zjištění, která anotace uvádí, jsou v něm skutečně obsaženy. Free annotated bibliography generator, který zakládá každé shrnutí na vlastním abstraktu článku, místo aby je sestavoval z paměti, ukazuje, jak vypadá skutečně na zdroji založená anotace vedle té, která taková nebyla.

U záznamů, které auditem projdou, jsou citing ChatGPT in APA a citing ChatGPT in MLA popsány krok za krokem.

Nic z toho nemění způsob, jakým formátujete záznam poté, co jste potvrdili, že je skutečný. Jak citovat ChatGPT samotný je samostatná otázka, která je plně pokryta pro APA, MLA, Chicago a IEEE, a generátor citací formátuje běžný odkaz stejným způsobem bez ohledu na styl. Ani jeden z nich nezachytí anotaci popisující článek, který nikdo nenapsal, dostatečně plynulou na to, aby nikoho nenapadlo ji zkontrolovat.

XLinkedInFacebook

Často kladené otázky

Protože citace musí jen vypadat správně, stačí pravděpodobný autor, časopis a DOI, aby prošla letmým pohledem. Anotace musí být správná, protože uvádí konkrétní tvrzení o metodě a zjištěních práce, které buď odpovídá skutečnému zdroji, nebo ne. Model, který práci nikdy nečetl, může mnohem snadněji napodobit podobu odkazu než obsah shrnutí.

Sara

Content planner and copywriter at TextPulse. Sara runs the blog day to day, from planning and drafting through to publishing. She writes the practical guides: clear explanations of academic writing problems, aimed at the person who actually has to hand something in.