AI Humanization

Az em dash árulkodó jele: miért használja túl gyakran a ChatGPT

Mi okozza valójában a ChatGPT em dash használatára való hajlamát, milyen szerepet tölt be ez a jel a mondatban, és mihez nyúl helyette az emberi szerkesztő: vesszőhöz, kettősponthoz vagy ponthoz.

5 min
Table showing what a human writer uses instead of the chatgpt em dash habit, by sentence function

Néha egy felvételi vezető elküld egy kísérőlevelet egy kollégának egy hozzáadott sorral: ellenőrizd a kötőjeleket. Ez a hosszú fajta háromszor jelenik meg két mondatban, egyszer vesszőként, egyszer kettőspontként, és egyszer pontként, mindez ugyanabban a bekezdésben. Az a kis szokás, amellyel a chatgpt rendelkezik, az az, amikor már azelőtt meglátod a kötőjelet, hogy elolvasnád a mondanivalót. Fontos ezt a szokást helyesen megérteni, mielőtt bármilyen következtetést levonnánk arról, hogy valójában mit jelent. Ez a reflex, vagyis a jel észrevétele az érvelés elolvasása előtt, a chatgpt em dash szokásának kicsinyített változata, és érdemes helyesen megérteni, mielőtt eldöntenénk, hogy valójában mit bizonyít.

Az em dash a hosszú kötőjel, hosszabb, mint a kötőjel, és hosszabb, mint a számtartományban használt kötőjel, amelyet az író a mondat közepén helyez el, hogy egy vessző, egy kettőspont vagy egy pont szerepét töltse be. ChatGPT ezt gyakrabban használja, mint a legtöbb szerkesztett próza, bár az, hogy pontosan mennyivel gyakrabban, attól függ, melyik modellváltozat állította elő az Ön előtt lévő bekezdést. Ez az írás szűken erre az egy jelre összpontosít, mi okozza ezt a szokást, milyen feladatot lát el valójában, amikor megjelenik, és mit helyettesít be helyette egy emberi szerkesztő.

Mi okozza a ChatGPT em dash szokását?

Az OpenAI-nál senki sem tett közzé technikai magyarázatot, de abból, amit tudunk, sokat független vizsgálatnak köszönhetünk, nincs szükség vállalati blogbejegyzésre. Egy jó példa erre Sean Goedecke szoftvermérnök 2025 októberében írt részletes elemzése. Ahelyett, hogy találgatott volna, maga tesztelte az egyszerű elméleteket. Kipróbált egy modellt, amely úgy takarított meg tokeneket, hogy egyetlen jelet használt egy vessző helyett. De egy vessző pontosan ugyanolyan rövid. Kipróbált továbbá egy, a humán visszajelzést adó munkatársaktól átvett dialektuspreferenciát is, és megvizsgált egy nagy mintát nigériai angol szövegből, amelyet gyakran ezzel a munkakörrel társítanak. Valójában ott ritkábban fordult elő, mint a hétköznapi modern angolban, nem gyakrabban.

Goedecke saját tesztelése által életben hagyott elmélet arra mutat, hogy a modellverziók között változás történt a tanítási adatokban. Azt találta, hogy ez a szokás alig volt jelen a GPT-3.5 kimenetében, majd körülbelül tízszer gyakoribbá vált, miután a GPT-4o megjelent, ami inkább arra utal, hogy mi változott a tanítási készletben, mintsem magára a modellarchitektúrára. A legjobb becslése a 1800-as évek végéről és az 1900-as évek elejéről származó digitalizált könyvek, egy olyan időszak, amikor ez a jel a nyomtatott angolban szokatlanul magas volt, jóval azon a szinten, ahol a kortárs írásban található. A modelleket tanító laborokon kívül senki sem tudja ezt megerősíteni. Ez a rendelkezésre álló legszigorúbban tesztelt elmélet, nem pedig egy lezárt tény.

2026 márciusában megjelent egy külön kutatási irány, amely egy kapcsolódó, megnevezésre érdemes okra mutat: arra, hogy a modell tanító szövegének mekkora része volt formázott markdown, nem pedig egyszerű próza, azon az elméleten alapulva, hogy az ilyen formázási stílussal való erős érintkezés maga is nyomot hagy az írásjelek megválasztásán általában. Az őszinte összegzés az, hogy több magyarázat is valószínű, egyet viszonylag jól teszteltek, és egyiket sem erősítette meg az az egyetlen fél, amely ténylegesen meg tudná erősíteni.

Mi a jel szerepe a mondatban?

Mielőtt helyettesítőt választanánk, hasznos megnevezni, milyen feladatot lát el a jel, mert a vessző, a kettőspont és a pont nem felcserélhetők, és ugyanez igaz a hosszú gondolatjelre is. Négy feladat szinte minden olyan esetre lefedi a tartományt, amellyel az olvasó valószínűleg találkozik.

Mit csinál a jelMit használ helyette egy emberi szerzőPélda
Egy mellékes megjegyzés elkülönítése egy mondaton belülEgy vesszőpár, vagy zárójelekA megállapítás, amelyet kétszer is megismételtek, mindkét feltétel mellett fennállt.
Egy hirtelen fordulat vagy éles megszakítás jelöléseEgy pont és egy új mondatA megállapítás mindkét feltétel mellett fennállt. Egy harmadikat azonban nem élt túl.
Két szorosan összefüggő önálló állítás összekapcsolásaEgy pont, vagy egy pontosvessző, ha a kapcsolat lényegesA minta kicsi volt. A hatásméret nem.
Egy felsorolás, összegzés vagy magyarázat bevezetéseKettőspontAz eredmény egy irányba mutatott: a replikáció kudarcot vallott.

E mondatok mindegyike olyan volt, amelyben használhatták volna a jelet, mégsem tették. Ez az írás maga is amellett érvel, hogy a jel gépi árulkodó jel, és ezt az érvet úgy fejti ki, hogy soha, egyetlen egyszer sem használja azt a karaktert, amelyet leír, sem a fenti, sem az alábbi mondatokban.

Emberibbé tenni saját dolgozatát

Alakítsa át az AI által támogatott szövegét úgy, hogy emberinek hangozzon, anélkül hogy fontos szavakat vagy hivatkozásokat érintene.

Kezdje el ingyen

Ugyanaz-e minden ChatGPT em dash szokása?

Nem, és a rendszerek közötti különbség nagy. Egy azonos prompttal végzett teszt hat chatboton 2025 közepén, amelyre TextPulse szélesebb körű útmutatója az AI írási mintázatairól hivatkozik, azt találta, hogy három rendszer nagyjából hetven szavanként egyszer, egy pedig nagyjából négyszázhetven szavanként egyszer hozta létre a jelet, míg két másik a mintában egyáltalán nem hozta létre. A gyakoriság annak a rendszernek és verziónak a tulajdonsága, amely az Ön előtt álló bekezdést létrehozta, nem pedig általában az AI írásának rögzített jellemzője.

OpenAI 2025 novemberében részleges javítást adott ki, egy egyéni utasítások beállítást, amely, ha a felhasználó bekapcsolja, arra utasítja a modellt, hogy hagyja abba. Sam Altman maga jelentette be ezt, úgy keretezve, mint egy régóta fennálló panasz végre meghallgatását. A beállítás opcionális, nem alapértelmezett, ezért a mindennapi ChatGPT kimenetek hatalmas részét soha nem érintette, és a szokás ott is fennmarad, ahol senki sem vette a fáradságot, hogy átkapcsolja a kapcsolót.

A jel hírneve mint AI-árulkodó jel maga is meglehetősen új, és valamelyest túlzó. A visszahatás 2025 februárja körül kezdődött, legalábbis az ezt nyomon követő kommentárok szerint. Egy népszerű írás a tendenciáról megjegyezte, hogy soha nem volt szilárd bizonyíték arra, hogy a chatbotok gyakrabban használnák a jelet, mint ahogyan azt a körültekintő emberi szerzők már eleve tették. A két állítás együtt is megfér: a szokás valódi és mérhető a nyers kimenetben, ugyanakkor az internet magabiztossága abban, hogy ezt egyetlen mondatból felismeri, jóval megelőzi a tényleges bizonyítékokat.

Hogyan ellenőrizze saját vázlatát erre a szokásra

Olvasson fel hangosan egy bekezdést, és jelölje meg minden helyet, ahol hosszú gondolatjel jelenik meg. Egyetlen előfordulás egy oldalon stilisztikai döntés, olyasmi, amit az emberi szerzők évszázadok óta tesznek. Több előfordulás egyetlen bekezdésben, különösen ha az alábbi táblázatban szereplőktől eltérő feladatokat lát el, már megér egy második pillantást. Az ilyen sűrűség szokatlan az AI-kimeneten kívül, és azon a néhány tudatosan gondolatjel-túlhasználó prózastíluson kívül is.

A TextPulse ingyenes em dash eltávolítója automatikusan ellenőrzi ezt a sűrűséget, és minden egyes esethez a vesszőt, a kettőspontot, a pontot vagy az átszerkesztést javasolja, ami gyorsabb, mint egy hosszú dokumentumban kézzel számolni. Ugyanez az ingyenes eszközkészlet lefedi azokat a további szinteket is, amelyeket egy gép által megfogalmazott bekezdés egyszerre jelezni szokott, a szóválasztást, a mondatritmust és a szerkezetet, így az ellenőrzés túlmutat az írásjeleken önmagukban.

A töltelékkifejezések ugyanezt a munkát végzik mondatszinten, és van egy lista azokról, amelyeket először érdemes kihúzni. E szókincs eltávolítása egy már megírt vázlatból ismét más megközelítést igényel.

Ehhez semmilyen különleges szoftverre nem volt szükség az ellenőrzéshez, csupán figyelemre és arra, hogy hajlandó legyen újra elolvasni a mondatot. Ez a szöveg a saját megírása során végig ugyanezt a döntést hozta: vesszőt, kettőspontot vagy pontot használjon, és egyszer se azt a jelet, amelyről tizenötezer szóban beszélt.

XLinkedInFacebook

Gyakran ismételt kérdések

A ChatGPT em dash szokása főként abból ered, hogy a modellverziók között megváltozott a tanítóadat, nem pedig tudatos tervezési döntésből. Független tesztelés azt találta, hogy ez a jel sokkal gyakoribb a GPT-4o kimenetében, mint a GPT-3.5 esetében, és a vezető elmélet arra utal, hogy erős kitettség érte a régebbi nyomtatott könyveknek abból az időszakból, amikor ez a jel szokatlanul gyakori volt. OpenAI nem tett közzé saját magyarázatot, ezért ez továbbra is a legjobban alátámasztott elmélet, nem pedig megerősített tény.

Mark

Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.