Il segno dell'em dash: perché ChatGPT lo usa troppo
Che cosa causa davvero l'abitudine di ChatGPT a fare affidamento sull'em dash, quale funzione svolge il segno in una frase, e a che cosa ricorre invece un editor umano: una virgola, i due punti o un punto.
A volte, un responsabile delle assunzioni invierà una lettera di presentazione a un collega con una riga aggiunta: controlla i trattini. Questo tipo lungo compare tre volte in due frasi, una volta come virgola, una volta come due punti e una volta come punto, tutto nello stesso paragrafo. La piccola abitudine che ha chatgpt è quella in cui si vede il trattino prima di leggere il punto. È importante comprendere correttamente questa abitudine prima di trarre qualsiasi conclusione su ciò che significa davvero. Quel riflesso, notare il segno prima di leggere l'argomentazione, è in miniatura l'abitudine del trattino lungo di chatgpt, ed è utile comprenderla bene prima di decidere che cosa dimostri davvero.
Il trattino lungo è il trattino lungo, più lungo di un trattino breve e più lungo del trattino usato in un intervallo di numeri, che uno scrittore inserisce a metà frase per svolgere il lavoro di una virgola, di due punti o di un punto. ChatGPT lo usa più spesso di quanto faccia la maggior parte della prosa revisionata, anche se di preciso quanto più spesso dipende da quale versione del modello ha prodotto il paragrafo che hai davanti. Questo testo si concentra in modo ristretto su quel solo segno: che cosa causa l'abitudine, quale funzione sta effettivamente svolgendo quando compare e che cosa un editor umano sostituisce al suo posto.
Che cosa causa l'abitudine del trattino lungo di ChatGPT?
Nessuno in OpenAI ha pubblicato una spiegazione tecnica, ma gran parte di ciò che sappiamo è merito di un'indagine indipendente, senza bisogno di un post aziendale. Un buon esempio è un'analisi approfondita scritta dall'ingegnere del software Sean Goedecke nell'ottobre 2025. Invece di fare ipotesi, ha testato personalmente le teorie più semplici. Ha provato un modello che risparmiava token usando un segno invece di una virgola. Ma una virgola è esattamente altrettanto breve. Ha anche provato una preferenza dialettale acquisita dai lavoratori del feedback umano, e ha esaminato un ampio campione di testo in inglese nigeriano, un dialetto comunemente associato a quella forza lavoro. In effetti, lì compariva meno spesso che nell'inglese moderno ordinario, non di più.
La teoria che i test di Goedecke hanno lasciato in piedi indica un cambiamento nei dati di addestramento tra le versioni del modello. Ha rilevato che l'abitudine era appena presente nell'output di GPT-3.5, poi circa dieci volte più frequente una volta che GPT-4o è stato rilasciato, il che indica ciò che è cambiato nel set di addestramento piuttosto che l'architettura del modello stessa. La sua ipotesi migliore è che si tratti di libri digitalizzati della fine del 1800 e dell'inizio del 1900, un periodo in cui il segno era insolitamente frequente nell'inglese stampato, ben al di sopra del livello che ha nella scrittura contemporanea. Nessuno al di fuori dei laboratori che hanno addestrato questi modelli può confermarlo. È la teoria più accuratamente testata disponibile, non un fatto accertato.
Una linea di ricerca separata pubblicata nel marzo 2026 indica una causa correlata che vale la pena nominare: quanto del testo di addestramento di un modello fosse formattato in markdown anziché in prosa semplice, sulla teoria che una forte esposizione a quello stile di formattazione lasci una propria impronta sulle scelte di punteggiatura in generale. Il riassunto onesto è che diverse spiegazioni sono plausibili, una è ragionevolmente ben testata e nessuna è confermata dalla sola parte che potrebbe effettivamente confermarla.
Quale funzione svolge il segno nella frase?
Prima di scegliere un sostituto, è utile nominare la funzione che il segno svolge, perché una virgola, i due punti e il punto non sono intercambiabili, e non lo sono nemmeno i loro sostituti con trattino lungo. Quattro funzioni coprono quasi ogni caso in cui un lettore possa imbattersi.
| Ciò che fa il segno | Ciò che usa invece uno scrittore umano | Esempio |
|---|---|---|
| Isolare un commento secondario all'interno di una frase | Una coppia di virgole, oppure parentesi | Il risultato, replicato due volte, è rimasto valido in entrambe le condizioni. |
| Segnalare una svolta improvvisa o un'interruzione brusca | Un punto fermo e una nuova frase | Il risultato è rimasto valido in entrambe le condizioni. Non ha resistito a una terza. |
| Unire due affermazioni indipendenti strettamente correlate | Un punto fermo, oppure un punto e virgola quando il nesso conta | Il campione era piccolo. L'effetto non lo era. |
| Introdurre un elenco, un riassunto o una spiegazione | Due punti | Il risultato indicava una direzione: la replicazione è fallita. |
Ognuna di quelle frasi era una frase che avrebbe potuto usare il segno e non lo ha fatto. Questo testo è esso stesso un argomento secondo cui il segno è un indizio di macchina, e costruisce tale argomento non usando mai il carattere che descrive, neppure una volta, in nessuna frase sopra o sotto.
Umanizza il tuo articolo
Trasforma il tuo testo assistito dall'AI e fallo suonare umano, senza toccare parole importanti o citazioni.
Il comportamento del trattino lungo di ogni chatbot è lo stesso?
No, e il divario tra i sistemi è ampio. Un test con lo stesso prompt su sei chatbot a metà del 2025, citato nella guida più ampia di TextPulse ai modelli di scrittura dell'IA, ha rilevato che tre sistemi producevano il segno all'incirca una volta ogni settanta parole e uno lo produceva all'incirca una volta ogni quattrocentosettanta, mentre altri due non lo producevano affatto nel campione. La frequenza è una proprietà del sistema e della versione che hanno generato il paragrafo davanti a voi, non un tratto fisso della scrittura dell'IA in generale.
OpenAI ha rilasciato una correzione parziale nel novembre 2025: un'impostazione di istruzioni personalizzate che, una volta attivata dall'utente, dice al modello di smettere. Sam Altman lo ha annunciato personalmente, presentandolo come un ascolto finalmente dato a una lamentela di lunga data. L'impostazione è facoltativa, non predefinita, quindi una quantità enorme di output quotidiani di ChatGPT non ne è mai stata toccata, e l'abitudine continua ovunque nessuno si sia preso la briga di attivare l'interruttore.
La reputazione del segno come indicatore di AI è essa stessa piuttosto recente e in parte sopravvalutata. La reazione negativa è iniziata intorno a febbraio 2025, secondo i commenti che la hanno seguita. Un articolo molto diffuso sulla tendenza osservava che non vi è mai stata una prova solida del fatto che i chatbot usino il segno più di quanto facessero già gli scrittori umani attenti. Le due cose possono coesistere: l'abitudine è reale e misurabile nell'output grezzo, e la fiducia del web nel riconoscerla da una sola frase è molto più avanti delle prove effettive.
Come Verificare la Propria Bozza per l'Abitudine
Legga ad alta voce un paragrafo e segni ogni punto in cui compare un trattino lungo. Una sola occorrenza in una pagina è una scelta stilistica, del tipo che gli scrittori umani fanno da secoli. Diverse nello stesso paragrafo, soprattutto quando svolgono funzioni diverse rispetto alla tabella sopra, meritano un secondo sguardo. Una tale densità è insolita al di fuori dell'output di AI e di una manciata di stilisti della prosa che usano deliberatamente molti trattini.
Il rimuovi trattini lunghi gratuito di TextPulse controlla automaticamente tale densità e propone, per ogni occorrenza, la virgola, i due punti, il punto o una ristrutturazione, il che è più rapido del conteggio manuale in un documento lungo. La stessa raccolta di strumenti gratuiti copre gli altri livelli che un paragrafo redatto da una macchina tende a segnalare insieme, scelta delle parole, ritmo delle frasi e struttura, per un controllo che va oltre la sola punteggiatura.
Le frasi riempitive svolgono lo stesso lavoro a livello di frase, e c'è un elenco di quelle da eliminare per prime. Rimuovere questo lessico da una bozza che ha già scritto richiede ancora un approccio diverso.
Nulla di tutto ciò richiedeva software speciale per essere verificato, solo attenzione e la disponibilità a rileggere la frase. Questo testo ha fatto la stessa scelta per tutta la propria stesura: ricorrere a una virgola, a due punti o a un punto, e mai una sola volta al segno che ha passato millecinquecento parole a descrivere.
Domande frequenti
L'abitudine di ChatGPT all'em dash deriva soprattutto da ciò che è cambiato nei dati di addestramento tra le versioni del modello, non da una scelta progettuale deliberata. Test indipendenti hanno rilevato che il segno è molto più comune nell'output di GPT-4o che in quello di GPT-3.5, e l'ipotesi principale punta a una forte esposizione a libri stampati più vecchi, di un periodo in cui il segno era insolitamente frequente. OpenAI non ha pubblicato una propria spiegazione, quindi questa resta l'ipotesi meglio supportata, non un fatto confermato.
Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.