Το σημάδι της παύλας em: γιατί το ChatGPT το χρησιμοποιεί υπερβολικά
Τι ακριβώς προκαλεί τη συνήθεια του ChatGPT να στηρίζεται στην παύλα em, ποιο έργο επιτελεί το σημείο μέσα σε μια πρόταση, και τι επιλέγει ένας ανθρώπινος επιμελητής αντί γι' αυτό: ένα κόμμα, μια άνω και κάτω τελεία ή μια τελεία.
Μερικές φορές, ένας υπεύθυνος προσλήψεων θα στείλει μια συνοδευτική επιστολή σε έναν συνάδελφο με μια πρόσθετη γραμμή: ελέγξτε τις παύλες. Αυτός ο μακρύς τύπος εμφανίζεται τρεις φορές σε δύο προτάσεις, μία ως κόμμα, μία ως άνω και κάτω τελεία και μία ως τελεία, όλα στην ίδια παράγραφο. Η μικρή συνήθεια που έχει το chatgpt είναι εκείνη όπου βλέπετε την παύλα πριν διαβάσετε το νόημα. Είναι σημαντικό να κατανοήσετε σωστά αυτή τη συνήθεια πριν καταλήξετε σε οποιοδήποτε συμπέρασμα για το τι σημαίνει στην πραγματικότητα. Αυτό το αντανακλαστικό, η αναγνώριση του σημείου πριν από την ανάγνωση του επιχειρήματος, είναι η συνήθεια της em dash του chatgpt σε μικρογραφία, και αξίζει να την κατανοήσετε σωστά πριν αποφασίσετε τι αποδεικνύει στην πραγματικότητα.
Η em dash είναι η μακριά παύλα, μακρύτερη από μια ενωτική παύλα και μακρύτερη από την παύλα που χρησιμοποιείται σε ένα αριθμητικό εύρος, την οποία ένας συγγραφέας τοποθετεί μέσα στη πρόταση για να επιτελέσει τον ρόλο ενός κόμματος, μιας άνω και κάτω τελείας ή μιας τελείας. Το ChatGPT τη χρησιμοποιεί συχνότερα από ό,τι κάνει η περισσότερη επιμελημένη πεζογραφία, αν και το ακριβές πόσο συχνότερα εξαρτάται από το ποια έκδοση του μοντέλου παρήγαγε την παράγραφο που έχετε μπροστά σας. Το παρόν κείμενο παραμένει αυστηρά σε αυτό το ένα σημείο, τι προκαλεί τη συνήθεια, ποιο έργο επιτελεί στην πραγματικότητα όταν εμφανίζεται και τι βάζει στη θέση της ένας ανθρώπινος επιμελητής.
Τι προκαλεί τη συνήθεια της em dash του ChatGPT;
Κανείς στο OpenAI δεν έχει δημοσιεύσει τεχνική εξήγηση, αλλά μεγάλο μέρος όσων γνωρίζουμε οφείλεται σε ανεξάρτητη διερεύνηση, χωρίς να χρειάζεται ανάρτηση σε εταιρικό blog. Ένα καλό παράδειγμα είναι μια εις βάθος ανάλυση που έγραψε ο μηχανικός λογισμικού Sean Goedecke τον Οκτώβριο του 2025. Αντί να μαντέψει, δοκίμασε ο ίδιος τις εύκολες θεωρίες. Δοκίμασε ένα μοντέλο που εξοικονομούσε tokens χρησιμοποιώντας ένα σημείο αντί για κόμμα. Όμως ένα κόμμα είναι ακριβώς το ίδιο σύντομο. Δοκίμασε επίσης μια προτίμηση διαλέκτου που είχε αποκτηθεί από εργαζομένους ανατροφοδότησης ανθρώπων, και εξέτασε ένα μεγάλο δείγμα κειμένου σε Nigerian English, μια διάλεκτο που συνδέεται συνήθως με εκείνο το εργατικό δυναμικό. Στην πραγματικότητα, εκεί εμφανιζόταν λιγότερο συχνά από ό,τι στα συνηθισμένα σύγχρονα English, όχι περισσότερο.
Η θεωρία που οι δικές του δοκιμές του Goedecke άφησαν να σταθεί δείχνει σε μια αλλαγή στα δεδομένα εκπαίδευσης μεταξύ εκδόσεων του μοντέλου. Διαπίστωσε ότι η συνήθεια ήταν μόλις και μετά βίας παρούσα στην έξοδο του GPT-3.5, και έπειτα περίπου δέκα φορές συχνότερη μόλις κυκλοφόρησε το GPT-4o, κάτι που δείχνει προς αυτό που άλλαξε στο σύνολο εκπαίδευσης και όχι προς την ίδια την αρχιτεκτονική του μοντέλου. Η καλύτερη εκτίμησή του είναι ψηφιοποιημένα βιβλία από τα τέλη του 1800 και τις αρχές του 1900, μια περίοδο κατά την οποία το σημείο εμφανιζόταν ασυνήθιστα συχνά στα τυπωμένα αγγλικά, πολύ πάνω από το επίπεδο στο οποίο βρίσκεται στη σύγχρονη γραφή. Κανείς εκτός των εργαστηρίων που εκπαίδευσαν αυτά τα μοντέλα δεν μπορεί να το επιβεβαιώσει. Είναι η πιο προσεκτικά ελεγμένη θεωρία που υπάρχει, όχι ένα οριστικά διαπιστωμένο γεγονός.
Μια ξεχωριστή γραμμή έρευνας που δημοσιεύθηκε τον Μάρτιο του 2026 δείχνει σε μια σχετική αιτία που αξίζει να ονομαστεί, δηλαδή στο πόσο από το κείμενο εκπαίδευσης ενός μοντέλου είχε μορφοποιηθεί σε markdown αντί για απλή πρόζα, με τη θεωρία ότι η έντονη έκθεση σε αυτό το στυλ μορφοποίησης αφήνει το δικό της αποτύπωμα στις επιλογές στίξης γενικά. Η ειλικρινής σύνοψη είναι ότι αρκετές εξηγήσεις είναι εύλογες, μία έχει ελεγχθεί αρκετά καλά, και καμία δεν έχει επιβεβαιωθεί από το ένα μέρος που θα μπορούσε πράγματι να την επιβεβαιώσει.
Τι Ρόλο Επιτελεί το Σημείο στην Πρόταση;
Πριν επιλέξει κανείς ένα υποκατάστατο, βοηθά να ονομάσει κανείς τον ρόλο που επιτελεί το σημείο, επειδή ένα κόμμα, μια άνω και κάτω τελεία και μια τελεία δεν είναι εναλλάξιμα, ούτε και τα υποκατάστατά τους με μακρά παύλα. Τέσσερις ρόλοι καλύπτουν σχεδόν κάθε περίπτωση που είναι πιθανό να συναντήσει ένας αναγνώστης.
| Τι κάνει η παύλα | Τι χρησιμοποιεί αντ' αυτού ένας ανθρώπινος συγγραφέας | Παράδειγμα |
|---|---|---|
| Ξεχωρίζοντας ένα παρενθετικό σχόλιο μέσα σε μια πρόταση | Ένα ζεύγος κόμματα, ή παρενθέσεις | Το εύρημα, που αναπαράχθηκε δύο φορές, παρέμεινε και στις δύο συνθήκες. |
| Σημειώνοντας μια απότομη στροφή ή μια αιφνίδια διακοπή | Μια τελεία και μια νέα πρόταση | Το εύρημα παρέμεινε και στις δύο συνθήκες. Δεν επέζησε μιας τρίτης. |
| Συνδέοντας δύο στενά συναφείς ανεξάρτητες δηλώσεις | Μια τελεία, ή ένα ελληνικό ερωτηματικό όπου η σύνδεση έχει σημασία | Το δείγμα ήταν μικρό. Το μέγεθος του αποτελέσματος δεν ήταν. |
| Εισάγοντας μια λίστα, μια σύνοψη ή μια εξήγηση | Δύο τελείες | Το αποτέλεσμα έδειχνε προς μία κατεύθυνση: η αναπαραγωγή απέτυχε. |
Καθεμία από εκείνες τις προτάσεις ήταν μία που θα μπορούσε να είχε χρησιμοποιήσει το σύμβολο και δεν το έκανε. Αυτό το κείμενο είναι από μόνο του ένα επιχείρημα ότι το σύμβολο αποτελεί ένδειξη μηχανής, και διατυπώνει αυτό το επιχείρημα χωρίς ποτέ να χρησιμοποιεί τον χαρακτήρα που περιγράφει, ούτε μία φορά, σε καμία πρόταση παραπάνω ή παρακάτω.
Ανθρωποποιήστε τη δική σας εργασία
Μετασχηματίστε το κείμενό σας με τη βοήθεια AI και κάντε το να ακούγεται ανθρώπινο, χωρίς να αγγίξετε σημαντικές λέξεις ή παραπομπές.
Είναι η συνήθεια της παύλας σε κάθε Chatbot η ίδια;
Όχι, και η απόσταση μεταξύ των συστημάτων είναι μεγάλη. Μια δοκιμή με το ίδιο prompt σε έξι chatbots στα μέσα του 2025, που παρατίθεται στον ευρύτερο οδηγό του TextPulse για τα πρότυπα γραφής AI στο ευρύτερο οδηγό για τα πρότυπα γραφής AI, διαπίστωσε ότι τρία συστήματα παρήγαν το σύμβολο περίπου μία φορά κάθε εβδομήντα λέξεις και ένα το παρήγαγε περίπου μία φορά κάθε τετρακόσιες εβδομήντα, ενώ δύο άλλα δεν το παρήγαγαν καθόλου στο δείγμα. Η συχνότητα είναι ιδιότητα του εκάστοτε συστήματος και της έκδοσης που παρήγαγε την παράγραφο μπροστά σας, όχι σταθερό γνώρισμα της γραφής AI γενικά.
Η OpenAI κυκλοφόρησε μια μερική διόρθωση τον Νοέμβριο του 2025, μια ρύθμιση προσαρμοσμένων οδηγιών που, μόλις την ενεργοποιήσει ο χρήστης, λέει στο μοντέλο να σταματήσει. Ο Sam Altman το ανακοίνωσε ο ίδιος, παρουσιάζοντάς το ως επιτέλους ανταπόκριση σε ένα μακροχρόνιο παράπονο. Η ρύθμιση είναι προαιρετική, όχι προεπιλεγμένη, οπότε ένα τεράστιο μέρος της καθημερινής παραγωγής του ChatGPT δεν επηρεάστηκε ποτέ από αυτήν, και η συνήθεια συνεχίζεται όπου κανείς δεν μπήκε στον κόπο να γυρίσει τον διακόπτη.
Η φήμη του σημείου ως ένδειξης AI είναι η ίδια σχετικά πρόσφατη και κάπως υπερβολική. Η αντίδραση άρχισε γύρω στον Φεβρουάριο του 2025, σύμφωνα με σχόλια που την παρακολουθούν. Ένα δημοφιλές κείμενο για την τάση σημείωσε ότι δεν υπήρχαν ποτέ ισχυρά στοιχεία πως τα chatbots χρησιμοποιούν το σημείο περισσότερο από όσο ήδη έκαναν οι προσεκτικοί ανθρώπινοι συγγραφείς. Και τα δύο μπορούν να ισχύουν μαζί, η συνήθεια είναι πραγματική και μετρήσιμη στην ακατέργαστη παραγωγή, και η βεβαιότητα του διαδικτύου ότι μπορεί να την εντοπίσει από μία μόνο πρόταση προηγείται κατά πολύ των πραγματικών στοιχείων.
Πώς να Ελέγξετε το Δικό σας Προσχέδιο για τη Συνήθεια
Διαβάστε μια παράγραφο μεγαλόφωνα και σημειώστε κάθε σημείο όπου εμφανίζεται μια μακριά παύλα. Μία εμφάνιση σε μια σελίδα είναι υφολογική επιλογή, το είδος που οι ανθρώπινοι συγγραφείς κάνουν εδώ και αιώνες. Αρκετές σε μία παράγραφο, ιδίως όταν επιτελούν διαφορετικούς ρόλους από εκείνους του πίνακα παραπάνω, αξίζουν μια δεύτερη ματιά. Αυτή η πυκνότητα είναι ασυνήθιστη έξω από AI output και έξω από μια χούφτα σκόπιμα πεζογράφων με έντονη χρήση παυλών.
Το free em dash remover του TextPulse ελέγχει αυτή την πυκνότητα αυτόματα και προτείνει το κόμμα, την άνω και κάτω τελεία, την τελεία ή την αναδιάρθρωση που απαιτεί κάθε περίπτωση, κάτι που είναι ταχύτερο από το να μετρά κανείς με το χέρι σε ένα μακρύ έγγραφο. Η ίδια free tools collection καλύπτει τα άλλα επίπεδα που τείνει να σηματοδοτεί ταυτόχρονα μια παράγραφος γραμμένη από μηχανή, την επιλογή λέξεων, τον ρυθμό των προτάσεων και τη δομή, για έναν έλεγχο που υπερβαίνει την απλή στίξη.
Οι φράσεις πλήρωσης κάνουν την ίδια δουλειά σε επίπεδο πρότασης, και υπάρχει μια λίστα με εκείνες που αξίζει να αφαιρεθούν πρώτες. Η αφαίρεση αυτού του λεξιλογίου από ένα προσχέδιο που έχετε ήδη γράψει ακολουθεί πάλι μια διαφορετική προσέγγιση.
Τίποτε από αυτά δεν απαιτούσε ειδικό λογισμικό για να ελεγχθεί, μόνο προσοχή και προθυμία να διαβαστεί ξανά η πρόταση. Το παρόν κείμενο έκανε την ίδια επιλογή σε όλη τη δική του σύνταξη, να στραφεί σε ένα κόμμα, σε μια άνω και κάτω τελεία ή σε μια τελεία, και ούτε μία φορά στο σημείο που αφιέρωσε χίλιες πεντακόσιες λέξεις για να περιγράψει.
Συχνές ερωτήσεις
Η συνήθεια του ChatGPT με την παύλα em οφείλεται κυρίως σε ό,τι άλλαξε στα δεδομένα εκπαίδευσής του μεταξύ των εκδόσεων του μοντέλου, όχι σε μια σκόπιμη επιλογή σχεδιασμού. Ανεξάρτητες δοκιμές διαπίστωσαν ότι το σημείο εμφανίζεται πολύ συχνότερα στην έξοδο του GPT-4o από ό,τι στο GPT-3.5, και η επικρατέστερη θεωρία δείχνει προς τη μεγάλη έκθεση σε παλαιότερα έντυπα βιβλία από μια περίοδο κατά την οποία το σημείο εμφανιζόταν ασυνήθιστα συχνά. Η OpenAI δεν έχει δημοσιεύσει τη δική της εξήγηση, επομένως αυτό παραμένει η καλύτερα τεκμηριωμένη θεωρία και όχι επιβεβαιωμένο γεγονός.
Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.