La señal del guion largo: por qué ChatGPT lo usa en exceso
Qué causa realmente el hábito de ChatGPT de apoyarse en el guion largo, qué función cumple ese signo en una oración y a qué recurre en su lugar un editor humano: una coma, dos puntos o un punto.
A veces, un responsable de contratación enviará una carta de presentación a un colega con una línea añadida: comprueba los guiones. Este tipo largo aparece tres veces en dos frases, una vez como coma, una vez como dos puntos y una vez como punto final, todo en el mismo párrafo. El pequeño hábito que tiene ChatGPT es aquel en el que se ve el guion antes de leer el punto. Es importante entender este hábito correctamente antes de sacar cualquier conclusión sobre lo que realmente significa. Ese reflejo, detectar el signo antes de leer el argumento, es el hábito del guion largo de ChatGPT en miniatura, y merece la pena entenderlo correctamente antes de decidir lo que realmente demuestra.
El guion largo es el guion largo, más largo que un guion corto y más largo que el guion usado en un intervalo numérico, que un autor inserta en mitad de una frase para hacer el trabajo de una coma, dos puntos o un punto final. ChatGPT lo usa con más frecuencia de la que aparece en la prosa editada habitual, aunque exactamente cuánto más depende de qué versión del modelo produjo el párrafo que tienes delante. Este texto se centra de forma estricta en ese único signo: qué causa el hábito, qué función cumple realmente cuando aparece y qué pone en su lugar un editor humano.
¿Qué causa el hábito del guion largo de ChatGPT?
Nadie en OpenAI ha publicado una explicación técnica, pero gran parte de lo que sabemos se debe a una investigación independiente, sin necesidad de una entrada de blog de la empresa. Un buen ejemplo es un análisis en profundidad escrito por el ingeniero de software Sean Goedecke en octubre de 2025. En lugar de adivinar, puso a prueba él mismo las teorías sencillas. Probó un modelo que ahorraba tokens usando un signo en lugar de una coma. Pero una coma es exactamente igual de corta. También probó una preferencia dialectal adquirida a partir de trabajadores de retroalimentación humana, y examinó una gran muestra de texto en inglés nigeriano, un dialecto comúnmente asociado con ese personal. De hecho, allí apareció con menos frecuencia que en el inglés moderno ordinario, no con más frecuencia.
La teoría que las propias pruebas de Goedecke dejaron en pie apunta a un cambio en los datos de entrenamiento entre versiones del modelo. Encontró el hábito apenas presente en la salida de GPT-3.5, y luego aproximadamente 10 veces más frecuente una vez que se lanzó GPT-4o, lo que apunta a lo que cambió en el conjunto de entrenamiento más que a la arquitectura del modelo en sí. Su mejor conjetura son libros digitalizados de finales de los 1800 y principios de los 1900, un periodo en el que la marca aparecía inusualmente a menudo en el inglés impreso, muy por encima de donde se sitúa en la escritura contemporánea. Nadie fuera de los laboratorios que entrenaron estos modelos puede confirmarlo. Es la teoría más cuidadosamente probada disponible, no un hecho establecido.
Una línea de investigación separada publicada en marzo de 2026 apunta a una causa relacionada que conviene nombrar: cuánto del texto de entrenamiento de un modelo estaba formateado en markdown en lugar de prosa llana, con la idea de que una exposición intensa a ese estilo de formato deja su propia huella en las elecciones de puntuación en general. El resumen honesto es que varias explicaciones son plausibles, una está razonablemente bien probada, y ninguna está confirmada por la única parte que realmente podría confirmarla.
¿Qué función cumple la marca en la oración?
Antes de elegir un sustituto, conviene nombrar la función que cumple la marca, porque una coma, dos puntos y un punto no son intercambiables, y tampoco lo son sus sustitutos con guion largo. Cuatro funciones cubren casi todos los casos con los que es probable que se encuentre un lector.
| Qué hace el signo | Qué usa en su lugar un escritor humano | Ejemplo |
|---|---|---|
| Separar un comentario lateral dentro de una oración | Una pareja de comas, o paréntesis | El hallazgo, replicado dos veces, se mantuvo en ambas condiciones. |
| Marcar un giro abrupto o una interrupción brusca | Un punto y una nueva oración | El hallazgo se mantuvo en ambas condiciones. No sobrevivió a una tercera. |
| Unir dos afirmaciones independientes estrechamente relacionadas | Un punto, o un punto y coma cuando la relación importa | La muestra era pequeña. El tamaño del efecto no lo era. |
| Introducir una lista, un resumen o una explicación | Dos puntos | El resultado apuntaba en una dirección: la replicación fracasó. |
Cada una de esas oraciones era una que podría haber usado el signo y no lo hizo. Este texto es, en sí mismo, un argumento de que el signo es una señal de máquina, y formula ese argumento al no usar nunca el carácter que describe, ni una sola vez, en ninguna oración anterior o posterior.
Humanice su propio artículo
Transforme su texto asistido por IA y hágalo sonar humano, sin tocar palabras importantes ni citas.
¿Es igual el hábito del guion largo en todos los chatbots?
No, y la diferencia entre sistemas es grande. Una prueba con el mismo prompt en seis chatbots a mediados de 2025, citada en la guía más amplia de TextPulse sobre patrones de escritura de IA, encontró que tres sistemas producían el signo aproximadamente una vez cada setenta palabras y uno lo producía aproximadamente una vez cada cuatrocientas setenta, mientras que otros dos no lo produjeron en absoluto en la muestra. La frecuencia es una propiedad del sistema y la versión que generaron el párrafo que tiene delante, no un rasgo fijo de la escritura de IA en general.
OpenAI lanzó una solución parcial en noviembre de 2025: una opción de instrucciones personalizadas que, una vez que el usuario la activa, indica al modelo que deje de hacerlo. Sam Altman lo anunció él mismo, presentándolo como una respuesta por fin a una queja de larga data. La opción no está activada por defecto, sino que es optativa, de modo que una gran cantidad de la producción cotidiana de ChatGPT nunca fue afectada por ella, y el hábito continúa allí donde nadie se molestó en accionar el interruptor.
La reputación de la marca como indicio de IA es en sí misma bastante reciente y algo exagerada. La reacción adversa comenzó alrededor de febrero de 2025, según los comentarios que la han seguido. Un artículo popular sobre la tendencia señaló que nunca hubo pruebas sólidas de que los chatbots usaran la marca más de lo que ya lo hacían los escritores humanos cuidadosos. Ambas cosas pueden coexistir: el hábito es real y medible en la producción bruta, y la confianza de internet para detectarlo a partir de una sola frase va muy por delante de la evidencia real.
Cómo comprobar tu propio borrador para detectar el hábito
Lee un párrafo en voz alta y marca cada lugar en que aparezca un guion largo. Una sola aparición en una página es una elección estilística, del tipo que los escritores humanos han hecho durante siglos. Varias en un mismo párrafo, especialmente si cumplen funciones distintas de las de la tabla anterior, merecen una segunda mirada. Esa densidad es inusual fuera de la producción de IA y fuera de un pequeño grupo de estilistas de la prosa que usan guiones de forma deliberadamente abundante.
El eliminador gratuito de guiones largos de TextPulse comprueba esa densidad automáticamente y propone la coma, los dos puntos, el punto o la reestructuración que cada caso requiere, lo que es más rápido que contar a mano en un documento largo. La misma colección de herramientas gratuitas cubre los otros niveles que un párrafo redactado por una máquina suele señalar a la vez, la elección de palabras, el ritmo de las frases y la estructura, para una comprobación que va más allá de la puntuación por sí sola.
Las frases de relleno hacen el mismo trabajo a nivel de oración, y hay una lista de las que conviene eliminar primero. Eliminar este vocabulario de un borrador que ya has escrito adopta de nuevo un enfoque distinto.
Nada de esto requirió software especial para comprobarlo, solo atención y disposición para leer la frase otra vez. Este texto hizo la misma elección a lo largo de su propia redacción: recurrir a una coma, a dos puntos o a un punto, y ni una sola vez a la marca que pasó mil quinientas palabras describiendo.
Preguntas frecuentes
El hábito de ChatGPT con el guion largo se debe sobre todo a lo que cambió en sus datos de entrenamiento entre versiones del modelo, no a una decisión de diseño deliberada. Las pruebas independientes encontraron que el signo era mucho más frecuente en la salida de GPT-4o que en la de GPT-3.5, y la teoría principal apunta a una exposición intensa a libros impresos antiguos de un periodo en el que el signo aparecía con una frecuencia inusualmente alta. OpenAI no ha publicado su propia explicación, así que esta sigue siendo la teoría mejor respaldada y no un hecho confirmado.
Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.