¿Es la raya una señal de IA?

La observación que hay detrás del consejo es correcta. La conclusión que se saca de ella no lo es, y el remedio al que se recurre es un buscar y reemplazar global sobre un texto que no tenías ninguna otra razón para tocar.

Equipo de HumanPen

· 12 min de lectura

La respuesta corta

Nada de lo que encontramos en la documentación del propio proveedor respalda esa idea, y la siguiente sección muestra exactamente dónde buscamos. Buscamos en tres de las páginas de ayuda de Turnitin el 18 de agosto de 2026: la guía del AI Writing Report, las preguntas frecuentes sobre la detección de escritura con IA y la página de requisitos de archivo. En esas tres, la cadena «dash» aparece exactamente una vez, dentro de la palabra «dashboard». La palabra «punctuation» aparece exactamente una vez, en una respuesta que explica que el detector «is not tuned to target Grammarly-generated spelling, grammar, and punctuation modifications to content» (no está ajustado para detectar en el contenido las modificaciones de ortografía, gramática y puntuación generadas por Grammarly). Y la página que responde a la pregunta «what parameters or flags does Turnitin's model take into account when detecting AI writing?» (¿qué parámetros o indicadores tiene en cuenta el modelo de Turnitin al detectar escritura con IA?) responde enteramente en términos de secuencias de palabras. Así que el consejo que se repite con más seguridad a propósito de un signo de puntuación no se apoya en nada que podamos encontrar que la empresa que construyó el detector haya dicho al respecto.

Eso no equivale a demostrar que una raya no pueda influir. Un modelo que aprende patrones estadísticos no tiene ninguna obligación de publicar lo que aprendió, y ningún material público descarta que una raya aporte algo. Lo que falta es la otra mitad: nada de lo que encontramos respalda tampoco darle peso. Mientras tanto, el remedio al que se recurre —sustituir todas las rayas, en todas partes— es un cambio en casi todos los párrafos de un documento, hecho de una sola vez, sin que nadie lea el resultado.

Dos afirmaciones distintas con la misma frase

«Las rayas son una señal de IA» se dice como si fuera una sola cosa. Son dos, y nada las une:

  • El texto generado contiene muchas rayas. Una afirmación sobre lo que sale de los modelos de lenguaje. Cualquiera puede ir y comprobarlo.
  • Una raya sube la puntuación de escritura con IA. Una afirmación sobre lo que pondera un clasificador concreto. Nadie ajeno al proveedor puede comprobarlo.

La primera puede ser enteramente cierta mientras la segunda es falsa, porque que un rasgo sea frecuente en una población no dice nada sobre cómo lo usa un detector entrenado con ambas poblaciones. Quien escribe y usa mucho la raya es justo la población sobre la que la segunda afirmación fallaría, y nada de la primera afirmación te dice qué les pasa a esas personas.

No somos los primeros en decir la versión general de esto. En nuestra propia página sobre qué miden los detectores de IA defendemos que un pasaje no recibe una puntuación alta por una sola costumbre visible. Lo que sigue aquí es más estrecho: fuimos y comprobamos si esta costumbre en particular aparece en algún lugar de la documentación del propio proveedor, porque una afirmación tan extendida debería tener un documento detrás en alguna parte.

Qué fuimos a buscar y qué había

Tres páginas, recuperadas el 18 de agosto de 2026, leídas como texto de página ya renderizado y buscadas sin distinguir mayúsculas de minúsculas: «Using the AI Writing Report» (Cómo usar el AI Writing Report), «Turnitin's AI writing detection capabilities FAQs» (Preguntas frecuentes de Turnitin sobre las capacidades de detección de escritura con IA) y «File requirements for an AI Writing Report» (Requisitos de archivo para un AI Writing Report). Son las páginas que exponen el mecanismo y las reglas de archivo; las notas de versión y las páginas de problemas conocidos no formaron parte de esta búsqueda. Las cifras son apariciones, no líneas.

Término de búsqueda (en inglés)Guía del AI Writing ReportPreguntas frecuentes de detección IARequisitos de archivo
dash01, dentro de «dashboard»0
em dash000
hyphen000
punctuation010
character000
comma000
«300 words» (control)111

La última fila está ahí porque una búsqueda que no encuentra nada y una búsqueda que nunca llegó a la página se ven igual desde fuera. Que una expresión que sabemos que está en las tres páginas devuelva un resultado en cada una es lo que hace que los ceros de arriba signifiquen algo.

Con eso queda un único resultado real. Aquí está la respuesta completa en la que aparece, a la pregunta de si la revisión gramatical de Grammarly queda marcada:

«No. Our detector is not tuned to target Grammarly-generated spelling, grammar, and punctuation modifications to content but rather, other AI content written by LLMs such as GPT-3.5. Based on tests we conducted on human-written documents with no AI-generated content in them, in most cases, changes made by Grammarly (free & premium) and/or other grammar-checking tools were not flagged as AI-written by our detector. Please note that this excludes content generated by Grammarly's generative AI-powered features, including draft generation, paraphrasing, summarizing, and other features. Content produced using these features will likely be flagged as AI-generated by our detector.» (No. Nuestro detector no está ajustado para detectar en el contenido las modificaciones de ortografía, gramática y puntuación generadas por Grammarly, sino otro contenido de IA escrito por LLM como GPT-3.5. Según las pruebas que hicimos con documentos escritos por personas sin contenido generado por IA, en la mayoría de los casos los cambios hechos por Grammarly (gratuito y premium) y/o por otras herramientas de revisión gramatical no fueron marcados como escritos por IA por nuestro detector. Ten en cuenta que esto excluye el contenido generado por las funciones de IA generativa de Grammarly, incluidas la redacción de borradores, el parafraseo, los resúmenes y otras funciones. Es probable que el contenido producido con esas funciones sí sea marcado como generado por IA por nuestro detector.)

Léelo por lo que es. Trata de las correcciones de un corrector gramatical, no de tus rayas; dice «in most cases» (en la mayoría de los casos) en lugar de nunca, y las dos últimas frases tiran con fuerza en la dirección contraria para todo lo que Grammarly genera en vez de corregir. La frontera entre texto corregido y texto generado es un tema aparte, y la trazamos en ¿Detecta Turnitin Grammarly?. Lo único para lo que sirve aquí es esto: en el único lugar de esas tres páginas donde la puntuación y la detección aparecen en la misma frase, la frase apunta en contra del ajuste a nivel de puntuación y no a favor.

Luego está la pregunta que habría respondido la nuestra directamente si la respuesta fuera en esa dirección. Bajo el encabezado «What parameters or flags does Turnitin's model take into account when detecting AI writing?» (¿Qué parámetros o indicadores tiene en cuenta el modelo de Turnitin al detectar escritura con IA?), la parte sustantiva dice:

«Our classifiers are trained to detect these differences in word probability and are adept at the particular word probability sequences of human writers.» (Nuestros clasificadores están entrenados para detectar esas diferencias en la probabilidad de las palabras y conocen bien las secuencias concretas de probabilidad de palabras propias de quienes escriben.)

Probabilidad de las palabras. Secuencias de palabras. Ese es el nivel en el que el proveedor describe que trabajan sus propios clasificadores, en la respuesta que da cuando sus propias preguntas frecuentes preguntan sin rodeos qué tiene en cuenta el modelo.

Nada de lo publicado nombra una unidad más pequeña que la palabra

Si sigues el vocabulario hacia abajo por la descripción publicada de cómo se produce una puntuación, se detiene antes de llegar al carácter:

«When a paper is submitted to Turnitin, sentences from the submission are extracted and segmented into overlapping sections for prediction analysis. Each segment is classified by the AI detection model and given a value between 0 and 1 … Each qualifying sentence within these segments inherits the segment's score.» (Cuando se envía un trabajo a Turnitin, las frases del envío se extraen y se dividen en secciones superpuestas para el análisis de predicción. Cada sección es clasificada por el modelo de detección de IA y recibe un valor entre 0 y 1 … Cada frase calificable dentro de esas secciones hereda la puntuación de la sección.)

Secciones. Frases. Texto calificable, que las mismas preguntas frecuentes definen como bloques escritos como frases gramaticales estándar. Secuencias de probabilidad de palabras. Todas las unidades nombradas en esa cadena son una palabra o algo mayor, y lo más pequeño que recibe alguna vez un número propio es un tramo de varias frases, del que una frase toma luego ese número.

Una raya está dentro de ese tramo. Si la quitas, la sección sigue conteniendo las mismas palabras en el mismo orden: eso es justo lo que un cambio de puntuación no modifica, y el orden de las palabras es lo que el proveedor nombró. Que al tokenizador le importe es una pregunta aparte que nadie fuera de Turnitin puede responder, y no vamos a fingir lo contrario. Pero el consejo se da casi siempre como si el mecanismo se conociera, y el mecanismo publicado no tiene hueco para eso.

Lo que una raya cambia de forma demostrable

Hay una consecuencia medible de borrar una raya que puedes comprobar tú mismo en los próximos treinta segundos, y no tiene nada que ver con la detección. Microsoft Word trata la raya (—) y la semirraya (–) como límite de palabra, y el guion (-) no, así que «cost—benefit» cuenta como dos palabras y «well-known» como una. Sustituye cuarenta rayas sin espacios por guiones y tu recuento de palabras baja en cuarenta.

Para la mayoría de los documentos eso es una curiosidad. Para una entrega cerca de un límite estricto no lo es, y los requisitos de archivo del propio Turnitin ponen un techo a lo que se procesa; por eso dedicamos una sección a las rayas y los contadores de palabras en ¿Puede Turnitin revisar una tesis completa?. Fíjate en la forma de esto: el efecto que de verdad podemos demostrar pasa por un contador de palabras, no por un clasificador.

Lo que cuesta borrarlas

Una raya hace un trabajo en la frase. Lo que pongas en su lugar hace un trabajo distinto, y la elección no es cosmética:

  • Una coma debilita la pausa. Donde la raya sostenía una interrupción real, la coma la pierde o deja una coma mal puesta entre dos frases.
  • Un punto y coma eleva el registro y exige que lo que siga pueda valerse por sí solo como proposición. Muchas veces no puede.
  • Los paréntesis rebajan el contenido a un comentario aparte. Eso cambia lo que afirmas sobre su importancia, y en una sección de discusión eso es un argumento, no una decisión de formato.
  • Un punto divide una idea en dos. A veces es una mejora. A veces corta el vínculo que era el sentido de la frase.
  • Nada en absoluto funciona más a menudo de lo que la gente espera, y es la única opción de esta lista que no introduce una decisión nueva.

Ahora multiplícalo por las que tenga el documento. Buscar y reemplazar toma todas esas decisiones de la misma manera, en una sola acción, en un texto que no tenías ninguna otra razón para abrir. Es la edición más grande que la mayoría de la gente le hará a un manuscrito terminado, y es la que se hace con menos atención.

Y si tu documento se rige por un manual de estilo, la regla sobre rayas que te obliga es la de ese manual, no la de un hilo de foro. Averiguar cuáles de tus rayas son largas y cuáles cortas es al menos una pregunta que tiene respuesta.

La parte de la afirmación que sigue en pie

Si quitas la teoría sobre los clasificadores, queda algo en pie, pero apunta a una persona y no a una puntuación.

Mucha gente cree en la regla. Si tu director o directora es uno de ellos, tus rayas te cuestan algo real: una impresión, formada en la primera página, antes de que intervenga ningún detector. Ese riesgo no depende de ninguna explicación de cómo funciona el programa, y por eso mismo es la mitad más sólida de la afirmación. Creemos que es la mitad que merece tomarse en serio, y lo ofrecemos como nuestra lectura, no como algo publicado.

Pero fíjate en que buscar y reemplazar es una mala respuesta para eso. Quien se forma una impresión de tu texto reacciona a una página, no cuenta caracteres, y el mismo párrafo que le pareció hecho por una máquina se lo parecerá igual con comas. Lo que mueve a un lector es que el texto sea reconociblemente tuyo y que puedas hablar de él, que es el argumento a favor de guardar borradores; cómo se usa realmente esa prueba lo explicamos en el historial de versiones como prueba.

La impresión que un lector se forma de tu estilo y un resultado de detección de IA son informaciones de distinta naturaleza. Turnitin dice que los estudiantes no pueden ver directamente el indicador ni el informe de escritura con IA: un docente tiene que descargarlo y compartirlo. Consigue el informe, mira los resaltados reales y usa tus borradores y tus registros de escritura para explicar tu proceso, en vez de deducir el resultado a partir de los signos de puntuación.

Hacerlo a una escala que puedas leer

Decidas lo que decidas sobre las rayas, el principio útil es el que vulnera un reemplazo global: cambia el texto a una escala en la que todavía puedas leer qué cambió. Cada cambio no revisado es un sitio donde un documento puede estropearse en silencio.

Esa restricción, y no ninguna opinión sobre la puntuación, es lo que dio forma a la herramienta HumanPen. Dale el archivo más un informe de IA de Turnitin o iThenticate y los pasajes marcados se convierten en el alcance; todo lo demás conserva la redacción que escribiste. En nuestra propia página se enuncia la regla de granularidad sin rodeos: «a paragraph is the smallest unit a rewrite can touch, so a selection is expanded to full paragraphs before it is counted.» (un párrafo es la unidad más pequeña que una reescritura puede tocar, así que una selección se amplía a párrafos completos antes de contarse). Un párrafo está varios niveles por encima de lo que trata este artículo.

De ahí salen dos cosas que conviene enunciar como límites y no como funciones. La facturación cuenta las palabras efectivamente reescritas, así que un trabajo acotado cuesta lo que cuesta el alcance y no lo que pesa el archivo. Los pasajes que cumplen los requisitos pueden volver a procesarse sin coste.

Lo que no podemos hacer es darte un número. La posición del propio Turnitin sobre su modelo es que las predicciones individuales «may not always be explainable in simple feature-by-feature terms» (puede que no siempre sean explicables en términos sencillos, característica por característica), y no ha publicado nada que relacione una edición con un movimiento en la puntuación, así que una herramienta que te cita un porcentaje resultante está citando algo que no tiene. Y por debajo del umbral empeora, porque las puntuaciones entre 1 % y 19 % se muestran como un asterisco, sin porcentaje ni resaltados, lo que significa que una mejora real dentro de esa franja es invisible para todos, incluido tú. Si quieres las razones por las que dos herramientas dan cifras distintas sobre el mismo párrafo, eso está en por qué no coinciden los detectores; si tienes un informe en la mano ahora mismo, empieza por cómo leer un informe de escritura con IA de Turnitin.

Preguntas frecuentes

¿Bajará mi puntuación de IA si borro todas las rayas? Nadie puede decírtelo, y quien diga que sí o que no con seguridad está yendo más allá de lo publicado. Lo que sí podemos afirmar es que las tres páginas de ayuda de Turnitin que buscamos no mencionan las rayas en ningún momento, y que el único sitio donde aparece la puntuación es una respuesta que dice que el detector no está ajustado para detectar modificaciones de puntuación.

¿Usan los modelos de IA más rayas que las personas? Es muy posible, y es una afirmación que puedes comprobar tú mismo con texto generado. Es una afirmación distinta de «un detector las pondera», y no la implica.

¿Hay algún efecto medible al quitarlas? Uno, que puedes comprobar tú mismo, y no tiene que ver con la detección. Word cuenta la raya como límite de palabra y el guion como si no lo fuera, así que cambiar rayas sin espacios por guiones reduce tu recuento de palabras en uno por cada cambio.

Mi director dijo que mis rayas parecen de ChatGPT. ¿Qué hago? Tómalo como la impresión de un lector y no como el resultado de un detector, porque eso es lo que es. A una impresión se responde con borradores, notas y con poder recorrer tu propia argumentación, no con un buscar y reemplazar que no va a notar.

¿Debería escribir distinto para evitarme todo este problema? Escribir deliberadamente por debajo de tu nivel tiene un coste seguro en notas y un beneficio no medido frente a una puntuación que normalmente no tienes permiso para ver. La lista que el propio proveedor publicó de cómo son sus falsos positivos —texto con poca variación estructural, texto que se repite literalmente— no es una lista de puntuación, y las ediciones manuales que sí respalda las repasamos en cómo humanizar texto de IA sin una herramienta.

Seguir leyendo