¿Analiza Turnitin el texto de las tablas? La regla de la prosa en las tablas
El texto de las tablas era invisible para el detector de IA de Turnitin. Eso cambió. Te contamos qué se procesa ahora, qué sigue fuera y por qué el porcentaje y los resaltados casi nunca coinciden.
Equipo de HumanPen
· 5 min de lectura
La confusión en torno a las tablas
Si alguna vez entregaste un trabajo con tablas de datos y luego te quedaste mirando el informe de escritura con IA, seguro que te preguntaste qué analizó Turnitin en realidad. La confusión es comprensible. Durante mucho tiempo, un artículo de ayuda de Turnitin decía: «The model does not reliably detect AI-generated text in the form of non-prose, such as poetry, scripts, or code, nor does it detect short-form/unconventional writing such as bullet points, tables, or annotated bibliographies.» (El modelo no detecta de forma fiable el texto generado por IA cuando no es prosa, como poesía, guiones o código, y tampoco detecta la escritura breve o poco convencional, como viñetas, tablas o bibliografías comentadas.)
Esa redacción colocaba las tablas en la misma categoría que la poesía y los guiones: formatos que el detector no tocaba. Estudiantes y profesores lo interpretaron como que cualquier texto dentro de una tabla se ignoraba por completo. Era una lectura razonable, pero no era todo el panorama.
La realidad es que la detección de IA de Turnitin solo procesa lo que llama oraciones en prosa. La documentación lo explica: «This qualifying text includes only prose sentences, meaning that we only analyze blocks of text that are written in standard grammatical sentences and do not include other types of writing such as lists, bullet points (short non-sentence structures), or other non-sentence structures.» (Este texto calificable incluye únicamente oraciones en prosa, es decir, solo analizamos bloques de texto escritos con oraciones gramaticalmente correctas y que no incluyen otros tipos de escritura como listas, viñetas (estructuras breves que no son oraciones) u otras estructuras que no son oraciones.) Las tablas no quedaron excluidas por una regla especial sobre tablas, sino porque la mayor parte del contenido de una tabla no cuenta como prosa.
Qué puede procesar Turnitin dentro de las tablas
Turnitin actualizó su lógica de procesamiento. La entrada del 9 de agosto de 2023 en su página modelo de detección de escritura con IA (guides.turnitin.com/hc/en-us/articles/28294949544717-AI-writing-detection-model) afirma: «We are now able to process long-form prose text in tables.» (Ahora podemos procesar texto en prosa de formato largo dentro de las tablas.) Es un cambio importante. Si tu tabla contiene oraciones completas con una gramática estándar, esas oraciones ya las analiza el modelo de detección de IA.
La frase clave es «texto en prosa de formato largo». Una celda que dice «Los resultados indican una correlación estadísticamente significativa entre la variable X y la variable Y, con un valor p inferior a 0.01» es una oración en prosa normal, y se procesará. Una celda que dice «p < 0.01» o «Variable X, 0.85» no es una oración: es un fragmento de datos, y se omitirá.
Esta distinción importa porque muchas tablas académicas mezclan oraciones completas con entradas de datos breves. Las partes que son oraciones se analizarán; los datos no. No puedes asumir que una tabla entera se incluye o se excluye. Turnitin evalúa el contenido bloque a bloque, buscando oraciones gramaticalmente estándar, sin importar si están dentro de una celda o en el cuerpo del documento.
Esa misma entrada también indica: «Resubmit to reprocess existing submissions that contain tables.» (Vuelve a enviar el trabajo para reprocesar los envíos existentes que contienen tablas.) Si enviaste un trabajo antes de esta actualización, la prosa de las tablas de ese envío no se procesó. Volver a enviarlo activa la lógica actualizada.
Qué queda excluido
Incluso con la actualización de la prosa en tablas, varios tipos de contenido siguen fuera del análisis de detección de IA. La regla de «solo prosa» implica que las viñetas, las estructuras breves que no son oraciones y las listas no se procesan. Si tu tabla contiene fragmentos cortos en lugar de oraciones completas, esos fragmentos quedan excluidos.
Las bibliografías se corrigieron en la misma fecha. La entrada del 9 de agosto de 2023 dice: «We have fixed a bug that was occasionally highlighting AI writing within references listed in a bibliography. Bibliographies are now excluded when processing the AI writing report.» (Hemos corregido un error que a veces resaltaba escritura con IA dentro de las referencias de una bibliografía. Las bibliografías ahora se excluyen al procesar el informe de escritura con IA.) Esta corrección resolvió un problema concreto: las entradas de referencias se marcaban y eso daba resultados engañosos. La indicación es clara: «Resubmit to reprocess existing submissions that contain highlighted reference sections.» (Vuelve a enviar el trabajo para reprocesar los envíos existentes que contienen secciones de referencias resaltadas.)
Así que la lista de excluidos incluye fragmentos breves de tabla, viñetas, entradas de datos y ahora también las bibliografías completas. El detector se centra en las oraciones en prosa del cuerpo del documento y de las celdas, y omite todo lo demás. Esto no es un fallo del sistema: es una decisión de diseño basada en que el modelo se entrenó con prosa, no con formatos de datos ni con estructuras de citas.
Por qué tu porcentaje y los resaltados no coinciden
Una de las fuentes de confusión más habituales es la diferencia entre el porcentaje de escritura con IA y el texto resaltado en el informe. La documentación lo aborda directamente: «This means that a document containing several different writing types would result in a disparity between the percentage and the highlights.» (Esto significa que un documento con varios tipos de escritura distintos daría lugar a una discrepancia entre el porcentaje y los resaltados.)
Si tu documento incluye tablas con oraciones completas, fragmentos de datos breves, viñetas y una bibliografía, solo se analizan las oraciones en prosa. El porcentaje refleja la proporción de prosa analizada que el modelo clasificó como generada por IA; no refleja la proporción del envío completo. La documentación señala: «This percentage is not necessarily the percentage of the entire submission.» (Este porcentaje no es necesariamente el porcentaje de todo el envío.)
Por eso puedes ver una puntuación de escritura con IA del 40 por ciento y solo unos pocos párrafos resaltados. Los resaltados muestran qué segmentos de prosa se marcaron. El porcentaje se calcula solo a partir de la prosa analizada. El contenido excluido, como los datos de tablas o las entradas de bibliografía, no aparece en los resaltados ni entra en el cálculo del porcentaje como cabría esperar.
Entender esta distinción te ayuda a leer bien el informe. El porcentaje no es una simple proporción entre texto marcado y texto total: es una puntuación basada en la prosa que el modelo procesó realmente, que puede ser solo una parte de tu documento.
Qué revisar antes de enviar
Antes de enviar un documento con tablas, te recomendamos revisar el contenido de esas tablas. Si tus celdas contienen oraciones completas, el detector de IA las analizará. Asegúrate de que esas oraciones reflejen tu propia escritura. Si usaste IA para redactar alguna prosa de tabla, esa prosa se evaluará igual que cualquier otra oración de tu trabajo.
Revisa tu bibliografía. Las bibliografías ya no entran en el análisis de escritura con IA, así que las referencias no deberían aparecer resaltadas. Si tienes un informe antiguo en el que se marcaron referencias, volver a enviar el documento aplicará la lógica actualizada que excluye las bibliografías.
Si tu documento tiene tipos de contenido mezclados, no te sorprendas si el porcentaje y las secciones resaltadas parecen incoherentes. Como explica la documentación, es normal que haya discrepancia entre el porcentaje y los resaltados cuando un documento contiene varios tipos de escritura. Lee los resaltados para saber qué segmentos concretos de prosa se marcaron, y trata el porcentaje como una puntuación derivada de la prosa analizada, no de todo el envío.
Si ya tienes un informe de escritura con IA de Turnitin y quieres trabajar sobre los pasajes que quedaron marcados, puedes importar ese informe y reescribir solo esos pasajes. El informe tiene que venir de la cuenta de Turnitin de tu institución; nosotros no generamos informes.
Seguir leyendo
Guía para estudiantes chinos sobre cómo reducir las puntuaciones de detección de IA de Turnitin
5 min de lectura
Informes de detecciónEl mito de perplexity y burstiness: qué usa Turnitin en realidad
5 min de lectura
Informes de detecciónPerplexity y burstiness explicados: qué detectores de IA los usan
5 min de lectura