¿Puede Turnitin detectar IA en entregas que no están en inglés?

La pregunta sobre el idioma en realidad son tres preguntas que se responden como si fueran una, y casi siempre se responde primero la equivocada. Una es en qué idioma está el archivo. Otra es qué admite el detector. Y otra es qué pasa cuando escribiste en un idioma y entregaste en otro, que es justo la situación en la que está la mayoría de quienes preguntan.

Equipo de HumanPen

· 6 min de lectura

La respuesta breve

Cuatro, a fecha de 18 de agosto de 2026. Ese día Turnitin añadió el Modern Standard Arabic al inglés, el español y el japonés, y su propia página de requisitos de archivo sigue diciendo tres; comprueba por tanto la fecha de todo lo que leas sobre esto, incluido esto. Un archivo en un idioma fuera de esos cuatro queda fuera de lo que un AI Writing Report está documentado para gestionar. Y la regla se refiere al idioma del archivo que entregas, así que un trabajo redactado en portugués y entregado en inglés es una entrega en inglés.

La lista de idiomas admitidos, literalmente

De la página de Turnitin requisitos de archivo para un AI Writing Report, tal como estaba el 21 de agosto de 2026:

"File must be written in a supported language: English, Spanish, Japanese" (El archivo debe estar escrito en un idioma admitido: inglés, español, japonés)

Justo al lado, en la misma lista breve: «Accepted file types: .docx, .pdf, .txt, .rtf» (Tipos de archivo aceptados: .docx, .pdf, .txt, .rtf). Esa línea sí está al día. La línea de los idiomas va tres días por detrás.

El árabe se activó el 18 de agosto de 2026 y la página de requisitos no se ha editado desde entonces. La entrada de las notas de la versión de esa fecha lleva por título "New AI detection writing detection capabilities for Modern Standard Arabic submissions" (Nuevas capacidades de detección de escritura con IA para envíos en Modern Standard Arabic), y la página de actualizaciones del producto lo resume en una frase: "Arabic detection will run alongside our English, Spanish, and Japanese detectors" (La detección en árabe funcionará junto a nuestros detectores de inglés, español y japonés). Así que la lista vigente es de cuatro. Si entras en la página de requisitos y cuentas tres, lo que has encontrado es una página que no se ha puesto al día, no una contradicción. El alemán, el chino, el portugués y el coreano no aparecen en ninguna de las dos versiones.

Los cuatro detectores no son idénticos entre sí

Esta es la parte que casi nunca llega a los resúmenes. La página de preguntas frecuentes sobre detección de escritura con IA empieza acotando su alcance: «The following content and FAQs pertain to our AI writing detection capabilities for English submissions only.» (El siguiente contenido y estas preguntas frecuentes se refieren únicamente a nuestras capacidades de detección de escritura con IA para envíos en inglés.) Justo debajo de esa línea hay tres enlaces de salida: uno a una FAQ en español, otro a una FAQ en japonés y otro a una FAQ en árabe. La nota de versión explica por qué con palabras más sencillas: «our Arabic AI writing model is a separate model from our English AI writing, Spanish AI writing, and Japanese AI writing models» (nuestro modelo de escritura con IA en árabe es un modelo distinto de nuestros modelos de escritura con IA en inglés, español y japonés).

Y la capacidad que busca texto pasado por herramientas de parafraseo o de evasión solo existe en inglés. La página de Turnitin sobre el uso del AI Writing Report dice que «only our English AI detector includes AI paraphrasing and AI bypasser detection capabilities» (solo nuestro detector de IA en inglés incluye capacidades de detección de parafraseo con IA y de evasión con IA), y la frase inmediatamente después: «At this time our Spanish and Japanese AI detectors do not include AI paraphrasing or AI bypasser detection capabilities.» (En este momento, nuestros detectores de IA en español y japonés no incluyen capacidades de detección de parafraseo con IA ni de evasión con IA.) Esa página no se ha revisado para el árabe y sigue mencionando solo dos. El detector de árabe no se cuela por el hueco: la FAQ en árabe de Turnitin responde a la pregunta en su propia página y dice que la detección de parafraseo con IA está disponible actualmente solo en el detector de inglés. Esa página está en árabe; la redacción en inglés que ves aquí es nuestra.

No lo leas como una apertura. Léelo como un recordatorio de que «la detección de IA de Turnitin» no es una cosa uniforme, y de que todo lo que hayas leído sobre su comportamiento se escribió casi con toda seguridad sobre el detector de inglés.

Traducir al inglés lo convierte en una entrega en inglés

El requisito se refiere al archivo. Si redactaste en tu lengua materna y el documento que subes está en inglés, es el texto en inglés el que se segmenta y se puntúa, sin importar dónde se escribieran primero las ideas.

Y eso plantea la pregunta que la gente hace en realidad: ¿la prosa traducida automáticamente se parece a la salida de un modelo? Turnitin no ha publicado nada que la responda directamente, y nadie fuera de Turnitin tiene el acceso que haría falta para responderla como es debido. Lo que Turnitin sí ha publicado es la lista de propiedades que aparecen en sus propios falsos positivos:

"Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas." (A veces los falsos positivos —es decir, marcar como generado por IA un texto escrito por una persona— pueden incluir contenido con poca variación estructural, texto que se repite literalmente, o texto que se ha parafraseado sin desarrollar ideas nuevas.)

La prosa académica traducida puede encajar en las tres, no porque quien escribe haya hecho algo mal, sino porque la traducción tiende a regularizar la forma de las frases. Esa conexión es una inferencia nuestra, no una afirmación de Turnitin.

La frase siguiente del propio Turnitin es la que conviene llevar a una reunión con tu director: "If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated." (Si nuestro indicador muestra una cantidad mayor de escritura con IA en ese texto, te recomendamos tenerlo en cuenta al mirar el porcentaje indicado.) El proveedor ha dejado constancia de que quienes leen estos informes deben tenerlo presente.

Lo que Turnitin dice haber hecho frente al sesgo

En sus preguntas frecuentes se dice que la muestra de entrenamiento incluyó deliberadamente a "statistically under-represented groups like second-language learners, English users from non-English speaking countries, students at colleges and universities with diverse enrollments and less common subject areas such as anthropology, geology, sociology, and others to minimize bias when training our model" (grupos estadísticamente subrepresentados, como quienes aprenden el inglés como segunda lengua, usuarios del inglés en países de habla no inglesa, estudiantes de colleges y universidades con matrículas diversas, y áreas de estudio menos comunes como antropología, geología, sociología y otras) para minimizar el sesgo al entrenar el modelo.

Esa es la versión de la empresa sobre su propio proceso, y no viene acompañada de cifras publicadas sobre el sesgo. Tómalo como una intención declarada. La pregunta distinta de quién acaba siendo marcado con más frecuencia tiene su propia evidencia, y la repasamos en por qué quienes escriben en inglés sin ser nativos reciben más marcas.

Los documentos cortos se comportan peor, en cualquier idioma

Antes de dar por hecho que una reflexión de dos páginas es el caso de bajo riesgo:

"In shorter documents where there are only a few hundred words, the prediction will be mostly 'all or nothing' because we're predicting on a single segment without the opportunity to overlap." (En documentos más cortos, con apenas unos cientos de palabras, la predicción será casi siempre «todo o nada», porque predecimos sobre un único segmento, sin oportunidad de solapamiento.)

La línea después de esa: «This means that some text that is a mix of AI-generated and original content could be flagged as entirely AI-generated.» (Esto significa que algunos textos que combinan contenido generado por IA y contenido original podrían marcarse como enteramente generados por IA.) Los textos cortos son el punto donde se encuentran la escritura muy traducida y la puntuación de todo o nada, y esa combinación produce los informes más difíciles de discutir.

Preguntas frecuentes

Mi trabajo está en alemán. ¿Recibirá una puntuación de IA? El alemán no está en la lista de idiomas admitidos para un AI Writing Report. Si la configuración de tu institución hace algo más con el archivo es una pregunta para la institución, no algo que cubra la documentación de Turnitin.

Lo escribí yo y después usé una herramienta de traducción. ¿Eso es generado por IA? Son dos preguntas distintas y la primera solo la responde tu institución. Las normas de declaración cubren cada vez más la traducción además de la redacción, así que lee la política real en lugar de asumir que la traducción queda exenta.

¿El detector de español funciona igual que el de inglés? No de forma idéntica, y tampoco el de japonés ni el de árabe. Turnitin describe los cuatro como modelos separados, la capa de parafraseo y evasión está documentada como exclusiva del inglés, y la FAQ principal se limita a los envíos en inglés y remite los otros tres idiomas a páginas propias.

Mi universidad usa Turnitin, pero nunca he visto un porcentaje de IA. No lo verías. Turnitin dice que solo el profesorado y el personal administrativo pueden ver el indicador, aunque el profesorado puede descargar el informe en PDF y compartirlo. Además, la detección de IA requiere una licencia específica, así que algunas instituciones no tienen ninguna.

¿El modelo intenta identificar qué herramienta de IA se usó? No. Clasifica los segmentos según la probabilidad de que sean obra humana o generados por IA (más sobre qué es esa medición).

Seguir leyendo