Cómo humanizar un texto de IA sin ninguna herramienta: las correcciones que de verdad mueven las estadísticas

Turnitin puntúa segmentos solapados de varias oraciones, no oraciones sueltas. Aquí tienes qué correcciones manuales atacan las propiedades que señala su propia documentación y cuánto cuesta de verdad hacer ese trabajo a mano.

Equipo de HumanPen

· 14 min de lectura

La respuesta breve

Bajo la etiqueta de «humanizar un texto de IA» se esconden dos trabajos muy distintos. Uno consiste en intentar colar un texto generado por un control. El otro es la situación en la que está la mayoría de la gente: el texto es tuyo, o empezó siendo un borrador que desde entonces has reescrito, y aun así te lo devolvieron marcado. Esta página va de lo segundo. Casi todo lo que viene a continuación es la razón por la que lo primero es una diana en movimiento.

Trabaja al nivel de pasajes completos. Turnitin divide el envío en segmentos solapados de varias oraciones, puntúa cada segmento y hace que cada oración calificable herede la puntuación de los segmentos en los que aparece, de modo que un cambio limitado a una sola oración compite contra el párrafo que la rodea. Las tres propiedades que Turnitin menciona entre sus propios falsos positivos son los textos con poca variación estructural, los que se repiten literalmente y los que se han parafraseado sin aportar ideas nuevas. Esa lista es lo más parecido a una especificación publicada que existe para corregir a mano.

Nadie, nosotros incluidos, puede decirte en qué cifra se quedará tu puntuación después. La mayoría de los consejos sobre este tema están escritos como si pudieras medir tu propio resultado. Por lo general no puedes, y más abajo hay una sección sobre eso.

Sobre qué se calcula esa puntuación

El porcentaje de escritura con IA no es un recuento de oraciones sospechosas. En las preguntas frecuentes de Turnitin describen el proceso así:

"When a paper is submitted to Turnitin, sentences from the submission are extracted and segmented into overlapping sections for prediction analysis. Each segment is classified by the AI detection model and given a value between 0 and 1, denoting the probability of the text being likely human or AI-generated. Each qualifying sentence within these segments inherits the segment's score. Since segments overlap, some sentences may have multiple scores, which are then pooled into a single score. These sentence scores are further aggregated and used to compute the overall document AI writing score." (Cuando se envía un trabajo a Turnitin, las oraciones del envío se extraen y se dividen en secciones solapadas para el análisis de predicción. El modelo de detección de IA clasifica cada segmento y le asigna un valor entre 0 y 1, que indica la probabilidad de que el texto sea humano o generado por IA. Cada oración calificable dentro de esos segmentos hereda la puntuación del segmento. Como los segmentos se solapan, algunas oraciones pueden tener varias puntuaciones, que luego se combinan en una sola. Esas puntuaciones de las oraciones se agregan a su vez y se usan para calcular la puntuación global de escritura con IA del documento.)

De ahí salen tres consecuencias prácticas.

Una oración no tiene criterio propio. Su puntuación viene de los bloques de texto a los que pertenece, y pertenece a más de uno. Así que la oración que tienes delante puede estar arrastrando una puntuación que le han puesto sus vecinas.

Solo cuenta la prosa. Turnitin lo llama texto calificable y dice que analiza "only blocks of text that are written in standard grammatical sentences" (solo los bloques de texto escritos con oraciones gramaticalmente correctas), no listas, viñetas ni otras estructuras que no sean oraciones. También dice que la cifra resultante "is not necessarily the percentage of the entire submission" (no es necesariamente el porcentaje de todo el envío) y que un documento que mezcla varios tipos de escritura "would result in a disparity between the percentage and the highlights" (daría lugar a una discrepancia entre el porcentaje y los fragmentos resaltados). Si el texto resaltado no parece sumar la cifra que te dieron, esa es la razón documentada, no un fallo. Hay más sobre esto en cómo leer un informe de escritura con IA de Turnitin.

Y la puntuación va unida al pasaje: esa es la unidad que lee el detector.

La única lista de rasgos que Turnitin ha publicado

Todo lo demás que ves en esta página cuelga de una sola frase de esas preguntas frecuentes:

"Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas." (A veces los falsos positivos —es decir, marcar como generado por IA un texto escrito por una persona— pueden incluir contenido con poca variación estructural, texto que se repite literalmente o texto parafraseado sin desarrollar ideas nuevas.)

La frase siguiente importa lo mismo: "If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated." (Si nuestro indicador muestra una mayor cantidad de escritura con IA en este tipo de texto, te recomendamos que lo tengas en cuenta al interpretar el porcentaje indicado.) Es el propio proveedor pidiendo al profesorado que relativice las puntuaciones altas en escritos así.

Ten claro qué es esa lista: Turnitin enumerando las formas de escritura humana en las que su propio detector se equivoca. No es una descripción de cómo funciona el modelo ni una lista de comprobación para disfrazar texto generado. Es una descripción de la situación en la que estás si escribiste el texto tú y aun así te lo marcaron. Tres propiedades nombradas, tres correcciones. El método se reduce a eso.

La explicación popular es más estrecha de lo que parece

Antes de pasar a las correcciones, quita esto de en medio, porque la mitad de los consejos que circulan por internet se apoyan en ello.

La historia habitual es que los detectores miden la ráfaga (burstiness) y la perplejidad (perplexity), y que la prosa académica puntúa mal porque lleva un ritmo uniforme. Las mismas preguntas frecuentes lo abordan: el modelo "is not explicitly programmed to evaluate specific signals such as 'burstiness,' 'perplexity,' or other individual metrics sometimes referenced in public discussions" (no está programado explícitamente para evaluar señales concretas como la 'burstiness', la 'perplexity' u otras métricas individuales que a veces se mencionan en los debates públicos). En su lugar, dice que el modelo aprende patrones estadísticos de los datos de entrenamiento y que predicciones concretas puede que no siempre sean explicables rasgo por rasgo.

Cuidado con hasta dónde llevas eso. La misma página dice también que sus clasificadores se entrenan para detectar diferencias en la probabilidad de las palabras, y la perplejidad es una medida de la probabilidad de las palabras. Así que la versión exacta es más estrecha: Turnitin niega calcular esas dos puntuaciones concretas como reglas explícitas. No niega que las estadísticas de elección de palabras importen.

El efecto práctico es menor de lo que parece. Variar el ritmo de las oraciones sigue valiendo la pena, pero por la razón de la sección anterior, no porque estés moviendo el dial de la ráfaga. Repasamos de dónde salió esa historia en qué miden los detectores de IA más allá de la perplejidad y la ráfaga.

Corrección 1: reconstruye el párrafo en vez de reparar la oración

Abre el párrafo marcado, cierra el borrador y vuelve a escribir el párrafo a partir de tus notas, de tu esquema o de la fuente de la que salió. No edites las oraciones que ya están. Escribe el pasaje y compáralo después con el anterior para comprobar que no se ha perdido ningún dato, cifra o cita.

Por qué va primero: la puntuación por segmentos significa que las oraciones de alrededor forman parte de lo que produjo la puntuación. Un párrafo reescrito a partir de las fuentes sale con otro repertorio de oraciones, otro orden de las afirmaciones y, normalmente, otra extensión. Un párrafo editado palabra por palabra sale con la misma forma.

Hazlo en tandas de dos o tres párrafos seguidos, en lugar de repartir arreglos de una sola oración por todo el documento. Los segmentos cruzan los límites entre párrafos, así que trabajar en bloques contiguos rinde más que el mismo número de correcciones esparcidas.

Esta es la corrección lenta. También es la única que da de forma fiable un texto que puedes defender como tuyo, oración por oración, si alguien te lo pide.

Corrección 2: devuelve la variación estructural

Primer punto de la lista de falsos positivos de Turnitin. Los borradores generados y, siendo sinceros, muchos borradores humanos escritos con cansancio acaban convergiendo en la misma forma: párrafos de longitud casi idéntica, cada uno abierto por una oración temática, cada uno cerrado con un remate del tipo «esto demuestra que» y cada uno con tres ideas de apoyo.

Qué cambiar:

  • Deja que la extensión del párrafo siga al trabajo que hace. Una salvedad puede ser una sola oración. Un ejemplo desarrollado puede ocupar doce, y debe ocuparlas si hace falta para desarrollarlo.
  • Quita la oración final de resumen a los párrafos que no la necesiten. En muchos borradores, uno de cada tres párrafos termina repitiendo lo que ya dijo al empezar.
  • Rompe el reflejo de la oración temática: empieza un párrafo con la excepción, otro con la cifra y otro ya a mitad de la argumentación.
  • Algunas oraciones deberían simplemente terminar.

Una trampa. Pasar la prosa a viñetas no es esta corrección. Las viñetas no son texto calificable, así que sacar la prosa de las oraciones la saca del análisis, y eso puede mover la cifra sin que nada de tu escritura haya cambiado. Quien te evalúa lo notará, y habrás empeorado el trabajo por arreglar una estadística. Meter el texto en una tabla ni siquiera llega a eso: una nota de versión dice que Turnitin ya puede procesar prosa extensa en tablas y que los envíos ya realizados tienen que volver a enviarse para que eso se les aplique.

Corrección 3: borra todo lo que tu borrador dice dos veces

Segundo punto de la lista, y la victoria más barata de esta página.

Busca en tu propio documento cadenas repetidas de seis palabras o más. Después revisa los cuatro sitios donde los borradores académicos se repiten por costumbre: el resumen contra la introducción, la introducción contra la primera sección, todos los «como se ha mencionado antes» y la conclusión contra todo lo demás. Revisa también si hay algún párrafo que al final repita su propia primera oración, que es el problema de la corrección 2 con otro disfraz.

Borra la segunda aparición, no la primera. Si de verdad hay que retomar un punto en la conclusión, retómalo en una sola oración subordinada, no en un párrafo.

Bien hecho, esto puede sacar de una sección más de lo que imaginas. Además acorta el trabajo, que normalmente es otro problema que ya tenías.

Corrección 4: desarrolla la idea en vez de reformularla

Tercer punto: "text that has been paraphrased without developing new ideas" (texto parafraseado sin desarrollar ideas nuevas). Es la única corrección de la lista que cambia lo que el párrafo afirma, y no solo cómo suena, y es la que sobrevive al contacto con quien lo corrige de verdad.

Para cada pasaje marcado, añade lo que solo tú puedes añadir:

  • La cifra que sale de tus propios datos y el caso en el que no se cumplió.
  • Por qué elegiste este método después de descartar el evidente.
  • Una limitación que observaste mientras hacías el trabajo, y no una que encontraste listada en la discusión de otro.
  • Dónde discrepan dos de tus fuentes y a cuál de las dos sigues.
  • El resultado que esperabas y no obtuviste.

Si un párrafo no puede absorber nada de eso, pregúntate si sostiene realmente una argumentación. Los párrafos ciertos pero vacíos son los que suenan a generados y, según el propio Turnitin, también los que su detector falla.

Coste: este no tiene límite. Puede significar volver a tus fuentes durante toda una tarde. También es la única corrección de aquí que mejora la nota con independencia de cualquier puntuación de detección.

Corrección 5: comprueba si tu documento es siquiera lo bastante largo para que esto funcione

Turnitin dice que los documentos cortos se comportan de otra manera:

"In shorter documents where there are only a few hundred words, the prediction will be mostly 'all or nothing' because we're predicting on a single segment without the opportunity to overlap." (En documentos más cortos, de apenas unos cientos de palabras, la predicción será básicamente «todo o nada», porque estamos prediciendo sobre un único segmento y no hay oportunidad de solaparlo.)

Y la frase siguiente: "This means that some text that is a mix of AI-generated and original content could be flagged as entirely AI-generated." (Esto significa que un texto que mezcla contenido generado por IA y contenido original podría marcarse como si fuera IA en su totalidad.)

En una declaración personal de 500 palabras o en una intervención de un foro, en la práctica hay un solo segmento. Corregir dos oraciones dentro de él no es un avance parcial hacia nada. O reescribes el texto entero a partir de tus notas, o aceptas que la puntuación se comporta como está documentado y pones el esfuerzo en poder demostrar cómo lo escribiste. Tratamos esa parte en te han marcado, pero lo escribiste tú.

Qué ataca cada corrección y cuánto cuesta, aproximadamente

La columna del esfuerzo es una estimación, no una medición. Supone prosa académica en inglés, tus notas a mano y ninguna interrupción, que es un conjunto de supuestos que no se ha cumplido jamás ni una vez.

CorrecciónQué atacaEsfuerzo aproximado por cada 1.000 palabras
Reconstruir los párrafos a partir de las notasPuntuación por segmentos: la unidad es el pasaje, no la oración45 a 90 min
Restaurar la variación estructural"content without a lot of structural variation" (contenido con poca variación estructural)15 a 30 min
Eliminar la repetición literal"text that literally repeats itself" (texto que se repite literalmente)10 a 20 min
Desarrollar las ideas, añadir lo que solo tú sabes"paraphrased without developing new ideas" (parafraseado sin desarrollar ideas nuevas)Sin límite, a menudo horas
Convertir la prosa en viñetasSaca la prosa del análisis en lugar de cambiarlaNo lo hagas

Lee las cuatro primeras filas como un único trabajo, no como una carta. Se solapan mucho: reconstruir un párrafo a partir de las notas suele arreglar su extensión, su repetición y su vacuidad en la misma pasada.

Probablemente no puedas medir nada de esto

Esta es la parte que la mayoría de las guías se salta, y cambia lo que deberías hacer.

Ni el indicador ni el informe de escritura con IA son visibles para los estudiantes. Solo los ven el profesorado y el personal administrativo, aunque un docente puede descargar el informe en PDF y compartirlo. Así que, a menos que alguien te lo enseñe, estarás corrigiendo sin indicador.

Incluso con el informe delante, la resolución es baja en la parte inferior. Turnitin no muestra un porcentaje para las puntuaciones entre el 1 % y el 19 %, solo un asterisco, y dice que lo hace para evitar posibles falsos positivos. Una corrección que haya hecho pasar un documento del 18 % al 6 % aparece en el informe exactamente igual que una corrección que no haya hecho nada.

El modelo también está construido para quedarse corto. Turnitin dice que, para mantener baja su tasa de falsos positivos, "there is a chance that we might miss some AI written text in a document" (es posible que pasemos por alto parte del texto escrito con IA de un documento), y pone su propio ejemplo: un documento con un 50 % "could contain as much as 65% AI writing" (podría contener hasta un 65 % de escritura con IA). Una cifra que baja no demuestra gran cosa en ninguno de los dos sentidos.

Una cosa que conviene tener presente mientras haces este trabajo. La guía de Turnitin para el profesorado dice que la puntuación se usa como es debido cuando se trata como "a single data point rather than a definitive response" (un único dato, en lugar de una respuesta definitiva), y tres de sus páginas de ayuda afirman que la puntuación no debe ser el único fundamento para adoptar medidas perjudiciales contra un estudiante. Arregla el trabajo. La puntuación va por detrás del trabajo y, además, tú no puedes verla.

Lo que cuesta de verdad hacerlo a mano

El tiempo es lo obvio, y no escala de forma lineal. Un ensayo de 1.500 palabras es cosa de una tarde. Un capítulo de 8.000 palabras con tablas, bibliografía y referencias cruzadas es otro animal, porque la corrección deja de ser la parte difícil.

Los costes menos obvios:

  • Cada párrafo que reescribes es un párrafo que tienes que volver a verificar. Las cifras, el tiempo verbal en la sección de métodos, si la cita sigue apuntando a la afirmación a la que iba unida. La verificación suele llevar más tiempo que la reescritura.
  • Puedes aplanar tu propia argumentación. Tres pasadas de «haz esto menos uniforme» sobre tu propia prosa, a la una de la mañana, es la manera en que una matización cuidadosa se convierte en una afirmación exagerada.
  • En los archivos largos el daño es estructural. Las referencias cruzadas, los pies numerados, las notas al pie y los campos del índice se rompen cuando el texto se mueve, y se rompen en silencio. Escribimos sobre ese modo de fallo en campos de Word, índices y referencias cruzadas.
  • Puede que rehagas trabajo que ya estaba bien, porque no puedes ver qué pasajes se han marcado a menos que tu docente comparta el informe.

El alcance es la parte cara, y es la parte en torno a la que se construyó HumanPen, así que lee este párrafo como lo que es: una parte interesada hablando. La ruta de importación del informe toma el AI Writing Report que te dieron y, en palabras de esa página, "Only passages matched from the report are rewritten; the rest of the document is preserved verbatim" (solo se reescriben los pasajes que coinciden con el informe; el resto del documento se conserva tal cual). Los pasajes que cumplen los requisitos pueden volver a procesarse sin coste. Haz las correcciones a mano o no las hagas. El principio es el mismo en los dos casos, y es el aburrido: cuanto más estrecho sea el alcance, menos habrá que volver a verificar después.

Cuándo hacerlo a mano de todos modos

La corrección manual es la decisión acertada más a menudo de lo que a un vendedor de herramientas le gustaría admitir:

  • El documento es corto. Con unos cientos de palabras vas a reescribirlo entero de todos modos.
  • Todavía tienes las notas y las fuentes abiertas. La corrección 4 en ese momento es casi gratis e imposible seis meses después.
  • La sección marcada es de las que puedes reescribir de verdad a partir del trabajo de fondo, como una sección de métodos o un párrafo de resultados.
  • El problema que encontró el informe es un problema real. La repetición, los párrafos vacíos y la estructura uniforme son defectos de escritura antes que otra cosa. Corregirlos mejora el trabajo, se mueva o no la cifra.

Preguntas frecuentes

¿Variar la longitud de las oraciones baja la puntuación de detección de IA? No por la razón que se suele dar. Turnitin dice que su modelo no está programado explícitamente para evaluar señales como la ráfaga o la perplejidad. Pero por separado señala el "content without a lot of structural variation" (contenido con poca variación estructural) como una propiedad habitual en sus propios falsos positivos, así que merece la pena recuperar la variación. Tómalo como una corrección más entre varias, no como el truco.

¿Cuánto tengo que cambiar para que se mueva la cifra? Nadie puede decírtelo, y cualquiera que te dé un porcentaje se lo está inventando. Turnitin puntúa segmentos solapados y combina los resultados, así que el efecto de una corrección depende del pasaje que la rodea. Además pierdes la retroalimentación en la franja del 1 % al 19 %, donde el informe muestra un asterisco en lugar de una cifra.

Han resaltado mi bibliografía. ¿Debo editar mis referencias? Comprueba primero qué informe tienes en la mano. Una nota de versión dice que las bibliografías quedan excluidas cuando se procesa el informe de escritura con IA (los envíos ya realizados solo recogen ese cambio al volver a enviarse), y Turnitin dice que los resaltados de escritura con IA no son visibles en el Similarity Report en absoluto. Una bibliografía resaltada es casi siempre una coincidencia de similitud, y que las entradas bibliográficas coincidan es lo normal, porque un estilo de citación existe precisamente para que todo el mundo dé el mismo formato a la misma fuente.

Solo usé un corrector gramatical. ¿Eso se marca? Las preguntas frecuentes de Turnitin dicen que, en pruebas con documentos escritos por personas, "in most cases" (en la mayoría de los casos) los cambios hechos con Grammarly y otros correctores gramaticales no fueron marcados por su detector. Añaden que esto excluye las funciones generativas de Grammarly —generar borradores, parafrasear y resumir— y que el contenido producido con esas funciones "will likely be flagged as AI-generated by our detector" (probablemente será marcado como generado por IA por nuestro detector). La línea que trazan separa corregir tus oraciones de generarlas.

¿Hay alguna puntuación a la que deba aspirar? No existe ningún umbral publicado y cada institución fija su propia práctica. La guía de Turnitin para el profesorado dice que la puntuación se usa como es debido cuando se trata como un único dato y no como una respuesta definitiva. Entramos en por qué la popular cifra del 20 % no es una regla en ¿es demasiado un 20 % de IA?.

Fuentes: las AI writing detection capabilities FAQs (preguntas frecuentes sobre las capacidades de detección de escritura con IA), Using the AI Writing Report (uso del informe de escritura con IA) y las AI writing detection model release notes (notas de versión del modelo de detección de escritura con IA) de Turnitin. Citas cotejadas con esas páginas el 14 de agosto de 2026. Publicado en el blog de una empresa que vende un humanizador de documentos, lo cual conviene saber cuando leas la sección sobre lo que cuesta la corrección manual.

Seguir leyendo