Como humanizar um texto de IA sem ferramenta: as edições que realmente mudam as estatísticas

O Turnitin pontua trechos sobrepostos de várias frases, não frases isoladas. Aqui está quais edições manuais atingem as propriedades que a própria documentação dele nomeia, e quanto esse trabalho à mão custa de verdade.

Equipe HumanPen

· 14 min de leitura

A resposta curta

Duas coisas diferentes recebem o nome de "humanizar texto de IA". Uma é tentar fazer um texto gerado passar por uma verificação. A outra é a situação da maioria das pessoas: o texto é seu, ou começou como um rascunho que você reescreveu desde então, e mesmo assim voltou marcado. Esta página é sobre a segunda. Quase tudo o que vem abaixo é um motivo pelo qual a primeira é um alvo em movimento.

Trabalhe ao nível de trechos inteiros. O Turnitin divide o trabalho em trechos sobrepostos de várias frases, pontua cada trecho e faz cada frase elegível herdar a pontuação dos trechos em que aparece: uma mudança confinada a uma única frase está competindo com o parágrafo em volta dela. As três propriedades que o Turnitin cita nos próprios falsos positivos são texto sem muita variação estrutural, texto que se repete literalmente e texto parafraseado sem desenvolver ideias novas. Essa lista é o que mais se aproxima de uma especificação publicada para quem vai editar à mão.

Ninguém, nós incluídos, pode dizer em que número a sua pontuação vai parar depois. A maior parte dos conselhos sobre esse assunto é escrita como se você pudesse medir o próprio resultado. Em geral você não pode, e há uma seção sobre isso mais abaixo.

Afinal, o que esse número mede

A porcentagem de escrita por IA não é uma contagem de frases suspeitas. O FAQ da Turnitin descreve o processo assim:

"When a paper is submitted to Turnitin, sentences from the submission are extracted and segmented into overlapping sections for prediction analysis. Each segment is classified by the AI detection model and given a value between 0 and 1, denoting the probability of the text being likely human or AI-generated. Each qualifying sentence within these segments inherits the segment's score. Since segments overlap, some sentences may have multiple scores, which are then pooled into a single score. These sentence scores are further aggregated and used to compute the overall document AI writing score." (Quando um trabalho é enviado ao Turnitin, as frases do envio são extraídas e segmentadas em seções sobrepostas para análise de predição. Cada segmento é classificado pelo modelo de detecção de IA e recebe um valor entre 0 e 1, que indica a probabilidade de o texto ser provavelmente humano ou gerado por IA. Cada frase elegível dentro desses segmentos herda a pontuação do segmento. Como os segmentos se sobrepõem, algumas frases podem ter várias pontuações, que depois são reunidas em uma única. Essas pontuações de frase são agregadas e usadas para calcular a pontuação geral de escrita por IA do documento.)

Três consequências práticas saem daí.

Uma frase não tem opinião própria. A pontuação dela vem dos blocos de texto aos quais ela pertence, e pertence a mais de um. Ou seja, a frase que você está encarando pode estar carregando uma pontuação definida pelas frases vizinhas.

Só a prosa conta. O Turnitin chama isso de texto elegível e diz analisar "only blocks of text that are written in standard grammatical sentences" (apenas blocos de texto escritos em frases gramaticais padrão), não listas, marcadores ou outras estruturas que não sejam frases. Diz também que o número resultante "is not necessarily the percentage of the entire submission" (não é necessariamente a porcentagem de todo o envio), e que um documento que mistura vários tipos de escrita "would result in a disparity between the percentage and the highlights" (resultaria em uma discrepância entre a porcentagem e os destaques). Se o texto destacado não parece somar o número que você recebeu, esse é o motivo documentado, não uma falha do sistema. Há mais sobre isso em como ler um AI Writing Report do Turnitin.

E a pontuação está ligada ao trecho: é essa a unidade que o detetor lê.

A única lista de características que o Turnitin publicou

Todo o resto desta página deriva de uma única frase daquele FAQ:

"Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas." (Às vezes os falsos positivos — sinalizar incorretamente texto escrito por humanos como gerado por IA — podem incluir conteúdo sem muita variação estrutural, texto que se repete literalmente ou texto que foi parafraseado sem desenvolver ideias novas.)

A frase seguinte importa tanto quanto: "If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated." (Se o nosso indicador mostra uma quantidade maior de escrita por IA em um texto assim, recomendamos que você leve isso em consideração ao analisar a porcentagem indicada.) É o fornecedor dizendo aos professores para descontarem pontuações altas em escrita desse tipo.

Deixe claro o que essa lista é: o Turnitin descrevendo as formas de escrita humana que o próprio detector dele erra. Não é uma descrição de como o modelo funciona, e não é um checklist para disfarçar texto gerado. É uma descrição da posição em que você está se escreveu o texto e mesmo assim ele foi marcado. Três propriedades nomeadas, três edições. Esse é o método inteiro.

A explicação popular é mais estreita do que parece

Antes das edições, tire isso do caminho, porque metade dos conselhos que circulam na internet se apoia nisso.

A história padrão é que os detectores medem burstiness e perplexidade, e que a prosa acadêmica se dá mal porque tem ritmo uniforme. O mesmo FAQ trata disso: o modelo "is not explicitly programmed to evaluate specific signals such as 'burstiness,' 'perplexity,' or other individual metrics sometimes referenced in public discussions" (não é programado explicitamente para avaliar sinais específicos como 'burstiness', 'perplexity' ou outras métricas individuais às vezes citadas em discussões públicas). Em vez disso, diz que o modelo aprende padrões estatísticos a partir dos dados de treinamento, e que predições individuais nem sempre são explicáveis característica por característica.

Cuidado com até onde você leva isso. A mesma página diz também que os classificadores são treinados para detectar diferenças na probabilidade das palavras, e perplexidade é uma medida de probabilidade das palavras. Então a versão exata é estreita: o Turnitin nega calcular aquelas duas pontuações nomeadas como regras explícitas. Não nega que as estatísticas de escolha de palavras importem.

O efeito prático é menor do que parece. Variar o ritmo das frases ainda vale a pena, mas pelo motivo da seção anterior, não porque você está girando um botão de burstiness. Contamos de onde veio essa história em o que os detectores de IA medem além de perplexidade e burstiness.

Edição 1: reconstrua o parágrafo em vez de consertar a frase

Abra o parágrafo marcado, feche o rascunho e escreva o parágrafo de novo a partir das suas anotações, do seu esboço ou da fonte de onde ele veio. Não edite as frases que já existem. Escreva o trecho e depois compare com o antigo para conferir se nenhum fato, número ou citação ficou pelo caminho.

Por que esta primeiro: como a pontuação é feita por segmento, as frases em volta fazem parte do que produziu aquela pontuação. Um parágrafo reescrito a partir das fontes sai com outro inventário de frases, outra ordem de argumentos e, em geral, outro tamanho. Um parágrafo editado palavra por palavra sai com a mesma forma.

Faça isso em blocos de dois ou três parágrafos seguidos, em vez de espalhar consertos de uma frase pelo documento. Os segmentos atravessam as fronteiras entre parágrafos, então trabalho contínuo rende mais do que o mesmo número de edições espalhadas.

Esta é a edição lenta. É também a única que produz, com segurança, um texto que você consegue defender como seu, frase por frase, se alguém pedir.

Edição 2: devolva a variação estrutural

Primeiro item da lista de falsos positivos do Turnitin. Rascunhos gerados — e, sinceramente, muitos rascunhos humanos escritos com sono — convergem para a mesma forma: parágrafos de tamanho quase idêntico, cada um abrindo com uma frase-tópico, cada um fechando com um arremate do tipo "isso mostra que", cada um com três pontos de sustentação.

O que mudar:

  • Deixe o tamanho do parágrafo seguir o trabalho que ele faz. Uma ressalva pode ser uma frase sozinha. Um exemplo resolvido pode ter doze, e deve ter, se for isso que o exemplo exige.
  • Corte a frase final de resumo dos parágrafos que não precisam dela. Em muito rascunho, um em cada três parágrafos termina repetindo a própria abertura.
  • Quebre o reflexo da frase-tópico: comece um parágrafo pela exceção, outro pelo número, outro já no meio do argumento.
  • Algumas frases devem simplesmente parar.

Uma armadilha. Converter prosa em marcadores não é esta edição. Marcadores não são texto elegível, então tirar a prosa das frases a tira da análise, o que pode mexer no número sem que nada na sua escrita tenha mudado. Seu avaliador vai notar, e você terá piorado o trabalho para consertar uma estatística. Passar texto para uma tabela nem faz tanto assim: uma nota de versão diz que o Turnitin agora consegue processar prosa longa em tabelas, e que envios já feitos precisam ser reenviados para que isso passe a valer para eles.

Edição 3: apague tudo o que seu rascunho diz duas vezes

Segundo item da lista, e a vitória mais barata desta página.

Procure no seu próprio documento sequências repetidas de seis palavras ou mais. Depois confira os quatro lugares em que rascunhos acadêmicos costumam se repetir: o resumo contra a introdução, a introdução contra a primeira seção, cada "como mencionado acima", e a conclusão contra todo o resto. Procure também o parágrafo que repete a própria primeira frase no final, que é o problema da edição 2 com outro chapéu.

Apague a segunda ocorrência, não a primeira. Se um ponto realmente precisa ser retomado na conclusão, retome em uma oração, não em um parágrafo.

Feito direito, isso pode tirar uma quantidade surpreendente de uma seção. Também encurta o trabalho, o que em geral é um problema separado que você já tem.

Edição 4: desenvolva a ideia em vez de reescrevê-la

Terceiro item: "text that has been paraphrased without developing new ideas" (texto que foi parafraseado sem desenvolver ideias novas). Esta é a única edição da lista que muda o que o parágrafo afirma, e não como ele soa, e é a que sobrevive ao contato com um avaliador de verdade.

Para cada trecho marcado, acrescente o que só você pode acrescentar:

  • O número dos seus próprios dados, e o caso em que ele não se sustentou.
  • Por que você escolheu este método depois de rejeitar o óbvio.
  • Uma limitação que você percebeu enquanto fazia o trabalho, e não uma que encontrou listada na seção de discussão de outra pessoa.
  • Onde duas das suas fontes discordam, e qual delas você está seguindo.
  • O resultado que você esperava e não obteve.

Se um parágrafo não absorve nada disso, pergunte se ele carrega algum argumento. Parágrafos verdadeiros mas vazios são os que soam como gerados e, pelo relato do próprio Turnitin, também são os que o detector dele erra.

Custo: este é em aberto. Pode significar voltar às suas fontes por uma tarde. Também é a única edição aqui que melhora a nota independentemente de qualquer pontuação de detecção.

Edição 5: veja se o seu documento tem sequer o tamanho para isso funcionar

O Turnitin diz que documentos curtos se comportam de outro jeito:

"In shorter documents where there are only a few hundred words, the prediction will be mostly 'all or nothing' because we're predicting on a single segment without the opportunity to overlap." (Em documentos mais curtos, com apenas algumas centenas de palavras, a predição será basicamente "tudo ou nada", porque estamos prevendo com base em um único segmento, sem oportunidade de sobreposição.)

E a frase seguinte: "This means that some text that is a mix of AI-generated and original content could be flagged as entirely AI-generated." (Isso significa que um texto que mistura conteúdo gerado por IA e conteúdo original pode ser sinalizado como inteiramente gerado por IA.)

Para uma declaração pessoal de 500 palavras ou um post de discussão, existe na prática um único segmento. Editar duas frases dentro dele não é um progresso parcial rumo a coisa alguma. Ou reescreva a peça inteira a partir das suas anotações, ou aceite que a pontuação está se comportando como documentado e coloque sua energia em conseguir mostrar como você escreveu aquilo. Cobrimos esse lado em marcado, mas foi você quem escreveu.

O que cada edição atinge, e mais ou menos quanto custa

A coluna de esforço é uma estimativa, não uma medição. Pressupõe prosa acadêmica em inglês, suas anotações na mesa e nenhuma interrupção — um conjunto de pressupostos que nunca, nem uma vez, foi verdadeiro.

EdiçãoO que atingeEsforço aproximado por 1.000 palavras
Reconstruir parágrafos a partir das anotaçõesPontuação por segmento: a unidade é o trecho, não a frase45 a 90 min
Restaurar a variação estrutural"content without a lot of structural variation" (conteúdo sem muita variação estrutural)15 a 30 min
Cortar a repetição literal"text that literally repeats itself" (texto que se repete literalmente)10 a 20 min
Desenvolver as ideias, acrescentar o que só você sabe"paraphrased without developing new ideas" (parafraseado sem desenvolver ideias novas)Em aberto, muitas vezes horas
Converter prosa em marcadoresRemove a prosa da análise em vez de mudá-laNão faça

Leia as quatro primeiras linhas como um trabalho só, não como um cardápio. Elas se sobrepõem bastante: reconstruir um parágrafo a partir das anotações costuma corrigir o tamanho, a repetição e o vazio dele na mesma passada.

Você provavelmente não consegue medir nada disso

Esta é a parte que a maioria dos guias pula, e ela muda o que você deveria fazer.

O indicador e o relatório de escrita por IA não ficam visíveis para estudantes. Só professores e administradores os veem, embora um professor possa baixar o relatório em PDF e compartilhar. Ou seja, a menos que alguém mostre, você está editando sem medidor.

Mesmo com o relatório na sua frente, a resolução é ruim na parte de baixo. O Turnitin não exibe porcentagem para pontuações entre 1 e 19, só um asterisco, e diz fazer isso para evitar possíveis falsos positivos. Uma edição que levou um documento de 18% a 6% aparece no relatório exatamente igual a uma edição que não fez nada.

O modelo também é construído para sub-reportar. O Turnitin diz que, para manter baixa a taxa de falsos positivos, "there is a chance that we might miss some AI written text in a document" (há a chance de deixarmos passar algum texto escrito por IA em um documento), e dá o próprio exemplo: um documento apontado em 50% "could contain as much as 65% AI writing" (pode conter até 65% de escrita por IA). Um número que cai não é prova de muita coisa em nenhuma das duas direções.

Uma coisa vale segurar enquanto você faz esse trabalho. A orientação do Turnitin a educadores é que a pontuação está sendo usada como pretendido quando é tratada como "a single data point rather than a definitive response" (um único dado, e não uma resposta definitiva), e três das páginas de ajuda dizem que a pontuação não deve ser a única base para uma medida adversa contra um estudante. Conserte o trabalho. A pontuação vem depois do trabalho, e você não a vê de qualquer forma.

Quanto esse trabalho à mão custa de verdade

O tempo é o custo óbvio, e não escala de forma linear. Um ensaio de 1.500 palavras é uma noite. Um capítulo de 8.000 palavras com tabelas, lista de referências e remissões é outra história, porque aí a edição deixa de ser a parte difícil.

Os custos menos óbvios:

  • Cada parágrafo que você reescreve é um parágrafo que você precisa verificar de novo. Números, o tempo verbal na seção de métodos, se a citação ainda aponta para a afirmação à qual estava ligada. A verificação costuma ser mais longa que a reescrita.
  • Você pode achatar o próprio argumento. Três passadas de "deixe isso menos uniforme" na sua própria prosa, à 1 da manhã, é assim que uma ressalva cuidadosa vira uma afirmação exagerada.
  • Em arquivos longos o estrago é estrutural. Remissões, legendas numeradas, notas de rodapé e campos de sumário quebram quando o texto se move, e quebram em silêncio. Escrevemos sobre esse modo de falha em campos do Word, sumários e remissões.
  • Você pode refazer trabalho que já estava bom, porque não consegue ver quais trechos foram marcados a menos que seu professor compartilhe o relatório.

Escopo é a parte cara, e é a parte em torno da qual o HumanPen foi construído, então leia este parágrafo como uma parte interessada falando. O caminho de importação do relatório recebe o AI Writing Report que você recebeu e, nas palavras daquela página, "Only passages matched from the report are rewritten; the rest of the document is preserved verbatim" (Apenas os trechos correspondentes do relatório são reescritos; o resto do documento é preservado na íntegra). Passagens elegíveis podem ser reprocessadas sem custo. Faça as edições à mão ou não faça. O princípio é o mesmo de qualquer forma, e é o princípio chato: quanto mais estreito o escopo, menos há para reverificar depois.

Quando fazer à mão mesmo assim

A edição manual é a escolha certa com mais frequência do que um fornecedor de ferramenta gostaria de admitir:

  • O documento é curto. Em algumas centenas de palavras você vai reescrever tudo de qualquer forma.
  • Você ainda tem as anotações e as fontes abertas. A edição 4 é quase de graça nesse ponto e impossível seis meses depois.
  • A seção marcada é uma que você consegue reescrever de verdade a partir do trabalho que a sustenta, como uma seção de métodos ou um parágrafo de resultados.
  • O problema que o relatório encontrou é um problema real. Repetição, parágrafos vazios e estrutura uniforme são defeitos de escrita antes de qualquer outra coisa. Corrigi-los melhora o trabalho, mova-se ou não qualquer número.

Perguntas frequentes

Variar o tamanho das frases reduz uma pontuação de detecção de IA? Não pelo motivo que costumam dar. O Turnitin diz que o modelo não é programado explicitamente para avaliar sinais como burstiness ou perplexidade. Mas nomeia separadamente "content without a lot of structural variation" (conteúdo sem muita variação estrutural) como uma propriedade comum nos próprios falsos positivos, então vale a pena restaurar a variação. Trate isso como uma edição entre várias, não como o truque.

Quanto preciso mudar antes de o número se mexer? Ninguém pode dizer, e quem dá uma porcentagem está inventando. O Turnitin pontua segmentos sobrepostos e reúne os resultados, então o efeito de uma edição depende do trecho em volta. Você também perde a devolutiva na faixa de 1% a 19%, onde o relatório mostra um asterisco em vez de um número.

Minha lista de referências foi destacada. Devo editar minhas referências? Confira primeiro qual relatório você tem nas mãos. Uma nota de versão diz que as bibliografias são excluídas quando o relatório de escrita por IA é processado (envios já feitos só recebem essa mudança ao serem reenviados), e o Turnitin diz que os destaques de escrita por IA não aparecem no Similarity Report. Uma bibliografia destacada é quase sempre uma correspondência de similaridade, e entradas de referência que coincidem são o caso normal, já que um estilo de citação existe para fazer todo mundo formatar a mesma fonte do mesmo jeito.

Só usei um corretor gramatical. Isso é marcado? O FAQ da Turnitin diz que, em testes com documentos escritos por humanos, "in most cases" (na maioria dos casos), as mudanças feitas pelo Grammarly e outras ferramentas de revisão gramatical não foram sinalizadas pelo detector. Em seguida diz que isso exclui os recursos generativos do Grammarly — citando geração de rascunho, paráfrase e resumo — e que o conteúdo produzido com esses recursos "will likely be flagged as AI-generated by our detector" (provavelmente será sinalizado como gerado por IA pelo nosso detector). A linha que ele traça fica entre corrigir as suas frases e gerá-las.

Existe uma pontuação que eu deva buscar? Não existe limite publicado, e cada instituição define a própria prática. A orientação do Turnitin a educadores é que a pontuação está sendo usada como pretendido quando é tratada como um dado único, e não como uma resposta definitiva. Entramos em por que o popular índice de 20% não é uma regra em 20% de IA é alto demais?.

Fontes: as AI writing detection capabilities FAQs, o Using the AI Writing Report e as AI writing detection model release notes, da Turnitin. Citações conferidas nessas páginas em 14 de agosto de 2026. Publicado no blog de uma empresa que vende um humanizador de documentos, o que vale saber ao ler a seção sobre quanto custa a edição manual.

Continue lendo