Reescrevi um texto de IA com outra IA e o Turnitin sinalizou mesmo assim
Uma segunda passagem de IA é um fluxo de trabalho que o Turnitin descreve na própria documentação e contra o qual publicou notas de versão datadas. Aqui está sobre o que a pontuação é de fato calculada, o que as cores do relatório podem e não podem dizer agora que o Turnitin fundiu duas categorias numa só, e a única comparação que você pode fazer com os seus dois arquivos.
Equipe HumanPen
· 14 min de leitura
A resposta curta
Estão acontecendo duas coisas distintas, e elas costumam ser tratadas como se fossem uma só. Primeiro: a porcentagem não é calculada sobre as palavras que mudaram. O Turnitin extrai frases, agrupa essas frases em segmentos sobrepostos, atribui a cada segmento uma pontuação entre 0 e 1, e cada frase elegível herda, de forma agrupada, as pontuações dos segmentos em que aparece. Uma reescrita que devolve as mesmas frases, na mesma ordem e com as mesmas quebras de parágrafo, devolve o mesmo agrupamento. Segundo: esse fluxo exato é algo que o Turnitin descreve na própria documentação e contra o qual vem publicando atualizações desde dezembro de 2023.
Qual das duas está agindo no seu caso não dá para ler na porcentagem. A categoria do relatório costumava ser uma resposta parcial, e em 4 de agosto de 2026 o Turnitin fundiu as duas categorias em uma só, então num relatório recém-gerado ela já não é nem isso. O que sobra é uma comparação que você pode fazer nos seus dois arquivos, sem detector nenhum. As duas estão abaixo.
Este artigo parte do princípio de que o texto começou como produção de IA e você passou um paraphraser por cima. Se você escreveu tudo sozinho e mesmo assim foi sinalizado, a situação e a resposta são outras, e isso está em sinalizado, mas foi você mesmo que escreveu.
A que a pontuação está ligada, e o que a sua reescrita mexeu
O FAQ de capacidades do Turnitin descreve o processo em um parágrafo:
"When a paper is submitted to Turnitin, sentences from the submission are extracted and segmented into overlapping sections for prediction analysis. Each segment is classified by the AI detection model and given a value between 0 and 1, denoting the probability of the text being likely human or AI-generated. Each qualifying sentence within these segments inherits the segment's score. Since segments overlap, some sentences may have multiple scores, which are then pooled into a single score. These sentence scores are further aggregated and used to compute the overall document AI writing score." (quando um trabalho é enviado ao Turnitin, as frases do envio são extraídas e divididas em seções sobrepostas para análise de previsão; cada segmento é classificado pelo modelo de detecção de IA e recebe um valor entre 0 e 1, que indica a probabilidade de o texto ser humano ou gerado por IA; cada frase elegível dentro desses segmentos herda a pontuação do segmento; como os segmentos se sobrepõem, algumas frases têm mais de uma pontuação, que é então reunida numa pontuação única; essas pontuações por frase são agregadas e usadas para calcular a pontuação geral de escrita por IA do documento.)
A unidade que carrega a pontuação é o segmento, e um segmento é um conjunto de frases. Isso é uma afirmação sobre escopo, não um veredito sobre qualquer operação de edição específica. A substituição dentro de uma frase é uma entre várias operações que uma reescrita pode fazer; o que ela provoca na pontuação de um segmento depende de quanto do segmento se move junto, e o Turnitin não publicou nem a forma de reunir as pontuações nem a de agregá-las, então não existe quantidade publicada a partir da qual raciocinar. Essa lacuna não é do tipo que um fornecedor consiga fechar de fora, o nosso incluído.
O que dá para dizer sem adivinhar é mais estreito, e ainda assim útil. Se o arquivo reescrito tem a mesma contagem de frases, a mesma ordem de frases e as mesmas quebras de parágrafo, então as frases que dividiam um segmento antes continuam dividindo um agora. Juntar duas frases, dividir uma, cortar uma oração redundante ou mover uma afirmação para outro parágrafo muda quais frases ficam juntas. Essa distinção está visível nos seus dois arquivos, o que é mais do que se pode dizer da maior parte do que se afirma sobre esses relatórios.
As propriedades que o Turnitin realmente nomeou em público estão nesse mesmo nível. No mesmo FAQ, a empresa diz que os falsos positivos "can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas" (podem incluir conteúdo com pouca variação estrutural, texto que se repete literalmente ou texto que foi parafraseado sem desenvolver ideias novas). Esse terceiro item é uma descrição do que uma passagem de paraphraser produz, escrita pelo próprio fornecedor, numa lista de texto que acaba sinalizado. A frase logo em seguida aponta na outra direção e também cabe aqui: "If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated." (se o nosso indicador mostrar uma quantidade maior de escrita por IA nesse tipo de texto, recomendamos levar isso em conta ao observar a porcentagem indicada.) As edições manuais que decorrem de tudo isso estão em como humanizar texto de IA sem ferramenta.
O fluxo tem nome na documentação, e tem datas
A segunda coisa não tem a ver com o seu arquivo. Tem a ver com aquilo para que o detector foi construído. O FAQ do Turnitin diz isso diretamente:
"Furthermore, it can also identify instances where AI-generated text may have been modified by AI paraphraser or bypasser (also called humanizers) tools to evade detection." (além disso, também é possível identificar casos em que texto gerado por IA pode ter sido modificado por ferramentas de paraphraser ou de evasão, também chamadas de humanizers, para escapar da detecção.)
Os parênteses são do Turnitin, não nossos. Três notas de versão dão uma linha do tempo a essa capacidade, e a mais recente mudou o que o relatório mostra sem mudar o que o modelo procura.
| Nota de versão | O que ela diz | O que significa para uma segunda passagem |
|---|---|---|
| 6 de dezembro de 2023 | "AI word spinners are sometimes used to avoid identification of AI-generated text. We now detect likely AI-generated text even if it may have been paraphrased using an AI word spinner." (os word spinners de IA às vezes são usados para evitar a identificação de texto gerado por IA; agora detectamos texto provavelmente gerado por IA mesmo que ele possa ter sido parafraseado com um word spinner de IA.) | A etapa de paráfrase está dentro do escopo declarado do modelo há mais de dois anos. A mesma nota acrescenta que envios já existentes precisam ser reenviados para que a mudança se aplique a eles. |
| 27 de agosto de 2025 | "With this release, the 'AI-generated only' category in the AI writing report will now include the percentage of AI-generated text that may have been modified by an AI bypasser tool." (com esta versão, a categoria 'AI-generated only', ou "apenas gerado por IA", no relatório de escrita por IA passará a incluir a porcentagem de texto gerado por IA que pode ter sido modificada por uma ferramenta de evasão.) | A partir dessa data, um destaque `AI-generated only` não descarta uma classificação de evasão. Nunca houve uma terceira cor separada para isso. |
| 4 de agosto de 2026 | "We've updated the AI Writing Report to combine the previous two categories blue and purple into a single blue category" (atualizamos o AI Writing Report para combinar as duas categorias anteriores, azul e roxa, numa única categoria azul), e "purple highlights previously used for AI-paraphrased text will no longer be shown" (os destaques roxos usados antes para texto parafraseado por IA deixarão de ser exibidos). A mesma nota acrescenta que o modelo "will continue to detect likely AI generated content that may have been further modified by AI paraphrasers or bypassers" (continuará detectando conteúdo provavelmente gerado por IA que possa ter sido modificado depois por paraphrasers ou evasores de IA). | O relatório deixou de separar as duas coisas. A detecção não parou. O Turnitin diz que o novo relatório vale para arquivos enviados depois daquela data, e que um envio mais antigo precisa passar de novo pelo sistema antes de o relatório ser refeito, então um relatório que você já tem em mãos ainda pode mostrar roxo. |
O Turnitin também diz que não vai publicar contra quais ferramentas treinou o modelo: "Our AI writing detector has been trained and tested to detect leading paraphraser and bypasser tools. However, to safeguard the integrity of our solution and its effectiveness in maintaining academic honesty, we're unable to disclose the names of these tools." (o nosso detector de escrita por IA foi treinado e testado para detectar as principais ferramentas de paraphraser e de evasão; no entanto, para proteger a integridade da nossa solução e a eficácia dela na manutenção da honestidade acadêmica, não podemos divulgar os nomes dessas ferramentas.) É por isso que ninguém consegue dar uma resposta verificável sobre qual paraphraser passa, incluindo quem vende um. A lista não existe em público, e o modelo muda.
Um limite para tudo isso, nas palavras do próprio fornecedor. Uma capacidade documentada é uma descrição do que um modelo foi treinado para fazer, não uma prova de que uma passagem específica passou por aquele fluxo. A orientação do próprio Turnitin diz que o modelo "may not always be accurate (it may misidentify human-written, AI-generated, and AI-paraphrased text), so it should not be used as the sole basis for adverse actions against a student" (pode não ser sempre preciso, pois pode classificar mal texto escrito por humanos, gerado por IA e parafraseado por IA, e por isso não deve ser usado como única base para medidas adversas contra um estudante), e que determinar má conduta "takes further scrutiny and human judgment in conjunction with an organization's application of its specific academic policies" (exige mais exame e julgamento humano, em conjunto com a aplicação das políticas acadêmicas específicas da instituição).
O idioma também importa aqui: um artigo de ajuda do Turnitin afirma que "only our English AI detector includes AI paraphrasing and AI bypasser detection capabilities" (apenas o nosso detector de IA em inglês inclui recursos de detecção de paráfrase por IA e de evasão por IA), e acrescenta que os detectores em espanhol e em japonês não incluem.
O que a cor do relatório diz, agora que só existe uma
Até 4 de agosto de 2026, o AI Writing Report padrão tinha duas categorias visíveis. `AI-generated only` era uma delas e, desde a atualização de agosto de 2025, também podia conter texto que o modelo considera possivelmente modificado por um evasor. A outra era `AI-generated text that was AI-paraphrased`, mostrada em roxo: uma inferência adicional aplicada a texto já considerado provavelmente gerado por IA. Em 4 de agosto de 2026, o Turnitin incorporou a segunda à primeira e disse que os destaques roxos deixariam de ser exibidos.
Então o quanto a cor vale depende de qual relatório você tem em mãos. Num gerado antes daquela data, o roxo diz que o modelo chegou a uma classificação de paráfrase além da de IA, enquanto a outra categoria, depois de agosto de 2025, não diz nada em nenhum dos sentidos sobre uma etapa de paráfrase. Num gerado depois, existe uma única categoria e nenhuma resposta nesse nível. O que não mudou foi a detecção: a mesma nota de versão diz que o modelo continuará detectando conteúdo gerado por IA que possa ter sido modificado por paraphrasers ou evasores. Nenhum dos dois estados nomeia uma ferramenta, uma conta, um aparelho ou um prompt, e as duas categorias antigas merecem ser lidas com cuidado antes de você construir uma história em cima de um relatório antigo: nós as desmontamos em o que os rótulos AI-paraphrased e AI-bypasser do Turnitin realmente significam.
Há uma segunda razão para não ler demais numa mudança de categoria entre os seus dois relatórios. Essas mudanças não são aplicadas retroativamente: o Turnitin diz que a de agosto de 2026 vale apenas para o que você enviar depois, e que o que já está no sistema mantém o relatório que tem até você enviar de novo. Dois relatórios gerados em lados opostos de uma atualização não estão medindo a mesma coisa, e uma categoria pode mudar sem que o seu texto seja a causa. Se você tem dois relatórios e está tentando entender o que a sua revisão fez, a comparação tem mais peças móveis do que parece, e comparar dois relatórios em vez de duas pontuações é a versão longa desse argumento.
A comparação que você pode fazer sem detector
Você quase certamente não consegue medir o efeito da reescrita, por duas razões documentadas que se somam. O Turnitin não mostra número nem destaques para pontuações acima de 0% e abaixo de 20%, só um asterisco, então uma queda real de 19% para 3% e nenhuma mudança têm exatamente a mesma cara. E na maioria das configurações o indicador não está disponível para você: o Turnitin diz que o relatório não fica visível para estudantes, embora instrutores possam baixar o PDF e compartilhar.
O que você pode fazer é abrir lado a lado os arquivos antes e depois da paráfrase e responder a quatro perguntas. Nenhuma delas precisa do detector, e as quatro levam cerca de cinco minutos num capítulo.
| O que comparar | Como verificar | O que isso diz |
|---|---|---|
| Contagem de frases por parágrafo | Conte a pontuação final em três ou quatro parágrafos sinalizados, nos dois arquivos | Se as contagens batem, as frases que dividiam um segmento antes continuam dividindo um agora |
| Quebras de parágrafo e ordem das afirmações | Leia os dois com zoom de 50%, olhando o formato em vez das palavras | Juntar, dividir e reordenar muda quais frases ficam juntas. Substituições dentro de uma frase deixam esse arranjo como estava |
| Trechos que o primeiro relatório nunca destacou | Marque-os no relatório e depois verifique se a reescrita mexeu neles mesmo assim | Uma reescrita sem relatório à frente trata do mesmo jeito a prosa sinalizada e a não sinalizada. Tudo o que ela tocou é texto que você agora precisa reler |
| Material citado, números e citações no texto | Busque aspas e, em seguida, cada citação | Um paraphraser não tem como saber qual frase é uma citação direta de uma fonte que você é obrigado a reproduzir exatamente |
Uma armadilha específica desse fluxo: se você testou o paraphraser num trecho curto, o resultado disse muito pouco. O Turnitin afirma que, em documentos de apenas algumas centenas de palavras, "the prediction will be mostly 'all or nothing' because we're predicting on a single segment without the opportunity to overlap" (a previsão será basicamente 'all or nothing', ou seja, tudo ou nada, porque a previsão é feita sobre um único segmento, sem chance de sobreposição), e que, por isso, texto que mistura conteúdo gerado por IA e conteúdo original pode ser apontado como inteiramente gerado por IA.
A quarta linha é a que custa nota às pessoas, e não pontos percentuais. Também é a que ninguém confere, porque o arquivo voltou parecendo pronto.
O que a reescrita cega fez com o resto do documento
Um paraphraser rodado sobre o arquivo inteiro não tem relatório e, portanto, não tem escopo. Ele reescreve a introdução com a qual você estava satisfeito, o parágrafo de métodos em que passou uma semana e a frase que contém o número que o seu orientador questionou. Nada disso estava sinalizado. Tudo isso agora é prosa que você não leu na forma atual.
É um trabalho de revisão do tamanho do documento, e ele cai justamente no momento do ciclo de submissão em que há menos tempo para isso. O que quebra é específico, tedioso e consequente: uma citação direta sutilmente reescrita, um hedge removido e uma afirmação passando a dizer mais do que os seus dados sustentam, um termo técnico trocado por um quase sinônimo no meio do texto, e o mesmo conceito passa a ter dois nomes, um número arredondado. Listas de referências, tabelas e equações têm modos de falha próprios, que listamos em o que acontece com citações, tabelas e equações.
A alternativa não é "não fazer nada". É fazer o relatório definir o escopo, para que os parágrafos que você revalida sejam os parágrafos sobre os quais algo foi realmente dito. É isso que reescrever apenas os parágrafos que um relatório sinalizou significa na prática, e a maior parte da dificuldade está em casar um destaque que começa no meio de uma oração com um parágrafo no seu arquivo original.
O que fazer com o relatório que você já tem
Você tem algo mais útil do que uma porcentagem: um conjunto de trechos marcados. Parta deles.
- Guarde todos os arquivos, em ordem. O rascunho original, a versão parafraseada e os dois relatórios. Essa sequência é a única coisa aqui que responde a "como isto foi escrito", e continua respondendo seja qual for o número.
- Não rode uma segunda reescrita cega sobre tudo. Ela dobra o trabalho de revalidação e acaba com a sua capacidade de dizer qual mudança fez o quê, já que você terá duas rodadas de edição misturadas numa prosa que já não reconhece.
- Releia as quatro linhas da tabela acima antes de qualquer coisa. Citações e referências primeiro. Isso é critério de avaliação, não saída de detector.
- Defina o escopo pelo relatório, não pela pontuação. Um trecho que ninguém destacou é um trecho sem evidência ligada a ele.
- Verifique a regra da sua instituição antes de reescrever qualquer coisa. Não existe limiar publicado, e o que conta como assistência aceitável é definido localmente, não pelo fornecedor. Por que os 20% tão citados não são essa regra está em 20% de IA é alto demais.
Nós construímos uma ferramenta para o quarto item. A ferramenta HumanPen recebe o AI Writing Report em PDF, cruza os trechos destacados com o documento que você enviou e mostra o escopo antes de qualquer coisa rodar. O parágrafo é a menor unidade que ela reescreve, então um destaque que cobre metade de um parágrafo é ampliado para o parágrafo inteiro e mostrado assim, para você confirmar. A cobrança é pelas palavras que ela de fato reescreve, então um trabalho restrito a quatro parágrafos custa como quatro parágrafos.
O que ela não faz é dar uma pontuação prevista, porque esse número não está disponível para ninguém fora do Turnitin. O que podemos dizer é que passagens elegíveis podem ser reprocessadas sem custo.
Perguntas frequentes
Uma terceira passagem de paráfrase ajudaria? Não existe quantidade publicada que permita a alguém responder isso, e cada passagem acrescenta uma rodada de edição a uma prosa que você depois precisa revalidar. A própria lista de falsos positivos do fornecedor nomeia "text that has been paraphrased without developing new ideas" (texto que foi parafraseado sem desenvolver ideias novas) como uma propriedade de texto que acaba sinalizado, e vale ler isso antes de acrescentar uma terceira rodada exatamente disso.
Tem roxo no meu relatório. Isso prova que usei uma ferramenta de paráfrase? Não, e confira primeiro a data do relatório. Roxo era uma classificação a que o modelo chegava a partir da prosa final, não um registro de como o documento foi produzido, e o Turnitin diz que o modelo pode classificar mal texto escrito por humanos, gerado por IA e parafraseado por IA, e que a pontuação não deve ser a única base para uma medida contra um estudante. Desde 4 de agosto de 2026 essa categoria não é exibida separadamente, então roxo na página significa que você está olhando um relatório gerado antes disso, ou um envio que não foi reenviado desde então.
Parafraseei um trecho de 300 palavras para testar e o trecho inteiro voltou sinalizado. Por quê? O Turnitin diz que, em documentos de apenas algumas centenas de palavras, a previsão é basicamente tudo ou nada, porque existe um único segmento e nenhuma chance de sobreposição, e que, por isso, conteúdo misto pode ser apontado como inteiramente gerado por IA. Um trecho curto está perto de ser a pior bancada de teste possível.
Algo disso vale para a minha submissão em espanhol ou japonês? A parte da paráfrase, não. Um artigo de ajuda do Turnitin afirma que apenas o detector em inglês inclui recursos de detecção de paráfrase por IA e de evasão por IA, e que os detectores em espanhol e em japonês não incluem.
Posso simplesmente verificar a pontuação entre as passagens? Em geral, não. Qualquer coisa acima de 0% e abaixo de 20% aparece como um asterisco, sem número e sem destaques, e na maioria das configurações o indicador e o relatório ficam visíveis para instrutores e administradores, não para você. Essa é a principal razão pela qual essa área inteira funciona à base de afirmações em vez de medições, e também é o motivo de detectores diferentes darem respostas diferentes, o que abordamos em por que o mesmo texto tem pontuações diferentes em cada detector.
Fontes: as FAQs de capacidades de detecção de escrita por IA, Como usar o AI Writing Report e as notas de versão do modelo de detecção de escrita por IA do Turnitin. Citações conferidas nessas páginas em 14 de agosto de 2026, e a entrada de 4 de agosto de 2026 nas notas de versão do Turnitin conferida em 18 de agosto de 2026. Isto é publicado no blog de uma empresa que vende uma ferramenta de reescrita de documentos, o que vale saber enquanto se lê a seção sobre o custo de uma reescrita cega.
Continue lendo
Se eu reescrever uma frase marcada, a nota cai proporcionalmente a essa frase?
9 min de leitura
Escrita acadêmicaUma ferramenta de reescrita por IA se enquadra nas regras de edição de terceiros da sua universidade?
14 min de leitura
Detectores de IAVocê deveria mudar sua forma de escrever para evitar ser sinalizado?
11 min de leitura