O Turnitin consegue detectar IA em trabalhos que não estão em inglês?

A questão do idioma na verdade são três perguntas respondidas como se fossem uma, e quase sempre a errada é respondida primeiro. Uma é em que idioma está o arquivo. Outra é o que o detector aceita. E outra é o que acontece quando você escreveu em um idioma e enviou em outro, que é justamente a situação da maioria de quem pergunta.

Equipe HumanPen

· 6 min de leitura

A resposta curta

Quatro, em 18 de agosto de 2026. Foi nesse dia que o Turnitin adicionou o Modern Standard Arabic ao inglês, ao espanhol e ao japonês, e a própria página de requisitos de arquivo ainda diz três; confira por isso a data de tudo o que você ler sobre isso, inclusive isto. Um arquivo em um idioma fora desses quatro está fora do que um AI Writing Report está documentado para tratar. E a regra diz respeito ao idioma do arquivo que você envia, de modo que um trabalho redigido em português e enviado em inglês é um envio em inglês.

A lista de idiomas suportados, na íntegra

Da página do Turnitin requisitos de arquivo para um AI Writing Report, na versão de 21 de agosto de 2026:

"File must be written in a supported language: English, Spanish, Japanese" (O arquivo deve estar escrito em um idioma suportado: inglês, espanhol, japonês)

Logo ao lado, na mesma lista curta: "Accepted file types: .docx, .pdf, .txt, .rtf" (Tipos de arquivo aceitos: .docx, .pdf, .txt, .rtf). Essa linha está atualizada. A linha dos idiomas está três dias atrasada.

O árabe entrou em funcionamento em 18 de agosto de 2026 e a página de requisitos não foi editada desde então. A entrada das notas de versão daquela data tem o título "New AI detection writing detection capabilities for Modern Standard Arabic submissions" (Novos recursos de detecção de escrita por IA para envios em Modern Standard Arabic), e a página de atualizações do produto resume isso numa frase: "Arabic detection will run alongside our English, Spanish, and Japanese detectors" (A detecção em árabe funcionará junto com nossos detectores de inglês, espanhol e japonês). Portanto, a lista vigente é de quatro. Se você abrir a página de requisitos e contar três, o que encontrou foi uma página que não se atualizou, não uma contradição. O alemão, o chinês, o português e o coreano não aparecem em nenhuma das duas versões.

Os quatro detectores não são idênticos entre si

Esta é a parte que quase nunca chega aos resumos. A página de perguntas frequentes sobre detecção de escrita por IA começa limitando o próprio alcance: "The following content and FAQs pertain to our AI writing detection capabilities for English submissions only." (O conteúdo e as perguntas frequentes a seguir referem-se apenas aos nossos recursos de detecção de escrita por IA para envios em inglês.) Logo abaixo dessa linha há três links de saída: um para uma FAQ em espanhol, um para uma FAQ em japonês e um para uma FAQ em árabe. A nota de versão explica o motivo com palavras mais simples: "our Arabic AI writing model is a separate model from our English AI writing, Spanish AI writing, and Japanese AI writing models" (nosso modelo de escrita com IA em árabe é um modelo separado de nossos modelos de escrita com IA em inglês, espanhol e japonês).

E o recurso que procura texto que passou por ferramentas de paráfrase ou de evasão existe apenas para o inglês. A página do Turnitin sobre o uso do AI Writing Report diz que "only our English AI detector includes AI paraphrasing and AI bypasser detection capabilities" (apenas nosso detector de IA para o inglês inclui recursos de detecção de paráfrase por IA e de evasão por IA), e a frase logo em seguida: "At this time our Spanish and Japanese AI detectors do not include AI paraphrasing or AI bypasser detection capabilities." (Neste momento, nossos detectores de IA para espanhol e japonês não incluem recursos de detecção de paráfrase por IA nem de evasão por IA.) Essa página não foi revisada para o árabe e continua citando apenas dois. O detector de árabe não escapa por essa brecha: a FAQ em árabe do Turnitin responde à pergunta na própria página e diz que a detecção de paráfrase por IA está disponível atualmente apenas no detector de inglês. Essa página está em árabe; a redação em inglês apresentada aqui é nossa.

Não leia isso como uma abertura. Leia como um lembrete de que "a detecção de IA do Turnitin" não é uma coisa única e uniforme, e de que tudo o que você leu sobre o comportamento dela foi escrito, quase com certeza, sobre o detector de inglês.

Traduzir para o inglês torna isso um envio em inglês

O requisito diz respeito ao arquivo. Se você fez o rascunho na sua primeira língua e o documento que envia está em inglês, é o texto em inglês que é segmentado e pontuado, independentemente de onde as ideias tenham sido escritas primeiro.

Isso levanta a pergunta que as pessoas realmente fazem: uma prosa traduzida por máquina parece a saída de um modelo? O Turnitin não publicou nada que responda a isso diretamente, e ninguém fora do Turnitin tem o acesso necessário para responder como se deve. O que o Turnitin publicou foi a lista de características que aparecem nos próprios falsos positivos:

"Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas." (Às vezes os falsos positivos — isto é, marcar como gerado por IA um texto escrito por um humano — podem incluir conteúdo com pouca variação estrutural, texto que se repete literalmente, ou texto que foi parafraseado sem desenvolver novas ideias.)

A prosa acadêmica traduzida pode se enquadrar nas três, não porque quem escreve tenha feito algo errado, mas porque a tradução tende a regularizar a forma das frases. Essa ligação é uma inferência nossa, não uma declaração do Turnitin.

A frase seguinte do próprio Turnitin é a que você deve levar para uma reunião com seu orientador: "If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated." (Se o nosso indicador mostrar uma quantidade maior de escrita por IA nesse texto, recomendamos que você leve isso em consideração ao observar a porcentagem indicada.) O fornecedor registrou formalmente que as pessoas que leem esses relatórios devem levar isso em conta.

O que o Turnitin diz ter feito quanto ao viés

Nas perguntas frequentes, a empresa diz que a amostra de treinamento incluiu deliberadamente "statistically under-represented groups like second-language learners, English users from non-English speaking countries, students at colleges and universities with diverse enrollments and less common subject areas such as anthropology, geology, sociology, and others to minimize bias when training our model" (grupos estatisticamente sub-representados, como aprendizes de inglês como segunda língua, usuários de inglês em países de língua não inglesa, estudantes de faculdades e universidades com matrículas diversas e áreas de estudo menos comuns como antropologia, geologia, sociologia e outras) para minimizar o viés no treinamento do modelo.

Essa é a versão da empresa sobre o próprio processo, e não vem acompanhada de números publicados sobre viés. Trate-a como uma intenção declarada. A pergunta separada sobre quem acaba sendo marcado com mais frequência tem evidências próprias, e nós as examinamos em por que quem escreve inglês sem ser falante nativo é marcado com mais frequência.

Documentos curtos se comportam pior, em qualquer idioma

Antes de presumir que uma reflexão de duas páginas é o caso de baixo risco:

"In shorter documents where there are only a few hundred words, the prediction will be mostly 'all or nothing' because we're predicting on a single segment without the opportunity to overlap." (Em documentos mais curtos, com apenas algumas centenas de palavras, a previsão será quase sempre «tudo ou nada», porque fazemos a previsão sobre um único segmento, sem oportunidade de sobreposição.)

A linha seguinte: "This means that some text that is a mix of AI-generated and original content could be flagged as entirely AI-generated." (Isso significa que algum texto que mistura conteúdo gerado por IA e conteúdo original pode ser marcado como inteiramente gerado por IA.) Textos curtos são o ponto em que a escrita com muita tradução e a pontuação tudo ou nada se encontram, e essa combinação produz os relatórios mais difíceis de contestar.

Perguntas frequentes

Meu trabalho está em alemão. Ele receberá uma pontuação de IA? O alemão não está na lista de idiomas suportados para um AI Writing Report. Se a configuração da sua instituição faz algo mais com o arquivo é uma pergunta para a instituição, não algo que a documentação do Turnitin cubra.

Eu mesmo escrevi e depois usei uma ferramenta de tradução. Isso é gerado por IA? São duas perguntas diferentes e a primeira só a sua instituição pode responder. As regras de divulgação cobrem cada vez mais a tradução, além da redação, portanto leia a política de fato em vez de presumir que a tradução está isenta.

O detector de espanhol funciona da mesma forma que o de inglês? Não de forma idêntica, e o mesmo vale para o de japonês e o de árabe. O Turnitin descreve os quatro como modelos separados, a camada de paráfrase e evasão está documentada como exclusiva do inglês, e a FAQ principal se limita a envios em inglês e encaminha os outros três idiomas para páginas próprias.

Minha universidade usa o Turnitin, mas nunca vi uma porcentagem de IA. Você não veria mesmo. O Turnitin diz que apenas instrutores e administradores podem ver o indicador, embora os instrutores possam baixar o relatório em PDF e compartilhá-lo. E a detecção de IA exige uma licença específica, de modo que algumas instituições não têm nenhuma.

O modelo tenta identificar qual ferramenta de IA foi usada? Não. Ele classifica os segmentos pela probabilidade de serem provavelmente humanos ou provavelmente gerados por IA (mais sobre o que é essa medição).

Continue lendo