O travessão é um sinal de IA?

A observação por trás desse conselho é boa. A conclusão tirada dela, não — e a solução que as pessoas adotam é um localizar e substituir global num texto que elas não tinham nenhum outro motivo para mexer.

Equipe HumanPen

· 12 min de leitura

A resposta curta

Nada do que conseguimos encontrar na documentação do próprio fornecedor sustenta essa ideia, e a próxima seção mostra exatamente onde procuramos. Buscamos três das páginas de ajuda da Turnitin em 18 de agosto de 2026 — o guia do AI Writing Report, as perguntas frequentes sobre detecção de escrita por IA e a página de requisitos de arquivo. Nas três, a string "dash" aparece exatamente uma vez, dentro da palavra "dashboard". A palavra "punctuation" aparece exatamente uma vez, numa resposta que explica que o detector "is not tuned to target Grammarly-generated spelling, grammar, and punctuation modifications to content" (não é ajustado para atingir alterações de ortografia, gramática e pontuação geradas pelo Grammarly no conteúdo). E a página que responde à pergunta "what parameters or flags does Turnitin's model take into account when detecting AI writing?" (quais parâmetros ou sinalizadores o modelo da Turnitin leva em conta ao detectar escrita por IA?) responde inteiramente em termos de sequências de palavras. Ou seja, o conselho mais repetido com tanta certeza sobre um sinal de pontuação não se apoia em nada que a empresa que construiu o detector diga a respeito.

Isso não é a mesma coisa que provar que um travessão não pode influenciar nada. Um modelo que aprende padrões estatísticos não tem nenhuma obrigação de publicar o que aprendeu, e nada do material público descarta a possibilidade de um travessão contribuir com alguma coisa. O que falta é a outra metade: nada do que encontramos justifica dar peso a isso tampouco. Enquanto isso, a solução que as pessoas adotam — trocar todos os travessões, em todo lugar — é uma alteração em quase todos os parágrafos de um documento, feita com um único comando, sem ninguém ler o resultado.

Duas afirmações diferentes vestidas na mesma frase

"Travessão é sinal de IA" é dito como se fosse uma coisa só. São duas, e nada as liga:

  • Texto gerado contém muitos travessões. Uma afirmação sobre o que sai dos modelos de linguagem. Qualquer pessoa pode ir lá e conferir.
  • Um travessão aumenta a pontuação de escrita por IA. Uma afirmação sobre o que um classificador específico pondera. Ninguém de fora do fornecedor pode examinar isso.

A primeira pode ser inteiramente verdadeira enquanto a segunda é falsa, porque uma característica ser comum numa população não diz nada sobre como um detector treinado nas duas populações a usa. Escritores humanos que usam muito o travessão são exatamente a população sobre a qual a segunda afirmação erraria, e nada na primeira afirmação diz o que acontece com eles.

Não somos os primeiros a dizer a versão geral disso. A nossa própria página sobre o que os detectores de IA medem sustenta que uma passagem não recebe pontuação alta por causa de um hábito visível. O que vem aqui é mais estreito: fomos verificar se esse hábito específico aparece em algum ponto da documentação do próprio fornecedor, porque uma afirmação tão difundida deveria ter algum documento por trás dela em algum lugar.

O que fomos procurar e o que havia lá

Três páginas, acessadas em 18 de agosto de 2026, lidas como texto renderizado da página e pesquisadas sem distinguir maiúsculas de minúsculas: "Using the AI Writing Report", "Turnitin's AI writing detection capabilities FAQs" (perguntas frequentes sobre os recursos de detecção de escrita por IA da Turnitin) e "File requirements for an AI Writing Report" (requisitos de arquivo para um AI Writing Report). São as páginas que estabelecem o mecanismo e as regras de arquivo; notas de versão e páginas de problemas conhecidos não fizeram parte desta busca. Os números são de ocorrências, não de linhas.

Termo de buscaUso do AI Writing ReportFAQs sobre detecção de IARequisitos de arquivo
dash01, dentro de "dashboard"0
em dash000
hyphen000
punctuation010
character000
comma000
"300 words" (controle)111

A última linha está ali porque uma busca que não encontra nada e uma busca que nunca chegou à página parecem idênticas vistas de fora. Uma frase que sabemos estar nas três páginas, retornando uma ocorrência em cada uma, é o que faz os zeros acima significarem alguma coisa.

Isso deixa uma ocorrência real. Aqui está a resposta inteira em que ela aparece, sobre a questão de saber se a verificação gramatical do Grammarly é sinalizada:

"No. Our detector is not tuned to target Grammarly-generated spelling, grammar, and punctuation modifications to content but rather, other AI content written by LLMs such as GPT-3.5. Based on tests we conducted on human-written documents with no AI-generated content in them, in most cases, changes made by Grammarly (free & premium) and/or other grammar-checking tools were not flagged as AI-written by our detector. Please note that this excludes content generated by Grammarly's generative AI-powered features, including draft generation, paraphrasing, summarizing, and other features. Content produced using these features will likely be flagged as AI-generated by our detector." (Não. O nosso detector não é ajustado para atingir alterações de ortografia, gramática e pontuação geradas pelo Grammarly no conteúdo, mas sim outro conteúdo de IA escrito por LLMs como o GPT-3.5. Com base em testes que realizamos com documentos escritos por humanos sem nenhum conteúdo gerado por IA, na maioria dos casos as alterações feitas pelo Grammarly nas versões gratuita e premium e/ou por outras ferramentas de verificação gramatical não foram sinalizadas como escritas por IA pelo nosso detector. Observe que isso exclui o conteúdo gerado pelos recursos de IA generativa do Grammarly, incluindo geração de rascunhos, paráfrase, resumo e outros recursos. É provável que o conteúdo produzido com esses recursos seja sinalizado como gerado por IA pelo nosso detector.)

Leia-a pelo que ela é. É sobre as edições de um corretor gramatical, não sobre os seus travessões; diz "in most cases" (na maioria dos casos) em vez de dizer nunca; e as duas últimas frases puxam forte na direção oposta para tudo o que o Grammarly gera em vez de corrigir. A fronteira entre texto corrigido e texto gerado é um assunto à parte, e nós a mapeamos em o Turnitin detecta o Grammarly. O que ela serve aqui é só isto: no único lugar, entre aquelas três páginas, em que pontuação e detecção aparecem na mesma frase, a frase aponta para longe do ajuste no nível da pontuação, e não para perto dele.

Depois há a pergunta que teria respondido à nossa diretamente, se a resposta fosse nessa direção. Sob o título "What parameters or flags does Turnitin's model take into account when detecting AI writing?" (quais parâmetros ou sinalizadores o modelo da Turnitin leva em conta ao detectar escrita por IA?), a parte substantiva diz:

"Our classifiers are trained to detect these differences in word probability and are adept at the particular word probability sequences of human writers." (Os nossos classificadores são treinados para detectar essas diferenças na probabilidade das palavras e são proficientes nas sequências particulares de probabilidade de palavras dos escritores humanos.)

Probabilidade de palavras. Sequências de palavras. É esse o nível em que o fornecedor descreve os seus próprios classificadores trabalhando, na resposta que dá quando a sua própria FAQ pergunta sem rodeios o que o modelo leva em conta.

Nada do que foi publicado menciona uma unidade menor que a palavra

Acompanhe o vocabulário pela descrição publicada de como uma pontuação é produzida e ele para antes de chegar a um caractere:

"When a paper is submitted to Turnitin, sentences from the submission are extracted and segmented into overlapping sections for prediction analysis. Each segment is classified by the AI detection model and given a value between 0 and 1 … Each qualifying sentence within these segments inherits the segment's score." (Quando um trabalho é enviado ao Turnitin, as frases do envio são extraídas e segmentadas em seções sobrepostas para análise de predição. Cada segmento é classificado pelo modelo de detecção de IA e recebe um valor entre 0 e 1 … Cada frase elegível dentro desses segmentos herda a pontuação do segmento.)

Segmentos. Frases. Texto elegível, que a mesma FAQ define como blocos escritos na forma de frases gramaticais padrão. Sequências de probabilidade de palavras. Toda unidade mencionada nessa cadeia é uma palavra ou maior, e a menor coisa que chega a receber um número próprio é um trecho de várias frases, do qual uma frase então toma emprestado.

Um travessão fica dentro desse trecho. Tire-o e o segmento ainda contém as mesmas palavras na mesma ordem — isso é exatamente o que uma troca de pontuação não altera, e a ordem das palavras é o que o fornecedor nomeou. Se o tokenizador se importa com isso é uma pergunta separada, que ninguém de fora da Turnitin pode responder, e não vamos fingir que sabemos. Mas o conselho costuma ser dado como se o mecanismo fosse compreendido, e o mecanismo como publicado não tem lugar para ele.

O que um travessão muda de forma comprovável

Uma consequência mensurável de apagar um travessão, que você mesmo pode verificar nos próximos trinta segundos, e que não tem nada a ver com detecção. O Microsoft Word trata um travessão ou um meio-travessão como limite de palavra e um hífen como não sendo um, então "cost—benefit" conta como duas palavras e "well-known" conta como uma. Substitua quarenta travessões sem espaço por hífens e a sua contagem de palavras cai quarenta.

Para a maioria dos documentos isso é uma curiosidade. Para um trabalho perto de um limite rígido, não é — e os próprios requisitos de arquivo da Turnitin estabelecem um teto para o que será processado afinal, e é por isso que dedicamos uma seção a travessões e contadores de palavras em o Turnitin consegue verificar uma tese inteira. Repare na forma disso: o efeito que conseguimos demonstrar de fato passa por um contador de palavras, não por um classificador.

O que apagá-los custa

Um travessão está fazendo um trabalho na frase. O que você colocar no lugar dele faz um trabalho diferente, e a escolha não é cosmética:

  • Uma vírgula torna a quebra mais fraca. Onde o travessão sustentava uma interrupção de verdade, a vírgula ou a perde ou produz uma vírgula indevida entre duas orações.
  • Um ponto e vírgula eleva o registro e exige que o que vem depois se sustente sozinho como uma oração. Muitas vezes não se sustenta.
  • Parênteses rebaixam o conteúdo a um comentário à parte. Isso muda o que você está afirmando sobre a importância dele, o que numa seção de discussão é um argumento, não uma decisão de formatação.
  • Um ponto final divide um pensamento em dois. Às vezes é uma melhora. Às vezes corta a ligação que era justamente o ponto da frase.
  • Nada mesmo funciona com mais frequência do que as pessoas esperam, e é a única opção desta lista que não introduz uma nova decisão.

Agora multiplique pelo número de travessões que o documento tiver. O localizar e substituir toma cada uma dessas decisões do mesmo jeito, numa única ação, num texto que você não tinha outro motivo para abrir. Essa é a maior edição que a maioria das pessoas fará num manuscrito pronto, e é a que é feita com a menor atenção.

E se existe um manual de estilo que rege o seu documento, a regra sobre travessões que vale para você é a daquele manual, não a de uma discussão na internet. Descobrir quais dos seus travessões são em e quais são en é, pelo menos, uma pergunta que tem resposta.

A versão da afirmação que sobrevive

Tire a teoria sobre classificadores e alguma coisa continua de pé, mas aponta para uma pessoa, e não para uma pontuação.

Muitos leitores acreditam nessa regra. Se o seu orientador for um deles, os seus travessões custam alguma coisa real — uma impressão, formada na primeira página, antes de qualquer detector entrar na história. Esse risco não depende de nenhuma explicação sobre como o software funciona, e é exatamente por isso que é a metade mais sólida da afirmação. Achamos que é a metade que vale levar a sério, e oferecemos isso como a nossa leitura, não como algo publicado.

Mas repare que um localizar e substituir é uma resposta ruim para isso. Quem forma uma impressão da sua escrita está reagindo a uma página, não contando caracteres, e o mesmo parágrafo que soou feito por máquina vai soar do mesmo jeito com vírgulas no lugar. O que move um leitor é a escrita ser reconhecidamente sua e você conseguir falar sobre ela — esse é o argumento para guardar rascunhos, e mostramos como essa evidência é realmente usada em histórico de versões como evidência.

A impressão que um leitor forma do seu estilo e um resultado de detecção de IA são tipos diferentes de informação. A Turnitin diz que os estudantes não conseguem ver diretamente o indicador nem o relatório de escrita por IA; um instrutor precisa baixá-lo e compartilhá-lo. Consiga o relatório, olhe os destaques de verdade e use seus rascunhos e seus registros de escrita para explicar o seu processo, em vez de adivinhar o resultado pelos sinais de pontuação.

Fazendo isso numa escala que você consegue ler

Seja o que você decidir sobre travessões, o princípio útil é aquele que uma substituição global viola: mude o texto numa escala em que ainda dá para ler o que mudou. Toda alteração não revisada é um lugar onde um documento pode dar errado em silêncio.

Essa restrição, e não qualquer visão sobre pontuação, foi o que moldou A ferramenta HumanPen. Basta entregar o arquivo mais um relatório de IA da Turnitin ou do iThenticate, e as passagens marcadas se tornam o escopo; tudo o que está fora delas mantém a redação que você escreveu. A nossa própria página enuncia a regra de granularidade de forma clara: "a paragraph is the smallest unit a rewrite can touch, so a selection is expanded to full paragraphs before it is counted." (um parágrafo é a menor unidade que uma reescrita pode tocar, então uma seleção é expandida para parágrafos inteiros antes de ser contada.) Um parágrafo está vários níveis acima do assunto deste artigo.

Duas coisas decorrem disso, e vale enunciá-las como limites, não como recursos. A cobrança conta as palavras efetivamente reescritas, então um trabalho com escopo definido custa o que o escopo custa, e não o que o arquivo pesa. Passagens elegíveis podem ser reprocessadas sem custo.

O que não podemos fazer é lhe dar um número. A posição da própria Turnitin sobre o seu modelo é que previsões individuais "may not always be explainable in simple feature-by-feature terms" (podem nem sempre ser explicáveis em termos simples, característica por característica), e ela não publicou nada que mapeie uma edição para um movimento na pontuação, então uma ferramenta que lhe cotasse uma porcentagem resultante estaria cotando alguma coisa que não tem. Fica pior abaixo da linha, porque pontuações entre 1% e 19% aparecem como um asterisco, sem porcentagem e sem destaques, o que significa que uma melhora real dentro dessa faixa é invisível para todos, inclusive você. Se você quer as razões pelas quais duas ferramentas reportam números diferentes no mesmo parágrafo, isso está em por que os detectores discordam; se você está com um relatório na mão agora, comece por como ler um AI Writing Report da Turnitin.

Perguntas frequentes

Apagar todos os travessões vai baixar a minha pontuação de IA? Ninguém pode lhe dizer, e quem afirma que sim com certeza ou que não com certeza está indo além do que foi publicado. O que podemos relatar é que as três páginas de ajuda da Turnitin que pesquisamos não mencionam travessões em nenhum momento, e que o único lugar em que pontuação aparece nelas é uma resposta dizendo que o detector não é ajustado para atingir modificações de pontuação.

Modelos de IA usam mesmo mais travessões do que as pessoas? É bem possível, e essa é uma afirmação que você mesmo pode ir testar em texto gerado. É uma afirmação diferente de "um detector lhes dá peso", e não implica essa última.

Existe algum efeito mensurável de removê-los? Um, que você mesmo pode conferir, e não tem a ver com detecção. O Word conta um travessão como limite de palavra e um hífen como não sendo um, então trocar travessões sem espaço por hífens reduz a sua contagem de palavras em uma a cada troca.

O meu orientador disse que os meus travessões parecem coisa do ChatGPT. O que eu faço? Tome isso como a impressão de um leitor, e não como um resultado de detector, porque é isso que é. Uma impressão se responde com rascunhos, anotações e com você conseguir percorrer o seu próprio argumento, não com um localizar e substituir que eles não vão notar.

Devo escrever de forma diferente para evitar esse problema inteiro? Escrever deliberadamente abaixo do seu próprio nível tem um certo custo em notas e um benefício não medido contra uma pontuação que você geralmente não tem permissão para ver. A lista publicada pelo próprio fornecedor do que os seus falsos positivos parecem — texto com pouca variação estrutural, texto que se repete literalmente — não é uma lista de pontuação, e percorremos as edições manuais que ela realmente sustenta em como humanizar texto de IA sem uma ferramenta.

Continue lendo