Turnitin riesce a rilevare l’IA in elaborati che non sono in inglese?
La domanda sulla lingua in realtà sono tre domande che ricevono una sola risposta, e di solito a essere risolta per prima è quella sbagliata. C’è la lingua in cui è scritto il file. C’è ciò che il rilevatore supporta. E c’è cosa succede quando hai scritto in una lingua e consegnato in un’altra, che è esattamente la situazione in cui si trova la maggior parte di chi fa questa domanda.
Team HumanPen
· 6 min di lettura
La risposta breve
Quattro, alla data del 18 agosto 2026. Quel giorno Turnitin ha aggiunto il Modern Standard Arabic a inglese, spagnolo e giapponese, e la pagina dei requisiti dei file ne indica ancora tre: controlla quindi la data di tutto ciò che leggi in proposito, questo testo compreso. Un file in una lingua diversa da queste quattro esce da ciò che un AI Writing Report è documentato in grado di gestire. E la regola riguarda la lingua del file che consegni, quindi un elaborato scritto in portoghese e consegnato in inglese è una consegna in inglese.
L’elenco delle lingue supportate, testualmente
Dalla pagina Turnitin requisiti dei file per un AI Writing Report, nella versione del 21 agosto 2026:
"File must be written in a supported language: English, Spanish, Japanese" (Il file deve essere scritto in una lingua supportata: inglese, spagnolo, giapponese)
Subito accanto, nella stessa breve lista: «Accepted file types: .docx, .pdf, .txt, .rtf» (Tipi di file accettati: .docx, .pdf, .txt, .rtf). Quella riga è aggiornata. Quella sulle lingue è indietro di tre giorni.
L’arabo è diventato operativo il 18 agosto 2026 e la pagina dei requisiti non è stata più modificata da allora. La voce delle note di rilascio per quella data ha come titolo «New AI detection writing detection capabilities for Modern Standard Arabic submissions» (Nuove capacità di rilevamento della scrittura IA per gli elaborati in Modern Standard Arabic), e la pagina degli aggiornamenti di prodotto lo dice in una frase: «Arabic detection will run alongside our English, Spanish, and Japanese detectors» (Il rilevamento per l’arabo funzionerà insieme ai nostri rilevatori per inglese, spagnolo e giapponese). La lista di riferimento è quindi di quattro. Se arrivi alla pagina dei requisiti e ne conti tre, hai trovato una pagina che non si è aggiornata, non una contraddizione. Il tedesco, il cinese, il portoghese e il coreano non compaiono in nessuna delle due versioni.
I quattro rilevatori non sono identici tra loro
È la parte che finisce di rado nei riassunti. La pagina delle FAQ sul rilevamento della scrittura IA si apre con una limitazione: «The following content and FAQs pertain to our AI writing detection capabilities for English submissions only.» (I contenuti e le FAQ che seguono riguardano esclusivamente le nostre capacità di rilevamento della scrittura IA per gli elaborati in inglese.) Subito sotto quella riga ci sono tre link in uscita: uno a una FAQ in spagnolo, uno a una FAQ in giapponese e uno a una FAQ in arabo. La nota di rilascio spiega il perché con parole più semplici: «our Arabic AI writing model is a separate model from our English AI writing, Spanish AI writing, and Japanese AI writing models» (il nostro modello di scrittura IA per l’arabo è un modello separato dai nostri modelli di scrittura IA per inglese, spagnolo e giapponese).
E la capacità che cerca testi passati attraverso strumenti di parafrasi o di aggiramento esiste solo per l’inglese. La pagina di Turnitin sull’uso dell’AI Writing Report dice che «only our English AI detector includes AI paraphrasing and AI bypasser detection capabilities» (solo il nostro rilevatore IA per l’inglese include capacità di rilevamento della parafrasi IA e dell’aggiramento IA), e la frase subito dopo: «At this time our Spanish and Japanese AI detectors do not include AI paraphrasing or AI bypasser detection capabilities.» (Al momento i nostri rilevatori IA per spagnolo e giapponese non includono capacità di rilevamento della parafrasi IA o dell’aggiramento IA.) Quella pagina non è stata aggiornata per l’arabo e ne cita ancora solo due. Il rilevatore per l’arabo non passa attraverso la falla: la FAQ in arabo di Turnitin risponde alla domanda nella propria pagina, dicendo che il rilevamento della parafrasi IA è attualmente disponibile solo nel rilevatore per l’inglese. Quella pagina è in arabo; la formulazione inglese riportata qui è nostra.
Non leggerla come un’apertura. Leggila come un promemoria: il «rilevamento IA di Turnitin» non è un blocco uniforme, e tutto ciò che hai letto sul comportamento di questo rilevamento è stato scritto quasi certamente a proposito del rilevatore per l’inglese.
Tradurre in inglese significa consegnare in inglese
Il requisito riguarda il file. Se hai scritto la prima stesura nella tua lingua madre e il documento che carichi è in inglese, è il testo inglese a essere segmentato e valutato, indipendentemente da dove le idee siano state messe giù per la prima volta.
E questo solleva la domanda che le persone fanno davvero: la prosa tradotta automaticamente assomiglia all’output di un modello? Turnitin non ha pubblicato nulla che vi risponda in modo diretto, e nessuno fuori da Turnitin ha l’accesso necessario per rispondere come si deve. Quello che Turnitin ha pubblicato è l’elenco delle caratteristiche che ricorrono nei propri falsi positivi:
"Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas." (A volte i falsi positivi — cioè il segnalare come generato dall’IA un testo scritto da un essere umano — possono riguardare contenuti con poca variazione strutturale, testi che si ripetono letteralmente, o testi parafrasati senza sviluppare idee nuove.)
La prosa accademica tradotta può rientrare in tutte e tre, non perché chi scrive abbia fatto qualcosa di sbagliato, ma perché la traduzione tende a regolarizzare la forma delle frasi. Questo collegamento è una deduzione nostra, non un’affermazione di Turnitin.
La frase successiva, sempre di Turnitin, è quella da portare a un incontro con il relatore: "If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated." (Se il nostro indicatore mostra una quantità maggiore di scrittura IA in tale testo, ti consigliamo di tenerne conto quando guardi la percentuale indicata.) Il fornitore ha messo agli atti che chi legge questi report deve tenerne conto.
Ciò che Turnitin dice di aver fatto contro i pregiudizi
Nelle FAQ si dice che il campione di addestramento ha incluso deliberatamente "statistically under-represented groups like second-language learners, English users from non-English speaking countries, students at colleges and universities with diverse enrollments and less common subject areas such as anthropology, geology, sociology, and others to minimize bias when training our model" (gruppi statisticamente sottorappresentati, come chi impara l’inglese come seconda lingua, gli utenti di lingua inglese in Paesi non anglofoni, gli studenti di college e università con iscrizioni diversificate e aree disciplinari meno comuni come antropologia, geologia, sociologia e altre) per ridurre i pregiudizi durante l’addestramento del modello.
Questa è la versione dell’azienda sul proprio processo, e non è accompagnata da dati pubblicati sui pregiudizi. Prendila come un’intenzione dichiarata. La domanda distinta su chi venga effettivamente segnalato più spesso ha prove proprie, e le abbiamo esaminate in perché chi scrive in inglese senza averlo come lingua madre viene segnalato più spesso.
I documenti brevi si comportano peggio, in ogni lingua
Prima di dare per scontato che una riflessione di due pagine sia il caso a basso rischio:
"In shorter documents where there are only a few hundred words, the prediction will be mostly 'all or nothing' because we're predicting on a single segment without the opportunity to overlap." (Nei documenti più brevi, con solo poche centinaia di parole, la previsione sarà per lo più «tutto o niente», perché prevediamo su un singolo segmento, senza possibilità di sovrapposizione.)
La riga successiva: «This means that some text that is a mix of AI-generated and original content could be flagged as entirely AI-generated.» (Questo significa che un testo che mescola contenuti generati dall’IA e contenuti originali potrebbe essere segnalato come interamente generato dall’IA.) I testi brevi sono il punto in cui la scrittura molto tradotta e la valutazione tutto o niente si incontrano, e questa combinazione produce i report più difficili da contestare.
Domande frequenti
Il mio elaborato è in tedesco. Riceverà un punteggio IA? Il tedesco non è nell’elenco delle lingue supportate per un AI Writing Report. Se la configurazione del tuo ateneo faccia altro con il file è una domanda per l’ateneo, non è qualcosa che la documentazione di Turnitin copra.
L’ho scritto io, poi ho usato uno strumento di traduzione. È generato dall’IA? Sono due domande diverse e alla prima risponde solo il tuo ateneo. Le regole sulla dichiarazione coprono sempre più anche la traduzione, non solo la stesura: leggi quindi la politica reale invece di presumere che la traduzione sia esente.
Il rilevatore per lo spagnolo funziona come quello per l’inglese? Non in modo identico, e nemmeno quello per il giapponese o per l’arabo. Turnitin descrive tutti e quattro come modelli separati, il livello di parafrasi e aggiramento è documentato come disponibile solo per l’inglese, e la FAQ principale si limita agli elaborati in inglese e rimanda le altre tre lingue a pagine proprie.
La mia università usa Turnitin, ma non ho mai visto una percentuale IA. Non la vedresti. Turnitin dice che solo docenti e amministratori possono vedere l’indicatore, anche se i docenti possono scaricare il report in PDF e condividerlo. E il rilevamento IA richiede una licenza specifica, quindi alcuni atenei non ne hanno affatto.
Il modello cerca di capire quale strumento di IA sia stato usato? No. Classifica i segmenti in base alla probabilità che risultino umani o generati dall’IA (più informazioni su che cosa misura questo valore).
CONTINUA A LEGGERE