Kann Turnitin KI in Einreichungen erkennen, die nicht auf Englisch sind?
Die Frage nach der Sprache zerfällt eigentlich in drei, die meist wie eine beantwortet werden — und zuerst beantwortet wird die falsche. Da ist die Frage, in welcher Sprache die Datei vorliegt. Da ist die Frage, was der Detektor unterstützt. Und da ist die Frage, was passiert, wenn Sie in einer Sprache geschrieben und in einer anderen eingereicht haben — und genau darin stecken die meisten, die das fragen.
HumanPen-Team
· 6 Min. Lesezeit
Die kurze Antwort
Vier, Stand 18. August 2026. An diesem Tag hat Turnitin Modern Standard Arabic zu Englisch, Spanisch und Japanisch hinzugefügt, und auf der eigenen Seite zu den Dateianforderungen stehen weiterhin drei — prüfen Sie also das Datum von allem, was Sie dazu lesen, auch von diesem Text. Eine Datei in einer Sprache außerhalb dieser vier liegt außerhalb dessen, wofür ein AI Writing Report dokumentiert ist. Und die Regel betrifft die Sprache der Datei, die Sie einreichen: Ein Paper, das auf Portugiesisch entworfen und auf Englisch eingereicht wurde, ist eine englische Einreichung.
Die Liste der unterstützten Sprachen, im Wortlaut
Aus Turnitins Seite Dateianforderungen für einen AI Writing Report in der Fassung vom 21. August 2026:
"File must be written in a supported language: English, Spanish, Japanese" (Die Datei muss in einer unterstützten Sprache verfasst sein: Englisch, Spanisch, Japanisch)
Direkt daneben, auf derselben kurzen Liste: "Accepted file types: .docx, .pdf, .txt, .rtf" (Akzeptierte Dateitypen: .docx, .pdf, .txt, .rtf). Diese Zeile ist aktuell. Die Zeile zu den Sprachen hinkt drei Tage hinterher.
Arabisch ging am 18. August 2026 live, und die Seite mit den Anforderungen wurde seitdem nicht mehr bearbeitet. Der Eintrag in den Versionshinweisen zu diesem Datum trägt die Überschrift "New AI detection writing detection capabilities for Modern Standard Arabic submissions" (Neue Funktionen zur Erkennung von KI-Text für Einreichungen auf Modern Standard Arabic), und die Seite mit den Produktneuheiten fasst es in einem Satz zusammen: "Arabic detection will run alongside our English, Spanish, and Japanese detectors" (Die Erkennung für Arabisch läuft parallel zu unseren Detektoren für Englisch, Spanisch und Japanisch). Die Arbeitsliste umfasst also vier. Wenn Sie auf die Anforderungsseite klicken und dort drei zählen, haben Sie eine Seite gefunden, die nicht nachgezogen hat — keinen Widerspruch. Deutsch, Chinesisch, Portugiesisch und Koreanisch stehen auf keiner der beiden Versionen.
Die vier Detektoren sind nicht deckungsgleich
Genau dieser Teil landet selten in den Zusammenfassungen. Die FAQ-Seite zur Erkennung von KI-Texten beginnt mit einer Einschränkung: "The following content and FAQs pertain to our AI writing detection capabilities for English submissions only." (Die folgenden Inhalte und FAQs betreffen ausschließlich unsere Funktionen zur Erkennung von KI-Texten für englische Einreichungen.) Direkt unter dieser Zeile stehen drei weiterführende Links: einer zu einer spanischen FAQ, einer zu einer japanischen FAQ und einer zu einer arabischen FAQ. Die Notiz in den Versionshinweisen sagt mit einfacheren Worten, warum: "our Arabic AI writing model is a separate model from our English AI writing, Spanish AI writing, and Japanese AI writing models" (unser arabisches KI-Textmodell ist ein eigenes Modell, getrennt von unseren Modellen für englische, spanische und japanische KI-Texte).
Und die Funktion, die nach Text sucht, der durch Umformulierungs- oder Umgehungswerkzeuge gelaufen ist, gibt es nur für Englisch. Turnitins Seite zum Umgang mit dem AI Writing Report sagt: "only our English AI detector includes AI paraphrasing and AI bypasser detection capabilities" (nur unser englischer KI-Detektor umfasst Funktionen zur Erkennung von KI-Umformulierung und KI-Umgehung), und der Satz direkt danach: "At this time our Spanish and Japanese AI detectors do not include AI paraphrasing or AI bypasser detection capabilities." (Zum jetzigen Zeitpunkt umfassen unsere spanischen und japanischen KI-Detektoren keine Funktionen zur Erkennung von KI-Umformulierung oder KI-Umgehung.) Diese Seite wurde nicht für Arabisch überarbeitet und nennt weiterhin nur zwei. Der arabische Detektor fällt nicht durch die Lücke: Turnitins FAQ auf Arabisch beantwortet die Frage auf der eigenen Seite und sagt, dass die Erkennung von KI-Umformulierung derzeit nur im englischen Detektor verfügbar ist. Diese Seite ist auf Arabisch; die englische Formulierung hier stammt von uns.
Lesen Sie das nicht als Einladung. Lesen Sie es als Erinnerung daran, dass „die KI-Erkennung von Turnitin" keine einheitliche Sache ist — und dass alles, was Sie über ihr Verhalten gelesen haben, mit an Sicherheit grenzender Wahrscheinlichkeit über den englischen Detektor geschrieben wurde.
Wer ins Englische übersetzt, reicht auf Englisch ein
Es geht um die Datei. Haben Sie in Ihrer ersten Sprache entworfen und laden ein Dokument auf Englisch hoch, dann ist es der englische Text, der segmentiert und bewertet wird — unabhängig davon, wo die Gedanken zuerst niedergeschrieben wurden.
Damit steht die Frage im Raum, die Menschen eigentlich stellen: Sieht maschinell übersetzte Prosa nach Modellausgabe aus? Turnitin hat nichts veröffentlicht, das das direkt beantwortet, und außerhalb von Turnitin hat niemand den Zugang, den es bräuchte, um es sauber zu beantworten. Veröffentlicht hat Turnitin die Liste der Eigenschaften, die in den eigenen Fehlalarmen auftauchen:
"Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas." (Manchmal können falsch positive Ergebnisse — also von Menschen geschriebener Text, der fälschlich als KI-generiert markiert wird — Inhalte ohne große strukturelle Abwechslung umfassen, Text, der sich wörtlich wiederholt, oder Text, der umformuliert wurde, ohne neue Ideen zu entwickeln.)
Übersetzte wissenschaftliche Prosa kann auf alle drei zutreffen — nicht, weil die schreibende Person etwas falsch gemacht hätte, sondern weil Übersetzung den Satzbau zu vereinheitlichen pflegt. Dieser Zusammenhang ist unsere Schlussfolgerung, nicht eine Aussage von Turnitin.
Der nächste Satz von Turnitin selbst ist der, den Sie in ein Gespräch mit einer Betreuungsperson mitnehmen sollten: "If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated." (Wenn unser Indikator bei einem solchen Text einen höheren Anteil an KI-Text anzeigt, empfehlen wir Ihnen, das bei der Betrachtung des angegebenen Prozentsatzes zu berücksichtigen.) Der Anbieter hat öffentlich festgehalten, dass die Menschen, die diese Berichte lesen, das einbeziehen sollen.
Was Turnitin eigenen Angaben zufolge gegen Verzerrungen getan hat
In der FAQ heißt es, in die Trainingsstichprobe seien absichtlich Gruppen einbezogen worden, die "statistically under-represented groups like second-language learners, English users from non-English speaking countries, students at colleges and universities with diverse enrollments and less common subject areas such as anthropology, geology, sociology, and others to minimize bias when training our model" (statistisch unterrepräsentierte Gruppen wie Menschen, die Englisch als Zweitsprache lernen, englischsprachige Nutzer aus Ländern ohne Englisch als Amtssprache, Studierende an Colleges und Universitäten mit vielfältiger Studierendenschaft sowie weniger verbreitete Fachrichtungen wie Anthropologie, Geologie, Soziologie und andere) umfassen, um Verzerrungen beim Training des Modells zu verringern.
Das ist die Darstellung des Unternehmens zum eigenen Vorgehen, und dazu gibt es keine veröffentlichten Zahlen. Behandeln Sie es als erklärte Absicht. Die Frage, wer tatsächlich häufiger markiert wird, ist eine eigene Frage mit eigener Beleglage — wir haben sie in warum Menschen, die Englisch nicht als Muttersprache haben, häufiger markiert werden durchgegangen.
Kurze Dokumente verhalten sich schlechter, in jeder Sprache
Bevor Sie annehmen, eine zweiseitige Reflexion sei der Fall mit dem geringen Risiko:
"In shorter documents where there are only a few hundred words, the prediction will be mostly 'all or nothing' because we're predicting on a single segment without the opportunity to overlap." (Bei kürzeren Dokumenten mit nur wenigen hundert Wörtern ist die Vorhersage meist „alles oder nichts", weil wir auf einem einzigen Segment vorhersagen, ohne die Möglichkeit zur Überlappung.)
Die Zeile danach: "This means that some text that is a mix of AI-generated and original content could be flagged as entirely AI-generated." (Das bedeutet, dass mancher Text, der eine Mischung aus KI-generierten und eigenen Inhalten ist, als vollständig KI-generiert markiert werden könnte.) Kurze Stücke sind der Punkt, an dem übersetzungsgeprägtes Schreiben und Alles-oder-Nichts-Bewertung zusammentreffen — und diese Kombination erzeugt die Berichte, mit denen sich am schwersten argumentieren lässt.
Häufig gestellte Fragen
Meine Arbeit ist auf Deutsch. Bekommt sie einen KI-Wert? Deutsch steht nicht auf der Liste der unterstützten Sprachen für einen AI Writing Report. Ob die Konfiguration Ihrer Einrichtung sonst noch etwas mit der Datei macht, ist eine Frage an die Einrichtung und nichts, wozu die Dokumentation von Turnitin etwas sagt.
Ich habe selbst geschrieben und dann ein Übersetzungswerkzeug benutzt. Ist das KI-generiert? Das sind zwei verschiedene Fragen, und die erste beantwortet nur Ihre Einrichtung. Offenlegungsregeln decken zunehmend auch die Übersetzung ab, nicht nur das Verfassen — lesen Sie also die tatsächliche Richtlinie, statt anzunehmen, Übersetzung sei ausgenommen.
Funktioniert der spanische Detektor genauso wie der englische? Nicht identisch — und der japanische und der arabische auch nicht. Turnitin beschreibt alle vier als eigenständige Modelle, die Ebene für Umformulierung und Umgehung ist als nur für Englisch verfügbar dokumentiert, und die Haupt-FAQ beschränkt sich auf englische Einreichungen und verweist die anderen drei Sprachen auf eigene Seiten.
Meine Universität nutzt Turnitin, aber ich habe noch nie einen KI-Prozentsatz gesehen. Das würden Sie auch nicht. Turnitin sagt, dass nur Lehrende und Administrationspersonal den Indikator sehen können, wobei Lehrende den Bericht als PDF herunterladen und weitergeben können. Und für die KI-Erkennung ist eine bestimmte Lizenz nötig, manche Einrichtungen haben gar keine.
Versucht das Modell herauszufinden, welches KI-Werkzeug benutzt wurde? Nein. Es ordnet Segmente nach der Wahrscheinlichkeit ein, mit der sie eher von Menschen oder eher von KI stammen (mehr darüber, was diese Messgröße ist).
WEITERLESEN