Turnitin은 영어가 아닌 제출물에서도 AI를 탐지할 수 있습니까?
언어에 대한 질문은 사실 세 가지로 나뉘지만, 마치 하나인 것처럼 답해집니다. 그리고 대개 먼저 답을 얻는 것은 엉뚱한 질문입니다. 하나는 파일이 어떤 언어로 되어 있는지입니다. 다른 하나는 탐지기가 무엇을 지원하는지입니다. 그리고 또 하나는 어떤 언어로 쓰고 다른 언어로 제출했을 때 무슨 일이 일어나는지인데, 사실 이 질문을 하는 분들의 대부분은 바로 그 상황에 있습니다.
HumanPen 팀
· 6분
짧은 답
2026년 8월 18일 기준으로 네 개입니다. 바로 그날 Turnitin이 Modern Standard Arabic를 영어, 스페인어, 일본어에 추가했지만, 자사의 파일 요건 페이지에는 여전히 세 개라고 적혀 있습니다. 그러니 이 문제에 관해 읽는 모든 것, 이 글을 포함해서, 반드시 날짜를 확인하십시오. 이 네 가지 외의 언어로 된 파일은 AI Writing Report가 처리한다고 문서화된 범위 밖에 있습니다. 그리고 이 규칙은 여러분이 제출하는 파일의 언어에 관한 것이므로, 포르투갈어로 초안을 쓰고 영어로 제출한 논문은 영어 제출물입니다.
지원 언어 목록, 있는 그대로
2026년 8월 21일 기준 Turnitin의 AI Writing Report 파일 요건 페이지에서 인용합니다:
"File must be written in a supported language: English, Spanish, Japanese" (파일은 지원되는 언어로 작성되어야 합니다: 영어, 스페인어, 일본어)
같은 짧은 목록의 바로 옆에는 이렇게 적혀 있습니다. "Accepted file types: .docx, .pdf, .txt, .rtf" (허용되는 파일 형식: .docx, .pdf, .txt, .rtf). 이 문장은 현재 유효합니다. 반면 언어에 관한 문장은 사흘 뒤처져 있습니다.
아랍어는 2026년 8월 18일에 적용되기 시작했지만 요건 페이지는 그 뒤로 한 번도 수정되지 않았습니다. 그 날짜의 릴리스 노트 항목 제목은 "New AI detection writing detection capabilities for Modern Standard Arabic submissions" (Modern Standard Arabic 제출물에 대한 새로운 AI 작성 탐지 기능)이고, 제품 업데이트 페이지는 이를 한 문장으로 이렇게 정리합니다. "Arabic detection will run alongside our English, Spanish, and Japanese detectors" (아랍어 탐지는 영어, 스페인어, 일본어 탐지기와 함께 실행됩니다). 따라서 실제 목록은 네 개입니다. 요건 페이지를 열어 세 개만 세었다면, 그것은 모순을 발견한 것이 아니라 아직 따라오지 못한 페이지를 발견한 것입니다. 독일어, 중국어, 포르투갈어, 한국어는 두 판 어디에도 없습니다.
네 개의 탐지기는 서로 동일하지 않습니다
이 부분은 요약글에는 거의 등장하지 않습니다. AI 작성 탐지를 다루는 FAQ 페이지는 먼저 자기 적용 범위를 한정하는 말로 시작합니다. "The following content and FAQs pertain to our AI writing detection capabilities for English submissions only." (다음 내용과 FAQ는 영어 제출물에 대한 AI 작성 탐지 기능에만 적용됩니다.) 그 문장 바로 아래에는 외부 링크 세 개가 놓여 있습니다. 스페인어 FAQ, 일본어 FAQ, 아랍어 FAQ입니다. 릴리스 노트는 그 이유를 더 쉬운 말로 이렇게 밝힙니다. "our Arabic AI writing model is a separate model from our English AI writing, Spanish AI writing, and Japanese AI writing models" (당사의 아랍어 AI 작성 모델은 영어, 스페인어, 일본어 AI 작성 모델과는 별개의 모델입니다).
또한 패러프레이징 도구나 우회 도구를 거친 텍스트를 찾는 기능은 영어에만 있습니다. Turnitin의 AI Writing Report 사용법 페이지는 "only our English AI detector includes AI paraphrasing and AI bypasser detection capabilities" (AI 패러프레이징 및 AI 우회 탐지 기능을 갖춘 것은 영어 AI 탐지기뿐입니다)라고 밝히고, 바로 다음 문장에서 이렇게 덧붙입니다. "At this time our Spanish and Japanese AI detectors do not include AI paraphrasing or AI bypasser detection capabilities." (현재 스페인어와 일본어 AI 탐지기에는 AI 패러프레이징이나 AI 우회 탐지 기능이 포함되어 있지 않습니다.) 이 페이지는 아랍어에 맞춰 개정되지 않아 여전히 둘만 언급합니다. 그렇다고 아랍어 탐지기가 그 공백을 빠져나가는 것은 아닙니다. Turnitin의 아랍어 FAQ는 자체 페이지에서 이 질문에 답하며, AI 패러프레이징 탐지는 현재 영어 탐지기에서만 제공된다고 밝힙니다. 그 페이지는 아랍어로 되어 있으며, 여기에 옮긴 영어 표현은 저희가 작성한 것입니다.
이를 여지가 생긴 것으로 읽지 마십시오. "Turnitin의 AI 탐지"가 하나의 균일한 대상이 아니라는 사실을 일깨워 주는 것으로 읽으십시오. 그리고 그 작동 방식에 대해 여러분이 지금까지 읽은 내용은 거의 확실히 영어 탐지기에 관해 쓰인 것입니다.
영어로 번역하면 그것은 영어 제출물이 됩니다
이 요건은 파일에 관한 것입니다. 여러분이 모국어로 초안을 쓰고 업로드하는 문서가 영어라면, 분할되어 점수를 받는 것은 영어 텍스트입니다. 그 아이디어가 처음 어느 언어로 적혔는지는 중요하지 않습니다.
그러면 사람들이 실제로 던지는 질문이 떠오릅니다. 기계 번역된 문장이 모델의 출력처럼 보일까 하는 것입니다. Turnitin은 이에 직접 답하는 내용을 공개한 적이 없고, Turnitin 외부에는 제대로 답하는 데 필요한 접근 권한을 가진 사람도 없습니다. Turnitin이 공개한 것은 자사 오탐지에 나타나는 특성들의 목록입니다:
"Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas." (때때로 오탐지, 즉 사람이 쓴 텍스트를 AI가 생성한 것으로 잘못 표시하는 경우에는 구조적 변화가 거의 없는 내용, 문자 그대로 반복되는 문장, 또는 새로운 생각을 전개하지 않은 채 바꾸어 쓴 문장이 포함될 수 있습니다.)
번역된 학술 문장은 이 세 가지 모두에 해당할 수 있습니다. 이는 글쓴이가 잘못한 것이 있어서가 아니라, 번역이 문장 형태를 규칙적으로 만드는 경향이 있기 때문입니다. 다만 이 연결은 저희의 추론이며, Turnitin이 밝힌 내용은 아닙니다.
Turnitin이 직접 남긴 다음 문장은 지도교수와의 면담에 가져가야 할 문장입니다. "If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated." (해당 텍스트에서 AI 작성 비중이 더 높게 나타난다면, 표시된 비율을 보실 때 그 점을 고려하시기를 권합니다.) 이 업체는 이러한 보고서를 읽는 사람들이 그 점을 반영해야 한다고 공식적으로 밝혔습니다.
편향과 관련해 Turnitin이 했다고 밝힌 것
해당 FAQ는 모델 학습 시 편향을 줄이기 위해 학습 표본에 의도적으로 "statistically under-represented groups like second-language learners, English users from non-English speaking countries, students at colleges and universities with diverse enrollments and less common subject areas such as anthropology, geology, sociology, and others to minimize bias when training our model" (두 번째 언어로 영어를 배우는 학습자, 비영어권 국가의 영어 사용자, 다양한 학생 구성의 대학에 다니는 학생, 그리고 인류학·지질학·사회학처럼 흔하지 않은 전공 분야 등 통계적으로 과소 대표되는 집단과 그 밖의 집단)을 포함했다고 밝힙니다.
이것은 기업이 자사 절차를 스스로 설명한 것이며, 편향 수치는 공개된 것이 없습니다. 선언된 의도로 받아들이십시오. 실제로 누가 더 자주 표시되는지라는 별개의 질문에는 그에 관한 근거가 따로 있으며, 저희는 영어를 모국어로 하지 않는 필자가 더 자주 표시되는 이유에서 이를 살펴보았습니다.
짧은 문서는 어떤 언어에서든 결과가 더 나쁩니다
두 쪽짜리 성찰문이 위험이 낮은 사례라고 단정하기 전에, 다음을 확인하십시오:
"In shorter documents where there are only a few hundred words, the prediction will be mostly 'all or nothing' because we're predicting on a single segment without the opportunity to overlap." (단어가 몇백 개뿐인 짧은 문서에서는 겹칠 기회 없이 단일 세그먼트에 대해 예측하기 때문에, 예측 결과는 대체로 'all or nothing', 즉 전부 아니면 전무가 됩니다.)
그다음 문장입니다. "This means that some text that is a mix of AI-generated and original content could be flagged as entirely AI-generated." (이는 AI가 생성한 내용과 직접 쓴 내용이 섞인 텍스트도 전부 AI가 생성한 것으로 표시될 수 있음을 의미합니다.) 짧은 글은 번역 의존도가 높은 문장과 전부 아니면 전무 방식의 채점이 만나는 지점이며, 이 조합이 가장 반박하기 어려운 보고서를 만들어 냅니다.
자주 묻는 질문
제 논문은 독일어로 되어 있습니다. AI 점수가 매겨질까요? 독일어는 AI Writing Report의 지원 언어 목록에 없습니다. 여러분의 기관 설정이 그 파일로 다른 무엇을 하는지는 기관에 물어볼 문제이며, Turnitin 문서가 다루는 바가 아닙니다.
제가 직접 쓰고 나서 번역 도구를 사용했습니다. 이것도 AI 생성인가요? 그것은 서로 다른 두 질문이며, 첫 번째 질문에는 여러분의 기관만 답할 수 있습니다. 공개 규정은 점차 글쓰기뿐 아니라 번역도 포괄하는 추세이므로, 번역이 예외라고 단정하지 말고 실제 정책을 읽어 보십시오.
스페인어 탐지기는 영어 탐지기와 같은 방식으로 작동합니까? 동일하게 작동하지 않으며, 일본어 탐지기와 아랍어 탐지기도 마찬가지입니다. Turnitin은 네 개를 모두 별개의 모델로 설명하고, 패러프레이징 및 우회 계층은 영어 전용으로 문서화되어 있습니다. 또한 주 FAQ는 영어 제출물로 범위를 한정하고 나머지 세 언어를 각자의 페이지로 안내합니다.
저희 대학은 Turnitin을 사용하지만 AI 비율을 본 적이 없습니다. 보지 못하는 것이 당연합니다. Turnitin에 따르면 이 지표는 교수자와 관리자만 볼 수 있으며, 교수자는 보고서를 PDF로 내려받아 공유할 수 있습니다. 또한 AI 탐지에는 별도의 라이선스가 필요하므로 아예 도입하지 않은 기관도 있습니다.
모델은 어떤 AI 도구가 사용되었는지 알아내려 합니까? 아닙니다. 모델은 각 세그먼트를 사람이 썼을 가능성과 AI가 생성했을 가능성에 따라 분류할 뿐입니다(이 측정값이 무엇인지에 대해서는 여기를 보십시오).
계속 읽기