Turnitin은 학위논문 전체를 검사할 수 있을까요?
Turnitin의 두 페이지에는 AI 작성 보고서에 적용되는 단어 상한이 나와 있습니다. 학위논문은 대개 그 위에 있습니다. 이 사실은 점수가 무엇을 뜻하는지, 빈 지시자가 무엇을 뜻하는지, 그리고 지도교수님이 실제로 어떤 파일을 보셨는지를 바꿔 놓습니다.
HumanPen 팀
· 7분
짧은 답
Turnitin은 30,000단어를 넘는 제출물이나 산문이 300단어에 못 미치는 제출물에 대해서는 AI 작성 보고서를 생성하지 않습니다. 같은 제한이 자사 도움말 페이지 두 곳에 나와 있습니다. 이 범위를 벗어나면 백분율이 없고, 지시자에는 회색 이중 대시가 표시됩니다. 이는 제출물을 처리할 수 없었다는 뜻이지, 깨끗하게 통과했다는 뜻이 아닙니다.
학위논문 전체라면 보통 상한을 훌쩍 넘습니다. 그러니 "내 논문 AI 점수"를 두고 고민하고 계시다면, 먼저 물어보실 것은 어떤 파일이 그 점수를 만들었는지입니다.
그렇게 말하는 두 페이지
첫 번째는 AI Writing Report의 파일 요건이라는 짧은 페이지입니다. 페이지 전체가 약 700자에 불과합니다. 첫 문장은 "In order for a submission to generate an AI writing report and percentage, the submission needs to meet the following requirements" (제출물이 AI 작성 보고서와 백분율을 생성하려면 다음 요건을 충족해야 합니다)이고, 그다음에 요건들이 나열됩니다. 긴 문서가 점수를 받을 수 있는지 자체를 결정하는 것은 그중 세 가지입니다.
- 파일 크기는 100MB 미만이어야 합니다
- 파일에는 장문 형식의 산문 텍스트가 최소 300단어 포함되어 있어야 합니다
- 파일은 30,000단어를 초과할 수 없습니다
나머지 목록은 지원되는 언어와 허용되는 파일 형식을 다룹니다.
두 번째 페이지는 AI 작성 탐지 기능 FAQ로, 보고서 지시자의 의미를 설명하는 부분에서 같은 요건을 반복합니다. 숫자도 같고 순서도 같습니다.
공급업체 자체 사이트에 두 번 있다는 것은 생각보다 중요합니다. Turnitin의 제한에 대해 돌아다니는 이야기 대부분은 한 블로그가 다른 블로그를 베낀 것이기 때문입니다.
회색 이중 대시는 합격이 아닙니다
FAQ에는 지시자가 보여줄 수 있는 것들이 나와 있습니다. 0에서 100 사이의 숫자가 붙은 파란색 지시자는 제출물이 처리되었다는 뜻입니다. 별표는 AI가 1%에서 19% 범위에서 탐지되었다는 뜻이며, Turnitin은 오탐을 피하려고 숫자와 강조 표시 없이 이를 보여줍니다. 그리고 이렇게 이어집니다.
"Gray with no percentage displayed (- -): The AI writing detection indicator is unable to process this submission." (백분율이 표시되지 않는 회색 (- -): AI 작성 탐지 지시자가 이 제출물을 처리할 수 없습니다.)
페이지에는 이유도 나와 있습니다. 하나는 제출이 AI 작성 탐지 기능 출시 이전에 이루어진 경우로, 다시 제출하는 것 외에는 해결되지 않습니다. 다른 하나는 파일이 위의 요건을 충족하지 못하는 경우입니다.
느낌표로 표시되는 별도의 오류 상태는 Turnitin이 제출물을 처리하지 못했다는 뜻이며, 다시 시도하거나 지원팀에 문의하라고 안내합니다.
따라서 60,000단어짜리 학위논문에 회색 대시가 나오는 것은 예상된 결과이며, 여러분의 글에 대해서는 아무것도 말해 주지 않습니다. 어떤 결론을 내리기 전에 세 가지 상태 중 무엇을 보고 계신지 아는 것이 중요합니다. 특히 여러분에게 전달된 것이 스크린샷뿐이라면 더욱 그렇습니다.
즉, 학위논문은 장별로 점수가 매겨집니다
실제로 긴 작업은 나누어 제출됩니다. 지도교수님께는 한 장, 진행 심사에는 한 절, 최종 파일은 저장소로. 각각은 별개의 예측이며, 여기서부터 산수는 직관대로 되지 않습니다.
Turnitin은 그 작동 방식을 이렇게 설명합니다. 제출물을 겹치는 세그먼트로 자르고, 각 세그먼트에 0에서 1 사이의 점수를 매기고, 자격이 되는 각 문장이 자신을 포함한 세그먼트의 점수를 물려받게 한 뒤, 그것들을 모아 집계해 문서의 숫자로 만든다는 것입니다. 장 점수는 논문 점수의 조각이 아닙니다. 논문 점수라는 것이 존재하지 않기 때문입니다. 그것들은 서로 다른 분량의 텍스트에 대한 별개의 실행입니다.
범위의 아래쪽 끝은 또 다르게 작동합니다. Turnitin은 단어가 몇 백 개뿐인 문서에서는 세그먼트가 하나뿐이고 평균을 낼 겹침 구간이 없기 때문에 예측이 대체로 "all or nothing" (전부 아니면 전무)이라고 말하며, 이는 짧은 문서에서 섞인 내용이 전부 AI가 생성한 것으로 플래그될 수 있다는 뜻이라고 합니다. 400단어 분량의 서론을 단독으로 제출하면 바로 그 영역에 들어갑니다. 초록만 단독으로 제출하면 300단어 산문 하한선에 아예 미치지 못합니다.
반대쪽 끝에서 FAQ는 긴 문서에 대해 솔직합니다. 진짜 글과 AI가 생성한 글이 섞인 더 긴 문서에서는 어디서 하나가 끝나고 다른 하나가 시작되는지 정확히 판별하기 어려울 수 있다고 말하며, 그 결과물을 학생과 대화를 시작하기 위한 안내라고 설명합니다.
그 백분율은 논문 전체의 백분율이 아닙니다
범위 안에서도 그 숫자가 다루는 것은 생각보다 적습니다. Turnitin이 분석하는 것은 자격 텍스트라고 부르는 것으로, 표준적인 문법적 문장으로 쓰인 덩어리, 즉 산문 문장이라고 정의합니다. 목록과 불릿, 그 밖에 문장이 아닌 구조는 여기 들어오지 않습니다. 또한 그 백분율이 반드시 전체 제출물의 백분율인 것은 아니며, 장문 산문으로 간주되지 않는 텍스트는 포함되지 않는다고 FAQ는 분명히 밝힙니다.
장문 산문에 대한 정의는 형식을 직접 지목합니다. 더 긴 저작물을 이루는 단락에 담긴 개별 문장, 예를 들어 에세이, 학위논문, 논문 기사 등입니다.
이제 연구 방법 장을 떠올려 보십시오. 번호가 붙은 절차 단계, 매개변수 표, 수식, 코드, 그림 캡션. 그것 중 문장으로 이루어진 단락은 아주 적습니다. 백분율의 분모는 여러분 글에서 논의 형태를 띤 부분으로만 줄어듭니다. 그런데 점수도 바로 거기서 나옵니다. Turnitin AI 작성 보고서 읽는 법은 그 숫자와 강조 표시 사이의 간격을 짚어 줍니다.
그 30,000단어는 누구의 집계일까요?
Turnitin은 어떤 카운터를 쓰는지 공개하지 않습니다. 그리고 이는 사소한 트집이 아닙니다. 같은 파일을 세는 두 도구가 흔히 서로 다른 값을 내기 때문입니다.
늘 문제가 되는 것은 대시입니다. Word는 두 단어 사이의 대시를 어떤 형식에서는 단어 경계로 보고 어떤 형식에서는 그렇지 않게 봅니다. 이는 UT 오스틴의 법률 작문 블로그에서 페이지 범위를 예로 들어 깔끔하게 보여 줍니다. 저희도 대시가 많은 문서에서 자체 카운터가 Word와 어긋나는 것을 본 적이 있습니다.
여유는 작습니다. 그것이 중요한 곳은 한 곳뿐이고, 그곳이 바로 여기입니다. Word가 29,800이라고 하고 반대쪽에서 세는 쪽이 그보다 조금 더 큰 값을 말한다면, 보고서가 나오느냐 회색 대시가 나오느냐는 대시 몇 개로 갈립니다. 상한 근처라면 나중에 알게 되는 것보다 파일을 나누시는 편이 낫습니다.
이것을 어떻게 쓰실 것인가
- 어떤 점수든 해석하기 전에 어떤 파일이 제출되었는지 물어보십시오. 한 장, 합본 학위논문, 포털이 만든 PDF, 부록을 뗀 버전은 네 가지 서로 다른 제출물입니다.
- 회색 대시는 "처리되지 않음"으로 다루십시오. 깨끗한 결과라고 위에 보고하지 마십시오.
- 장 백분율을 더하거나 평균내지 마십시오. 서로 다른 분모에 대한 별개의 예측입니다.
- 짧은 절은 거칠게 나온다고 예상하십시오. 이유는 짧은 텍스트에 대한 Turnitin 자체의 전부 아니면 전무 채점 설명이고, 여러분의 글이 아닙니다.
- 공급업체가 그 숫자의 용도라고 말하는 것을 기억하십시오. Turnitin은 자사 페이지 여러 곳에서 모델이 틀릴 수 있으며 학생에게 불리한 조치의 유일한 근거가 되어서는 안 된다고 밝히고, 다른 곳에서는 점수를 확정적 답변이 아니라 하나의 데이터 포인트라고 부릅니다. 그것은 지도교수님과의 면담에 가져가기에 무리가 없는 문장입니다.
이미 그 대화 중이고 직접 쓰신 글이라면, 플래그가 붙었지만 직접 쓴 글에서 어떤 증거를 모을 가치가 있는지 다룹니다.
결국 한 장을 다시 쓰게 되신다면
장 분량에서 비싸지는 것은 두 가지입니다. 나중에 다시 읽으셔야 하는 분량과, 다시 쓰기 위해 지불하신 비용입니다. 둘 다 같은 설정, 즉 파일의 어디까지가 범위에 들어갔는지로 결정됩니다. 플래그가 붙은 단락 세 개와 장 전체는 교정 분량이 전혀 다릅니다.
HumanPen 도구는 반대 방향으로 작동합니다. 해당 장의 Turnitin 또는 iThenticate 보고서를 가져오시면 플래그가 붙은 부분이 그대로 범위가 됩니다. 다시 쓰이는 것은 그 텍스트뿐이고 나머지는 그대로 두며, 과금은 업로드하신 문서가 아니라 실제로 다시 쓴 단어를 셉니다. 엔진이 건드리는 가장 작은 단위는 문단이며, 문단의 일부만 선택한 경우에는 문단 전체로 확장되어 작업 시작 전에 여러분에게 보여집니다. 업로드 쪽에는 요청당 단어 상한이 없으므로 한 장이 파일 하나로 들어갑니다. 조건을 충족하는 부분은 무료로 다시 실행할 수 있습니다.
이 가운데 어느 것도 다음 보고서에 대한 예측이 아닙니다. 무엇이 건드려지고 무엇이 과금되는지에 대한 진술입니다.
자주 묻는 질문
30,000단어보다 긴 문서도 Turnitin이 검사할 수 있나요? AI 작성에 대해서는 아닙니다. Turnitin의 파일 요건 페이지와 FAQ는 모두 AI 작성 보고서와 백분율이 생성되려면 제출물이 30,000단어를 초과하지 않아야 한다고 밝힙니다. 유사도 검사는 별개 시스템이며 저마다의 동작 방식이 있습니다.
제 학위논문에 AI 백분율이 없이 돌아왔습니다. 좋은 것인가요? 보고서가 아예 만들어지지 않았을 가능성이 가장 큽니다. 회색 이중 대시는 지시자가 제출물을 처리할 수 없었다는 뜻이고, 파일 요건을 넘는 것은 Turnitin이 그 이유로 든 것 중 하나입니다.
제 장의 점수가 지도교수님이 제출하신 파일의 점수와 다른 이유는 무엇인가요? 서로 다른 실행입니다. 점수는 제출된 것의 겹치는 세그먼트를 대상으로 계산되고, 백분율은 자격이 되는 산문만 다루므로, 같은 단어가 담긴 두 파일이 서로 다른 분모와 다른 숫자를 만들 수 있습니다.
최소 길이가 있나요? 있습니다. 파일에는 장문 작성 형식의 산문 텍스트가 최소 300단어 있어야 합니다. Turnitin은 또한 단어가 몇 백 개뿐인 문서에 대한 예측은 평균을 낼 겹침이 없는 단일 세그먼트이기 때문에 전부 아니면 전무 쪽으로 기운다고 말합니다.
계속 읽기