GPTZero 대 Turnitin: 어느 것이 성적을 결정하는가
GPTZero와 Turnitin은 같은 시험의 두 버전처럼 취급되곤 한다. 그러나 그렇지 않다. 하나는 대학에 라이선스가 부여되어 실제 제출물에 연결되어 있다. 다른 하나는 자정에 스스로 실행할 수 있는 소비자용 제품이다. 무엇이 이 둘을 구분하는지 살펴보자.
마감일 전날 밤 11시에 학생이 자신의 에세이를 GPTZero에 붙여 넣고 40퍼센트를 넘는 수치가 올라가는 것을 본다. 그 순간 당황이 시작되지만, 그 수치는 다음 날 아침 파일이 제출된 뒤 대학의 실제 제출 시스템이 무엇을 보고하는지와는 아무런 관련이 없다. GPTZero vs Turnitin은 같은 검사의 두 버전이 아니라, 서로 다른 구매자를 위해 만들어진 두 제품의 비교이기 때문이다.
Turnitin은 대학이 구매하여 과제 제출 포털에 연동하는 제품이다. GPTZero는 누구나 오늘 밤 브라우저에서 열어 텍스트를 붙여 넣고, 몇 초 안에 수치를 돌려받을 수 있는 제품이며, 해당 기관이 이를 라이선스했는지 여부와는 무관하다. 두 제품 모두 AI 생성 글쓰기를 찾아낸다고 주장한다. 그러나 어느 한쪽이 다른 쪽을 예측한다는 수치를 공개하는 곳은 없다.
이 글은 바로 그 구분에 초점을 둔다. 각 제품이 실제로 무엇인지, 채점자가 무엇을 보는지, 그리고 자가 실행 점수가 공식 점수의 미리보기가 아닌 이유가 무엇인지 설명한다. 작성자가 탐지기가 보고하는 내용을 바꾸려 할 때 어떤 일이 일어나는지에 대한 더 넓은 질문은, 우리의 AI humanizer 도구 비교에서 이러한 제품이 어디에서 도움이 되고 어디에서 그렇지 않은지를 다룬다.

GPTZero vs Turnitin: 왜 학생들은 서로 다른 두 제품을 혼동하는가
혼란은 이해할 만하다. 대부분의 학생의 머릿속에서는 둘 다 같은 문장 안에 있기 때문이다, 바로 'the AI checker.' Turnitin은 20년 동안 운영해 온 표절 대조 Similarity Report의 동반 도구이며, 기관에 라이선스가 부여되고 그 기관의 관리자 설정에서 켜거나 끌 수 있다. GPTZero는 누구나 직접 사용할 수 있도록 만든 독립형 AI 탐지기로 출시되었고, 이후 표절 검사, 문법 교정, 기타 자체적인 글쓰기 품질 기능을 추가했으며, GPTZero의 자체 수치에 따르면 3,500개가 넘는 대학과의 기관 라이선스 계약도 보유하게 되었다.
이 중첩은 중요하다. GPTZero는 순수한 소비자용 제품이 아니기 때문이다. 일부 기관은 이를 자체 공식 검사 도구로도 라이선스한다. 반면 Turnitin 쪽은 여러 해 동안 일관되게 유지되어 왔다. 공개 페이지 어디에서도 개인이 가입해 자신의 논문을 AI Writing Indicator에 돌리고 비용을 지불할 수 있게 한 적은 없으며, 그렇게 할 수 있는 것은 기관 라이선스뿐이다. 당신이 내리는 결정에서 이 구분이 핵심인지 Turnitin에 직접 확인하라.
구매 주체의 차이는 이후의 모든 과정을 형성한다. Turnitin은 제출물에 연결된 하나의 일관된 기록이 필요한 기관에 판매되므로, 그 결과는 관리자가 이의 제기 과정에서 몇 달 뒤 다시 열어볼 수 있는 보고서 안에 남는다. GPTZero는 30초 안에 답을 원하는 개인에게 판매되므로, 그 결과는 읽고 닫는 화면이다. 어느 설계도 그 구매자에게는 잘못된 것이 아니다. 다만 이것이 의미하는 바는, 두 수치가 서로 다른 압력 아래 산출된다는 점이며, 한 사람에게 빠른 답을 주도록 만들어진 제품은 징계 절차를 견디도록 만들어진 제품과 일치할 이유가 없다는 점이다.
한눈에 보는 GPTZero vs Turnitin
아래 표는 학생이나 평가자가 실제로 중요하게 여기는 네 가지 질문, 누가 실행할 수 있는지, 평가자가 무엇을 보는지, 무엇을 측정하는지, 비용이 얼마인지에 따라 두 도구를 나란히 정리한다. 일부 칸은 의도적으로 비워 두었는데, 이번 확인 시점에는 어느 공급자의 가격 페이지도 사용할 수 있는 달러 금액을 표시하지 않았기 때문이다.
| Turnitin | GPTZero | |
|---|---|---|
| 누가 실행할 수 있는가 | Turnitin 라이선스를 보유한 기관만 가능하며, 개인 작성자를 위한 소비자용 제품은 존재하지 않는다 | 개인은 누구나 직접 가입할 수 있으며, GPTZero는 기관에도 별도로 라이선스를 제공한다 |
| 채점자가 보는 것 | AI Writing Indicator는 Similarity Report의 교원 및 관리자 보기 안에 표시되며, 학생은 기본적으로 이를 볼 수 없다 | 학생이 공유하기로 선택한 내용만 보인다, 자체 실행 점수는 기관이 GPTZero를 자체 업무 흐름에 대해 별도로 라이선스하지 않는 한 교원 보기로 자동 전달되는 경로가 없다 |
| 무엇을 측정하는가 | 적격 산문 텍스트 중 likely AI-generated 또는 AI-paraphrased로 점수화된 비율을, 서로 겹치는 문장 구간 전반에 걸쳐 평균한 값 | Claude, ChatGPT, GPT-5, Gemini를 포함한 명시된 모델 전반의 AI-generated content, 이는 GPTZero 자체 제품 설명에 따른 것이다 |
| 비용은 얼마인가 | 공개된 소비자 가격은 없으며, 기관에 직접 판매된다 | 개인을 위한 무료 등급이 있으며, 유료 Professional 및 Enterprise 또는 Team 요금제가 존재하지만, 이번 확인 시점에는 GPTZero의 자체 가격 페이지에서 사용 가능한 달러 금액이 표시되지 않았다 |
자신의 논문을 인간적으로 다듬기
중요한 단어나 인용은 건드리지 않고, AI 보조로 작성한 텍스트를 자연스럽고 사람처럼 들리게 바꾸세요.
각 점수가 실제로 측정하는 것
Turnitin은 자체 백분율을 정확하게 정의한다, 즉 'qualifying text'의 비율이다. 여기서 qualifying text는 장문 문서의 산문 문장을 뜻하며, 이 모델이 likely AI-generated 또는 likely AI-generated이고 이어서 paraphrasing 또는 bypass tool로 수정된 것으로 점수화한 부분을 가리킨다. 문서는 대략 다섯에서 열 개의 문장으로 이루어진 서로 겹치는 구간으로 나뉘며, 각 문장은 0에서 1 사이로 점수화되고, 그 구간 점수들이 평균되어 채점자가 보는 단일 숫자가 된다. 제출물은 어떤 점수도 생성되기 전에 최소 300 words의 적격 산문이 있어야 한다.
GPTZero의 자체 사이트는 제목에 '99% Accuracy' 수치를 제시하고, 해당 탐지기가 Claude, ChatGPT, GPT-5, Gemini를 포함한 명시된 모델들의 출력물을 대상으로 한 제3자 테스트를 통해 검증되었다고 설명한다. 그러나 GPTZero의 공개 페이지들에서는, 적어도 이 검토에서 확인한 범위에서는, Turnitin이 문장 단위 메커니즘으로 문서가 어떻게 분할되고, 점수가 매겨지고, 그 점수들이 평균화되어 그 제목의 수치가 되는지를 설명하는 내용이 제시되지 않는다. 이 차이는 그 자체로 명시할 가치가 있다. 한 업체는 방법을 감사할 수 있을 만큼 충분히 자세히 공개하고, 다른 업체는 결과만 공개한다. 무료 burstiness checker는 적어도 분류기들이 읽는 경향이 있는 통계적 신호 가운데 하나에서 자신의 초안이 어디에 위치하는지 보여줄 수 있으며, 최종적으로 어떤 명시된 도구가 파일을 여는지와는 무관하다.
누가 점수를 보고, 그것이 실제로 언제 채점자에게 도달하는가
Turnitin의 자체 안내는 AI writing detection 표시와 보고서가 기본적으로 학생에게 보이지 않는다고 분명히 밝힌다. 기관이 해당 기능을 활성화하면 교사는 Similarity Report 뷰어 안에서 그 비율을 보게 되며, 학생이 자신의 점수를 보게 되는 유일한 경로는 교사가 보고서를 수동으로 내려받아 직접 공유하는 것이다.
GPTZero 점수는 기본적으로 그와 반대로 작동한다. 실행한 사람이 누구든 즉시 볼 수 있으며, 그것이 초안을 점검하는 학생이든, 기관 계약 밖에서 제출물을 수동으로 확인하는 교사이든 마찬가지다. 이러한 비공식성은 양면적이다. 2023년 UC Davis에서 한 교수는 학생 William Quarterman의 과제를 GPTZero에 직접 돌려 표절로 낙제시켰고, 이는 Turnitin식 기관 워크플로와는 완전히 무관하게 이루어졌으며, Turnitin의 자체 AI 탐지기와 관련된 별도의 사건이 공개되기 며칠 전이었다. 누구도 이를 기관 차원에서 라이선스하지 않았지만, 성적에 대한 권한을 가진 사람이 그것에 직접 근거해 행동하기로 선택했다. 그것은 실제 성적이었다.
전날 밤의 GPTZero 점수가 Turnitin의 점수를 예측하지 못하는 이유
두 수치 사이에는 수학적으로 아무런 연결도 없다. 훈련 데이터가 다르고, 채점 메커니즘이 다르고, 최소 단어 수가 다르고, 파일 처리 규칙이 다르기 때문이다. 한쪽의 점수는 같은 문서에 대해 다른 쪽이 무엇을 보고할지에 관해 보정된 정보를 전혀 주지 않는다. Turnitin 자체의 지침도 그 도구를 단독으로 볼 때 같은 점을 분명히 한다. 즉, 점수는 교육자의 판단을 위한 데이터이지, 그 자체로 부정행위의 판정이 아니다.
실무상의 차이도 누적된다. Turnitin은 자격을 갖춘 장문 산문만 점수화하며, 아무 결과도 반환하려면 300 words가 필요하다. 따라서 짧은 성찰문은 점수가 나오지 않지만, 소비자용 검사기는 단 하나의 문단에 대해서도 백분율을 반환할 수 있다. 문서 처리도 다르다. 본문 텍스트로 무엇을 볼지, 제목, 캡션, 블록 인용, 참고문헌 항목으로 무엇을 건너뛸지는 각 공급자가 자체 기준에 따라 결정하며, 어느 쪽도 이를 완전하게 공개하지 않는다. 두 도구에 같은 파일을 넣으면, 모델이 단어 하나를 점수화하기 전에 실제로는 서로 다른 두 문서를 읽고 있는 셈이다.
두 도구 모두 문서화된 오류율을 가진다. Turnitin은 이미 20% AI를 넘는 것으로 표시된 문서에 대해 문서 수준의 거짓 양성률이 1% 미만이며, 문장 수준에서는 약 4%라고 밝힌다. Vanderbilt University가 2023년에 Turnitin의 AI 탐지기를 끌 때 이 수치를 이름까지 들어 인용했을 만큼 구체적인 수치이다.
Originality.ai는 Turnitin과 나란히 놓고 볼 만한 세 번째 탐지기이며, 그 비교에는 별도의 페이지가 있다. 탐지기 자체가 아니라 도구들에 대해서는, 학술 글쓰기를 위한 최선의 AI humanizer를 별도로 평가한다.
TextPulse의 자체 무료 도구를 통해서든 다른 방식으로든, 자신의 초안을 같은 종류의 통계적 신호와 대조해 보는 것은 글에 관해 실제로 무엇인가를 알려 준다. 그러나 그것만으로는 여전히 채점자가 실제로 받은 Turnitin 보고서가 무엇을 말하는지 알 수 없다. 그 수치는 애초에 사용자가 실행할 수 있는 것이 아니었기 때문이다.
자주 묻는 질문
아니다. GPTZero 대 Turnitin은 서로 다른 훈련 데이터, 서로 다른 점수 산출 방식, 서로 다른 최소 단어 수를 가진 두 제품의 비교이므로, 어느 쪽 점수도 다른 쪽을 예측하지 못한다. 마감 전날 밤 학생이 직접 수행한 GPTZero 검사는 다음 날 대학의 Turnitin 통합 제출 시스템이 보고하는 결과와 보정된 관계가 없다.
Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.