플래그가 뜬 문장 하나를 다시 쓰면 점수가 그 문장 하나 분량만큼 떨어지나요?
Turnitin 의 AI 비율이 어떻게 산출되는지에 대한 몇 가지 설명을 보면 단순 합산 방식으로 보입니다. 각각의 설명은 공식 문서로 거슬러 올라갈 수 있는데, 각 경우에 그 문서는 그 설명을 바탕으로 만들어진 조언보다 적은 내용만 담고 있습니다.
HumanPen 팀
· 9분
간단한 답변
아닙니다. 문장이 떠안게 되는 점수는 그 문장 하나가 따로 번 것이 아니므로, 고친 문장 개수와 줄어든 퍼센트 포인트 사이에는 고정된 교환비율이 존재하지 않습니다. Turnitin 이 공개한 설명에 따르면 문장은 추출된 뒤 겹치는 세그먼트로 그룹화되고, 각 세그먼트는 0 에서 1 사이의 점수를 받으며, 문장은 자신이 속한 모든 세그먼트의 점수를 물려받습니다. 즉 경계에 걸친 문장은 두 개 이상의 점수를 지니며, 이들이 풀링됩니다. 이 설명에는 상속·풀링·집계라는 세 가지 연산이 등장하지만 실제 정의는 공개되지 않았으므로, 어느 한 문장의 기여분을 따로 떼어読む 수가 없습니다. 이 계산 방식에 대한 세 가지 구체적 설명이 유통되고 있는데, 셋 모두 합산식입니다. 각각은 문서로 거슬러 올라가지만, 각 경우에 그 문서는 그 설명보다 적은 내용만 담고 있습니다.
이 세 가지는 아래에서 각각 해당 문서와 나란히 실었습니다. 메커니즘 자체와 거기서 도출되는 수동 수정은 별도로 정리했습니다. 도구 없이 AI 텍스트를 사람처럼 쓰는 법
"리포트는 문장 수준에서 이진법으로 작동한다"
AI 점수를 낮추는 법을 다루는 교정 업체의 가이드에서 2026 년 8 월 18 일 확인한 내용을 그대로 인용합니다:
"유사성 리포트처럼 색상 단계가 있는 게 아니다. AI 리포트는 문장 수준에서 이진법이다: 각 문장은 플래그가 뜨거나 뜨지 않거나 둘 중 하나다. 전체 퍼센트는 문서 전체에서 플래그가 뜬 텍스트의 비율일 뿐이다."
눈앞의 리포트를 설명하는 말로 보면 전반부는 맞습니다. 문장은 강조 표시되거나 그러지 않거나일 뿐, 농담는 없습니다. 틀린 건 강조 표시 뒤의 실제 메커니즘입니다. Turnitin 이 직접 밝힌 설명:
"해당 세그먼트 내의 각 대상 문장은 세그먼트의 점수를 물려받는다. 세그먼트가 겹치기 때문에 일부 문장은 여러 점수를 가질 수 있으며, 이들은 하나의 점수로 풀링된다."
즉 문장 하나가 따로 판정을 받은 게 아닙니다. 그 문장을 포함하는 텍스트 블록들에서 확률을, 때로는 두 개를 물려받은 것입니다. 강조 표시는 임계값을 렌더링한 것일 뿐, 그 숫자가 만들어진 실제 양이 아닙니다.
인용문의 마지막 절에는 별개의 문제가 있습니다. "문서 전체에서 플래그가 뜬 텍스트의 비율"은 Turnitin 이 퍼센트의 분모라고 말하는 것이 아닙니다. 분석 대상은 소위 '대상 텍스트'뿐입니다. 표준 문법 문장으로 쓰인 블록만이며, 목록과 불릿은 제외됩니다. 그래서 Turnitin 이 끄는 결론은 "이 퍼센트는 반드시 제출물 전체의 퍼센트와 같지 않다"입니다. 파일의 3 분의 1 이 표와 불릿, 참고문헌이라면 분모는 문서 전체가 아닙니다. 이를 따로 해체했습니다. Turnitin AI 작성 리포트 읽는 법
그걸 바탕으로 만들어진 조언은 이렇습니다: 강조된 문장 수를 세고, 나누고, 몇 개를 고쳐야 할지 계산한다. 공개된 설명 아래에서 이 연산은 지시 대상이 없습니다. 강조된 문장 수와 퍼센트가 하나의 양을 두 가지로 본 것이 아니기 때문입니다.
"모든 세그먼트 점수의 평균"
휴머니자이저 업체의 가이드에서 나온 것으로, 메커니즘에 대한 출처로 Turnitin 자체 헬프센터를 인용하고 있습니다. 2026 년 8 월 18 일 확인, 그대로 인용:
"모델은 모든 세그먼트 점수의 평균을 기반으로 전체 예측값을 계산하며, 이는 AI 작성 인디케이터에 표시되는 퍼센트가 된다."
이 설명은 훨씬 가깝습니다. 그 간격을 정확히 짚을 가치가 있습니다. 공개된 문장은 다음과 같습니다:
"이러한 문장 점수들은 더 집계되어 전체 문서 AI 작성 점수를 계산하는 데 사용된다."
세그먼트 점수가 아니라 문장 점수입니다. 세그먼트 점수는 문장이 물려받는 중간값이며, 때로는 두 번 물려받습니다. 집계되는 것은 풀링을 거친 결과물입니다.
둘이 다른 숫자로 수렴하는지는 알려드릴 수 없습니다. Turnitin 이 풀링 함수도 집계 방식을 공개하지 않았기 때문입니다. 다른 건 연산의 범위입니다. 그리고 그것이 수정 계획의 절반이 의존하는 지점입니다. 세그먼트 평균 아래에서는 세그먼트가 포함하는 문장 수와 무관하게 모든 세그먼트가 동일하게 카운트되며, 각 문장은 정확히 하나의 세그먼트에만 속합니다. 이 둘 중 어느 것도 공개된 설명이 말하는 바가 아닙니다.
"모든 문단의 첫 문장과 마지막 문장을 다시 써라"
세 번째 설명은 메커니즘을 건너뛰고 지시사항으로 도착합니다: 모든 문단의 시작과 끝 문장을 다시 써라, 시작과 끝이 가장 많이 플래그가 뜨기 때문이라는 이유입니다.
배경에는 실제 문서가 있습니다. 2023 년 5 월 24 일짜리 릴리스노트, "문서 시작과 끝 부분의 탐지력 개선" 항목에서 Turnitin 은 다음과 같이 썼습니다:
"출시 이후로 우리는 문서의 처음 몇 문장이나 마지막 몇 문장에서 거짓 양성 탐지의 더 높은 발생률을 관찰했다. 이러한 문장들은 소개나 결론 내용을 일반화된 방식으로 쓴 경우가 많았다. 이에 따라 이러한 거짓 양성을 줄이는 데 도움이 되도록 탐지 로직을 변경했다."
거기서 세 가지를 takeaway 할 수 있습니다. 자주 누락되는 순서대로 정리했습니다.
문서의 시작과 끝이라고 했지, 모든 문단의 시작과 끝이라고 한 게 아닙니다. 조언이 구조상 두 단계 아래로 이주했습니다.
이건 수정 공지입니다. 세 번째 문장이 공지사항입니다. 첫 두 문장을 현재 탐지기의 작동 방식으로 인용하는 건, 버그리포트를 스펙으로 인용하는 격입니다.
그리고 노트는 계속됩니다: "또한 우리는 세그먼트 경계 탐지를 더 정밀하게 만드는 작업을 진행했으며, 이로 인해 일부 드문 경우 이전 버전과 비교해 경계가 변경될 수 있습니다." 경계가 움직였습니다. 어느 문장이 어느 세그먼트에 속하는지는 버전별 구현 세부사항일 뿐, 계획할 대상이 아닙니다.
비위 심의 면담을 준비 중이라면 이 릴리스노트를 가지고 들어가지 마십시오. 맞은편에 앉은 사람도 세 번째 문장은 읽을 수 있습니다. 합리적으로 말할 수 있는 건 이보다 좁고 더 견고합니다: 업체가 거짓 양성에 대응해 모델을 수정했으며, 이는 확정된 증거로 취급할 대상의 작동을 말하는 게 아니라는 점입니다.
오늘 밤을 어떻게 보낼지가 달라집니다
- 어느 문장을 다시 써야 한다는 규칙을 따르기 전에 그 규칙이 나온 문단을 먼저 찾으세요. 위의 세 가지 모두 출처 문서가 있습니다. 셋 모두 문서는 그 규칙이 말하는 것보다 적은 내용만 담고 있으며, 그 간격은 5 분 정도 읽으면 보입니다.
- 실제로 있는 강조 표시를 바탕으로 작업하세요. 리포트가 특정 구절을 표시했다면 그 구절에 증거가 붙어 있는 겁니다. 위치에 관한 규칙 뒤에 있는 증거는 2023 년짜리 릴리스노트입니다.
- 바꿀 문단이 아니라 재확인할 문단의 수를 세세요. 손대는 문단 하나는 인용이 깨지지 않았는지, 주장이 움직이지 않았는지, 숫자가 바뀌지 않았는지 다시 읽어야 할 문단 하나입니다. 논문 전체의 모든 문단에 손대는 계획은 조용히 논문 크기의 교정 작업을 만들어낸 셈입니다.
- 시작 파일을 보관하세요. 여기에서 증거 가치를 지닌 건 초안과 중간 드래프트이며, 숫자가 어떻게 움직이든 그 가치는 유지됩니다. 메커니즘은 증거로서의 버전 히스토리 에 있습니다.
우리가 만드는 툴, 그리고 줄 수 없는 숫자
HumanPen 은 AI 작성 리포트를 PDF 로 받아 표시된 구절을 바탕으로 작업합니다. 여기에 관련 있는 규칙이 하나 있습니다: 한 문단이 리라이트의 최소 단위이며, 따라서 하나의 문단 일부에 걸친 선택은 작업 실행 전에 문단 전체로 확장됩니다.
이 규칙은 채점에 관한 주장이 아닙니다. 강조 표시는 절 중간에서 시작할 수 있기 때문이며, 강조된 문자만 정확히 리라이트하면 두 사람이 쓴 문단이 됩니다. 하나는 한 어조로, 나머지는 아무도 손대지 않은 절반에서 도입된 용어에 기대는 나머지 절반. Turnitin 점수를 움직이기 위해 리라이트가 커버해야 할 단위가 무엇인지 공개하지 않았으며, 우리도 밖에서 역추적할 입장이 아닙니다.
우리가 드리 수 없는 건 교환비율이며, 다른 그 무엇도 마찬가집니다. 예측 퍼센트를 제시하는 툴은 자기가 가지고 있지 않은 숫자를 제시하는 것입니다.
자주 묻는 질문
문장이 강조되면 그 문장을 삭제하면 그 문장의 점수 몫이 사라지나요? 예측 가능하게는 아닙니다. 강조 표시는 문장이 주변 세그먼트에서 물려받은 점수를 반영하며, 텍스트를 삭제하면 세그먼트가 바뀝니다. 문서 번호는 강조된 문장의 합계가 아니라 풀링된 문장 점수의 집계입니다.
문단 전체를 다시 쓰면 같은 폭으로 점수가 떨어지나요? 문단에 대해서도, 문장에 대해서도 공개된 수치는 없습니다. 공개된 것은 세그먼트가 겹친다는 점이며, 따라서 어느 한 구절에 어떤 일이 일어나는지는 그 좌우의 텍스트에 달렸습니다.
왜 강조 표시와 퍼센트가 일치하지 않나요? 퍼센트는 대상 산문에만 계산되며, Turnitin 은 여러 작성 유형이 혼재된 문서에서 "퍼센트와 강조 표시 사이에 불일치가 발생할 것"이라고 말합니다.
정말 각 문단의 첫 문장과 마지막 문장이 더 많이 플래그가 뜨나요? 이 얘기를 시작한 문서는 문서의 처음 몇 문장과 마지막 몇 문장이라고 했으며, 2023 년에 그렇게 말했고 같은 노트에서 이를 줄이기 위한 탐지 로직 변경을 공지했습니다. 현재 행동에 대한 설명이 아니며 변호용으로 쓸 수 없습니다.
내 편집을 직접 테스트해볼 수 있나요? 보통은 아닙니다. 20% 미만은 숫자도 강조도 없는 별표로만 표시되며, 대부분의 설정에서 이 인디케이터는 사용자보다 지도교수와 관리자에게만 보입니다.
---
계속 읽기