AI 탐지기가 오탐을 보고할 때 자신의 작업이 원본임을 증명하는 방법
어떤 도구도 당신이 무언가를 작성했다고 인증할 수 없습니다. 당신이 할 수 있는 일은 "내가 이것을 썼습니다"가 "이것은 생성되었습니다"보다 더 단순한 설명이 되도록 증거 사슬을 구성하는 것입니다.
HumanPen 팀
· 16분
짧은 대답
어떤 도구도 당신이 텍스트의 원본 저자임을 증명할 수 없습니다. 당신이 할 수 있는 일은 증거 사슬을 구축하는 것이다: 시간에 따라 문서가 편집되었음을 보여주는 버전 히스토리, 메모와 개요와 주석이 달린 출처 같은 원본 자료, 감독자 이메일부터 글쓰기 센터 방문까지 작문 과정의 기록, 그리고 당신의 텍스트가 왜 그렇게 보이는지에 대한 설명. 이들 중 어느 것도 단독으로는 AI 사용을 반박하지 못합니다. 함께 쓰이면 점수를 검토하는 사람에게 점수 자체 외에 볼 것이 생깁니다. 그리고 도구를 만든 회사는 세 개의 별도 도움말 문서에서 점수가 학생에 대한 조치의 유일한 근거로 사용되어서는 안 된다고 말했습니다. 그것은 당신의 주장이 아닙니다. 그들의 주장입니다.
이 글의 나머지는 네 가지 증거 층, 각각이 무엇을 보여주고 무엇을 보여주지 않는지, 그리고 과도하게 주장하지 않고 대화에 가져가는 방법을 설명합니다. Turnitin 자신이 자신의 점수에 대해 말한 것에 대한 섹션도 있습니다. 왜냐하면 그 진술들은 방에 있어야 할 것이며, 당신이 할 말이 아니기 때문입니다.
이것과 부정의 차이는 "나는 AI를 사용하지 않았습니다"와 "이 문서가 어떻게 존재하게 되었는지가 여기 있습니다"의 차이입니다. 첫 번째는 주장입니다. 두 번째는 증거입니다. 오직 두 번째만 검토자에게 작업할 것을 줍니다.
어떤 도구도 원본성을 증명하지 못하며, 그것은 도구가 측정하는 것이 아닙니다
AI 작문 탐지기는 텍스트를 분류합니다. 문서를 받아 세분화하고, 각 세그먼트에 확률을 할당하며, 그것들을 하나의 숫자로 집계합니다. 그 숫자는 산문의 통계적 속성을 기술합니다. 누가 썼는지, 어떻게 작성되었는지, 파일이 제출되기 전에 무슨 일이 있었는지는 기술하지 않습니다.
이 점을 분명히 말할 가치가 있습니다. 왜냐하면 "how do I prove my work is original" (영어 원문 그대로 인용)라는 질문이 종종 Turnitin에 대칭되는 도구, 즉 당신의 초안을 받아 "네, 당신이 이것을 썼습니다"라고 출력하는 무언가가 있는 것처럼 답해지기 때문입니다. 그런 도구는 없습니다. 원본성을 위한 분류기는 없습니다. 원본성은 과정과 기원에 대한 주장이며, 과정과 기원은 다른 점수가 아니라 기록으로 확립하는 것들입니다.
그러므로 작업은 역탐지를 찾는 것이 아닙니다. 작업은 작문 과정을 보이게 만드는 자료를 모으고, 그것을 Turnitin 자신이 자신의 점수가 무엇을 해결하고 무엇을 해결하지 않는지에 대해 말한 진술과 짝짓는 것입니다. 우리는 깃발되었지만 직접 작성했다면에서 먼저 해야 할 일의 일반적인 버전을 살펴보았습니다. 이 글은 더 넓은 틀입니다.
첫 번째 층: 버전 히스토리
버전 히스토리는 시간에 따라 문서가 어떻게 변했는지에 대한 타임스탬프 로그입니다. Word는 OneDrive 자동 저장과 Track Changes를 통해 하나를 보존합니다. Google Docs는 기본적으로 하나를 보존하며 기본적으로 켜져 있습니다. Overleaf는 Git 스타일의 페이지 히스토리를 보존합니다. 셋 모두 편집이 언제 일어났는지와 각 판이 대략 얼마나 컸는지 기록합니다.
버전 히스토리가 보여줄 수 있는 것:
- 문서가 서로 다른 날짜에 여러 세션에 걸쳐 편집되었습니다.
- 일부 판은 작았고(문단 하나, 문장 하나) 일부는 더 컸습니다.
- 파일이 더 이른 상태로 존재했으며, 때로는 제출 몇 주 전입니다.
- 편집은 피드백 사건, 감독자 코멘트, 또는 당신 자신의 수정 패스 주위에 모입니다.
보여줄 수 없는 것:
- 모든 문장이 사람에 의해 작성되었다는 것.
- 어떤 단계에서도 AI 도구가 사용되지 않았다는 것.
- 최종 텍스트가 중간 초안과 줄 단위로 일치한다는 것.
버전 히스토리의 가치는 AI 사용을 반박하는 것이 아닙니다. 그렇게 하지 못합니다. 가치는 문서가 시간에 걸쳐 작성된 것과 일치하는 히스토리를 가짐을 보여주는 것입니다. 붙여 넣은 블록은 히스토리가 없습니다. 직접 쓴 논문은 하나 있습니다. 그 구별은 AI 점수가 볼 수 없는 것이며, 점수는 최종 텍스트만 보기 때문입니다.
Word나 Google Docs에서 작성했다면, 회의 전에 버전 히스토리를 내보내라. Overleaf에서 작성했다면, 페이지 히스토리가 같은 목적을 합니다. 날짜가 보이는 판 목록을 스크린샷하고, 타임라인을 따라 세 개 또는 네 개 판을 골라 각각에서 무엇이 변했는지 기록하고, Track Changes를 사용했다면 표시가 여전히 보이는 사본을 보존하라. 표시가 달린 버전이 편집 과정을 인라인으로 보여주는 것입니다.
두 번째 층: 출처 자료
초안이 존재하기 전에 다른 것들이 있었습니다. 독서에서 나온 메모. 개요. 주석이 달린 PDF. 당신 자신의 표시가 달린 참고 문헌 목록. 도서관 데이터베이스의 검색 이력. 이들은 생성이 아니라 연구의 잔재입니다. 그 날짜들은 하나의 텍스트 출력처럼 보이지 않는 경로를 그립니다.
가져올 것:
- 당신이 아직 가지고 있는 가장 이른 초안, 거칠더라도. 거친 초안은 작문 과정의 증거입니다. 그 날짜는 문서가 최종 버션 전에 존재했다는 증거입니다.
- 작업하는 동안 작성한 메모, 개요 또는 주석이 달린 PDF. 출처의 구절을 강조하고 여백에 메모를 작성했다면, 그 표시들은 그 자료에 대해 쓰기 전에 참여했다는 증거입니다.
- 서식을 입히기 전, 작업 상태의 참고 문헌 목록. 출처를 찾으면서 몇 주에 걸쳐 자란 참고 문헌 목록은 한 번에 생성된 것과 다르게 보입니다.
이것들 중 어느 것도 탐지기 결과가 아닙니다. 어느 것도 숫자를 생산하지 않습니다. 그것이 하는 일은 작문을 타임라인을 가진 맥락에 놓는 것이며, 그 타임라인은 문서 전에 시작해 문서 후에 끝나는 방향으로 흐릅니다. 생성된 논문은 '이전'이 없습니다.
세 번째 층: 작문 과정
세 번째 층은 문서 자체 밖에 존재하는 작문 과정의 기록입니다.
- 감독자 또는 피드백을 준 누구와의 이메일 스레드. 특정 날짜에 초안을 보내고 코멘트를 받았다면, 그 교환은 타임라인의 한 점을 닻 내립니다. 또한 문서가 작성 중에 다른 사람에 의해 검토되고 있었음을 보여줍니다.
- 동료 검토 기록 또는 글쓰기 센터 방문. 초안을 글쓰기 튜터에게 가져가거나 동급생과 초안을 교환했다면, 그 세션에는 날짜가 있고 때로는 메모가 있습니다. 그것들은 작문이 사회적 과정을 거쳤다는 증거이며, 대부분의 학술 작문이 실제로 그렇게 이루어집니다.
- 이 과제를 향해 쌓아온 모든 이른 과제. 이 논문이 제안서, 주석이 달린 참고 문헌 목록, 또는 따로 제출한 방법론 섹션에서 자라났다면, 그 이른 제출물들은 같은 작문 궤적의 일부입니다.
이 층이 하는 일은 문서를 다른 사람과 다른 날짜에 연결하는 것입니다. 어떤 이전 상호작용에도 연결 없이 홀로 있는 문서는 의문하기 더 쉽습니다. 이메일, 튜토리얼, 이른 제출물의 사슬 안에 있는 문서는 그것을 작성한 사람과 분리하기 더 어렵습니다.
네 번째 층: 텍스트를 설명할 수 있습니다
네 번째 층은 당신의 텍스트가 왜 그렇게 보이는지 설명하는 능력입니다. 이곳이 Turnitin 자신의 오탐에 대한 지침이 관련이 되는 곳입니다.
AI 작문 탐지 FAQ는 오탐을 일으키는 경향이 있는 텍스트의 특성을 기술한다:
"Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas." (영어 원문 그대로 인용)
다음 문장이 당신의 맥락에서 중요한 것이다:
"If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated." (영어 원문 그대로 인용)
그것이 무엇을 다루는지 읽어라. 구조적 변화가 많지 않은 콘텐츠. 문자 그대로 자신을 반복하는 텍스트. 새로운 아이디어를 발전시키지 않고 패러프레이즈된 텍스트. 그것들은 학술 작문의 큰 몫을 기술합니다. 문헌 고찰은 요약하고 종합하며, 그것은 본질적으로 패러프레이즈입니다. 방법론 섹션은 표준 절차를 같은 절차이기 때문에 반복적이어야 하는 언어로 기술합니다. 서론과 결론은 종종 설계상 일반적인데, 중간에 구체적인 작업을 틀 짓기 위해서입니다.
당신의 깃발된 섹션이 그 영역에 있다면, 도구를 만든 회사는 점수를 읽는 사람에게 정확히 그 이유로 점수를 할인하라고 말하고 있는 것입니다. 당신이 아니라. 회사입니다. 당신의 일은 어떤 깃발된 섹션이 그 특성에 부합하는지 식별하고 그렇게 말하는 것입니다. "방법론 섹션은 표준 프로토콜을 기술하며, 언어가 반복적인 것은 프로토콜이 그러하기 때문입니다." 그것은 변명이 아닙니다. 그것은 Turnitin 자신이 나열한 특성에 대한 직접적 일치입니다.
Turnitin이 자신의 점수에 대해 말하는 것
방에 있어야 할 두 번째 진술 묶음이 있으며, 그들 중 어느 것도 당신의 것이 아닙니다.
AI 작문 보고서 가이드는 말한다:
"Our AI writing detection model may not always be accurate (it may misidentify human-written, AI-generated, and AI-paraphrased text), so it should not be used as the sole basis for adverse actions against a student." (영어 원문 그대로 인용)
그 직후의 문장이 이 인용이 사용될 때마다 빠지는 것이다:
"It takes further scrutiny and human judgment in conjunction with an organization's application of its specific academic policies to determine whether academic misconduct has occurred." (영어 원문 그대로 인용)
둘을 함께 읽어라. 첫 번째는 이 숫자를 단독으로 사용하지 말라고 말합니다. 두 번째는 대신 무슨 일이 일어나야 하는지 말한다: 추가 조사, 인간 판단, 기관 자신의 정책. 그것은 숫자를 가진 사람에게 결론을 내리기 전에 더 많은 작업을 하라고 말하는 제조사입니다.
별도의 페이지 AI 작문 보고서는 어떻게 검토해야 합니까?는 다르게 말한다:
"It is not meant to provide definitive answers in isolation. More important than any tool is the educator who sees the score and makes decisions balancing this information with their personal knowledge of their students, their work, and institutional policy." (영어 원문 그대로 인용)
다음 문장이 그것을 완성한다:
"When educators look at the AI writing score and utilize it as a single data point rather than a definitive response, then it is being used as intended." (영어 원문 그대로 인용)
그것은 자신의 점수를 단일 데이터 점이라 부르는 제조사입니다. 평결이 아닙니다. 최종 응답이 아닙니다. 당신이 구축하고 있는 증거 사슬이 그 단일 데이터 점을 여러 데이터 점으로 바꾸는 것이며, 그것이 제조사가 옳다고 말하는 사용법입니다.
이 진술들은 세 개의 별도 Turnitin 도움말 문서에 나타납니다. 학생의 방어가 아닙니다. 그것은 도구 제작자 자신의 숫자가 무엇을 의미하는지에 대한 경계입니다.
오탐률이 다루고 다루지 않는 것
Turnitin의 FAQ는 정확도 목표를 진술한다:
"We strive to maximize the effectiveness of our detector while keeping our false positive rate - incorrectly identifying fully human-written text as AI-generated - under 1% for documents with over 20% of AI writing." (영어 원문 그대로 인용)
다음 문장이 그것을 재진술한다:
"In other words, we might flag a human-written document as AI-written for one out of every 100 fully-human written documents." (영어 원문 그대로 인용)
한정어를 주목하라. 1% 미만 목표는 AI 작문이 20% 넘는 문서에 적용됩니다. 그것이 표시기가 실제 숫자와 강조를 보여주는 대역입니다. 20% 미만에서, 현재 표시 규칙은 숫자를 별표로 대체합니다. 그러므로 오탐 보장은 도구가 수치를 확정하는 대역을 다루며, 별표 대역으로 확장되지 않습니다.
같은 페이지가 그 트레이드오프를 설명한다:
"In order to maintain this low rate of 1% for false positives, there is a chance that we might miss some AI written text in a document. We're comfortable with that since we do not want to incorrectly highlight human-written text as AI-written. For example, if we identify that 50% of a document is likely written by an AI tool, it could contain as much as 65% AI writing." (영어 원문 그대로 인용)
그 방향을 읽어라. 모델은 오탐을 피하도록 조정되었으며, 그 조정의 비용은 과소 보고입니다. 높은 점수는 모델이 주의로 편향시키는 조정에도 불구하고 주장에 확정하는 것입니다. 낮은 점수는 "아무 일도 일어나지 않았습니다"와 "모델이 잡아내지 못한 무언가가 일어났습니다" 모두와 일치합니다. 어느 방향도 문서를 누가 작성했는지의 문제를 해결하지 못합니다. 우리는 20% AI가 너무 높은가에서 20%가 무엇을 의미하고 임계값이 어디 있는지 살펴보았습니다.
당신에게는 보고서를 볼 권리가 있습니다
점수에 대해 무엇이든 설명하기 전에, 당신은 보고서를 보아야 합니다. Turnitin의 FAQ는 진술한다:
"Please note, only instructors and administrators are able to see the indicator." (영어 원문 그대로 인용)
같은 페이지는 또한 말한다:
"The AI writing detection indicator and report are not visible to students." (영어 원문 그대로 인용)
그것은 절대적으로 들립니다. 다음 문장이 그것을 바꾼다:
"However, with the PDF download feature, instructors can download and share the AI report with students." (영어 원문 그대로 인용)
그러므로 아무도 당신에게 보고서를 주지 않았다면, PDF를 요청하라. 백분율의 스크린샷이 아닙니다. 전체 보고서입니다. 왜냐하면 전체 보고서는 강조가 어디 앉아 있는지, 몇 단어가 분석되었는지, 점수가 실제 숫자인지 별표인지, 그리고 보고서가 언제 생성되었는지 보여주기 때문입니다. 그 모든 것이 당신이 무엇이든 설명하기 전에 필요한 정보입니다.
숫자의 스크린샷은 당신에게 한 가지를 말합니다. 보고서의 PDF는 그 숫자가 숫자인지 아닌지를 알려줍니다. Turnitin의 Using the AI Writing Report 페이지는 표시기가 있을 수 있는 일곱 가지 상태를 나열하며, 단 두 가지만 화면에 백분율을 올린다: 0%, 그리고 20에서 100 사이의 모든 것. 나머지 다섯 가지는 별표, 여전히 로드 중인 보고서, 처리 오류, 요건을 놓친 파일, 그리고 당신이 제출할 때 탐지가 꺼진 것입니다. 그들 중 어느 것도 당신이 논쟁할 수 있는 숫자가 아닙니다. 우리는 Turnitin AI 작문 보고서 읽는 법에서 그 상태들을 읽는 법을 살펴보았습니다.
회의 준비
당신은 슬라이드 모음이 필요하지 않습니다. 타임라인이 있는 한 장의 페이지와 각 깃발된 섹션을 설명과 짝짓는 짧은 목록이 필요합니다.
- 수평선을 그려라. 가장 이른 초안의 날짜를 왼쪽에, 제출 날짜를 오른쪽에 표시하라.
- 버전 히스토리 날짜를 선 위에 놓아라. 모든 판이 아닙니다. 다섯 개 또는 여섯 개. 무언가가 변한 판입니다.
- 감독자 이메일, 동료 검토 세션, 그리고 글쓰기 센터 방문을 같은 선 위에 놓아라. 이것들은 버전 히스토리를 파일 밖에서 일어난 사건에 닻 내립니다.
- Turnitin 보고서 생성 날짜를 선 위에 놓아라. 이것은 점수가 생산된 날짜이지, 당신이 제출한 날짜가 아닙니다. 그들은 때로 다릅니다.
- 선 아래에, AI 보고서의 각 강조된 섹션과 당신의 설명을 나열하라. "방법론 섹션, 표준 프로토콜, 설계상 반복적." "문헌 고찰, 세 개 출처를 종합, 구조적 변화가 낮은 것은 종합이 그렇게 생기기 때문입니다." 이것들은 Turnitin 자신이 오탐 경향 아래 나열한 특성에 직접 대응합니다.
- 세 개의 Turnitin 인용을 가져와라. 인쇄하고, 각각 그것이 앉아 있는 페이지와 함께. 유일-근거 진술과 그 다음 문장은 Using the AI Writing Report에 있다, guides.turnitin.com/hc/en-us/articles/22774058814093-Using-the-AI-Writing-Report. 단일-데이터-점 진술과 그 다음 문장은 How should I review the AI Writing report?에 있다, guides.turnitin.com/hc/en-us/articles/27139000787853-How-should-I-review-the-AI-Writing-report. 오탐 특성과 그 다음 문장은 Turnitin's AI writing detection capabilities FAQs에 있다, guides.turnitin.com/hc/en-us/articles/28477544839821-Turnitin-s-AI-writing-detection-capabilities-FAQs. 이것은 당신의 말이 아닙니다. 도구 제작자의 것입니다.
그 페이지는 두 가지를 합니다. 검토자에게 점수 외에 볼 것을 주고, 부정을 하러 온 것이 아니라 검토에 참여하러 왔음을 보여줍니다.
하지 말아야 할 것
증거 사슬이 AI 사용을 반박한다고 주장하지 마라. 그렇지 않습니다. 버전 히스토리는 문서가 시간에 따라 편집되었음을 보여줍니다. 원본 자료는 연구가 일어났음을 보여줍니다. 과정 기록은 다른 사람이 관여했음을 보여줍니다. 이들 중 어느 것도 역탐지 결과가 아닙니다. 그들이 보여주는 것 이상을 주장하면 상대방에게 쉬운 반박을 주고 당신이 가져온 다른 모든 것을 약화시킵니다.
도구의 점수를 방어로 가져오지 마라. 논문을 다른 AI 탐지기에 돌리고 "0% AI"를 얻는 것은 아무것도 증명하지 않으며, Turnitin을 만든 회사는 어떤 점수도 유일한 근거가 되어서는 안 된다고 명시적으로 말했습니다. 다른 점수를 점수와 싸우게 가져오는 것은 제조사가 검토자에게 사용하지 말라고 한 같은 논리를 사용하는 것입니다.
Turnitin 인용이 의미하는 것을 과도하게 주장하지 마라. 유일-근거 진술은 점수가 유일한 근거가 되어서는 안 된다고 말합니다. 점수가 틀렸다고 말하지 않습니다. 단일-데이터-점 진술은 점수가 하나의 입력이라고 말합니다. 점수가 무의미하다고 말하지 않습니다. 그것들을 있는 그대로 제시하라: 제조사 자신의 숫자가 어떻게 사용되어야 하는지에 대한 경계. 결론을 내리는 것은 검토자에게 맡겨라.
우리가 있는 곳
HumanPen은 문서 재작성기입니다. 우리는 논문을 재작성기에 돌리는 것이 AI 점수를 사라지게 할 것이라고 말하지 않을 것입니다. 왜냐하면 우리는 미래 점수에 대해 주장하지 않기 때문입니다. 우리가 말할 수 있는 것은 도구가 하는 일이다: 문서를 AI 작문 보고서와 함께 업로드하면, 보고서가 깃발한 구절만 재작성됩니다. 문서의 나머지는 그대로 머뭅니다. 최종적인 것이 되기 전에 출력을 검토합니다.
원본 문서를 가지고 회의에 들어가 증거 사슬이 말하게 하고 싶다면, 그것이 한 경로입니다. 회의 전에 깃발된 섹션을 수정하고 싶다면, 그것이 다른 것입니다. 둘 다 정당합니다. 회의가 먼저 옵니다.
자주 묻는 질문
AI를 사용하지 않았음을 증명할 수 있나? 아니오. 어떤 도구도 당신의 작문 과정에 대한 부정을 증명할 수 없습니다. 당신이 할 수 있는 일은 "내가 이것을 썼습니다"가 더 단순한 설명이 되도록 증거 사슬을 구성하는 것입니다. 버전 히스토리, 원본 자료, 과정 기록, 그리고 당신의 텍스트가 왜 그렇게 보이는지에 대한 설명. 함께 쓰이면 검토자에게 점수 외에 볼 것을 줍니다.
버전 히스토리가 없다면? 가장 강한 단일 타임라인 증거를 잃지만, 모든 것을 잃지는 않습니다. 이른 초안의 파일 수정 날짜, 감독자에게 보낸 이메일 첨부, 클라우드 동기화 백업 폴더는 모두 타임스탬프를 가집니다. 그들은 버전 히스토리 창만큼 깨끗하지 않지만, 같은 이야기를 합니다.
교수님이 백분율의 스크린샷만 보내셨습니다. 무엇을 요청해야 하나? 전체 AI 작문 보고서를 PDF로. Turnitin의 FAQ는 학생이 표시기를 볼 수 없다고 말하지만, 강사가 PDF 다운로드 기능을 통해 보고서를 다운로드하고 공유할 수 있다고도 말합니다. 스크린샷이 아닌 PDF를 요청하라. 보고서는 강조가 어디 앉아 있는지, 몇 단어가 분석되었는지, 점수가 실제 숫자인지 별표인지 보여줍니다.
깃발된 섹션이 모두 내 문헌 고찰에 있습니다. 그것이 중요한가? 그렇습니다. Turnitin의 FAQ는 오탐과 관련된 특성으로 "content without a lot of structural variation" (영어 원문 그대로 인용)와 "text that has been paraphrased without developing new ideas" (영어 원문 그대로 인용)를 나열합니다. 문헌 고찰은 종합하고 요약하므로 둘 다에 부합합니다. FAQ의 다음 문장은 말한다: "If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated." (영어 원문 그대로 인용) 그것이 바로 검토자에게 그 정확한 이유로 점수를 할인하라고 말하는 회사입니다.
Turnitin 자신의 도움말 페이지에서 인용을 회의로 가져올 수 있나? 그렇습니다. 점수가 유일한 근거가 아니라는 진술, 단일 데이터 점이라는 진술, 오탐 특성에 대한 진술은 Turnitin의 도움말 문서에 출판되어 있습니다. 그들은 도구 제작자의 말이지, 당신의 말이 아닙니다. 그것들을 URL과 함께 인쇄하여 가져오는 것이 패러프레이즈하는 것보다 더 효과적입니다.
계속 읽기