제3자 AI 휴머나이저 테스트 읽는 법

입력과 출력을 인쇄하는 기능은 검사 가능한 증거를 제공합니다. 평결의 일부는 페이지에서 재구성할 수 있고, 일부는 페이지가 재현 가능하게 만들지 않은 자료나 판단에 의존합니다. 그 부분들을 구분하는 것이 유용한 기술입니다.

HumanPen 팀

· 10분

짧은 답변

공개된 테스트를 두 번 읽으십시오. 첫 번째 통과는 리뷰어가 내린 결론을 알려줍니다. 두 번째는 페이지에 인쇄된 증거에서 어떤 결론에 도달할 수 있는지 묻습니다. 2026년 8월 Tom's Guide 기사에서 한 발견은 직접 검증 가능합니다: 재작성 도구가 “적어도 15,000년 전”을 “수세기 전”으로 바꾸었고, 두 문장 모두 인쇄되어 있습니다. 리듬과 자연스러움에 대한 판단은 다릅니다. 동의할 수는 있지만, 기사는 그 판단을 다른 파일에 적용하기 위한 명시된 규칙을 제시하지 않습니다.

기사는 인기 있는 AI 휴머나이저를 테스트했습니다 — 그것들은 제 글쓰기를 훨씬 더 나빠지게 만들었습니다, Amanda Caswell 저, 2026년 8월 21일 공개. 2026년 8월 28일 페이지를 확인했습니다. 아래에 기사에 귀속된 인용문은 모두 그 렌더링된 기사에서 나온 것입니다: HumanPen 섹션의 인용문은 자사 제품 페이지 텍스트로 식별됩니다.

무엇보다 먼저 짚어야 할 것이 있습니다. 저희는 문서 재작성 도구를 판매하므로, 이 범주가 어떻게 논의되는지에 이해관계가 있습니다. 그 관심을 염두에 두십시오. 아래 집계는 다른 출판물이 인쇄한 문단을 사용하며, 이는 저희를 신뢰하지 않고도 되풀이할 수 있음을 뜻합니다.

테스트가 실제로 무엇이었는지

기사는 독자가 하나의 전후 예를 검사할 수 있을 만큼 설정의 충분한 부분을 인쇄합니다.

  • 원문은 생성된 것이었습니다: 리뷰어가 “ChatGPT에게 개의 가축화에 대한 짧은 에세이를 쓰게 하”였고, 그 에세이의 서론이 전부 인쇄되어 있습니다. 단순 공백 분할로 65단어입니다.
  • 그 한 문단이 재작성 도구에 통과되었고, 돌려받은 세 버전이 전부 인쇄되어 있습니다: Grammarly의 Humanizer, Rehumanize.io, Ace.ai입니다.
  • 페이지에는 두 탐지기, GPTZero와 Pangram이 지명되어 있고, 하나의 평결이 보고됩니다: Pangram이 Ace.ai 출력을 AI 생성으로 표시했습니다.
  • 기사는 “여러” 도구가 시도되었다고 말하며, 더 기술적인 내용으로 테스트를 실행했을 때 “벤치마크 점수와 버전 번호를 수반하여” 같은 문제가 나타났다고 합니다. 그 추가 실행은 서술되지만 인쇄되지는 않습니다.

따라서 가시적 말뭉치는 네 문단입니다: 하나의 입력과 세 개의 출력, 모두 같은 주제에 모두 영어입니다. 작은 증거 묶음이지만 검사 가능합니다. 페이지는 실행이 언제 일어났는지, 얼마나 걸렸는지, 어떤 설정이 쓰였는지 밝히지 않습니다.

세 가지 발견, 그리고 그것들은 같은 종류가 아닙니다

기사는 세 가지 문제를 보고하며, 그것들은 어디로든 가져가려 하면 완전히 다르게 행동합니다.

기사가 보고하는 것페이지가 검증용으로 주는 것직접 재구성할 수 있습니까?
“the rhythm became choppy and unnatural” (리듬이 끊기고 부자연스러워졌습니다)네 문단, 전부 인쇄됨페이지에 제시된 고정 규칙에 의한 것이 아닙니다. 네 개 모두를 읽고 자신의 견해를 가질 수는 있지만, 기사는 그 판단을 다른 문서에 적용하기 위한 채점 규칙을 공개하지 않습니다
“the tools changed facts or stripped away important context” (도구들이 사실을 바꾸거나 중요한 문맥을 제거했습니다)입력 문장과 출력 문장, 둘 다 축어적으로예. 두 텍스트에는 직접 검증 가능한 사실 변경이 하나 있습니다
“processing a draft through a humanizer actually increased its probability of being flagged” (초안을 휴머나이저에 통과시키는 것이 실제로 플래그될 확률을 높였습니다)한 문장, 더해 하나의 출력에 대한 탐지기 평결부분적으로. 단일 평결은 서술됩니다. 그 문장 뒤에 있는 여러 실행은 인쇄되지 않습니다

탐지기 결과는 이 기사의 주제 밖이며, 저는 세 번째 행 위에 무엇도 세우지 않을 것입니다. 그것은 증거의 경계를 표시하기 위해 포함되었습니다: 페이지는 하나의 지명된 평결을 보고하는 반면, 더 포괄적인 문장 뒤의 다른 실행은 인쇄되지 않습니다. 그 문장은 비율로 바뀌어서는 안 됩니다.

재구성할 수 있는 한 발견을 재구성하기

제 규칙을 말씀드리니, 이의를 제기하실 수 있습니다. 숫자 토큰은 `\d[\d,]*` 패턴으로 찾은, 내부 쉼표를 포함할 수 있는 최대 자릿수 연속입니다. 말뭉치는 그 페이지에 인쇄된 네 문단이며 그 이외는 아닙니다. 숫자는 동일한 토큰이 해당 출력 어딘가에 나타나면 살아남습니다. 저는 의미를 판단하지 않았습니다: 문자열을 맞추었습니다.

입력: “유전학적 및 고고학적 증거는 개가 적어도 15,000년 전에 고대 늑대 집단에서 내려왔음을 시사합니다.” · Rehumanize.io 출력: “유전학과 오래된 발견에 근거하면, 개가 수세기 전에 고대 늑대 무리에서 온 것으로 보입니다.” 기사 자신의 줄: “우리는 15,000년에서 '수세기'로 갔습니다.”

입력 문단에는 두 숫자 토큰, `15,000`과 `30,000`이 있습니다. 세 개의 인쇄된 출력은 두 토큰이 돌아올 여섯 번의 기회를 주고, 여섯 중 다섯이 돌아왔습니다. 돌아오지 않은 하나는 Rehumanize.io 출력의 `15,000`이며, 이것이 기사가 지명하는 표류입니다. 다른 두 출력은 두 토큰 모두를 돌려주었습니다. 같은 추출 문단에 대한 민감도 검사: `dogs`의 대소문자 무시 전체 단어 일치 계수는 각 문단에서 두 일치를 반환하므로, 검사는 한 곳에서 멈추지 않고 넷 모두를 읽고 있었습니다.

이제 그 숫자에 대한 정직한 부분입니다. 여섯은 두 숫자 × 세 인쇄 출력이며, 모두 페이지에 표시된 65단어 입력 하나에서 파생되었습니다. 그것은 공개일을 가진 기사에서 보고된 하나의 지명된 예를 검증합니다. 비율이나 순위, 자신의 파일에 대한 기대치에는 턱없이 부족합니다. 기사에서 가져갈 줄은 리뷰어 자신의 것입니다: “원문과 줄별로 대조하여 확인하지 않고서는 출력을 신뢰할 수 없습니다. 도구가 절약할 수 있는 시간은 빠르게 사라집니다.”

이런 종류의 오류가 교정을 살아남는 이유

“수세기 전”은 오타가 아닙니다. 문법적이지만, 그것이 내포하는 주장은 원문 문장의 주장이 아닙니다. 맞춤법 검사는 그 주장들을 비교하지 않습니다. 정확한 전후 비교는 그렇게 합니다.

페이지는 세 도구가 내부적으로 어떻게 작동하는지 밝히지 않으므로, 이 변경이 왜 일어났는지 말해줄 수 없습니다. 가시적 쌍이 보여주는 것은 더 좁습니다: 문장이 문법적인 채로, 특정 값이 넓은 시간 표지가 되었습니다. 리뷰어는 벤치마크 점수와 버전 번호를 두 가지 더 많은 예로 들고, “데이터 같은 세부사항은 특정 단어처럼 교환 가능하지 않습니다”고 씁니다. 학술 문서에서 같은 비교는 표본 크기, p값, 용량, 조항과 절 번호, 날짜, 따옴표 안의 단어, 인용 안의 저자-연도 쌍을 포함할 수 있습니다.

이 예에서 변경을 잡는 직접적인 방법은 돌려받은 문장을 원문과 비교하는 것입니다. 위험의 더 넓은 지도를 원하신다면, AI 휴머나이저에서 인용, 표, 수식에 무슨 일이 일어나는지가 별도 검사가 필요한 요소들을 다룹니다. 이미 잘못 돌아온 것이 있다면, AI 휴머나이저가 내 논문을 망쳤나? 인용과 서식 복원이 복원 순서를 다룹니다.

기능 테스트가 당신의 문서에 대해 말해줄 수 없는 것

잡지 기능은 벤치마크가 아니며, 그렇다고 한 적도 없으니, 이것은 불만이 아닙니다. 기사를 누군가에게—자신에게까지—인용하기 전에 머릿속에 두어야 할 목록입니다.

  • 비율. 한 문단, 세 인쇄 출력. “N%의 도구가 이것을 합니다”를 뒷받침할 분모가 여기에는 없습니다.
  • 다른 도구가 어떻게 행동하는지. 가시적 전후 비교는 세 제품을 지명합니다. 페이지에 표시되지 않은 제품이 어떻게 행동하는지 확정할 수 없습니다.
  • 문서에 무슨 일이 일어나는지. 인쇄된 네 문단에는 각주, 번호가 매겨진 표, 상호 참조, 참고문헌 목록이 없습니다. 기사는 추가 기술 콘텐츠 실행에 대해 언급하되 인쇄하지 않으므로, 가시적 말뭉치는 파일 계층의 질문에 답할 수 없습니다.
  • 가시적 실행이 언제 일어났는지. 2026년 8월 21일은 기사의 공개일입니다. 페이지는 제품 실행의 날짜를 밝히지 않으므로, 출력을 그날에 고정할 수 없습니다.
  • 당신의 언어에서 무슨 일이 일어나는지. 네 문단 모두 영어입니다.

그것이 주는 것은 제품 페이지가 아닌 제3자 출판물의 증거입니다: 가시적 사실 변경을 동반한 인쇄된 전후입니다. 그것은 리더보드가 아니라 검사를 만들기에는 충분합니다. 문서 형식 주장과 다운로드 가능한 테스트 데이터를 겨냥한 별도의 방법은, AI 휴머나이저의 “서식을 보존한다”는 주장 검증 방법을 참조하십시오.

공개된 예를 직접 재검증하십시오

어떤 도구에도 텍스트를 보내지 않고 위 집계를 재현할 수 있습니다. 이것은 기사가 인쇄하는 것을 검사하며, 그 더 포괄적인 평결 뒤에 있는 비인쇄 실행은 아닙니다.

  1. 기사를 열고 인쇄된 네 문단을 찾으십시오: 개 가축화 입력과 Grammarly, Rehumanize.io, Ace.ai 출력입니다.
  2. 명시된 규칙으로 원문 숫자 토큰을 추출하십시오. 즉 내부 쉼표를 포함할 수 있는 최대 자릿수 연속입니다. 입력은 `15,000`과 `30,000`을 주어야 합니다.
  3. 각 출력에 그 정확한 문자열이 있는지 확인하십시오. 이열 표에 있음 또는 없음을 기록하십시오. 그것은 백분율이 아니라 여섯 개의 셀을 만듭니다.
  4. 비인쇄 주장은 별도의 열에 두십시오. 기술 콘텐츠 실행, 제품 설정, 실행 날짜, 탐지기 값은 기사에서 보고되지만 가시적 문단에서 재구성할 수 없습니다.

표에는 다섯 개의 있음 셀과 하나의 없음 셀이 있어야 합니다. 그렇지 않다면, 결론을 내리기 전에 문단 앵커와 토큰 규칙을 비교하십시오. 자신의 문서를 테스트하려면, 별도의 파일 수준 프로토콜을 사용하십시오: AI 휴머나이저의 “서식을 보존한다”는 주장 검증 방법은 의도적으로 어려운 샘플을 다루고, 제출 전에 휴머나이즈된 Word 문서를 검토하는 방법은 돌려받은 파일을 다룹니다.

경계가 그어지는 곳

처음에 이해관계를 선언했으므로, 자사 페이지가 말하는 것에 한정된 자사 부분을 말씀드립니다. HumanPen은 텍스트 상자가 아니라 파일을 받고, 범위는 무엇이든 실행되기 전에 사용자가 정하는 것입니다: 문단을 직접 추가하거나 Turnitin 또는 iThenticate 보고서를 가져올 수 있고, 페이지는 문단이 엔진이 재작성하는 최소 단위라고 진술하여, 한 문단의 일부를 덮는 선택은 “is expanded to the full paragraph and shown that way for you to confirm. Everything else is left untouched.” (전체 문단으로 확장되어 확인을 위해 그렇게 표시됩니다. 나머지는 모두 그대로 남습니다.) 범위 안에 있는 것에 대한 명시된 목표는 “preserve meaning, structure, terminology, citations, layout, and styles while rewriting only the necessary language.” (필요한 언어만 재작성하면서 의미, 구조, 용어, 인용, 레이아웃, 스타일을 보존하는 것입니다.) 적격 결과는 무료로 계속 AI를 낮출 수 있습니다.

이것은 경계가 어디에 있는지에 대한 서술이지, 그 안에 무엇이 돌아오는지에 대한 주장이 아닙니다. 자사 FAQ는 해당 답변을 “Review complex documents after download,” (다운로드 후 복잡한 문서를 검토하십시오,)로 끝맺으며, 이 전체 기사가 그것에 찬성하는 논증이므로 저는 그 줄이 제거되기를 원하지 않습니다.

워크플로우의 그 어떤 것도 위의 네 번째 단계를 제거하지 않습니다. 더 작은 범위는 비교할 문단 목록이 더 짧다는 것을 뜻하며, 대안이 온 논문일 때 실질적인 절약입니다. 그것은 범위에 있던 문단에 대한 비교를 건너뛸 이유가 아닙니다.

자주 묻는 질문

Tom's Guide 테스트 전체를 검증했습니까? 아니오. 가시적 전후를 재구성하고 명시된 `15,000`에서 “수세기”로의 변경을 찾았습니다. 페이지는 다른 기술 실행, 설정, 날짜, 탐지기 값을 인쇄하지 않으므로, 이 기사는 그 기능의 그 부분들을 감사하지 않습니다.

왜 리뷰어의 전체 평결을 그대로 되풀이하지 않습니까? 가시적 입력이 인용, 표, 참고문헌 목록이 없는 65단어의 생성 에세이 서론인 반면, 기사는 인쇄하지 않는 기술 실행에도 언급하기 때문입니다. 인쇄된 사실 변경은 독립적으로 검증할 수 있습니다. 더 포괄적인 평결은 더 크고 일부만 공개되지 않은 실행 집합에 대한 리뷰어의 보고로 남습니다.

이것이 숫자가 항상 바뀐다는 뜻입니까? 아니오. 페이지의 여섯 숫자 반환 중 다섯이 온전히 돌아왔습니다. 가시적 예는 이런 종류의 변경이 한 번 일어났고 정확한 비교가 그것을 잡는다는 것을 확립합니다. 보통의 읽기가 그것을 잡을지, 문제가 흔한지 드문지는 확립하지 않습니다.

제 파일을 테스트하고 싶으면 어디서 시작합니까? 위에 링크된 서식 보존 별도 프로토콜을 사용하십시오. 그것은 이미 의도적으로 어려운 샘플 구축과 돌려받은 산출물 비교를 다루며, 이 페이지는 공개된 기능에 인쇄된 증거의 재구성에 머뭅니다.

이런 테스트를 읽은 후 벤더에게 무엇을 물어야 합니까? 당신의 것 같은 자료로 만든 전후를 요청하고, 예가 가시적으로 증명하는 것과 벤더가 그것에 대해 말하는 것을 분리하십시오. 집계가 나타나면, 무엇이 계수되었는지, 분모는 무엇이었는지, 어떤 규칙이 그 숫자를 만들었는지 물으십시오.

계속 읽기