AI 탐지기는 종종 표절 검사기처럼 취급되지만, 근본적으로 다릅니다. 표절은 데이터베이스와의 일치 여부를 확인하는 것이고, AI 탐지는 통계적 추측입니다. 이러한 차이가 탐지기의 정확성을 좌우합니다.
숫자가 실제로 보여주는 것
독립적인 테스트에서 실제 편차가 발견됩니다. GPTZero, Turnitin, Originality.ai와 같은 탐지기는 명백한 기계 생성 텍스트를 높은 신뢰도로 잡아내지만, 다음과 같은 경우에는 정확도가 떨어집니다:
- 짧은 문단 — 측정할 신호가 적습니다.
- 과도하게 편집된 텍스트 — 다듬는 과정에서 탐지기가 찾는 리듬이 평탄해집니다.
- 비원어민 또는 격식 있는 글쓰기 — AI와 무관한 이유로 통계적으로 “매끄러워” 보일 수 있습니다.
진짜 위험은 오탐(false positive)입니다
미탐(false negative)은 불편함에 그칩니다. 하지만 오탐(false positive), 즉 사람이 쓴 글이 AI로 판정되는 것은 심각한 결과를 초래할 수 있습니다. 탐지기들은 이 점을 인정하여 이분법적 판정 대신 확률과 신뢰도 임계값을 보고합니다. 그러나 임계값도 여전히 오류가 발생할 수 있으며, 그 stakes는 클 수 있습니다.
점수가 서로 다른 이유
같은 문단이라도 도구마다 점수가 다르게 나올 수 있습니다. 각 탐지기가 신호를 다르게 가중치를 두고 서로 다른 데이터로 학습되었기 때문입니다. 직접 확인하고 싶다면 한 지문을 AI 탐지기에 넣고 비교해 보세요.
스스로를 보호하는 방법
- 초안을 보관하세요 — 버전 기록이 증거가 됩니다.
- 다양한 리듬과 구체적인 디테일로 작성하세요 — 자연스러운 인간의 글은 점수가 더 낮습니다.
- 제출 전에 확인하세요 — 점수를 확인한 뒤 표시된 문장을 수정하세요.
점수가 높다고 해서 문장 하나하나와 싸울 필요는 없습니다. DeAIze는 의미를 유지하는 반복 과정을 통해 표시된 구절을 인간화합니다. 홈페이지에서 사용해 보고, 사용량에 맞는 요금제를 확인하세요.