AI 판별기는 신비롭게 느껴지지만, 사실 통계적 분류기에 불과합니다. 판별기가 사용하는 신호를 이해하는 것이 자신 있게 글을 쓰는 첫걸음이며, 점수가 잘못 나왔을 때 이를 낮추는 방법이기도 합니다.
핵심 신호: 혼란도(perplexity)
언어 모델은 가장 가능성 높은 다음 단어를 예측하여 텍스트를 생성합니다. 혼란도(perplexity) 는 모델이 여러분의 텍스트에 있는 각 단어에 얼마나 “놀랄”지를 측정합니다. 혼란도가 낮다는 것은 여러분의 단어가 모델이 선택했을 바로 그 단어였다는 뜻이며, 이는 기계 생성의 강한 단서입니다. 인간의 글쓰기는 자주 놀라움을 줍니다. 인간은 관습적이지 않은 선택을 하기 때문입니다.
리듬 신호: 버스트성(burstiness)
버스트성(burstiness) 은 문장 길이와 구조의 변화를 측정합니다. 인간은 몰아치듯 씁니다. 짧은 한 방, 그다음 길게 이어지는 절, 그다음 단편 조각이 이어집니다. AI 출력은 기묘할 정도로 균일합니다. 판별기는 이러한 균일함을 또 하나의 지문으로 간주합니다.
더 깊은 특징들
이 두 가지 외에도, 탐지기는 종종 다음을 살펴봅니다:
- 구문적 균일성 — 반복되는 문장 형태와 절 패턴.
- N-gram 가능도 — 흔한 단어 연속의 확률.
- 문체적 평탄함 — 관용구, 개성, 구체적 세부의 부족.
점수가 산출되는 방식
분류기는 이러한 특징에 가중치를 부여하고 확률을 출력합니다: “이 텍스트는 X% 확률로 AI 생성일 가능성이 있습니다.” 도구마다 신호에 다르게 가중치를 부여하기 때문에, 같은 문단이 한 탐지기에서는 30%를, 다른 탐지기에서는 80%를 기록할 수 있습니다. AI 탐지기로 직접 측정해 볼 수 있습니다.
이것이 좋은 소식인 이유
탐지는 의도가 아니라 패턴을 측정하기 때문에 점수는 바뀔 수 있습니다. 리듬을 다양하게 하고, 정형화된 전환을 없애고, 구체적인 세부를 추가하면 점수가 떨어집니다. 도구가 이를 자동화할 수 있습니다: DeAIze는 의미를 보존하면서 탐지 피드백 루프에서 표시된 문장을 인간화합니다. 홈페이지에서 확인하거나, 단어 팩에 대한 가격을 검토하세요.