Cómo probamos
Esta página indica exactamente qué mide DeAIze, cómo se acepta una reescritura y cómo interpretar las cifras que publicamos. Está redactada para que cualquiera pueda comprobar nuestras afirmaciones con su propio texto.
1. Qué es una puntuación de detección
Los detectores no detectan la autoría; detectan regularidad estadística. El texto generado por máquina tiende a ser más predecible que la escritura humana: menor perplejidad, ritmo de frase más plano, menos sorpresas léxicas. Cada puntuación que ves, incluida la nuestra, es una estimación de probabilidad a partir de esa señal, no una medición de quién escribió el texto.
2. Puntuación a nivel de frase
Una única puntuación del documento no te dice nada sobre dónde está el problema. Resalta los rastros de IA por frase: identifica exactamente qué líneas reescribir. Las puntuaciones por frase son sobre las que actúa el bucle de reescritura, y son las que el banco de trabajo resalta.
3. El bucle cerrado
Reescribe, compara con tu significado original y conserva la versión que suene a ti. Un candidato de reescritura se acepta solo cuando la similitud semántica con el original supera un umbral, por lo que se preserva el significado y por lo que la herramienta reporta un "reembolso automático en caso de no operación" cuando no puede mejorar un pasaje en lugar de inventar un cambio.
4. Verificaciones cruzadas del detector
Una predicción de nuestro propio modelo no es evidencia. Donde se configura una API de detector, el paso de verificación envía el texto reescrito al detector real y registra ese resultado. El recuento de esas ejecuciones se publica en la página de estadísticas para que el número de verificaciones de terceros detrás de nuestras cifras sea visible. Una tasa de aprobación reportada no es una verificación cruzada: solo las ejecuciones enviadas realmente a una API de detector se cuentan allí.
5. Qué significa la "puntuación humana predicha"
Es la estimación de nuestro propio modelo de cuán humano se lee el resultado — una métrica direccional para rastrear la mejora, no una puntuación oficial de ningún detector de terceros. Cuando citamos un número de terceros (GPTZero, Turnitin, Copyleaks, Originality.ai, Sapling) lo decimos y, cuando podemos, registramos la ejecución como una verificación cruzada.
Puntuaciones humanas reportadas por el detector. Las puntuaciones humanas mostradas en la página de inicio y en la página de estadísticas son cifras de primera parte que DeAIze reporta para su propia salida de reescritura. Los proveedores de detectores no las publican y no las han auditado, y no son una garantía para ningún documento individual. El indicador de escritura con IA de Turnitin no tiene una API de puntuación pública, por lo que la entrada de Turnitin no es una lectura de API en vivo; los otros cuatro pueden volver a ejecutarse a través de sus API públicas, y esas ejecuciones se cuentan como verificaciones cruzadas según el §4. Fechamos las cifras y no las presentamos como un benchmark independiente.
6. Límites y divulgación
- Las puntuaciones de los detectores varían según la versión, el idioma, la longitud del texto y el dominio. Un número sin una fecha y una versión del detector no es reproducible, por lo que fechamos nuestras cifras publicadas.
- El rendimiento en idiomas distintos del inglés es más débil que en inglés, y los textos cortos son más ruidosos que los largos.
- Cuando publicamos un benchmark, este incluye su tamaño de muestra, fecha de prueba y versiones del detector. Las puntuaciones humanas en la página de inicio se etiquetan como cifras reportadas por el propio interesado en lugar de un benchmark auditado, porque eso es lo que son.
- Los falsos positivos son reales y perjudiciales. Si un detector marca tu propia escritura, humanizar tu borrador es una respuesta legítima ante un guardián probabilístico — tergiversar el trabajo de otra persona no lo es.
Correcciones
Si alguna cifra aquí no puede reproducirse, avísanos y la corregiremos: [email protected].