¿Son precisos los detectores de IA? No como veredicto. Estiman la probabilidad a partir de patrones en tu texto, no coinciden entre sí y señalan una gran cantidad de escritura humana. Una puntuación es una señal sobre las palabras de la página, no una prueba de quién las escribió. La vista a nivel de oración es lo que realmente puedes usar.
Puntos clave
- La puntuación de un detector es una estimación de probabilidad, no una prueba de autoría. Ninguna herramienta puede ver quién escribió las palabras.
- Dos detectores no coinciden porque usan señales, datos de entrenamiento y umbrales diferentes. El mismo borrador, respuesta diferente.
- La escritura humana se marca. En nuestra propia medición del 19/09/2026, 17 de 46 guías DeAIze escritas a mano superaron un umbral de marcado del 30%.
- Las puntuaciones a nivel de oración superan a un único número de documento. Te muestran qué líneas llevan la señal.
- Puedes revisar tu propio borrador en minutos y corregir las oraciones específicas que suenan hechas por una máquina.
- Nunca reescribas las ideas de otra persona para esquivar una puntuación. El argumento, los datos y las conclusiones tienen que ser tuyos.
Qué cambió para que estas puntuaciones sean más difíciles de confiar
La detección dejó de ser una novedad y se convirtió en infraestructura. El indicador de escritura con IA de Turnitin ahora aparece en los flujos de trabajo de calificación de las instituciones que lo usan. GPTZero, Copyleaks, Originality.ai y Sapling venden licencias a escuelas, editoriales, agencias y equipos de contratación. Un número que antes era una curiosidad ahora está vinculado a calificaciones, contratos y solicitudes de empleo.
Al mismo tiempo, las cosas que buscan los detectores se han extendido a la escritura humana común. El texto predictivo completa tu oración. Las herramientas de traducción suavizan tu gramática. Los editores pasan los borradores por procesos de reescritura. Un escritor no nativo de inglés que aprendió frases académicas formales escribe exactamente en el registro que los detectores asocian con texto generado.
El resultado es que ahora una puntuación tiene consecuencias reales mientras sigue siendo genuinamente incierta. Esa discordancia es todo el problema. Nada en las herramientas cambió para convertir el número en un hecho. Solo aumentó lo que está en juego.
Por qué dos detectores no coinciden sobre el mismo borrador
Cada detector es un modelo entrenado con una mezcla distinta de texto, que evalúa un conjunto distinto de señales y corta el resultado en un umbral distinto. Cuatro cosas impulsan la discrepancia.
Datos de entrenamiento distintos. Un detector entrenado intensamente con la salida de un modelo aprende los hábitos de ese modelo. Si le das texto de un modelo distinto, o de un humano que casualmente comparte un hábito, la confianza baja o sube por razones que no tienen nada que ver con la autoría.
Señales distintas. Algunas herramientas se apoyan en la perplejidad y la variabilidad, la previsibilidad estadística de tus elecciones de palabras y la variación en la longitud de las oraciones. Otras se apoyan en características de clasificador aprendidas de principio a fin. Algunas combinan ambas y añaden sus propias heurísticas. Las herramientas basadas en perplejidad son sensibles al vocabulario; las basadas en clasificadores son sensibles a la estructura.
Umbrales distintos. Un proveedor ofrece un corte conservador que solo marca pasajes de alta confianza. Otro ofrece un corte agresivo que marca cualquier cosa por encima de un listón bajo. El mismo borrador produce dos etiquetas distintas sin ningún cambio en el texto.
Diferente granularidad. Una puntuación a nivel de documento promedia todo, por lo que un solo párrafo que suena a máquina puede arrastrar un documento humano por encima del umbral. Una puntuación a nivel de oración te muestra dónde está realmente la señal.
Si quieres ver cuáles de tus oraciones llevan la señal, pasa el borrador por el detector de IA primero. Puntúa el documento y resalta cada oración, para que puedas discutir con una línea específica en lugar de un número que no puedes inspeccionar.
Qué significa esto para ti, honestamente
Si escribiste el borrador tú mismo y obtuviste una puntuación alta, no te estás imaginando el problema. Nuestra propia medición del 2026-09-19 lo demuestra. Puntuamos 46 guías DeAIze escritas a mano con nuestro detector con un umbral de marcado del 30%: puntuación media de IA 27%, mediana 25%, rango 0-55%. Diecisiete de las 46 fueron marcadas. Esos son documentos escritos por personas, sobre su propio trabajo, sin ningún modelo en el proceso.
Así que una marca en escritura humana es normal, no exótico. Eso corta en ambos sentidos, y vale la pena ser directo sobre la segunda dirección: la salida de modelo sin editar en la misma ejecución obtuvo una media del 35% con un rango de 25-49%. Las dos distribuciones se superponen. Una sola puntuación no puede separarlas limpiamente, y cualquier herramienta que afirme lo contrario está exagerando lo que puede hacer una estimación de probabilidad.
La consecuencia práctica es que una puntuación es evidencia sobre el texto, no sobre ti. Si te acusan, el movimiento útil es mostrar tu proceso: borradores, notas, historial de versiones, fuentes. Si te auto-revisas antes de enviar, el movimiento útil es encontrar las líneas específicas que se leen como hechas por máquina y corregirlas. Ambos caminos pasan por la inspección a nivel de oración.
Un límite honesto más. Nuestra medición también encontró 3 frases reveladoras de IA por cada 100 palabras en la muestra humana frente a 1 por cada 100 palabras en la salida del modelo sin editar. Los humanos, en otras palabras, usaron más de las frases hechas que la gente asocia con la IA que el modelo. Las señales superficiales son una guía débil. La estructura y el ritmo importan más.
Si tu borrador es asistido por IA en lugar de completamente tuyo, las reglas son diferentes y vale la pena leerlas con atención. Escritura asistida por IA para estudiantes cubre dónde está el límite en la mayoría de las instituciones.
Cómo revisar tu propio texto oración por oración
No necesitas una suscripción para hacer esto. Necesitas dejar de leer tu borrador como un todo y empezar a leerlo línea por línea.
- Puntúa el documento, luego ignora la puntuación del documento. Abre el borrador en un detector que informe la salida por oración. El número principal es lo menos accionable en la pantalla.
- Ordena las oraciones por probabilidad de IA. Las primeras son tu lista de trabajo. Todo lo demás es ruido por ahora.
- Lee en voz alta cada oración marcada. Las oraciones hechas por máquina tienden a ser gramaticalmente perfectas, uniformemente ponderadas y ligeramente vacías. Si puedes eliminar la oración sin perder una idea, esa es la señal.
- Revisa la variación en la longitud de las oraciones a ojo. Mira cinco oraciones consecutivas. Si todas tienen aproximadamente la misma longitud y forma, esa uniformidad es a lo que reacciona el detector. La escritura real es irregular.
- Busca los movimientos estereotipados. Aperturas que anuncian lo que hará el párrafo. Cierres que lo repiten. Frases de transición que no hacen nada. Listas de tres elementos donde dos bastarían.
- Vuelve a puntuar después de las ediciones. Cambia una cosa a la vez cuando puedas, para que aprendas qué ediciones mueven la lectura y cuáles no.
Para una explicación más profunda de lo que los modelos están midiendo realmente, cómo funciona la detección de IA recorre las señales sin el marketing.
Cómo corregir las oraciones marcadas
Corregir es más mecánico de lo que la gente espera, y se trata principalmente de restaurar la especificidad.
| Patrón problemático | Cómo se ve | Qué hacer en su lugar |
|---|---|---|
| Ritmo uniforme | Cinco oraciones de longitud y estructura similares | Divide una, fusiona dos, empieza una con una conjunción |
| Encuadre vacío | “Esta sección explorará los factores clave” | Elimínalo y empieza con el factor |
| Sustantivos abstractos | “implementación”, “optimización”, “consideraciones” | Nombra la cosa: el archivo, la fecha límite, la persona |
| Hedging uniforme | Cada afirmación suavizada de la misma manera | Comprométete con la afirmación, o elimínala |
| Finales reformulados | La oración final repite la primera | Termina con el dato más reciente |
| Frases hechas | El vocabulario que todos ahora reconocen | Dilo como lo dirías en voz alta |
Aquí hay una ilustración, no una puntuación real. Antes: “Es importante considerar los diversos factores que contribuyen a una estrategia de contenido efectiva, ya que estos elementos juegan un papel crucial en la consecución de resultados óptimos.” Después: “La estrategia de contenido falla por razones aburridas. Elegiste el canal equivocado, o dejaste de publicar en la tercera semana.” Misma idea, diferente densidad. La segunda tiene un sujeto, un verbo y una afirmación.
Si estás trabajando en un borrador más largo, limpiar patrones hechos por máquinas repasa esto a nivel de párrafo, y cómo reelaborar texto de ChatGPT cubre mantener tu significado intacto mientras recortas el relleno.
Una advertencia sobre el atajo. Las herramientas que reescriben todo, oración por oración, cambiarán tu significado junto con tu ritmo. Si una pasada de reescritura no puede decirte si el significado sobrevivió, estás cambiando un problema por uno peor. El humanizador de DeAIze ejecuta un bucle cerrado por esta razón: puntúa el texto, reescribe solo las oraciones marcadas, mantiene una reescritura solo cuando la similitud semántica indica que el significado se mantuvo, luego vuelve a puntuar y te muestra el antes y el después. En el párrafo de ejemplo en el sitio, una puntuación de IA del 92% se convierte en 4%.
Los límites son reales. Reportamos una reducción promedio de la puntuación de IA del 60 %+ después de humanizar, con un mejor caso del 71 %, y esas son nuestras propias puntuaciones predichas, no un veredicto de ningún detector externo. Las verificaciones cruzadas se ejecutan contra API reales de detectores externos donde estén configuradas, incluidas GPTZero, Turnitin, Copyleaks, Originality.ai y Sapling, en lugar de confiar en una estimación interna. Ninguna herramienta, incluida la nuestra, puede garantizar lo que dirá otro detector.
Cuando un detector tiene razón y aun así tienes un problema
A veces la puntuación es precisa y el problema es el borrador. Si generaste una primera versión con un modelo y la entregaste casi sin cambios, el detector está haciendo su trabajo. La solución no es disfrazar el texto. Es hacer el trabajo que el borrador omitió: verificar las afirmaciones, añadir los ejemplos que solo tú tienes, eliminar las secciones que no puedes defender en una conversación.
Ese es también el límite honesto de toda esta categoría. Un humanizador reduce los falsos positivos en tu propia escritura y limpia tus propios borradores asistidos por IA. No es una forma de hacer pasar el trabajo de otra persona, y ninguna herramienta seria debería venderse así. Si eres un escritor no nativo de inglés al que se le señala por frases formales que te enseñaron, por qué un detector de IA señala a escritores no nativos de inglés es la lectura relevante.
¿Listo para ver qué frases suenan hechas por una máquina?
Deja de discutir con un solo número. Obtén la vista línea por línea y trabaja a partir de ahí.
- Ejecuta el detector de IA gratuito — 200 palabras al registrarte, sin tarjeta de crédito, resaltado a nivel de frase para que veas exactamente qué líneas contienen la señal.
- Abre el editor de borradores — reescribe solo las frases marcadas, mantén un cambio solo cuando el significado se conserve, luego vuelve a puntuar y compara antes y después.
- Consulta los precios — créditos de pago por uso que nunca caducan, sin suscripción. Starter $20.99 por 1,000 palabras, Standard $44.99 por 3,000, Pro $99.99 por 10,000, Max $199.99 por 30,000.
- Crea una cuenta y pruébalo con el párrafo que realmente te preocupa. Las cargas aceptan .txt, .docx y .pdf, y reescribir un documento de Word conserva fuentes, estilos y tablas.
La detección y la reescritura cubren el inglés y otros 9 idiomas, la interfaz está disponible en 10. Tu texto se procesa solo para la tarea actual, nunca se usa para entrenamiento ni se revende. Y mantén el enfoque claro: una puntuación de detector es una estimación de probabilidad, no una prueba de autoría. Úsala para encontrar frases débiles en tu propio trabajo.