Los detectores rara vez se explican. Entregan un porcentaje y te dejan adivinando qué midieron. Debajo de ese número suele haber dos señales estadísticas con nombres raros: perplejidad y burstiness. Entenderlas cambia cómo lees cada puntuación — y por qué el mismo texto puede parecer humano en una herramienta y artificial en otra.
Perplejidad: ¿qué tan predecible es esta frase?
La perplejidad mide qué tan sorprendido está un modelo de lenguaje con cada palabra. Una frase hecha de palabras comunes y esperadas tiene perplejidad baja: el modelo ya la veía venir. Una frase con palabras raras, combinaciones inusuales o giros bruscos tiene perplejidad alta: el modelo no la esperaba.
El texto generado por IA tiende a la perplejidad baja porque los modelos eligen palabras probables por diseño. La escritura humana sube y baja: una frase simple, luego una extraña, luego jerga que solo un iniciado usaría. Los detectores tratan la perplejidad baja sostenida como huella de máquina.
El matiz: predecible no es lo mismo que artificial. Los contratos, la documentación técnica y los ensayos de principiante se leen con perplejidad baja porque el género exige frases estándar. Un detector no distingue entre "escrito por un modelo" y "escrito con fórmula".
Burstiness: ¿dónde está el ritmo?
El burstiness mide la variación: longitud, complejidad y estructura de las frases a lo largo del texto. Los humanos alternamos: un golpe de tres palabras, luego una explicación larga y sinuosa, luego un fragmento. Con intención. Los modelos derivan hacia el medio: frases medianas, complejidad mediana, ritmo constante, párrafo tras párrafo.
Es la señal que casi todos sienten antes de poder nombrarla. Lee un texto sospechoso en voz alta. Si cada frase cae con el mismo peso y la misma longitud, el burstiness es bajo — y la mayoría de los detectores se inclinará hacia lo artificial.
Pero la uniformidad también tiene causas humanas. La edición ajustada aplana el ritmo. Las guías de estilo lo exigen. Quien escribe con cuidado en un segundo idioma produce frases parejas y correctas. Todo eso se lee como "burstiness bajo" sin que haya máquina de por medio.
Por qué ambas señales cambian
Ninguna señal es estable en todos los contextos, y por eso los porcentajes bailan:
- Longitud. Las muestras cortas le dan a la estadística casi nada con qué trabajar. Un párrafo solo puede puntuar cualquier cosa; el mismo texto dentro de tres páginas se estabiliza.
- Género. La poesía y los chats varían muchísimo; los contratos y manuales no. Un detector entrenado con ensayos lee mal ambos extremos.
- Edición. Cada pasada de revisión — humana o automática — suaviza el texto hacia el promedio. La escritura humana muy pulida converge a la misma estadística que el texto generado.
- Familiaridad del tema. Escribir sobre un tema trillado atrae frases estándar (perplejidad baja). Escribir desde experiencia fresca rompe patrones (perplejidad alta). Mismo autor, distintas puntuaciones.
Cómo leer las dos señales juntas
Tres reglas mantienen la perplejidad y el burstiness útiles en vez de engañosos:
- Compara puntuaciones solo dentro de la misma herramienta. Cada detector calibra sus escalas distinto; un número de uno no es evidencia en otro.
- Repite la prueba antes de actuar. Pasa el mismo texto dos veces, y usa una muestra más larga cuando la primera es corta. Las puntuaciones que oscilan entre intentos nunca fueron veredictos.
- Fija el umbral antes de probar. Decide qué pasa por encima y por debajo de tu línea — revisión manual en ambos lados — en vez de negociar con el número después.
Vortixy y el enfoque de revisar primero
La respuesta productiva a una puntuación extraña no es un detector mejor. Es un mejor borrador: hechos verificables, una idea por párrafo, frases concretas en vez de relleno y un ritmo que varía a propósito. Vortixy revisa el borrador en busca de claridad, estructura, voz y consistencia factual, explica cada problema y devuelve una revisión que aceptas o ajustas. Tú conservas la decisión; el reporte muestra el trabajo.
Pruébalo en el chat: revisa mi borradorPreguntas frecuentes
¿Qué es el burstiness en la detección de IA?
Es la variación en longitud y complejidad de las frases de un texto. El burstiness alto — golpes cortos mezclados con explicaciones largas — se lee humano. La uniformidad sostenida se lee artificial para la mayoría de los detectores, aunque la edición, las guías de estilo y la escritura cuidadosa también aplanan el ritmo.
¿Qué es la perplejidad en la detección de IA?
Es qué tan predecible es cada palabra para un modelo de lenguaje. Perplejidad baja significa frases esperadas y comunes; alta significa elecciones sorprendentes. El texto generado tiende a lo bajo porque los modelos prefieren palabras probables — pero también los contratos, los manuales y la escritura humana formularia.
¿Qué porcentaje de detector de IA es malo?
No hay un porcentaje malo universal porque las escalas difieren por herramienta y ambas señales cambian con longitud, género y edición. Fija tu propio umbral antes de probar, exige acuerdo entre dos herramientas y confirma con lectura humana antes de cualquier decisión importante.
¿Por qué mi texto humano marca como IA?
Las causas típicas son muestras cortas, géneros formales o técnicos, edición intensa que parejó el ritmo y redacción cuidadosa que bajó la perplejidad. Alarga la muestra, revisa si el género mismo es formulario y evalúa el texto por calidad — publicable y artificial son preguntas distintas.