Saltar al contenido

Para todos · 7 min de lectura

El mejor detector de IA en español: qué dicen los estudios

Qué dicen los estudios independientes de GPTZero, Turnitin, ZeroGPT, Pangram, Compilatio y Copyleaks, por qué no hay un ranking fiable en español y cómo probarlos tú.

Equipo de Detector IA · Actualizada el

Respuesta corta: nadie lo sabe con certeza. No hemos encontrado ninguna comparativa independiente y revisada por expertos de los detectores comerciales con textos en español. Los estudios serios están hechos en inglés, y las cifras de los fabricantes («99 % de acierto») no se pueden comprobar porque usan datos propios.

Lo que sí se puede hacer es mirar qué dicen esos estudios, qué publica cada herramienta sobre sí misma y, sobre todo, probarla con textos tuyos antes de fiarte. Al final te contamos cómo.

Lo que dicen los estudios independientes

  • Universidad de Chicago (2025). Brian Jabarian y Alex Imas compararon Pangram, GPTZero, Originality.ai y un modelo abierto con textos en inglés de seis tipos (noticias, blogs, novelas, reseñas, currículos) escritos por personas y, con los mismos encargos, por GPT, Claude y Gemini. Pangram tuvo errores casi nulos; GPTZero y Originality quedaron en un segundo escalón; el modelo abierto marcó como IA entre el 30 y el 78 % de los textos humanos. Con textos pasados por un «humanizador», GPTZero dejó escapar la mitad o más de la IA.
  • Estudio europeo (Weber-Wulff y otros, 2023). Probó 14 herramientas, entre ellas Turnitin, GPTZero, ZeroGPT y Compilatio. Conclusión: ninguna era «precisa ni fiable», tendían a dar por humano el texto de IA y acertaban mucho menos si el texto se parafraseaba o se traducía. Son versiones de 2023: hoy pueden ser mejores.
  • Stanford (Liang y otros, 2023). Siete detectores marcaron como IA, de media, el 61 % de las redacciones humanas de estudiantes de inglés como segunda lengua. El vocabulario sencillo se confunde con el de una máquina.
  • En español, AuTexTification (2023). Una competición científica organizada en España para distinguir textos humanos y de IA en español e inglés. El mejor de los 36 equipos llegó a una puntuación (F1) de 0,71 en español sobre 1: detectar IA en español era difícil incluso para los especialistas, y eso fue con modelos de 2023.

Detector por detector

Solo lo que se puede comprobar en las fuentes del final. Ordenados sin ningún criterio de calidad: con los datos públicos no se puede hacer un ranking honesto en español.

Qué se sabe de cada detector de IA
DetectorAccesoPruebas independientes
TurnitinSolo a través de tu centro (licencia institucional).Entre las 14 herramientas del estudio europeo de 2023, que concluyó que ninguna era «precisa ni fiable». Detecta textos en español desde 2024; no hemos encontrado ninguna prueba independiente de su modelo en español.
GPTZeroWeb gratuita con límite de caracteres; planes de pago.Estudio de la Universidad de Chicago (2025, en inglés): pocos falsos positivos en textos medianos y largos, pero con textos «humanizados» deja escapar la mitad o más de la IA.
PangramPlan gratuito limitado y planes de pago.El mejor del estudio de Chicago: errores casi nulos y el único que seguía detectando bien la IA con un límite de falsos positivos del 0,5 %. Probado en inglés.
ZeroGPTWeb gratuita; planes de pago.Entre las 14 herramientas del estudio europeo de 2023 (versión de entonces). No conocemos pruebas independientes recientes ni en español.
CompilatioLicencia institucional; lo usan universidades españolas.Entre las 14 herramientas del estudio europeo de 2023. No conocemos pruebas independientes de su detector de IA en español.
CopyleaksWeb con planes de pago.No hemos encontrado pruebas independientes revisadas por expertos, ni en inglés ni en español.

¿Por qué no los hemos probado nosotros?

Lo pensamos. Pero las condiciones de uso de estas webs prohíben usarlas con herramientas automáticas, y algunas prohíben expresamente usar sus resultados para comparar o mejorar un detector de la competencia. Preferimos respetarlas y no publicar una «comparativa» hecha a escondidas. Lo que sí hacemos es publicar todas nuestras cifras: tú puedes poner los mismos textos en cualquier detector.

Cómo comprobar tú mismo un detector en 15 minutos

  1. Reúne cinco textos que escribiste antes de 2022(redacciones, trabajos, correos largos). Son humanos seguro.
  2. Pide a ChatGPT o Gemini cinco textos con los mismos temas, y retoca a mano uno o dos.
  3. Pásalos por el detector y apunta cuántos textos tuyos marca como IA. Ese es el dato que importa: cada uno sería una acusación injusta.
  4. Después mira cuánta IA detecta, y si con los retocados se le escapa.

Un detector que marca aunque sea uno de tus textos antiguos no debería usarse para acusar a nadie.

Y el nuestro, ¿qué tal?

Lo medimos con 354 textos en español (109 de ChatGPT, Gemini y Claude y 245 humanos: literatura, prensa, enciclopedia, libros de texto, redacciones y apuntes de alumnos), siempre con textos que el modelo no había visto al entrenar. Separa la IA de lo humano con un AUC de 0,97 y, con su banda más alta, reconoce el 47 % de la IA sin marcar ningún texto humano.

También tiene puntos débiles, y los publicamos: la IA retocada a mano o resumida se le escapa casi siempre, y con apuntes técnicos muchas veces no se decide. Todo está en precisión, con el corpus explicado.

Lo que no cambia, uses el que uses

Ningún detector es una prueba. Úsalo para mirar con más atención, compara con trabajos anteriores y habla con el alumno antes de decidir. Lo tienes paso a paso en la guía para docentes.

Fuentes

Sigue leyendo