El detector dice 87 % IA. Y ese número no te sirve de nada

Share
El detector dice 87 % IA. Y ese número no te sirve de nada

Tu alumna te entrega una redacción que no encaja, no te cuadra. Es demasiado buena, demasiado limpia y demasiado poco suya.

Coges el texto, lo pasas por un detector, y te devuelve un número: 87 % de probabilidad de IA.

Y ahora, ¿qué haces exactamente con ese 87 %?

Ese número no significa lo que crees

Un detector no reconoce texto de máquina. Mide lo predecible que es un texto: si cada palabra es la que uno esperaría, concluye que lo ha escrito un modelo, porque los modelos de lenguaje eligen siempre la opción más probable, es pura estadística.

El problema salta a la vista en cuanto piensas en tus alumnos. Cuando escribimos en una segunda lengua que no dominamos, también tendemos a elegir la palabra más previsible. No porque seamos máquinas: porque nuestro vocabulario es limitado.

Un equipo de Stanford probó siete detectores con redacciones del examen TOEFL escritas por estudiantes no nativos. Todas humanas. Los detectores se equivocaron en el 61,3 % de los casos. Sin embargo, con redacciones de nativos acertaban casi siempre.

Traducido a tu aula: el detector no señala al que copia. Señala al que peor escribe.

Es un estudio estadounidense, con redacciones de TOEFL. No hay nada equivalente hecho con adolescentes españoles escribiendo en alemán o inglés, y conviene decirlo. Pero el mecanismo que describe funciona igual en cualquier lengua.

Y aunque el número fuera fiable, seguirías teniendo el problema equivocado

Imagina por un momento un detector perfecto. Infalible. Te dice con total certeza que ese texto lo ha escrito una máquina.

Ya lo sabes. ¿Y ahora?

Sigues sin saber lo único que necesitabas saber, que es qué sabe hacer ese alumno.

La pregunta útil nunca fue "¿lo ha escrito él?". Es esta otra:

¿Este texto evidencia lo que este alumno sabe hacer?

Parece un matiz y lo cambia todo, porque la segunda pregunta sí se puede responder. Sin software, sin acusar a nadie y sin arriesgarte a hacerle un daño injusto a un chaval de quince años.

Lo que de verdad se ha roto

Que la IA escriba redacciones no es el problema. El problema es que ha dejado al descubierto tres cosas que ya cojeaban antes y que nadie miraba:

La tarea que se puede resolver sin haber pisado tu clase. Si el enunciado es "escribe 150 palabras sobre tus vacaciones", cualquiera puede resolverlo: una IA, un traductor, un hermano mayor o una redacción de otro año. Que se pudiera resolver sin ti no es culpa de ChatGPT. Es que la tarea nunca pidió nada tuyo, nada de la realidad de tu clase.

La nota que depende solo del producto final. Si el cien por cien de la calificación está en el texto entregado, estás evaluando un objeto, no a una persona. Y los objetos se pueden fabricar.

La corrección como único momento de contacto. Recoges, corriges en casa, devuelves con un número. Entre medias no hay ninguna conversación. Y sin conversación no hay forma de saber qué hay detrás de un texto.

Ninguna de las tres es nueva. Lo nuevo es que ahora se notan.

Lo que sí funciona, en tres movimientos

Ancla la tarea a tu aula. Que para resolverla haya que haber estado allí: referirse a la historia que trabajasteis el martes, usar tres expresiones de la unidad en contexto propio, responder a lo que dijo un compañero…

Haz que el proceso cuente. Si la redacción se hace en dos sesiones sobre la misma hoja —borrador primero, versión final debajo— tienes el proceso delante sin pedir nada extra. Añade tres líneas de "qué cambié y por qué" y tienes metacognición, que es de lo que más se aprende al escribir.

Cambia la acusación por una conversación de dos minutos. No con todos ni siempre: con tres al azar por tarea. Explícame la idea principal. ¿Por qué esta palabra y no otra? Si añadieras una frase más, ¿cuál sería? Como nadie sabe si le toca, a todo el mundo le compensa entender lo que entrega.

El detector que sí sirve en clase de idiomas, y no es un programa

Aquí tenemos una ventaja que no tiene ningún profesor de otra materia, y casi nadie la nombra: el desajuste de nivel.

Si das alemán, lo tienes servido, y este curso lo tengo yo más servido que nunca: doy alemán en dos grupos de 1º de ESO que empiezan de cero esta misma semana (septiembre de 2026).

Piénsalo. En octubre, un alumno de ese grupo puede saber decir cómo se llama y de dónde es. Si en noviembre me entrega una subordinada con el verbo al final, ahí no hay margen de interpretación. No es que sea sospechoso: es que no ha podido salir de él, porque en ocho semanas no da tiempo ni a colocar bien un verbo, y mucho menos a mandarlo al final.

El alemán es transparente con el nivel de una forma que el inglés no lo es. En inglés el desajuste es más sutil, aunque también asoma: el alumno que lleva todo el curso diciéndote "explain me the exercise" y de pronto te entrega un texto diciendo "delve into the complexities of".

Ese desajuste no prueba absolutamente nada, y es importante no usarlo como prueba. Puede haberlo aprendido por su cuenta — ojalá. Y da igual si viene de una IA, de un traductor o de su prima la de Londres.

Lo único que dice es que ese texto no evidencia lo que ese alumno sabe hacer. No acusa: activa la conversación de dos minutos.

Todos nos equivocamos

Más de una vez me han discutido que la producción era suya, probablemente con razón — o al menos en parte.

Cuando nos apoyamos en corazonadas entramos en una discusión en la que podemos perder parte de la confianza de un grupo entero, porque los alumnos hablan entre ellos.

Y esa es la ventaja práctica de dejar de detectar. Frente a una familia puedes decir:

"No he podido comprobar que este trabajo demuestre lo que su hijo sabe hacer."

en vez de:

"Creo que ha copiado."

La primera es una afirmación sobre la evidencia y la sostienes entera. La segunda es una afirmación sobre la honestidad de un menor, no la puedes demostrar, y te deja vendido en cuanto te pregunten cómo lo sabes.

El paso siguiente, uno solo

La próxima vez que un texto no te cuadre, no lo pegues en ningún sitio. Habla con el alumno tres minutos, a solas, y empieza así:

"He leído tu texto y hay cosas que están muy bien. Cuéntame cómo lo hiciste."

Y escucha. La mayoría te lo cuenta. Y muchas veces la respuesta es "lo escribí yo y luego se lo pasé a ChatGPT para que lo mejorara" — que es una conversación distinta y mucho más útil, porque ahí es donde puedes enseñarle a usar la herramienta sin dejar de aprender.

Esto no lo escribo desde la teoría de agosto. Acabo de empezar en un centro nuevo, con seis grupos, y lo voy a aplicar desde la primera entrega de este curso. Si funciona, lo contaré aquí. Si me estrello, también.

¿Ya estás suscrito? Descarga el recurso aquí.

Preguntas frecuentes

¿Entonces dejo que usen la IA para todo?
No. Lo que dejas es de intentar controlarlo con software. Sigues decidiendo qué se hace en clase y qué en casa, y sigues evaluando lo que el alumno sabe hacer. Lo que cambia es dónde pones la evidencia: en el proceso y en la conversación, no en el producto entregado.

Esto suena a mucho trabajo extra.
Anclar la tarea no cuesta más: cuesta lo mismo, se piensa distinto. Las dos sesiones sobre la misma hoja no añaden tiempo. Y la conversación de dos minutos con tres alumnos son diez minutos de clase. A cambio dejas de perder tiempo buscando una prueba difícil de sostener y que, aunque la tuvieras, no resolvería tu problema.

Y depende mucho del grupo. Este curso doy segundas lenguas extranjeras a grupos de menos de seis alumnos: ahí la conversación de dos minutos no es una medida excepcional, es sencillamente cómo doy clase. En un grupo de treinta cuesta de verdad y hay que elegir a quién. Cuanto más pequeño es el grupo, menos falta te hace todo esto — porque ya sabes lo que sabe hacer cada uno.

¿Y si el alumno sí lo escribió y no sabe explicarlo?
Pasa, y es información valiosa. Un alumno que ha escrito algo y no puede explicarlo tampoco ha aprendido mucho al escribirlo. Ahí no hay sospecha ninguna: hay una necesidad pedagógica.

Referencias

  • Liang, W., Yuksekgonul, M., Mao, Y., Wu, E. y Zou, J. (2023). GPT detectors are biased against non-native English writers. Patterns, 4(7), 100779. Texto completo