tecnología

Alguien ha entrenado un modelo IA para detectar textos escritos con IA y dice detectarlos con un 98% de precisión

Que estamos rodeados por texto escrito por una IA ya no sorprende a nadie. Los que queremos leer a personas vamos todo el día con el hacha levantada buscando indicios para comprobar si estamos leyendo a un humano o a un robot, pero aunque eso pueda ser una cuestión ética o de preferencia, hay ámbitos como el educativo en el que hacen falta herramientas buenas que detecten el texto escrito por IA. Y digo "buenas" porque algunas de las que más fama tienen fallan más que una escopeta de feria calif

Actualizado hace 1 minuto5 min de lectura2 lecturasComentarios

Escuchá el resumen

Exclusivo para suscriptores Premium

Desbloquear
Alguien ha entrenado un modelo IA para detectar textos escritos con IA y dice detectarlos con un 98% de precisión
Lo esencial

Que estamos rodeados por texto escrito por una IA ya no sorprende a nadie. Los que queremos leer a personas vamos todo el día con el hacha levantada buscando indicios para comprobar si estamos leyendo a un humano o a un robot, pero aunque eso pueda ser una cuestión ética o de preferencia, hay ámbitos como el educativo en el que hacen falta herramientas buenas que detecten el texto escrito por IA. Y digo "buenas" porque algunas de las que más fama tienen fallan más que una escopeta de feria calif

  • Y digo "buenas" porque algunas de las que más fama tienen fallan más que una escopeta de feria calificando como "hecho por IA" textos humanos y viceversa
  • Para ponerlo a prueba, reunió 2.250 posts de blogs de 268 empresas de comunicación, todos ellos publicados antes de que se lanzara ChatGPT y recuperados usando Wayback Machine
  • Luego, pidió a cinco modelos (GPT-5.4, Claude Sonnet 4.6, Gemini 3 Flash, DeepSeek V3.2 y Kimi K2.5 que escribieran su propia versión a partir de un resumen del contenido original
  • El resultado fue que, en las pruebas, obtuvo alrededor de 97-98 de macro F1, una métrica que combina precisión y cobertura para humanos e IA

Que estamos rodeados por texto escrito por una IA ya no sorprende a nadie. Los que queremos leer a personas vamos todo el día con el hacha levantada buscando indicios para comprobar si estamos leyendo a un humano o a un robot, pero aunque eso pueda ser una cuestión ética o de preferencia, hay ámbitos como el educativo en el que hacen falta herramientas buenas que detecten el texto escrito por IA. Y digo "buenas" porque algunas de las que más fama tienen fallan más que una escopeta de feria calificando como "hecho por IA" textos humanos y viceversa.

Un investigador llamado Jochen Madler se ha cansado y ha ideado un sistema que no sólo dice si un texto es IA o no, sino si ese texto está escrito por un humano que simplemente se ha dedicado a parafrasear el resultado que le ha dado la IA. ¿Resultado? Un macro F1 cercano al 98%.

En corto. El estudio se titula 'SlopShape' y, en él, Madler expone que el sistema analizó una serie de textos cuyo modelo nunca había visto y alcanzó el mencionado 98% de éxito a la hora de etiquetar si había sido escrito por una IA o por un humano de principio a fin. Según el investigador, el sistema no lee el texto y emite el veredicto, sino que un modelo de lenguaje responde para cada post un cuestionario de más de 200 preguntas sobre cómo está montado ese texto.

En concreto, analiza el orden en el que se presentan las ideas, si el artículo anuncia su estructura por adelantado, se fija en dónde aparece la tesis, cómo se presentan las fuentes, la orientación práctica del artículo o si el texto termina repitiendo o reformulando la conclusión. El experimento. Para ponerlo a prueba, reunió 2.250 posts de blogs de 268 empresas de comunicación, todos ellos publicados antes de que se lanzara ChatGPT y recuperados usando Wayback Machine.

Luego, pidió a cinco modelos (GPT-5.4, Claude Sonnet 4.6, Gemini 3 Flash, DeepSeek V3.2 y Kimi K2.5 que escribieran su propia versión a partir de un resumen del contenido original. En total fueron 11.250 versiones generadas por esos modelos, escritas y reescritas de nuevo, para comprobar hasta qué punto su sistema podía identificar cambios desde profundos a menores. El resultado fue que, en las pruebas, obtuvo alrededor de 97-98 de macro F1, una métrica que combina precisión y cobertura para humanos e IA.

Cuando se reescribían los textos varias veces usando la IA, ese macro F1 apenas variaba. Sólo bajó significativamente cuando se cambiaban características de estilo (con una puntuación de 88,1). La conclusión es que la IA deja una huella en la arquitectura del discurso, dando textos previsibles, muy masticados y con conclusiones repetitivas.

De hecho, según las pruebas, en un 79% de las ocasiones el sistema podía incluso señalar qué modelo había escrito qué en función de los 'dejes' de cada uno de ellos. La forma del slop. Y el meollo: lo que da pistas a la herramienta es lo que da título a la investigación, esa "forma del slop".

Según Madler, suelen tener estos rasgos: - Forma muy ordenada, a veces con bullet points iniciales que indican los apartados. - El título promete exactamente lo que el artículo va a dar, sin aportar contexto tangencial. - La introducción enseguida presenta la tesis y luego sigue una estructura de "definición, ventajas, pasos, errores y recomendaciones" como si fuera una guía o experto. - La conclusión termina parafraseando la idea que ya anunciaba en la introducción. Hay otros factores, como afirmaciones sin fuentes, estadísticas sin contexto o una especie de listas de pros y contras que siempre están equilibradas y que no aportan nada. PERO.

Que que se cumplan estos rasgos no demuestra que un texto lo haya escrito una IA. De hecho, en prensa y antes de ChatGPT, nos encontramos con agencias de comunicación que lanzaban mensajes siguiendo esa estructura tan corporativa. Tiene sentido porque son los textos que han usado para el estudio y también con los que la IA de las diferentes compañías han sido entrenadas (entre tantas y tantas cosas robadas para dicho entrenamiento, claro).

Además, y esto es importante, el estudio se ha hecho con artículos en inglés, por lo que no se puede aplicar a otros idiomas ni a cualquier texto escrito en Internet. La conclusión es que lo característico de las formaciones es la combinación repetida de todos y cada uno de esos factores que pueden hacernos sospechar y, sobre todo, los textos con "mucho texto" y que no sólo no aportan nada, sino que no muestran una progresión de ideas. Pero bueno, al final, de momento es una investigación más sobre algo que, evidentemente, es un problema.

Y es que, en una era en la que cada dos por tres se lanzan más y más modelos de frontera, son necesarias herramientas para distinguir quién ha hecho qué texto. Como curiosidad, he analizado este texto y soy un 70% humano. Y en este otro dice que un 80% cuando es una entrevista.

Hay que seguir afinando la herramienta. Imágenes | Jochen Madler

Fuente: Xataka|Fuente primaria|Editado por Tempranísimo IA

Preguntale a la nota

Hacé preguntas y la IA responde usando solo este artículo

2 preguntas restantes · Respuestas basadas en el contenido del artículo

Compartir
WhatsAppXFacebookTelegram

Recibí las noticias en WhatsApp

Seguí nuestro canal para recibir lo más importante del día, directo a tu celular.

Seguir canal

Comentarios

para dejar un comentario

Cargando comentarios...

Noticias Relacionadas

Hoy en Action (y rebajada) la solución para tener iluminación inteligente en casa sin gastar más de 10 euros
Tecnología

Hoy en Action (y rebajada) la solución para tener iluminación inteligente en casa sin gastar más de 10 euros

Si estás pensando dar el salto a la domótica sin que tu bolsillo sufra, desde hoy, Action tiene en sus tiendas una oferta muy tentadora. Concretamente, han rebajado el pack de tres bombillas inteligentes LSC Smart Connect a 9,95 euros . Igualar en precio a Action con esta oferta es muy difícil, ya que el precio es imbatible. Aunque si no tienes una tienda de la cadena cerca y quieres comprar bombillas inteligentes recibiéndolas cómodamente en tu hogar, hoy en la Fiesta de Ofertas Prime de Amazon

ChatGPT quiere convertirse en tu probador virtual: subes una foto y te enseña cómo te queda la ropa
Tecnología

ChatGPT quiere convertirse en tu probador virtual: subes una foto y te enseña cómo te queda la ropa

Una de las desventajas de comprar ropa online es que no nos la podemos probar. Los procesos de devolución se han simplificado mucho, pero hasta que la prenda no llega no podemos saber cómo nos va a quedar. ChatGPT quiere minimizar esa incertidumbre con su nueva función de probador virtual. Nuevas funciones de compras. OpenAI ha estrenado dos nuevas funciones para ayudar a los usuarios que compren online a través de su chatbot. La primera es el probador virtual para ver cómo nos quedará una prend

Al introducir el gen de un tardígrado japonés en células humanas, científicos han dotado a nuestro ADN de una protección que la evolución nunca nos otorgó
Tecnología

Al introducir el gen de un tardígrado japonés en células humanas, científicos han dotado a nuestro ADN de una protección que la evolución nunca nos otorgó

Un animal microscópico capaz de sobrevivir a la desecación, el frío extremo y dosis extraordinarias de radiación escondía una herramienta que nuestras células nunca desarrollaron. En el año 2016, investigadores japoneses identificaron en el tardígrado Ramazzottius varieornatus una proteína llamada Dsup y dieron un paso insólito: hicieron que células humanas cultivadas pudieran producirla. Cuando las bombardearon con rayos X, su ADN sufrió aproximadamente la mitad de fragmentación que el de célul