InDetect

Prueba de detección de IA Turnitin 2026:GPT-5.5, Claude Opus 4.8 y Gemini 3.1 Pro Resultados

Imagen del autor
Escrito por  Eleanor Rose Sterling
2026-07-05 12:04:02 7 min de lectura

En resumen: La detección de IA de Turnitin es notablemente efectiva. Probamos 9 textos generados por IA mediante tres modelos de vanguardia —incluyendo textos que fueron sometidos a una humanización especializada— y Turnitin los detectó todos. Por otro lado, el texto escrito por humanos obtuvo un 0%. Aquí tienen el desglose completo.


Por qué realizamos esta prueba

Las herramientas de escritura mediante IA están por todas partes. ChatGPT, Claude y Gemini son utilizadas a diario por estudiantes, investigadores y creadores de contenido. Turnitin — implementado en más de 16,000 instituciones — es el filtro de facto para la integridad académica, y su función de detección de IA determina cada vez más si un trabajo es señalado.

Tres preguntas surgen constantemente:

  1. ¿Puede Turnitin realmente detectar texto generado por IA de los modelos más recientes?

  2. ¿Las técnicas de "humanización" — reescritura, ingeniería de prompts — realmente disminuyen la puntuación de IA?

  3. ¿Produce Turnitin falsos positivos en la escritura humana real?

Llevamos a cabo una prueba controlada para responder a las tres.


Cómo realizamos las pruebas

Los modelos

Tres modelos de vanguardia a mediados de 2026:

  • ChatGPT (OpenAI GPT-5.5)

  • Claude Opus 4.8

  • Gemini 3.1 Pro

Los tres modos de redacción

Para cada modelo, generamos texto de tres formas distintas:

Modo

Qué hicimos

Qué evalúa

Generación directa

Solicitar al modelo que redacte sobre la degradación de la basura marina. Sin instrucciones adicionales.

Tasa base de detección de IA

Reescritura humanizada

Generar el texto primero y, a continuación, pedir al modelo que lo reescriba "para que suene más natural y humano".

Si la edición posterior evade la detección

Requisitos humanizados

Incluir instrucciones de humanización directamente en el prompt inicial.

Si la ingeniería de prompts evade la detección

Los prompts exactos utilizados se encuentran documentados en el apéndice.

El grupo de control humano

Para comprobar la existencia de falsos positivos, presentamos escritos humanos reales anteriores a la existencia de los modelos de lenguaje de gran tamaño:

  • 3 fragmentos de documentos legales reales (Constitución de los EE. UU., Declaración de Derechos — lenguaje formal y altamente estructurado)

  • 9+ párrafos de artículos académicos previos a 2015 (agradecimientos de tesis, artículos de economía — imposible que hayan sido generados por IA)

Tema y longitud

Todos los textos de IA trataron sobre la degradación de la basura marina, un tema neutral y objetivo que garantiza la coherencia de los resultados en todos los modelos. Cada texto tuvo al menos 3 párrafos para asegurar que Turnitin contara con material suficiente para su análisis.

Debido al coste por verificación de Turnitin, combinamos varios textos en envíos grupales (no más de 4 por envío).


Los Resultados

Puntuaciones de Detección de IA

Modelo

Modo de Escritura

Puntuación de IA

GPT-5.5

Generación Directa

100%

GPT-5.5

Reescritura Humanizada

100%

GPT-5.5

Requisitos Humanizados

100%

Claude Opus 4.8

Generación Directa

100%

Claude Opus 4.8

Reescritura Humanizada

100%

Claude Opus 4.8

Requisitos Humanizados

100%

Gemini 3.1 Pro

Generación Directa

100%

Gemini 3.1 Pro

Reescritura Humanizada

100%

Gemini 3.1 Pro

Requisitos Humanizados

95%

Resultados de Texto Humano

Tipo de Texto

Puntuación de IA

Documentos legales (Constitución de los EE. UU., Declaración de Derechos)

0%

Documentos académicos anteriores a 2015

0%


Capturas de pantalla: Informes de detección de IA de Turnitin

GPT-5.5

Generación directa — IA: 100%

Informe de detección de IA de Turnitin de generación directa de GPT-5.5

Reescritura humanizada — IA: 100%

Informe de detección de IA de Turnitin de reescritura humanizada de GPT-5.5

Con requisitos humanizados — IA: 100%

Informe de detección de IA de Turnitin con requisitos humanizados de GPT-5.5


Claude Opus 4.8

Generación directa — IA: 100%

Informe de detección de IA de Turnitin de generación directa de Claude Opus 4.8

Reescritura humanizada — IA: 100%

Informe de detección de IA de Turnitin de reescritura humanizada de Claude Opus 4.8

Con requisitos humanizados — IA: 100%

Informe de detección de IA de Turnitin con requisitos humanizados de Claude Opus 4.8


Gemini 3.1 Pro

Generación directa — IA: 100%

Informe de detección de IA de Turnitin de generación directa de Gemini 3.1 Pro

Reescritura humanizada — IA: 100%

Informe de detección de IA de Turnitin de reescritura humanizada de Gemini 3.1 Pro

Con requisitos humanizados — IA: 95%

Informe de detección de IA de Turnitin con requisitos humanizados de Gemini 3.1 Pro


Texto humano

Documentos legales del mundo real — IA: 0%

Informe de detección de IA de Turnitin de documentos legales

Artículos académicos anteriores a 2015 — IA: 0%

Informe de detección de IA de Turnitin de artículos académicos anteriores a 2015


Análisis

1. Turnitin detectó todo

En tres modelos de vanguardia diferentes y mediante tres estrategias de escritura distintas, Turnitin marcó todos y cada uno de los textos generados por IA. Ni uno solo pasó desapercibido.

La puntuación más baja fue del 95%, lo cual sigue siendo un indicador inequívoco de que "esto es IA". Ningún instructor vería una puntuación de detección de IA del 95% y pensaría: "quizás esto fue escrito por un humano".

2. La humanización no funciona

Probamos las dos estrategias de humanización más comunes:

  • Reescritura posterior a la generación: "Haz que esto suene más humano".

  • Ingeniería de prompts previa a la generación: "Escribe como un humano reflexivo, no como una plantilla".

Ninguna funcionó. GPT-5.5 y Claude se mantuvieron en el 100% en todos los casos. Gemini bajó del 100% al 95%, un cambio insignificante que sigue gritando "IA".

Esto nos revela algo importante: Turnitin no se fija en características superficiales como las palabras de transición o la uniformidad de las oraciones. Los patrones que detecta —probablemente regularidades estadísticas en la elección de palabras, la sintaxis y la estructura— sobreviven a la paráfrasis, la reestructuración y los ajustes estilísticos.

Al comparar los textos lado a lado, las versiones humanizadas se leían de forma diferente. La longitud de las oraciones variaba más. Las transiciones formularias se redujeron. Algunos pasajes adoptaron un tono más observacional. Pero Turnitin detectó todo eso. La señal subyacente era demasiado fuerte.

3. Cero falsos positivos en textos humanos

Esto es igual de importante. Cuando enviamos textos legales formales y escritos académicos previos a 2015:

  • Constitución de los Estados Unidos y Declaración de Derechos: 0% IA. Estos son textos muy estructurados y formales; exactamente el tipo de documentos que, según los críticos, podrían ser señalados erróneamente.

  • Tesis y artículos económicos previos a 2015: 0% IA. Estos se escribieron antes de que existiera el GPT, por lo que Turnitin los identificó correctamente como humanos.

El miedo a que Turnitin pueda marcar textos humanos formales y estructurados como generados por IA es una de las objeciones más comunes a las herramientas de detección de IA. En nuestra prueba, ese temor no se materializó.

4. Por qué Gemini 3.1 Pro bajó al 95%

El único dato distinto fue el de Gemini 3.1 Pro con requisitos de humanización, que obtuvo un 95% en lugar de un 100%. ¿Qué había de diferente en ese texto?

  • Era más largo (5 párrafos frente a los 4 de la generación directa).

  • Comenzaba con una escena narrativa ("De pie en una playa...")

  • Utilizaba más preguntas retóricas y lenguaje reflexivo.

  • Las oraciones variaban más en longitud y ritmo.

A pesar de todo eso, el 95% sigue siendo una marca definitiva de IA. La diferencia es académicamente interesante pero prácticamente irrelevante: nadie confundiría una puntuación del 95% con un texto escrito por un humano.


Puntos clave

La detección de IA de Turnitin es extremadamente precisa

Detección del 100% en 8 de 9 textos creados por IA, y del 95% en el noveno. Turnitin no realiza suposiciones probabilísticas; identifica de manera fiable el contenido generado por IA a partir de tres modelos de vanguardia diferentes con una consistencia casi perfecta.

La humanización es un camino sin salida (frente a Turnitin)

La industria de la "humanización de IA" promete hacer que el texto generado sea indetectable. Nuestra prueba demuestra que, al menos frente a Turnitin, estas afirmaciones no se sostienen:

  • Reescritura posterior a la generación: efecto nulo

  • Humanización durante la generación: efecto insignificante (una caída del 5% en un modelo y cero en los otros dos)

Los patrones que detecta Turnitin son demasiado fundamentales: sobreviven a la paráfrasis, la reestructuración y los ajustes de estilo.

Turnitin no genera falsos positivos en textos escritos por humanos

Nuestro grupo de control obtuvo una puntuación del 0% en IA. La prosa jurídica formal y la escritura académica —estilos que, según temen los críticos, podrían ser clasificados erróneamente— fueron identificados correctamente como humanos. El temor a los falsos positivos, al menos en lo que respecta a la escritura formal y académica, parece infundado según nuestros resultados.


Limitaciones

Sea transparente sobre lo que esta prueba abarca y lo que no:

  1. Tamaño de la muestra: 9 textos de IA y 2 grupos de textos humanos. Es significativo, pero no exhaustivo.

  2. Tema único: Todos los textos de IA trataban sobre basura marina. Una narrativa personal o un tema creativo podrían generar patrones diferentes.

  3. Solo escritura formal: Evaluamos prosa informativa, no escritura creativa, poesía ni contenido técnico.

  4. Instantánea temporal: Turnitin actualiza sus algoritmos constantemente. Estos resultados reflejan la situación a julio de 2026.

  5. Envíos combinados: Los textos se agruparon para controlar costos. Esto podría afectar teóricamente la puntuación, aunque Turnitin opera a nivel de oración.

  6. Sin técnicas adversarias: Probamos la humanización directa. No evaluamos la ofuscación agresiva (perturbaciones a nivel de carácter, errores intencionados o retrotraducción), métodos que suelen degradar la calidad del texto hasta volverlo inútil.


Qué significa esto

Para estudiantes

Si está generando texto con IA y espera que Turnitin no se dé cuenta, lo hará. La tasa de detección en nuestra prueba fue prácticamente del 100%.

El mejor enfoque: utilice la IA como una herramienta, no como un sustituto. Intercambie ideas, esquematice argumentos y refine su propia prosa. Mantenga su voz y sus ideas en el centro. Si utiliza asistencia de IA, sea transparente conforme a las políticas de su institución.

Para educadores

La detección de IA de Turnitin es una señal confiable, pero sigue siendo solo una señal, no un veredicto. Una puntuación del 100% de IA debería dar pie a una conversación, no a una penalización automática. Revise el historial de escritura del estudiante, hable sobre la tarea y considere el contexto completo.

Nuestra prueba también confirma que la escritura humana formal y bien estructurada no genera falsos positivos. Puede confiar en una puntuación del 0% con razonable seguridad.

Para creadores de contenido

Si necesita contenido que supere la detección de IA, es poco probable que generar texto con cualquier modelo importante y luego "humanizarlo" funcione frente a Turnitin. La estrategia más confiable es escribir el contenido usted mismo y utilizar la IA como una herramienta complementaria.


Referencia de la metodología de prueba

Parámetro

Detalle

Fecha de la prueba

Julio de 2026

Modelos probados

ChatGPT (GPT-5.5), Claude Opus 4.8, Gemini 3.1 Pro

Textos de IA

9 (3 por modelo, 3 modos de escritura cada uno)

Textos humanos

Documentos legales (3 extractos), trabajos académicos anteriores a 2015 (9+ párrafos)

Tema

Degradación de residuos marinos

Longitud mínima

3 párrafos por texto

Herramienta de detección

Detección de IA de Turnitin

Método de envío

Documentos fusionados (≤4 textos por envío)


Apéndice: Prompts utilizados

Para una total reproducibilidad, aquí se encuentran los prompts exactos utilizados para cada modo de escritura. Estos se aplicaron de manera idéntica en los tres modelos.

Prompt 1: Generación directa

Please write a short article about "the degradation of marine litter" in English.

Requirements:
1. The article should contain at least three paragraphs.
2. Discuss the sources of marine litter, its environmental impacts, the difficulty of degradation, and the importance of reducing marine pollution.
3. Use a clear and formal style suitable for a general science or environmental awareness article.
4. Do not use headings or bullet points.
5. Do not include fabricated statistics, studies, organizations, or citations.
6. Keep the writing coherent and logically structured.

Prompt 2: Reescritura humanizada

Este prompt se aplicó al resultado del Prompt 1; se le solicitó al modelo que revisara su propio texto.

Please revise the following article to make it read more naturally, as if it were written by a real person with a thoughtful writing style.

Revision requirements:
1. Preserve the original meaning, main ideas, and overall topic.
2. Do not add fabricated statistics, studies, organizations, cases, or citations.
3. Vary the sentence length and rhythm so the writing does not feel overly uniform.
4. Reduce mechanical transitions such as "firstly," "secondly," "moreover," "in conclusion," or similar formulaic phrases.
5. Make the tone more natural while still keeping it professional and clear.
6. Avoid making the article too casual or conversational.
7. Keep at least three paragraphs.

Original article:
[Paste the original article here]

Prompt 3: Generación con requisitos de humanización

Este prompt se utilizó para una generación desde cero; las instrucciones de humanización fueron integradas desde el inicio, en lugar de aplicarse como una segunda revisión.

Please write a short article about "the degradation of marine litter" in English.

Content requirements:
1. The article should contain at least three paragraphs.
2. Discuss the main sources of marine litter.
3. Explain why marine litter, especially plastic waste, is difficult to degrade in ocean environments.
4. Describe its impacts on marine life, ecosystems, and human society.
5. Mention the importance of reducing marine litter and improving waste management.

Writing style requirements:
1. Write in a natural and thoughtful style, as if the article were written by a real person rather than generated from a fixed template.
2. Avoid making every paragraph follow the same structure.
3. Vary sentence length and rhythm.
4. Include a few natural observations or reflections where appropriate.
5. Avoid overusing formulaic transitions such as "firstly," "secondly," "finally," or "in conclusion."
6. Do not use headings or bullet points.
7. Do not include fabricated statistics, studies, organizations, cases, or citations.
8. Keep the writing clear, accurate, and suitable for general readers.

Decisiones clave de diseño

Los tres prompts fueron diseñados para comprobar una hipótesis específica: ¿puede la reescritura simple de los prompts reducir las puntuaciones de detección de IA de Turnitin?

  • Prompt 1 representa el caso de uso más frecuente: un estudiante que copia la consigna de una tarea en ChatGPT y envía el resultado.

  • Prompt 2 simula el popular flujo de trabajo de "humanizar mi texto": generar primero y luego pedir a la IA que lo reescriba para que suene menos artificial.

  • Prompt 3 comprueba si integrar las instrucciones de humanización en el prompt inicial es más efectivo que aplicarlas a posteriori.

Los prompts evitan deliberadamente incluir estadísticas y citas inventadas para garantizar que la prueba aísle el estilo de escritura del modelo en lugar de su precisión factual.


Veredicto Final

La detección de IA de Turnitin superó esta prueba de manera convincente. Detectó el texto generado por IA de los tres modelos de vanguardia — GPT-5.5, Claude Opus 4.8 y Gemini 3.1 Pro — con una precisión del 100% (o del 95% en un caso). Identificó correctamente el texto escrito por humanos con una tasa del 0%. Las técnicas de humanización no marcaron una diferencia significativa.

La reescritura simple de los prompts no puede eludir la detección de IA de Turnitin. Esta es la conclusión más importante de nuestra prueba. Probamos dos enfoques distintos —reescritura tras la generación e instrucciones de estilo previas a la generación— y ambos fracasaron. En los modelos GPT-5.5, Claude Opus 4.8 y Gemini 3.1 Pro, los resultados fueron unánimes: Turnitin detectó la señal de IA independientemente de cómo se formulara el prompt. Los patrones estadísticos que Turnitin identifica están integrados a un nivel demasiado profundo como para que los ajustes estilísticos superficiales puedan ocultarlos.

El mensaje es claro: si envía texto generado por IA a través de Turnitin, será detectado. La mejor forma de evitar una marca de IA es redactar su propio contenido.