Su texto no pasó el detector de IA: un experimento con textos en ruso
Anthropic
Moonshot AI
OpenAI
DeepSeek
Сбер
Яндекс
Text.ru
GPTZero
Un experimento puso a prueba cuatro detectores de IA frente a textos generados por seis grandes modelos de lenguaje y textos escritos por humanos en ruso. Los resultados muestran que los detectores tienen dificultades con textos cortos y presentan 'puntos ciegos' para ciertos modelos. El artículo analiza los principios detrás de la detección de IA y la controversia sobre su precisión.
El artículo del hub de IA de Habr explora el auge del contenido generado por IA y la proliferación de detectores de IA. Señala un estudio de Graphite que muestra que en noviembre de 2024, los textos generados por IA superaron en número a los escritos por humanos, y un estudio actualizado en la primavera de 2026 afirma que hay paridad. El autor describe cómo funcionan los detectores típicos, citando el Neurodetector de Yandex y el detector de IA de Text.ru como ejemplos, y menciona que OpenAI cerró su clasificador en 2023 debido a su baja precisión. GigaCheck de Sber, basado en un modelo Mistral ajustado, afirma una precisión del 94,7%. El experimento utilizó cuatro detectores (Neurodetector de Yandex, GigaCheck, detector de IA de Text.ru, GPTZero) y seis modelos de lenguaje de gran tamaño (LLM por sus siglas en inglés) (Claude Opus 5, Kimi K3, GPT-5.6 Sol, GLM 5.2, DeepSeek V4 Pro, GigaChat 3.5 Ultra). Tres textos escritos por humanos sobre pangramas, publicados antes de 2021, sirvieron como control. Los modelos generaron textos de longitudes similares, y todos los textos se verificaron una vez con cada detector. Los resultados se normalizaron en categorías de IA/HUMANO. El autor reconoce las limitaciones: muestra pequeña, ejecución única y la fecha del 27 de julio de 2026. Los hallazgos indican que los textos más largos se clasifican con mayor precisión, mientras que los textos cortos causan más errores. En particular, el Neurodetector de Yandex clasificó erróneamente tres textos de Claude Opus 5 como humanos, y Text.ru marcó por error textos de GPT-5.6 Sol como humanos, lo que sugiere 'puntos ciegos'. El artículo se abstiene de recomendar ningún detector.
Fuente: Habr — хаб ИИ —
original
