Segurança de IAPesquisa 🇷🇺 02.08.2026 00:03

Seu Texto Falhou no Detector de IA: Um Experimento com Textos em Russo

AnthropicAnthropic Moonshot AIMoonshot AI OpenAIOpenAI DeepSeekDeepSeek СберСбер ЯндексЯндекс Text.ruText.ru GPTZeroGPTZero
Um experimento testou quatro detectores de IA contra textos gerados por seis grandes modelos de linguagem e textos escritos por humanos em russo. Os resultados mostram que os detectores têm dificuldade com textos curtos e têm 'pontos cegos' para certos modelos. O artigo discute os princípios por trás da detecção de IA e a controvérsia em torno de sua precisão.
O artigo do hub de IA do Habr explora o aumento do conteúdo gerado por IA e a proliferação de detectores de IA. Ele observa um estudo da Graphite mostrando que, em novembro de 2024, os textos gerados por IA superavam os escritos por humanos, com um estudo atualizado na primavera de 2026 alegando paridade. O autor descreve como os detectores típicos funcionam, citando o Neurodetector da Yandex e o detector de IA do Text.ru como exemplos, e menciona que a OpenAI desativou seu classificador em 2023 devido à baixa precisão. O GigaCheck da Sber, baseado em um modelo Mistral ajustado, afirma ter 94,7% de precisão. O experimento usou quatro detectores (Neurodetector da Yandex, GigaCheck, detector de IA do Text.ru, GPTZero) e seis LLMs (Claude Opus 5, Kimi K3, GPT-5.6 Sol, GLM 5.2, DeepSeek V4 Pro, GigaChat 3.5 Ultra). Três textos escritos por humanos sobre pangramas, publicados antes de 2021, serviram como controle. Os modelos geraram textos de comprimentos semelhantes, e todos os textos foram verificados uma vez por cada detector. Os resultados foram normalizados nas categorias IA/HUMANO. O autor reconhece limitações: amostra pequena, execução única e a data de 27 de julho de 2026. As descobertas indicam que textos mais longos são classificados com mais precisão, enquanto textos curtos causam mais erros. Notavelmente, o Neurodetector da Yandex classificou erroneamente três textos do Claude Opus 5 como humanos, e o Text.ru sinalizou erroneamente textos do GPT-5.6 Sol como humanos, sugerindo "pontos cegos". O artigo se abstém de recomendar qualquer detector.
Fonte: Habr — хаб ИИ — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas