Sécurité de l'IARecherche 🇷🇺 02.08.2026 00:03

Votre texte a échoué au détecteur d'IA : une expérience avec des textes en langue russe

AnthropicAnthropic Moonshot AIMoonshot AI OpenAIOpenAI DeepSeekDeepSeek СберСбер ЯндексЯндекс Text.ruText.ru GPTZeroGPTZero
Une expérience a testé quatre détecteurs d'IA sur des textes générés par six grands modèles de langage et des textes écrits par des humains en russe. Les résultats montrent que les détecteurs ont du mal avec les textes courts et présentent des « angles morts » pour certains modèles. L'article aborde les principes derrière la détection d'IA et la controverse entourant sa précision.
L'article du hub IA de Habr explore l'essor du contenu généré par l'IA et la prolifération des détecteurs d'IA. Il note une étude de Graphite montrant qu'en novembre 2024, les textes générés par l'IA étaient plus nombreux que ceux écrits par des humains, avec une étude mise à jour au printemps 2026 affirmant la parité. L'auteur décrit le fonctionnement des détecteurs typiques, citant le Neurodetector de Yandex et le détecteur d'IA de Text.ru comme exemples, et mentionne qu'OpenAI a fermé son classificateur en 2023 en raison de sa faible précision. Le GigaCheck de Sber, basé sur un modèle Mistral affiné, revendique une précision de 94,7 %. L'expérience a utilisé quatre détecteurs (Neurodetector de Yandex, GigaCheck, détecteur d'IA de Text.ru, GPTZero) et six modèles de langage (Claude Opus 5, Kimi K3, GPT-5.6 Sol, GLM 5.2, DeepSeek V4 Pro, GigaChat 3.5 Ultra). Trois textes écrits par des humains sur les pangrammes, publiés avant 2021, ont servi de contrôle. Les modèles ont généré des textes de longueurs similaires, et tous les textes ont été vérifiés une fois par chaque détecteur. Les résultats ont été normalisés en catégories IA/HUMAIN. L'auteur reconnaît les limites : petit échantillon, exécution unique et date du 27 juillet 2026. Les résultats indiquent que les textes plus longs sont classés avec plus de précision, tandis que les textes courts entraînent plus d'erreurs. Notamment, le Neurodetector de Yandex a mal classé trois textes de Claude Opus 5 comme étant humains, et Text.ru a signalé à tort des textes de GPT-5.6 Sol comme humains, suggérant des « angles morts ». L'article s'abstient de recommander un détecteur en particulier.
Source: Habr — хаб ИИ — original
Nos articles précédents sur ce sujet ↓
Infos fraîches