llms.txt doğrulayıcı yazdım: 64 test ve botların bu dosyayı okuyup okumadığını kontrol ettim
Yazar, llms.txt için bir üretici ve doğrulayıcı oluşturdu, 64 test çalıştırdı ve yapay zeka botlarının bu dosyayı nadiren istediğini buldu: 515 milyon bot olayından yalnızca 408 istek. Doğrulayıcı, dosyanın sıklıkla ihlal edilen spesifikasyona uygun olmasını sağlamaya yardımcı oluyor.
Habr'da yayınlanan bir makale, dil modellerine site özetleri sağlamak için önerilen bir standart olan llms.txt dosyası için bir doğrulayıcı ve üretecin geliştirilmesini anlatıyor. Yazar 64 test gerçekleştirdi ve yapay zeka botlarının llms.txt'yi nadiren talep ettiğini keşfetti: Limy.ai'nin Mayıs 2026 analizi, 90 gün boyunca yaklaşık 515 milyon bot etkinliğinden yalnızca 408 istek olduğunu gösterdi. Buna rağmen, doğrulayıcının yararlı olduğu kanıtlandı çünkü spesifikasyon gerçek dosyalarda sıklıkla ihlal ediliyor; eksik başlıklar, birden fazla H1 ve http bağlantıları gibi sorunlar mevcut. Ayrıştırıcı, ayrıştırmayı doğrulamadan ayırıyor ve doğrulama puanı, 100'den ağırlıklı cezaları (kritik 40, yüksek 25, orta 12, düşük 5) çıkarıyor. Test paketi, 22 belirli kuralı ve uç durumları kapsıyor ve 43 milisaniyede çalışıyor. Yazar, llms.txt'yi yapay zeka yanıtları için garantili bir yol olmaktan ziyade ucuz bir sigorta politikası olarak kullanmayı öneriyor ve yayınlamadan önce dosya yapısını kontrol etmeyi tavsiye ediyor.
Kaynak: Habr — хаб ИИ —
orijinal
