Araştırma 🇨🇳 30.07.2026 19:03

Kayıp yakınsaması öğrenme anlamına gelmez: Tencent Hunyuan, ACL 2026'da SFT eğitimindeki %15,3 "yanlış öğrenme" örneğini inceliyor

TencentTencent
Tencent Hunyuan, ACL 2026'da yayımladığı bir çalışmada, denetimli ince ayar (SFT) sırasında kayıp yakınsamasının modelin gerçekten öğrendiğini garanti etmediğini gösterdi. Eğitim örneklerinin %15,3'ünün, kaybın düştüğü ancak modelin aslında amaçlanan bilgiyi edinmediği "yanlış öğrenme" vakaları olduğunu tespit ettiler. Araştırma, bu örnekleri tespit etmek için bir yöntem sunuyor ve SFT için iyileştirmeler öneriyor.
Tencent Hunyuan, ACL 2026'da denetimli ince ayar (supervised fine-tuning, SFT) sırasında "yanlış öğrenme" olgusunu analiz eden bir araştırma sundu. Çalışma, eğitim kaybı yakınsasa bile modelin hedef bilgiyi gerçekten öğrenmemiş olabileceğini ortaya koyuyor. SFT'deki örneklerin %15,3'ünde, kayıp azalmasına rağmen modelin genelleme yapamadığı bu yanlış öğrenmenin gerçekleştiğini buldular. Ekip, bu tür örnekleri tespit etmek için bir yöntem geliştirdi ve yanlış öğrenmeyi azaltarak SFT'nin güvenilirliğini artıracak teknikler önerdi.
Kaynak: Tencent Hunyuan (GNews) — orijinal
Bu konudaki önceki yazılarımız ↓
Güncel haberler