Галлюцинации LLM: как ИИ-модели выдумывают несуществующие пакеты

OpenAI Meta DeepSeek Mistral
Новое исследование показывает, что большие языковые модели часто галлюцинируют названия пакетов, создавая риск атак на цепочку поставок. Исследователи протестировали 16 моделей, сгенерировав 576 000 образцов кода, и обнаружили, что в среднем 19,7% рекомендаций пакетов были вымышленными. Они также предлагают стратегии смягчения последствий.
Исследование «We Have a Package for You!» («У нас есть для вас пакет!») посвящено анализу «галлюцинаций» пакетов у больших языковых моделей (LLM, large language model), генерирующих код. Учёные протестировали 16 моделей, включая GPT-3.5, GPT-4, GPT-4 Turbo, CodeLlama, DeepSeek Coder и другие, сгенерировав 576 000 образцов кода для Python и JavaScript. Выяснилось, что 440 445 рекомендаций (19,7%)
Показать ещё ↓
Источник: Habr — хаб ИИ — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости