Wie LLMs bei der Datenherkunft helfen können
Der Artikel erörtert die Verwendung großer Sprachmodelle (LLMs) zur automatischen Extraktion von Datenherkunft (Data Lineage) aus SQL-Code. Es wird ein Ansatz vorgestellt, der auf GigaChat von Sber basiert und hohe F1-Werte erzielt. Eine agentenbasierte Reflexionsschleife optimiert die Aufforderungen (Prompts), und eine mit Streamlit erstellte Weboberfläche visualisiert die Ergebnisse.
Сбер
