KI entziffert antike vergessene Sprachen: Was neuronale Netze leisten können
Google DeepMind
Künstliche Intelligenz, genauer gesagt neuronale Netze, unterstützt die Entzifferung antiker Schriften wie Linear A, Etruskisch und Indus-Tal-Zeichen. Sie werden eingesetzt, um fehlende Textfragmente zu rekonstruieren, Muster zu erkennen, Hypothesen zu überprüfen und Artefakte zu datieren. Ohne ausreichende Daten oder Kontext können sie eine verlorene Sprache jedoch nicht vollständig entschlüsseln.
Antike Inschriften bestehen oft aus geheimnisvollen Symbolen auf Stein oder Ton, die Kulturen repräsentieren, die verschwunden sind. Die Entzifferung ist ohne einen Rosetta-Stein oder verwandte Sprachen eine Herausforderung. Neuronale Netze wurden kürzlich eingesetzt, um fehlende Teile von Texten zu rekonstruieren, Muster in Tausenden von Inschriften zu identifizieren, Hypothesen zu testen und Alter und Herkunft zu schätzen. Sie sind besonders gut darin, wiederholte Sequenzen zu finden und Lücken zu füllen, indem sie sowohl Text als auch Bild verwenden. Sie können auch nach Übereinstimmungen zwischen verwandten Sprachen suchen, Annahmen massenhaft überprüfen und Datierung sowie geografische Zuordnung liefern. Zum Beispiel verwendete Simon Cordwell ein Programm, um eine Hypothese über Linear A zu testen und schlug Lesarten für 40 Zeichen und ein Wörterbuch mit 408 Einträgen vor. Das Team der Vesuvius Challenge nutzte Tomographie und neuronale Netze, um eine verkohlte Schriftrolle virtuell zu entrollen und eine philosophische Abhandlung zu enthüllen. Das Aeneas-Modell von Google DeepMind für lateinische Inschriften erreicht eine Genauigkeit von 73 % beim Füllen von Lücken, 72 % bei der Provinzattribution und Fehler von etwa 13 Jahren bei der Datierung. Ithaca, für das antike Griechisch, rekonstruiert Texte mit 62 % Genauigkeit, und wenn es von Historikern verwendet wird, verbessert sich ihre Genauigkeit von 25 % auf 72 %. Für chinesische Orakelknochen schlagen generative adversariale Netze mögliche fehlende Zeichen vor. Allerdings können neuronale Netze nicht ableiten, was nicht in den Daten enthalten ist; wenn es zu wenige Texte gibt, können sie nur plausible, aber unbestätigte Hypothesen anbieten. Sie sagen wahrscheinliche Fortsetzungen voraus, verstehen aber nicht die Bedeutung. Daher bleiben sie Werkzeuge für Forscher, die Hypothesentests und Entdeckungen beschleunigen, aber sie können eine vergessene Sprache nicht vollständig entschlüsseln.
Quelle: Habr — хаб ИИ —
Original
