Belegdichte im TLA

Korpus
TLA
Werkzeuge

Wie sich darstellen lässt, wann ein Lemma belegt ist, obwohl ägyptische Texte auf Zeiträume und nicht auf Jahre datiert sind.

Veröffentlichungsdatum

15. September 2026

Ägyptische Texte sind fast nie auf ein Jahr datiert, sondern auf eine Regierungszeit, eine Dynastie, eine Epoche — auf einen Zeitraum von zehn bis mehreren hundert Jahren.

Die Kurven hier verteilen jeden Token gleichmäßig über den Datierungszeitraum seines Textes: Ein Token aus einem auf hundert Jahre datierten Text trägt zu jedem dieser Jahre ein Hundertstel bei, einer aus einem auf zehn Jahre datierten Text ein Zehntel. Über das Korpus summiert ergibt das für jedes Jahr ein Gewicht, und diese Gewichte sind die Kurve.

Die Kurve lesen

Die Y-Achse ist die Summe der Gewichte in Token pro Jahr. Die blasse Linie ist die rohe Summe, die kräftige dieselben Daten, gaußgeglättet über 25 Jahre; am Abstand zwischen beiden lässt sich ablesen, wie viel von der Kurvenform aus den Daten stammt und wie viel aus der Glättung. Die Bänder im Hintergrund sind die üblichen Epochen.

In der absoluten Ansicht zeigt die Kurve das Gewicht des Lemmas selbst. Da eng datierte Texte pro Jahr mehr beitragen als weit datierte und das Korpus über die Jahrhunderte ungleich dicht ist, steigt und fällt sie mit dem Korpus ebenso wie mit dem Wort. Die relative Ansicht teilt dasselbe Gewicht durch das Gewicht aller lemmatisierten Token desselben Jahres.

Belegdichte von mꜣꜣ und ptr über die Zeit, in Token pro Jahr. Frühdynastische Zeit Altes Reich 1. Zwischenzeit Mittleres Reich 2. Zwischenzeit Neues Reich 3. Zwischenzeit Spätzeit Griechisch-Römische Zeit 2600 v. Chr. 2400 v. Chr. 2200 v. Chr. 2000 v. Chr. 1800 v. Chr. 1600 v. Chr. 1400 v. Chr. 1200 v. Chr. 1000 v. Chr. 800 v. Chr. 600 v. Chr. 400 v. Chr. 200 v. Chr. 0 n. Chr. 200 n. Chr. 0.0 2.00 4.00 6.00 8.00 10.0 Token pro Jahr mꜣꜣ — sehen; erblicken 66270 · 2.848 Token ptr — sehen; erblicken 62900 · 560 Token
Abbildung 1: Zwei Verben des Sehens, mꜣꜣ und ptr, in absoluter Ansicht.

Was gezählt wird

Gezählt wird jedes Token, das eine Lemma-ID trägt; zerstörte und nicht bestimmte Wörter tragen nichts bei. Lesungsvarianten einer Passage liegen im TLA als eigene Dateien und würden doppelt gezählt, weshalb nur die kanonische Lesung verwendet wird. Trägt ein Text mehrere Datierungsangaben, so wird sein Gewicht auf sie verteilt.

Zwei Ausschlüsse: Texte, deren Datierung im Thesaurus kein Jahresintervall trägt, fallen heraus, und Lemmata mit weniger als drei Token im Korpus sind gar nicht erst exportiert.

Zwei Formen vergleichen

Gebaut habe ich das nicht für die einzelne Kurve, sondern für den Vergleich zweier Kurven. Wo eine mittelägyptische Form und ihr neuägyptisches Gegenstück konkurrieren, zeigt ein gemeinsames Diagramm, ob die eine zurückgeht, während die andere vordringt, ob beide jahrhundertelang nebeneinander stehen und wo sie einander kreuzen — falls sie es tun.

Dafür ist die relative Ansicht nötig (Abbildung 2). In absoluten Zahlen steigen und fallen beide Kurven mit dem Korpus, und zwei Formen, die in denselben Texten belegt sind, sehen einander ähnlich, wie verschieden ihre Geschichte auch sein mag; erst als Anteile an der Evidenz desselben Jahres lassen sie sich gegeneinander lesen.

Belegdichte von mꜣꜣ und ptr über die Zeit, als Anteil an der Evidenz des Jahres. Frühdynastische Zeit Altes Reich 1. Zwischenzeit Mittleres Reich 2. Zwischenzeit Neues Reich 3. Zwischenzeit Spätzeit Griechisch-Römische Zeit 2600 v. Chr. 2400 v. Chr. 2200 v. Chr. 2000 v. Chr. 1800 v. Chr. 1600 v. Chr. 1400 v. Chr. 1200 v. Chr. 1000 v. Chr. 800 v. Chr. 600 v. Chr. 400 v. Chr. 200 v. Chr. 0 n. Chr. 200 n. Chr. 0.00 % 0.05 % 0.10 % 0.15 % 0.20 % 0.25 % 0.30 % 0.35 % 0.40 % 0.45 % % mꜣꜣ — sehen; erblicken 66270 · 2.848 Token ptr — sehen; erblicken 62900 · 560 Token
Abbildung 2: Dieselben zwei Verben in relativer Ansicht.

Das Werkzeug

Attestation density in the TLA nimmt eine oder mehrere Lemmanummern entgegen, durch Komma getrennt, und zeichnet sie in ein gemeinsames Diagramm. Demotische Lemmata tragen ein vorangestelltes d; da der TLA zwei Lemmalisten führt, lassen sich verknüpfte Einträge zusammenfassen und ein Wort so über den Schriftwechsel hinweg verfolgen.

Belegdichte von zꜣ über die Zeit, als Anteil an der Evidenz des Jahres. Frühdynastische Zeit Altes Reich 1. Zwischenzeit Mittleres Reich 2. Zwischenzeit Neues Reich 3. Zwischenzeit Spätzeit Griechisch-Römische Zeit 2600 v. Chr. 2400 v. Chr. 2200 v. Chr. 2000 v. Chr. 1800 v. Chr. 1600 v. Chr. 1400 v. Chr. 1200 v. Chr. 1000 v. Chr. 800 v. Chr. 600 v. Chr. 400 v. Chr. 200 v. Chr. 0 n. Chr. 200 n. Chr. 0.00 % 0.20 % 0.40 % 0.60 % 0.80 % 1.0 % 1.2 % 1.4 % 1.6 % 1.8 % % zꜣ — Sohn; Enkel 125510 · 4.667 Token
Abbildung 3: zꜣ „Sohn” in relativer Ansicht, allein aus der hieroglyphischen Lemmaliste.
Belegdichte von zꜣ über die Zeit, als Anteil an der Evidenz des Jahres, mit den verknüpften demotischen Einträgen. Frühdynastische Zeit Altes Reich 1. Zwischenzeit Mittleres Reich 2. Zwischenzeit Neues Reich 3. Zwischenzeit Spätzeit Griechisch-Römische Zeit 2600 v. Chr. 2400 v. Chr. 2200 v. Chr. 2000 v. Chr. 1800 v. Chr. 1600 v. Chr. 1400 v. Chr. 1200 v. Chr. 1000 v. Chr. 800 v. Chr. 600 v. Chr. 400 v. Chr. 200 v. Chr. 0 n. Chr. 200 n. Chr. 400 n. Chr. 0.00 % 1.0 % 2.0 % 3.0 % 4.0 % 5.0 % 6.0 % 7.0 % % zꜣ — Sohn; Enkel 125510 · 8.765 Token · mit d4968
Abbildung 4: Dasselbe Lemma mit dem verknüpften demotischen Eintrag.

Grundlage sind die TLA-Rohdaten, Korpusausgabe v20. Der Index dahinter hält je Lemma die Datierungsintervalle der Texte, in denen es vorkommt, mit einer Tokenzahl — aggregiert und ohne Textkennungen.