Thesen zum ägyptischen Genitiv, geprüft am gesamten TLA

Korpus
TLA
Genitiv
Jansen-Winkeln und Werning haben beide Thesen dazu aufgestellt, wann das Ägyptische den direkten und wann den indirekten Genitiv setzt. Was 16 812 Belege aus dem TLA daraus machen: eine bestätigt, eine auf zwei Formeln geschrumpft, eine gar nicht auffindbar.
Veröffentlichungsdatum

16. September 2026

Das Ägyptische kennt zwei Weisen, zwei Substantive zu verbinden. Der direkte Genitiv stellt sie nebeneinander, prw= nzw „Königshaus”; der indirekte schiebt ein Verbindungselement ein, prw nï nzw „Haus des Königs”. Über den größten Teil der Sprachgeschichte stehen beide zur Verfügung und sagen dasselbe. Worüber sich die Wahl im Einzelfall entscheidet, wird seit einem Jahrhundert diskutiert.

Zwei Arbeiten treffen Aussagen, die sich an einem Korpus auszählen lassen. Karl Jansen-Winkeln (ZÄS 127, 2000) geht die älteren Erklärungen durch — Sander-Hansens Morphologie, Junkers Besitzkriterium, Grandet und Mathieus Determiniertheit, Junges Einschränkung, Schenkels engere und weitere Zugehörigkeit — und verwirft sie alle. An ihre Stelle setzt er, dass Lemma und Form des nomen regens die Wahl steuern, und fügt hinzu, die Regeln auszuarbeiten würde „umfangreiche Statistiken erfordern”. Daniel Werning (2024, DOI 10.18452/28786) zählt die Genitive des Höhlenbuchs aus, einer Komposition des 13. Jahrhunderts v. Chr. von rund 11 500 Wörtern: 526 Belege, wenn man die Litaneiwiederholungen beiseitelässt, davon 80 Prozent direkt gegen 20 indirekt. Er liest das als Hyperkorrektur, die nicht nur das zeitgenössische Neuägyptische übertrifft, sondern wahrscheinlich auch das echte ältere Ägyptisch, und fasst égyptien(s) de tradition insgesamt als mentale Übersetzung aus dem Neuägyptischen als Erstsprache in die emulierte ältere Sprachstufe als Zweitsprache. Unter anderem findet er, dass unbelebte Possessoren den direkten Genitiv stärker bevorzugen als belebte — das Gegenteil dessen, was die Typologie erwarten lässt.

Dieser Beitrag berichtet, was herauskommt, wenn man die Statistik tatsächlich rechnet. Das Material ist der Thesaurus Linguae Aegyptiae in der Fassung v20, beschränkt auf Fälle, in denen beide Konstruktionen wirklich zur Verfügung standen: 16 812 Belege über die gesamte Bezeugungsgeschichte hinweg.

Über diese Geschichte verteilt sich das Material ungleich, und nicht nur der Menge nach. Vom Neuen Reich an ist ein großer Teil des Erhaltenen nicht in der Sprache seiner Zeit geschrieben, sondern in einer älteren: 3538 Belege sind als égyptien(s) de tradition ausgewiesen, weitere 1777 als Mittelägyptisch nach dem Mittleren Reich, gegenüber 906 in irgendeiner Form von Neuägyptisch. Knapp die Hälfte des Korpus trägt gar keine Sprachangabe; die Zahlen sind also Untergrenzen.

Welche Konfigurationen den direkten Genitiv strukturell ausschließen, listet Jansen-Winkeln (§6) — ein adjektivisches oder pronominales Attribut, die Kopula pw, ein Adverb oder eine Präpositionalphrase, eine Partikel, ein Suffixpronomen am Regens und einige weitere —, mit dem Vorbehalt, dass kaum eine davon strikt zwingend ist, weil sich jede umgehen lässt. Werning bestätigt die beiden klarsten durch Auszählung: Zwei bloße Substantive stehen in neun von zehn Fällen direkt, ein Suffixpronomen am Regens macht die Konstruktion ausnahmslos indirekt. Ausgeschlossen sind hier 137 Belege: die 133 mit eingeschobenem Determinator, von denen keiner älter ist als 1550 v. Chr., da ein dazwischentretender Determinator den bestimmten Artikel voraussetzt, und vier mit Suffixpronomen am Regens. Alle 137 stehen ausnahmslos indirekt.

Warum ein Modell und keine Auszählung

Der naheliegende Einwand gegen jede Anteilstabelle in der Ägyptologie lautet, dass das Gezählte nicht gleichartig ist. Vier Schwierigkeiten vor allem, für die ein hierarchisches Modell gebaut ist und eine Kreuztabelle nicht.

Nichts ist ausgewogen. zꜣ „Sohn” erscheint 1 005-mal als Kopf, ꞽwf „Fleisch” 642-mal, nb „Herr” 562-mal; im Median ist ein Kopf siebenmal belegt, und die zwanzig häufigsten Kopflemmata tragen 42 Prozent aller Belege. Manche Texte steuern zwei Belege bei, andere zweihundert. Ein roher Anteil überlässt die Entscheidung den großen Beiträgern, und „das Korpus sagt” heißt dann stillschweigend, was das halbe Dutzend größter Teilkorpora sagt.

Alles ist mit allem konfundiert. Eine Gattung wirkt archaisierend, bis man bemerkt, dass sie zufällig bestimmte Wörter gebraucht; ein Lexem wirkt konservativ, bis man bemerkt, dass es vorwiegend in frühen Texten vorkommt. Wer einen Faktor nach dem anderen auszählt, kann das nicht trennen. Ein Modell wägt sie gleichzeitig ab und berichtet, was von jedem übrig bleibt, wenn die übrigen konstant gehalten werden — weshalb etwa der Belebtheitseffekt weiter unten in den rohen Zahlen fast unsichtbar ist und deutlich wird, sobald die Frequenz verrechnet ist.

Seltenes darf nicht überlesen werden. Die nützlichste Eigenschaft eines hierarchischen Modells ist eine, in der Ägyptolog*innen eine alte methodische Sorge wiedererkennen werden, nur präzise gefasst. Ein zweimal belegtes Lexem, beide Male mit indirektem Genitiv, erhält keine Rate von 100 Prozent; es wird zum Korpusmittel hin gezogen, und wie weit, hängt davon ab, wie viel Evidenz es mitbringt. Lexeme mit vielen Belegen behalten ihren eigenen Wert, Lexeme mit wenigen finden bei den übrigen Halt. Nichts muss verworfen werden, weil es selten ist, und nichts Seltenes bekommt mehr Gewicht, als ihm zusteht.

Datierungen sind Zeiträume, keine Jahre. Die Zeitachse des Modells ist eine glatte Kurve, angepasst an die Mittelpunkte der Datierungsspannen — ein Kompromiss, aber ein offengelegter.

Das Ergebnis ist eine hierarchische bayesianische logistische Regression: eigene Ebenen für das Kopflemma, das abhängige Lemma und deren Kombination, daneben Text, Satz, Teilkorpus und Gattung, dazu eine Kurve über die Zeit und eine Reihe gewöhnlicher Prädiktoren. Angepasst in Stan; die Implementierung ist hier nicht der Gegenstand.

Wie die Zahlen unten zu lesen sind

Zwei Konventionen, weil der Rest des Beitrags durchgehend mit ihnen arbeitet.

Die Koeffizienten stehen in Log-Odds. Sie sind additiv auf einer Skala, die sich erst dann in Prozente übersetzt, wenn man weiß, wo man begonnen hat. Ein Koeffizient von +0,33 besagt: Lagen vergleichbare Fälle bei 40 Prozent indirekt, so verschiebt dieses Merkmal sie auf etwa 48. Dieselben +0,33 auf Fälle angewandt, die schon bei 80 Prozent liegen, verschieben sie nur auf 85 — die Skala staucht an den Enden, was genau das ist, was man will, wenn das Modellierte ein Anteil ist. Negativ heißt „zum direkten Genitiv hin”, positiv „zum indirekten hin”. Als grober Anhalt: ±0,2 ist klein, ±1 ist groß, ±2 ist erdrückend.

Die Intervalle bedeuten, wonach sie aussehen. Die Klammern enthalten 90-Prozent-Kredibilitätsintervalle, und hier zahlt sich der bayesianische Rahmen für die philologische Arbeit aus: „−0,99 [−1,65; −0,35]” besagt, dass der Wert mit einer Wahrscheinlichkeit von 90 Prozent in diesem Bereich liegt, gegeben Modell und Daten. Das ist die Aussage, die alle treffen wollen und die ein klassisches Konfidenzintervall nicht zulässt. Deckt ein Intervall die Null ab, dann sagen uns die Daten nichts über die Richtung — was, wie sich zeigen wird, hier öfter vorkommt, als einem lieb ist.

Es kommt auf das Kopfsubstantiv an

Vor den einzelnen Thesen ein Befund, den keine von ihnen ausspricht. Von allem, was das Lexikon zur Wahl beiträgt, entfallen rund 57 Prozent auf die Kombination der beiden Substantive, 36 auf den Kopf und nur 7 auf das abhängige Substantiv. Der Kopf wiegt fünfmal so schwer wie das abhängige Substantiv — Jansen-Winkelns These, bestätigt. Der größte Anteil gehört aber keinem der beiden für sich. Welche zwei Wörter zusammenstehen, zählt mehr als jedes einzelne von ihnen, und keine Eigenschaft eines der beiden sagt es vorher.

zꜣ „Sohn” zeigt, was das in der Praxis heißt. Werning findet im Höhlenbuch alle neun Verwandtschaftsfälle direkt und erklärt sie als altes lexikalisiertes Kompositum, mit dem koptischen ⲥⲓⲧⲉ „Basilisk” aus zꜣ tꜣ als Rest. Über das ganze Korpus hinweg ist es eine starke, aber keine kategorische Präferenz: 22 Prozent seiner 1 005 Belege stehen indirekt, und sie verteilen sich über alle Epochen.

Die Numerusregel gilt — für zwei Formeln

Jansen-Winkelns klarste lexikalische Beobachtung betrifft einsilbige Maskulina, besonders Körperteile: In den Pyramidentexten stehen sie im Singular mit dem indirekten Genitiv, im Dual und Plural mit dem direkten. Auf dieses Korpus beschränkt er das Muster nicht — er führt ḥm nï „die Majestät des” an und findet Spuren noch im späten Mittelägyptischen —, und seine Lexemliste endet mit „und andere”.

Die Hälfte davon trifft zu. Roh steht der Singular in 40,6 Prozent der Fälle indirekt, der Plural in 40,6 — kein Unterschied — und der Dual in 16,2. Im Modell, bei sonst konstant gehaltenen Bedingungen, liegt der Dual bei −0,99 [−1,65; −0,35] und der Plural bei +0,07 [−0,29; +0,41]. Der Zug zum direkten Genitiv ist im Dual also erheblich und im Plural nicht vorhanden: eine Präzisierung, keine Widerlegung, denn paarige Körperteile im Dual bilden den Kern seiner Beispiele.

Doch selbst das ist ungleicher. Von 419 Dualbelegen entfallen 252 auf drei Kopflemmata, und zwei davon sind einzelne feste Wendungen: ꜥꜣ-wï= p:t „die beiden Türflügel des Himmels”, 99 Belege, und zḫn-wï= p:t, 89 Belege, was ein Lemmapaar ist. Beide stehen nahezu ausnahmslos direkt. Nimmt man die drei häufigsten Dualköpfe heraus, steht der Dual bei 35,9 Prozent gegen 40,6 im Singular — fünf Punkte statt vierundzwanzig.

Das Modell hat eine Ebene für das Lemmapaar, gerade damit Formeln wie diese dort aufgefangen werden, statt sich als Grammatik auszugeben, und halb gelingt das auch: ꜥꜣ + p:t liegt bei −0,93, aber mit einem Intervall von [−2,07; +0,20], das die Null abdeckt. Bei 99 Belegen einer einzigen Wendung und fast keiner Gegenevidenz aus demselben Paar im Singular kann das Modell nicht abschließend entscheiden, ob es eine Eigenschaft der Wendung, des Lexems oder des Duals vor sich hat. Alle drei Erklärungen passen.

Die redliche Formulierung lautet, dass die Regel für bestimmte lexikalisierte Dualwendungen gilt und nicht für den Dual als grammatische Kategorie. Das ist kein geringer Unterschied: Er verschiebt das Phänomen aus der Morphologie ins Lexikon, und dorthin hat Jansen-Winkeln die ganze Frage von vornherein verlegt.

Material und Maß: stark, aber keine Regel

Er hält ferner daran fest, dass Ausdrücke des Materials, der Länge und des Inhalts stets den indirekten Genitiv nehmen; Werning findet dasselbe für den genitivus materiae, der auf seiner semantischen Karte nur indirekt erscheint.

Die These stammt nicht ursprünglich von Jansen-Winkeln. Er berichtet sie von Erman und Osing, die zwei Genitive scheiden — Zugehörigkeit und Abhängigkeit auf der einen, qualifizierende Näherbestimmung (Material, Maß, Inhalt, Art) auf der anderen Seite —, und er fügt eine morphologische Erklärung hinzu: Der zweite Typ gehe auf eine umgekehrte, passivische Nisbe nï zurück, wie in mdw nï z „das Wort des Mannes” gegenüber z nï mdw „ein Mann der Worte” (§§9–11). Nach seiner Auffassung sollte der zweite Typ strenggenommen gar nicht Genitiv heißen.

Die Präferenz ist stark, die Ausnahmslosigkeit nicht gegeben. Materialwörter als abhängiges Substantiv stehen in 68,8 Prozent der Fälle indirekt, Maßangaben in 72,2, gegenüber 40,0 sonst — aber 29 Material- und 10 Maßbelege stehen im direkten Genitiv.

Ob die Präferenz der Klasse zukommt oder ihren acht Mitgliedern, lässt sich hier nicht entscheiden: Der Klasseneffekt liegt bei +0,50 [−0,19; +1,19] und belegt damit nichts. Was die Klasse trägt, sind drei Wörter: ṯḥn:t „Fayence, Glas” mit 94 Prozent von 17 Belegen, ḥmt „Kupfer, Erz” mit 83 Prozent von 24 und mḥ „Elle” mit 73 Prozent von 33. Das zweitgrößte Materiallexem, bd „Natron”, steht bei 45 Prozent von 22 Belegen und damit kaum über dem Korpusmittel. „Materialwörter” als Kategorie tragen nichts.

Wernings Belebtheitsartefakt tritt hier nicht auf

Wernings Befund zur Belebtheit ist eigentlich keine These über Belebtheit. Er ist eine These über ein Artefakt: Die umgekehrte Beziehung, die er misst, sei, so sein Argument, ein Nebenprodukt von Fällen wie nb= ḏꜣḏꜣ „Herr des Kopfes”, wo das Possessum den Possessor grammatisch besitzt. Nimmt man diese heraus, verschwindet die Beziehung fast. Seine rohen Zahlen zeigen die Umkehrung deutlich: Gegen Kammerzells Erwartung und gegen das Ikonizitätsprinzip steht bei ihm die unveräußerliche Possession zu 35 Prozent indirekt, die veräußerliche nur zu 15.

Die Prüfung verlangt eine Belebtheitsskala, über die der TLA nicht verfügt — seine Kategorien für das abhängige Substantiv (Göttername, Ortsname, Titel, Königsname, Personenname, Appellativum) bilden keine, weil das Appellativum Personen und Dinge vermischt. Also wurden 200 abhängige Lexeme, die 88 Prozent der Belege abdecken, von Hand kodiert, auf einem Bogen, der das Verhalten dieser Lexeme absichtlich nicht auswies.

Die Prüfung vergleicht zwei Läufe, einen mit seiner Klasse im Modell und einen ohne, denn seine These betrifft eine Verzerrung und keinen Wert. Der Belebtheitskoeffizient bewegt sich um 0,002 — zwei Tausendstel einer Log-Odds-Einheit, also nichts. Seine Klasse selbst liegt bei −0,29 [−0,92; +0,35] und trägt ebenfalls nichts.

Die Belebtheit weist in diesem Korpus in die gewöhnliche Richtung und nicht in die umgekehrte: +0,33 [+0,06; +0,60] für menschliche und göttliche Possessoren unter den Appellativa, das sind etwa acht Prozentpunkte. Und sie ist ein gutes Beispiel dafür, warum man modelliert statt auszuzählen, denn roh ist sie fast unsichtbar: 41,0 Prozent indirekt bei belebten Possessoren gegen 39,5 bei unbelebten. Anderthalb Punkte.

Verdeckt wird sie von der Frequenz. Belebte Appellativa sind erheblich häufigere Wörter, und Frequenz zieht zum direkten Genitiv; die beiden Effekte heben einander beinahe auf. Vergleicht man Gleiches mit Gleichem, tritt der Unterschied hervor — im mittleren Frequenzband stehen belebte Possessoren in 49,7 Prozent der Fälle indirekt, unbelebte in 30,2. Zwanzig Punkte. Eine Kreuztabelle hätte „kein Belebtheitseffekt” gemeldet und damit falsch gelegen, und eine nach Frequenz aufgeteilte Kreuztabelle wären die Daten ausgegangen.

Anteil der indirekten Genitive bei unbelebten und bei menschlichen oder göttlichen Possessoren, insgesamt und in drei Frequenzbändern. Insgesamt liegen beide weniger als zwei Punkte auseinander; im mittleren Band liegt die belebte Gruppe fast zwanzig Punkte höher. Die Frequenz verdeckt den Animatheitseffekt Anteil der indirekten Genitive bei appellativischen Rekta, aufgeteilt danach, wie häufig das abhängige Lemma ist. Rohe Anteile, keine Kontrollen; die Bänder sind Drittel der Lemmafrequenz. unbelebter Possessor menschlicher oder göttlicher Possessor 0 % 20 % 40 % 60 % 80 % Alle Appellativa 39,5 % (n = 5 046) 41,0 % (n = 4 416) Seltenes Drittel 45,7 % (n = 2 784) 48,4 % (n = 380) Mittleres Drittel 30,2 % (n = 2 152) 49,7 % (n = 1 579) Häufiges Drittel 68,2 % (n = 110) 34,3 % (n = 2 457) Insgesamt unterscheiden sich die beiden Gruppen um 1,5 Punkte; im mittleren Band, wo beide gut belegt sind, um 19,5. Belebte Appellativa sind viel häufigere Wörter, und die Frequenz selbst zieht zum direkten Genitiv; die beiden Effekte heben sich fast auf. Umrandeter Balken: Das häufige Band enthält nur 110 unbelebte Belege und trägt nichts.
Abbildung 1: Nur appellativische abhängige Substantive: 9 462 der 12 274 appellativischen Belege, Tiere und unbestimmte Lexeme ausgenommen. Die Bänder sind Drittel der Frequenz des abhängigen Lemmas. Rohe Anteile. Das oberste Band enthält nur 110 unbelebte Belege, weshalb es in die andere Richtung weist.

Ein Vorbehalt zum negativen Befund. Weil jedes Kopflemma im Modell seinen eigenen Effekt hat, sind nb, ḥqꜣ und nzw bereits einzeln verrechnet, bevor Wernings Klasse zugeschaltet wird. Geprüft wird hier, ob die Klasse darüber hinaus etwas verzerrt. Das tut sie nicht — womit aber nicht gezeigt ist, dass seine Korrektur in einer einfachen Kreuztabelle entbehrlich wäre, wo sie durchaus nötig sein mag.

Archaisierend sind Kompositionen, nicht Gattungen

Werning liest die 80 Prozent direkter Genitive des Höhlenbuchs als absichtliches Archaisieren. Plausibel wird diese Lesart durch den Kontrast zu den Zeitgenossen: Über das Neue Reich hinweg steht das Korpus bei 51,7 Prozent indirekt, ein Text bei 20 Prozent liegt also weit außerhalb dessen, was zur Zeit seiner Abfassung üblich war.

Nicht nur der Anteil gerät dem Höhlenbuch aus dem Rahmen. Jansen-Winkeln betont, dass der direkte Genitiv im Alt- und Mittelägyptischen kein Kompositum ist, sondern eine freie Wortgruppe: Das abhängige Glied kann durch ein Suffix, einen weiteren Genitiv, ein Adjektiv oder einen Relativsatz erweitert werden, und die Abfolge lässt sich aufbrechen (§4). Werning findet im Höhlenbuch 14 klare und 23 strittige Fälle unmittelbar verschachtelter Genitive, ein Muster, das im echten Alt- und Mittelägyptischen so gut wie unbezeugt ist, und schließt daraus, dass die Verfasser den direkten Genitiv nicht mehr als phonologisch markiertes Kompositum verstanden, sondern als bloße Juxtaposition. Die Regel, die er für ihre mentale Übersetzung rekonstruiert — Artikel tilgen, Konnektor flektieren oder tilgen —, enthält keine Phonologie mehr.

Das ist eine überprüfbare Vorhersage: Religiöse Kompositionen des Neuen Reichs müssten deutlich direkter stehen als ihre Zeitgenossen, sobald Datierung, Lexikon und Grammatik konstant gehalten werden.

Das tun sie, und zwar deutlich. Religiöse und funeräre Texte des Neuen Reichs liegen bei −1,73 [−2,14; −1,33] gegenüber allem anderen ihrer Zeit, das Totenbuch bei −1,31.

Anteil der indirekten Genitive nach Teilkorpus des Neuen Reichs, von den medizinischen Texten bei 69,4 Prozent bis zu den Briefen bei 20,8 Prozent. Indirekter Genitiv nach Teilkorpus, Neues Reich Anteil der Belege mit indirekter Konstruktion, 1550–1070 v. Chr. Teilkorpora mit mindestens 150 Belegen (4 619 von 4 856). Gestrichelte Linie: Mittel des Neuen Reichs, 51,7 %. 0 % 20 % 40 % 60 % Medizinische Texte 69,4 % n = 725 Unterweltsbücher 59,7 % n = 278 Amarna-Texte 58,4 % n = 161 Magische Texte 58,4 % n = 425 Ramessidische Inschriften 53,1 % n = 569 Literarische Texte 52,0 % n = 763 Magisch-medizinisch (Heka) 50,7 % n = 290 Totenbuch 42,3 % n = 665 Historisch-biographisch 40,1 % n = 551 Briefe 20,8 % n = 192
Abbildung 2: Teilkorpora des Neuen Reichs mit mindestens 150 Belegen, 4 619 von 4 856. Die Anteile sind roh; die Reihenfolge bleibt erhalten, wenn Datierung, Lexikon und Grammatik konstant gehalten werden.

Die Spanne beträgt fast fünfzig Punkte, und nichts davon ist chronologisch — das sind durchweg dieselben fünf Jahrhunderte. Die Fachprosa liegt am indirekten Ende: medizinische Texte 69,4 Prozent, magische Texte 58,4. Die Gebrauchsschriftlichkeit liegt am direkten Ende, die Briefe mit 20,8 am tiefsten von allen. Das Totenbuch liegt mit 42,3 Prozent knapp zehn Punkte unter der Literatur derselben Zeit. Das ist Register: dieselbe Sprache, und Schreiber, die je nachdem, was sie schrieben, anders wählten.

Für Wernings eigenes Material trifft die Vorhersage allerdings nicht zu, und zwar aus einem Grund, den man kennen sollte. Die Unterweltsbücher des Neuen Reichs liegen bei +0,10 [−0,37; +0,59] — im Mittel nichts Archaisierendes. Und das Höhlenbuch selbst steht im TLA mit sechs Textstücken, fünf davon in die 30. Dynastie datiert und eines auf Psammetich I., weil der TLA nach dem Textzeugen datiert und die erhaltenen Abschriften aus TT 33 und später stammen. Nur zwei seiner Belege erreichen diese Untersuchung überhaupt. Sein Text ist in diesem Korpus faktisch nicht enthalten.

Was bleibt, ist schärfer als die ursprüngliche Frage. Archaisierend sind nicht religiöse Texte im Allgemeinen, sondern einzelne Kompositionen: Das Totenbuch hält am direkten Genitiv fest, die Unterweltsbücher tun es nicht — gleiche Zeit, gleiches Lexikon, gleiche weitere Textkategorie.

Der größte Effekt hat keine Erklärung

Worauf das Modell hier stößt, ist größer als alles bisher Besprochene, und das Korpus kann nicht klären, was dahintersteht.

Weil die Numerusregel lexikalisch ist und nicht allgemein, erhält jedes Kopflemma seine eigene Steigung für „nicht Singular” — seine eigene Antwort auf die Frage, was der Plural mit ihm macht. Die Streuung dieser Steigungen beträgt 2,11 in Log-Odds, die größte Einzelgröße der ganzen Analyse: größer als jede Gruppenebene, größer als die Datierung, größer als jeder feste Effekt. Und sie läuft in beide Richtungen. ꞽb= nṯr „das Herz des Gottes” steht in 70 Prozent seiner Belege indirekt; ꞽb-w= nṯr-w „die Herzen der Götter” in keinem seiner fünfzehn Pluralbelege. ꜥ „Arm” steht in 72 Prozent der Singulare indirekt und in 2 Prozent der Duale. ḥꜣb „Fest” geht den umgekehrten Weg: 22 Prozent im Singular, 83 im Plural.

Für 22 Kopflemmata der Anteil indirekter Genitive im Singular links und im Dual oder Plural rechts. Körper- und Seelenteile fallen steil ab, andere Lemmata steigen. Was der Plural mit einem Kopfnomen macht, hängt vom Nomen ab Anteil der indirekten Genitive im Singular und im Dual oder Plural, für die 22 Kopflemmata mit mindestens zehn Belegen in beiden. Rohe Anteile, keine Kontrollen. 0 % 25 % 50 % 75 % 100 % Singular Dual, Plural ꞽb 76 % bꜣ 74 % ꜥ 72 % ḥꜥ-w 68 % sḫr 65 % ꜥꞽ 33 % ꜥrf 27 % ḥꜣb 22 % ḫꜣs:t 12 % ḥꜣb 83 % ꜥꞽ 54 % ḫꜣs:t 47 % ꜥrf 41 % ḥꜥ-w 33 % sḫr 32 % bꜣ 17 % ꞽb 9 % ꜥ 2 % Blau: Körper- und Seelenteile, im Plural zum direkten Genitiv gezogen.Orange: Lemmata, die in die andere Richtung gezogen werden. Grau: die übrigen dreizehn.
Abbildung 3: Kopflemmata mit mindestens zehn Belegen in beiden Numeri. Rohe Anteile, keine Kontrollen; blau die Körper- und Seelenteile, orange die Lemmata, die sich in die andere Richtung bewegen.

Als Erstes ist auszuschließen, dass dies ein Artefakt des oben beschriebenen Heranziehens an den Mittelwert ist — dass das Modell Variation unter Lexemen erfindet, über die es nichts weiß. Das ist es nicht: 412 von 625 Kopflemmata haben überhaupt keinen Beleg außer im Singular, und ihre Steigungen streuen um 0,02 gegen 1,47 bei den übrigen. Das Modell zieht die uninformierten genau so auf null, wie es soll, und die 2,11 stammen von den etwa 35 Lemmata, die wirkliche Evidenz mitbringen.

Der sauberste Nachweis, dass der Effekt sprachlicher Natur ist, kommt ganz ohne das Modell aus. Von den 42 Lemmapaaren, die in beiden Numeri mindestens fünfmal belegt sind, beträgt der mittlere Anteilsunterschied zwischen Singular und Nicht-Singular 24 Prozentpunkte, und elf unterscheiden sich um mehr als 30. Gleicher Kopf, gleiches abhängiges Substantiv, anderer Numerus, andere Konstruktion.

Die naheliegende Erklärung ist Alienabilität. Die Lexeme, die es im Plural zum direkten Genitiv zieht, sind im Großen und Ganzen Körper- und Seelenteile — ꜥ, ꞽb, qs „Knochen”, bꜣ, dp —, und die in die andere Richtung ziehen, sind veräußerliche Dinge und Ereignisse. Das wäre ein bemerkenswerter Befund, denn Werning findet keine Alienabilitätsspaltung als Haupteffekt: Sie bestünde nur in Wechselwirkung mit dem Numerus.

Sie hält der Prüfung nicht stand. Kodiert man 213 Kopflemmata von Hand und nimmt Alienabilität als Prädiktor auf die Steigung hinzu, ergibt das über alle kodierten Lemmata −0,75 [−1,33; −0,15]. Fünfunddreißig dieser Lemmata sind aber gerade diejenigen, die die Hypothese überhaupt erst nahegelegt haben. Beschränkt auf die übrigen 178 ergibt sich −0,47 [−1,14; +0,20]: die richtige Richtung, etwa 87 Prozent der Wahrscheinlichkeitsmasse unterhalb der Null und ein Intervall, das auch einschließt, dass nichts geschieht. Und selbst in der großzügigen Fassung erklärt sie rund 8 Prozent derjenigen Variation, die zu erklären sie angetreten ist; in der redlichen Fassung 2.

Eine schärfere Prüfung bräuchte mehr Duale und Plurale, als es gibt. Es sind 1 622 von 16 812 Belegen, 9,6 Prozent, verteilt auf 213 Lemmata.

Es gibt einen Erklärungsvorschlag, der älter ist als die Alienabilität, und er stammt von Jansen-Winkeln selbst. Er hält die Komplementarität der Einsilber — indirekt im Singular, direkt im Dual und Plural — für morphologisch und phonologisch bedingt und nicht für semantisch, und in einer Fußnote nennt er einen Mechanismus: Ein Einsilber hat im Singular notwendig einen kurzen betonten Vokal, es gibt also keine Kürzung von lang zu kurz, die der Status constructus vornehmen könnte, während Plural und Femininum eine haben und im Dual eine Kürzung zumindest leichter fiele (§8 mit Anm. 78). Er kennzeichnet das als Vermutung. Die Lemmata mit den steilsten negativen Steigungen sind hier weitgehend seine Einsilber. Der Prüfung steht entgegen, dass jedes Kopflemma nach Silbenstruktur und nach seinem Verhalten im Status constructus klassifiziert werden müsste, und die TLA-Annotation liefert weder das eine noch das andere. Die Erklärung, die am besten passt, ist diejenige, nach der sich dieses Korpus nicht fragen lässt.

Das Größte also, was diese Analyse misst, ist real, ist lexikalisch und wird hier nicht erklärt.

Ein Satz von 2000

Nachdem er beschrieben hat, wie Lexikon und Morphologie die Wahl steuern, schreibt Jansen-Winkeln (§8):

Diese Regeln im einzelnen (und für die verschiedenen Epochen) zu entschlüsseln, würde > umfangreiche Statistiken erfordern.

Der Satz ist sechsundzwanzig Jahre alt. Verlangt werden darin umfangreiche Statistiken. Was sie voraussetzen, ist seither entstanden: ein digitales, lemmatisiertes Korpus und die Rechenleistung für ein bayessches Modell, das jedem Lemma einen eigenen Effekt gibt. Dieser Beitrag rechnet eine solche Statistik, für den Teil des Materials, in dem beide Konstruktionen wirklich zur Verfügung standen. Am häufigsten lautet das Ergebnis: Das lässt sich hier nicht entscheiden. Auch das ist eine Auskunft.


16 812 Belege aus TLA v20, alle Epochen. Hierarchische bayesianische logistische Regression in Stan: gekreuzte Ebenen für Kopflemma, abhängiges Lemma und Lemmapaar, daneben Text, Satz, Teilkorpus und Gattung, ein kubischer Spline über die Datierung und Prädiktoren auf den Lexemebenen; durchgehend nichtzentrierte Parametrisierung, vier Ketten, keine Divergenzen. Code, Kodierbögen und vollständige Koeffiziententabellen sind nicht veröffentlicht; auf Anfrage gebe ich sie gern weiter. Dies ist ein Nebenprojekt, die Befunde sind vorläufig.