Buch D.A.S.E.R.S.C.H.R.E.C.K.E.N.A.M.S.
Anwendung jenes Prinzips des Unvermögens
Anwendung jenes Prinzips des Unvermögens
denken Sie auf eine Ebene einen Hügel von einigermaßen glatter Oberfläche
aufgesezt. auf seinem Gipfel sollen viele gleichfalls geglättete Kugeln liegen.
durch einen kleinen Anstoß bringt man die Kugeln ins Rollen. sie rollen nach
allen Seiten hinab bis an den Fluß des Hügels und dann noch ein kleines
Stück, bis sie liegen bleiben. wenn das Gelände nicht zu unregelmäßig ist,
werden sie um den Hügel eine Kreislinie bilden. jemand, der diese Gestalt
sieht, wird sie für außerordentlich unwahrscheinlich halten.
bekannt sind die langen Züge der Prozessionsraupen, die zustande kommen,
indem jedes Tier sich mit der Stirn an das Hinterende des Vordermannes
anfügt und ihm nachläuft. gerät die Spitze in ein Loch, aus dem sie sich nicht
wieder heraushelfen kann, so stockt der Zug und kann stehenbleiben, bis alle
Raupen verhungert sind. man hat ferner das Spitzentier so mit Hilfe einer
Attrappe hinter das letzte zu lenken, daß es sich diesem anschließt. dann
zieht die Prozession im Kreise, bis alle sterben.
wahrlich, schon der Pfau versteht die spezifische Geste des Truthahns nicht
mehr.
Jeder Streifen repräsentiert einen Textabschnitt in der Arbeitsbiografie. Je heller ein Streifen, desto verwandter ist der Text mit dem aktuellen Text. Der aktuelle Werk hat die Farbe Rot, der aktuelle Abschnitt ist orange markiert.
Grundlage der Textanalyse ist das Sprachmodell MiniLM-L12 / BGE-M3. Mit dessen Hilfe wird der aktuelle Textabschnitt mit allen anderen Textabschnitten verglichen (insgesamt knapp 3 Millionen Kombinationen) und ein Ähnlichkeitskennwert berechnet.
Die Ähnlichkeit basiert nicht auf Wortgleichheit, sondern auf semantischen Eigenschaften. Beispiele:
Als ähnlich erkannt werden Synonyme, Umschreibungen und Paraphrasen sowie gleiche Bedeutungen – auch in unterschiedlichen Sprachen – erkannt. Beispiel: Kunst und Politik ⟷ art and politics.
Aktuell werden die Textverwandtschaften auf Basis des gesamten Textkorpus statisch vorberechnet und bei Änderungen einzelner Inhalte aktualisiert. In die Berechnung werden nur Textabschnitte einbezogen, die mehr als 100 Wörter Inhalt haben. Leere oder kurze Abschnitte sind daher in dieser Textgenetik nicht enthalten.
Die Verwandtschafts-Abstufungen wurden in 6 Gruppen zusammengefasst: 0 = keine Verwandtschaft, 20, 40, 60, 80, 100 = sehr nah am aktuellen Text.
Die Fundstellen in dieser Verwandtschafts-Textgenetik liefern also möglicherweise völlig andere, eventuell unerwartete Lese-Anregungen, während die zugeordneten Verweise (unter siehe auch) redaktionell ausgewählt wurden.