Buch D.A.S.E.R.S.C.H.R.E.C.K.E.N.A.M.S.
Anwendung jenes Prinzips des Unvermögens
Anwendung jenes Prinzips des Unvermögens
BAZON BROCK
HAUPTAMTLICHER BEWEGER
ZUSTÄNDIGER ZU ITZEHOE
UNERMUDLICHER OHRENZEUGENSCHAFT GELEGENHEITSMACHER
LINIENLEGER
ARBEITER AM FOLGENREICHEN KOTFLUEGEL
NICHTWERK UND LESEFLÄCHEN
PATE DER PRINCESSIN ZU CLEVE
PHILOSOPH DER NICHT DENKT
EINER DER ERSTEN DICHTER OHNE LITERATUR
habe ich mir keine dorischen Säulen in die Hosen genäht
wer dennoch mir den kleinen Finger reicht, dem hacke ich die ganze Hand ab
dies sind seine Merkmale, nachdem die Abgründe ausgetrocknet ( ) sein
Haupt ist eine Fama, die nicht schläft, sein rechtes Auge umlaufen, sein linkes
verworfen, die beiden Pupillen seiner Augen sind weiß unter ihren Lidern,
seine Unterlippe ist groß, seine Füße sind breit, seine Finger und Fußgelenke
gekrümmt, er ist die Sichel des Ubergangs, die Nähte sind nah, er wird ernten
Pausenzeichen ex una voce plures faciens nulle efficiens
Pathologie des Schweigens doch laß
diese Hände mich loben und daß wir
Schicksal ebensowenig abstellen wollen
wie einen Radioapparat alle Schleusen
gehen hoch die Schleier fallen sind uns
Gebirge Vorbild im Herrschen
und er sprach mit einem Akzent, den er für biblisch hielt
Jeder Streifen repräsentiert einen Textabschnitt in der Arbeitsbiografie. Je heller ein Streifen, desto verwandter ist der Text mit dem aktuellen Text. Der aktuelle Werk hat die Farbe Rot, der aktuelle Abschnitt ist orange markiert.
Grundlage der Textanalyse ist das Sprachmodell MiniLM-L12 / BGE-M3. Mit dessen Hilfe wird der aktuelle Textabschnitt mit allen anderen Textabschnitten verglichen (insgesamt knapp 3 Millionen Kombinationen) und ein Ähnlichkeitskennwert berechnet.
Die Ähnlichkeit basiert nicht auf Wortgleichheit, sondern auf semantischen Eigenschaften. Beispiele:
Als ähnlich erkannt werden Synonyme, Umschreibungen und Paraphrasen sowie gleiche Bedeutungen – auch in unterschiedlichen Sprachen – erkannt. Beispiel: Kunst und Politik ⟷ art and politics.
Aktuell werden die Textverwandtschaften auf Basis des gesamten Textkorpus statisch vorberechnet und bei Änderungen einzelner Inhalte aktualisiert. In die Berechnung werden nur Textabschnitte einbezogen, die mehr als 100 Wörter Inhalt haben. Leere oder kurze Abschnitte sind daher in dieser Textgenetik nicht enthalten.
Die Verwandtschafts-Abstufungen wurden in 6 Gruppen zusammengefasst: 0 = keine Verwandtschaft, 20, 40, 60, 80, 100 = sehr nah am aktuellen Text.
Die Fundstellen in dieser Verwandtschafts-Textgenetik liefern also möglicherweise völlig andere, eventuell unerwartete Lese-Anregungen, während die zugeordneten Verweise (unter siehe auch) redaktionell ausgewählt wurden.