Das Konzept

Die Verschiebung des Sagbaren

Eine fortlaufende, methodisch abgesicherte Vermessung, wie sich rechte Rhetorik in der deutschsprachigen Medienlandschaft ausbreitet und vom Rand in die Mitte wandert.

Kurzfassung

Flag ordnet einen fortlaufenden Querschnitt öffentlicher Äußerungen und gemeldeter Kommentare nach Schweregrad (0 bis 5) und rhetorischem Mechanismus ein. Die Kennzahlen dieser Seite aktualisieren sich mit der laufenden Auswertung.

·
Beiträge ausgewertet
·
Reliabilität Mensch ↔ KI (Krippendorffs α)
·
Mittlere Konfidenz der Einordnung

Das Modell

Rechte Rede ist selten ein offener Aufruf. Sie arbeitet mit wiederkehrenden Verfahren: einer Zuspitzung von Volk gegen Elite, der Delegitimierung von Institutionen, einer Erzählung von Bedrohung. Einzeln wirkt jeder Beitrag beliebig. Erst über den gesamten Bestand wird das Verfahren messbar, und mit ihm die Bewegung vom Rand in die Mitte.

Flag beschreibt jeden Beitrag auf zwei getrennten Ebenen: der Schweregrad misst die menschen- und demokratiefeindliche Schärfe auf einer geordneten Skala von 0 bis 5, die Mechanismen benennen die verwendeten rhetorischen Verfahren. Bewertet werden Aussagen und Muster, nie einzelne Menschen.

Abb. 1 Die geordnete Schweregrad-Skala mit den absoluten Fallzahlen der laufenden Auswertung. Ab Stufe 3 beginnt die gruppenbezogene Menschenfeindlichkeit; Stufe 4 ist Extremismus im engeren Sinn vorbehalten.

Methode

Die Einordnung erhält nur den Inhaltstext, keine Namen, keine Bilder. Ein Sprachmodell klassifiziert nach einem festen Codebook mit expliziten Abgrenzungen zwischen den Stufen; jeder vergebene Mechanismus wird mit einem wörtlichen Belegzitat gestützt.

Statt eines Einzelurteils entsteht die Einordnung im Selbstkonsistenz-Ensemble: mehrere Durchläufe je Beitrag, aggregiert zum Median-Schweregrad und zum Mehrheitsvotum der Mechanismen. Aus der Übereinstimmung folgt eine Konfidenz. Unsichere oder in sich widersprüchliche Fälle werden nicht übernommen, sondern an eine menschliche Prüfung eskaliert.

Jede menschliche Prüfung, ob Bestätigung oder Korrektur, bildet ein Paar aus KI- und Mensch-Einordnung desselben Falls. Daraus berechnen wir Krippendorffs α1, den etablierten, chance-korrigierten Kennwert für die Übereinstimmung von Codierungen. Gegen einen annotierten Goldstandard misst ein offener Prüfstand zusätzlich Genauigkeit, Makro-F1 und Konfusionsmatrix.

Befunde

Wird geladen.

Abb. 2 Verteilung nach Schweregrad, als Anteil mit 95-Prozent-Konfidenzintervall (Punkt und Whisker) auf logarithmischer Achse. Die logarithmische Darstellung macht auch die seltenen, schweren Stufen sichtbar. Absolute Fallzahlen rechts.

Häufigste rhetorische Mechanismen

Abb. 3 Häufigste Mechanismen, als Zahl der Beiträge, in denen der Mechanismus auftritt.

Zusammenspiel der Mechanismen

Die zentrale Beobachtung ist nicht die Häufigkeit einzelner Muster, sondern ihr Zusammenspiel. Die folgenden Paare treten statistisch signifikant gemeinsam auf; sie verstärken sich, statt unabhängig zu erscheinen.

Abb. 4 Signifikant gemeinsam auftretende Mechanismen. Lift ist das Verhältnis der beobachteten zur unter Unabhängigkeit erwarteten gemeinsamen Häufigkeit; p aus einem einseitigen exakten Test (Fisher). Ein Lift über 1 bedeutet: die Mechanismen verstärken sich.

Angegriffene Gruppen

Gemeint sind die Gruppen, gegen die sich die Feindlichkeit richtet, also die Angegriffenen, nicht eine anvisierte Zielgruppe.

Abb. 5 Die angegriffenen Gruppen, gegliedert nach dem Grund des Angriffs.

Diskussion und Grenzen

Die überwiegende Mehrheit der ausgewerteten Beiträge liegt im unteren Bereich der Skala. Das ist erwartbar, denn analysiert wird ein Querschnitt der Medienlandschaft, nicht nur der rechte Rand. Aussagekräftig ist deshalb nicht der Durchschnitt, sondern die absolute Zahl der schweren Fälle und vor allem das Zusammenspiel der Mechanismen.

Die Grenzen benennen wir offen. Die Stichprobe ist nicht repräsentativ im statistischen Sinn; sie speist sich aus Meldungen und beobachteten Quellen und bildet daher kein bevölkerungsrepräsentatives Bild, sondern das Material, das uns erreicht. Die automatische Einordnung ist trotz Ensemble und menschlicher Prüfung fehlbar, besonders bei Ironie und Kontext. Die Taxonomie ist ein Modell und entwickelt sich weiter. Für seltene Stufen sind die Fallzahlen klein, entsprechend breit sind ihre Intervalle. Diese Seite ist ein laufender Befund, kein Endergebnis.

  1. Krippendorffs α. Chance-korrigiert, hier ordinal für den Schweregrad. Übliche Schwellen: α ab 0,80 verlässlich, 0,667 bis 0,80 vorläufig, darunter unzureichend.

Journalist:innen und Forschende können weitere Daten anfragen: aggregierte Auswertungen, methodische Details und Datenauszüge. Zur Anfrage.