Woher die Daten kommen, was fehlt, wie gerechnet wird.
Ein Werkzeug, um nachzulesen und zu vergleichen, was im Deutschen Bundestag gesagt wird. Es enthält jede Rede aus dem Plenum seit Beginn der 18. Wahlperiode - 83.697 Reden von 1.603 Redner:innen an 791 Sitzungstagen, 2013 bis 2026. Gedacht für Journalist:innen, Forschende und alle, die wissen wollen, wer wann was gesagt hat.
Aus den amtlichen Plenarprotokollen des Bundestages, in der XML-Fassung, die der Bundestag selbst veröffentlicht. Die Protokolle werden über das Dokumentations- und Informationssystem für Parlamentsmaterialien (DIP) gefunden und von dserver.bundestag.de geladen. Sprecher:in, Fraktion und Regierungsamt stehen dort als Auszeichnung im Dokument - sie werden ausgelesen, nicht aus dem Text geraten. Jede Rede verlinkt auf das PDF des Protokolls, in dem sie steht.
Neue Protokolle erscheinen ein bis drei Tage nach der Sitzung. Der Bestand wird täglich abgeglichen; auch nachträglich korrigierte Protokolle werden übernommen. Letzter Abgleich: 21.09.2026, 11:15.
Die Porträtfotos stammen aus Wikimedia Commons, nicht von bundestag.de: Die offiziellen Bilder des Bundestages sind laut Impressum nur für den privaten Gebrauch freigegeben. Gezeigt werden nur Bilder mit vollständiger Lizenz- und Urheberangabe, die unter jedem Porträt steht - für rund 69 % der Redner:innen liegt ein solches Bild vor, die übrigen erhalten ihre Initialen.
Geburtsjahr, Beruf, Wahlkreis und Geschlecht kommen aus den MdB-Stammdaten des Bundestages (Open Data). Deren Personen-IDs sind dieselben wie im DIP, die Verknüpfung ist also exakt und kein Namensabgleich. Für 1.479 der 1.603 Redner:innen liegen Stammdaten vor; es fehlen vor allem Gäste und Mitglieder des Bundesrates.
Die Protokolle vermerken in Klammern, was während einer Rede geschieht. Diese Einträge werden getrennt erfasst: 307.000 Zurufe, 407.000 Beifallsbekundungen, dazu Heiterkeit und Widerspruch. Von den Zurufen ließen sich 94 % einer Person im Bestand zuordnen. Namentlicher Beifall („Beifall des Abg. …“) zählt als Beifall, nicht als Zuruf. Zu jeder Reaktion ist vermerkt, nach welchem Absatz der Rede sie fiel - das erlaubt, Beifall und Zurufe im Text zu verorten. Im Redetext selbst erscheinen sie nicht - dort sind sie weiterhin ausgeschlossen.
Suche. Volltext mit deutscher Stammformreduktion, sodass „Steuer“ auch „Steuern“ findet, und ohne Umlautempfindlichkeit.
Wortstatistik. Wörter werden auf ihren Stamm reduziert und in der häufigsten Schreibweise angezeigt. Funktionswörter und parlamentarische Floskeln („Kolleginnen“, „Drucksache“) sind ausgeschlossen. Anteile werden je 10.000 Wörter der jeweiligen Fraktion angegeben, damit vielredende Fraktionen die Kurven nicht verzerren.
Kennzeichnende Wörter. Log-Odds der Häufigkeit gegenüber dem Gesamtkorpus: nicht die meistgebrauchten Wörter, sondern die, die eine Fraktion oder Person deutlich öfter benutzt als alle anderen. Beschränkt auf Substantive.
Vorher/Nachher. Gewichtete Log-Odds mit informativem Prior (Monroe, Colaresi & Quinn 2008), damit häufige Allerweltswörter, die zufällig schwanken, nicht die Liste anführen.
Wortschatz. Yule’s K als Wiederholungsmaß statt der Type-Token-Ratio, die vor allem misst, wer wenig geredet hat. Ein enger Wortschatz bedeutet im Parlament meist ein enges Ressort.