Zum Inhalt springen
KIWITTeilprojekt NBS
← Werkstatt

· Werkstatt

Über 60.000 Modulhandbücher aus 26 Jahren

Aufbau des Bestands, seine Abdeckung und die Erkennung von Modulhandbüchern

Was eine Hochschule lehrt, steht in ihren Modulhandbüchern: welches Modul welche Inhalte hat, mit welchem Umfang, in welchem Studiengang. Diese Dokumente sind öffentlich zugänglich, und die ältesten in unserem Bestand stammen aus dem Jahr 2000. Damit lässt sich eine Frage beantworten, die sonst nur über Umfragen zu haben wäre: Wann taucht künstliche Intelligenz in der Lehre auf, in welchen Fächern zuerst, und wie schnell breitet sie sich aus.

Voraussetzung dafür ist der Bestand selbst. Ein Programm besucht die Webseiten der Hochschulen, sammelt PDF-Dateien ein und entscheidet für jede, ob sie ein Modulhandbuch ist. Der Stand:

ErhebungStand August 2026
Hochschulen in der Erhebungsliste422
eingesammelte Dokumenteknapp 300.000
davon als Modulhandbuch erkanntüber 60.000
Hochschulen, von denen Dokumente vorliegen356
Hochschulen, von denen Modulhandbücher vorliegenmindestens 272

Ein Teil der großen Hochschulportale baut seine Seiten erst im Browser auf und ist über einen einfachen Abruf nicht erreichbar. Diese Portale erschließt ein Browser ohne Anzeige, der die Verzeichnisse selbst durchklickt — und damit gerade die großen Häuser mit vielen Studiengängen.

In Deutschland gibt es etwa 22.000 Studiengänge. Damit liegen im Schnitt mehrere Dokumente pro Studiengang vor, teils weil Hochschulen jährlich aktualisieren und dieselbe Ordnung in mehreren Jahrgängen erscheint. Für die historische Frage ist das der Gewinn: Wir können denselben Studiengang über zwei Jahrzehnte verfolgen.

  • 272 mit Modulhandbüchern
  • 84 nur mit anderen Dokumenten
  • 66 bisher ohne Fund
Ein Punkt je Hochschule · Stand August 2026 · eigene Erhebung

Wo die anderen 150 stecken

  • Viele Hochschulen legen ihre Dateien auf einem eigenen Server ab, der nicht zur Hauptadresse gehört; ein Abruf, der nur einer Domain folgt, erreicht sie nicht.
  • Manche Hochschulen veröffentlichen ihre Modulhandbücher nicht.
  • Für einen Teil der Häuser steht die Erhebung noch aus.

„Alle Seiten einer Hochschule“ ist dabei keine wohldefinierte Menge. Eine Hochschule bietet auf ihrer Seite ein interaktives Gebäudemodell an, in dem die Reihenfolge der besuchten Räume in der Adresse steht; damit existieren beliebig viele gültige Adressen für dieselben Räume. Allein dort haben wir 3,5 Millionen offene Verweise gezählt. Eine Erhebung muss deshalb vorab festlegen, welche Bereiche sie ausschließt.

Das Programm ist dabei nicht auf Modulhandbücher zugeschnitten. Seiten finden, Dateien einsammeln und den Dokumenttyp bestimmen sind getrennte Teile, und nur der letzte hängt am Dokumenttyp. Derselbe Aufbau erhebt deshalb auch andere öffentlich zugängliche Dokumente einer Hochschule, und ein Lauf lässt sich mit vergleichbarem Ergebnis wiederholen.

Gezielt suchen statt flächig sammeln

Das Programm sucht daher nicht die ganze Website ab, sondern zuerst dort, wo Modulhandbücher üblicherweise liegen: in der Sitemap und unter bekannten Pfaden wie /studium oder /modulhandbuecher. Nachrichten, Termine und Impressum werden übersprungen.

Die Erhebung verbessert sich dabei mit jedem Durchgang: Findet das Programm ein Verzeichnis, in dem eine Hochschule ihre Dokumente ablegt — bei vielen Systemen heißt es fileadmin —, merkt es sich diesen Pfad und besucht ihn beim nächsten Mal zuerst. Liegt der Dateiserver außerhalb der Hauptadresse, lässt er sich von Hand nachtragen. Eine vollständige Runde über alle 422 Hochschulen dauert rund 73 Stunden.

Wie man ein Modulhandbuch erkennt

  • 296.826 gesammelte Dokumente
  • über 60.000 Modulhandbücher (gerundet)
Was beim Sammeln übrig bleibt · Gleiche Skala · Stand August 2026

Von knapp 300.000 Dokumenten sind über 60.000 Modulhandbücher; der Rest ist Prüfungsordnung, Formular, Flyer, Vorlesungsfolie. Die Unterscheidung läuft in zwei Stufen. Zuerst eine Heuristik: Steht eine Liste von Leistungspunkten drin? Kommt das Wort „Modulhandbuch“ vor? Ist es ein strukturiertes PDF mit Tabellen? Was danach unklar bleibt, geht an ein Sprachmodell, das die ersten zwei Seiten liest und ja oder nein sagt.

Die Reihenfolge ist Absicht. Die Heuristik ist billig und begründet ihre Entscheidung selbst; das Modell entscheidet nur, was sie offenlässt. Wichtiger noch: Volltext-Erfassung und Einordnung sind getrennte Schritte. Der Text wird einmal gewonnen, die Einordnung läuft darauf. Man kann also später anders einordnen, ohne erneut bei den Hochschulen anzufragen.

Was der Bestand über sich selbst sagt

Gut die Hälfte der gefundenen Modulhandbücher gehört zu Bachelor-, gut ein Drittel zu Masterstudiengängen; bei knapp neun Prozent ließ sich der Abschluss nicht bestimmen. Vier Fünftel sind deutsch, ein Neuntel englisch. Die meisten Dokumente haben unter 200 Seiten, einzelne über 5.000 — Gesamtverzeichnisse ganzer Fakultäten oder Fehleinordnungen. Beides geht in die Auswertung ein und wird dort gesondert behandelt.

Das Wort, nach dem man sucht, gab es damals noch nicht

Die Schwierigkeit der historischen Frage ist keine technische. In einem Modulhandbuch von 2006 steht nicht „künstliche Intelligenz“, sondern — wenn überhaupt — Soft Computing, Expertensystem, neuronales Netz, wissensbasiertes System. Eine Suche mit heutigem Vokabular findet in diesen Jahrgängen nichts.

Was als Nächstes kommt

Der Bestand steht. Jetzt kommt die Frage, für die er gebaut wurde: In welchen Modulen taucht das Thema auf, in welchen Fächern zuerst, und wie schnell hat sich das seit den frühen 2000er-Jahren verschoben. Dafür braucht es eine Begriffsordnung, die drei Dinge unterscheidet — wird KI als Werkzeug benutzt, wird sie am Rande erwähnt, oder ist sie Kerninhalt des Moduls — und die die Wortwechsel der letzten zwanzig Jahre mitträgt. Daran arbeitet parallel eine studentische Abschlussarbeit.

Eine methodische Einschränkung ist dabei absehbar: Solche Begriffsordnungen werden üblicherweise auf Englisch formuliert, unsere Dokumente sind zu vier Fünfteln deutsch. Zwischen einem englischen Kategoriennamen und einer deutschen Modulbeschreibung liegt eine Übersetzungsschicht mit eigener Fehlerrate; sie zu quantifizieren steht noch aus.

Auch die Bezugsgröße ist eine Festlegung: Wie viele Hochschulen es in Deutschland gibt, hat keine eindeutige Antwort. Wir arbeiten mit 422; je nach Umgang mit Außenstandorten, eigenständigen Fakultäten und sehr kleinen privaten Einrichtungen kommt man auf andere Werte. Jede Prozentangabe zur Abdeckung auf dieser Seite bezieht sich auf diese 422.

Beitrag aus dem KIWIT-Teilprojekt NBS. Beschriebene Arbeit: Fynn-Frithjof Kraft, M.Sc..