Skip to main content
Section project presentations and practical reports

ExpoKo – Eine Ressource für das wissenschaftliche Schreiben. Ein Projektbericht

Authors

Abstract

Der Projektbericht stellt das Projekt ExpoKo vor, in dessen Rahmen ein Korpus mit Exposés aufgebaut wird. Ziel ist es, eine sprachdidaktische Ressource zu schaffen, die als Anschauungsmaterial und digitales Werkzeug zur Unterstützung der Textproduktion sowie als Forschungsgrundlage genutzt werden kann. Der Beitrag verfolgt die Genese des Projekts, vom Bedarf einer Ressource für das Verfassen von Exposés über die Datenakquise bis hin zur Aufbereitung und Annotation der Daten. Außerdem wird exemplarisch aufgezeigt, wie ExpoKo bereits in der Lehre eingesetzt wird. Zudem wird ein Ausblick auf die geplante Veröffentlichung der Daten gegeben.

The project report introduces the ExpoKo project, which focuses on the development of an exposé corpus. The objective of the project is twofold: first, to create a didactic resource that can serve both as illustrative material and as a digital tool to facilitate text production; and second, to establish the corpus as a foundation for future research. The report outlines the project’s development, tracing the process from the initial need for a resource to support exposé writing, through data collection and processing, to the annotation phase. It also presents examples of how ExpoKo is already being used in university teaching. Finally, the report outlines plans for the publication of the data.

Keywords: Exposés, Wissenschaftsschreibdidaktik, Hochschullehre, Lernerkorpora, exposés, academic writing didactics, university teaching, learner corpora

How to Cite:

Lösel, A., Messner, A., Schwendemann, M. & Wallner, F., (2026) “ExpoKo – Eine Ressource für das wissenschaftliche Schreiben. Ein Projektbericht”, Korpora Deutsch als Fremdsprache 6(1), 188–204. doi: https://doi.org/10.48694/kordaf.6177

78 Views

18 Downloads

Published on
2026-08-10

1. Einleitung1

Die Beobachtung, dass das Verfassen wissenschaftlicher Texte vielfach eine große Herausforderung für Studierende darstellt – insbesondere für Studierende mit Deutsch als Fremd- und Zweitsprache –, ist nicht neu (vgl. z.B. Stezano Cotelo 2008; Knorr 2017; Bärenfänger et al. 2024). Studien, die sich der empirischen Erforschung studentischer Textproduktion und den damit verbundenen Schwierigkeiten widmen, legen allerdings zumeist den Fokus auf die Textsorten Haus- und/oder Abschlussarbeit (vgl. z.B. Hufeisen 2002; Kaiser 2002; Pohl 2007; Steinhoff 2007; Prestin 2011; Hornung 2014; Mächler 2020; Nardi / Farroni 2022). Eine bislang eher wenig beachtete, aber in hohem Maße relevante Textsorte im Studienkontext stellen Exposés dar.

Bei einem Exposé handelt es sich um die schriftliche Darstellung eines geplanten Forschungsvorhabens. Indem Exposés grundlegende Aspekte des geplanten Forschungsvorhabens explizieren (so etwa zentrale Fragestellungen, Hypothesen und das methodische Vorgehen), stellen sie einen wesentlichen Zwischenschritt im Forschungsprozess dar. Sie helfen den Verfasser:innen, frühzeitig Klarheit über die innere Struktur des Forschungsprojekts zu gewinnen. Das Exposé dient jedoch nicht nur als Planungs- und Orientierungsdokument für die Verfasser:innen selbst: Insbesondere im Kontext von Qualifikationsarbeiten wie Bachelor- oder Masterarbeiten werden Exposés häufig auch von potenziellen Betreuer:innen bereits in der Anbahnungsphase einer Betreuung eingefordert. Dabei dient das Exposé als Beratungs- und Entscheidungsgrundlage. So beurteilen potenzielle Betreuer:innen auf Basis des Exposés üblicherweise die Realisierbarkeit und die wissenschaftliche Qualität des Vorhabens. Daran anknüpfend entscheiden sie schließlich auch über die Annahme oder Ablehnung der Betreuung. In diesem Sinne stellen Exposés eine High-Stakes-Textsorte dar, denen eine zentrale Schlüssel- bzw. Scharnierfunktion im studentischen Qualifikationsprozess zukommt.

Das textsortenadäquate Verfassen von Exposés ist auch für den weiteren wissenschaftlichen Qualifikationsprozess von Bedeutung: Bei der Bewerbung um eine Promotionsförderung durch ein Stipendium oder einen Drittmittelgeber stellt ein Exposé ein zentrales Bewerbungsdokument dar. So verlangen aktuell (Stand Mai 2026) alle 13 Begabtenförderungswerke als Teil der Bewerbungsunterlagen um ein Promotionsstipendium ein Exposé. Auch in außeruniversitären Forschungsinstitutionen und Drittmittelprojekten ist es üblich, in der Planungsphase eines Forschungsprojekts ein Exposé oder ein vergleichbares Konzeptpapier zu erstellen. Das Exposé fungiert dabei als zentrale Förder- und Entscheidungsgrundlage für Drittmittelgeber:innen bzw. Gutachter:innen.

Dieser zentralen Bedeutung von Exposés für den Studienerfolg und ggf. auch für weitere wissenschaftliche Qualifikationen steht die Feststellung gegenüber, dass es sich bei Exposés um eine vergleichsweise singuläre Textsorte handelt: Anders als etwa Hausarbeiten werden Exposés im Student Life Cycle (vgl. Bärenfänger et al. 2024: 12–13) nicht unbedingt zu mehreren Gelegenheiten eingeübt bzw. als Prüfungsleistung verlangt. Erstmals mit der Anforderung konfrontiert, ihr Forschungsvorhaben in Form eines Exposés zu verschriftlichen, kann dies daher von Studierenden bzw. Graduierten häufig als besonders herausfordernd empfunden werden.

Unterstützung bieten Ratgeberliteratur, Hinweisdokumente und Handreichungen zur Erstellung von Exposés (vgl. z.B. Heidler et al. 2021: 25–45; Franck 2022: 67–72; Voss 2022: 60–62)2. Insbesondere das online verfügbare Angebot ist jedoch kaum überschaubar und sehr heterogen. Dazu trägt neben den disziplinspezifischen Anforderungen an Exposés bei, dass bislang keine empirischen Forschungsarbeiten vorliegen, die Exposés (textsorten-)linguistisch näher beschreiben. Zudem fehlt es an Anschauungsmaterial, anhand dessen die Produktion eines Exposés nachvollzogen werden kann.

Gleichzeitig erlebt das (wissenschaftliche) Schreiben als Kulturtechnik derzeit eine tiefgreifende und in hohem Maße dynamische Transformation (vgl. Gredel et al. 2024: 378). Der weitgehend niedrigschwellige Zugang zu und die inzwischen weit verbreitete Nutzung von leistungsstarken Textgeneratoren bzw. LLMs verändern u.a. wissenschaftliche Strukturierungs- und Schreibprozesse grundlegend. Dies betrifft das studentische Schreiben ebenso wie das Schreiben von ausgebildeten Wissenschaftler:innen. (Studentische) Exposés scheinen als Textsorte in besonderem Maße durch textgenerierende Programme in ihrer ‚Authentizität‘ bedroht, da sie sich aufgrund ihrer Kürze einerseits und ihrer gleichzeitigen besonderen Verdichtung andererseits besonders für eine schnelle Generierung durch ein LLM anzubieten scheinen und so potenziell keine „Auskunft über die Kompetenz der Autorin oder des Autors“ (Bubenhofer im Druck: 2) mehr geben. Zu beachten ist allerdings, dass viele Funktionen des Schreibens nicht ausschließlich auf das Produkt abzielen, sondern ihren Wert vielmehr aus dem Prozess der Erstellung erhalten (vgl. ebd.). Dies gilt sicherlich in besonderem Maße für Exposés, sollen hier doch eigene Forschungsideen und der mögliche Weg zu ihrer Umsetzung entwickelt werden. Gleichwohl bieten gerade auch im Kontext der Nutzung von KI kürzere Textsorten wie Exposés große didaktische Möglichkeiten. So kann etwa der „Kontrollverlust“ (Gredel et al. 2024: 381), den das Schreiben durch KI im Sinne von Copy-and-Paste-Verfahren notwendigerweise mit sich bringt, sichtbar und nachvollziehbar und durch „intensives Kuratieren und editorische Auswahl“ (ebd.) im Anschluss aufgefangen werden. Gerade der Vergleich mit authentischem Textmaterial und textsortentypischen Strukturen und Mustern kann Studierenden hier bei der eigenen Textproduktion entscheidend dabei helfen, KI-generierte Texte in ihrer Qualität zu bewerten und hinsichtlich der Passung zum eigenen wissenschaftlichen Vorhaben adäquat einzuschätzen. Dies kann aber nur dann gelingen, wenn aufbereitete Unterstützungsressourcen bzw. spezialisierte und aufbereitete Sprachkorpora zur Verfügung stehen.

Vor diesem Hintergrund wird bereits seit Ende 2022 im Rahmen des Projekts ExpoKo ein Korpus mit Exposés aufgebaut. Das Hauptziel besteht dabei darin, ein auf sprachdidaktische Informationsbedürfnisse zugeschnittenes Korpus bereitzustellen, welches als Werkzeug zur Erstellung von Exposés genutzt werden kann. Daneben soll das Korpus aber auch als Forschungsgrundlage dienen und die Möglichkeit bieten, Exposés als Textsorte auf empirischer Grundlage zu beschreiben und die mit dem Verfassen von Exposés verbundenen Herausforderungen zu identifizieren. Hierfür ist geplant, das Korpus langfristig einer breiten Öffentlichkeit für Lehr- und Forschungszwecke zugänglich zu machen.

Der vorliegende Projektbericht gibt einen Einblick in die bisherigen Aktivitäten des Projekts ExpoKo. Dabei werden im ersten Schritt die Ergebnisse einer dem Korpusaufbau vorgeschalteten Analyse von frei verfügbaren Handreichungen zur Textsorte Exposé präsentiert, deren Ziel es war, einen fächerübergreifenden Minimalkonsens bezüglich der Anforderungen an Exposés und zentraler Textmerkmale herauszuarbeiten. Daran anschließend wird der Aufbau des Korpus mit seinen bisherigen Annotationen erläutert. Der Beitrag schließt mit einem Ausblick auf zukünftige Aktivitäten innerhalb des Projektkontextes.

2. Die Textsorte Exposé in Handreichungen

Ein auf didaktische Informationsbedürfnisse zugeschnittenes Korpus sollte neben einem zielgruppenspezifischen Zugriff auf Exposés auch die Möglichkeit bieten, zentrale Textmerkmale (bspw. Strukturelemente und sprachliche Handlungen) direkt anzusteuern. Das setzt wiederum voraus, dass entsprechende Informationen und Merkmale bei der Planung der Datenerhebung sowie bei der Aufbereitung der Korpusdaten bereits berücksichtigt werden. Um einen ersten Überblick zu erhalten, welche Zielgruppen und Textmerkmale hier grundsätzlich in Betracht kommen und welche den üblichen Erwartungshorizont repräsentieren, wurde eine explorative Analyse von online zugänglichen Handreichungen zur Textsorte Exposé durchgeführt.

Die Recherche nach entsprechenden Dokumenten beschränkte sich auf den deutschsprachigen Raum und erfolgte nach drei zentralen Kriterien: Erstens sollten sämtliche Handreichungen frei verfügbar sein und auf Webseiten von Bildungseinrichtungen (Schulen und Universitäten) bereitstehen. Nicht einbezogen wurden hingegen Ratgebertexte, die lediglich in Printform vorliegen oder aber auf kommerziellen oder communitybasierten Plattformen bereitgestellt werden. Zweitens wurde bei der Recherche der Handreichungen eine Berücksichtigung aller Fächergruppen gemäß der Fächersystematik des Statistischen Bundesamtes angestrebt (vgl. Statistisches Bundesamt 2024)3. Publikationen zentraler Einrichtungen, etwa von Graduierten- oder Doktoratszentren, wurden dabei der Kategorie „außerhalb der Studienbereichsgliederung“ zugeordnet. Zuletzt wurde darauf geachtet, dass durch die erfassten Handreichungen verschiedene Stationen der (vor)wissenschaftlichen Qualifikation abgedeckt werden.

Umgesetzt wurde die Suche nach entsprechenden Handreichungen durch eine Online-Recherche über verschiedene Suchmaschinen. Dabei wurden die Suchausdrücke „Exposé“ und „Handreichung“ bzw. „Style Sheet“ mit Bezeichnungen für Bildungseinrichtungen (z.B. „Universität“, „Gymnasium“), universitäre Organisationseinheiten (z.B. „Institut“, „Seminar“) und Fächer bzw. Fächergruppen kombiniert. Ziel war es, mindestens 100 Handreichungen zu ermitteln und der Dokumentenanalyse zugrunde zu legen. Letztlich bildeten 102 Handreichungen die Datengrundlage. Dabei zeigte sich, dass die Textsorte Exposé nicht erst im Hochschulkontext relevant wird, sondern den gesamten wissenschaftlichen Enkulturationsprozess begleitet – von der Schule über das Studium bis hin zur Promotion. So tritt das Exposé vielfach bereits in der gymnasialen Oberstufe auf, hier zumeist im Zusammenhang mit der Facharbeit (Deutschland) bzw. der vorwissenschaftlichen Arbeit (Österreich). Diese schulische Form der wissenschaftlichen Hausarbeit kann ebenfalls eine Planungsskizze erfordern, die in ihrer Funktion und Struktur Parallelen zu universitären Exposés aufweist. Die Dokumentenanalyse umfasst 14 (13,73 %) frei verfügbare Hinweisblätter verschiedener Gymnasien, die sich an Schüler:innen richten. Die Mehrheit der ermittelten Handreichungen (n = 57, 55,88 %) richtet sich allerdings an Studierende. Zudem adressieren 15 (14,71 %) Handreichungen Studierende und (angehende) Doktorand:innen gleichermaßen, weitere 15 wenden sich ausschließlich an (angehende) Doktorand:innen (vgl. Abbildung 1).

Abbildung 1
Abbildung 1

Zielgruppen der erfassten Handreichungen zur Textsorte Exposé

Bezüglich der Fächergruppen wird deutlich, dass mit 43 (42,16 %) insbesondere die Rechts-, Wirtschafts- und Sozialwissenschaften Handreichungen für Exposés zur Verfügung stellen. Aus den Geisteswissenschaften stammen 21 Handreichungen (20,59 %). Für die anderen Fächergruppen finden sich jeweils nur wenige Handreichungen. Weitere acht Handreichungen (7,84 %) können auf Seiten außerhalb der Studienbereichsgliederung ermittelt werden (vgl. Abbildung 2)4.

Abbildung 2
Abbildung 2

Verteilung der Handreichungen zur Textsorte Exposé über Fächergruppen

Ein zentrales Erkenntnisinteresse der Dokumentenanalyse lag in der Identifikation der als konstitutiv präsentierten textuellen Bestandteile eines Exposés. Die größte Übereinstimmung besteht hinsichtlich der Fragestellung (n = 92, 90,20 %) und des methodischen Vorgehens (n = 93, 91,18 %). Beide Bestandteile werden in über 90 % der erfassten Handreichungen genannt (vgl. Abbildung 3). Bezüglich der anderen Bestandteile, etwa der Notwendigkeit eines Kapitels zur Problemstellung und Relevanz der Arbeit (n = 83, 81,37 %) oder auch zum Forschungsstand (n = 76, 74,50 %), liegt kein solch eindeutiger Konsens vor. Dennoch werden auch diese Bestandteile mehrheitlich als zentrale Bestandteile benannt. Eher selten Erwähnung finden hingegen Abstract (n = 7, 6,86 %), eventuelle eigene Vorarbeiten (n = 8, 7,84 %) und erwartete Ergebnisse (n = 3, 2,94 %).

Abbildung 3
Abbildung 3

Geforderte bzw. empfohlene Bestandteile von Exposés in den Handreichungen zur Textsorte Exposé

Bezüglich weiterer Textmerkmale sind die Angaben in den Handreichungen sehr heterogen. Mehrheitlich wird jedoch die Einbindung von Quellen in irgendeiner Form thematisiert. Teilweise erfolgt dies lediglich indirekt durch Angaben zur formalen Gestaltung von Verweisen und Literaturangaben. Mehrfach werden aber auch Hinweise zur Versprachlichung gegeben. Das Spektrum reicht hier von dem Hinweis auf die Notwendigkeit, fremdes Gedankengut entsprechend zu kennzeichnen, bis hin zu konkreten Beispielen, wie Literatur in die eigene Argumentation eingebunden werden kann.

Eher vereinzelt werden Hinweise zur Formulierung weiterer wissenschaftssprachlicher Handlungen gegeben. Teilweise werden diese auch anhand von Beispielen illustriert. Meist handelt es sich dabei um argumentierende Handlungen (Begründung einer Aussage, Formulierung von Gegenargumenten). Mitunter finden sich auch Vorschläge zur Formulierung der Fragestellung, der Zielsetzung der Arbeit, des Forschungsinteresses oder auch zur Relevanz des Themas.

Ebenfalls selten finden sich in den Handreichungen konkrete Beispiele für Exposés. So enthalten lediglich vier der 102 Handreichungen ein Muster-Exposé (3,92 %). Drei weitere Handreichungen (2,94 %) stellen immerhin Beispiele für die Versprachlichung einzelner Bestandteile des Exposés bereit.

Insgesamt unterstützen die Ergebnisse der Analyse der Handreichungen den bisherigen Eindruck, dass es keine einheitlichen Anforderungen an Exposés gibt. Vielmehr sind die Anforderungen an ein Exposé in hohem Maße abhängig von der Qualifikationsstufe sowie standort- und disziplinspezifisch. Zudem hat sich bestätigt, dass es an konkreten Beispielen für Exposés oder für Bestandteile von Exposés mangelt und der Aufbau einer entsprechenden Ressource ein Desiderat darstellt. Da mithilfe der Recherche eine eher zufällige Stichprobe vorhandener Dokumente zusammengestellt wurde, lassen sich bezüglich des Korpusaufbaus jedoch nur bedingt Schlussfolgerungen ableiten. Insbesondere im Hinblick auf Zielgruppen und Fachbereiche ist davon auszugehen, dass die Ergebnisse nur eine Momentaufnahme darstellen, da die Bereitstellung und Zugänglichkeit entsprechender Dokumente von sehr vielen Faktoren abhängen. Etwas aufschlussreicher sind die Ergebnisse aber in Bezug auf zentrale Textmerkmale. Diese lassen sich im Rahmen der Aufbereitung und Vorstrukturierung der Daten durchaus berücksichtigen (vgl. auch Abschnitt 3.3).

3. Der Aufbau von ExpoKo

3.1 Vorbemerkungen

Die folgenden Ausführungen beziehen sich auf die erste Erhebungsphase (11/2022–12/2025) von ExpoKo. In dieser ersten Erhebungsphase wurden hauptsächlich Texte zurückliegender Semester erhoben, die somit vor dem niedrigschwelligen Zugang zu LLMs wie ChatGPT verfasst wurden. Der sukzessive Korpusaufbau war dabei maßgeblich geprägt von Praxisbedarfen und Förderbedingungen. Diese werden im Folgenden kurz umrissen.

Der Aufbau von ExpoKo startete im November 2022 und reagierte dabei zunächst auf einen konkreten Bedarf aus der universitären Lehre: So ist die Anfertigung eines Exposés im Rahmen des an internationale Studierende gerichteten Moduls „Deutsch als fremde Wissenschaftssprache“ am Herder-Institut der Universität Leipzig Bestandteil der Prüfungsleistung (vgl. Fandrych et al. 2014). Entsprechend wird diese Textsorte im Rahmen der Lehrveranstaltungen des Moduls gezielt eingeübt. Als besonders sinnvoll erwies sich dabei die Arbeit mit authentischen Beispielexposés, die jedoch bislang nur sehr begrenzt zur Verfügung standen. Die Ausschreibung von Hilfskraftmitteln des Sächsischen Staatsministeriums für Wissenschaft, Kultur und Tourismus (SMWK) für die Entwicklung digital gestützter Lehr- und Lernszenarien eröffnete schließlich die Möglichkeit, auf diesen Bedarf zu reagieren und den Aufbau eines systematisch aufbereiteten Exposé-Korpus anzugehen. Eine Voraussetzung für die Förderung war, dass sich die zu entwickelnden Lehr- und Lernszenarien auf ein konkretes Lehrangebot der Universität Leipzig beziehen. Entsprechend wurde bei der Datenerhebung zunächst ein etwas engerer Fokus gesetzt und die Exposés lediglich innerhalb des Fachbereichs Deutsch als Fremd- und Zweitsprache erhoben.

3.2 Datenakquise

Aufgrund der spezifischen Bedingungen für die Förderung lag ein erster Schwerpunkt der Datenerhebung zunächst auf dem Modul „Deutsch als fremde Wissenschaftssprache“ des Herder-Instituts der Universität Leipzig. So wurden alle Absolvent:innen des Moduls seit dem Wintersemester 2017/2018 angefragt, ob sie ihr Exposé dem Projekt zur Verfügung stellen möchten. In der derzeit geplanten zweiten Erhebungsphase werden Exposés sowohl von Studierenden innerhalb als auch außerhalb des Moduls und von anderen Universitäten erhoben5.

Die Erhebung selbst erfolgt über das Umfrage-Tool LimeSurvey. Dabei werden neben den Exposés eine Reihe von Metadaten abgefragt. Diese umfassen insbesondere Informationen zum studien- und sprachbiografischen Hintergrund der Studierenden sowie eventuelle Schreib-Vorerfahrungen (z.B. Anzahl bereits verfasster wissenschaftlicher Arbeiten). Darüber hinaus werden Urheberrechts- und Einverständniserklärungen zur Datenverwendung eingeholt, welche die Veröffentlichung des Exposés, einschließlich der Metadaten, in anonymisierter Form, bspw. über ein öffentlich zugängliches Repositorium, zulassen. Auf diese Weise kann das Korpus perspektivisch einer breiten Öffentlichkeit zugänglich gemacht werden.

3.3 Aufbereitung und automatische Annotation der Daten

Im Rahmen der Aufbereitung der Daten werden diese zunächst anonymisiert und in das texttechnologisch verarbeitbare txt-Format konvertiert. Zudem werden mit Blick auf die weitere Annotation und Bereitstellung der Daten Bereinigungsschritte vorgenommen. Dazu zählt etwa die Tilgung der nicht ausformulierten wissensverarbeitenden Bestandteile (bspw. Inhalts- und Literaturverzeichnisse, Tabellen, Abbildungen), die Umwandlung von Fußnoten in Endnoten, die Entfernung von Leerzeichen innerhalb von Abkürzungen sowie die Ersetzung von spitzen Klammern.

Die txt-Dateien werden daran anschließend in EXMARaLDA (Dulko)6 (vgl. Nolda 2024) eingepflegt. Hierbei handelt es sich um ein Set von Werkzeugen, das auf den EXMARaLDA Partitur Editor aufbaut. EXMARaLDA (Dulko) ermöglicht es, unterschiedliche automatische Aufbereitungen durchzuführen (Tokenisierung, automatisierte Satzspannenannotation, POS-Tagging mit Hilfe des STTS (vgl. Schiller et al. 1999) und Lemmatisierung).

Die Satzspannenannotation wird für alle Exposés in ExpoKo manuell nachkorrigiert. Dies erwies sich als erforderlich, da bspw. Zitate und Verweise mit Doppelpunkt und Formen gendersensibler Sprache mit Genderdoppelpunkt vielfach zu fehlerhaften Satzspannen führten. Abbildung 4 demonstriert dies am Beispiel der automatisierten Satzspannenannotation bei gendersensibler Schreibweise mit Genderdoppelpunkt. Abbildung 5 zeigt die vorgenommene manuelle Bereinigung.

Abbildung 4
Abbildung 4

Screenshot aus EXMARaLDA Partitur Editor 1.8, Exp_1–007 (automatische Aufbereitung)

Abbildung 5
Abbildung 5

Screenshot aus EXMARaLDA Partitur-Editor 1.8, Exp_1–007 (manuelle Bereinigung)

Zur Überprüfung der Qualität des POS-Tagging und der Lemmatisierung wurden zudem für ein Subkorpus – bestehend aus neun randomisiert ausgewählten Exposés – die POS-Tags sowie die Lemmata manuell nachkorrigiert. Der Vergleich ergab eine Korrektheitsrate von 94,8 % (Lemmatisierung) bzw. 94,2 % (POS-Tagging). Diese wurde für die weitere Verarbeitung der Dateien als ausreichend erachtet. Eine Korrektur der automatischen Annotation für die übrigen Korpusdaten wurde daher nicht vorgenommen.

3.4 Manuelle Annotation

Wie bereits angedeutet, soll ExpoKo als Ressource für das wissenschaftliche Schreiben die Möglichkeit bieten, zentrale Textmerkmale direkt anzusteuern. Damit ist gemeint, dass Nutzer:innen sich beispielsweise mit einer Suchanfrage alle im Korpus vorkommenden Forschungsfragen oder auch alle Belegstellen für einzelne wissenschaftssprachliche Handlungen wie etwa Zitate oder Verweise anzeigen lassen können. In Vorbereitung auf die technische Realisierung müssen diese Merkmale in den Daten manuell annotiert werden. Dieser Prozess ist sehr zeitaufwändig und erfordert umfangreiche personelle Ressourcen. Aus kapazitären Gründen war daher bislang nur die manuelle Annotation ausgewählter Textmerkmale möglich. Die Auswahl erfolgte dabei im Wesentlichen auf der Grundlage der in Abschnitt 2 erläuterten Analyse der Handreichungen. Sie beruht zum einen auf den als konstitutiv eingestuften Bestandteilen von Exposés (Strukturannotation). Zum anderen bezieht sie sich auf Verweise und Zitate, die zu den zentralen wissenschaftssprachlichen Handlungen zählen (vgl. Jakobs 1999; Sadowski 2017) und auch bei der Analyse der Handreichungen als besonders relevant hervortraten. Im Folgenden werden die manuellen Annotationen genauer erläutert und der Annotationsworkflow vorgestellt.

3.4.1 Strukturannotation

Die Strukturannotation bezieht sich auf die strukturellen Makro-Elemente jedes Exposés. Dies umfasst einerseits Überschriften und Absätze, die sich anhand formaler Merkmale identifizieren lassen. Andererseits werden ganze Abschnitte, die in einem thematischen Zusammenhang stehen, als inhaltliche Blöcke (Struktur_Inhaltliche Blöcke) annotiert. Diese korrespondieren mit den als konstitutiv eingestuften und in der Dokumentenanalyse identifizieren Bestandteilen (vgl. Abschnitt 2) von Exposés (so zum Beispiel „Relevanz des Themas“, „Forschungsstand“, „Methodisches Vorgehen“). Tabelle 1 gibt einen Überblick über die dabei vergebenen Annotationstags.

Tabelle 1

Überblick über das Tagset für die Strukturannotation

Annotationsspur Struktur_Überschrift Struktur_Absatz Struktur_Inhaltliche Blöcke
Vergebene Tags Überschrift_Funktionsbezeichung7
Überschrift_Exposé
Überschrift_Untertitel
Überschrift_Abschnitt
Überschrift_Teilabschnitt
Abs. (jeweils für das erste Token eines neuen Absatzes) Inhalt_Relevanz
Inhalt_Forschungsstand
Inhalt_Fragestellung
Inhalt_Methode
Inhalt_Zeitplan
Inhalt_Fußnote
Inhalt_Sonstiges

Für die Einarbeitung der vorgenommenen Annotationen in EXMARaLDA (Dulko) wird dort jeweils eine eigene Annotationsspur angelegt (vgl. Abbildung 6). Der iterative Annotationsprozess wird durch regelmäßige Datensitzungen begleitet, um Zweifelsfälle zu besprechen und ein einheitliches Vorgehen der Annotator:innen zu gewährleisten.

Abbildung 6
Abbildung 6

Screenshot aus EXMARaLDA Partitur-Editor 1.6.1, Exp_2–050

Eine besondere Herausforderung der Strukturannotation besteht darin, dass nicht in allen Exposés die entsprechenden Abschnitte durch passende Überschriften gekennzeichnet sind. Entsprechend erfordert die Vergabe der Annotationstags auch eine genaue inhaltliche Überprüfung. Außerdem gibt es Exposés, bei welchen sich inhaltliche Blöcke überschneiden; bspw., wenn in einem Absatz Forschungsstand und Fragestellung beschrieben werden. Solche Vorkommnisse sind aktuell nicht annotiert, da EXMARaLDA (Dulko) keine Doppelannotation innerhalb einer Spur erlaubt und noch evaluiert wird, ob solche Überschneidungen häufiger oder lediglich in Ausnahmefällen vorkommen.

3.4.2 Annotation von Zitaten und Verweisen

Die Annotation von Zitaten und Verweisen erfordert ebenfalls eine inhaltliche Analyse der Daten. Dabei gilt es zunächst, entsprechende Textstellen im Korpus aufzufinden. Zudem müssen die verschiedenen Typen und Ausprägungen von Zitaten und Verweisen identifiziert werden. Zu diesem Zweck wird auf kollaborative Annotationsverfahren zurückgegriffen (vgl. auch Bender / Müller 2020: 15–16). Dabei erfolgt die Annotation zunächst individuell anhand der anonymisierten Exposés, bevor die Ergebnisse in der Projektgruppe diskutiert und validiert werden. Dieses Vorgehen dient neben der Qualitätssicherung einer datengeleiteten multiperspektivischen Entwicklung der Annotationstags. Gleichzeitig bietet dieser kollaborative Prozess die Möglichkeit, das Tagset immer wieder zu überprüfen, es basierend auf den tatsächlichen Vorkommen von Zitaten und Verweisen im Korpus zu verfeinern und gegebenenfalls anzupassen. Herausgestellt sei hier jedoch, dass mit dem geschilderten Vorgehen eine Verlängerung des Annotationsprozesses einhergeht, da jede Anpassung eine erneute Überprüfung und Korrektur der bereits erfolgten Annotationen erforderlich macht (vgl. ebd.).

Im Rahmen des kollaborativen Annotationsverfahrens wurde zunächst von den beiden in der wissenschaftlichen Praxis üblichen Hauptkategorien Zitat und Verweis ausgegangen. Diese wurden in den Originaldaten auf Satzebene ermittelt. Dabei zeigten sich in den Daten einige Fälle, die eine Erweiterung des Kategoriensets erforderlich machten. Zum einen handelte es sich dabei um Sätze, in denen sowohl Verweise als auch Zitate vorkamen. Diese wurden als ‚Mixed Quotation‘ annotiert (vgl. (1)):

    1. (1)
    1. Diese [Lese-Rechtschreibschwäche] kann nicht allein durch die kognitive oder biologische Entwicklung oder äußere Einflüsse beeinflusst sein (vgl. Deutsches Institut für Medizinische Dokumentation und Information 2018: WWW-Veröffentlichung) und wird allgemein auch als „genetisch bedingte Störung angenommen“ (Gerlach 2019: 11). (Exp_1–007)

Zum anderen fanden sich Sätze, die sich an vorherige Verweise oder Zitate anschließen bzw. diese fortsetzen. Alleinstehend können sie jedoch keiner Quelle zugeordnet werden, da die Angabe entweder mit ebd. erfolgt (vgl. (2)) oder die Bezugnahme durch eine substantivische Referenz (der Autor, die Autor:innen) oder auch pronominal umgesetzt wurde (vgl. (3)–(5)). Diese Fälle wurden als ‚Verweiskette‘ annotiert, damit sie für die spätere Korpusnutzung auch zusammenhängend abgerufen werden können (Hervorhebungen in den Belegen durch die Verfasser:innen).

    1. (2)
    1. Außerdem fügt Brand (2022: 224) noch die inhaltliche und die soziale Ebene hinzu. Zwar unterscheiden sich die Ebenen der Differenzierung, aber oft kommt es zu Überschneidungen zwischen den verschiedenen Ebenen (vgl. ebd.). (Exp_2–062)
    1. (3)
    1. MacSwan hingegen kam auf die Idee, die Sprachdominanz zu beobachten und den Sprachewechsel bei balancierten und unbalancierten bilingual aufwachsenden Kindern zu vergleichen (vgl. Arencibia, Müller 2009: 105). Seine Arbeit zeigte, dass CS keine eigenen Regeln befolgt, sich aber an den Regeln der beteiligten Sprachen hält. (Exp_3–001)
    1. (4)
    1. Desweiteren ist es zu erwähnen, dass die Definition von Bedarf bzw. Bedu?rfnissen nach Berwick (1989, S. 59) eine große Rolle bei jeder Bedarfsanalyse spielt, denn sie bildet deren Grundlage. Allerdings weist der Autor darauf hin, dass es bei jeder Analyse eine neue Definition von Bedarf bzw. Bedu?rfnissen abhängig von dem Ansatz des Bildungssystems oder von demjenigen, der analysiert, entwickelt wird. (Exp_2–034)
    1. (5)
    1. Knöbls (2012) Untersuchung hingegen enthält auch stärker regionalsprachlich geprägte Varietäten. Er wertete Audioaufnahmen aus dem Jahr 2003 aus, die den Unterricht und das Pausengeschehen einer 9. Klasse an einem Ulmer Gymnasium (schwäbisches Sprachgebiet) dokumentieren. Außerdem erhob er auch Sprachdaten von drei Lehrkräften und wertete alle Aufnahmen in Hinblick auf 15 Variablen aus. (Exp_1–008)

Innerhalb dieser nunmehr vier Hauptkategorien (Zitat, Verweis, Mixed Quotation, Verweiskette) wurden wiederum Tags vergeben, die auch die syntaktische Einbettung der Zitate bzw. Verweise berücksichtigten. So etwa wurde bei Zitaten differenziert zwischen Zitaten, die von den Verfasser:innen in ihren eigenen Text syntaktisch integriert (und ggf. angepasst) wurden (vgl. (6)). Dem gegenüber stehen Zitate, die von den Verfasser:innen als eigenständige Sätze im Fließtext übernommen wurden (vgl. (7)).

    1. (6)
    1. Trotz der verfügbaren Literatur zum Einsatz von Filmen im Fremdsprachunterricht, werden „Spielfilme im schulischen Fremdsprachenunterricht relativ selten eingesetzt und noch seltener evaluiert“ (Kováčová und Jurková, 2019 S. 157.) (Exp_2–003)
    1. (7)
    1. Auf dieser Grundlage beschreibt Schewe den Dramapädagogik-orientierten DaF-Unterricht wie folgt: „Im dramapädagogischen Fremdsprachenunterricht wird mit Kopf, Herz, Hand und Fuß gelernt und gelehrt“ (Schewe 1993: 8). (Exp_2–002)

Auf ähnliche Weise wurde auch bei Verweisen unterschieden: Hier wurde zwischen syntaktisch integrierten Verweisen differenziert, in denen der Name der Autor:innen im Fließtext genannt wird (vgl. (8)), und solchen, bei denen der Verweis dem Fließtext nachgestellt ist (vgl. (9)):

    1. (8)
    1. Bei dem Beitrag von Thurmair (2010) handelt es sich um alternative Überlegungen zur Didaktik von Modalpartikeln. (Exp_2–014)
    1. (9)
    1. Das Thema [Perfekt] wird somit in den meisten Lehrwerken bereits auf A1-Niveau eingeführt und thematisiert (vgl. Thielmann 2014). (Exp_2–036)

Tabelle 2 gibt einen Überblick über die Annotationsspuren und die darin verwendeten Tags.

Tabelle 2

Überblick über das Tagset für die Zitat- und Verweisannotation

Annotationsspur Zitat Verweis Mixed Quotation Verweiskette
Vergebene Tags Zitat_integriert
Zitat_nicht integriert
Verweis_integriert
Verweis_nicht integriert
MQ Zitat_integriert_Kette
Zitat_nicht integriert_Kette
Verweis_integriert_Kette
Verweis_nicht integriert_Kette
MQ_Kette

Die Zuordnung zu den einzelnen Annotationskategorien mag auf den ersten Blick trivial erscheinen. Zu beachten ist jedoch, dass es sich bei ExpoKo um ein Korpus von Studierenden handelt, die mehrheitlich als Noviz:innen im Wissenschaftsbetrieb betrachtet werden können. Ein Teil der Verfasser:innen zeigt dementsprechend noch Unsicherheiten im Umgang mit der textuellen Einbindung von Zitaten und Verweisen und den damit verbundenen Konventionen. Dies erschwert die Zuordnung zu den Annotationstags teilweise erheblich.

Für jede der vier Annotationskategorien wurde daher gemäß des korpusgesteuerten Workflows eine Reihe von Markern entwickelt, die der Identifikation und Zuordnung dienten und sich auch dann anwenden ließen, wenn Verweis oder Zitat nicht mustergültig realisiert wurden. Demnach wurden Aussagen als Zitat bestimmt, wenn sie durch (doppelte) Anführungszeichen gekennzeichnet sind und eine Angabe zu Autor:innen (inkl. Jahr und Seite) in runden Klammern (vgl. (6), (7)) aufweisen. Als Verweise wurden wiederum Aussagen ohne Anführungszeichen eingestuft, die aber eine Angabe zu den Autor:innen enthalten (vgl. (8), (9)). Ausgehend davon erweiterten Zweifelsfälle diese Arbeitsdefinition, welche hier durch ausgewählte Beispiele veranschaulicht werden: Die Aussage in (10) wird aufgrund der Auslassungszeichen als Zitat gewertet, obwohl die Anführungszeichen fehlen. Auch Anführungszeichen stellten sich als ambig heraus, wenn sie genutzt wurden, um beispielsweise Titel (vgl. (11)) oder Begriffe (vgl. (12)) zu markieren – wobei die Grenze zum Zitat verschwimmen kann. Diese Fälle wurden in Datensitzungen besprochen (siehe Abschnitt 3.3.1). Dabei wurde festgelegt, dass Titel als Verweise und Begriffe als Zitate getaggt werden (jeweils, wenn auf die Autor:innen verwiesen wird) und Hervorhebungen nicht getaggt werden.

    1. (10)
    1. Die Kenntnis von Textsorten […] stellt also ein wesentliches Element für kommunikativ erfolgreiches sprachliches Handeln dar und ist ein Baustein im Erwerb einer umfassenden Sprachkompetenz (Fandrych/Thurmair 2011: 16). (Exp_2–005)
    1. (11)
    1. So fehlte die Kategorie Geschlecht in den großen deutschsprachigen Handbüchern zu Fremd- und Zweitsprachenerwerb, -unterricht und -forschung, bis 2016 erstmals das Kapitel „Geschlecht“ in das „Handbuch Fremdsprachenunterricht“ (Burwitz et al. 2016) aufgenommen wird und von der Relevanz des Themenkomplexes Geschlecht in der Fremdsprachenvermittlung zeugt. (Exp_1–002)
    1. (12)
    1. Nach Gündoĝdu (2007) ist die„Aktualität und Gebräuchlichkeit“ bei dem Umgang mit Phraseologismen im Unterricht enorm wichtig. (Exp_2–058)

Ein häufiges Phänomen ist außerdem die Nennung von Autor:innen ohne weitere Hinweise auf Publikationsjahr oder Seite (vgl. (13)). Dieses Phänomen findet sich in zwei Varianten: Meistens wurden die Autor:innen mit einer vollständigen Quellenangabe früher im Text eingeführt, seltener fehlt die Angabe vollständig. Solche Vorkommen werden als Verweis bzw. Zitat getaggt, jedoch nicht als Kette, auch wenn die Autor:innen bereits eingeführt wurden.

    1. (13)
    1. In dem Text Casdorffs wird durch die Nennung einer Schuld, die „gerade wir Deutsche“ hätten, im Kontext der Beschreibung der Kriegsverbrechen Russlands in der Ukraine ein mehr oder weniger impliziter Vergleich der beiden Verbrechen gezogen. (Exp_1–003)

3.4.3 Arbeitsstand

In der unter 3.2 beschriebenen ersten Erhebungsphase von ExpoKo wurden 96 Exposés erhoben, die in Bachelor- und Masterstudiengängen Deutsch als Fremdsprache und Germanistik verfasst wurden. Davon haben bislang 76 Exposés (134.382 Token, Stand Mai 2026) die unter 3.3 und 3.4 beschriebenen Aufbereitungs- und Annotationsschritte vollständig durchlaufen. Bei den meisten dieser Exposés (n = 56, 68,29 %) handelt es sich um Exposés zur Masterarbeit. In geringerem Umfang konzipieren die erhobenen Exposés Forschungsprojekte, die im Rahmen von Seminararbeiten durchgeführt wurden (n = 19, 23,17 %). Weitere Exposés wurden für Bachelorarbeiten (n = 2, 2,44 %), als Prüfungsleistung eines Moduls (n = 3, 3,66 %) oder in Vorbereitung einer Studienreise (n = 1, 1,22 %) angefertigt. Ein Großteil der Exposés (n = 66, 86,84 %) stammt von Studierenden mit Deutsch als L2. Weitere acht Exposés wurden von Studierenden mit Deutsch als L1 verfasst. Zwei Verfasser:innen gaben an, zwei oder mehr Erstsprachen (darunter Deutsch) zu besitzen.

Im Rahmen der Aufbereitung beanspruchte besonders die Annotation der Zitate und Verweise viel Zeit. Insgesamt wurden im Rahmen dieses Aufbereitungsschrittes 218 Zitate und 1502 Verweise identifiziert. Erste Analysen zu diesen Annotationen werden demnächst veröffentlicht (vgl. Lösel et. al. eingereicht 2027).

4. Datennutzung und Ausblick

Mit Blick auf die Nutzung der Daten aus ExpoKo in Forschung und Lehre sowie vor Hintergrund der steigenden Bedeutung von Open Science und nachhaltigem Forschungsdatenmanagement im Kontext von Deutsch als Fremd- und Zweitsprache (vgl. Schwendemann et al. 2024) wurden für die Daten Einverständnis- und Urheberrechtserklärungen erhoben, die sowohl ihre Nutzung in Forschungs- und Lehrkontexten als auch ihre Veröffentlichung unter freien Lizenzen (z.B. CC-Lizenzen) zulassen. Auf diese Weise kann eine möglichst umfassende Nachnutzung der Daten durch die Fachcommunity ermöglicht werden.

Aktuell werden die Daten aus ExpoKo bereits für Analysen in sprachwissenschaftlichen Seminaren und im Rahmen von Haus- und Abschlussarbeiten sowie in Forschungsbeiträgen (z.B. Nguyen 2025) genutzt. Überdies dienen sie in wissenschaftspropädeutischen Lehrveranstaltungen als Anschauungsmaterial. Durch die Vielfalt an Themen ist es dabei möglich, unterschiedliche themen- und fachbereichsspezifische Facetten von Exposés sichtbar zu machen. Da ein Großteil der Exposés von Noviz:innen im Wissenschaftsbetrieb und dabei mehrheitlich auch von Studierenden mit Deutsch als L2 stammt, ist es zudem möglich, etwaige Schwierigkeiten und Herausforderungen gemeinsam mit den Studierenden zu analysieren. Das kann sich beispielsweise auf formale Inkonsistenzen beziehen. Das folgende Beispiel (vgl. (14)) zeigt dies anhand eines Belegs, in dem die angegebene Quelle nicht mit den Personen übereinstimmt, auf die verwiesen wird:

    1. (14)
    1. Corbin und Strauss sehen die Abhängigkeit der Datenerhebung vom Forschungsprozess und den darin handelnden Personen als wesentliches Element sozialwissenschaftlicher Forschung, das reflektiert und genutzt werden soll (BREUER 2010: 39f). (Exp_3–002)

Zudem lassen sich anhand einzelner Beispiele aus den Exposés sprachliche Auffälligkeiten thematisieren. Als besonders gewinnbringend hat sich dabei erwiesen, ausgewählte Sequenzen gemeinsam oder in Gruppen zu überarbeiten bzw. überarbeiten zu lassen. Durch den Einsatz von KI-Tools ist auch die Generierung von Überarbeitungen möglich. Dies gestattet dann eine Reflexion zu den vorgenommenen Veränderungen im Text und deren Angemessenheit. Die folgenden Beispiele illustrieren dies anhand von Formulierungsvorschlägen aus DeepL Write8:

    1. (15)
    1. Die bereits in der Einleitung erwähnten Autoren Gradel und Hell stellen zwar die Tatsache fest, dass es Schwierigkeiten bei dem Erwerb der Adjektivdeklination bei den Lernenden gibt, gehen aber nicht genauer auf die konkreten Schwierigkeiten ein. (Exp_2–012)
    1.  
    1. (15a)
    1. Die bereits in der Einleitung erwähnten Autoren Gradel und Hell stellen zwar fest, dass es Schwierigkeiten beim Erwerb der Adjektivdeklination gibt, gehen aber nicht genauer auf die konkreten Schwierigkeiten ein. (Formulierungsvorschlag von DeepL Write)
    1. (16)
    1. Wissenschaftler/innen wie Di Meola, Engemann und Vater plädieren dafür, dass man heutzutage eine Gegentendenz beobachten kann […]. (Exp_2–004)
    1.  
    1. (16a)
    1. In der aktuellen wissenschaftlichen Diskussion vertreten Di Meola, Engemann und Vater die Auffassung, dass gegenwärtig eine Gegentendenz zu beobachten ist. (Formulierungsvorschlag von DeepL Write)

Beim Einsatz von KI-Tools ist allerdings Vorsicht geboten, da sie auch unangemessene Ergebnisse generieren können. Zudem werden zuweilen auch angemessene Formulierungen verändert, was zu Verunsicherung der Studierenden führen kann. Demnach sollten Studierende bei der Nutzung von KI-Tools auch für deren Grenzen sensibilisiert werden.

Derzeit ist ein Zugriff auf die ExpoKo-Daten und die bisherigen Annotationen nur projektintern möglich und erfordert eine fortgeschrittene korpuslinguistische Expertise. Für eine noch bessere Nutzbarkeit von ExpoKo ist jedoch die Überführung der Daten in eine Korpusinfrastruktur überaus wünschenswert. Zu diesem Zweck wird aktuell an der TU Dortmund eine technische Lehr- und Forschungs-Umgebung zum Management von Korpora aufgebaut. Die Grundlage hierfür bildet die Architektur der ZuMult-Korpus-Plattform (vgl. Fandrych et al. 2023). Mit der Einrichtung einer eigenen Instanz dieser Plattform an der TU Dortmund erfolgt zugleich eine Anpassung der Architektur an die Spezifika der ExpoKo-Daten und ihrer Nutzungsbedarfe in Forschung und Lehre. Studierenden und Forschenden soll damit ein umfassender Zugriff auf die ExpoKo-Daten und die bisherigen Annotationen ermöglicht werden. Nach einer ersten Erprobungsphase an der TU Dortmund (voraussichtlich ab Herbst 2026) wird geprüft, ob die Plattform auch standortübergreifend zugänglich gemacht werden kann.

Neben der Vorbereitung der Bereitstellung der ExpoKo-Daten wird derzeit eine weitere Erhebungsphase konzipiert. Hierzu ist zunächst eine Bedarfsanalyse geplant, auf deren Grundlage die Auswahl der zu berücksichtigenden Fächergruppen und Kontexte erfolgen soll. Ferner ist in diesem Zusammenhang auch eine Überarbeitung des Metadatensets vorgesehen, um bislang unberücksichtigte Aspekte (wie bspw. Nutzung von KI-Tools) mit einzubeziehen.

Notes

  1. Wir danken ganz herzlich den anonymen Gutachter:innen unseres Projektberichts für die wertvollen Anmerkungen und Hinweise zur Überarbeitung. [^]
  2. Die Ratgeberliteratur erscheint insgesamt jedoch eher allgemein gehalten und fokussiert sich auf Haus- und Abschlussarbeiten. Exposés sind dabei meist Randerscheinungen, die nur selten und/oder kurz thematisiert werden. [^]
  3. Diese Systematik listet acht Fächergruppen auf: 1) Geisteswissenschaften, 2) Sport, 3) Rechts-, Wirtschafts- und Sozialwissenschaften, 4) Mathematik, Naturwissenschaften, 5) Humanmedizin/Gesundheitswissenschaften, 6) Agrar-, Forst- und Ernährungswissenschaften, Veterinärmedizin, 7) Ingenieurwesen, 8) Kunst, Kunstwissenschaft. [^]
  4. Die Auswertung ist hinsichtlich der Verteilung innerhalb der einzelnen Fächergruppen sicherlich weder repräsentativ noch exhaustiv, sondern hat vielmehr explorativen Charakter und dient dazu, erste Tendenzen zur Textsorte Exposé aufzuzeigen. [^]
  5. Diese neu zu erhebenden Daten werden dann zudem systematische Vergleiche der Exposés mit und ohne KI-Unterstützung ermöglichen. Um dies adäquat abbilden zu können, werden derzeit auch die zu erhebenden Metadaten grundlegend überarbeitet bzw. erweitert. [^]
  6. Zunächst wurde mit der Version 1.6.1 gearbeitet, danach mit der Version 1.8. In der aktuellen EXMARaLDA-Version sind die DULKO-Tools automatisch integrierter Bestandteil der Software. [^]
  7. Gemeint ist hier die Funktion des Exposés (bspw. „Exposé für die Bachelorarbeit / Masterarbeit“ usw.). [^]
  8. https://www.deepl.com/de/write (28.05.2026). [^]

Literatur und Ressourcen

Bärenfänger, Olaf / Feike, Julia / Magosch, Christine (2024): Sprachliche Kompetenzen im Studium. Lernziele für die studienbezogene Deutschförderung. Stuttgart: Klett.

Bender, Michael / Müller, Marcus (2020): Heuristische Textpraktiken in den Wissenschaften. Eine kollaborative Annotationsstudie zum akademischen Diskurs. In: Zeitschrift für germanistische Linguistik 48: 1, 1-46.

Bubenhofer, Noah (2026, im Druck): Wissenschaftliches Schreiben mit KI: Schreibmaschine oder Programmierung? In: Weder, Mirjam / Bubenhofer, Noah (Hrsg): Schreiben mit KI in der Literatur und im Alltag. Bielefeld: Transcript. Preprint verfügbar unter: https://www.bubenhofer.com/publikationen/Preprint_BubenhoferWissenschaftlichesSchreibenmitKI.pdf (28.05.2026).

Fandrych, Christian / Klemm, Albrecht / Riedner, Renate (2014): Die Förderung des Deutschen als Wissenschaftssprache auf Master-Niveau: Das Beispiel eines integrierten Fach-/Sprachmoduls am Herder-Institut der Universität Leipzig. In: Mackus, Nicole / Möhring, Jupp (Hrsg.): Wege für Bildung, Beruf und Gesellschaft – mit Deutsch als Fremd- und Zweitsprache. 38. Jahrestagung des Fachverbandes Deutsch als Fremdsprache an der Universität Leipzig 2011. Göttingen: Universitätsverlag, 177-194.

Fandrych, Christian / Schmidt, Thomas / Wallner, Franziska / Wörner, Kai (Hrsg.) (2023): Zugänge zu multimodalen Korpora gesprochener Sprache. (Themenausgabe). In: Korpora Deutsch als Fremdsprache 3: 1. https://kordaf.tujournals.ulb.tu-darmstadt.de/issue/92/info/ (28.05.2026).

Franck, Norbert (2022): Handbuch Wissenschaftliches Schreiben. Eine Anleitung von A bis Z. 2. Aufl. Paderborn: Brill Schöningh.

Gredel, Eva / Pospiech, Ulrike / Schindler, Kirsten (2024): Künstliche Intelligenz und Schreiben in (hoch-)schulischen Kontexten. In: Zeitschrift für germanistische Linguistik 52: 2, 378-404.  http://doi.org/10.1515/zgl-2024-2018.

Heidler, Petra / Krczal, Albin / Krczal, Eva (2021): Wissenschaftlich Arbeiten für Vielbeschäftigte. Ein praktischer Leitfaden mit Beispielen, Anleitungen und Vorlagen. Opladen / Toronto: Budrich.

Hornung, Antonie (2014): Wissen referieren in der Fremdsprache Deutsch. Tesina und mündliche Präsentation als erste Schritte zum kritischen Denken. In: Alman Dili ve Edebiyati Dergisi. Studien zur deutschen Sprache und Literatur 32: 2, 35-56.

Hufeisen, Britta (2002): Ein deutsches Referat ist kein englischsprachiges Essay. Theoretische und praktische Überlegungen zu einem verbesserten textsortenbezogenen Schreibunterricht in der Fremdsprache Deutsch an der Universität. Innsbruck et al.: Studienverlag.

Jakobs, Eva-Maria (1999) Textvernetzung in den Wissenschaften. Zitat und Verweis als Ergebnis rezeptiven, reproduktiven und produktiven Handelns. Tübingen: Niemeyer.

Kaiser, Dorothee (2001): Wege zum wissenschaftlichen Schreiben. Eine kontrastive Untersuchung zu studentischen Texten aus Venezuela und Deutschland. Tübingen: Stauffenberg.

Knorr, Dagmar (2017): Schreibentwicklung in der Hochschule: wissenschaftliche Textkompetenz in der Zweitsprache Deutsch. In: Grießhaber, Wilhelm / Schmölzer-Eibinger, Sabine / Roll, Heike / Schramm, Karen (Hrsg.): Schreiben in der Zweitsprache Deutsch. Berlin / Boston: de Gruyter, 135-148.

Lösel, Andrea / Messner, Annalena / Schwendemann, Matthias / Wallner, Franziska (eingereicht, 2027): Integrierte Verweise in studentischen Exposés. Eine Fallstudie auf der Grundlage von ExpoKo. In: IDSopen. https://idsopen.de/ (28.05.2026).

Mächler, Lisette (2020): Erwerb des wissenschaftlichen Schreibens in der Fremdsprache Deutsch. Berlin: Lang.

Meißner, Cordula / Wallner, Franziska (2019): Das gemeinsame sprachliche Inventar der Geisteswissenschaften. Lexikalische Grundlagen für die wissenschaftspropädeutische Sprachvermittlung. Berlin: Erich Schmidt.

Nardi, Antonella / Farroni, Cristina (2022): Wissenschaftssprachliche Kompetenz beim Schreiben in Deutsch als fremde Wissenschaftssprache. Eine korpusbasierte Untersuchung. In: Korpora Deutsch als Fremdsprache 2: 1, 61-80.  http://doi.org/10.48694/kordaf-3488.

Nguyen, Thị Thiên Trang (2025): Passivkonstruktionen in Exposés von Masterarbeiten: Ein kontrastiver Vergleich der Texte deutscher und vietnamesischer Masterstudierender. In: Deutsch lehren und lernen in Vietnam. Chancen und Herausforderungen. Tagungsband UNIC2025, Hanoi: 26-38.

Nolda, Andreas (2024): Die DULKO-Tools des EXMARaLDA-Partitur-Editors. Von einer externen Toolsammlung zum integrierten Bestandteil. In: Korpora Deutsch als Fremdsprache 4: 2, 224-235.  http://doi.org/10.48694/kordaf.4139.

Pohl, Thorsten (2007): Studien zur Ontogenese wissenschaftlichen Schreibens. Tübingen: Niemeyer.

Prestin, Maike (2011): Wissenstransfer in studentischen Seminararbeiten. Rekonstruktion der Ansatzpunkte für Wissensentfaltung anhand empirischer Analysen von Einleitungen. München: Iudicium.

Sadowski, Sabrina (2017): Die Annotation von Zitaten und Verweisen im GeWiss-Korpus. In: Fandrych, Christian / Meißner, Cordula / Wallner, Franziska (Hrsg.): Gesprochene Wissenschaftssprache – digital. Verfahren zur Annotation und Analyse mündlicher Korpora, Tübingen: Stauffenburg, 147-166.

Stezano Cotelo, Kristin (2008): Verarbeitung wissenschaftlichen Wissens in Seminararbeiten ausländischer Studierender. Eine empirische Sprachanalyse. München: Iudicium.

Schiller, Anne / Teufel, Simone / Stöckert, Christine / Thielen, Christine (1999): Guidelines für das Tagging deutscher Textcorpora mit STTS (Kleines und großes Tagset). Stuttgart / Tübingen: Universität Stuttgart / Universität Tübingen. Unter: https://www.ims.uni-stuttgart.de/documents/ressourcen/lexika/tagsets/stts-1999.pdf (28.05.2026).

Schwendemann, Matthias / Portmann, Annette / Schlauch, Julia / Gamper, Jana / Wisniewski, Katrin (2024): Forschungsdaten für alle: Rechtliche Möglichkeiten und Herausforderungen bei der Veröffentlichung von Lernerkorpora. In: Korpora Deutsch als Fremdsprache 4: 2, 149-179.  http://doi.org/10.48694/kordaf.4138.

Statistisches Bundesamt (2024): Bildung und Kultur. Studierende an Hochschulen – Fächersystematik. https://www.destatis.de/DE/Methoden/Klassifikationen/Bildung/studenten-pruefungsstatistik.pdf?__blob=publicationFile&v=12 (28.05.2026).

Steinhoff, Torsten (2007): Wissenschaftliche Textkompetenz. Sprachgebrauch und Schreibentwicklung in wissenschaftlichen Texten von Studenten und Experten. Tübingen: Niemeyer.

Voss, Rödiger (2022): Wissenschaftliches Arbeiten … leicht verständlich! 8. Aufl. München: UVK.

Biografische Notiz

Andrea Lösel ist wissenschaftliche Mitarbeiterin im Arbeitsbereich Linguistik des Deutschen als Zweit- und Fremdsprache an der TU Dortmund. Ihre Arbeitsschwerpunkt in Forschung und Lehre liegen in den Bereichen Sprachdidaktik, Deutsch als (fremde) Wissenschaftssprache, Lexikologie und (Lerner-)Korpuslinguistik.

Kontaktanschrift:

Andrea Lösel

TU Dortmund

Emil-Figge-Straße 50

44227 Dortmund

andrea.loesel@tu-dortmund.de

Biografische Notiz

Annalena Messner ist DAAD-Lektor:in an der Universität Zagreb. Ihre Schwerpunkte in der Lehre sind die Phonetik/Phonologie des Deutschen sowie Aussprachetraining. Außerdem setzt sie sich mit korpuslinguistischen und geschlechtersensiblen Perspektiven im Bereich Deutsch als Fremd- und Zweitsprache auseinander.

Kontaktanschrift:

Annalena Messner

Odsjek za germanistiku

Filozofski Fakultet Sveučilišta u Zagrebu

Ivana Lučića 3

10000 Zagreb (Kroatien)

annalena.messner@daad-lektorat.de

Biografische Notiz

Matthias Schwendemann ist Juniorprofessor für Deutsch als Fremdsprache im Kontext von Mehrsprachigkeit an der Friedrich-Alexander-Universität Erlangen-Nürnberg. Seine Arbeitsschwerpunkte in Forschung und Lehre liegen in den Bereichen Deutsch als Wissenschaftssprache, Erwerb und Entwicklung des Deutschen als Fremd- und Zweitsprache sowie der korpuslinguistischen Analyse von Lernersprache.

Kontaktanschrift:

Matthias Schwendemann

Friedrich-Alexander-Universität Erlangen-Nürnberg

Bismarckstr. 1

91054 Erlangen

matthias.schwendemann@fau.de

Biografische Notiz

Franziska Wallner ist Professorin für Linguistik des Deutschen als Zweit- und Fremdsprache an der TU Dortmund. Ihre Forschungsschwerpunkte sind unter anderen das Deutsche als fremde Bildungs- und Wissenschaftssprache, die korpusbasierte Erforschung der gesprochenen Sprache, Mündlichkeitsdidaktik sowie die Nutzung von Korpora im Kontext von Deutsch als Fremd- und Zweitsprache.

Kontaktanschrift:

Franziska Wallner

TU Dortmund

Emil-Figge-Straße 50

44227 Dortmund

franziska.wallner@tu-dortmund.de