Skip to main content
Artikel zum Themenschwerpunkt: Grammatik im Fokus: Theorie – Empirie – Vermittlung, hrsg. von Anna Volodina und Lutz Gunkel

Wieso? Weshalb? Warum? – Hoezo? Waarom? Form, Variation und Funktion von kausalen Fragewörtern im deutsch-niederländischen Sprachvergleich

Authors
  • Wieso? Weshalb? Warum? – Hoezo? Waarom? Form, Variation und Funktion von kausalen Fragewörtern im deutsch-niederländischen Sprachvergleich

    Artikel zum Themenschwerpunkt: Grammatik im Fokus: Theorie – Empirie – Vermittlung, hrsg. von Anna Volodina und Lutz Gunkel

    Wieso? Weshalb? Warum? – Hoezo? Waarom? Form, Variation und Funktion von kausalen Fragewörtern im deutsch-niederländischen Sprachvergleich

    Authors

Abstract

Der Beitrag untersucht die kausalen Fragewörter wieso, weshalb, warum im Deutschen sowie hoezo, waarom im Niederländischen vergleichend aus variationslinguistischer Perspektive. Auf der Grundlage von geschrieben- und gesprochensprachlichen Korpora wird analysiert, wie sich die einzelnen Formen in Abhängigkeit von Register, Formalitätsgrad sowie konzeptioneller Schriftlichkeit und Mündlichkeit verteilen. Die Ergebnisse zeigen, dass warum/waarom in beiden Sprachen eine dominante, stilneutrale Variante darstellen, während weshalb bzw. wieso/hoezo register- und medienabhängig verteilt sind. Weshalb erscheint vor allem im konzeptuell geschriebenen, formell geprägten Bereich, wieso/hoezo erweisen sich dagegen als Marker eines informellen Stils in konzeptuell mündlicher Sprache.

In this article, the causal question words German wieso, weshalb, warum and Dutch hoezo, waarom (‘why’) are examined from a comparative perspective in a variationist linguistic study. The distribution of the individual forms – depending on register, degree of formality, and conceptually written and spoken language – is studied in written and spoken reference corpora of the two languages. The results show that warum/waarom constitute dominant, style-neutral variants in both languages, while weshalb and wieso/hoezo are distributed depending on register and medium. Weshalb appears mainly in the conceptually written, formal domain, while wieso/hoezo, in contrast, prove to be markers of an informal style in conceptually oral language. 

 

Keywords: Fragewörter, Korpusuntersuchung, Deutsch-Niederländisch, Sprachvergleich, Stil und Register, question words, corpus study, German-Dutch, contrastive linguistics, style and register

How to Cite:

Dierolf, K. & Kürschner, S., (2026) “Wieso? Weshalb? Warum? – Hoezo? Waarom? Form, Variation und Funktion von kausalen Fragewörtern im deutsch-niederländischen Sprachvergleich”, Korpora Deutsch als Fremdsprache 6(1), 82–100. doi: https://doi.org/10.48694/kordaf.6173

58 Views

22 Downloads

Published on
2026-08-10

Peer Reviewed

1. Einleitung

Wer Deutsch als Fremdsprache erwirbt, wird sich zu irgendeinem Zeitpunkt mit der Frage beschäftigen, ob und wie sich die drei Frageadverbien wieso, weshalb und warum, die sehr ähnliche Funktionen erfüllen, in ihrer Distribution und Bedeutung (zumindest in Bedeutungsnuancen) unterscheiden. Das Dreierpaar von kausalen Fragewörtern ist auch außerhalb des DaF-Kontextes bekannt: Die Alliteration hat etwa bei der Titelmusik der deutschsprachigen Ausgabe der Sesamstraße inspirierend gewirkt, die Kindern (und aufgrund der langen Bestehenszeit auch den meisten Erwachsenen) üblicherweise bekannt sein dürfte und das Stellen kausaler Fragen im Kontext des Erwerbs von Vorschulwissen zentral stellt1. Auch eine Serie von Kinderhörspielen mit Wissenskontexten wurde Wieso? Weshalb? Warum? getauft und ist mit einer entsprechenden eingängigen Titelmusik bei vielen Kindern und Eltern bekannt. Ob sich L1-Nutzer/-innen des Deutschen dabei über das Bestehen des Dreierpaars an Fragewörtern und die Ergänzung um das weitere kausale Fragewort weswegen wundern und es hinterfragen, ist unseres Wissens weitgehend unerforscht. Gleichwohl wird diese Frage in informellen Online-Diskussionen, etwa in Foren wie Reddit oder Gute-Frage.net, häufig thematisiert – was vor dem Hintergrund, dass formale Unterschiede üblicherweise mit funktionalen Unterschieden assoziiert werden, kaum überrascht2. In sprachwissenschaftlichen Studien wurde das Thema (relativ spärlich) reflektiert, allerdings kommt etwa Gallmann (1997: 54) zum Fazit: „Die Wörter der warum-Gruppe werfen immer noch Fragen auf. Zu den Rätseln gehört die große Anzahl der Formen und deren relative diachrone Stabilität, dazu gehört auch das teilweise Fehlen einer rekonstruierbaren Motivation für die Morphemkombinationen (…)“.

Ein weiterer Kontext, in dem auch L1-Deutschsprachige auf eine vergleichbare Konstellation treffen können, besteht beim Erwerb des Niederländischen als Fremdsprache. Hier ist es zwar kein Dreier- bis Viererpaar, aber doch ein Zweierpaar von Fragewörtern, die zudem zu zwei der deutschen Gegenstücke kognat sind und so für Deutschsprachige nahelegen, eine vergleichbare Verteilung wie im Deutschen mitzubringen. Es handelt sich um die Wörter hoezo ‚wieso‘ (bestehend aus hoe ‚wie‘ und zo ‚so‘) und waarom ‚warum‘ (bestehend aus waar ‚wo‘ und om ‚um‘). Die Fragewort-Cluster des Deutschen und Niederländischen bilden also nicht nur innerhalb der beiden Einzelsprachen, sondern auch mit Blick auf angewandte Aspekte des Erwerbs nah verwandter Fremdsprachen einen interessanten Komplex.

Der vorliegende Artikel nimmt diesen Komplex aus einer variationslinguistischen Perspektive in den Blick und untersucht die kausalen Fragewörter des Deutschen (wieso, weshalb, warum) und des Niederländischen (hoezo, waarom) vergleichend. Im Zentrum steht dabei die Frage, wie sich die einzelnen Varianten in Abhängigkeit von Register, Formalitätsgrad sowie konzeptioneller Schriftlichkeit und Mündlichkeit verteilen. Ausgangspunkt der Untersuchung ist die Annahme, dass die Verwendung der kausalen Fragewörter potenziell polyfunktional ist und sich Unterschiede aus kontextuellen Faktoren erklären lassen.

Kap. 2 geht zunächst auf die Behandlung der w-Fragewörter in Wörterbüchern und Grammatiken des Deutschen sowie bisherige Forschungsarbeiten dazu ein. Kap. 3 stellt in dieser Hinsicht die Ergebnisse zum Niederländischen zusammen. Kap. 4 wird dann anhand der Analyse geschrieben- und gesprochensprachlicher Korpora Überlegungen zu Parallelen und Divergenzen der Fragewortgruppen in den beiden eng verwandten Sprachen nachgehen. Der Artikel schließt mit einem Fazit in Kap. 5.

2. Forschungshintergrund im Deutschen

2.1 Etymologie

Bei allen drei Fragewörtern handelt es sich um komplexe Wortbildungen mit unterschiedlichen Komplexitätsgraden. Wieso wird nach Pfeifer (vgl. Etymologisches Wörterbuch des Deutschen (EtymWb)3) auf eine Univerbierung auf Grundlage eines Satztyps wie „Wie ist es so, dass…?“ zurückgeführt und ist seit dem 16. Jahrhundert regelmäßig verzeichnet (vgl. auch das Deutsche Wörterbuch von Jacob Grimm und Wilhelm Grimm4). Gegenwartssprachlich kann es als formal transparente, aber semantisch undurchsichtige Konstruktion gelten (vgl. Gallmann 1997: 53-54).

Weshalb lässt sich auf den Genitiv von was in Verbindung mit der (heute nicht mehr genutzten) Präposition halb(en) zurückführen, die ältere Form lautet weshalben. Auch diese Form ist seit dem 16. Jahrhundert belegt (vgl. Deutsches Wörterbuch von Jacob Grimm und Wilhelm Grimm5).

Warum gilt als die im Vergleich älteste Form; erste Belege finden sich bereits im 11. Jahrhundert (vgl. EtymWb; Kluge6). Es ist zusammengesetzt aus ‚wo‘ mit erhaltenem altem ā und auslautendem -r (vgl. ahd. (h)wār) und um (< umbi, vgl. ahd. wārumbi) und hat sich in diesem Zusammenhang von worum formal und semantisch differenziert (anders als im Niederländischen, wo das lokale Fragewort waar in waarom gleichlautend erhalten bleibt).

2.2 Wörterbücher, Grammatiken und Forschungsarbeiten zum Gegenwartsdeutschen

Für den Forschungsüberblick wurden – neben der geringen Zahl an dezidiert dem Phänomen gewidmeter Forschungsliteratur – gängige Grammatiken und Wörterbücher des Deutschen gesichtet, wobei im Folgenden aus denjenigen Werken berichtet wird, in denen Beobachtungen zu Unterschieden zwischen kausalen w-Fragewörtern in relevantem Umfang thematisiert werden.

Dabei zeigt sich, dass wieso, weshalb, warum übereinstimmend als Interrogativadverbien klassifiziert werden. Das Digitale Wörterbuch der deutschen Sprache (DWDS) weist in diesem Zusammenhang darauf hin, dass sie sowohl direkte als auch indirekte Fragesätze einleiten können7. Die Duden-Grammatik (vgl. Dudenredaktion 2016, 2022) ordnet sie dabei den kausalen w-Wörtern zu und beschreibt sie als Elemente, die im Vorfeld eines Satzes stehen und dort eine Adverbiale erfragen:

    1. (1)
    1. a.
    1. Wieso/weshalb/warum fährt der Bus nicht?
    1.  
    1. b.
    1. Sie erklärt, wieso/weshalb/warum der Bus nicht fährt.

Die Beispiele zeigen, dass alle drei Formen in denselben syntaktischen Umgebungen auftreten und sowohl in selbstständigen Ergänzungsfragen mit Verbzweitstellung als auch in Fragenebensätzen mit Verbletztstellung erscheinen können. Eine funktionale Differenzierung nimmt der Duden nicht vor; vielmehr illustrieren die Belege, dass wieso, weshalb, warum weitgehend austauschbar verwendet werden (vgl. Dudenredaktion 2016: 589-590; Dudenredaktion 2022: 806). Gleichermaßen ordnet das grammatische Informationssystem (grammis) des Instituts für Deutsche Sprache (IDS)8 sowie die IDS-Grammatik (vgl. Zifonun / Hoffmann / Strecker 1997) wieso, weshalb, warum als w-Adverbien ein9 und stellt fest, dass diese Gründe und Ursachen näher beschreiben.

Ebenso dokumentiert das Wahrig Wörterbuch (vgl. 2006: 1631, 1653, 1660) alle drei Formen als Interrogativadverbien. Für warum und weshalb verzeichnet es dabei die Paraphrasen aus welchem Grund und weshalb bzw. warum, während für wieso auch wie kommt das? und wie kommt es, dass …? ausgewiesen werden (s. Kap. 2.1). Dies signalisiert, dass wieso mit einer leicht unterschiedlichen semantischen Nuance aufgefasst wird, die im Gegensatz zu warum und weshalb zusätzlich auf das Entstehen einer Ursache abzielt.

Eisenberg (vgl. 2020: 245-247) beschreibt die Interrogativadverbien als eine Klasse, die durch gemeinsame syntaktische und teilweise morphologische Eigenschaften zusammengehalten wird. Insbesondere weist er auf einen einheitlichen Anlaut mit [v] hin, der einen paradigmatischen Zusammenhalt erzeugt, wie er im Deutschen sonst kaum vergleichbar zu finden ist. Fast jedem Frageadverb ist dabei ein entsprechendes Demonstrativadverb in paradigmatischer Opposition zugeordnet, wobei beide in weitgehend denselben syntaktischen Funktionen auftreten, vgl. weshalbdeshalb und warumdarum. Für wieso besteht hingegen kein entsprechendes d-Wort (*dieso).

Parallel zum Gebrauch als Interrogativadverbien dokumentieren die konsultierten Wörterbücher und Grammatiken auch die Verwendung als Relativadverbien. Die Duden-Grammatik weist darauf hin, dass diese dieselben Formen verwenden wie Interrogativadverbien und dass sie Relativsätze einleiten, die sich auf eine zuvor genannte Bezugsgröße beziehen (vgl. Dudenredaktion 2016: 590; Dudenredaktion 2022: 806-807):

    1. (2)
    1. Es gibt nicht einen Grund, wieso/weshalb/warum man das anders machen sollte.

In dem angeführten Beispiel zeigt sich erneut, dass die einzelnen Formen ohne erkennbare Bedeutungsdifferenzierung austauschbar sind.

Darüber hinaus bildet weshalb auch ein Wort zur Einleitung kausaler Nebensätze, die nicht als Interrogativ- oder Relativsatz gedeutet werden können. Das Wahrig Wörterbuch (vgl. 2006: 1653) klassifiziert weshalb in diesem Kontext bereits als Konjunktion, während das DWDS anmerkt, dass es sich noch „im Übergang zur Konjunktion“10 befinde. In dieser Funktion leitet weshalb einen weiterführenden Relativsatz ein, bei dem syntaktisch kein Bezugsausdruck vorhanden ist und die Bezugsgröße implizit bleibt (vgl. Breindl / Volodina / Waßner 2014: 895-896, ebenso den Eintrag zu weshalb im Wörterbuch der Konnektoren im grammis11):

    1. (3)
    1. Es regnet, weshalb (*wieso, *warum) Peter nicht aus dem Haus geht.

In diesem Zusammenhang kann weshalb durch aus diesem, dem gerade genannten Grund paraphrasiert werden (vgl. Wahrig 2006: 1653), „weist auf eine vorausgehende Ursache hin und bezeichnet deren Folge“ (DWDS12).

Insgesamt wird deutlich, dass wieso, weshalb, warum in ihrer Funktion in den meisten Bereichen zueinander in Konkurrenz zu stehen scheinen. Bemerkenswert ist, dass die Anzahl der Formen trotzdem nicht abgebaut wurde, sondern sich eine auffallende relative diachrone Stabilität zeigt, wodurch das Deutsche in diesem Bereich als „erstaunlich bunt“ (Gallmann 1997: 53) beschrieben werden kann.

Darüber hinaus weist Gallmann (ebd.: 53, 84) auf zwei weitere interessante Aspekte hin: Zum einen treten alle aufgeführten Formen sowohl in schriftlicher als auch in mündlicher Sprache frequent auf, was auf eine Verwendung über unterschiedliche Register hinweg schließen lässt. Zum anderen wird wieso im Unterschied zu weshalb und warum gehäuft in insistierenden Fragen verwendet, was auf pragmatische Unterschiede in der Nutzung der Formen hinweist.

Egbert / Vöge (2008) stellen eine konversationsanalytische Untersuchung vor und zeigen darin anhand informeller Alltagsgespräche, dass wieso eine Äußerung als Informationsanfrage markiert und informationssuchend verwendet wird, während warum in ihren Daten auf Problematisches verweist und Beschwerde, Vorwurf oder Herausforderung impliziert, aber nie rein informationssuchend auftritt. In institutionellen Kontexten wie Geschäftsmeetings beobachten sie darüber hinaus statusabhängige Gebrauchsmuster, indem warum nahezu ausschließlich in Top-down-Positionen verwendet wird.

Volodina (2021) untersucht in einer Korpusanalyse die Häufigkeit und Verwendung kausaler wieso- und warum-Fragen im gymnasialen Unterrichtsdiskurs. Dabei bestätigt sie die von Egbert / Vöge (2008) beschriebenen hierarchischen Gebrauchsmuster insofern, als Lehrende vor allem warum-Fragen verwenden, während Schüler/-innen mehrheitlich wieso-Fragen stellen. Sie zeigt zudem, dass die untersuchten warum-Fragen auf das Abfragen von Sachverhalten und Fakten durch Lehrpersonen abzielen, während wieso-Fragen stärker der Initiierung eines argumentativen Diskurses dienen.

3. Forschungshintergrund im Niederländischen

3.1 Etymologie

Aus einer Univerbierung von hoe ‚wie‘13 und zo ‚so‘ geht – parallel zu deutsch (dt.) wiesohoezo hervor, das sich als formal transparente Form verfestigt. Das Wort ist in der Form hoezoo bereits im Mittelniederländischen (1250-1550) verzeichnet (vgl. Middelnederlandsch Woordenboek unter zoo II14). Ebenso geht parallel zu dt. warum niederländisch (nl.) waarom auf die Zusammensetzung aus waar ‚wo‘ und om ‚um‘ (< mittelniederländisch (mnl.) -ombe) zurück, die formal transparenter als im Deutschen bewahrt ist. Der älteste Beleg für mnl. waeromme wird im Vroegmiddelnederlands Woordenboek mit 1240 datiert15.

3.2 Wörterbücher, Grammatiken und Forschungsarbeiten zum Niederländischen

Analog zum Deutschen wurden für das Niederländische gängige Grammatiken und Wörterbücher konsultiert, in denen die kausalen Fragewörter hoezo und waarom sowie deren funktionale Einordnung beschrieben werden. Dabei zeigt sich insgesamt, dass während im Deutschen die Funktion der Fragewörter in vielen Belangen vergleichbar erscheint, die Fragewörter im Niederländischen häufiger unterschiedlichen Funktionen zugeordnet werden16. So wird waarom zumeist – vergleichbar zum Deutschen – als Interrogativadverb eingeordnet (vgl. z.B. Groot Woordenboek van de Nederlandse taal17 als vragend en voornamelijk bijwoord ‚Frage- und Pronominaladverb‘). Dagegen wird hoezo zumeist als Interjektion (tussenwerpsel) dargestellt (vgl. z.B. ANW18, Van Dale 1996: 405, lediglich WikiWoordenboek19 als bijwoord ‚Adverb‘). Die Bedeutung von waarom wird mit om wat ‚wofür, weshalb‘, om welke reden ‚aus welchen Gründen‘, met welk doel ‚mit welchem Ziel‘ umschrieben, während hoezo als „uitroep van verbazing en onbegrip“ ‚Ausruf der Überraschung und des Unverständnisses‘ mit hoe bedoel je? ‚was meinst du damit?‘ paraphrasiert wird (vgl. ebd.). Laut WikiWoordenboek fragt hoezo „naar de logica achter een bepaalde bewering“ ‚nach der Logik hinter einer bestimmten Behauptung‘. Eine Beantwortung einer Sprachfrage durch „Onze Taal“20 sieht zwar eine vergleichbare Funktion von hoezo und waarom in einem Satz wie „Waarom/Hoezo mag ik hier niet parkeren?“ ‚Warum/wieso darf ich hier nicht parken?‘, beschreibt aber waarom als neutrales Fragewort, während hoezo neben der kausalen Frage Erstaunen bis hin zur Zuweisung von Verantwortung an das Gegenüber markiere. Im Vergleich mit waarom wird die Funktion von hoezo also wiederholt nicht primär in der Rolle als kausales Fragewort gesehen, sondern auf pragmatischer Ebene im Gespräch verortet.

Dies ist auch das Ergebnis einer aktuellen Analyse von Rullmann / Nederveen (2024), in der die Autoren anhand ausgewählter Sätze hoezo mit einer Primärfunktion als Diskurspartikel interpretieren. Die wesentliche Funktion besteht demnach darin, eine Äußerung eines vorausgehenden Sprechers in Frage zu stellen, z.B. in „Ben je ziek?“ – „Hoezo?“ ‚Bist du krank? – Wieso?‘ (ebd.: 4). Die Autoren argumentieren für eine primäre Funktion von hoezo auf der Ebene des Diskurses, da mit diesem Wort signalisiert werde, dass eine vom Gegenüber vorgenommene Aktualisierung des Diskursmodells (des Common Grounds) hinterfragt wird. Im gleichen Zuge ist eine Kausalsemantik auf Gesprächsebene zu verzeichnen, indem durch hoezo ein Grund für die vorhergehende Äußerung erbeten wird (im obigen Beispiel etwa: „Du siehst blass aus.“ (und deswegen frage ich, ob du krank bist)). Mit waarom werde also nach Gründen für behauptete Tatsachen gefragt, mit hoezo nach Gründen für eine Äußerung des Gegenübers (also die vorhergehende Diskursaktion). In einer erweiterten Funktion sehen die Autoren den Gebrauch von hoezo als Reaktion auf überraschende oder unerwünschte Ereignisse, etwa in Hoezo regent het nu alweer? ‚Warum (zum Teufel) regnet es nun schon wieder?‘. Der Gebrauch von hoezo trägt somit eine expressive Komponente. Vor dem Hintergrund dieser Analysen ist zu erwarten, dass hoezo in erster Linie in dialogisch orientierten Kontexten auftritt und stärker der Mündlichkeit als der Schriftlichkeit angehört.

4. Parallelen und Divergenzen der Fragewortgruppen im Deutschen und Niederländischen

Im Folgenden stellen wir eine korpusbasierte Untersuchung der kausalen Fragewortgruppen im Deutschen (wieso, weshalb, warum) und im Niederländischen (hoezo, waarom) vor. Ziel ist es, die in den vorangegangenen Kapiteln beschriebenen funktionalen Beobachtungen anhand authentischer Sprachdaten zu überprüfen und miteinander in Beziehung zu setzen.

Für beide Sprachen erfolgt das Vorgehen nach dem gleichen methodischen Prinzip: Zunächst werden die verwendeten Korpora vorgestellt, anschließend die Auftretenshäufigkeiten der jeweiligen Fragewörter dargestellt und schließlich auffällige Verteilungsmuster im Hinblick auf Register, Mündlichkeitsgrad und Kommunikationsform; darauf aufbauend werden die Ergebnisse beider Sprachen vergleichend zusammengeführt und kontrastiert. Die Analyse basiert auf Korpusabfragen, die im Zeitraum vom 24. November bis 23. Dezember 2025 durchgeführt wurden.

4.1 Verteilung von wieso, weshalb, warum im Deutschen

Für die Untersuchung der Fragewörter wieso, weshalb, warum wurden verschiedene Korpora des Deutschen herangezogen, die sowohl geschriebene als auch gesprochene Sprachdaten abdecken und ein breites Spektrum an Registern und Schriftlichkeits- und Mündlichkeitsgraden repräsentieren.

Im Bereich der geschriebenen Sprache wurde das Deutsche Referenzkorpus (DeReKo) genutzt, das über die webbasierte Benutzeroberfläche COSMAS II zugänglich ist und vom IDS bereitgestellt wird. Mit etwa 61,5 Milliarden Tokens stellt es die weltweit größte linguistisch motivierte Sammlung elektronischer Korpora mit geschriebenen deutschsprachigen Texten der Gegenwart und der neueren Vergangenheit dar21. Das Korpus umfasst belletristische, wissenschaftliche und populärwissenschaftliche Texte, Zeitungstexte sowie eine Vielzahl weiterer Textsorten, die kontinuierlich erweitert werden (vgl. ausführlich Kupietz / Lüngen / Diewald 2023).

Die in COSMAS II zugänglichen Korpora sind in thematischen Archiven organisiert. Für die vorliegende Untersuchung wurde das Archiv der geschriebenen Korpora (Hauptarchiv, kurz: Archiv W) verwendet, das insgesamt mehr als 46.000.000 Texte vom 18. Jahrhundert bis in die Gegenwart enthält22. Es bietet die größte Bandbreite an Textsorten innerhalb des DeReKo23. Zur Analyse spezifischer Textsorten und Register wurden im Archiv W darüber hinaus folgende Subkorpora genutzt (vgl. Tabelle 1).

Tabelle 1

Überblick über die ausgewählten Subkorpora des DeReKo-Archivs W

Korpus Anzahl Texte Anzahl Tokens Anzahl Quellen Erhebungszeitraum Beschreibung
Fachsprachen-Korpus 1 (fsp-pub) 12 617.690 1 1997-2006 k.A.
Wikipedia Artikel (wpd 11) 2.221.736 574.761.167 1 2002-2011 Artikel der Website wikipedia.de
Belletristik/Trivial-literatur (lit-pub) 1.078 16.578.131 9 1787-2016 Texte u.a. von: Brüder Grimm, Goethe-Korpus, Belletristik des 20. und 21. Jahrhunderts mit diversen Schriftstellern
Kinder- und Jugendliteratur (kjl) 88 4.037.493 1 1978-2016 k.A.
Dortmunder Chat-korpus 2.2 (dck) 470 1.240.589 1 1998-2006 k.A.

Ergänzend wurden verschiedene Korpora des Digitalen Wörterbuchs der deutschen Sprache (DWDS) einbezogen. Das DWDS umfasst zum einen das sogenannte DWDS-Kernkorpus, das erste zeitlich und nach Textsorten ausgewogene Korpus deutscher Texte des 20. Jahrhunderts, und zum anderen eine Vielzahl weiterer historischer und gegenwartssprachlicher Teilkorpora. Die Plattform vereint sowohl geschriebene als auch gesprochene Korpora und wird kontinuierlich um neue Datenbestände erweitert. Insgesamt stehen über die DWDS-Infrastruktur mehr als 75 Milliarden Tokens aus unterschiedlichen Textkorpora zur Verfügung24. Für die vorliegende Analyse wurden folgende Subkorpora berücksichtigt (vgl. Tabelle 2):

Tabelle 2

Überblick über die ausgewählten Subkorpora der DWDS-Korpora

Korpus Anzahl Texte Anzahl Tokens Anzahl Quellen Erhebungszeitraum Beschreibung
Gesetze und Verordnungen 4.660 17.095.696 k.A. 1897-2025 Gesetzes- und Verordnungstexte der Bundesrepublik Deutschland in konsolidierten Fassungen
Blogs 225.964 107.069.513 917 1995-2014 Beiträge und Kommentare verschiedener Blogs, z.B. apfeltech.net, bitblokes.de, lumma.de, zockerseele.com, iphoneblog.de

Zur Berücksichtigung gesprochener Sprache wurden Bestände der Datenbank für Gesprochenes Deutsch (DGD) herangezogen. Die DGD ist ein Korpusmanagementsystem im Programmbereich „Mündliche Korpora“ des IDS und stellt Teilbestände des Archivs für Gesprochenes Deutsch (AGD) der wissenschaftlichen Öffentlichkeit online zur Verfügung (vgl. ausführlich Schmidt 2017). Das System wird kontinuierlich erweitert und umfasst derzeit 44 Korpora, die sowohl verschiedene Varietäten des Deutschen (binnendeutsche Dialekte, Umgangssprachen, extraterritoriale Varietäten) als auch unterschiedliche Gesprächssituationen dokumentieren. Neben Audioaufnahmen werden Transkripte, Metadaten sowie ergänzende Materialien bereitgestellt.

Für die vorliegende Analyse wurden das Forschungs- und Lehrkorpus Gesprochenes Deutsch (FOLK) sowie das Korpus Deutsch Heute (DH) einbezogen (vgl. Tabelle 3). Das FOLK umfasst insgesamt 259 Gesprächsereignisse und rund 200 Stunden Audio- und Videoaufnahmen, die unterschiedliche Bereiche privater, institutioneller und öffentlicher Interaktionen abdecken, z.B. Telefongespräche, Gesellschaftsspiele, Schulunterricht, Prüfungsgespräche, berufliche Meetings, Podiumsdiskussionen (vgl. Schmidt 2017: 453-454). Es gilt als ein „Best Practices genügendes Gesprächskorpus“ (ebd.: 453) und dient als Referenzkorpus der DGD. Das Korpus DH enthält Sprachaufnahmen aus insgesamt 194 Orten, in denen Deutsch als Amts- und Unterrichtssprache verwendet wird. Von den Teilnehmer/-innen liegen jeweils etwa 90 Minuten Aufnahmen vor, die als Grundlage für Daten zur regionalen Aussprachevariation im Atlas zur Aussprache des deutschen Gebrauchsstandards dienen25.

Tabelle 3

Überblick über die ausgewählten Subkorpora der DGD

Korpus Anzahl Transkripte Anzahl Tokens Anzahl Quellen Erhebungszeitraum Beschreibung
FOLK 980 3.693.896 k.A. 2003-2024 Private Kommunikation, Institutionelle Kommunikation, Experimentsituation bzw. Kommunikationsspiel, Öffentliche Kommunikation
DH 6.939 6.274.343 k.A. 2006-2008 Aufnahmeaktionen im Rahmen des Spracherhebungsprojekts Deutsch heute, u.a. Lesesprache, Interview, Maptask

Die ausgewählten Korpora bilden insgesamt ein breites Spektrum ab, das von stark formalisierten, geschriebensprachlich geprägten Textsorten bis hin zu dialogischen und konzeptionell mündlichen Kontexten reicht. Damit lassen sich mögliche Zusammenhänge zwischen Register und Mündlichkeitsgrad in der Verteilung der Fragewörter systematisch untersuchen.

Bevor auffällige Verteilungsmuster diskutiert werden, geben die Tabellen 4 und 5 einen Überblick über die absoluten und relativen Auftretenshäufigkeiten von wieso, weshalb und warum in den ausgewählten Korpora. Die Werte fassen Groß- und Kleinschreibung zusammen. Dabei wird zwischen geschrieben- und gesprochensprachlichen Korpora differenziert.

Geschriebensprachliche Korpora:

Tabelle 4

Übersicht der absoluten und relativen Auftretenshäufigkeit von wieso, weshalb, warum (klein- und großgeschriebene Varianten) in den aufgeführten geschriebensprachlichen Korpora26

Korpus wieso weshalb warum
Archiv W (gesamt) 259.478 / 8 % 466.115 / 14 % 2.518.339 / 78 %
Fachsprachen-Korpus (fsp-pub) 13 / 5 % 41 / 15 % 216 / 80 %
Wikipedia Artikel (wpd 11) 799 / 3 % 17.625 / 55 % 13.580 / 42 %
Belletristik/Trivialliteratur (lit-pub) 2.941 / 20 % 1.096 / 8 % 10.305 / 72 %
Kinder- und Jugendliteratur (kjl) 1.273 / 31 % 285 / 7 % 2.569 / 62 %
Dortmunder Chatkorpus 2.2 (dck) 491 / 33 % 32 / 2 % 975 / 65 %
Gesetze und Verordnungen 0 / 0 % 41 / 26 % 115 / 74 %
Blogs 8.202 / 14 % 4.449 / 8 % 44.760 / 78 %

Gesprochensprachliche Korpora:

Tabelle 5

Übersicht der absoluten und relativen Auftretenshäufigkeit von wieso, weshalb, warum (klein- und großgeschriebene Varianten) in den aufgeführten gesprochensprachlichen Korpora

Korpus wieso weshalb warum
FOLK (gesamt) 776 / 24 % 39 / 1 % 2.422 / 75 %
FOLK (öffentlich) 13 / 5 % 12 / 4 % 265 / 91 %
FOLK (institutionell) 151 / 17 % 16 / 2 % 712 / 81 %
FOLK (privat) 579 / 30 % 10 / 1 % 1.328 / 69 %
DH 305 / 16 % 14 / 1 % 1.611 / 83 %

Im Ergebnis wird deutlich, dass warum in nahezu allen betrachteten Korpora, sowohl geschrieben- als auch gesprochensprachlich, die dominierende Form ist, während wieso und weshalb insgesamt deutlich seltener auftreten. Im Archiv W, das eine Vielzahl geschriebener Textsorten umfasst, entfallen 78 % auf warum, 14 % auf weshalb und 8 % auf wieso. Eine differenzierte Betrachtung der geschriebensprachlichen Subkorpora zeigt allerdings Unterschiede in der Verteilung von insbesondere wieso und weshalb:

In formelleren, geschriebensprachlich standardisierten Registern, wie Fachsprachenkorpora oder Gesetzestexten, ist weshalb vergleichsweise häufig vertreten (15 % bzw. 26 %; vgl. 4a-b), während wieso mit 5 % bzw. 0 % deutlich seltener oder gar nicht vorkommt. Diese Register sind konzeptionell schriftlich geprägt, d.h. sie zeichnen sich unter anderem durch konservatives Schreiben, Monologizität und Fremdheit der Kommunikationspartner aus (vgl. Koch / Oesterreicher 2008: 201). Auch im Korpus der Wikipedia‑Artikel zeigt sich dieses Verteilungsmuster: Hier erreicht weshalb sogar eine Auftretenshäufigkeit von 55 % (vgl. 4c), warum 42 % und wieso lediglich 3 %. Diese Verteilung deutet darauf hin, dass weshalb in formellen Registern und konzeptionell schriftlichen Kommunikationsformen merklich häufiger verwendet wird als in anderen Kontexten. Wieso spielt dort hingegen nur eine untergeordnete Rolle.

    1. (4)
    1. a.
    1. Ein Grund, weshalb der Stille mit so hartnäckigem Ignorieren ihrer Essentialität begegnet wird, (…), dürfte hierhin bestehen: (…). (fsp-pub)27
    1.  
    1. b.
    1. Aus dem Vorbehalt muss sich ergeben, (…) weshalb der Verfrachter keine ausreichende Gelegenheit hatte, die Angabe nachzuprüfen. (Gesetze und Verordnungen)
    1.  
    1. c.
    1. Diese These vermag jedoch nicht zu erklären, weshalb Lukas die von Paulus als einschneidend beschriebene Entscheidung für die Heidenmission erwähnt (…). (wpd 11)28

Mit abnehmendem Formalitätsgrad und zunehmendem Mündlichkeitsgrad verschiebt sich das Verhältnis von wieso und weshalb deutlich: In Beiträgen und Kommentaren verschiedener Blogs nimmt der Anteil von weshalb auf 8 % ab, während wieso mit 14 % belegt ist (warum bleibt mit 78 % dagegen klar dominant). In Belletristik und Trivialliteratur zeigt sich eine weitere Zunahme von wieso (20 %), während weshalb nur zu 8 % und warum zu 72 % vertreten sind. Noch stärker ist dieser Trend in der Kinder- und Jugendliteratur nachvollziehbar, wo wieso 31 %, weshalb 7 % und warum 62 % erreicht. Diese Befunde deuten darauf hin, dass weshalb in weniger formellen Registern und in stärker konzeptionell mündlich geprägten Kommunikationsformen eine geringere Rolle spielt, während die Auftretenshäufigkeit von wieso in diesen Kontexten zunimmt (vgl. 5).

    1. (5)
    1. a.
    1. Und überhaupt, wieso bist du auf einmal – entschuldige den Ausdruck – scheißfreundlich? (lit-pub)
    1.  
    1. b.
    1. Was glaubst du, wieso ich seit Wochen wieder trainieren kann (…)? (kjl)

In noch mündlichkeitsnäheren bzw. dialogischen Kommunikationsformen – gekennzeichnet durch kommunikative Nähe, Dialogizität und Spontaneität (vgl. Koch / Oesterreicher 2008: 201) – verschiebt sich die Verteilung weiter zugunsten von wieso. Besonders deutlich zeigt sich dies im Dortmunder Chatkorpus, das informelle Online-Interaktionen abbildet: Hier erreicht wieso einen Anteil von 33 %, während weshalb mit lediglich 2 % nur marginal vertreten ist; trotz der weiterhin bestehenden Dominanz von warum lässt sich hier im informellen und mündlichkeitsnäheren Bereich also eine deutlich höhere Nutzung von wieso erkennen, vgl. (6a) gegenüber dem stärker distanzsprachlichen Kontext in (6b).

    1. (6)
    1. a.
    1. Das tut mir leid, aber das verstehe ich schon wieder nicht, wieso komplett ablehnen? (dck)
    1.  
    1. b.
    1. Bitte nehmen Sie noch einmal Stellung, warum Sie keine weiteren Proben von Kaspar Hauser bekommen. (dck)

In den gesprochenen Korpora setzt sich der in den geschriebensprachlichen Korpora erkennbare Trend fort, dass mit zunehmender konzeptioneller Mündlichkeit wieso gegenüber weshalb häufiger auftritt. So erreicht wieso im FOLK einen Anteil von 24 %, während weshalb mit lediglich 1 % nur äußerst selten verwendet wird (warum dominiert mit 75 % weiterhin). Das FOLK umfasst neben privaten Gesprächen auch institutionelle und öffentliche Kommunikationsformen, wodurch der Anteil von wieso in der Gesamtauswertung erwartbar geringer ausfällt als etwa im Dortmunder Chatkorpus. Ein differenzierter Blick auf die einzelnen Domänen zeigt, dass wieso in privaten Gesprächen mit einer Auftretenshäufigkeit von 30 % deutlich häufiger verwendet wird (vgl. typisch gesprochensprachliche Strukturen in 7) als in institutionellen (17 %) oder öffentlichen Kontexten (5 %).

    1. (7)
    1. a.
    1. wieso bist du nich auf die goethe gekommen papa wieso nich au die goethe? (FOLK privat)
    1.  
    1. b.
    1. abwehr (.) schalke eins null ja – wieso nimmst du plötzlich die ganzen schalker (…). (FOLK privat)

Umgekehrt steigt der Anteil von weshalb und warum in formelleren Kommunikationssituationen an, vgl. (8). Ähnliche Werte zeigt das DH, in dem wieso 16 %, weshalb 1 % und warum 83 % ausmachen; hier sind unter anderem Lesesprache und vorbereitete Gesprächssituationen enthalten und somit ebenfalls formellere und schriftsprachennähere Strukturen vertreten.

    1. (8)
    1. a.
    1. un des war der grund weshalb ich damals gesagt hab ich gehe gerne arbeit ich mach meine arbeit auch. (FOLK institutionell)
    1.  
    1. b.
    1. ich frag mich halt eh warum bei so was irgendwie nich ne famillentherapie (…) angeordnet oder vorgeschlagen wird (…). (FOLK institutionell)

Insgesamt zeigt sich, dass weshalb vor allem in konzeptionell schriftlich geprägten, formellen Registern häufiger verwendet wird, während wieso mit zunehmender konzeptioneller Mündlichkeit an Bedeutung gewinnt; warum erweist sich in allen Korpora als die dominierende Form und wird unabhängig von Register und Nähe-Distanz-Kontinuum sehr häufig verwendet.

4.2 Verteilung von hoezo, waarom im Niederländischen

Für die Analyse der geschriebenen niederländischen Gegenwartssprache wurde auf das Corpus Hedendaags Nederlands (CHN) zurückgegriffen, das über die CLARIN-Plattform29 zugänglich ist30. Das CHN wird vom Instituut voor de Nederlandse Taal (INT) gepflegt und enthält moderne niederländische Texte, für die das INT die Online-Nutzungsrechte erworben hat.

Das Material stammt aus den Niederlanden, Flandern, Surinam und den Niederländischen Antillen und umfasst unter anderem Zeitungen, Zeitschriften, Nachrichtenbeiträge und juristische Texte. Ein besonderer Schwerpunkt liegt auf kontinuierlich aktualisierten Daten, insbesondere Zeitungsartikeln31. Insgesamt enthält das Korpus mehr als 3 Milliarden Tokens aus ca. 800.000 Texten und ist in mehrere Subkorpora unterteilt, die nach verschiedenen Kriterien, z.B. Medium, Sprache, Autor, gefiltert werden können; von diesen sind neben dem Gesamtkorpus folgende in die Analyse eingegangen (gefiltert nach Medium, vgl. Tabelle 6):

Tabelle 6

Überblick über die ausgewählten Subkorpora des CHN

Korpus (nach Medium) Anzahl Texte Anzahl Tokens Erhebungszeitraum Beschreibung
CHN Official Journal 939 4.747.614 2017-2022 Amtliche Veröffentlichungen
CHN Blog 3.522 1.291.668 2007-2025 k.A.
CHN Chat 2 29.930.488 2012 Marocchat, scarynet

Ergänzend wurde das Stevin Nederlandstalig Referentiecorpus (SoNaR) einbezogen, das ebenfalls vom INT betreut wird und über die CLARIN-Plattform zugänglich ist32. SoNaR stellt ein groß angelegtes Referenzkorpus zur geschriebenen niederländischen Gegenwartssprache dar und umfasst rund 540 Millionen Tokens aus Texten ab 195433. Das Korpus berücksichtigt 38 verschiedene Textsorten und ist so balanciert, dass es die europäischen niederländischsprachigen Regionen proportional abbildet, d.h. ein Drittel der Texte stammt aus Flandern, zwei Drittel aus den Niederlanden.

Neben klassischen geschriebensprachlichen Domänen wie Zeitungen, Zeitschriften, Berichten und institutionellen Publikationen enthält SoNaR auch Daten aus neueren Kommunikationsformen, darunter Chat-Protokolle, SMS, E-Mails und Forenbeiträge. Das Korpus ist in mehrere Subkorpora unterteilt, die nach unterschiedlichen Kriterien gefiltert werden können und strukturell den im CHN ausgewiesenen Kategorien entsprechen. In die Analyse sind neben dem Gesamtkorpus folgende Subkorpora eingegangen (vgl. Tabelle 7):

Tabelle 7

Überblick über die ausgewählten Subkorpora des SoNaR

Korpus (nach Kollektion) Anzahl Texte Anzahl Tokens Erhebungszeitraum Beschreibung
Legal texts 7.860 10.689.681 k.A. EU-Richtlinien, EU-Verord-nungen, EU-Beschlüsse u.a.
Policy documents 216 8.711.551 k.A. Politische Grund-satzpapiere, Plenarprotokolle
Wikipedia 124.124 23.001.184 k.A. Artikel der Website wikipedia.nl
SMS 218 723.876 k.A. Textnachrichten per SMS

Zur Untersuchung der gesprochenen Sprache wurde das Corpus Gesproken Nederlands (CGN) herangezogen, das ebenfalls über die CLARIN-Plattform zugänglich ist34. Das CGN wurde im Rahmen eines Projekts von 1998 bis 2003 aufgebaut und enthält rund 1.000 Stunden an Sprachaufnahmen, was etwa 10 Millionen Wörtern entspricht (vgl. Schuurman et al. 2003). Es dokumentiert Äußerungen von erwachsenen L1-Nutzer/-innen aus den niederländischen Standardvarietäten, wobei – entsprechend der regionalen Bevölkerungsverteilung – ca. zwei Drittel der Aufnahmen aus dem Norden und ein Drittel aus dem Süden des Sprachraums stammen. Das Korpus enthält sowohl spontane als auch vorbereitete Sprachdaten und ist mit verschiedenen Transkriptionsformen, syntaktischen Annotationen und POS-Tags versehen35. Darüber hinaus werden Metadaten, lexikalische Ressourcen und Häufigkeitslisten bereitgestellt. Für die Analyse wurden neben dem Gesamtkorpus folgende Subkorpora verwendet (vgl. Tabelle 8):

Tabelle 8

Überblick über die ausgewählten Subkorpora des CGN.

Korpus (nach Kollektion) Anzahl Texte Anzahl Tokens Erhebungszeitraum Beschreibung
Lectures and seminars 78 149.099 1999, 2002 Transkripte von Vorträgen und Seminaren
Interviews and discussions (broadcast) 642 866.482 1998-2001 Transkripte von öffentlichen Interviews und Diskussionen
Spontaneous conversations, face-to-face 1.537 3.063.803 1999-2003 Transkripte von informellen, spontanen Gesprächen zwischen Personen im direkten Kontakt

Im Folgenden wird die Verteilung der niederländischen Fragewörter hoezo und waarom in den ausgewählten Korpora dargestellt. Eine Übersichtstabelle gibt zunächst die absoluten und relativen Häufigkeiten wieder (vgl. Tabellen 9 und 10); dabei werden Groß- und Kleinschreibung zusammengefasst. Die anschließende Analyse richtet den Blick auf Unterschiede zwischen konzeptionell schriftlich und konzeptionell mündlich geprägten Kommunikationsformen sowie auf auffällige Verteilungsmuster und Besonderheiten innerhalb der einzelnen Subkorpora.

Geschriebensprachliche Korpora:

Tabelle 9

Übersicht der absoluten und relativen Auftretenshäufigkeit von hoezo, waarom (klein- und großgeschriebene Varianten) in den aufgeführten geschriebensprachlichen Korpora

Korpus hoezo waarom
CHN (gesamt) 18.594 / 2 % 866.061 / 98 %
CHN Official Journal 0 / 0 % 453 / 100 %
CHN Blog 10 / 2 % 453 / 98 %
CHN Chat 2.108 / 15 % 12.222 / 85 %
SoNaR (gesamt) 8.627 / 4 % 191.839 / 96 %
SoNaR Legal texts 0 / 0 % 176 / 100 %
SoNaR Policy documents 2 / 0 % 2.408 / 100 %
SoNaR Wikipedia 7 / 1 % 722 / 99 %
SoNaR SMS 30 / 14 % 186 / 86 %

Gesprochensprachliche Korpora:

Tabelle 10

Übersicht der absoluten und relativen Auftretenshäufigkeit von hoezo, waarom (klein- und großgeschriebene Varianten) in den aufgeführten gesprochensprachlichen Korpora

Korpus hoezo waarom
CGN (gesamt) 567 / 12 % 3.981 / 88 %
CGN Lectures and seminars 0 / 0 % 82 / 100 %
CGN Interviews and discussions (broadcast) 21 / 4 % 469 / 96 %
CGN Spontaneous conversations, face-to-face 275 / 19 % 1.161 / 81 %

Im Ergebnis zeigt sich, dass waarom in allen untersuchten Korpora, sowohl geschrieben- als auch gesprochensprachlich, die eindeutig dominierende Frageform ist, während hoezo über alle Korpora hinweg deutlich seltener auftritt. So entfallen im geschriebensprachlichen CHN-Gesamtkorpus 98 % der Belege auf waarom, während hoezo nur zu 2 % vertreten ist. Im SoNaR-Korpus erreicht waarom 96 % und hoezo 4 %. Im Vergleich dazu steigt in den gesprochenen Daten des CGN die relative Auftretenshäufigkeit von hoezo auf 12 % merklich an, waarom bleibt mit 88 % aber weiterhin die massiv frequenter auftretende Form.

Trotz dieser klaren Gesamtpräferenz zeigen die Subkorpora deutliche Unterschiede, die auf eine differenzierte Nutzung in Abhängigkeit von Register und konzeptioneller Ausrichtung hinweisen. In stark formellen, geschriebensprachlich standardisierten Registern wie amtlichen Veröffentlichungen, juristischen Texten oder Policy-Dokumenten liegt der Anteil von waarom durchgängig bei 100 %, vgl. (9a-b). Hoezo kommt lediglich in zwei Belegen vor und hat somit keinen Einfluss auf das Gesamtbild. Auch in weniger streng formellen, aber weiterhin stark geschriebensprachlich geprägten Kontexten, etwa im SoNaR-Wikipedia-Korpus oder im CHN-Blog, bleibt waarom mit 99 bzw. 98 % Auftretenshäufigkeit die klar bevorzugte Form (vgl. 9c-d). Diese Verteilung deutet darauf hin, dass waarom in Registern, die formell und konzeptionell schriftlich geprägt sowie durch referenzielle Distanz gekennzeichnet sind, beinahe exklusiv auftritt, während hoezo nur in minimalem Umfang verwendet wird.

    1. (9)
    1. a.
    1. Een lidstaat (…) dient daartoe een aanvraag in bij de Commissie waarin hij verklaart waarom naar zijn mening aan de in artikel 17, lid 2, vastgestelde voorwaarden wordt voldaan. (Legal texts)
    2. Ein Mitgliedsstaat reicht dafür einen Antrag bei der Kommission ein, in dem er erklärt, warum seiner Ansicht nach die in Artikel 17 Absatz 2 genannten Voraussetzungen erfüllt werden.
    1.  
    1. b.
    1. De aanvrager wordt binnen 30 dagen (…) in kennis gesteld van het besluit tot afgifte van een vergunning of van de redenen waarom de aanvraag werd afgewezen. (Policy documents)
    2. Der Antragsteller wird innerhalb von 30 Tagen über den Beschluss zur Erteilung einer Genehmigung oder über die Gründe zur Ablehnung des Antrags informiert. (… warum der Antrag abgewiesen wurde)
    1.  
    1. c.
    1. Waarom Yilmaz tot moord overging, weet niemand, na 22 jaar nog niet. (Wikipedia)
    2. Warum Yilmaz zum Mord überging, weiß niemand, auch nach 22 Jahren noch nicht.
    1.  
    1. d.
    1. In een studentenstad als Leuven zijn er uiteraard heel wat verschillende boekwinkels te vinden. Wat is jullie favoriete Leuvense boekwinkel en waarom? (Blog)
    2. In einer Studentenstadt wie Leuven gibt es natürlich viele verschiedene Buchhandlungen. Welche ist eure Lieblingsbuchhandlung von Leuven und warum?

Ein ähnliches Muster zeigt sich in vorbereiteten mündlichen Kontexten mit hohem konzeptionell schriftlichem Anteil, etwa in Vorträgen und Seminaren des CGN, die durch Strukturierung, geringe Spontaneität und Monologizität (vgl. Koch / Oesterreicher 2008: 201) gekennzeichnet sind. Hier wird ausschließlich waarom verwendet (vgl. 10a-b). Und auch in Interviews und Diskussionen (CGN broadcast) liegt der Anteil von waarom mit 96 % deutlich über dem von hoezo mit nur 4 % (vgl. 10c).

    1. (10)
    1. a.
    1. alles wordt ethisch bekeken en waarom? omdat de mens waarschijnlijk beseft dat hij zonder ethische codes niet kan leven zonder afspraken niet kan leven. (CGN Lectures and seminars)
    2. Alles wird unter ethischen Gesichtspunkten betrachtet, und warum? Wahrscheinlich weil der Mensch erkennt, dass er ohne ethische Grundsätze nicht leben kann, ohne Vereinbarungen nicht leben kann.
    1.  
    1. b.
    1. tweede vraag. waarom is Al (…) Teofiel Van Dijck in die auto blijven zitten? een wet van de bergbeklimmers is never alone nooit (…) in uw eentje gaan klimmen. (CGN Lectures and seminars)
    2. Zweite Frage: Warum blieb Al (…) Teofiel Van Dijck in diesem Auto sitzen? Ein Gesetz der Bergsteiger ist: Never alone, klettere niemals alleine.
    1.  
    1. c.
    1. Maar waardevol zijn ze [landgoederen]. En dat is ook trouwens de reden waarom ze ook ontstaan zijn hè. (CGN Lectures and seminars)
    2. Aber wertvoll sind sie (die Landgüter). Und das ist übrigens auch der Grund, warum sie überhaupt entstanden sind.

Im Vergleich dazu zeigt sich in informelleren, stärker konzeptionell mündlich geprägten Kommunikationsformen eine geänderte Verteilung. In Chats und SMS, die von spontanen Reaktionen und einer hohen Vertrautheit der Kommunikationspartner geprägt sind, steigt der Anteil von hoezo auffällig an: So entfallen im CHN-Chatkorpus 15 % der Belege auf hoezo (vgl. 11a), im SoNaR-Korpus-SMS 14 % (vgl. 11b).

    1. (11)
    1. a.
    1. bespreek da eens prive graag :) (…) – hoezo prive? (Chat)
    2. Besprecht das mal gerne privat. :) (…) – Wieso privat?
    1.  
    1. b.
    1. Ee liger nog in – Hoezo? – Te weinig reden om eruit te komen :P (SMS)
    2. (Nee?,) ich liege noch drin. – Wieso? – Zu wenige Gründe, um rauszukommen.

In spontanen face-to-face-Gesprächen des CGN, die sich zusätzlich durch eine unmittelbare räumlich-zeitliche Nähe auszeichnen (vgl. Koch / Oesterreicher 2008: 201), setzt sich dieser Trend fort, indem hoezo dort eine Auftretenshäufigkeit von 19 % erreicht und damit deutlich häufiger vertreten ist als in den formellen Subkorpora. In diesen Kontexten sinkt der Anteil von waarom entsprechend auf 81 bis 85 % zugunsten von hoezo, vgl. (12).

    1. (12)
    1. a.
    1. had had je 'm [een corsage] naar mij moeten sturen. – hoezo? (CGN Sponta-neous conversations, face-to-face)
    2. Du hättest sie [die Korsage] mir schicken sollen. – Wieso?
    1.  
    1. b.
    1. oh ja Moskou was er ook nog. ik wil in ieder geval ook naar de Love Parade weer. – hoezo gaat Moskou niet meer door? (CGN Spontaneous conversations, face-to-face)
    2. Ach ja, Moskau stand ja auch noch auf dem Programm. Ich will auf jeden Fall auch wieder zur Love Parade. – Wieso findet Moskau nicht mehr statt?

Zusammenfassend wird deutlich, dass waarom in allen untersuchten Korpora die stark dominante Frageform darstellt, während hoezo mit zunehmender konzeptioneller Mündlichkeit häufiger (wenn auch weiterhin gegenüber waarom zu deutlich geringeren Anteilen) verwendet wird; in stark konzeptionell schriftlich geprägten Kontexten tritt hoezo hingegen nahezu gar nicht auf.

4.3 Vergleich der einzelsprachlichen Ergebnisse

Im Vergleich der beiden Sprachen zeigt sich insgesamt ein ähnliches Grundmuster: Die kognaten Fragewörter warum bzw. waarom stellen in allen untersuchten Korpora die dominierenden Formen dar. Dagegen variiert die Verwendung von weshalb und wieso bzw. hoezo in Abhängigkeit von Register und Medium (vgl. Koch / Oesterreicher 2008). Weshalb tritt bevorzugt in formellen Registern und konzeptionell schriftlichen Kommunikationsformen auf, z.B. in Fachsprachenkorpora oder Gesetzestexten, während wieso in diesen Bereichen kaum Verwendung findet. Im Wikipedia-Korpus tritt weshalb sogar häufiger als warum auf. Dies legt nahe, dass weshalb in formeller, präziser Sprache, etwa hier in einer Enzyklopädie, als besonders geeignet erachtet wird. Analog dazu bleibt im Niederländischen hoezo in vergleichbaren, eher formellen Kontexten nahezu ungenutzt.

Mit abnehmendem Formalitätsgrad und zunehmendem Mündlichkeitsgrad verschiebt sich das Verhältnis zugunsten von wieso, das verstärkt in Blogs, Belletristik und Trivialliteratur sowie in der Kinder- und Jugendliteratur verwendet wird. In noch mündlichkeitsnäheren Kommunikationsformen und in gesprochener Sprache, etwa in privaten Gesprächen oder Chats, ist der Anteil von wieso noch höher. Für das Niederländische zeigt sich ein vergleichbares Muster: Hoezo wird mit zunehmender konzeptioneller Mündlichkeit häufiger verwendet, während in formellen, konzeptionell schriftlichen Kommunikationsformen nahezu ausschließlich waarom verwendet wird. Die Kognaten wieso und hoezo haben somit in konzeptionell mündlichen Korpora der Schriftlichkeit (Chat-Sprache) und in spontaner gesprochener Sprache ihre wesentliche Domäne. Sie können damit, unabhängig von ihrer jeweiligen semantischen oder diskurspragmatischen Funktion, als Marker eines informellen Stils in konzeptuell mündlicher Sprache angesehen werden.

5. Fazit und Ausblick

Der vorliegende Artikel hatte zum Ziel, die kausalen Fragewörter dt. wieso, weshalb, warum und nl. hoezo, waarom aus einer variationslinguistischen Perspektive kontrastiv zu untersuchen. Dabei stand die Frage im Mittelpunkt, wie sich die einzelnen Varianten in Abhängigkeit von Register, Formalitätsgrad sowie konzeptioneller Schriftlichkeit und Mündlichkeit verteilen. Zur Bearbeitung dieser Fragestellung wurden verschiedene geschrieben- und gesprochensprachliche Korpora des Deutschen und des Niederländischen ausgewertet, um die Verteilung der Fragewörter systematisch zu erfassen. Insgesamt lassen sich dabei für beide Sprachen ähnliche funktionale Muster feststellen: Die kognaten Fragewörter warum/waarom bilden die dominierende, stilneutrale Form, weshalb tritt vor allem in formellen, geschriebensprachlich geprägten Kontexten auf und die kognaten Fragewörter wieso/hoezo fungieren mit abnehmendem Formalitätsgrad und zunehmender Mündlichkeit als Marker eines informellen Stils.

Auch wenn die Verteilung bezüglich der untersuchten Faktoren insgesamt aufschlussreiche Variation aufzeigt, gilt es zu berücksichtigen, dass die vorliegende Untersuchung ausschließlich die Auftretenshäufigkeit der einzelnen Fragewörter im Ganzen erfasst. Unberücksichtigt bleibt somit unter anderem, in welchem Umfang die Formen jeweils z.B. direkte und indirekte Interrogativsätze, Relativsätze oder (im Falle von weshalb) weiterführende Relativsätze einleiten.

Als Desiderat muss an dieser Stelle auch eine funktionale Analyse des Gebrauchs der Fragewörter im Kontrast verbleiben. Erste Einblicke anhand qualitativer Analysen deuten jedoch darauf hin, dass sich Elemente der von Rullmann / Nederveen (vgl. 2024) beschriebenen Primärfunktion von hoezo als Diskursmarker auch für dt. wieso vorfinden lassen, zumindest im Sinne einer höheren Nutzung in expressiven Kontexten und einem stark am Dialog orientierten Gebrauch, vgl. etwa „Hast du schlechte Laune?“ (…) – „Nein! Wieso?“ (Archiv W, Korpus Berliner Morgenzeitung, L08/APR) oder „Ist das eine Belastung?“ – „Wieso denn? Ich hab das damals ja freiwillig gemacht und stehe dazu“ (Archiv W, Korpus Süddeutsche Zeitung 2002, U02/NOV). Gleichzeitig scheint im Deutschen eine vergleichbare Nutzung auch mit warum möglich zu sein (z.B. in „Was soll das Ganze? Warum ich? Wo bleibt die Perspektive?“ (Archiv W, Korpus Tages-Anzeiger 2009, E09/MAR)), wieso wird also nicht prioritär für diese Funktion gebraucht (und ist auch nicht auf diese beschränkt). Auch hier deutet sich also eine Multifunktionalität und Stilneutralität von warum und im Vergleich zum Niederländischen eine größere Toleranz für Funktionsteilungen zwischen den Fragewörtern im Deutschen an. Zur genaueren Untersuchung funktionaler Parallelen und Divergenzen sollten künftig qualitative Korpusstudien durchgeführt werden, die sich der Nutzung der Varianten in Abhängigkeit vom jeweiligen Kontext widmen.

Notes

  1. So nutzen auch Köpcke / Ziegler (2011) die Titelzeilen: „Der, die, das – Wer, wie, was – Wieso, weshalb, warum? Wer nicht fragt, bleibt dumm“ als Titel ihres einleitenden Beitrags zu einem Sammelband zur Grammatik-Didaktik und verwenden das Dreierpaar an kausalen Frageadverbien in einem ersten Kapitel, um den „didaktischen Impuls“ (ebd.: 3) des Bandes zu unterstreichen. [^]
  2. Vgl. etwa das Principle of Contrast: „Speakers take every difference in forms to mark a difference in meaning“ (Clark 1993: 64). Ein Hinweis darauf, dass das Dreierpaar in dieser Hinsicht auffällt, besteht in Presseanfragen, die uns 2024 und 2025 zu dieser Frage erreichten. [^]
  3. Vgl. https://www.dwds.de/wb/etymwb/wieso (01.07.2026). [^]
  4. Vgl. https://woerterbuchnetz.de/?sigle=DWB&lemid=W20734 (01.07.2026). [^]
  5. Vgl. https://woerterbuchnetz.de/?sigle=DWB&lemid=W18237 (01.07.2026). [^]
  6. Vgl. https://www.dwds.de/wb/etymwb/warum (01.07.2026); https://www.degruyterbrill.com/database/kluge/entry/kluge.12237/html (01.07.2026). [^]
  7. Vgl. https://www.dwds.de/wb/wieso (01.07.2026); https://www.dwds.de/wb/weshalb (01.07.2026); https://www.dwds.de/wb/warum (01.07.2026). [^]
  8. Vgl. https://grammis.ids-mannheim.de/systematische-grammatik/2093 (01.07.2026). [^]
  9. Eine im grammis eingegangene Anfrage zur möglichen Unterscheidung der Formen wieso, weshalb, warum ist bislang unbeantwortet geblieben. Vgl. https://grammis.ids-mannheim.de/fragen/135 (01.07.2026). [^]
  10. Vgl. https://www.dwds.de/wb/weshalb (01.07.2026). [^]
  11. Vgl. https://grammis.ids-mannheim.de/konnektoren/407106 (01.07.2026). [^]
  12. Vgl. https://www.dwds.de/wb/weshalb (01.07.2026). [^]
  13. Der Unterschied zwischen den Anlauten h- und w- zwischen hoe und waar ergibt sich, da im Nl. bei germ. anlautendem *hw- vor gerundeten Vokalen w schwand, wohingegen vor ungerundeten Vokalen wie bei waar h schwand (vgl. https://www.ensie.nl/etymologisch-woordenboek/hoe (01.07.2026)). Im Deutschen schwand in beiden Fällen h. [^]
  14. Vgl. https://gtb.ivdnt.org/iWDB/search?wdb=WNT&actie=article&uitvoer=HTML&id=M089691 (01.07. 2026). [^]
  15. Vgl. https://gtb.ivdnt.org/iWDB/search?actie=article&wdb=VMNW&id=ID20342&lemmodern=waarom (01.07.2026). [^]
  16. Vor diesem Hintergrund überrascht es, dass die Fragewörter von den gängigen Grammatiken des Niederländischen weitgehend ignoriert werden, wie auch Rullmann / Nederveen (2024: 1-2) feststellen. So wird etwa das Wort hoezo in der gesamten Referenzgrammatik zum Gegenwartsniederländischen, der ANS (2021), nicht erwähnt. [^]
  17. Vgl. https://www.ensie.nl/betekenis/waarom (01.07.2026). [^]
  18. Vgl. https://anw.ivdnt.org/article/hoezo (01.07.2026). [^]
  19. Vgl. https://nl.wiktionary.org/wiki/hoezo (01.07.2026). [^]
  20. Vgl. https://onzetaal.nl/taalloket/hoezo-waarom (01.07.2026). [^]
  21. Vgl. https://www.ids-mannheim.de/digspra/pb-s1/projekte/korpora/ (01.07.2026). [^]
  22. Vgl. https://www2.ids-mannheim.de/cosmas2/projekt/referenz/dokutexte.html (01.07.2026). [^]
  23. Vgl. https://www2.ids-mannheim.de/cosmas2/projekt/referenz/archive.html (01.07.2026). [^]
  24. Vgl. https://www.dwds.de/d/korpora (01.07.2026). [^]
  25. Vgl. https://agd.ids-mannheim.de/korpus_index.shtml (01.07.2026). [^]
  26. Aufgrund der deutlich ausfallenden Werte lassen sich klare registerspezifische Tendenzen bereits deskriptiv erkennen, ohne dass eine inferenzstatistische Modellierung erforderlich ist, auf die – auch im Sinne des explorativen Charakters der Studie – daher verzichtet wird. Dies gilt auch für die folgenden Auswertungen. [^]
  27. In einem Gutachten wurde vorgeschlagen, auch Beispiele zu nennen, in denen jeweils eines der kausalen w-Wörter dispräferiert oder weniger angemessen wäre. Dies lässt sich anhand der Korpusbeispiele leider kaum vornehmen, da grundsätzlich nie ganz klar eines der Wörter ausgeschlossen werden kann, sondern lediglich Wahrscheinlichkeiten für das Auftreten einzelner Elemente variieren. Für eine Darstellung der genannten Art wäre eine andere, etwa auf Befragung oder Experiment basierende Erhebungsmethode notwendig. [^]
  28. Die Daten deuten zudem darauf hin, dass weshalb in vielen Fällen nicht kausale Nebensätze einleitet, sondern weiterführende Relativsätze. Diese ersten Beobachtungen sollten in weiteren korpusgestützten Studien näher untersucht werden. [^]
  29. CLARIN (Common Language Resources and Technology Infrastructure) ist eine europäische Forschungsinfrastruktur, die darauf abzielt, Sprachressourcen und Sprachtechnologien für die Geistes- und Sozialwissenschaften dauerhaft, interoperabel und für Forschende zugänglich zu machen. Vgl. https://www.clarin.eu (01.07.2026). [^]
  30. Vgl. https://chn.ivdnt.org/ (01.07.2026). [^]
  31. Vgl. https://corpora.ato.ivdnt.org/blacklab-frontend/ACTER_2/static/files/manual.pdf (01.07.2026). [^]
  32. Vgl. https://opensonar.ivdnt.org/ (01.07.2026). [^]
  33. Vgl. https://www.lt3.ugent.be/projects/sonar/ (01.07.2026). [^]
  34. Vgl. https://opensonar.ivdnt.org/ (01.07.2026). [^]
  35. Vgl. https://taalmaterialen.ivdnt.org/download/tstc-corpus-gesproken-nederlands/ (01.07.2026). [^]

Literatur und Ressourcen

ANS (2021): Algemene Nederlandse Spraakkunst. 3. Online-Auflage, ANS3, Version 3.1.1. https://e-ans.ivdnt.org (01.07.2026).

Breindl, Eva / Volodina, Anna / Waßner, Ulrich Hermann (2014): Handbuch der deutschen Konnektoren 2. Semantik der deutschen Satzverknüpfer. Berlin / München / Boston: de Gruyter.

CGN: Corpus Gesproken Nederlands. https://opensonar.ivdnt.org/ (01.07.2026).

CHN: Corpus Hedendaags Nederlands. https://chn.ivdnt.org/ (01.07.2026).

Clark, Eve V. (1993): The lexicon in acquisition. Cambridge: Cambridge University Press.

DeReKo: Das Deutsche Referenzkorpus. http://www.ids-mannheim.de/kl/projekte/korpora/ (01.07.2026).

DGD: Datenbank für Gesprochenes Deutsch. http://dgd.ids-mannheim.de (01.07.2026).

Duden 2016 = Wöllstein, Angelika / Dudenredaktion (Hrsg.) (2016): Duden. Die Grammatik: Unentbehrlich für richtiges Deutsch (9., vollständig überarbeitete und aktualisierte Auflage). Berlin: Dudenverlag.

Duden 2022 = Wöllstein, Angelika / Dudenredaktion (Hrsg.) (2022): Duden – Die Grammatik: Struktur und Verwendung der deutschen Sprache: Sätze - Wortgruppe - Wort (10., völlig neu verfasste Auflage). Berlin: Dudenverlag.

DWDS: Digitales Wörterbuch der deutschen Sprache. https://www.dwds.de/ (01.07.2026).

Egbert, Maria / Vöge, Monika (2008): Wh-interrogative formats used for questioning and beyond: German warum (why) and wieso (why) and English why. In: Discourse Studies 10: 1, 17-36.

Eisenberg, Peter (2020): Grundriss der deutschen Grammatik. Der Satz. Stuttgart: J. B. Metzler.

Gallmann, Peter (1997): Zu Morphosyntax und Lexik der w-Wörter. Tübingen: Universität Tübingen (= Arbeitspapiere des Sonderforschungsbereichs 340, Sprachtheoretische Grundlagen für die Computerlinguistik, Bericht 107).

Koch, Peter / Oesterreicher, Wulf (2008): Mündlichkeit und Schriftlichkeit von Texten. In: Janich, Nina (Hrsg.): Textlinguistik. 15 Einführungen. Tübingen: Narr (= Narr Studienbücher), 199-215.

Köpcke, Klaus-Michael / Ziegler, Arne (2011): Der, die, das – Wer, wie, was – Wieso, weshalb, warum? Wer nicht fragt, bleibt dumm. In: Köpcke, Klaus-Michael / Ziegler, Arne (Hrsg.): Grammatik – Lehren, Lernen, Verstehen. Zugänge zur Grammatik des Gegenwartsdeutschen. Berlin / Boston: de Gruyter, 3-13.

Kupietz, Marc / Lüngen, Harald / Diewald, Niels (2023): Das Gesamtkonzept des Deutschen Referenzkorpus DEREKO. Vom Design bis zur Verwendung und darüber hinaus. In: Deppermann, Arnulf / Fandrych, Christian / Kupietz, Marc / Schmidt, Thomas (Hrsg): Korpora in der germanistischen Sprachwissenschaft. Mündlich, schriftlich, multimedial. Berlin / Boston: de Gruyter, 1-28.

Rullmann, Hotze / Nederveen, Sander (2024): A wh discourse particle: Dutch hoezo. In: Proceedings of the Linguistic Society of America 9: 1, 5683.

Schmidt, Thomas (2017): DGD – Die Datenbank für Gesprochenes Deutsch. Mündliche Korpora am Institut für Deutsche Sprache (IDS) in Mannheim. In: Zeitschrift für germanistische Linguistik 45: 3, 451-463.

Schuurman, Ineke / Schouppe, Machteld, Hoekstra, Heleen / van der Wouden, Ton (2003): CGN, an annotated corpus of spoken Dutch. In: Proceedings of 4th International Workshop on Linguistically Interpreted Corpora (LINC-03) at EACL 2003, 101-108.

SoNaR: Stevin Nederlandstalig Referentie corpus. https://opensonar.ivdnt.org/ (01.07.2026).

Van Dale (1996): Handwoordenboek van hedendaags Nederlands (2. Auflage). Utrecht / Antwerpen: van Dale.

Volodina, Anna (2021): „Wieso“ und nicht „Warum“! Von der Theorie zur Analyse kausaler Fragen in der Lehrer-Schüler-Interaktion. In: Schicker, Stephan / Schmölzer-Eibinger, Sabine (Hrsg.): ar|gu|men|tie|ren. Eine zentrale Sprachhandlung im Fach- und Sachunterricht. Weinheim / Basel: Beltz Juventa, 48-66.

Wahrig 2006 = Wahrig-Burfeind, Renate (Hrsg.): Wahrig. Deutsches Wörterbuch. Gütersloh / München: Wissen Media Verlag GmbH.

Zifonun, Gisela / Hoffmann, Ludger / Strecker, Bruno (1997): Grammatik der deutschen Sprache. Band 3 (Schriften des Instituts für Deutsche Sprache Band 7.3). Berlin / New York: de Gruyter.

Biographische Notiz

Kerstin Dierolf ist wissenschaftliche Mitarbeiterin am Lehrstuhl für Deutsche Sprachwissenschaft an der Katholischen Universität Eichstätt-Ingolstadt. In ihrer Promotion hat sie sich mit der Verstehbarkeit der historischen Sprachstufen des Deutschen beschäftigt. Ihre Forschungsschwerpunkte sind Verstehbarkeit nah verwandter Sprachen und Varietäten sowie Deutsch in Brasilien.

Kontaktanschrift:

Kerstin Dierolf

Katholische Universität Eichstätt-Ingolstadt

Universitätsallee 1

85072 Eichstätt

kerstin.dierolf@ku.de

Biographische Notiz

Sebastian Kürschner ist Professor für Deutsche Sprachwissenschaft an der Katholischen Universität Eichstätt-Ingolstadt. Zu seinen Forschungsschwerpunkten gehören Variationslinguistik, Sprachwandel- und -kontaktforschung, u. a. anhand der vergleichenden Untersuchung germanischer Sprachen, der historischen Morphologie, der Verstehbarkeit nah verwandter Varietäten, deutscher Sprachminderheiten in Brasilien und der Namenkunde.

Kontaktanschrift:

Sebastian Kürschner

Katholische Universität Eichstätt-Ingolstadt

Universitätsallee 1

85072 Eichstätt

sebastian.kuerschner@ku.de