Sprachqualität · Language Quality Overview

← Zurück zur Startseite · Back to start

Ehrlicher, automatisch aus dem tatsächlichen Dateibestand generierter Vollständigkeits-Bericht über jede Sprache im HSK-Reader — über alle 19 Lektionen hinweg: Textabdeckung (Vokabeln/Dialog/Beispielsätze), Vers-Audio, Wort-Lauflicht, UI-/Grammatik-/Lexikon-Pakete und sprachübergreifendes Wort-Alignment. Dieselbe Prüfung gilt unverändert für jede künftig hinzugefügte Sprache — eine Sprache zählt erst als „vollständig ausgebaut“, wenn diese Seite 100% zeigt.
Honest, automatically generated completeness report for every language in the HSK reader — across all 18 lessons: text coverage (vocabulary/dialogue/examples), verse audio, word-highlighting, UI/grammar/lexicon packs, and cross-language word alignment. The same check applies unchanged to every future language — a language only counts as "fully built out" once this page shows 100%.

vollständig · complete begonnen, Lücken · started, gaps nicht begonnen · not started

Sprache · Language Stand · Status UI-Paket · UI pack Grammatik · Grammar Konjugation · Conjugation Schrift-IPA · Script IPA Lexikon · Lexicon Vokabeln ⌀ · Vocab avg Dialog ⌀ · Dialogue avg Beispiele ⌀ · Examples avg Vers-Audio · Verse audio Lauflicht · Timing Alignment ⌀ Grammatik ⌀ · POS avg Übungen · Exercises Audio-Integrität · Audio integrity Zertifiziert ⌀ · Certified avg

Konjugations-Abdeckung · Conjugation drill coverage (studium/vendor/grammarGenerationRegistry.v1.js)

Zusatz-Übungstyp im Übungs-Hub ("🔄 Konjugation"): wandelt Lexikon-Grundformen in geprüft korrekte Flexionsantworten um. Kein Hart-Kriterium für „vollständig ausgebaut" (informativ, wie Schrift-IPA/ Zertifizierung) — aber diese Liste macht auf einen Blick sichtbar, für welche Sprachen noch kein Generierungsmodul existiert.
Extra exercise type in the exercise hub ("🔄 Conjugation"): turns lexicon citation forms into verified- correct inflected answers. Not a hard criterion for "fully built" (informative, like script IPA/ certification) — but this list makes it immediately visible which languages still lack a generation module.

Sprache · Language Code Stand · Status

Noch fehlende Schriften · Scripts not yet built ("beliebiger Donor"-Kandidatenliste, docs/REMAINING_SCRIPTS_POLICY.md)

Skript-Code Sprache/Volk Typ Status

Skript-CodeNameGrund der Zurückstellung

Skript-CodeNameBegründung

Bewusst dauerhaft ausgeschlossen (unabhängig von der Donor-Politik):

Skript-CodeGrund

Lektion × Sprache · Lesson × language matrix

Kombinierte Textabdeckung (Vokabeln+Dialog+Beispiele gemittelt) je Lektion und Sprache — auf einen Blick erkennbar, ob wirklich jede Lektion für jede Sprache gleich weit ausgebaut ist, nicht nur im Sprachdurchschnitt.
Combined text coverage (vocab+dialogue+examples averaged) per lesson and language — shows at a glance whether every lesson is equally built out for every language, not just on average.

Lektion · Lesson

Grammatik nach Konzept · Grammar by concept (32 A1-Konzepte × alle Sprachen mit Grammatik-Paket)

„Grammatik · Grammar" oben zeigt je Sprache nur eine Zahl (Konzeptanzahl gegen 32) — das verdeckt, OB es wirklich dieselben 32 Konzepte sind. Diese Tabelle gleicht jedes der 32 kanonischen A1-Konzepte (studium/data/grammar/grammarFunctionMapA1.U32.master.js) gegen die tatsächlich verwendete Konzept-ID jeder Sprache ab: exakt = identische ID, abweichend = gleiches Konzept (gleiches Nummern-Präfix), aber andere ID — Datenpflege-Hinweis, kein Fehler —, kein Treffer = Sprache hat ein Grammatik-Paket, aber nichts mit passendem Präfix. Zeiger auf Zell-Zahlen zeigen die betroffenen Sprachcodes.
"Grammatik · Grammar" above shows only a count per language (against 32) — that hides WHETHER these are really the same 32 concepts. This table cross-checks each of the 32 canonical A1 concepts against the ID each language actually uses: exact = identical ID, drift = same concept (same number prefix) but a different ID — a data-maintenance note, not a bug —, no match = language has a grammar pack but nothing with a matching prefix. Hover a count to see the affected language codes.

Konzept · Concept Exakt · Exact Abweichend · Drift Kein Treffer · No match Abdeckung · Coverage

Vokabeltrainer · Core Vocabulary Trainer (858 A0–A2-Wörter, separates Modul)

Der Kernwortschatz-Trainer (studium/coreVocab.html) ist ein vom 19-Lektionen-Kurs unabhängiges Zusatzmodul mit einem eigenen 858-Wörter-Datensatz je Sprache. Eine Sprache erscheint dort nur, wenn coreLexiconPack in languages.json gesetzt ist und die Datei vorhanden ist — ohne stillen Fallback. Diese Tabelle macht sichtbar, welche Sprachen aus dem Hauptkurs hier (noch) fehlen.
The core-vocabulary trainer is a separate add-on module with its own 858-word dataset per language. A language only appears there once coreLexiconPack is set and the file exists — no silent fallback. This table makes visible which course languages are (still) missing here.

Sprache · Language Vorhanden · Present Einträge · Entries Audio-Sprites · Audio sprites Stichprobe · Sample check

Visuelles Lernen · Visual Learning module (27 eigenständige Übungsseiten, portiert aus Sprechnetz_designer_v6, separates Modul)

Das Visuelles-Lernlabor (studium/visuelles_lernen/, Einstieg über studium/visuelles_lernen/ergebnisse.html) ist ein vom 19-Lektionen-Kurs unabhängiges Zusatzmodul mit 27 eigenständigen Übungsseiten (Bild-Wort-Karten, Minimalpaar-Hörtrainer, Dialog-Trainer, Mundbild-/Visem-Trainer u. v. m.), portiert aus Sprechnetz_designer_v6/visuelles_lernen/. Es zieht seine Daten aus neun Dateien je Sprache (coreVocabulary, minimal_pairs, phonology.core, script.core, learn_dialogues, learn_exercises, learn_vocab_themes, learn_ui, grammar_comparison) plus den eigenen UI-Strings (learn_visual_ui). Vier weitere Dateien (learn_shapes, learn_calendar, learn_dialogue_lines, coreVocabulary.gender) werden nur von einzelnen Übungsseiten gebraucht (Farben/Formen, Kalender, Dialogzeilen, Artikel/Kasus) — ohne sie zeigt nur die jeweilige Seite „nicht verfügbar", der Rest des Moduls bleibt unberührt (Spalte „Einzelseiten-Zusatzdateien" unten). Wort-Audio kommt aus dem bereits vorhandenen coreVocabulary-Sprite (studium/audio_sprites/core/<lang>/, per edge-tts erzeugt in Sprechnetz_designer_v6), verdrahtet über studium/visuelles_lernen/ui/_visualAudioBridge.v1.js — echte Aufnahme bei Textübereinstimmung, sonst automatischer Browser-TTS-Fallback (kein Absturz, kein stummer Fehler). Sprache apc hat kein coreVocabulary und bleibt daher ohne Audiostichprobe.
The visual-learning lab is a separate add-on module with 27 standalone exercise pages, ported from Sprechnetz_designer_v6/visuelles_lernen/. It draws its data from nine files per language plus its own UI strings. Word audio comes from the already-existing coreVocabulary sprite, wired through _visualAudioBridge.v1.js — a real recording on text match, otherwise an automatic browser-TTS fallback.

Sprache · Language Datendateien · Data files UI-Strings · Visual UI Einzelseiten-Zusatzdateien · Per-page extras Wort-Audio-Stichprobe · Word audio sample

Multidomain-Daten · Länder, Sprachen, Schriften, Kultur (Wikidata-Import, separates Modul)

Geografie-/Kultur-/Länderprofil-Erweiterung (studium/data/multidomain/, hinter dem Feature-Flag multidomainContentV10), unabhängig vom 19-Lektionen-Kurs. Länderfakten (Bevölkerung, Hauptstadt, Amtssprachen) stammen live von Wikidata (CC0); Kultur-Aussagen sind belegte Behauptungen mit sichtbarer Konfidenz und Quelle, keine universellen Fakten.
Geography/culture/country-profile extension, independent of the 18-lesson course. Country facts (population, capital, official languages) come live from Wikidata (CC0); culture statements are sourced claims with visible confidence and provenance, never universal facts. Ausführliche Pipeline-Dokumentation: docs/MULTIDOMAIN_PIPELINE.md.

Datei · File Einträge · Entries Provenienz ⌀ · Provenance Konfidenz ⌀ · Confidence

Phonetik-Modul · Pronunciation module (Sagittalschnitt, IPA, Minimalpaare, separates Modul)

Aussprache-Trainer (studium/phonetik.html), unabhängig vom 19-Lektionen-Kurs — animierter Sagittalschnitt je Laut, IPA-Referenzaudio, Minimalpaare und (wo ein Kernwortschatz-Modul existiert) echte Wortaufnahmen. „Darstellung" zählt Laute mit eigener oder abgeleiteter Sagittal-Pose (Diphthong als Gleitbewegung, Sekundärartikulation über den Grundlaut); „davon unterscheidbar" nur die, deren Bild tatsächlich von der Ruhelage abweicht — bei Glottalen wie h/ʔ ist Gleichheit mit der Ruhelage anatomisch korrekt, keine Lücke. Wort-Audio zählt nur textgeprüfte Treffer (derselbe Abgleich wie beim Abspielen: eine Aufnahme zählt nur, wenn ihr eigener aufgenommener Text zum Wort passt) — ohne das wäre die Abdeckung zu hoch ausgewiesen, s. Methodik unten. certified:false gilt für alle Sprachen: die Lautinventare stammen aus belegten phonologischen Quellen (PHOIBLE u. a.), nicht aus muttersprachlicher Prüfung.
Pronunciation trainer, independent of the 18-lesson course — animated sagittal cross-section per phoneme, IPA reference audio, minimal pairs, and (where a core-vocabulary module exists) real word recordings. "Pose coverage" counts phonemes with their own or a derived sagittal pose; "distinct" only those whose drawing actually differs from rest position — glottals like h/ʔ correctly show no difference, that's not a gap. Word audio only counts text-verified matches. Every language is certified:false: inventories come from sourced phonological data, not native-speaker review.

Sprache · Language Stufe · Tier Laute · Phonemes Darstellung · Pose … davon unterscheidbar · … distinct IPA-Referenzaudio · IPA ref. audio Minimalpaare · Minimal pairs Artikulationshinweis · Articulation note Wort-Audio · Word audio

Sprachvergleich-Modul · Contrastive comparison module (Lautinventar- + Grammatikvergleich zweier frei wählbarer Sprachen, separates Modul)

Kontrastiver Aussprache- und Grammatikvergleich (studium/sprachvergleich.html) zwischen zwei frei wählbaren Sprachen — Kollisionswarnung nach dem Perceptual-Assimilation-Modell, Wahrnehmungs-Quiz mit Minimalpaaren, jeder Laut im Beispielwort einzeln anklickbar. Die Zahlen hier sind NICHT der Durchschnitt der einzelnen Sprachprofile (das steht oben beim Phonetik-Modul), sondern die Vereinigungsmenge aller distinkten Laute über alle Sprachen — die Größe, die für „kann ich mir jeden vorkommenden Laut anhören" zählt. „Segment-Audio" zählt nur das vorab aufgelöste Profil-Feld; „Chip-Audio wirksam" zählt zusätzlich, was zur Laufzeit aus Diakritikum-Basisformen (ɐ̯→ɐ) und Diphthong-Zerlegung (aɪ̯→a+ɪ) aus der sprachunabhängigen IPA-Audio-Bibliothek gefunden wird — nie ein anderer, ähnlich klingender Laut als Ersatz. Für den Rest gibt es keinen Fallback: der Laut bleibt stumm, statt eine Näherung als echte Aufnahme auszugeben.
Contrastive pronunciation and grammar comparison between two freely chosen languages — collision warnings based on the Perceptual Assimilation Model, a minimal-pair perception quiz, every phoneme in an example word individually clickable. The figures here are the UNION of distinct phonemes across all languages, not a per-language average (see Phonetics module above) — the number that actually matters for "can I hear every phoneme that occurs". "Segment audio" counts only the profile's pre-resolved field; "chip audio effective" additionally counts what's found at runtime via diacritic base forms and diphthong decomposition from the shared IPA audio library — never a different, similar-sounding phoneme as a substitute. No fallback exists for the remainder: it stays silent rather than presenting an approximation as a real recording.

Schriftzeichen lernen · Script learning module (Alphabet/Zeichen einer Schrift durchsuchen, nachzeichnen, testen — separates Modul von der Phonetik oben)

Alphabet-/Zeichen-Browser mit Nachzeichnen und Testabfrage (studium/scriptLearn.html) — ein Registry-Eintrag pro SCHRIFT (nicht pro Sprache), s. studium/data/scriptLearn/scriptLearnFlows.v1.json. Mehrere Sprachen mit demselben Schriftsystem teilen sich normalerweise denselben Eintrag — das ist kein Fehler. Entscheidend pro Sprache: existiert überhaupt ein Eintrag für ihr Skript ("fehlt komplett" wäre der schlimmste, sonst unsichtbare Fall), ist die Sprache selbst als sourceLanguage eingetragen ("dedicated", eigene Beispiele + Sprech-Knopf), teilt sie sich den Eintrag mit einer anderen Sprache, die eine Stimme hat ("geliehen, Sprech-Knopf funktioniert" — normal bei geteilten Schriften), oder ist der Eintrag der generische, unzertifizierte 173-Schriften-Katalog ganz ohne sourceLanguage ("geliehen, kein Sprech-Knopf" — die View blendet den Knopf dann bewusst aus, kein Bug, aber echte Stummschaltung).
Alphabet/character browser with tracing and quiz mode — one registry entry per SCRIPT, not per language; multiple languages sharing a script normally share one entry, which is expected. What matters per language: does an entry for its script exist at all ("missing" would be the worst, otherwise invisible case), is the language itself registered as sourceLanguage ("dedicated"), does it share the entry with another language that has a voice ("borrowed, speak works" — normal for shared scripts), or is the entry the generic, uncertified 173-script catalog with no sourceLanguage at all ("borrowed, no speak button" — the view deliberately hides the button then, not a bug, but a real silence).

Buchstaben-Aussprache · Letter-name audio (Sprache × Alphabet/Schrift × verwendete TTS-Stimme, studium/letterName/manifest.json)

Kuratierte Aufnahmen der ECHTEN, in der Schule gelehrten Buchstabennamen (nicht der bloße Laut) für jeden Buchstaben/jedes Zeichen einer Schrift — abgespielt beim Antippen einer Karteikarte in „Schriftzeichen lernen" (studium/scriptLearn.html), s. Abschnitt oben. Manche Schriften (v. a. Latein) haben MEHRERE Varianten, je eine eigene Stimme + eigene, landestypisch gelehrte Buchstabennamen (Latn = Deutsch, Latn-en = Englisch, Latn-fr = Französisch, …) — beim Lernen wird zuerst die zur gerade gewählten Lernsprache passende Variante versucht, erst danach die schriftweite Grundvariante als Rückfall. „Modus" unterscheidet zwei Aufnahme-Arten: own = eigener, kuratierter Buchstabenname (z. B. hebräisch א gesprochen als „Alef", nicht als bloßer Laut), bare = das reine Graphem in der nativen Stimme in Schul-Aussprache vorgelesen (typisch bei Silben-/Wortschriften ohne eigene „Buchstabennamen" wie Kantonesisch/Hanzi).
Curated recordings of the REAL, school-taught letter names (not the bare phoneme) for every letter/character of a script — played when tapping a flashcard in "Schriftzeichen lernen". Some scripts (mainly Latin) have MULTIPLE variants, each with its own voice and its own country-specific taught letter names — the variant matching the language currently being learned is tried first, falling back to the script-wide default. "Mode" distinguishes two recording types: own = a dedicated, curated letter name; bare = the bare grapheme read aloud in the native voice's school pronunciation (typical for syllable/word scripts without distinct "letter names", e.g. Cantonese/Hanzi).

Schrift-Code · Script code Sprache · Language TTS-Stimme · TTS voice Modus · Mode Buchstaben · Letters Abdeckung · Coverage

Sprach- und Skript-Genealogie · Language & script genealogy (Sprachfamilien-Baumpfade + Schrift-Paläografie, separates Modul)

Strukturierte Abstammungsdaten für linguistische/graphemische Vergleiche — Sprachfamilie als Baumpfad (Glottolog-belegt, studium/data/multidomain/reference/languageGenealogy.v1.json) und Schrift-Paläografie (einzeln recherchiert, keine Wiederverwendung der sprechnetz_designer_v6-Skriptgenealogie — die zeigte dieselben Warnsignale, die am 26.07.2026 bereits zur Entfernung von 1080 Kultur-Einträgen führten, s. docs/MULTIDOMAIN_PIPELINE.md Abschnitt 8m). „Editorial" = redaktionell verfasstes Profil mit echtem historischen/typologischem Kontext, „templated" = mechanisch aus der reinen Klassifikation erzeugter Kurzsatz (nur bei Sprachen außerhalb des Sprechnetz-Kursangebots). „Ohne Vorläufer" ist bei eigenständig erfundenen/unentzifferten Skripten (Hangul, Cherokee, Adlam, Linear A, Keilschrift …) das erwartete, korrekte Ergebnis, keine Lücke.
Structured ancestry data for linguistic/graphemic comparison — language family as a tree path (Glottolog-sourced) and script paleography (individually researched, deliberately not reusing the sprechnetz_designer_v6 script genealogy, which showed the same red flags that led to removing 1080 culture entries on 2026-07-26). "Editorial" = hand-written profile with real historical/typological context; "templated" = a sentence mechanically generated from the bare classification (only for languages outside the Sprechnetz course offering). "No parent" is the expected, correct result for independently invented/undeciphered scripts (Hangul, Cherokee, Adlam, Linear A, Cuneiform, …), not a gap.
→ Als interaktiver Stammbaum ansehen · view as an interactive family tree
→ Wörter aus der coreVocabulary phonetisch vergleichen · compare coreVocabulary words phonetically
→ Wortstellung, Morphologie & Grammatik vergleichen · compare word order, morphology & grammar
→ Orthographietiefe der Skripte vergleichen · compare orthographic depth of scripts
→ Noto-Schriftnamen per TTS anhören · listen to Noto font names via TTS

Sprachfamilie · Language family

Code Familie · Family Baumpfad · Tree path Konfidenz · Confidence Profil · Profile Kurssprache? · Course lang? Kreuzcheck · Cross-check

Skript-Paläografie · Script paleography

Code Name Typologie · Typology Vorläufer · Parent Konfidenz · Confidence Profil · Profile G2P Katalog · Catalog

Weitere Qualitätsberichte · Additional audit reports (Release/Contract/Performance/Punctuation/UI)

Einmalig oder bei Bedarf laufende Audits (nicht Teil der pro-Sprache-Übersicht oben), automatisch aus dem Dateibestand gelesen — jede Sektion erscheint nur, wenn der jeweilige Bericht existiert.
One-off or on-demand audits (not part of the per-language overview above), read automatically from disk — each section only appears if that report exists.