# Whisper Hotwords — handle with extreme care Whisper-Hotwords bias'en das ASR-Modell aggressiv. Ein Hotword, das in einem konkreten Fall hilft, kann in einem unverwandten Diktat dazu führen, dass das Modell den Begriff aus phonetischer Ähnlichkeit **halluziniert** (orthopädischer Befund schreibt plötzlich „Holosystolikum"). ## Bevorzugter Korrekturpfad `server/vocab/*.txt` (Gazetteer, edit-distance ≤ 2 mit Dict-Veto). Strukturell halluzinationsfrei, weil Korrekturen nur greifen, wenn Whisper bereits ein Token erzeugt hat, das phonetisch nah am Vocabulary-Eintrag liegt. ## Wenn überhaupt Hotwords - Nur generische Termini aus einem breiten Fall-Korpus - Nicht aus einem einzelnen Test-Fall heraus optimiert (Curve-Fitting) - Vor Aktivierung: Negativ-Kontrolle gegen Diktate aus mehreren Fachbereichen — sucht das Modell nach Halluzinationen, die nur durch den Hotword-Bias entstehen? ## Datei-Konvention Hotword-Files in diesem Verzeichnis enthalten **ausschließlich whitespace-separierte Termini** (kein Markdown, keine Kommentare), weil der gesamte File-Inhalt 1:1 als `hotwords`-Form-Field an die Whisper-API gesendet wird.