Blog
Bessere Spracherkennung im boostN-CLI: Audio-Normalisierung + flexibles Whisper-Modell
Warum diktierte Texte verschluckt wurden, wie SoX-Normalisierung und ein Modell-Switcher das Problem lösen — und was im Hintergrund wirklich passiert.
Sprach-KI in beide Richtungen — Spracherkennung/Transkription (STT) und Sprachsynthese (TTS), anbieterübergreifender Einsatzzweck, z. B. Whisper, Kokoro, ElevenLabs.
Warum diktierte Texte verschluckt wurden, wie SoX-Normalisierung und ein Modell-Switcher das Problem lösen — und was im Hintergrund wirklich passiert.